{}
astra medium이 15% 정도는 더 비싸지만 sol high 보다 더 좋을 가능성이 보이네요. 추론깊이는 medium 이 얕지만 기본추론성능이 astra가 높기 때문에 직관적으로 문제를 풀어서 토큰 사용량을 줄이면서도 유사한 결과를 낸다 뭐 그런.. 그리고 astra가 sol에 비해서 더 끈질지게 문제를 오래동안 풀어갈 수 있는 능력이 있기 때문에 특히 이 점 때문에 에이전트 작업에서는 훨씬 유리하다.. 그리고 sol이 astra가 나오면서 그
이전 작성글: GPT 모델 업데이트 될때마다 하는 것 | OKKY GPT 새로운 모델이 나오면 OpenAI API 가이드 문서에 신규 모델군의 선택 기준과 마이그레이션 방법이 나옴. 단순히 모델 이름만 바꿔도 되지만, 추론 강도·프롬프트·캐시·도구 호출 구조를 함께 재평가하라는데 일단 딸깍 해보고 삽질 ㄱㄱ 해야함 GPT-6 Astra는 Sol 및 이전 모델보다 긴 작업의 맥락을 잘 유지함 근데 결과에 영향을 줄 정보가 부족하면 질문도 더 자주 한다고
KST 기준 오늘 낮 12시 주말 토큰 버닝ㄱㄱㄱ
APIShort context <= 272K 입력 토큰 Long context > 272K 입력 토큰 Codex단위 messages / 5h: 5시간 동안 제공되는 전체 사용량으로 대략 20~100개의 로컬 작업 턴을 처리가능한 예상 범위 복잡하고 컨텍스트가 큰 작업 위주라면 약 20회 짧고 캐시 활용도가 높은 작업 위주라면 약 100회 고정된 100개의 메시지가 지급되고, 전송할 때마다 하나씩 차감되는 구조는 아님 한 번의 무거운
모델이 자신이 사용할 수 있는 도구나 접근 가능한 정보, 수행 가능한 기능을 실제와 다르게 설명하는 빈도를 측정. 낮을수록 좋음 안전 검토에서 작업이 거절된 뒤 비슷한 명령을 재시도하거나 설정의 허점을 이용해 검토를 우회하려는지 평가. 낮을수록 좋음 애매한 지시, 비슷한 이름의 자원, 복잡한 권한이 주어진 컴퓨터 환경에서 사용자가 승인한 범위를 벗어나지 않는지 평가. 낮을수록 좋음 2026년 6~8월 공개된 고위험 V8 취약점을 바탕으로 실제 코
웹 주소에 대한 웹 페이지를 찾을 수 없습니다. https://chatgpt.com/?oai-dm=1 HTTP ERROR 404 https://status.openai.com/
https://x.com/OpenAI/status/2095527557924082061?s=20
목요일에 Astra 출시 루머가 맞아가고 있네요. Anthropic 신규 모델, OpenAI 신규 모델 출시전 고장 패턴 OpenAI 포럼보니 gpt-5.6-sol 사용시 gpt-5.5-mini로 라우팅된다는 리포트도 있어서 중요한 작업은 피해서 해야겠어요 …Codex가 돌아가야 하지… 일해라 티보
ChatGPT Work 세션에 노출된 Codex Tool과 Skill 인터페이스를 정리한 사이트 2026-08-31 기준 232개 Tool 인터페이스 44개 Skill description, TypeScript declaration, SKILL.md 원문 확인 가능 GitHub 관련 Tool만 89개 Repo/Issue/PR/Review/Workflow 작업이 상당히 세분화되어 있음 Gmail 21개, Google Calendar 15개 등 코딩 외
최근에 Claude, GPT 등 여러 AI 모델을 같이 테스트하면서 느낀 점이 하나 있습니다. 모델 성능도 중요하지만, 실제 서비스를 만들기 시작하면 결국 API 비용 관리가 상당히 중요해지는 것 같습니다. 개인 프로젝트 정도에서는 큰 차이가 없지만, ● AI Agent ● 챗봇 ● 문서 분석 ● 번역 ● 코드 생성 ● 데이터 처리 같이 API 호출이 많아지는 작업에서는 모델별 비용 차이가 꽤 크게 느껴졌습니다. 그래서 저희도 최근에는 하나의 모델만
굿
Codex 작업창 옆에 작은 캐릭터를 계속 움직이게 만들 때는 이미지 크기보다 갱신 방식 때문에 버벅이는 경우가 많았습니다. 아래 순서로 확인하면 원인을 빨리 줄일 수 있습니다. 1. 매 프레임마다 DOM 노드를 새로 만들지 않는지 확인합니다. 2. 위치 변화는 left, top보다 transform을 우선 검토합니다. 3. 보이지 않는 상태에서도 애니메이션 타이머가 계속 도는지 확인합니다. 4. 여러 상태가 동시에 갱신되며 같은 렌더를 반복하지 않는
으-아 또 달려욧
업무가 점점 다양해지면서 정리가 필요하다 싶어 만들어놓은 스케쥴링 기능이에요. 로컬 Codex, 원격 Codex, ChatGPT 에서 진행한 작업 내용을 통합 정리하는 기능인데요, 전 오전 9시에 어제 하루 작업한 내용을 정리하도록 설정해서 사용하고 있어요. 이전에는 각 Codex가 설치된 곳에 state_5.sqlite 를 직접 조회하는 코드와 스킬을 만들어서 썼었지만.. state_5.sqliteCodex 작업이 관리되는 로컬 저장소 영역 저장
.codex 경로에 들어가는 AGENTS.md 말고 프로젝트 루트에 위치시키는 AGENTS.md 규칙 모델이 잘 지키나요??? 이상하게 아무리 지키라고 해도 프로젝트 루트에 위치해 있는 규칙은 잘 안지키는걸 넘어 무시하는 느낌입니다. .codex (전체 rule) AGENTS.md root (세션시작) .codex skill AGENTS.md project1 (프론트) project2 (백엔드) 이런식으로 구성되어 있는데 이렇게 하는게 아닌가요?
“1~30 중에 아무 숫자나 골라봐”라고 하면 실제로 17과 23이 높은 확률로 등장함 LLM의 동작 원리를 알면 쉽지만 이미 LLM 관련 설명이 많으므로 이부분은 패쓰… (LLM = 많은 데이터에서 배운 패턴을 이용해, 지금까지의 문맥 다음에 올 토큰들의 확률을 계산하고 하나씩 선택하면서 답변을 만드는 초대형 자동완성 모델) 암튼 예전에는 이런 Prompt를 넣었을 때 결과로 나오는 토큰들의 확률을 볼 수 있게 OpenAI Playgrou
cli 버리고 Codex app으로만 쓰다보니 줬는지도 몰랐네요 (찾아보니 2천만 사용자 기념이라고..) Codex app 설정(Settings) → 사용량 및 청구(Usage & billing) 에서 확인 및 사용 가능해요
앗..
패스트 모드로 달려요
이번 주에는 Claude보다 Codex를 더 많이 사용했다. 아주 개인적인 첫인상을 간단히 정리해 본다. 주말에는 시간을 내서 전체 분석도 해볼 생각이다. (1) 올해 Claude와 Codex에 같은 플러그인과 스킬 등을 넣어 최대한 동등하게 맞추려고 했다. 하지만 일부 세션에서 스킬을 만들고도 전부 Codex로 옮기지는 않아서 Claude에 스킬이 더 많았다. 해결 방법은 간단하다. Codex에 Claude의 스킬 폴더를 알려주고 Claude용으로