GPT-6 Astra의 험난했던 첫 주가 헤드라인을 장식했지만, 엔지니어링 팀에게 더 중요한 이야기는 OpenAI가 그 주변에 얼마나 많은 인프라를 출시했는가입니다. Agents API가 퍼블릭 베타로 진입하며 Codex 하네스를 관리형 서비스로 노출했습니다. Codex CLI 0.154.0은 터미널 도구를 git 워크트리를 갖춘 병렬 작업 시스템으로 탈바꿈시켰습니다. 품질 사후 분석은 Astra 출력을 저하시킨 세 가지 버그를 확인하고 전면적인 사용량 리셋을 촉발했습니다. 그리고 OpenAI는 용량 압박 속에서 ChatGPT Pro 신규 가입을 일시 중단했습니다.

이번 주의 분석입니다.

1. Astra 품질 사후 분석: 세 가지 버그, 한 번의 리셋

9월 11일 무렵, Astra가 출시 주보다 “더 나빠진 것 같다"는 개발자들의 불만과 나란히 비교한 영상들이 티핑 포인트에 도달했습니다. Codex/ChatGPT 리드인 Tibo Sottiaux는 9월 12일 사후 분석을 발표하며 세 가지 구체적인 문제를 확인했습니다:

  1. 레거시 스킬의 오작동 — 이전 모델용으로 작성된 스킬이 지나치게 공격적으로 트리거되거나 Astra가 자체 작업을 검증하는 것을 방해했습니다.
  2. 컨텍스트 관리 실험 버그 — 옵트인 실험으로 인해 조기 중단과 오래된 메시지에 대한 응답이 발생했습니다. 약 4,000~5,000명의 사용자가 영향을 받았습니다. 비활성화되었습니다.
  3. 잘못 구성된 서빙 엔진 — 제대로 조정되지 않은 엔진이 트래픽의 롱테일에 대해 품질을 저하시켰습니다. 제거되었습니다.

OpenAI는 9월 12일에서 13일로 넘어가는 자정에 Codex 및 Astra 사용자에게 전면적인 사용량 리셋을 발행했습니다. 아직 해결되지 않은 사항: xHigh 추론이 Medium보다 사용량을 덜 소모한다는 불만과, 출시 주보다 최대 4배 더 빡빡한 사용량 한도에 대한 보고입니다. ChatGPT Pro 신규 구독 또한 용량 제약으로 인해 일시 중단되었습니다.

엔지니어링 리드를 위한 시사점: 팀이 첫 48시간 내에 Astra를 도입하고 품질에 대한 의견을 형성했다면, 지금 재평가하십시오. 사후 분석의 수정 사항은 후속 일관성과 최신 메시지 추적을 실질적으로 변화시켰습니다.

2. Agents API: 관리형 서비스로서의 Codex 하네스

OpenAI는 9월 10일 Agents API를 퍼블릭 베타로 출시했습니다. 이것은 이름만 바꾼 Assistants API가 아닙니다. 내부적으로 Codex CLI와 ChatGPT를 구동하는 Codex 하네스 인프라 위에 구축된 완전히 새로운 서비스입니다.

OpenAI가 관리하는 것

세션, 오케스트레이션, 컨텍스트 압축, 충돌 복구, 서브에이전트 조정, 지연 도구 로딩, MCP 서버 연결. 사용자는 에이전트 정의(모델, 지침, 도구), 선택적 샌드박스 환경, 그리고 비즈니스 로직을 제공합니다.

샌드박스 옵션

  1. OpenAI 호스팅 샌드박스 — Codex와 ChatGPT를 뒷받침하는 동일한 인프라. 파일, 패키지, 스킬, 플러그인으로 구성 가능합니다.
  2. 셀프 호스팅 — 사용자 환경에서 codex exec-server를 실행합니다. 모든 연결은 아웃바운드 WebSocket입니다.
  3. 9개 파트너 샌드박스 — Blaxel, Cloudflare, Daytona, DigitalOcean, E2B, Modal, Oracle, Runloop, Vercel.

두 가지 엔터프라이즈 장벽

  • 베타 기간 중 미국 전용 데이터 레지던시. 데이터 레지던시 요구 사항이 있는 EU/영국 워크로드에는 확실한 장벽입니다.
  • 제로 데이터 보존(ZDR) 미지원 — 셀프 호스팅 샌드박스를 포함한 어떤 구성에서도 지원되지 않습니다. 보존 제한은 샌드박스가 아니라 API 계층에 있습니다. 컴퓨팅을 자체 VPC로 옮겨도 여전히 ZDR을 얻을 수 없습니다.

가격 책정은 간단합니다. Agents API에 대한 별도 요금은 없습니다. 표준 모델 토큰 요율, 호스팅 도구 호출 요율, 그리고 OpenAI 호스팅 샌드박스의 컨테이너 시간에 대해 지불합니다.

평가: Agents API는 이미 OpenAI의 모델 스택에 전념한 팀에게 프로토타입에서 프로덕션으로 가는 가장 빠른 경로입니다. 도구 실행이 비특권 샌드박스에서 실행되는 동안 오케스트레이션은 특권 상태로 유지되는 하네스/컴퓨팅 분리는 아키텍처적으로 건전합니다. 그러나 미국 전용 레지던시와 ZDR 미지원은 엄격한 컴플라이언스 태세를 가진 엔터프라이즈가 이를 글로벌 프로덕션 플랫폼이 아닌 미국 지역 베타로 취급해야 함을 의미합니다.

3. Codex CLI 0.154.0: 병렬 워크트리와 인라인 Q&A

이번 주의 대표 CLI 릴리스는 9월 9일에 출시되었으며, 팀이 Codex 세션을 다루는 방식을 바꾸는 두 가지 기능을 담고 있습니다.

Git 워크트리

--worktree 또는 /worktree는 새 세션이나 포크된 세션을 위한 격리된 git 체크아웃을 생성합니다. 병렬 작업이 더 이상 단일 작업 디렉터리에서 충돌하지 않습니다. package.json을 수정하는 세션은 같은 저장소에서 테스트를 실행하는 다른 세션과 충돌하지 않습니다. 워크트리 세션은 독립적으로 탐색하고 재개할 수 있습니다.

인라인 Q&A

이제 Codex는 작업을 계속하는 동안 질문(제안된 선택지 또는 사용자 지정 텍스트)에 답할 수 있습니다. 이전에는 명확화를 위한 프롬프트가 전체 세션을 차단했습니다. 이제 에이전트는 사용자가 자신의 일정에 맞춰 응답하는 동안 계속 실행됩니다.

기타 주목할 만한 추가 사항

  • Windows 공유 백그라운드 서버 — 데몬 수명 주기 명령과 관리형 업데이트 포함.
  • MCP OAuth 처리 — 연결이 토큰 갱신을 조정하고 갱신 실패 시 로그인 챌린지를 표시합니다.
  • 시작 신뢰 강화 — 워크스페이스가 제어하는 헬퍼가 신뢰가 설정되기 전에 실행되지 않습니다.
  • macOS 터미널 주입 보호 — 샌드박스가 터미널 입력 주입 공격을 차단합니다.
  • 플러그인 새로 고침 — 기존 세션이 재시작 없이 새로 설치된 플러그인 도구를 인식합니다.

더 이상 사용되지 않는 codex mcp-server 진입점(stdio를 통해 Codex를 MCP 서버로 실행)은 0.154.0에서 더 이상 사용할 수 없습니다. 해당 통합을 사용하는 팀은 마이그레이션해야 합니다.

4. API 속 GPT-Live-1: 분당 $0.05의 음성

OpenAI의 전이중(full-duplex) 음성-대-음성 모델이 9월 10일 API에 진입했습니다. GPT-Live-1은 자연스러운 발화 교대와 끼어들기를 통해 동시에 듣고 말합니다. 아키텍처는 음성 계층을 백엔드 추론과 분리합니다. GPT-Live-1이 음성을 처리하고 더 깊은 작업을 모든 백엔드 텍스트 모델(Astra, GPT-5.6 Luna, 또는 서드파티)에 위임합니다.

가격 책정은 Realtime 모델과 구조적으로 다릅니다. 음성 계층에 분당 $0.05이며 초 단위로 청구되고, 백엔드 모델에 대해서는 표준 API 요율이 추가됩니다. 참고로, gpt-realtime-2.1은 백만 오디오 입력 토큰당 $32, 백만 오디오 출력 토큰당 $64를 청구합니다. 일반적인 음성 밀도에서 GPT-Live-1은 음성 계층만 놓고 보면 대략 한 자릿수 배 더 저렴합니다.

동시성은 25개 세션(Tier 1)에서 500개(Tier 5)까지입니다. 무료 티어는 없습니다.

5. ChatGPT Images 2.5와 Data Agent

내부 도구를 만드는 엔지니어링 팀이 주목할 만한 두 가지 제품 릴리스:

ChatGPT Images 2.5(9월 8일)는 시각적 참조를 인라인으로 그리는 Sketch 도구, 대상 이미지 수정을 위한 댓글 기반 편집, 그리고 Images 2.0 대비 50% 낮은 지연 시간과 함께 출시되었습니다. 두 가지 API 모델 — Flare(기본, 빠름)와 Sunburst(프리미엄, 정밀) — 는 GPT-Image-2 요율의 2배로 책정되었습니다. SynthID 워터마킹이 ChatGPT, Codex, API 전반에 추가되었습니다.

Data Agent for ChatGPT Work(9월 10일)는 Snowflake, BigQuery, Redshift, Databricks, ClickHouse, MongoDB, Datadog에 연결하며, 기존 Power BI, Tableau, Sigma 대시보드도 읽습니다. 자연어로 비즈니스 질문에 답하고, 지표가 왜 변했는지 조사하며, 승인 워크플로를 갖춘 대화형 대시보드를 구축합니다.

6. 경쟁 구도: Anthropic의 매출 우위 확대

이번 주 경쟁 데이터는 봄부터 쌓여온 내러티브를 강화했습니다:

  • Anthropic 2026년 2분기 매출: $11.6B vs OpenAI $6.7B
  • Anthropic 연간 환산 매출(run rate): $65B vs OpenAI $40B+
  • 신규 엔터프라이즈 조달: Anthropic 65%, OpenAI 32%
  • Anthropic 비상장 기업가치: $965B vs OpenAI $852B

OpenAI는 여전히 총 사용자 규모(주간 활성 사용자 9억+ , 유료 구독자 5천만+)와 최상위 벤치마크 순위에서 앞서 있습니다. 그러나 조달 모멘텀은 이동했습니다. 플랫폼을 평가하는 팀에게 실질적인 함의는 OpenAI가 더 이상 기본 엔터프라이즈 선택이 아니라는 것입니다. 그것은 둘 중 하나이며, 결정은 브랜드보다 특정 워크로드 특성에 점점 더 의존합니다.

다음 주 전망

OpenAI DevDay 2026은 9월 29일 샌프란시스코에서 예정되어 있습니다. Agents API 업데이트, ZDR 또는 국제 레지던시의 GA 시점 가능성, 그리고 모델 로드맵 세부 사항이 예상됩니다. 오늘 Agents API 위에 구축하는 팀에게 미국 전용 및 ZDR 미지원 제약은 주시해야 할 핵심 항목입니다.

매일 Codex 업데이트를 보려면 https://x.com/kkaminsk 를 팔로우하세요. Codex 위클리 시리즈는 매주 월요일 발행됩니다.