GPT-5.6 출시 후의 먼지가 가라앉고 있으며, 이번 주 초점은 파괴적 자율성에서 플랫폼 통합으로 이동했습니다. OpenAI는 Codex CLI v0.145.0을 출시했습니다. 이는 ChatGPT 데스크톱 통합 이후 가장 큰 기능 릴리스로, 안정화된 멀티에이전트 협업, 크로스 툴 마이그레이션 임포터, 오디오 입력을 제공합니다. Codex 브랜드를 포함한 15개의 레거시 모델 스냅샷이 7월 23일 예정대로 종료되었습니다. ChatGPT Work는 중소기업 프로그램을 시작했습니다. 그리고 Google의 Gemini 3.5 Pro는 세 번째 출시 마감일을 놓쳤고, 대신 Gemini 3.6 Flash를 임시 방편으로 출시했습니다.

OpenAI의 모델, Codex 생태계, 그리고 더 넓은 경쟁 환경에서 이번 주 중요한 내용을 분석합니다.

1. Codex CLI v0.145.0 — 멀티에이전트 V2, 마이그레이션, 오디오

7월 21일 릴리스는 v0.144.0이 Codex를 ChatGPT 데스크톱 앱에 통합한 이후 가장 기능이 풍부한 업데이트입니다. 에이전트 협업, 도구 마이그레이션, 입력 양식의 세 영역에서 동시에 강화되었습니다.

멀티에이전트 V2 안정화. 옵트인 멀티에이전트 경험이 프리뷰에서 안정 버전으로 승격되었습니다. 루트 세션은 이제 spawn_agent, send_input, resume_agent, wait_agent, close_agent를 사용하여 구성 가능한 서브에이전트를 생성할 수 있습니다. 각 서브에이전트는 자체 모델, 추론 수준, 동시성 제한, 샌드박스 프로파일을 가집니다. 역할과 네비게이션이 이전 프리뷰에서 복원되었으며, 구현은 안정 버전으로 분류되었지만 기본적으로는 여전히 비활성화되어 있습니다. 엔지니어링 팀에게 이는 단일 Codex 세션에서 서로 다른 모델 계층 간에 작업을 병렬화할 수 있음을 의미합니다. Sol로 계획, Luna로 기계적 편집을 수행하고 외부 오케스트레이션 없이 실행할 수 있습니다.

/import가 Cursor와 Claude Code로 확장. Codex는 이제 Cursor와 Claude Code 양쪽에서 설정, MCP 서버, 플러그인, 세션, 명령, 프로젝트 범위 메모리를 감지하고 마이그레이션할 수 있습니다. 플러그인 명령은 임포트 중에 Codex 스킬로 변환됩니다. 마이그레이션은 단방향입니다. Codex에서의 변경 사항은 원본에 다시 기록되지 않으며, Claude Code의 채팅 대화는 포함되지 않고 에이전트 구성과 최근 세션만 마이그레이션됩니다. 임포터는 TUI에서 로컬로 실행되고 원격 세션을 거부하며, 세션 임포트를 30일 내에 변경된 50개 세션으로 제한합니다. Codex로의 전환을 평가하는 팀에게 전환 비용을 크게 줄여줍니다.

실험적 페이지네이션 스레드 히스토리. 스레드 히스토리가 효율적인 재개, 검색, 영구화된 이름, 서브에이전트 히스토리, 메모리 통합을 지원합니다. 이는 오랜 문제를 해결합니다. 긴 대화는 재로딩이 비싸고 검색이 불가능했습니다. 이 기능은 실험적으로 표시됩니다.

오디오 입력 및 스트리밍 실시간 V3. 로컬 오디오 형식을 입력으로 사용할 수 있으며, 도구 출력에 오디오를 포함할 수 있습니다. 스트리밍 실시간 V3 대화가 도입되었지만, 태그된 레지스트리에서는 여전히 개발 단계입니다.

Amazon Bedrock 로그인 (실험적). 커스텀 엔드포인트 및 인증 지원이 추가되었으며, GPT-5.6 Sol이 기본 Bedrock 모델로 설정되었습니다. 이를 통해 AWS 네이티브 팀은 OpenAI API를 직접 거치지 않고 Codex를 사용할 수 있는 퍼스트클래스 경로를 얻었습니다.

신뢰성 개선. 이전 프롬프트 편집이나 안전 버퍼된 턴 재시도가 원래 대화를 변경하는 대신 적절한 컨텍스트 브랜치를 생성합니다. Windows 샌드박스는 네이티브 exec-server 지원과 올바르게 인용된 훅 명령을 얻었습니다. MCP 시작업 데드라인이 클라이언트 생성을 커버하고, OAuth 디스커버리가 시작업을 차단하지 않으며, 리프레시가 직렬화되었습니다.

2. 15개 모델 retiring — 모든 Codex 스냅샷 포함

7월 23일, OpenAI는 단일 배치로 15개 모델 스냅샷을 종료했습니다. 가장 중요한 것은 모든 Codex 브랜드 API 모델이 이제 retiring되었다는 점입니다.

retiring된 Codex 모델: gpt-5-codex, gpt-5.1-codex, gpt-5.1-codex-max, gpt-5.1-codex-mini, gpt-5.2-codex는 모두 gpt-5.5(mini 변형은 gpt-5.4-mini)로 매핑됩니다. 프로덕션 코드가 이러한 엔드포인트를 호출 중이라면 요청이 즉시 실패합니다.

retiring된 채팅 모델: gpt-5-chat-latestgpt-5.1-chat-latest는 모두 gpt-5.5로 통합됩니다.

컴퓨터 사용 및 검색: computer-use-preview-2025-03-11gpt-5.4-mini로 이동합니다. 검색 프리뷰 모델(gpt-4o-search-preview, gpt-4o-mini-search-preview)도 gpt-5.4-mini로 매핑됩니다.

딥 리서치: o3-deep-researcho4-mini-deep-research는 모두 gpt-5.5-pro로 통합되며, 백만 토큰당 $30 입력 / $180 출력으로 제공됩니다. 자동화된 리서치 파이프라인에 실질적인 비용 증가입니다.

오디오: gpt-4o-mini-tts-2025-03-20gpt-4o-mini-tts-2025-12-15로 이동하고, gpt-audio-mini-2025-10-06gpt-audio-1.5로 매핑됩니다.

엔지니어링 팀 액션 아이템: 코드베이스를 감사하여 retiring된 목록의 하드코딩된 모델 ID를 확인하세요. API 호출을 권장 대체 모델로 업데이트하세요. 특히 딥 리서치 파이프라인에 주의하세요. o3-deep-research에서 gpt-5.5-pro로의 비용 점프는 출력 기준 약 6배입니다. 다음 retiring 배치는 10월 23일에 진행되며, GPT-3.5, GPT-4, GPT-4 Turbo, GPT-4.1 Nano, GPT-4o 및 여러 o 시리즈 모델을 포함합니다.

3. ChatGPT Work — 중소기업 프로그램 및 엔터프라이즈 성숙도

ChatGPT for Small Business (7월 21일). OpenAI는 ChatGPT Work를 중심으로 구축된 종합 중소기업 프로그램을 시작했습니다. 회계, 마케팅, 전자상거래 워크플로우를 위한 실무 가상 트레이닝 웨비나, OpenAI Academy 팀을 통한 전 미국 대면 AI 아카데미, ChatGPT Work에 직접 업로드할 수 있는 인터랙티브 가이드, Dropbox, Shopify, Intuit, Slack, Atlassian, Wix와의 파트너 통합이 포함됩니다. 5개의 무료 라이브 세션이 7월 30일부터 8월 27일까지 예정되어 있습니다. ChatGPT Work는 GPT-5.6으로 구동되며 모든 구독 플랜에서 이용 가능합니다. 엔터프라이즈 계층에 고정되지 않습니다. 플랫폼은 약 1,000만 ChatGPT Work 및 Codex 합산 사용자에 도달했습니다.

엔터프라이즈 거버넌스 업데이트. ChatGPT Enterprise 및 Edu 워크스페이스는 Global Admin Console에서 크레딧 사용 분석 및 업데이트된 지출 컨트롤을 얻었습니다. 워크스페이스 에이전트는 7월 6일 토큰 기반 가격 책정으로 전환했습니다. 크레딧 소비는 이제 고정 비용이 아닌 입력 토큰, 캐시된 입력 토큰, 출력 토큰을 기반으로 합니다. ChatGPT for PowerPoint는 Business 워크스페이스에서 일반 가용성에 도달했으며, Enterprise 고객의 토큰 기반 가격은 8월 6일 이후에 적용됩니다.

서비스 계정 API 키 관리. Go SDK v3.44.0(7월 18일)은 /organization/projects/{project_id}/service_accounts/{service_account_id}/api_keys 엔드포인트를 통해 서비스 계정 API 키의 프로그래밍 관리를 추가했습니다. Admin 키는 표준 API 키와 다르며 조직 관리로 범위가 제한되고, 워크스페이스 소유자 및 관리자가 도구를 ChatGPT 및 Codex 관리 API에 연결하는 데 사용할 수 있습니다. 역할 기반 권한(All, Read only, Restricted)을 가집니다.

데스크톱 채팅/워크 분리. ChatGPT 데스크톱 앱은 7월 16일 채팅과 워크 모드 간의 글로벌 전환기를 추가했습니다. 워크 대화는 웹, 모바일, 데스크톱 간에 동기화됩니다. 커스텀 명령어 제한이 Plus, Enterprise, Business, Education 사용자의 경우 1,500자에서 5,000자로 증가했습니다.

4. Assistants API — 남은 33일

8월 26일 종료까지 33일 남았습니다. 새로운 마이그레이션 도구는 출시되지 않았습니다. 권장되는 7월 중순 내부 마감일이 지났습니다.

중요한 알림: 자동화된 마이그레이션 도구가 없으며 출시 예정도 없습니다. Thread 내보내기가 없습니다. 지금 대화 기록을 추출하세요. 마이그레이션 중 사일런트 실패가 일반적입니다. 200 OK 응답에서 컨텍스트 손실, 빈 그라운딩, 스트리밍 중단 등. Responses API는 딥 리서치, MCP 도구 연결, 컴퓨터 사용을 포함한 완전한 기능 패리티에 도달했습니다. Azure OpenAI도 동일한 타임라인을 따릅니다. Zapier는 Assistants API를 사용하는 모든 ChatGPT 단계를 더 이상 사용하지 않으며, 이러한 워크플로는 8월 26일에 중지됩니다.

여전히 Assistants API를 사용하는 팀: 이것을 P0 마이그레이션으로 취급하세요. 모든 beta.assistants, beta.threads, beta.threads.runs 호출을 인벤토리화하세요. threads를 Conversations로, runs를 Responses로 매핑하세요. 스트리밍, 백그라운드 작업, 재시도, 취소에 대한 회귀 테스트를 구축하세요. 프로덕션 트래픽을 전환하기 전에 부작용을 억제한 섀도우 컷오버를 실행하세요.

5. 경쟁 환경 — Google 지체, xAI 오픈소스

Google — Gemini 3.5 Pro 세 번째 마감일 놓침

Gemini 3.5 Pro가 출시되지 않았습니다. Sundar Pichai가 Google I/O에서 6월 공개를 공개적으로 약속한 모델이 이제 세 개의 마감일을 놓쳤습니다. 원래 6월 윈도우, 7월 17일 목표, 7월 중순 수정 견적입니다. Google 공식 모델 카탈로그에는 여전히 Gemini 3.5 Pro가 나열되지 않습니다. Pro 계층은 Gemini 3.1 Pro(프리뷰)와 Gemini 2.5 Pro(안정 버전)로 남아 있습니다.

Bloomberg는 내부 코딩 벤치마크가 목표에 미달하고 주요 연구자가 이탈했다고 보도합니다. Google의 유일한 공식 성명은 “Gemini 3.5 Pro는 현재 파트너와 테스트 중이며, 준비되는 대로 광범위하게 제공할 예정입니다"입니다. 날짜, 벤치마크, 가격 정보가 없습니다.

대신 출시된 것: Gemini 3.6 Flash와 Gemini 3.5 Flash-Lite가 7월 21일 일반 가용성으로 출시되었습니다. Gemini 3.6 Flash는 백만 토큰당 $1.50/$7.50로 책정되었고, 2026년 3월 지식 컷오프, Google AI Studio, Android Studio, Google Antigravity, GitHub Copilot, Gemini 앱에서 사용 가능합니다. 특수 Gemini 3.5 Flash Cyber 취약점 탐지 모델은 제한된 파일럿 단계입니다.

xAI — Grok Build 데이터 논란 후 오픈소스화

xAI는 7월 15일 Apache 2.0 하에 Grok Build를 오픈소스화했습니다. 에이전트 루프, 도구 구현, 터미널 UI, 확장 시스템을 포괄하는 130만 줄 Rust 코드베이스입니다. 이 릴리스는 데이터 유출 논란이 촉발이 되었습니다. 사용자들은 grok CLI가 기본적으로 SSH 키와 비밀번호 관리자 데이터베이스를 포함한 전체 디렉토리를 xAI의 Google Cloud 버킷에 업로드하고 있음을 발견했습니다. xAI는 업로드 동작을 비활성화하고 보유된 데이터를 삭제했으며 신뢰를 회복하기 위해 전체 소스 코드를 공개했습니다.

개발자에게 의미하는 바: Grok Build는 완전히 오픈소스이고 공개 와이어 프로토콜(Agent Client Protocol)을 가진 유일한 주요 코딩 에이전트 하네스입니다. MCP 서버, 스킬, 플러그인, 훅을 지원하며 기존 Claude Code MCP 설정을 그대로 재사용할 수 있습니다. 하지만 외부 기여는 받아들여지지 않습니다. 이는 소스 투명성 릴리스이지 커뮤니티 프로젝트가 아닙니다. 기본 모델인 Grok 4.5는 백만 토큰당 $2/$6로 책정되어 Opus 4.8이나 GPT-5.6 Sol보다 훨씬 저렴합니다.

Anthropic — Claude Code 가속

Claude Code는 7월 21일 v2.1.217을 출시하며 Codex의 릴리스 속도를 유지하고 있습니다. 최근 하이라이트에는 /fork 백그라운드 세션 클론, 웹 검색 및 서브에이전트 세션 수준 캡(각 200), 장시간 호출에 대한 MCP 자동 백그라운딩, 페일 클로즈드 동작의 권한 분석기 전면 개선이 포함됩니다. Claude Sonnet 5는 여전히 기본 모델이며 1M 토큰 컨텍스트 윈도우를 가지고 8월 31일까지 백만 토큰당 $2/$10로 제공됩니다. Fable 5 액세스는 Pro 사용자를 위한 사용량 기반 청구로 전환했습니다. 이는 최상위 모델에 대한 소비 기반 가격 책정으로의 업계 전반의 움직임을 나타내는 신호입니다.

오픈 웨이트 생태계

DeepSeek V4는 백만 토큰당 $0.07의 캐시 히트 입력 가격을 계속 제공합니다. Moonshot AI의 Kimi K3는 여전히 2+ 조 매개변수 오픈 모델입니다. 프론티어 독점 모델과 오픈 웨이트 대안 사이의 격차가 여러 코딩 평가에서 한 자릿수 벤치마크 차이로 좁아졌습니다. 자체 호스팅 시나리오의 경우 이러한 모델은 평가할 가치가 있습니다.

결론

이번 주는 위기 관리에서 플랫폼 구축으로의 전환을 나타냅니다. Codex CLI v0.145.0의 멀티에이전트 안정화와 크로스 툴 마이그레이션 임포터는 OpenAI가 플랫폼에 통합하는 팀의 마찰을 줄이는 데 집중하고 있음을 보여줍니다. 모델 retiring은 필요한 정리 작업이지만, 15개의 더 이상 사용되지 않는 스냅샷 중 하나를 실행 중인 팀은 어제 마이그레이션했어야 합니다.

엔지니어링 리더를 위한 이번 주 3가지 행동 사항: 첫째, API 호출을 retiring된 모델 목록에 대해 감사하고 권장 대체로 업데이트하세요. 특히 Codex 브랜드 모델이나 o3-deep-research를 실행 중인 경우 중요합니다. 둘째, Assistants API 마이그레이션을 아직 시작하지 않았다면 지금 시작하세요. 적절한 테스트를 포함한 프로덕션 컷오버에는 33일이 충분하지 않습니다. 셋째, Codex CLI v0.145.0의 /import를 평가하여 Codex, Claude Code, Cursor 간의 전환 비용을 평가하세요. 멀티에이전트 V2 기능과 Bedrock 지원이 팀 아키텍처에 대한 판단을 바꿀 수 있습니다.

경쟁 환경은 진정한 대안을 만들어내고 있습니다. Grok Build의 오픈소스 하네스, Claude Sonnet 5의 가치 가격 책정, DeepSeek와 Moonshot의 오픈 웨이트 프론티어 모델은 모두 평가할 가치가 있습니다. Gemini 3.5 Pro에 대한 Google의 지속적인 어려움은 모든 랩이 이 속도를 유지할 수 있는 것은 아니라는 점을 상기시킵니다.

X에서 대화를 팔로우하세요.