이번 주는 OpenAI가 모델 액세스만 판매하는 회사에서 컨설팅 규모로 엔터프라이즈 성과를 판매하는 회사로 전환한 한 주였습니다. GPT-5.1-Codex-Max가 모든 Codex 표면에서 기본 모델이 되었습니다 — 여러 창에 걸쳐 자체 컨텍스트를 압축하도록 네이티브하게 훈련된 최초의 모델로, 수 시간에 걸친 작업을 처리합니다. IBM은 수천 명의 인증 컨설턴트를 보유한 전용 OpenAI Practice를 출범시켰고, OpenAI의 엔터프라이즈 매출은 공식적으로 소비자 매출을 추월했습니다. 한편 사이버보안 스토리는 더욱 격화되었습니다. GPT-5.6-Cyber가 확장된 Daybreak 프로그램을 통해 승인된 연구자들에게 제공되었고, 미공개 모델 Astra는 OpenAI 모델 최초로 Preparedness Framework의 “Critical” 임계값에 접근했습니다.

그리고 폐지(Deprecation) 시계는 계속 흘러가고 있습니다. gpt-5.2-chat-latestgpt-5.3-chat-latest는 8월 10일 API에서 제거되었습니다. Assistants API는 12일 후인 8월 26일에 종료됩니다. o3도 같은 날 ChatGPT에서 제외되며, DALL·E GPT는 8월 30일에 뒤따릅니다.

다음은 Codex CLI, 모델 레이어, 엔터프라이즈 추진, 보안 환경에 걸친 이번 주 분석입니다.

1. GPT-5.1-Codex-Max — 장기 작업을 위해 설계된 새로운 기본 모델

8월 11일, OpenAI는 GPT-5.1-Codex-Max가 Codex 표면(CLI, IDE 확장, 클라우드, 코드 리뷰)에서 기본 모델로 GPT-5.1-Codex를 대체했다고 발표했습니다.

이번 아키텍처 혁신의 핵심은 압축(compaction)입니다. GPT-5.1-Codex-Max는 여러 컨텍스트 창에 걸쳐 작동하도록 네이티브하게 훈련된 최초의 모델입니다. 컨텍스트 한도에 가까워지면 핵심 결정, 수정한 파일, 오류, 명령, 테스트 결과, 구현 방향을 보존하면서 덜 중요한 이력을 자동으로 정리한 뒤 새 창에서 이어갑니다. 이 과정은 작업이 완료될 때까지 반복되며, 단일 작업에서 수백만 토큰에 달하는 프로젝트 규모의 리팩터링, 심층 디버깅 세션, 일관된 작업이 가능해집니다.

사양
모델 IDgpt-5.1-codex-max
컨텍스트 창400,000 토큰
최대 출력128,000 토큰
입력 / 출력텍스트 + 이미지 / 텍스트
APIResponses API 전용
가격입력 $1.25/M, 캐시 $0.125/M, 출력 $10.00/M

벤치마크 개선도 상당합니다:

벤치마크GPT-5.1-Codex (high)GPT-5.1-Codex-Max (xhigh)
SWE-bench Verified (n=500)73.7%77.9%
SWE-Lancer IC SWE66.3%79.9%
Terminal-Bench 2.052.8%58.1%

새로운 Extra High(xhigh) 추론 티어는 지연 시간에 민감하지 않은 작업을 대상으로 하며, medium 노력 수준에서 Max 모델은 이전 기본 모델을 능가하면서도 사고 토큰을 30% 덜 사용합니다. GPT-5.1-Codex-Max는 Windows 환경에서 작동하도록 네이티브하게 훈련된 최초의 OpenAI 모델이기도 합니다 — 혼합 OS 개발자 기반을 둔 모든 엔터프라이즈에 직접적으로 관련된 사항입니다.

중요한 주의 사항 하나: 이 모델은 일반 목적의 채팅이 아니라 Codex 또는 Codex 유사 환경에서의 에이전틱 코딩에만 권장됩니다. 실제 소프트웨어 엔지니어링 작업(PR 생성, 코드 리뷰, 프런트엔드 코딩, Q&A)으로 훈련되었으며, 특히 Codex CLI 내부에서 협업하도록 설계되었습니다.

2. Codex CLI v0.148.0-alpha.5 — 내보내기, 포크, 아카이브

CLI는 계속해서 엄청난 속도를 내고 있습니다: 릴리스 간격 약 2.2일, 지난 한 달간 14개 릴리스, 2026년 누적 73개 추적. 8월 8일, v0.148.0-alpha.5가 세 가지 워크플로 추가와 함께 출시되었습니다:

  • /export — 전체 대화를 구조화된 Markdown으로 클립보드나 파일에 기록합니다. 원시 트랜스크립트를 붙여넣지 않는 감사 친화적인 세션 공유 방식입니다.
  • codex exec fork <SESSION_ID> [PROMPT] — 기존 세션에서 새 스레드를 생성하여 긴 디버깅 세션을 병렬 탐색으로 분기할 수 있게 합니다.
  • 세션 아카이빙 — 장기 실행 세션을 삭제 대신 아카이브하여 활성 목록을 어지럽히지 않으면서도 이력을 탐색 가능한 상태로 유지합니다.

이 기능들은 8월 7일의 v0.147.0 안정 릴리스(휴대용 Agent Plugins, --approve-for-me, MCP 2026-07-28 지원, 비밀번호(secret) 편집)와 7월 29일의 v0.146.0 릴리스(Agent Plugins 1.0, 이름 있는 세션, 스레드 포킹, WebSocket 기반 원격 Code Mode)를 보완합니다. 패턴은 분명합니다. Codex는 장기적이고 다중 세션의 에이전트 작업에 맞춰 조정되고 있습니다 — 모델 측에서는 압축, 클라이언트 측에서는 세션 관리입니다.

플랫폼 측면에서도 주목할 만한 소식: 8월 11일, OpenAI는 Linux용 ChatGPT 데스크톱 앱의 공개 미리보기(Ubuntu 24.04/26.04 LTS, Debian 13, Fedora 43/44; x64 및 ARM64; 네이티브 .deb/.rpm)를 출시했습니다. ChatGPT, ChatGPT Work, Codex를 하나의 네이티브 앱에 번들로 제공하며 — Anthropic의 Linux용 Claude 데스크톱 앱 이후 약 한 달 만에 마지막 주요 OS 공백을 메웠습니다. 가져오기 기능은 다른 AI 도구의 프로젝트, 채팅, 스킬, 플러그인을 가져옵니다.

3. GPT-5.6-Cyber, Daybreak Blue/Red, 그리고 Astra 임계값

GPT-5.6-Cyber (8월 10일). OpenAI는 승인된 취약점 연구, 익스플로잇 검증, 보안 테스트를 위해 GPT-5.6 Sol을 기반으로 구축된 사이버보안 특화 모델을 소개했습니다:

  • 고급 사이버 작업에서 95.0% 완료율 — 표준 Sol의 1.5%, 이전 GPT-5.5-Cyber의 57.3%와 대비
  • 이미 실제 제로데이를 발견했으며, 여기에는 CVE-2026-15903(Chrome V8 out-of-bounds read/write, Chrome 150.0.7871.128에서 패치됨)과 모바일 OS 권한 상승 체인이 포함
  • OpenAI의 Preparedness Framework에서 “High” 등급 — “Critical” 미만
  • 공개 API에 없음 — Daybreak Red 프로그램을 통한 게이티드(gated), 신청 기반 액세스

Daybreak는 두 개의 티어로 확장되었습니다. Daybreak Blue는 방어 팀에 취약점 발견, 보안 코드 리뷰, 악성코드 분석, 사고 대응, 패치 검증을 위한 맞춤형 가드레일을 갖춘 GPT-5.6 Sol을 제공합니다. Daybreak Red는 승인된 연구자에게 익스플로잇 검증과 레드 팀 활동을 위한 GPT-5.6-Cyber를 제공합니다. 신뢰받는 파트너로는 Accenture, Akamai, Cisco, Cloudflare, CrowdStrike, Fortinet, IBM, Palo Alto Networks, PwC, Sophos가 있으며 — 이 중 여러 곳이 현재 OpenAI 사이버 모델을 자사 보안 제품에 통합하고 있습니다. 거버넌스는 엄격합니다: 신원 확인, 모니터링, 승인된 용도 제한, 법적 확인서 — 그리고 9월 1일부터 모든 개인 Daybreak 계정에 하드웨어 보안 키가 필수가 됩니다.

Astra가 “Critical” 선에 접근합니다. 8월 7~10일에 공개된 고지에서 OpenAI는 미공개 모델 Astra가 Preparedness Framework의 Critical 등급에 도달했을 가능성을 “배제할 수 없다"고 밝혔습니다 — OpenAI 모델 사상 최초입니다. Critical은 모델이 강화된 실제 시스템 전반에서 기능적인 제로데이 익스플로잇을 자율적으로 식별하고 개발할 수 있거나, 높은 수준의 목표 하나만으로 종단 간 신규 사이버 공격 전략을 고안하고 실행할 수 있음을 의미합니다. OpenAI의 대응: 강화된 보안 요구사항을 충족하지 못하는 내부 Astra 활동 중단, 테스트 환경 격리, 가중치 보호 및 암호화 강화, 에이전틱 애플리케이션 전반의 체인 오브 소트(chain-of-thought) 모니터링, 실행 중 고위험 활동을 중단할 수 있는 자동 대응 시스템, 정부 기관 및 영국 AI 보안 연구소(UK AI Security Institute)와의 외부 테스트 — 그리고 2026년 6월 행정 명령에 따른 미국 정부의 모델 사상 최초 사전 릴리스 사이버보안 검토입니다. 릴리스 날짜는 없으며, 문구상으로는 몇 주가 아닌 몇 달의 지연을 시사합니다.

4. IBM, 엔터프라이즈 크로스오버, 그리고 IPO 카운트다운

IBM 전략적 파트너십 (8월 13일). IBM은 OpenAI의 프런티어 모델(GPT-5.6), Codex, ChatGPT Work를 IBM Consulting Advantage에 통합하고 있으며, OpenAI Partner Network를 통해 인증받은 수천 명의 컨설턴트로 구성된 전용 OpenAI Practice를 설립하고 있습니다. IBM은 OpenAI의 Elite 파트너 티어에 합류하며 세 가지 축을 갖습니다: 레거시 비즈니스 프로세스를 AI 준비 워크플로로 전환, 산업별 AI 솔루션 개발, Daybreak 및 IBM Autonomous Security를 통한 사이버보안 협력 확대. 이는 지금까지 가장 깊은 컨설팅 채널 계약입니다 — 추천(referral) 방식이 아니라 OpenAI를 IBM의 서비스 전달 플랫폼에 직접 내장합니다. Frontier Alliances(Accenture, BCG, Capgemini, McKinsey, Infosys, TCS)와 6월의 IBM-OpenAI Daybreak Cyber Partner Program을 기반으로 합니다.

엔터프라이즈 매출이 소비자 매출을 추월했습니다. CFO 사라 프라이어(Sarah Friar)는 8월 14일 주주들에게 엔터프라이즈 매출이 이제 ChatGPT 소비자 매출을 초과한다고 밝혔습니다 — 당초 2026년 말로 예상되었던 크로스오버가 몇 달 앞당겨진 것입니다. 연환산 매출 실행률(ARR)은 약 400억 달러(2026년 7월)까지 올라갔으며, 전월 대비 20% 증가, 비즈니스 고객은 32% 증가했습니다. 참고 수치: 2025년 공식 매출 131억 달러, 2026년 3월 기준 월 약 20억 달러 이상. 이번 주의 다른 비즈니스 움직임: **70억 달러 규모의 공개매수(tender offer)**가 8,520억 달러 밸류에이션에서 완료(8월 10일), 프레젠테이션 기술을 위한 NextSlide 인수(8월 10일), ChatGPT Business Premium 좌석 티어(8월 11일), 그리고 ChatGPT 사용자가 예약을 할 수 있는 Yelp 파트너십(8월 14일).

공개 S-1이 임박했습니다. 8월 중하순 예상 — 8월 13일 기준 아직 SEC EDGAR에는 등재되지 않았습니다. 주관사: Goldman Sachs, Morgan Stanley, JPMorgan. 2026년 9월 상장 목표, 밸류에이션 8,520억~1조 달러, 다만 일부 보도에 따르면 2027년으로 미뤄질 가능성도 있습니다. S-1은 감사된 재무제표, 소비자/엔터프라이즈/API 매출 분할, 정확한 Microsoft 수익 공유 조건(마이크로소프트는 완전 희석 기준 약 26.79% 보유), Astra 중단과 Apple 소송을 포함한 위험 요인, 그리고 공모 범위를 공개할 것입니다. 또한 기술 역사상 가장 큰 잠재적 IPO 시즌의 한복판에 등장할 것입니다 — Anthropic은 10월 상장 목표와 2조 달러 밸류에이션으로 6월 1일 기밀 S-1을 제출했고, xAI는 이미 SpaceX 합병 후 1.25조 달러 밸류에이션으로 IPO를 마쳤습니다.

5. 8월 폐지(Deprecation)의 관문

마감 시한이 이제 빽빽하게 쌓여 있으며, 몇 가지 항목은 이미 영향을 주기 시작했습니다:

  • gpt-5.2-chat-latestgpt-5.3-chat-latest가 8월 10일 API에서 제거되었습니다(5월 8일 발표). 폐지된 스냅샷에 고정된 요청은 실패합니다 — OpenAI는 자동 라우팅을 하지 않습니다. 권장 대체 모델: gpt-5.6-sol(1M 토큰당 $5/$30, 1,050,000 토큰 컨텍스트).
  • Assistants API는 12일 후인 8월 26일에 종료됩니다 — OpenAI와 Azure 모두에서. 자동 마이그레이션도, 유예 기간도 없으며, 폐지 후에는 410 Gone이 반환되고 대화 이력도 이전되지 않습니다. 대체: Responses API + Conversations API(OpenAI) 또는 Foundry Agent Service(Microsoft).
  • o3는 8월 26일 ChatGPT에서 제외됩니다(API o3 스냅샷은 12월 11일까지 유지).
  • DALL·E GPT는 8월 30일 폐지됩니다 — 사용자는 지금 저장된 이미지를 다운로드해야 합니다. 대체: GPT Image 2.
  • 레거시 모델(gpt-3.5-turbo, gpt-4)은 10월 23일 API에서 폐지됩니다.
  • GPT-5.4 및 GPT-5.4 mini는 8월 31일 ChatGPT 인증 세션의 Codex에서 제외됩니다 — API 키로는 계속 사용 가능합니다. 워크스페이스 기본값과 관리형 구성을 확인하세요.

계획을 위한 가격 참고: GPT-5.6 Luna는 1M 토큰당 $0.20/$1.20(80% 인하, 7월 30일 적용)으로 여전히 가장 저렴한 프런티어급 옵션 중 하나입니다 — 대규모 배치 작업, 분류, 가벼운 작업에 적합합니다. Claude Sonnet 5의 소개 가격은 8월 31일에 종료되어 $3.00/$15.00로 변경됩니다.

마지막 생각

엔지니어링 리더들이 이번 주에 조치해야 할 세 가지가 있습니다.

첫째, 장기 자동화를 위해 GPT-5.1-Codex-Max를 평가하세요. 압축 아키텍처는 단일 에이전트 실행이 할 수 있는 일의 범위를 바꿉니다 — 프로젝트 규모의 리팩터링과 수 시간에 걸친 루프가 이제 현실적이며, 128K 출력을 갖춘 400K 컨텍스트는 대규모 모노레포를 처리합니다. 이전 Codex 기본 모델로 표준화했다면 xhigh에서 Max를 기준으로 워크로드를 다시 벤치마킹하세요. SWE-Lancer 점프(66.3% → 79.9%)는 마이그레이션 비용을 정당화하는 종류의 수치입니다.

둘째, 8월 26일 Assistants API 종료를 확정적인 마감 시한으로 취급하세요. 12일 남았습니다. 어시스턴트를 정리하고, 구성을 백업하고, Responses/Conversations API 또는 Foundry Agent Service로 마이그레이션하고, 컷오프 전에 테스트로 검증하세요. 프로덕션 코드에 gpt-5.2-chat-latestgpt-5.3-chat-latest를 참조하는 부분이 있다면 이미 깨진 상태입니다 — 먼저 고치세요.

셋째, Astra 공개를 거버넌스 신호로 주목하세요. “Critical” 사이버 임계값에 접근하는 모델은 규제 대화를 바꿉니다 — 미국 정부의 사전 릴리스 검토 프로세스는 이제 프런티어 연구소에게 일상적인 현실이 되었습니다. 엔터프라이즈의 실질적 시사점은 변하지 않았지만 더 선명해졌습니다: 에이전트 배포에는 다층 방어 패턴이 필요합니다 — 하네스/컴퓨트 분리, 핫 패스의 가드레일, 되돌릴 수 없는 작업에 대한 승인 게이트, 그리고 모델 생성 실행 환경 밖에 보관된 자격 증명.

향후 90일은 공개 S-1, 9월 상장 창, IBM OpenAI Practice의 가동, 그리고 Astra의 검토 프로세스가 프런티어 모델 출시의 새로운 선례를 세울지 여부에 의해 정의될 것입니다. 플랫폼은 성숙해지고 있고, 그 판돈은 점점 커지고 있습니다.

X에서 대화를 이어가세요.