2026년 8월 12일부터 19일까지의 한 주는 SpaceXAI에게 지금까지 가장 파급력이 큰 출시 연속이었습니다. Grok 4.6이 8월 12일 AA Intelligence Index 61로 출시되며 GPT-5.6 Sol과 동률을 이루고 세계 3위에 올랐습니다. Grok Bot은 8월 11일 단일 클라우드 컴퓨터를 공유하는 상시 가동형 AI 팀원으로 베타에 진입했습니다. Grok Imagine Image 2.0은 8월 7일 영역 인식 편집 기능과 아레나 2위 랭킹과 함께 롤아웃되었습니다. 그러나 제품 출시 이면에는 진지한 조사가 필요한 두 가지 이야기가 있습니다. 머스크가 “모든 SpaceX 정보의 총합"으로 Grok을 학습시키려는 계획(공개된 옵트아웃 없이 약 14,000–15,000명 직원의 업무 산출물 포함)과, 2026년 상반기 추적 가능한 딥페이크 공격 파일의 87%를 Grok과 연결한 딥페이크 위협 보고서입니다.

이번 주 중요한 개발 사항에 대한 저희의 전문적인 분석은 다음과 같습니다.


Grok 4.6: 프런티어 인텔리전스, 공격적인 가격, 실제 격차

2026년 8월 12일, SpaceXAI는 새로운 플래그십 프런티어 모델인 Grok 4.6을 출시했습니다. 이 출시는 Grok 4.5 이후 약 5주 만에 이뤄졌으며 지금까지 가장 강력한 경쟁 포지셔닝을 보여줍니다. 다만 벤치마크 그림은 xAI의 마케팅이 시사하는 것보다 더 미묘합니다.

아키텍처와 학습

Grok 4.6은 Grok 4.5와 동일한 1.5조 파라미터 V9 파운데이션 위에 구축되었습니다. 성능 향상은 전적으로 사후 학습(post-training)에서 비롯되었습니다. 더 긴 보충 학습 런, 개선된 지도 미세 조정(SFT)과 강화 학습(RL), 그리고 xAI의 설명에 따르면 긴 추론 궤적에서 증가한 자체 검증(self-verification) 동작이 그것입니다. 이 모델은 Grok 4.5를 사용하여 추론 노력, 에이전트 하네스, STEM·소프트웨어 엔지니어링·지식 작업 등의 도메인에 걸친 SFT 궤적을 재생성합니다.

주요 사양:

  • 50만 토큰 컨텍스트 윈도우 — 장기(長期間) 에이전트 태스크에 특화 설계
  • 지식 컷오프: 2026년 2월 1일
  • 멀티모달 입력(텍스트 + 이미지), 텍스트 전용 출력
  • 4단계 추론 노력 수준: low / medium / high(기본값) / xhigh(신규)
  • 네이티브 도구: 함수 호출, 웹 검색, X 검색, 코드 실행, 구조화된 출력
  • OpenAI 호환 Responses 및 Chat Completions API
  • 프롬프트 캐싱(캐시된 입력 75% 저렴) 및 긴 에이전트 루프를 위한 컨텍스트 압축

벤치마크 성능

Grok 4.6은 강력한 수치를 기록하지만, 워크로드에 따라 그림이 크게 달라집니다:

BenchmarkGrok 4.6Grok 4.5GPT-5.6 Sol MaxClaude Fable 5 Max
AA Intelligence Index61566162
CursorBench v3.269.9%66.7%67.2%70.5%
DeepSWE v1.165.9%54%73%70%
Terminal-Bench v3.026%15.7%34.6%34.1%
GPQA Diamond94.9%~94%
GDPVal-AA v21753152617281741
AA-Briefcase Elo1577131315021574
Harvey LAB (Vals)15.8%12.9%2.5%11.3%
Databricks OfficeQA Pro63.2%
APEX-Agents57.5%47.1%56.7%59.2%

Grok 4.6은 AA Intelligence Index에서 GPT-5.6 Sol과 동률(61 vs. 61)을 기록했습니다. 이 지수는 인텔리전스, 속도, 비용을 종합적으로 반영하는 점수입니다. CursorBench(69.9% vs. 67.2%), GDPVal-AA(1753 vs. 1728), AA-Briefcase(1577 vs. 1502), APEX-Agents(57.5% vs. 56.7%), Harvey LAB(15.8% vs. 2.5%)에서는 GPT-5.6 Sol을 앞섰습니다. Harvey LAB 결과 — 법률 전문 업무 평가에서 6배 우위 — 는 특히 눈에 띄지만, 일반적인 법률 추론 우위라기보다 벤치마크 특화 최적화를 반영한 것일 수 있습니다.

Claude Fable 5 Max와 비교하면 그림이 달라집니다. Anthropic의 모델이 AA Intelligence Index(62 vs. 61), Terminal-Bench(34.1% vs. 26%), DeepSWE(70% vs. 65.9%), APEX-SWE(58.8% vs. 56.4%), FrontierCode(63.6% vs. 61.3%)에서 앞섭니다. Grok 4.6은 GDPVal-AA, CursorBench, AA-Briefcase, Harvey LAB에서 승리합니다. 패턴은 명확합니다: Grok 4.6은 지식 작업과 비용에 민감한 태스크에서 탁월하며, Anthropic은 에이전트형 터미널 및 소프트웨어 엔지니어링에서 우위를 유지합니다.

주목할 만한 결과 하나: xAI는 한 소식통에 따르면 실제 코딩 분야 CursorBench 3.2 1위를 주장하지만, 다른 보고서에서는 Claude Fable 5 Max가 더 높은 점수(70.5% vs. 69.9%)를 기록합니다. 이 차이는 서로 다른 벤치마크 구성이나 평가 조건을 반영하는 것으로 보입니다.

가격: 경쟁의 쐐기

Grok 4.6의 가격 구조는 가장 날카로운 경쟁 무기입니다:

TierInputCached InputOutput
Standard (<200K tokens)$2/M$0.50/M$6/M
Long-context (≥200K tokens)$4/M$1/M$12/M

GPT-5.6 Sol의 토큰 100만 개당 $5/$30과 비교하면 Grok 4.6은 입력 가격의 약 40%, 출력 가격의 약 20% 수준입니다. Claude Fable 5 Max와 비교하면 절감액은 80~88%에 이릅니다. 이는 시장에서 가장 공격적인 프런티어 모델 가격입니다.

중요한 디테일: 200K 토큰 프롬프트 임계값을 넘으면 요청 전체가 더 높은 롱 컨텍스트 요율로 재가격 책정됩니다. 200K를 초과하는 토큰만이 아닙니다. 해당 경계 부근에서 운영하는 엔터프라이즈는 의도치 않은 비용 상승을 피하기 위해 프롬프트를 신중하게 설계해야 합니다.

Artificial Analysis 실행에서의 비용 효율성은 Grok 4.6이 태스크당 약 $0.66–0.84로 태스크를 완료하며, GPT-5.6 Sol 또는 Fable 5 동급 모델보다 32~73% 저렴함을 보여줍니다. 장기 실행 평가는 Claude Opus 5 Max의 약 103턴, 약 20억 토큰 입력과 대비되어 평균 약 53턴과 약 5억 토큰 입력을 기록했으며, 지속적인 에이전트 워크로드에서 실질적으로 더 나은 효율성을 시사합니다.

제공 범위

Grok 4.6은 출시 당일 다음에서 사용할 수 있었습니다:

  • xAI API, Cursor, Grok Build, Grok Bot, OpenRouter, Vercel, Cloudflare(8월 12일)
  • GitHub Copilot(8월 14일) — VS Code, Visual Studio, Copilot CLI, JetBrains, Xcode, Eclipse 및 클라우드 에이전트의 Pro, Pro+, Max, Business, Enterprise 등급에 추가

GitHub Copilot 통합은 의미가 큽니다. 출시 48시간 만에 Grok 4.6을 GitHub의 방대한 개발자 기반 앞에 놓기 때문입니다. SuperGrok 구독자(월 $30)는 Grok Build 내부에서 접근할 수 있으며, 첫 주 프로모션은 Cursor와 Grok Build에서 포함 사용량 2배를 제공했습니다.

유의 사항

헤드라인 수치를 누그러뜨리는 몇 가지 유의 사항이 있습니다:

  • 여러 벤치마크 표는 벤더 보고입니다. “GPT-5.6 Sol과 동률"이라는 주장은 일부 매체에서 독립적인 검증이 아닌 xAI 자체 주장으로 나타납니다
  • 일부 리뷰어는 느린 첫 토큰 지연 시간을 지적합니다. 인터랙티브 코딩 워크플로에 의미 있는 문제입니다
  • 최상위 모델 대비 코딩 벤치마크 격차, 특히 Terminal-Bench와 DeepSWE에서의 격차가 남아 있습니다
  • 엔터프라이즈 포지셔닝 전환은 의도적입니다. SpaceXAI는 Grok 4.6을 “장기 실행 에이전트를 위해 처음부터 구축된 최초의 SpaceXAI 모델"이라고 부르며, 소비자 챗봇에서 엔터프라이즈 에이전트 플랫폼으로의 피벗을 알립니다

Grok Bot: 상시 가동형 AI 팀원 — 그리고 보안 아키텍처의 격차

2026년 8월 11일, SpaceXAI는 Grok Bot을 베타로 출시하며 “AI 팀원” 카테고리에 진출했습니다. 이 제품은 고객의 도구에 로그인하고, 애플리케이션 전반에서 작업하며, 지속적인 감독 없이 다단계 작업을 완료하는 상시 가동형 AI 에이전트를 내세웁니다.

출시된 것

각 Bot은 클라우드 컴퓨터의 명명된 영구 에이전트(브라우저, 파일시스템, 터미널을 갖춘 Linux VM)로, 노트북을 닫은 후에도 계속 작업합니다. Bot은 사용자의 자격 증명으로 기존 앱에 로그인하며, 컴퓨터 사용(computer-use)을 통해 깔끔한 API가 없는 UI — Gmail, Slack, CRM 등 — 를 구동합니다.

주요 기능:

  • 시연을 통한 학습: 작업을 한 번 지켜보면 Bot이 이를 루틴으로 저장하고 일정 또는 이벤트 트리거에 따라 실행합니다(Bot당 최대 약 50개 루틴)
  • Bot 간 조정: 여러 Bot이 서로 메시지를 주고받고, 스레드에서 컨텍스트를 공유하며, 그룹 채팅에서 협력할 수 있습니다. 작업을 넘기고 서로 소유권을 할당합니다
  • 지속적인 컨텍스트: Bot은 대화 전반에 걸쳐 정보를 유지하며, 시간이 지나면서 선호도와 예외 사례를 학습합니다
  • 플랫폼 제공 범위: macOS, Windows, Linux, iOS(Android는 “곧 출시”); SSO, SCIM, RBAC를 갖춘 엔터프라이즈 접근은 대기자 명단을 통해

기반 모델은 베타 시작 시점의 Grok 4.5에서 8월 12일 이후 Grok 4.6으로 전환되었습니다.

공유 컴퓨터 문제

Grok Bot 출시에서 가장 파급력이 큰 디테일은 보안 아키텍처에 관한 마케팅과 문서 사이의 간극입니다.

출시 페이지는 이렇게 말합니다: “Bot은 자신만의 컴퓨터를 가집니다.” 이 표현은 격리를 암시합니다. 각 Bot이 별도의 자격 증명과 제한된 폭발 반경을 가진 자체 샌드박스 환경에서 작동한다는 뜻입니다.

xAI 자체 문서는 다르게 말합니다. Grok Bot 개요 페이지에 따르면: “모든 Bot은 동일한 영구 클라우드 컴퓨터를 사용합니다.” 컴퓨터는 개별 Bot이 아니라 사용자 계정 단위로 격리됩니다. 각 Bot은 그 머신에서 자신만의 화면을 받지만, 파일, 브라우저 세션, 커맨드라인 자격 증명은 전체 Bot 명단이 공유합니다.

문서는 이를 명시적으로 밝힙니다:

“보안 경계로 별도의 Bot을 사용하지 마십시오.”

즉, 어떤 Bot 하나가 수립한 자격 증명(로그인, API 키, 세션 토큰)은 같은 계정의 다른 모든 Bot이 접근할 수 있습니다. Bot 삭제는 소프트 삭제입니다. Bot을 제거하면 해당 Bot의 프로필, 대화, 루틴은 사라지지만, 공유 컴퓨터의 파일과 로그인 정보는 남아 있을 수 있으며, 원천에서 폐기될 때까지 남은 명단이 접근할 수 있습니다.

엔터프라이즈 평가 관점에서 이 아키텍처는 방어 가능합니다. Bot이 서로에게 작업을 저렴하게 넘길 수 있게 해주기 때문입니다. 다만 전체 Bot 명단을 단일 아이덴티티 표면으로 취급해야 합니다. 모든 보안 검토는 개별 Bot 단위의 격리가 아니라 “어떤 Bot이든 도달할 수 있는 모든 것"으로 접근을 모델링해야 합니다. “자신만의 컴퓨터"라는 표현에서 격리를 합리적으로 추론하는 이해관계자들에게 이 사실을 전달하는 것을 마케팅 언어가 더 어렵게 만들고 있습니다.

가격과 접근성

Grok Bot에는 단독 가격이 없습니다. 접근은 기존 세 가지 구독 등급에 번들로 포함됩니다:

TierPriceProvider
SuperGrok Heavy월 $300(3개월간 $99 프로모션)SpaceXAI
Cursor Ultra월 $200Cursor
Cursor Teams Premium좌석당 월 $120Cursor

xAI는 이를 사용량 제한이 있는 “초기 베타"라고 부릅니다. 머스크는 수정 이후 접근이 확대될 것이라고 말했습니다. 엔터프라이즈 접근(SSO, SCIM, RBAC)은 대기자 명단 뒤에 있습니다.

유통 전략이 주목할 만합니다. Grok Bot은 고객이 이미 지불하고 있는 구독 안에 들어가며, SpaceXAI의 에이전트 전략을 Cursor의 인프라에 묶어둡니다. 이는 2026년 6월 SpaceX의 Cursor(Anysphere) 600억 달러 인수를 반영합니다.


Grok Imagine Image 2.0: 영역 인식 편집, 아레나 2위

2026년 8월 7~8일, SpaceXAI는 grok.com/imagine과 iOS·Android 앱의 새로운 Quality Mode로 Grok Imagine Image 2.0 롤아웃을 시작했습니다. 이 모델은 아레나에 SpaceXAI 이름으로 등장합니다.

새로운 기능

  • 영역 인식 편집: 매직 완드 도구가 가리키는 영역만 편집하고 나머지는 그대로 둡니다. 세그멘테이션이 정밀한 영역을 선택합니다. 배경 제거는 투명 배경의 모든 피사체를 내보냅니다
  • 다중 레퍼런스 블렌딩: 단일 생성에 최대 5개의 입력 이미지를 사용할 수 있어(한 소스당 3개) 수동 합성이 필요 없습니다
  • 생성과 편집을 모두 처리하는 단일 모델 — 별도의 워크플로 없음
  • 1K/2K 해상도 등급, 13가지 종횡비
  • 템플릿: 사진 편집, 제품 촬영, 헤드샷, 아이콘, 게임 에셋 등 일반적인 워크플로를 위한 기성 시작점

아레나 랭킹과 마케팅의 뉘앙스

Image 2.0은 8월 7일 기준 Arena Text-to-Image(Elo 약 1,320)와 Arena Image Edit(Elo 약 1,439) 리더보드 모두에서 세계 2위를 기록했습니다. OpenAI의 GPT Image 2(1,380 / 1,463)에 이은 것입니다. 한 소식통은 이후 Microsoft의 MAI-Image-2.6에 의해 3위로 밀려났다고 보고합니다.

주목할 만한 마케팅 뉘앙스: 아레나의 2위 항목은 “low” 컴퓨트 변형(grok-imagine-image-2 (low))이며, 품질 변형은 리더보드에서 더 낮게 랭크됩니다. 소비자용 “Quality Mode"는 더 높은 컴퓨트 모델을 사용하므로, 최상의 출력을 얻는 사용자가 반드시 그 랭킹을 획득한 모델을 사용하는 것은 아닙니다. 이는 기만적이지 않습니다. 아레나 랭킹은 제출된 것을 반영할 뿐입니다. 다만 경쟁력 주장을 흐리게 만듭니다.


Grok 4.7: SpaceX 데이터 학습과 프라이버시 폭풍

앞으로의 일정을 보면, 머스크는(X에 공개 게시된) 전 직원 회의에서 Grok 4.7이 “막대한 양의 SpaceX 회사 데이터"로 보충 학습 중이며 “34주 안에 준비"될 것이라고 발표했습니다. 목표 시점은 **2026년 9월 초중순**입니다. 보고된 사양(확인되지 않음, 모델 카드 없음): 4.6의 1.5T와 대비되는 약 2.1T 파라미터.

머스크는 Grok 4.7이 “현재 모든 모델을 능가할 것"이라고 주장하며, Starlink 텔레메트리, Raptor 엔진 로그, Starship 재진입 데이터, Slack/Jira/GitHub/ERP 아티팩트라는 독특한 SpaceX 말뭉치를 고려할 때 “실제 엔지니어링에서 어떤 모델이 더 나을 것이라고는 상상도 못 할 것"이라고 말합니다.

직원 데이터 문제

논란은 모델에 관한 것이 아닙니다. 학습 데이터에 관한 것입니다.

머스크는 SpaceX 직원들에게 Grok이 **“모든 SpaceX 정보의 총합”**으로 학습될 것이라고 말하며, “어떤 의미에서는 여러분으로 학습될 것입니다. 여러분이 사실상 그 AI의 부모가 되는 것입니다"라고 덧붙였습니다.

이 발표에서 빠진 것:

  • 포함되는 데이터 범주(커뮤니케이션, 로그, 메트릭, 행동 데이터)에 대한 공개 없음
  • 설명된 옵트아웃 메커니즘 없음
  • 데이터 수집, 필터링, 보호 방식에 대한 프라이버시 프로토콜 없음
  • 범위 제한 없음 — “총합"은 내부 커뮤니케이션과 의사결정 패턴을 포함한 모든 것을 의미합니다

14,000–15,000명의 SpaceX 직원이 잠재적 범위에 있습니다. 법적 지형은 불안정합니다. 업무상 창작물(work-for-hire) 원칙은 작업 산출물을 다루지만, 지속적인 행동 캡처(키스트로크, 의사결정 패턴, 커뮤니케이션 메타데이터)는 회색 지대에 있습니다. TechTimes 보도에 따르면 SpaceX 직원은 관할권 공백으로 NLRB 고발을 제기할 수 없습니다.

메타 선례

가장 유사한 선례는 직원의 키스트로크, 마우스 클릭, 스크린샷을 캡처해 내부 AI 모델을 학습시킨 Meta의 Model Capability Initiative(2026년 4월)입니다. 결과는 다음과 같습니다:

  • 약 1,600명의 직원이 프로그램에 반대하는 청원에 서명
  • 6월 개인 데이터가 회사 전체에 유출된 SEV 2 인시던트
  • 유출 이후 프로그램 중단

SpaceXAI는 Meta의 실패를 연구했는지, 유사한 결과를 방지하기 위한 안전장치를 구현했는지 밝히지 않았습니다. 공개된 거버넌스 프레임워크의 부재는 머스크의 공개적이고 광범위한 프레이밍과 결합되어 실질적인 규제 및 평판 리스크를 만듭니다. 유럽연합 집행위원회, 캘리포니아 주 법무장관(California AG), 영국, 호주 당국은 이미 별개의 사안으로 X와 Grok에 대한 조사를 시작했습니다.

엔터프라이즈가 물어야 할 거버넌스 질문

SpaceXAI 모델을 평가하는 모든 엔터프라이즈에게 SpaceX 학습 프로그램은 즉각적인 논란을 넘어서는 거버넌스 질문을 제기합니다:

  1. 데이터 출처: SpaceXAI는 API를 통해 제공되는 모델이 부적절하게 획득된 직원 행동 데이터로 학습되지 않았음을 인증할 수 있습니까?
  2. 규제 노출: 조사 결과 학습 프로그램이 어느 관할권에서든 프라이버시 법을 위반한 것으로 밝혀지면, 해당 모델을 프로덕션에서 사용하는 고객의 시정 경로는 무엇입니까?
  3. 직원 동의 인프라: SpaceX는 AI 학습에 대한 정보에 입각한 동의 프레임워크를 갖추고 있습니까, 아니면 “여러분이 그 AI의 부모가 될 것입니다"가 공개의 전부입니까?

이것은 가상의 우려가 아닙니다. Grok을 프로덕션 의존성으로 채택하기 전에 모든 컴플라이언스 팀이 물어야 할 조달 실사 질문입니다.


딥페이크 위기: 추적 가능한 공격의 87%가 Grok과 연관

이번 주 가장 충격적인 데이터 포인트는 8월 12일 발표된 Resemble AI의 H1 2026 딥페이크 위협 보고서에서 나옵니다.

수치

  • 1,760건의 뉴스 보도에서 문서화된 딥페이크 공격 821건
  • 생성된 합성 파일 약 346만 개
  • 확인된 피해자 최소 15,736명
  • 6개월 미디어 도달: 2,928억 노출 — 2025년 전체(2,964억)에 거의 맞먹는 수치
  • 추적 가능한 파일의 87%가 Grok에 귀속
  • 6건 중 1건(137건) 이 성인 또는 미성년자의 동의 없는 친밀 이미지(NCII)와 관련

규모는 충격적입니다. 추적 가능한 딥페이크 환경에서 Grok의 지배력 — 생성 모델을 식별할 수 있었던 파일의 87% — 은 Grok의 시장 위치와 이미지 생성 도구의 상대적 접근성을 모두 반영합니다. 이 보고서는 xAI가 이러한 사용을 의도하거나 용이하게 한다고 주장하지 않습니다. 귀속은 생성 파일의 기술적 핑거프린팅에 기반합니다.

규제 및 법적 노출

여러 규제 기관이 조사를 시작했습니다:

  • 유럽연합 집행위원회 — DSA 조항에 따라 X와 Grok 조사
  • 캘리포니아 주 법무장관 — 주 딥페이크 및 NCII 법률 준수 여부 검토
  • 영국호주 — Grok 플랫폼 관행에 대한 별도 조사

동의 없는 이미지를 허용하거나 유포하는 기업의 법정 민사 노출 규모는 15 U.S.C. §6851에 따라 약 22억 4천만 달러로 추산됩니다.

방법론 유의 사항

이 보고서는 공개적으로 보도된 사건과 추적 가능한 파일만을 기반으로 합니다. 실제 수치는 더 높을 가능성이 있습니다. Resemble AI는 또한 보지 못한 생성기에서 나온 합성 콘텐츠를 식별하도록 설계된 탐지 모델 DETECT-World을 출시했습니다. 유용한 방어 도구이지만, 근본 원인이 아닌 증상을 다루는 도구입니다.

엔터프라이즈에 주는 의미

딥페이크 보고서가 엔터프라이즈가 Grok을 피해야 한다는 뜻은 아닙니다. Grok의 이미지 생성 기능을 사용하는 모든 조직은 다음을 필요로 한다는 뜻입니다:

  • 동의 없는 실제 인물의 합성 미디어를 명시적으로 금지하는 허용 가능한 사용 정책
  • NCII 또는 명예훼손 법률을 위반할 수 있는 생성 콘텐츠에 대한 출력 모니터링
  • xAI의 콘텐츠 모더레이션 인프라(또는 그 부재)를 고려한 벤더 리스크 평가
  • 조직의 API 사용으로 추적되는 딥페이크에 대한 인시던트 대응 계획

관련 소식: River AI의 11억 달러 조달

이번 주 주목할 소식: xAI 공동 창업자(전 DeepMind/OpenAI)인 Igor Babuschkin이 설립한 River AI가 사후 평가액 약 50억 달러로 시드 + 시리즈 A에서 11억 달러를 조달했습니다. 라운드는 General Catalyst와 AMP PBC가 공동 주도했으며, Nvidia, AMD Ventures, Temasek, Y Combinator, a16z가 참여했습니다.

River AI는 설립 두 달밖에 안 됐고 아직 제품이 없습니다. 피치는 오픈웨이트, 사용자 소유, 로컬 추론 가능한 개인 및 엔터프라이즈 AI입니다. 이 조달이 주목할 만한 이유는 Babuschkin이 원조 Grok의 아키텍처 설계에 기여했기 때문입니다. 그의 xAI 이탈과 그에 따른 오픈웨이트 경쟁사에 대한 즉각적인 대규모 자금 조달은 프런티어 모델 시장이 아직 결정되지 않았음을 시사합니다. 투자자 명단(Nvidia, AMD Ventures)은 하드웨어 기업들이 오픈 및 클로즈드 모델 생태계 전반에 걸쳐 베팅을 분산하고 있음을 보여줍니다.

경쟁사 컨텍스트: Qwen 3.8-Max가 8월 12일 오픈웨이트로 출시되었습니다(커스텀 라이선스, Apache 아님; 비전 + 100만 컨텍스트, API 전용). DeepSeek V4 Pro는 API 업데이트를 받았습니다. Meta는 Muse Glimmer 30B(Apache 2.0)를 출시했습니다. 오픈웨이트 생태계는 클로즈드 프런티어 모델에 대한 신뢰할 수 있는 대안을 계속 생산하고 있습니다.


주목할 것

  • Grok 4.7 출시 일정: 머스크의 “34주” 목표는 출시 시점을 9월 초중순으로 잡습니다. SpaceX 데이터 학습 논란이 출시 전에 어떤 공개 또는 거버넌스 변경을 강제하는지 주목하십시오. docs.x.ai에는 아직 모델 카드, 가격, 컨텍스트 윈도우 세부 사항이 없습니다.
  • SpaceX 직원 데이터 거버넌스: 직원 반발, 규제 조치, 또는 SpaceXAI의 학습 데이터 거버넌스 프레임워크 공개를 주목하십시오. Meta 선례(청원 → 유출 → 중단)는 그럴듯한 궤적입니다.
  • 딥페이크 규제 조치: Resemble AI 보고서는 유럽, 캘리포니아, 영국, 호주 규제 기관의 관심을 끌었습니다. 특히 DSA 또는 15 U.S.C. §6851에 따른 X 또는 SpaceXAI에 대한 구체적인 집행 조치를 주목하십시오.
  • Grok 4.6 독립 벤치마크: 이 모델은 LMArena 평가에 등재되어 있습니다. 특히 xAI의 수치가 가장 약한 Terminal-Bench와 DeepSWE에서의 독립적인 벤치마크 검증이 종합 점수가 xAI 자체 평가 스위트 밖에서도 유지되는지를 결정할 것입니다.
  • Grok Bot 보안 공개: “자신만의 컴퓨터"와 “하나의 공유 컴퓨터” 사이의 간극은 엔터프라이즈 보안 검토에서 표면화될 것입니다. xAI가 마케팅 문구를 수정하거나, 기술적 격리 컨트롤을 추가하거나, 보안 아키텍처 문서를 발행하는지 지켜보십시오.
  • Grok Bot 모델 공개: xAI가 Grok Bot을 구동하는 모델을 밝히지 않은 것은 이례적입니다. Bot이 더 작거나 저렴한 모델로 실행된다면, 역량 상한과 비용 경제성은 구매자가 가정하는 것과 다릅니다.
  • River AI 궤적: 11억 달러와 신뢰할 수 있는 창업자를 가진 만큼 첫 제품 출시를 주목하십시오. 전 xAI 아키텍트가 만든 오픈웨이트 프런티어 모델은 경쟁 구도를 재편할 것입니다.
  • SpaceX 락업 연쇄: 내부자 주식 잠금 해제 1차분이 8월 6일 시작되었으며, 12월까지 2주마다 추가 분이 풀립니다. 매도 압력은 SPCX 주가 성과를, 나아가 SpaceX의 현재 자본 지출 규모(지난 실적 발표 기준 분기 CAPEX 184억 달러)에서 AI 인프라 지출에 대한 시장의 식욕을 형성합니다.

일일 AI 생태계 업데이트는 X의 Kevin Kaminski를 팔로우하세요. 다음 주 xAI Weekly에서 다시 만나요.