/ 블로그 / Grok 4.6 출시
ENGINEERING_BLOG · 2026.07.30

Grok 4.6 출시일: xAI의 8월 7일 목표는 현실적인가

GROK 4.6 · 목표 윈도우
8/7±

1.5T 파라미터 · SFT/RL 포스트트레이닝 강화 · Grok 4.7 2.1T는 수 주 내

Grok 4.6 출시일을 기다리며 Grok 4.5를 유지할지 Kimi K3로 전환할지 고민하거나, 「1.5조 파라미터」가 실제로 무엇을 의미하는지 정리하고 싶다면——본문은 일론 머스크의 7월 28일 공개 발언과 업계 보도를 하나의 실행 가능한 그림으로 묶습니다. 머스크는 Vercel CEO Guillermo Rauch에게 X에서 답글로 xAI가 8월 7일 전후 1.5조 파라미터 Grok 4.6을 출시하고, 수 주 내 2.1조 파라미터 Grok 4.7이 뒤따를 계획이라고 밝혔습니다. 핵심 결론: 현재 1차 정보원은 머스크의 X 답글 한 건이며, 모델 카드와 벤치마크는 없습니다. 머스크 일정은 역사적으로 며칠에서 수 주 밀리는 경우가 많으므로, 확정 전 xAI 공식 채널로 반드시 확인하십시오.

SECTION 01 Grok 4.6에 베팅하기 전에 걷어낼 5가지 함정

  • 트윗은 보도자료가 아닙니다: 7월 28일 정보는 머스크가 @rauchg에게 답글한 내용입니다. xAI 블로그와 제품 페이지는 스펙·일정을 확인하지 않았습니다.
  • 파라미터≠능력: 머스크는 순수 규모보다 SFT와 RL 업그레이드를 강조했습니다. Grok 4.5는 이미 Cursor 공동 훈련과 높은 토큰 효율로 Agent 벤치마크에서 경쟁력을 보였습니다.
  • 벤치마크 점수는 아직 없습니다: Grok 4.5의 상세 모델 카드와 달리 4.6/4.7에는 제3자 평가가 전혀 없어 Kimi K3나 소문의 Claude Fable 5.1과 단단한 비교가 불가합니다.
  • 경쟁 페이스가 가혹합니다: Kimi K3는 7월 26일 2.8T 풀 오픈 웨이트를 공개하고 Frontend Code Arena 1,679점을 기록했습니다. xAI의 압축된 4.6/4.7 일정은 이 압박을 반영합니다.
  • 안전 그림자: 7월 xAI는 Grok 경로 CSAM 생성 혐의로 사용자를 고소했습니다. Common Sense Media는 1월 Grok을 아동 안전 최악급 AI 중 하나로 평가했습니다. 역량과 컴플라이언스를 병행 평가하십시오.

SECTION 02 타임라인과 핵심 스펙: Grok 4.5에서 4.7까지

Grok 출시 페이스(2026년 여름)
날짜 사건
2026-07-08 xAI Grok 4.5 출시: 코딩/Agent flagship, Cursor 공동 훈련, 500K 컨텍스트, 입력 $2/출력 $6(백만 토큰)
2026-07-16–26 Moonshot AI Kimi K3 호스팅 후 풀 오픈 웨이트: 2.8T 파라미터, 1M 컨텍스트
2026-07-28 머스크가 Rauch 답글로 Grok 4.6/4.7 로드맵 게시. 같은 날 1,200명+ 직원이 「Pacing the Frontier」 공개서한 발표
~2026-08-07 Grok 4.6 목표: 1.5T 파라미터, SFT/RL 대폭 업그레이드(발표, 미출시)
~2026년 8월 말–9월 초 Grok 4.7 예상: 2.1T 파라미터. 머스크는 4.6보다 우수하지만 서빙은 약간 느리고 토큰 효율은 높다고 밝혔습니다
Grok 모델 라인업
모델 파라미터 중점 상태
Grok 4.3 Beta 비공개 전세대 베이스라인 출시
Grok 4.5 비공개(단일 SKU, MoE 아님) 코딩/Agent, Cursor 공동 훈련 출시
Grok 4.6 1.5T SFT/RL 업그레이드 발표
Grok 4.7 2.1T 4.6 전반 업그레이드 발표

파라미터 수, 가격, 벤치마크 수치는 벤더 또는 머스크 발언에 따릅니다. Grok 4.6과 4.7에는 독립 평가가 아직 없으므로 「발표」 행은 공식 출시 전까지 방향성 참고로 취하십시오.

SECTION 03 업그레이드 본질은 포스트트레이닝, 단순 규모가 아닙니다

지도 미세조정(SFT)은 큐레이션 예시로 출력을 정형합니다. 강화학습(RL)은 보상 신호로 다단계 Agent 작업을 학습합니다. 머스크의 「SFT & RL 대폭 개선」 표현은 Grok 4.5 전략을 계속합니다. 실제 Cursor 개발자 세션으로 Terminal-Bench 2.1 83.3%, SWE-Bench Pro 64.7%를 달성하고 SWE 작업당 출력 토큰은 Opus 4.8 67,020 대비 약 15,954——4.2배 효율 격차입니다.

Grok 4.6의 1.5T 점프는 실제 규모 확대이지만, 머스크의 Grok 4.7 언급——2.1T로 「서빙은 약간 느리지만 모든 면에서 우수」——는 품질 대 레이턴시 2 SKU 전략을 시사하고 Anthropic Sonnet/Opus 분리, OpenAI mini/full 계층과 동형입니다.

SECTION 04 정면 비교: Grok vs Kimi K3 및 동세 모델

프론티어 모델 스펙·가격(출시/발표 혼합)
모델 파라미터 컨텍스트 가격($/M 입/출)
Grok 4.5 비공개 500K $2 / $6
Grok 4.6(발표) 1.5T 비공개 비공개
Kimi K3 2.8T MoE 1M $0.30–$3 / $15
Claude Fable 5.1(소문) 비공개 비공개 소문 Fable 5($10/$50)
GPT-5.6 Sol 비공개 비공개 비공개

Grok 4.6 목표는 Kimi K3 오픈 웨이트 공개 약 10일 후입니다. K3는 Frontend Code Arena 1,679점으로 해당 리더보드에서 모든 클로즈드 모델을 넘은 최초 오픈 웨이트 모델입니다. 머스크는 K3 벤치마크 스레드에 「impressive」라고 댓글을 달았습니다. K3 상세는 K3 오픈 웨이트 해설, Fable 계열 맥락은 Opus 5와 증류 논란을 참고하십시오.

SECTION 05 논점: Musk time, 소송, 업계 분열

  • 타임라인 미검증: 정보원은 X 답글 한 건입니다. 「Musk time」 지연은 xAI, Tesla, SpaceX에서 흔합니다.
  • 벤치마크·가격 공백: 「1.5T」「SFT/RL 업그레이드」는 벤더 주장으로 제3자 검증이 없습니다.
  • 콘텐츠 안전 소송: 2026년 7월 xAI는 Grok 경로 CSAM 혐의로 사용자 고소——해당 유형 최초 소송. Common Sense Media는 이미 아동 안전 결함을 지적했습니다.
  • 페이스 충돌: 머스크가 4.6/4.7을 발표한 같은 날 OpenAI, Anthropic, Google DeepMind, Meta 1,200명+이 「Pacing the Frontier」를 공개했습니다. xAI는 서명자에 없습니다. GPT-6 전야전과 규제 경쟁을 참고하십시오.

머스크 일정이 지켜지면 Grok 4.6·4.7은 소문의 Claude Fable 5.1(8월 유출)과 Kimi K3 오픈 웨이트 충격과 겹쳐 2026년 8월은 프론티어 모델 출시가 가장 밀집한 달 중 하나가 될 수 있습니다. flagship 유효기간은 수 주로 줄고, 리더보드 순위보다 토큰 효율과 실제 작업 비용이 중요합니다.

SECTION 06 Grok 4.6 출시 전 6단계 체크리스트

  1. 공식 채널 구독: x.ai 블로그, Grok Build 공지, @elonmusk——2차 정보만 의존하지 마십시오.
  2. Grok 4.5 베이스라인 기록: SWE-Bench, Terminal-Bench 점수와 토큰 사용량을 기록해 출시 후 A/B에 대비하십시오.
  3. Cursor/OpenRouter 폴백 설정: Grok 4.5는 현재 Cursor에서 이용 가능합니다. 전환 윈도우용 Kimi K3 또는 GPT-5.6 Sol 경로를 확보하십시오.
  4. 가격 페이지 모니터: 4.5는 $2/$6(백만 토큰)로 출시했습니다. 4.6 가격은 바뀔 수 있으니 출시일 원문을 읽으십시오.
  5. 안전·컴플라이언스 검토: 엔터프라이즈·청소년 대상 제품은 xAI 정책, 로그, 최근 소송을 감사하십시오.
  6. 추론과 빌드 스택 분리: LLM API로 Agent 오케스트레이션, 네이티브 macOS 빌드는 물리 Apple Silicon上——VM EULA 리스크와 20–40% 오버헤드를 피하십시오.

SECTION 07 인용 가능 수치와 1차 정보원

  • Grok 4.5: 500K 컨텍스트;Terminal-Bench 2.1 83.3%;SWE-Bench Pro 64.7%;$2/$6(백만 토큰)
  • Grok 4.6(발표): 1.5T 파라미터;SFT/RL 포스트트레이닝 중점;목표 ~8월 7일
  • Grok 4.7(발표): 2.1T 파라미터;4.6 수 주 후;서빙 약간 느리고 토큰 효율 향상
  • 동세 참조: Kimi K3 2.8T, 1M 컨텍스트, Frontend Code Arena 1,679;Grok 4.5 SWE 작업 Opus 4.8 대비 약 4.2배 출력 토큰 효율

상류 업데이트 후 다음 링크를 재확인하십시오.

xAI: Introducing Grok 4.5

Moonshot AI: Kimi K3(Hugging Face)

The Verge: Pacing the Frontier coverage

Grok 4.6 SFT/RL 업그레이드는 API 선정 윈도우를 더 압축하지만 Xcode 빌드, Metal 디버깅, iOS 서명 체인은 대체할 수 없습니다. VM macOS는 EULA 리스크와 측정 가능한 성능 손실을 동반합니다. 실무적 스택은 프론티어 API(Grok/Kimi)로 백만 토큰 Agent 오케스트레이션, VPSNIX M4/M4 Pro 클라우드 물리 노드로 네이티브 Apple Silicon 빌드——정품 Apple 하드웨어, 풀 Root, 제로 Hypervisor 오버헤드, 일/월 유연 과금. 요금을 확인하십시오.

SECTION 08 자주 묻는 질문 FAQ

Grok 4.6은 구체적으로 언제 출시됩니까?

머스크는 X에서 「2026년 8월 7일 전후」라고 밝혔습니다. xAI는 공식 일정을 확인하지 않았습니다. 밀릴 수 있는 목표로 취하십시오.

Grok 4.6과 Grok 4.7의 차이는 무엇입니까?

Grok 4.6은 1.5T 파라미터로 SFT/RL 개선이 중점입니다. Grok 4.7은 수 주 후 예상되는 2.1T로, 머스크는 서빙 속도를 제외하면 4.6을 능가한다고 밝혔고 일부 레이턴시와 토큰 효율의 트레이드오프가 있습니다.

Grok 4.6이 Kimi K3나 Claude Fable 5.1을 이길 수 있습니까?

아직 판단할 수 없습니다. Grok 4.6에는 공개 벤치마크가 없습니다. Kimi K3에는 Frontend Code Arena 1위 등 검증된 점수가 있고 Claude Fable 5.1은 Anthropic이 미확인했습니다.

Grok 4.6 가격은 얼마일까요?

불명입니다. Grok 4.5는 입력 $2/출력 $6(백만 토큰)으로 출시했습니다. 참고값으로 타당하지만 4.6 가격은 미공개입니다.

Grok 4.6은 어디서 사용할 수 있을까요?

Grok 4.5 배포 경로에 따르면 Grok Build, xAI API, 콘솔이 선행하고 이후 서드파티 플랫폼으로 확대될 것으로 보이지만 4.6은 미확인입니다.