TechFeedTechFeed
LLM 모델xAI

Grok 4.3

xAI flagship with 2M context and multi-agent reasoning

Grok 4.3은 xAI의 최신 플래그십 모델로(직전 4.20 Beta의 GA 후속), 항상 켜져 있는 상시(continuous) 추론과 1M 토큰 컨텍스트를 갖춘 추론 우선 모델이다. 4.3에서 문서 생성과 비디오 입력이 추가됐고, X 검색·웹 검색·코드 실행 등 서버사이드 도구를 내장한다. 가장 강력한 기능은 SuperGrok Heavy($300/월) 상위 티어에서 풀로 열린다. 멀티에이전트 검증으로 할루시네이션을 낮춘 점이 강점이다.

컨텍스트
1M tokens
입력 가격
$2/1M tokens
출력 가격
$6/1M tokens
멀티모달
text, image

핵심 역량

컨텍스트 윈도우
2M 토큰 — 플래그십 모델 중 최대급
할루시네이션 방지
멀티에이전트 검증으로 4.2% 달성
출력 속도
265 tok/s — 업계 최고 수준
추론 강도
MMLU-Pro 95% 보고
코딩 강도
우수하나 Codex·Opus 대비 제한적
도구 사용
X 검색·웹 검색·코드 실행 내장

장점

  • 2M 토큰 컨텍스트 — 플래그십 모델 중 최대급
  • 할루시네이션율 4.2% — 멀티에이전트 검증으로 업계 최저
  • 265 tok/s 출력 속도 — Grok 4.1 대비 2배 이상
  • IFBench 82.9% — 프롬프트 준수율 1위
  • 입력 $2/1M — Claude Opus($5) 대비 60% 저렴
  • X 검색·웹 검색·코드 실행 서버사이드 도구 내장

단점

  • 최상위 기능(비디오 입력·문서 생성·고성능)은 SuperGrok Heavy $300/월 상위 티어 전용
  • 코딩 벤치마크(SWE-Bench 등)에서 Claude Opus 4.8·GPT-5.3-Codex 대비 열위
  • 파인튜닝 미지원
  • Claude Code·Cursor 등 주요 AI 코딩 도구 생태계 통합 부족
  • 서버사이드 도구(검색·코드실행) 별도 과금 ($5/1K calls)

이 모델이 포함된 비교

공식 링크