미국 xAI가 코딩·지식 작업 특화 모델 Grok 4.7을 출시했다. 더 큰 기반 모델 위에 강화학습을 더 길게 적용했고, 자체 출력 검증 능력을 개선했다고 회사 측은 밝혔다.

가격은 입력 토큰 100만 개당 $2, 출력 토큰 100만 개당 $6다. 서방 프런티어 모델보다 중국 모델 가격대에 가깝다.

독립 평가 기관 Artificial Analysis의 Intelligence Index(v4.3.2)는 10개 벤치마크를 종합한다. Grok 4.7은 이 지수에서 46점으로 중위권에 그쳤다. Claude Fable 5.1과 GPT-6는 각각 53점으로 공동 선두다.

에이전틱 코딩 격차는 더 크다. Terminal-Bench 4.0 기준 Grok 4.7은 26%에 그쳤다. GPT-6 Astra는 60%, Claude Fable 5.1은 55%다. 저가형 DeepSeek V4.1 Flash(27%)에도 1%포인트 뒤진다.

▼ 주요 모델 벤치마크 비교

모델Intelligence Index (v4.3.2)Terminal-Bench 4.0 (%)
GPT-6 Astra5360
Claude Fable 5.15355
DeepSeek V4.1 Flash-27
Grok 4.74626

Grok 4.7은 Grok API, Cursor, Grok Build를 통해 이용할 수 있다.