미국 xAI가 코딩·지식 작업 특화 모델 Grok 4.7을 출시했다. 더 큰 기반 모델 위에 강화학습을 더 길게 적용했고, 자체 출력 검증 능력을 개선했다고 회사 측은 밝혔다.
가격은 입력 토큰 100만 개당 $2, 출력 토큰 100만 개당 $6다. 서방 프런티어 모델보다 중국 모델 가격대에 가깝다.
독립 평가 기관 Artificial Analysis의 Intelligence Index(v4.3.2)는 10개 벤치마크를 종합한다. Grok 4.7은 이 지수에서 46점으로 중위권에 그쳤다. Claude Fable 5.1과 GPT-6는 각각 53점으로 공동 선두다.
에이전틱 코딩 격차는 더 크다. Terminal-Bench 4.0 기준 Grok 4.7은 26%에 그쳤다. GPT-6 Astra는 60%, Claude Fable 5.1은 55%다. 저가형 DeepSeek V4.1 Flash(27%)에도 1%포인트 뒤진다.
▼ 주요 모델 벤치마크 비교
| 모델 | Intelligence Index (v4.3.2) | Terminal-Bench 4.0 (%) |
|---|---|---|
| GPT-6 Astra | 53 | 60 |
| Claude Fable 5.1 | 53 | 55 |
| DeepSeek V4.1 Flash | - | 27 |
| Grok 4.7 | 46 | 26 |
Grok 4.7은 Grok API, Cursor, Grok Build를 통해 이용할 수 있다.








