OpenAI가 2026년 6월 26일 GPT-5.6 Sol을 공개했다. Anthropic의 Claude Mythos 클래스에 맞서는 신규 플래그십 모델이다. 단, 미국 정부 지시에 따라 API와 Codex를 통해 선별된 파트너에게만 제한적으로 제공된다.

OpenAI는 공식 블로그에서 불만을 숨기지 않았다. "이런 정부 승인 방식이 장기 기본값이 돼서는 안 된다. 이 방식은 최고의 도구를 필요로 하는 사용자, 개발자, 기업, 사이버 방어자, 글로벌 파트너에게서 최선의 도구를 빼앗는다." (OpenAI 공식 블로그)

앞서 미국 정부는 Anthropic의 Mythos 클래스 모델 Fable 5를 전 세계 고객 대상으로 비활성화하도록 강제한 바 있다.

모델 구조: 세대 번호 + 성능 티어

GPT-5.6은 Claude와 유사한 계층 구조를 도입했다. 세대 번호(x.6)와 성능 티어(Sol·Terra·Luna)를 분리해 각 티어가 독립적으로 업데이트될 수 있도록 설계했다.

티어위치특징
Sol플래그십최고 성능
Terra중간GPT-5.5 수준, 비용 절반
Luna보급형저비용 옵션
Sol max부가 모드심층 추론
Sol ultra부가 모드복잡 작업을 병렬 서브에이전트에 분산

벤치마크: 코딩에서 Sol이 앞서

▼ 주요 벤치마크 점수 비교

모델Terminal-Bench 2.1 (%)ExploitBench
GPT-5.6 Sol Ultra91.9Mythos Preview 동급 (토큰 약 1/3)
GPT-5.6 Sol88.8-
Claude Mythos 588.0~80% (효율 데이터 미제공)
Claude Fable 584.3-
Gemini 3.1 Pro Preview70.7-

에이전틱 코딩 벤치마크 Terminal-Bench 2.1에서 Sol Ultra가 91.9%로 1위다. Claude Mythos 5(88.0%)와 Sol(88.8%)은 근접한 수치다.

ExploitBench는 Google V8 JavaScript 엔진의 실제 보안 취약점을 찾아 코드 실행까지 이어지는 공격을 테스트한다. Sol은 Mythos Preview와 동등한 성능을 내면서 출력 토큰은 약 3분의 1만 사용했다. 다만 완전 자율 익스플로잇 체인은 생성하지 못했으며, OpenAI는 Sol이 자사 Preparedness Framework의 "Cyber Critical" 임계값 아래에 있다고 밝혔다.

GeneBench v1(유전체·정량 생물학)에서는 GPT-5.5 대비 성능이 향상됐다(최고 성능 기준 30% vs. 22%).

가격 구조

▼ GPT-5.6 티어별 가격 (100만 토큰 기준)

티어입력 ($)출력 ($)
Sol5.0030.00
Terra2.5015.00
Luna1.006.00

캐시 쓰기는 일반 입력 가격의 1.25배, 캐시 읽기는 90% 할인이다. 캐시 최소 유지 시간은 30분으로 보장된다.

OpenAI는 Sol이 여러 벤치마크에서 경쟁 모델 대비 적은 토큰으로 동등하거나 높은 성능을 내므로 실제 작업당 비용은 이전 세대보다 낮아질 수 있다고 설명했다. 7월에는 Cerebras에서 Sol이 초당 최대 750토큰 속도로 제공될 예정이다.

국내 개발자·기업에 주는 시사점

미국 정부의 고성능 AI 모델 접근 제한은 국내 기업과 개발자에게도 직접 영향을 미친다. GPT-5.6 Sol과 Claude Mythos 5 모두 현재 제한 공개 상태인 만큼, 안정적인 서비스 설계를 위해 온프레미스 배포가 가능한 오픈소스 모델이나 규제 리스크가 낮은 대안 모델을 병행 검토하는 흐름이 강해질 수 있다.