OpenAI가 7월 9일 GPT-5.6 모델 패밀리를 공개했다. 독립 AI 평가 플랫폼 Artificial Analysis에 따르면, 최상위 모델 Sol(max)은 Intelligence Index에서 59점을 기록해 Claude Fable 5(max·60점)에 1점 차로 바짝 붙었다.

▼ Artificial Analysis Intelligence Index 주요 모델 점수

모델Intelligence Index (점)
Claude Fable 5 (max)60
GPT-5.6 Sol (max)59
Claude Opus 4.856
GPT-5.6 Terra55
GPT-5.555

에이전트 코딩 성능에서는 격차가 뒤집힌다. Artificial Analysis의 Coding Agent Index에서 Sol(max)은 OpenAI Codex 환경 기준 80점으로 전체 1위를 차지했다. GPT-5.6 Terra(77점), Claude Fable 5 in Claude Code(77점), GPT-5.5 in Codex(76점)가 뒤를 이었다. OpenAI는 Sol이 Fable 5 대비 출력 토큰을 절반 이하로 사용하고, 처리 시간도 절반 이하라고 밝혔다.

비용 비교: Sol은 Fable 5의 3분의 1

▼ GPT-5.6 패밀리 vs Claude Fable 5 작업당 비용 및 토큰 가격

모델작업당 비용 ($)입력 ($/100만 토큰)출력 ($/100만 토큰)
Claude Fable 5 (max)2.75--
GPT-5.6 Sol (max)1.04530
GPT-5.6 Terra0.552.5015
GPT-5.6 Luna0.2116

캐시 읽기에는 90% 할인이 적용된다. Sam Altman(샘 올트먼) CEO는 CNBC 인터뷰에서 Sol이 에이전트 코딩 작업 기준 이전 모델 대비 출력 토큰을 최대 54% 절감한다고 밝혔다.

Artificial Analysis는 Sol이 "Intelligence 대비 출력 토큰 효율의 새로운 파레토 프런티어를 정의한다"고 평가했다.

보안과 ChatGPT Work

GPT-5.6은 OpenAI가 "역대 가장 강력한 사이버보안 모델"로 내세운다. 위협 모델링, 코드 리뷰·패치, 블루팀 시뮬레이션 등 방어적 활용을 지원한다. 트럼프 행정부가 악용 우려를 이유로 출시를 일시 제한했다가 7월 9일 공개 배포를 승인한 배경이기도 하다.

OpenAI는 GPT-5.6 출시와 함께 워크플로우 자동화 도구 ChatGPT Work도 선보였다. Codex 기술 기반으로 Google Drive, Slack, Salesforce, GitHub, Canva 등 주요 서비스와 통합되며, 단일 프롬프트로 문서 초안 작성부터 마케팅 자료 생성·현지화까지 처리한다. Auto-Review 기능은 중요 작업 실행 전 고급 모델이 사전 검토하며, 적대적 레드팀 테스트에서 보호 데이터 추출 시도를 100% 차단했다고 OpenAI는 밝혔다.

ChatGPT Work는 웹·모바일에서 Pro·Enterprise·Edu 플랜 우선 제공되며, 맥·윈도우 데스크톱 앱에서는 무료 플랜 포함 전 플랜에 즉시 개방됐다.

국내 개발사 관점: 비용 최적화 시나리오

국내 스타트업과 개발사가 AI 모델을 API로 도입할 때 비용은 핵심 변수다. GPT-5.6 패밀리는 작업 성격에 따라 모델을 나눠 쓰는 전략을 지원한다. 고정밀 추론이 필요한 작업에는 Sol, 중간 복잡도 작업에는 Terra($0.55/작업), 대량 반복 작업에는 Luna($0.21/작업)를 배치하면 비용을 단계적으로 낮출 수 있다. 캐시 읽기 90% 할인은 동일 컨텍스트를 반복 참조하는 RAG 파이프라인이나 문서 요약 서비스에서 절감 효과가 크다.