DeepSeek이 8월 13일 두 가지를 동시에 내놨다. 에이전트 성능을 강화한 플래그십 모델 DeepSeek-V4-Pro 정식 버전, 그리고 오픈소스 에이전트 프레임워크 DeepSeek Harness v0.1이다. 여기에 8월 16일부터 적용되는 API 가격 인상까지 더해지면서 개발자 커뮤니티의 시선이 집중됐다.

Harness: "모든 것은 플러그인이다"

DeepSeek Harness(dsh)는 Cordis 프레임워크 위에 구축된 에이전트 실행 환경이다. 핵심 설계 원칙은 단 하나다. "Everything is a plugin." 모델, 도구, 세션, 샌드박스, 파일시스템, 오케스트레이션, UI까지 사실상 모든 컴포넌트를 교체·확장할 수 있다.

npx @deepseek-ai/dsh web 명령 하나로 실행 가능하며, MIT 라이선스로 GitHub에 공개됐다. 출시 당일 GitHub 스타 약 2만 7,500개, 포크 약 2,000개를 기록했다. 단, 리포지터리 자체가 "개발자 프리뷰"임을 명시하며 "호환성을 깨는 변경이 있을 것"이라고 경고한다. 프로덕션 즉시 투입보다는 아키텍처 검토 단계로 접근하는 것이 적절하다.

Harness vs Claude Code vs OpenAI Codex

▼ 에이전트 프레임워크 3종 주요 기능 비교

항목DeepSeek HarnessClaude CodeOpenAI Codex
저장소 읽기·편집·테스트
셸·개발 도구
플래닝·서브에이전트
권한 제어·샌드박스플러그인으로 구성성숙한 내장 시스템세분화된 내장 시스템
주요 인터페이스로컬 웹 UI, 헤드리스, Python SDK터미널·VS Code·JetBrains·모바일·Slack 등CLI·IDE 확장·데스크톱·웹 등
호스팅 백그라운드 에이전트미제공
GitHub PR 워크플로미제공GitHub Actions·자동 리뷰클라우드 태스크·자동 리뷰
모델 선택DeepSeek·Anthropic·OpenAI·커스텀주로 Claude주로 OpenAI 모델
확장성최상 (컴포넌트 전체 교체 가능)강함강함
성숙도개발자 프리뷰상용 제품상용 제품 + 오픈소스 CLI
라이선스MIT상용Codex CLI 오픈소스, 클라우드는 관리형

Harness는 Claude Code나 Codex의 완전한 대체재가 아니다. 호스팅 에이전트, GitHub 네이티브 워크플로, 성숙한 IDE 통합 등에서 아직 격차가 있다. 하지만 모델 자체를 플러그인으로 취급하는 모델 무관(model-agnostic) 설계는 벤더 종속을 피하려는 팀에게 의미 있는 선택지다.

V4-Pro 정식 버전: 에이전트 성능 강화

DeepSeek-V4-Pro-0813은 4월 프리뷰 버전의 정식 전환이다. 1.6조 파라미터 규모에 토큰당 490억 파라미터가 활성화되고, 최대 100만 토큰 컨텍스트를 지원한다.

이번 버전의 핵심은 에이전트 성능 강화다. DeepSeek 자체 벤치마크 기준 Terminal Bench 2.1에서 87.9점, Toolathlon-Verified 74.1점을 기록했다(자사 발표 수치). 추론 노력을 Non-think·Think High·Think Max 세 단계로 조절할 수 있어, 루틴 작업과 복잡한 디버깅에 각각 다른 연산 자원을 배분할 수 있다.

OpenAI Responses API 네이티브 지원이 추가돼 기존 OpenAI 기반 애플리케이션의 전환 비용이 줄었다. 웹·모바일·API에서 동일하게 사용 가능하며, API 식별자 deepseek-v4-pro는 자동으로 최신 버전을 가리킨다.

API 가격 인상: 최대 1,100% 이상

8월 16일 16:00 UTC부터 기존 단일 요금제가 피크·오프피크 이중 요금제로 전환된다.

▼ DeepSeek API 가격 변동 (토큰 100만 개당, 캐시 미스 기준)

모델현재 입력현재 출력오프피크 입력오프피크 출력피크 입력피크 출력
V4-Flash$0.14$0.28$0.22$0.66$0.44$1.32
V4-Pro$0.435$0.87$0.66$1.98$1.32$3.96

피크 시간대는 UTC 기준 01:00–04:00, 06:00–10:00이며, 나머지는 오프피크다. 한국 시간으로는 오전 10시–오후 1시, 오후 3시–오후 7시가 피크에 해당한다.

"오프피크는 50% 저렴"이라는 DeepSeek의 표현은 현재 요금 대비가 아니라 새 피크 요금 대비 수치다. 입력 1백만 토큰·출력 1백만 토큰 기준 V4-Pro의 현재 비용은 $1.305인데, 오프피크 적용 시 $2.64(약 2배), 피크 시간대는 $5.28(약 4배)이 된다. Reuters는 토큰 카테고리와 시간대에 따라 인상폭이 50%에서 1,100% 이상에 달한다고 보도했다.

▼ 주요 AI 모델 API 가격 비교 (토큰 100만 개당)

모델입력 ($)출력 ($)합계 ($)제공사
DeepSeek-V4-Flash 오프피크0.220.660.88DeepSeek
DeepSeek-V4-Flash 피크0.441.321.76DeepSeek
DeepSeek-V4-Pro 오프피크0.661.982.64DeepSeek
DeepSeek-V4-Pro 피크1.323.965.28DeepSeek
GPT-5.6 Luna0.201.201.40OpenAI
Claude Opus 55.0025.0030.00Anthropic

인상 이후에도 DeepSeek은 Claude Opus 5 등 서방 주요 모델 대비 저렴한 구간을 유지한다. 그러나 피크 시간대 V4-Pro는 GPT-5.6 Luna보다 비싸지는 역전 구간이 생긴다.

국내 스타트업의 선택지 재편

이번 발표는 저비용 AI 에이전트 도입을 검토하는 국내 스타트업에게 두 가지 시사점을 준다.

첫째, API 비용 설계를 다시 짜야 한다. 피크 시간대 회피, 캐시 히트율 최적화, 자체 인프라에서 오픈웨이트 모델을 직접 운용하는 방안을 함께 검토해야 한다. DeepSeek 자신이 오픈웨이트 배포를 제공하고 있어, 호스팅 API 의존도를 낮추는 경로가 열려 있다.

둘째, Harness의 MIT 라이선스는 에이전트 인프라를 직접 구축하려는 팀에게 출발점이 될 수 있다. 다만 개발자 프리뷰 단계임을 감안해 프로덕션 적용 전 안정성 검증이 필요하다.