심야에 조용히 진행된 정식 버전 전환
2026년 8월 13일 심야 23시, DeepSeek 공식 API 문서의 모델 페이지가 업데이트되면서 모델 식별자가 DeepSeek-V4-Pro-0813으로 조용히 변경되었습니다. 온라인 발표회나 소셜 미디어를 통한 사전 티저 행사는 일절 진행되지 않았습니다. 그럼에도 불구하고 이번 업데이트는 해커 뉴스(Hacker News) 토론 1위에 빠르게 오르며 692개의 추천과 246개의 커뮤니티 의견을 받았습니다.
이러한 조용한 업그레이드 전략은 기존 통합 시스템의 마이그레이션 비용을 낮춰줍니다. 개발자는 API 호출 시 애플리케이션 로직을 수정할 필요 없이 시스템이 요청을 최신 0813 버전으로 자동 라우팅합니다. 이전의 구형 모델 식별자였던 deepseek-chat과 deepseek-reasoner는 지난 7월 말 정리가 완료되어 각각 Flash 아키텍처의 비추론 모드와 추론 모드로 매핑되었습니다. 이러한 조용한 정식 출시 전략은 API 서비스가 고가용성 수용 능력을 갖추었음을 나타내며, 갑작스러운 마케팅 트래픽으로 시스템 탄력성을 테스트할 필요가 없음을 보여줍니다.
그림: DeepSeek 공식 “모델 & 가격” 페이지, 모델 버전이 DeepSeek-V4-Pro-0813으로 업데이트됨. 출처: DeepSeek 오픈 플랫폼
에이전트 벤치마크에서 경량 버전을 역전
V4 시리즈의 주요 시점을 돌아보면, 2026년 4월 프리뷰(Preview) 단계 공개 당시 1.6T 파라미터를 갖춘 Pro 버전과 284B 파라미터의 Flash 버전이 함께 발표되었습니다. 그러나 7월 31일 V4-Flash-0731이 먼저 정식 버전으로 전환되었을 때, 경량 버전이 Terminal Bench 등의 벤치마크에서 82.7 대 61.8로 플래그십 프리뷰 버전을 앞서기도 했습니다. 이번 0813 정식 버전의 출시는 시리즈 내부에서 Pro 버전의 성능 위치를 다시 확고히 다졌습니다.
| 평가 벤치마크 | V4 Pro 0813 | V4 Pro Preview | Fable 5 |
|---|---|---|---|
| HLE (도구 미사용 / 도구 사용) | 42.7 / 60.0 | 37.7 / 48.2 | 53.3 / 63.0 |
| Terminal Bench 2.1 | 87.9 | 72.1 | 88.0 |
| Cybergym | 83.3 | 52.7 | 83.1 |
| DeepSWE | 62.7 | 12.8 | 70.0 |
| DSBench-FullStack | 71.1 | 41.8 | — |
공식 발표된 벤치마크 데이터에 따르면 V4 Pro 0813의 에이전트 실행 능력이 눈에 띄게 향상되었습니다. 그중 DeepSWE 점수는 프리뷰 단계의 12.8에서 62.7로 상승했고, Terminal Bench 2.1은 72.1에서 87.9로 증가했으며, Cybergym은 83.3점을 기록하며 Fable 5를 역전했습니다. DeepSWE에서 거둔 5배에 가까운 도약은 다단계 장기 코드 수정 시나리오에서 모델이 효과적인 일반화 능력을 발휘함을 입증합니다.
그림: DeepSeek V4 Pro 0813 공식 벤치마크 (에이전트 평가). 출처: DeepSeek 공식 발표 / deepseekv4pro.com 정리
물론 위 데이터는 모두 제조사 자체 측정 결과입니다. 에이전트 벤치마크 평가에서는 하네스(Harness) 환경, 프롬프트 형식, 추론 단계 설정이 최종 점수에 큰 영향을 미칩니다. HLE와 같은 도구 미사용 과제나 깊은 코드 저장소 추론에서는 Opus 4.8과 객관적인 점수 차이가 여전히 존재하므로, 커뮤니티 개발자들의 편향 없는 실측 검증이 필요합니다.
아키텍처 보완과 엔지니어링 실행의 미완성 과제
엔지니어링 사양 측면에서 V4 Pro 0813은 총 1.6T 파라미터를 보유한 모듈형 전문가(MoE) 아키텍처를 유지하며, 1회 추론 시 49B 파라미터가 활성화됩니다. 모델은 기본적으로 1M 컨텍스트 창을 지원하며, 1회 최대 출력 길이는 384K 토큰에 달합니다. 기능 제공 측면에서는 정식 버전에서 Responses API 지원이 추가되었고, Anthropic API 호환 레이어, 대화 접두사 이어쓰기, FIM 코드 완성 기능 등이 통합되었습니다.
API 인터페이스 기능은 갖추어졌으나 공식 도구 체인 생태계 구축에는 여전히 빈자리가 남아 있습니다. 이전에 커뮤니티가 기대했던 자체 에이전트 프레임워크인 DeepSeek Harness는 정식 버전과 동시에 출시되지 않았으며, 공식 문서에서는 여전히 OpenAI Codex, Claude Code, OpenClaw 등 제3자 에이전트 호스트 사용을 권장하고 있습니다. 또한 0813 버전의 오픈 소스 가중치가 MIT 라이선스에 따라 배포되는지 여부에 대해서도 공식 안내에서 명확히 밝히지 않았습니다.
1M 컨텍스트 처리 능력과 384K 출력 한도의 조합은 대규모 프로젝트 코드베이스의 전체 인덱싱을 지원할 수 있습니다. 하지만 이를 뒷받침할 공식 실행 프레임워크가 없어 엔터프라이즈 개발자가 직접 컨텍스트 잘라내기와 상태 전환 메커니즘을 설계해야 합니다. 공식 Harness 아키텍처가 동시 출시되지 않은 것은 기업용 개발자가 보안 샌드박스와 컨텍스트 정리 로직을 직접 구축해야 함을 의미합니다.
3배 가격 차이 뒤에 숨은 상업적 세분화 신호
제품의 정식 전환과 함께 단계별 요금 정책도 조정되었습니다. 공식 요금 페이지에 따르면 V4 Pro 0813의 입력 캐시 미적중 가격과 출력 가격은 100만 토큰당 각각 3.0 위안($0.435)과 6.0 위안($0.87)으로 설정되었습니다. 이는 Flash 0731의 1.0 위안 및 2.0 위안과 비교했을 때 기본 요금이 정확히 3배 높은 수준입니다.
| 요금 항목 | V4-Pro-0813 | V4-Flash-0731 |
|---|---|---|
| 입력 · 캐시 적중 | 0.025 위안 ($0.003625) | 0.02 위안 ($0.0028) |
| 입력 · 캐시 미적중 | 3.00 위안 ($0.435) | 1.00 위안 ($0.14) |
| 출력 | 6.00 위안 ($0.87) | 2.00 위안 ($0.28) |
| 단일 테넌트 동시성 한도 | 500 | 2500 |
가격 인상 외에도 동시 요청 한도가 현저히 축소되었습니다. Pro 버전의 단일 테넌트 동시성 한도는 500으로 설정되어 Flash 버전의 2500 한도의 5분의 1에 불과합니다. 동시에 피크 시간대에는 2배의 가격 배수가 계속 적용됩니다. 동시성 제한과 3배의 가격 차이 조합은 Flash가 고빈도 대규모 호출에 집중하고, Pro가 고단가 복잡 추론에 집중하는 차별화 노선을 명확히 보여줍니다.
더욱 명확한 신호는 공식 가격 페이지의 영문 주석에 숨어 있습니다. 공식 텍스트에서는 조만간 API 서비스의 전체 요금을 상향 조정할 계획이라고 명시하며 대폭적인 가격 인상을 예고했습니다. 앞서 8월 초 업계 매체를 통해 관련 가격 인상 계획이 공개된 바 있으며, 이번 공식 공지를 통해 이러한 상업적 의도가 공식 확인되었습니다. 가격 페이지의 인상 예고와 동시성 제한은 저가 보조금을 통해 높은 처리량을 확보하던 단계가 공식적으로 끝났음을 나타냅니다.
저가 API 시대의 종말과 첨단 경쟁의 새로운 규칙
DeepSeek V4 Pro 0813의 정식 출시는 오픈 아키텍처 첨단 모델이 에이전트 평가에서 보여준 신속한 엔지니어링 반복 속도를 보여줍니다. 그러나 이는 단순한 기술적 능력 보완에 그치지 않고, DeepSeek가 상업화 수확을 가속화하는 전환점이기도 합니다.
연구 개발 비용과 컴퓨팅 자원 소비가 증가함에 따라 저가 API로 시장을 확장하던 초기 전략이 마무리되고 있습니다. Flash와 Pro의 계층화된 가격 책정을 통해 저비용·고동시성 수요는 경량 모델로 유도하고, 고가치 복잡 시나리오는 프리미엄 플래그십 모델에 남겨두고 있습니다. 이어진 전체 가격 인상 계획은 기업 고객이 API 호출의 실제 투자 대비 효과(ROI)를 재평가하도록 만들 것입니다.
API 요금이 합리적 책정 단계로 접어드는 새로운 시기에는 단순한 토큰 가격 전쟁이 매력을 잃어가고 있습니다. 모델의 종합적인 제공 품질, 장기 에이전트 작업의 단일 성공률, 컨텍스트 최적화 효율이 저가 마케팅을 대신하여 모델 제공 업체의 핵심 가치를 측정하는 새로운 기준이 될 것입니다.
참고 링크:
- DeepSeek API Docs: Models & Pricing
- DeepSeek V4 Hub: V4 Pro 0813 Arrives With Strong Agent Scores
- 차오 뉴스: DeepSeek V4 Pro 정식 버전 출시: 1M 초대형 컨텍스트 + 384K 출력, Flash 대비 3배 높은 가격
- HN 토론 (49274600): DeepSeek V4 Pro 0813