V4-Pro 프리뷰는 지난주 금요일 새벽에 공개됐다.
오늘 아침, 딥시크는 API 대시보드에 공지를 게시했다: V4-Pro 75% 할인, 5월 5일까지. 동시에 전체 API의 입력 캐시 히트 가격을 기존의 10분의 1로 낮췄다.
출시부터 대폭 할인까지, 72시간도 채 걸리지 않았다.
숫자로 살펴보자
DeepSeek-V4-Pro 원래 가격:
| 항목 | 원래 가격 (100만 토큰당) |
|---|---|
| 입력 | $0.145 |
| 출력 | $3.48 |
| 캐시 히트 | 0.025위안/100만 토큰 (이미 인하된 가격, 원래의 1/10) |
프로모션 기간 동안 V4-Pro의 입력 가격은 약 $0.036/100만 토큰으로, 그 어떤 모델보다 저렴하다. 이 가격은 많은 사람들이 딥시크가 사용자 수를 늘리기 위해 적자를 내고 있는지 의심할 정도로 낮다.
현재 주류 클로즈드소스 플래그십 모델의 정가를 비교해보자:
- GPT-5.5: 표준판 $1.5/100만 입력, $10/100만 출력
- Gemini 3.1 Pro: 약 $1.25/100만 입력, $10/100만 출력
- Claude Opus 4.7: $15/100만 입력, $75/100만 출력
즉, V4-Pro의 원래 가격은 이미 GPT-5.5의 10분의 1 이하, Claude Opus 4.7의 100분의 1 이하다. 여기에 75% 할인을 더하면 격차는 더욱 벌어진다.
진짜 파괴력은 캐시 히트 가격 인하다
V4-Pro의 토큰 단가만 보면 이미 충분히 저렴하다. 하지만 더 강력한 조치는 딥시크가 전체 API 제품 라인의 입력 캐시 히트 가격을 기존의 10분의 1로 낮춘 것이다.
캐시 히트 가격이 사용되는 곳:
- 에이전트 애플리케이션이 동일한 시스템 프롬프트를 반복 실행하는 경우 — 대부분이 중복됨
- RAG 시나리오에서 동일한 컨텍스트를 모델에 자주 제공하는 경우
- 멀티턴 대화에서 이전 메시지가 반복 전송되는 경우
이러한 시나리오에서 캐시 히트 가격은 기업 사용자가 실제로 지불하는 비용의 대부분을 차지한다. 90% 인하는 개발자가 GPT와 Claude에서 딥시크로 마이그레이션하는 비용 장벽을 거의 허물었다는 것을 의미한다.
왜 이 시점에 움직였나
V4-Pro 프리뷰가 지난주 금요일(4월 24일) 새벽에 출시된 후, 시장 반응은 미묘했다. 블룸버그는 그날 "딥시크의 오랫동안 기다려온 새 모델, AI에서 미국과의 격차를 좁히지 못했다"는 제목의 기사를 냈다. 포춘은 V4-Pro가 세계 지식 벤치마크에서 여전히 Gemini 3.1 Pro에 뒤처진다고 보도했다.
간단히 말해: 기술적으로는 차별화되지 않았지만, 가격으로는 승부를 걸 수 있다.
딥시크의 전략은 명확하다 — 최상위 능력에서 단기간에 GPT-5.5와 Claude Opus에 정면으로 도전할 수 없다면, 다른 길을 간다: 개발자의 마이그레이션 비용을 무시할 수 없을 정도로 낮추는 것. 모델을 무료로 체험하게 하는 것은 드문 일이 아니지만, 출시 72시간 만에 75%를 할인하는 것은 하나의 자세다 — 아직 망설이고 있는 모든 개발자에게 말한다: 전환 비용은 내가 아껴주겠다고.
이 업계를 아는 사람들은 딥시크가 작년 1월 R1을 출시했을 때도 같은 전략을 사용했다는 것을 알고 있다: 성능은 충분하고, 가격은 압도적이었다. 그 파장은 중국 오픈소스 대형 모델의 가격 인하 물결을 촉발했고, OpenAI, Anthropic, Google도 이후 여러 차례 가격을 조정했다.
이번에도 같은 시나리오처럼 보인다.
누가 먼저 버티지 못할까
국내 경쟁사들은 이미 반응을 보였다. MiniMax의 홍콩 주식은 장중 9% 하락했고, Knowledge Atlas(Zhipu)도 비슷한 폭으로 하락했다. 모델이 나빠서가 아니다 — V4-Pro의 프로모션 가격이 그들의 가격 설정 여지를 직접적으로 압박했기 때문이다.
쉽게 말해: 오늘도 자국산 모델을 100만 토큰당 1달러에 팔려고 하는가? 개발자가 딥시크 콘솔을 열면 100만 토큰에 0.036달러가 보인다 — 27배나 비싼 이유를 어떻게 설명할 것인가?
OpenAI와 Anthropic은 단기간에 따라잡지 않을 것이다. 그들의 전략은 항상 "고가격, 고품질"이었다 — 고객은 신뢰성, SLA, 규정 준수, 엔터프라이즈 지원에 추가 비용을 지불한다. 하지만 진짜 고통을 겪는 것은 중간 계층이다:
- Mistral, Cohere와 같은 클로즈드소스지만 중간 가격대의 플레이어
- 국내 Zhipu, MiniMax, Moonshot 급
- 소위 "가성비"를 내세우는 소규모 업체들
이들은 딥시크보다 싸다고도, GPT-5.5보다 강하다고도 말할 수 없다. 이러한 압박으로 포지셔닝이 모호해진다.
이 전략의 부작용
딥시크의 이러한 접근 방식에는 명백한 대가가 있다: 마진이 마이너스가 될 수 있다.
V4-Pro는 1.6조 파라미터의 MoE 모델로, 추론당 490억 파라미터를 활성화한다. 이 규모를 Huawei Ascend 950PR에서 실행할 때 토큰당 한계 비용은 Gemini Flash나 GPT-5.4-Nano보다 훨씬 높지 않을 것이다 — 하지만 프로모션 가격과 비교하면 거의 확실히 손실이다.
그렇다면 왜 하는가? 답은 아마도 딥시크가 "사용자 수"와 "사용 빈도"를 다음 자금 조달 라운드와 IPO의 핵심 데이터 포인트로 삼고 있기 때문일 것이다. 며칠 전, 량원펑이 외부 투자자와 접촉하기 시작했다는 보도가 나왔다 — 3년간 VC를 거부한 후 처음으로 문을 연 것이다. 모델 품질은 2위권에 도달했으며, 다음에 이야기할 스토리는 "개발자 시장 점유율"이 될 것이다.
저렴함만으로는 진입 장벽이 아니다. 저렴함 + 충분한 품질 + 오픈소스 가중치 + 안정적인 API가 진입 장벽이다. 앞으로 한 달 동안 Hugging Face에서 V4-Pro의 다운로드와 API 실제 호출량이 계속 급증한다면, 이 한 수는 가치가 있었을 것이다.
다른 업체들이 따라잡을지 여부는? 6월까지는 답이 나올 것이다.
출처: DeepSeek Slashes Fees for New AI Model in Chinese Price War (Bloomberg);DeepSeek slashes AI model costs, reignites price war in sector (Investing.com / Reuters);DeepSeek V4-Pro Price Cut: 75% (TheNextWeb);China's DeepSeek Slashes AI Prices With 75% Discount on V4-Pro Model (Republic World);CocoLoop、DeepSeek's Long-Awaited New Model Fails to Narrow US Lead in AI (Bloomberg)