DeepSeek은 새로운 주력 모델인 V4 Pro로 API 라인업을 업데이트하는 동시에 플랫폼 전반에 걸쳐 가격을 대폭 인상했습니다. 이는 중국 연구소를 유명하게 만들고 경쟁업체를 가격 전쟁으로 몰아넣었던 최저 가격 전략에서 결정적인 전환이었습니다. 모든 DeepSeek 가격 인하를 시장을 움직이는 이벤트로 추적해 온 업계의 경우 반전도 그만큼 중요합니다. 모델 시장에 대한 최신 정보를 보려면 AI 뉴스 보도를 따르십시오.
이번 주에 업데이트된 회사의 공식 API 문서에는 이제 DeepSeek-V4-Flash-0731 버전을 실행하는 deepseek-v4-flash와 새로운 DeepSeek-V4-Pro-0813 빌드를 실행하는 deepseek-v4-pro의 두 가지 모델이 나열되어 있습니다. 둘 다 1백만 개의 토큰 컨텍스트 창, 최대 384,000개의 최대 출력 토큰, 이중 사고 및 비사고 모드를 제공하며 둘 다 Claude Code, GitHub Copilot 및 OpenCode와 같은 에이전트 도구 내에서 백엔드 모델로 사용할 수 있습니다. DeepSeek은 에이전트 개발자를 위한 툴킷인 "DeepSeek Harness"의 개발자 미리보기도 제공합니다. 이 이야기에 대한 자세한 내용은 최신 AI 동향를 참조하세요.
V4 Pro의 가격
DeepSeek가 공개한 가격에 따르면 새로운 플래그십은 모든 계층에서 정확히 3배의 Flash 가격을 제공합니다. 100만 개 토큰당 V4 Pro는 캐시된 입력 토큰의 경우 0.022달러, 사용량이 적은 시간에 캐시되지 않은 입력의 경우 0.66달러, 출력 토큰 100만 개당 1.98달러로 표시됩니다. 정점에서는 이 수치가 0.044달러, 1.32달러, 3.96달러로 두 배 증가합니다. 이에 비해 V4 Flash는 캐시 적중의 경우 $0.007/$0.014, 캐시 미스의 경우 $0.22/$0.44, 출력의 경우 $0.66/$1.32로 표시됩니다.
피크 시간은 01:00~04:00 및 06:00~10:00 UTC로 정의되며, 오프 피크 요금은 정확히 피크 시간의 절반으로 설정됩니다. 동시성도 계층화되어 있습니다. Flash 고객은 동시 요청 2,500개를 받는 반면 Pro 계정은 최대 500개로 제한됩니다.
가격이 10배나 올랐네요
DeepSeek의 가격 변화를 놓칠 수 없게 된 주간 출시 한도입니다. 월스트리트저널(WSJ)은 8월 14일 딥식크(DeepSeek)가 AI 모델 가격을 약 4배 인상했다고 보도했다. InfoWorld는 같은 날 AI 수요가 회사의 생산 능력에 부담을 준다는 이유로 일부 V4 가격이 10배 이상 올랐다고 보도했습니다. Engadget은 독자들에게 해당 모델의 가격이 "약 4배 더 비쌀 것"이라고 말했습니다.
8월 17일까지 Tech Times는 V4 API 가격이 피크 시간대에 4배로 올랐다고 보도했으며, 한국의 서울경제신문은 가장 가파른 인상을 최대 12배까지 기록하며 중국의 AI 경쟁이 이익으로 전환함에 따라 이러한 움직임을 포착했습니다. 중국 국영 글로벌타임스(Global Times)는 이번 인상을 "더 건강한 상업화"를 위한 노력의 일환으로 설명했습니다. 이는 베이징이 AI 챔피언의 우선순위로 시장 점유율뿐만 아니라 지속 가능한 단위 경제를 보고 있다는 신호입니다.
가격전쟁 무기에서 프리미엄 제품으로
전략 변화가 뚜렷하다. DeepSeek은 공격적인 가격 책정으로 글로벌 명성을 쌓았습니다. 7월 말에 새로 출시된 V4 플래시 모델은 OpenAI의 GPT-5.6 Luna와 60% 더 저렴한 가격으로 벤치마킹되었으며 모든 API 제공업체를 압박하는 바닥 경쟁을 가속화했습니다. 이제 동일한 연구소에서 프리미엄 요율을 부과하고 있습니다. V4 Pro의 최대 출력 가격은 백만 개 토큰당 3.96달러로 Flash 시대 고객이 지불하던 가격보다 훨씬 높습니다.
피크 및 오프 피크 창의 도입은 그 자체로 용량 관리 도구입니다. 가장 바쁜 시간 동안 두 배의 비용을 청구하고 프리미엄 모델의 동시성을 줄임으로써 DeepSeek 할당량을 클라우드 제공업체 및 전력 시장에 익숙한 플레이북인 더 높은 마진의 워크로드에 맞게 계산할 수 있습니다.
에이전트 시대를 위한 2계층 포트폴리오
두 모델 간의 분할은 서로 다른 구매자를 위해 설계되었습니다. 요청 동시성 제한이 2,500개로 제한되고 캐시 적중 가격이 최소인 Flash는 대용량 프로덕션 트래픽과 비용에 민감한 애플리케이션에 적합합니다. 동시 요청이 500개이고 가격이 3배인 Pro는 100만 개의 토큰 컨텍스트 창과 384,000개의 토큰 출력 한도가 중요한 추론 중심의 워크로드, 즉 긴 에이전트 세션, 대규모 코드베이스 분석 및 문서 중심의 파이프라인을 대상으로 합니다.
DeepSeek은 또한 이미 일하고 있는 개발자들에게 관심을 갖고 있습니다. 두 모델 모두 Claude Code, GitHub Copilot 및 OpenCode 내에서 백엔드로 직접 사용할 수 있으며 API는 OpenAI 및 Anthropic 호환 형식을 모두 사용합니다. 즉, 서구 공급자로부터의 마이그레이션은 단 한 줄의 구성 변경이 될 수 있습니다. 새로운 "DeepSeek Harness" 개발자 미리 보기는 해당 전략을 에이전트 하네스 빌더로 확장합니다.
개발자에게 미치는 영향
DeepSeek이 항상 저렴한 옵션일 것이라는 가정하에 비용에 민감한 애플리케이션을 구축한 개발자들에게 메시지는 적어도 중국 연구실에서는 토큰 가격이 끝없이 떨어지는 시대는 끝났다는 것입니다. 캐시 친화적 아키텍처는 이제 두 모델 모두에서 캐시 누락 호출보다 30배 낮은 입력 속도를 지불하므로 프롬프트 캐싱 규율이 모델 선택보다 훨씬 더 가치 있게 됩니다. 그리고 더 넓은 시장을 위해 DeepSeek의 피벗은 시장 바닥에서 가장 공격적인 가격 설정자를 제거합니다. 이는 일년 내내 성능만큼 비용으로 경쟁해 온 OpenAI, Anthropic 및 Google에 대한 조용한 선물입니다.
V4 Pro의 벤치마크가 프리미엄을 정당화하는지 여부는 독립적인 평가자에 의해 테스트되어야 합니다. 이미 분명한 것은 비즈니스 논리입니다. 2년 동안 전 세계 AI 사용에 보조금을 지급한 후 DeepSeek은 그에 대한 대가를 받기를 원합니다.
---
AI 최신 소식최신 AI 뉴스, 분석 및 혁신을 한 곳에서 확인하세요.
AI 뉴스 더 보기 →