DeepSeek-V4 프리뷰 출시: 100만 토큰 컨텍스트, 에이전트 성능 강화 및 오픈 소스 가중치 공개
오늘(4월 24일), DeepSeek는 새로운 모델 시리즈인 DeepSeek-V4의 프리뷰 버전을 공식 출시하고 오픈 소스로 공개했습니다.
DeepSeek-V4는 최대 100만 토큰의 컨텍스트를 지원하며, 에이전트 역량, 세계 지식, 추론 능력 등에서 국내 및 오픈 소스 모델 중 선도적인 성능을 달성했습니다. 본 시리즈는 두 가지 규모로 제공됩니다.
- DeepSeek-V4-Pro — 플래그십 모델로, 총 1.6조 개의 파라미터를 가진 대규모 MoE(Mixture of Experts) 모델입니다. 추론 시 패스당 49B(490억) 파라미터만 활성화하여 높은 효율성을 구현했습니다.
- DeepSeek-V4-Flash — 더 빠르고 비용 효율적인 옵션입니다. 동일한 MoE 설계를 적용하되 규모를 대폭 줄여(총 284B / 활성화 13B) 더 빠르고 저렴한 추론이 가능합니다.
- 두 모델 모두 100만 토큰 컨텍스트 윈도우를 공유하며, API를 통해 완전히 오픈 소스로 제공됩니다.
| 모델 | 파라미터 | 활성화 | 사전 학습 데이터 | 컨텍스트 길이 | 오픈 소스 | API 서비스 | 웹/앱 액세스 모드 |
|---|---|---|---|---|---|---|---|
| deepseek-v4-pro | 1.6T | 49B | 33T | 1M | ✓ | ✓ | Expert Mode |
| deepseek-v4-flash | 284B | 13B | 32T | 1M | ✓ | ✓ | Fast Mode |
오늘부터 chat.deepseek.com 또는 공식 앱에서 DeepSeek-V4와 대화할 수 있습니다. API 역시 즉시 사용 가능하며, model_name을 deepseek-v4-pro 또는 deepseek-v4-flash로 설정하여 시작할 수 있습니다.
앞서 발표한 추측성 내용과 사전 분석(DeepSeek V4 예상 가이드 및 기술 심층 분석)에 이어, 이제 공식적인 세부 정보를 확인하게 되었습니다. 아래에서는 실제 출시 내용과 새로운 기능, 그리고 현재 AI 모델을 구축하거나 평가 중인 분들에게 이것이 어떤 의미를 갖는지 다룹니다.
DeepSeek-V4-Pro: 최고 수준의 폐쇄형 모델과 경쟁
에이전트 역량 대폭 강화. 이전 모델과 비교했을 때, DeepSeek-V4-Pro는 에이전트 작업에서 비약적인 성능 향상을 보였습니다. 에이전트 코딩 벤치마크에서 V4-Pro는 모든 오픈 소스 모델 중 선두를 달리고 있습니다. DeepSeek는 사내 코딩 에이전트로 V4-Pro를 도입했으며, 직원들의 피드백에 따르면 Claude Sonnet 4.5를 능가하는 경험을 제공하고, 비사고(non-thinking) 모드에서는 Claude Opus 4.6에 근접한 출력 품질을 보여줍니다(단, Opus 4.6의 사고 모드보다는 약간 뒤처집니다).
풍부한 세계 지식. DeepSeek-V4-Pro는 세계 지식 벤치마크에서 다른 오픈 소스 모델들을 압도하며, 최고의 폐쇄형 모델인 Gemini Pro 3.1과 근소한 차이만을 보입니다.
세계적 수준의 추론 능력. 수학, STEM, 알고리즘 코딩 평가에서 DeepSeek-V4-Pro는 기존의 모든 오픈 소스 모델을 앞서며, 세계 최고의 폐쇄형 모델들과 대등한 성능을 보여줍니다.
DeepSeek-V4-Flash: 빠르고 경제적인 선택
V4-Pro와 비교했을 때, DeepSeek-V4-Flash는 세계 지식 측면에서는 약간 부족할 수 있으나 추론 성능은 대등합니다. 적은 파라미터 수와 낮은 활성화 비용 덕분에 V4-Flash는 더 빠른 응답 속도와 더 경제적인 API 가격을 제공합니다.
에이전트 벤치마크에서 V4-Flash는 단순한 작업에서는 V4-Pro와 대등한 성능을 보이며, 복잡한 작업에서는 약간의 격차가 존재합니다.
아키텍처 혁신 및 극한의 컨텍스트 효율성

DeepSeek-V4는 토큰 차원에서 압축을 수행하는 새로운 어텐션 메커니즘을 도입했습니다. 여기에 DSA(DeepSeek Sparse Attention) 기술을 결합하여 기존 방식보다 컴퓨팅 및 메모리 요구량을 대폭 줄이면서도 세계 최고 수준의 긴 컨텍스트 성능을 달성했습니다.
향후 모든 공식 DeepSeek 서비스의 표준은 100만 토큰 컨텍스트입니다.
에이전트 활용 사례를 위한 특화 최적화
DeepSeek-V4는 Claude Code, OpenClaw, OpenCode, CodeBuddy 등 대중적인 에이전트 제품을 위해 미세 조정 및 최적화되었습니다. 코드 생성, 문서 작성 등 다양한 에이전트 기반 작업에서 성능 향상이 확인되었습니다.
이러한 프레임워크별 튜닝은 실제 현장에서 매우 중요합니다. 단독 성능은 좋지만 구조화된 에이전트 루프 내에서 일관되지 않게 동작하는 모델은 신뢰성 있는 배포가 어렵기 때문입니다. 주요 에이전트 프레임워크를 최우선 최적화 대상으로 설정한 것은 생산형 AI 활용이 어떻게 진화했는지를 잘 보여줍니다.
DeepSeek-V4 API 액세스
V4-Pro와 V4-Flash 모두 DeepSeek API를 통해 즉시 이용 가능하며, OpenAI ChatCompletions 인터페이스와 Anthropic 인터페이스를 모두 지원하므로 최소한의 코드 변경만으로 기존 통합 환경을 V4 모델로 전환할 수 있습니다. base_url은 그대로 유지되며, 모델 파라미터만 deepseek-v4-pro 또는 deepseek-v4-flash로 업데이트하면 됩니다.
두 모델 모두 최대 100만 토큰의 컨텍스트 길이를 지원하며, 비사고(non-thinking) 및 사고(thinking) 모드를 제공합니다. 사고 모드에서는 reasoning_effort 파라미터를 high 또는 max로 설정할 수 있습니다. 복잡한 에이전트 워크플로우에는 사고 모드의 max 설정을 권장합니다. API 액세스 문서: https://api-docs.deepseek.com/zh-cn/guides/thinking_mode
⚠️ 지원 중단 공지: 기존 deepseek-chat 및 deepseek-reasoner 모델 이름은 **3개월 후(2026년 7월 24일)**에 퇴역합니다. 전환 기간 동안 해당 모델들은 각각 deepseek-v4-flash의 비사고 및 사고 모드로 매핑됩니다. 프로덕션 환경에서 해당 이름을 사용 중이라면 지금 바로 마이그레이션을 준비하십시오.
오픈 소스 가중치 및 로컬 배포
- 모델 가중치:Hugging Face | ModelScope
- 기술 리포트:DeepSeek-V4 PDF
로컬 또는 온프레미스 배포를 고려하는 팀의 경우, 총 1.6T 파라미터의 V4-Pro와 같은 규모는 하드웨어 요구 사항이 상당하다는 점에 유의해야 합니다. 오픈 소스로 제공되는 점은 기업의 컴플라이언스 및 커스터마이징 측면에서 큰 이점이지만, 대부분의 팀에게는 클라우드 API 액세스가 더 실용적인 출발점이 될 것입니다.
DeepSeek-V4 출시의 의미
이번 출시에서 주목할 점은 세 가지입니다.
첫째, 100만 컨텍스트 지원은 프리미엄 옵션이 아니라 모든 공식 서비스의 기본 사양입니다. 이는 오픈 소스 생태계의 기준을 상향시키는 신호이며, 다른 모든 제공업체에 변화를 촉구하는 압박으로 작용할 것입니다.
둘째, 에이전트 우선 최적화 작업은 DeepSeek가 배포를 바라보는 시각이 성숙해졌음을 보여줍니다. 벤치마크 성능은 기본일 뿐, 실제 프로덕션에서 중요한 것은 개발자가 사용하는 도구 내부에서의 동작입니다.
셋째, Claude Opus 4.6과 비교한 솔직한 경쟁 우위 평가가 돋보입니다. 무조건적인 우위를 주장하기보다 Sonnet 4.5보다 뛰어나고, 비사고 모드에서는 Opus 4.6에 근접하며, 사고 모드에서는 Opus 4.6을 추격 중이라는 상세한 비교를 통해 신뢰도를 높였습니다.
에이전트 워크플로우, 긴 문서 처리, 복잡한 추론 작업을 위해 모델을 평가하는 개발자들에게 DeepSeek-V4-Pro는 강력한 오픈 소스 선택지가 될 것입니다. 비용 최적화나 지연 시간에 민감한 파이프라인의 경우, V4-Flash가 확실한 대안을 제공합니다.
Atlas Cloud에서 DeepSeek-V4 경험하기
Atlas Cloud는 인프라 관리 없이 세계 최고의 AI 모델을 안정적이고 경제적으로 활용하고자 하는 개발자와 팀을 위한 프로덕션급 AI 플랫폼입니다. 통합 API, 투명한 가격 정책, 엔터프라이즈 수준의 컴플라이언스(SOC 2 준수, HIPAA 대비)를 통해 개발자는 운영이 아닌 구축에만 집중할 수 있습니다.
Atlas Cloud에서의 DeepSeek. 저희는 이미 DeepSeek V3.2, V3.2 Fast, V3.2 Speciale 및 V3.2 Exp를 단일 API 엔드포인트와 합리적인 가격으로 제공하고 있습니다. Atlas Cloud의 DeepSeek 모델은 긴 컨텍스트 워크로드와 에이전트 파이프라인에 최적화되어 있으며, 양자화 손실 없이 전체 컨텍스트 윈도우를 완벽하게 지원합니다. DeepSeek 외에도 Atlas Cloud에서는 LLM 생태계 전반의 300개 이상의 모델을 이용할 수 있습니다.
DeepSeek-V4, 곧 Atlas Cloud에 출시 예정. 현재 DeepSeek-V4-Pro 및 V4-Flash 통합을 활발히 진행 중입니다. 곧 발표될 출시 공지를 기다려 주시고, 그동안 플랫폼에서 제공되는 다양한 기능을 먼저 살펴보시기 바랍니다.






