DeepSeek V4 프리뷰, 오픈웨이트 MoE 모델과의 격차를 좁히다
1.6T 파라미터(활성 49B)의 V4-Pro와 284B의 V4-Flash, 둘 다 1M 컨텍스트로 Hugging Face에 오픈웨이트로 공개
리스트에 추가
아직 리스트가 없습니다.
요약
Deepseek는 2026년 4월 24일 V4 프리뷰를 공개하며 deepseek-v4-pro와 deepseek-v4-flash를 API 모델 ID로 올리고 Hugging Face에 오픈웨이트를 공개했다. V4-Pro는 활성 49B을 갖춘 1.6조 파라미터 mixture-of-experts 모델, V4-Flash는 활성 13B을 갖춘 284B이며, 둘 다 1M 토큰 컨텍스트를 지닌다. DeepSeek은 V4가 프런티어 모델과의 격차를 좁혀 추론에서 일부 GPT-5.2와 Gemini 3.0 Pro 결과를 능가한다고 주장한다. 완성 일정이 없는 프리뷰로 남아 있다. 토큰당 비용이 훨씬 저렴한 이 오픈웨이트 공개는 오픈 대 클로즈드 분열을 한층 날카롭게 하고, DeepSeek이 훈련하는 미국의 칩 수출 제약에 역행한다.
숫자로 보기
- 1.6T, V4-Pro 파라미터(활성 49B).
- 284B, V4-Flash 파라미터(활성 13B).
- 1M 토큰, 두 모델의 컨텍스트 창.
- 2026년 4월 24일, 프리뷰 공개.
- 오픈웨이트, Hugging Face에 공개.
왜 중요한가
중국 연구소가 내놓은 프런티어에 근접한 오픈웨이트 모델은 가격에서 클로즈드 연구소를 밑돌고, 미국이 최상위 미국 모델 주위에 세우고 있는 접근 관문을 없앤다. Anthropic 수출 통제 명령이 드러낸 비대칭이다. 칩 통제에도 불구하고 중국을 프런티어에서 경쟁력 있게 유지한다.
지켜볼 점
- GPT-5.5, Gemini 3.5, Opus 4.8 대비 독립 벤치마크.
- 완성된(프리뷰가 아닌) V4와 가격.
- 미국 수출 정책이 중국의 오픈웨이트 모델을 겨냥할지 여부.