产品介绍
DeepSeek 是开源模型阵营的旗舰厂牌——2025 年 1 月 R1 引爆全球(发布一周登顶美区 App Store,英伟达单日蒸发 5890 亿美元市值)之后,它就成了”开源追平闭源”的代名词。当前主力 V4(2026 年 4 月 preview)分两档:V4-Pro(1.6T 总参数/49B 激活)和 V4-Flash(284B/13B 激活),全线默认 1M token 上下文,MIT 许可、权重同步上 Hugging Face。硬指标够狠:V4-Pro 在 SWE-bench Verified 拿 80.6%,开源权重第一、与 Gemini 3.1 Pro 持平;2026 年 7 月开源综合榜上也以明显优势领跑 GLM、Qwen、Kimi。
成本仍是杀手锏:API 谷时 V4-Pro 输入 ¥3、输出 ¥6 每百万 token(缓存命中输入低至 ¥0.025),按输出价算约为 Claude Opus 4.8 的 1/29、GPT-5.5 的 1/35。本地部署生态也最成熟:V4-Flash 的社区 GGUF 量化 48 小时内就位,Q4 量化单张 80GB 显卡可跑。
生态位上,它和 Kimi 代表中国开源的两条路线:DeepSeek 押”纯模型 + 极致性价比”,编码和推理是长板,事实性世界知识仍落后 Gemini 3.1 Pro 一截;API 同时兼容 OpenAI 与 Anthropic 两种协议,迁移成本几乎为零。
注意:V4 目前仍是 preview 标签(官方称可生产使用,7 月中旬转正式版);转正后启用峰谷定价,北京时间白天峰时输出价翻倍至 ¥12/M;旧模型别名 deepseek-chat / deepseek-reasoner 将于 7 月 24 日彻底停用,存量接入需迁移模型名。
模型迭代时间线
| 时间 | 版本 | 要点 |
|---|---|---|
| 2023-11 | DeepSeek Coder | 首个开源代码模型,起家之作 |
| 2024-05 | V2 | 236B MoE,确立低成本高效路线 |
| 2024-12 | V3 | 671B MoE,极低训练成本对标闭源旗舰 |
| 2025-01 | R1 | 推理模型引爆全球,英伟达单日蒸发 5890 亿美元 |
| 2025-08 | V3.1 | 思考/非思考混合一体,推理并入主线 |
| 2025-12 | V3.2 | DSA 稀疏注意力大幅降本 |
| 2026-04 | V4 preview | Pro/Flash 双档,1M 上下文,开源编码登顶 |
Pro 1.6T + Flash 284B 双档,1M 上下文,MIT 开源
DSA 稀疏注意力大幅降本,为 V4 铺路
思考/非思考混合一体,推理并入主线




