DeepSeek V4(V4-Pro / V4-Flash)
DeepSeek 2026 年 6 月 27 日发布的 V4(代号 DSpark),分 Pro/Flash 两档。Pro 1.6T 参数 1M 上下文;Flash 主打超低价高吞吐($0.14/$0.28)。
发布 2026-07-20更新 2026-07-20规格
- 厂商
- 深度求索
- 发布日期
- 2026/6/27
- 类型
- coding
- 上下文窗口
- 1000K tokens
- 最大输出
- 64K tokens
- 定价
- V4-Pro ~$1.74/$3.48 · V4-Flash $0.14/$0.28
- API 兼容
- openai, deepseek
基准测试
✓ 优势
- •V4-Flash $0.14/$0.28,业界最低价档之一
- •1M 上下文,Pro/Flash 双档覆盖深度推理与高吞吐
- •V4-Pro 1.6T 参数,混合价约 $0.18/M
- •高并发低延迟,适合大规模在线业务
- •国内官方直供,无需中转
⚠ 不足
- •绝对能力天花板略低于顶级闭源前沿模型
- •生态与工具集成不如 OpenAI/Anthropic 丰富
- •多模态能力有限
- •旗舰级复杂 Agent 任务不如 Sol/Opus
适用场景
概述
DeepSeek V4(代号「DSpark」)是深度求索于 2026 年 6 月 27 日发布的新一代模型,分 V4-Pro 与 V4-Flash 两档。V4-Pro 为 1.6T 参数、1M 上下文,具备 reasoning 能力;V4-Flash 主打超低价、高吞吐($0.14/$0.28),定位高并发、低延迟的在线服务场景。
如果说 2026 上半年前沿模型的主题是「跑分内卷」,DeepSeek V4 把叙事拉回了成本——它再次扮演了「价格锚」的角色。
核心能力
击穿行业底价
V4-Flash 的 $0.14/$0.28 定价,让大规模 Agent 任务、批量数据处理、在线客服等高频调用场景的账单再降一个数量级。
| 档位 | Input | Output | 上下文 |
|---|---|---|---|
| V4-Pro | ~$1.74/M | ~$3.48/M | 1M |
| V4-Flash | $0.14/M | $0.28/M | 1M |
| 对比 GPT-5.6 Sol | $5/M | $30/M | 1.1M |
V4-Pro 混合价约 $0.18/M,是业界最低档之一。
双档覆盖
- V4-Pro:1.6T 参数,提供 reasoning 能力,适合需要深度推理但预算敏感的复杂任务
- V4-Flash:超低价高吞吐,适合客服、检索增强、内容审核等对单价极度敏感的高频场景
国内直供
作为国产模型,DeepSeek V4 官方 API 国内直供,无需海外账号或中转,配合国产工具链是当下性价比最高的组合之一。
API 调用示例
from openai import OpenAI
client = OpenAI(api_key="sk-...", base_url="https://api.deepseek.com/v1")
resp = client.chat.completions.create(
model="deepseek-v4-flash", # 或 deepseek-v4-pro
messages=[{"role": "user", "content": "批量提取这些文本的关键词"}],
)
print(resp.choices[0].message.content)
定价
见上文双档表格。V4-Flash 的定价几乎重新定义了「便宜」,让此前因成本无法落地的高频 AI 场景变得可行。
与同档模型怎么选
| 维度 | DeepSeek V4-Flash | Gemini 3.5 Flash | Grok 4.5 |
|---|---|---|---|
| Input | $0.14 | $1.50 | $2 |
| Output | $0.28 | $9 | $6 |
| 上下文 | 1M | 1M | 500K |
| 国内直供 | ✅ | ❌ | ❌ |
建议:高并发、成本敏感的在线业务首选 V4-Flash;需要深度推理的复杂任务用 V4-Pro;要更强绝对能力选 Kimi K3 或闭源前沿模型。
避坑清单
- Flash 有能力边界:超低价对应的是「够用」而非「最强」,复杂推理任务用 Pro 或旗舰模型。
- 算总账
的优势在高频、大批量场景,单次简单调用差异不明显。 - 多模态弱:纯文本/代码任务是它的主场,多模态需求另选。
FAQ
Q: V4-Pro 和 V4-Flash 怎么选? A: 看任务类型。高频、大批量、成本敏感(客服、检索、审核)选 Flash;需要深度推理的复杂任务(代码分析、多步逻辑)选 Pro。多数在线业务用 Flash 主力 + Pro 兜底难任务即可。
Q: V4 适合做 AI 编程主力吗? A: 适合成本敏感的团队做日常编码和 MVP。绝对能力不如 Sol/Opus/Sonnet 5,但性价比无出其右。对能力要求极高的复杂 Agent 任务,建议用闭源前沿模型。
Q: 国内怎么用? A: DeepSeek 官方 API 国内直供,注册即用,无需中转。
延伸阅读
- 对比同档:Kimi K3 / Grok 4.5 / GLM-5.2
- 相关模型:DeepSeek V3 / DeepSeek R1
- 相关资讯:DeepSeek V4 发布