DeepSeek V4(V4-Pro / V4-Flash)
DeepSeek 2026 年 6 月 27 日发布的 V4(代号 DSpark),分 Pro/Flash 两档。V4-Pro 于 8-13 正式 GA,启用峰谷定价 $0.435/$0.87;Flash 主打超低价高吞吐($0.14/$0.28)。同期 DeepSeek 开源 Agent 运行时 Harness(dsh)。
发布 2026-07-20更新 2026-08-15规格
- 厂商
- 深度求索
- 发布日期
- 2026/6/27
- 类型
- coding
- 上下文窗口
- 1000K tokens
- 最大输出
- 64K tokens
- 定价
- V4-Pro GA $0.435/$0.87(峰谷定价)· V4-Flash $0.14/$0.28
- API 兼容
- openai, deepseek
基准测试
优势
- •V4-Flash $0.14/$0.28,业界最低价档之一
- •1M 上下文,Pro/Flash 双档覆盖深度推理与高吞吐
- •V4-Pro 1.6T 参数,混合价约 $0.18/M
- •高并发低延迟,适合大规模在线业务
- •国内官方直供,无需中转
不足
- •绝对能力天花板略低于顶级闭源前沿模型
- •生态与工具集成不如 OpenAI/Anthropic 丰富
- •多模态能力有限
- •旗舰级复杂 Agent 任务不如 Sol/Opus
适用场景
概述
DeepSeek V4(代号「DSpark」)是深度求索于 2026 年 6 月 27 日发布的新一代模型,分 V4-Pro 与 V4-Flash 两档。V4-Pro 为 1.6T 参数、1M 上下文,具备 reasoning 能力;V4-Flash 主打超低价、高吞吐($0.14/$0.28),定位高并发、低延迟的在线服务场景。
如果说 2026 上半年前沿模型的主题是「跑分内卷」,DeepSeek V4 把叙事拉回了成本——它再次扮演了「价格锚」的角色。
2026-08 更新(V4 Pro 正式 GA):V4-Pro 于 8-13 正式 GA(General Availability),启用峰谷定价,价格从预览期的约 $1.74/$3.48 大幅下调至 $0.435 / $0.87 每百万 token,1M 上下文不变。同期 DeepSeek 开源首款 Agent 产品 Harness(dsh)(AGENT = MODEL + HARNESS,一切皆插件),把模型之外的工程化能力做成可组装运行时——V4 系列因此既是便宜的底座模型,也是 Harness 的默认后端之一。
核心能力
击穿行业底价
V4-Flash 的 $0.14/$0.28 定价,让大规模 Agent 任务、批量数据处理、在线客服等高频调用场景的账单再降一个数量级。
| 档位 | Input | Output | 上下文 |
|---|---|---|---|
| V4-Pro(GA 峰谷价) | $0.435/M | $0.87/M | 1M |
| V4-Flash | $0.14/M | $0.28/M | 1M |
| 对比 GPT-5.6 Sol | $5/M | $30/M | 1.1M |
V4-Pro GA 价较预览期下调明显($1.74/$3.48 → $0.435/$0.87),混合价约 $0.18/M,是业界最低档之一。
双档覆盖
- V4-Pro:1.6T 参数,提供 reasoning 能力,适合需要深度推理但预算敏感的复杂任务
- V4-Flash:超低价高吞吐,适合客服、检索增强、内容审核等对单价极度敏感的高频场景
国内直供
作为国产模型,DeepSeek V4 官方 API 国内直供,无需海外账号或中转,配合国产工具链是当下性价比最高的组合之一。
API 调用示例
from openai import OpenAI
client = OpenAI(api_key="sk-...", base_url="https://api.deepseek.com/v1")
resp = client.chat.completions.create(
model="deepseek-v4-flash", # 或 deepseek-v4-pro
messages=[{"role": "user", "content": "批量提取这些文本的关键词"}],
)
print(resp.choices[0].message.content)
定价
见上文双档表格。V4-Flash 的定价几乎重新定义了「便宜」,让此前因成本无法落地的高频 AI 场景变得可行。
与同档模型怎么选
| 维度 | DeepSeek V4-Flash | Gemini 3.5 Flash | Grok 4.5 |
|---|---|---|---|
| Input | $0.14 | $1.50 | $2 |
| Output | $0.28 | $9 | $6 |
| 上下文 | 1M | 1M | 500K |
| 国内直供 |
建议:高并发、成本敏感的在线业务首选 V4-Flash;需要深度推理的复杂任务用 V4-Pro;要更强绝对能力选 Kimi K3 或闭源前沿模型。
避坑清单
- Flash 有能力边界:超低价对应的是「够用」而非「最强」,复杂推理任务用 Pro 或旗舰模型。
- 算总账
的优势在高频、大批量场景,单次简单调用差异不明显。 - 多模态弱:纯文本/代码任务是它的主场,多模态需求另选。
FAQ
Q: V4-Pro 和 V4-Flash 怎么选? A: 看任务类型。高频、大批量、成本敏感(客服、检索、审核)选 Flash;需要深度推理的复杂任务(代码分析、多步逻辑)选 Pro。多数在线业务用 Flash 主力 + Pro 兜底难任务即可。
Q: V4 适合做 AI 编程主力吗? A: 适合成本敏感的团队做日常编码和 MVP。绝对能力不如 Sol/Opus/Sonnet 5,但性价比无出其右。对能力要求极高的复杂 Agent 任务,建议用闭源前沿模型。
Q: 国内怎么用? A: DeepSeek 官方 API 国内直供,注册即用,无需中转。
延伸阅读
- 对比同档:Kimi K3 / Grok 4.5 / GLM-5.2
- 相关模型:DeepSeek V3 / DeepSeek R1
- Agent 运行时:DeepSeek Harness(dsh)
- 相关资讯:DeepSeek V4 发布 / DeepSeek Harness 开源
相关工具
Augment Code vs Cursor:企业 AI 编程怎么选?Context Engine vs AI IDE 对比
Augment Code vs Cursor 2026 选型对比:Context Engine 全仓索引的企业 AI 平台 vs SpaceX 收购的 AI IDE 天花板,从形态、Context 覆盖、长任务、价格、合规、中文支持和适合人群 8 个维度判断,帮你选对企业 AI 编程工具。
Cursor vs Aider:GUI IDE 还是 CLI?2026 对比
Cursor vs Aider 2026 选型对比:GUI IDE vs Git 原生 CLI,从 Composer vs Architect 双模型、Tab 补全、多模型 BYOK、价格计费、开源与否和适合人群判断,帮开发者选对。Cursor 是闭源 VS Code fork 月费 $20,Aider 是开源 Apache-2.0 CLI 自带 API key。
Cursor vs Claude Code:什么时候用哪个?(2026 实测选型)
Cursor 和 Claude Code 到底怎么选?一句话结论 + 决策树 + 价格实测 + 国内可用性对比。GUI 派选 Cursor,终端长任务派选 Claude Code,最优解其实是共存。
Cursor vs GitHub Copilot:AI IDE 还是插件?2026 对比
Cursor vs GitHub Copilot 2026 选型对比:AI 原生 IDE vs IDE 插件,从 Composer vs Agent Mode、Tab 补全、多模型、AI Credits 计费、企业版和适合人群判断,帮开发者选对。Cursor 是 VS Code fork 重写交互层,Copilot 是 VS Code 插件继承原生体验。两家都已切 usage 制。
Cursor vs Trae:国内开发者怎么选?价格、模型、网络和真实体验对比
Cursor vs Trae 2026 选型对比:从价格、模型能力、国内访问、Builder/Composer、多文件改写、MCP 生态和适合人群判断,帮国内开发者决定继续用 Cursor,还是切到字节 Trae。
Cursor vs v0:AI 编程 IDE vs AI 前端生成器怎么选?
Cursor vs v0 2026 选型对比:Anysphere 的 AI 原生 IDE vs Vercel 的 AI 前端组件生成器。从定位、工作流、输出物、价格、适合人群 6 个维度帮你选对工具:全栈工程选 Cursor,快速 UI 原型选 v0。