跳到主内容
coding深度求索

DeepSeek V4(V4-Pro / V4-Flash)

DeepSeek 2026 年 6 月 27 日发布的 V4(代号 DSpark),分 Pro/Flash 两档。V4-Pro 于 8-13 正式 GA,启用峰谷定价 $0.435/$0.87;Flash 主打超低价高吞吐($0.14/$0.28)。同期 DeepSeek 开源 Agent 运行时 Harness(dsh)。

发布 2026-07-20更新 2026-08-15

规格

厂商
深度求索
发布日期
2026/6/27
类型
coding
上下文窗口
1000K tokens
最大输出
64K tokens
定价
V4-Pro GA $0.435/$0.87(峰谷定价)· V4-Flash $0.14/$0.28
API 兼容
openai, deepseek

基准测试

1.6T
V4-Pro 参数
约 $0.18/M
V4-Pro 混合价
1M
上下文

优势

  • V4-Flash $0.14/$0.28,业界最低价档之一
  • 1M 上下文,Pro/Flash 双档覆盖深度推理与高吞吐
  • V4-Pro 1.6T 参数,混合价约 $0.18/M
  • 高并发低延迟,适合大规模在线业务
  • 国内官方直供,无需中转

不足

  • 绝对能力天花板略低于顶级闭源前沿模型
  • 生态与工具集成不如 OpenAI/Anthropic 丰富
  • 多模态能力有限
  • 旗舰级复杂 Agent 任务不如 Sol/Opus

适用场景

高并发在线业务(客服/检索/审核)批量数据处理与内容生成成本受限团队的 MVP 开发需深度推理但预算敏感的任务(Pro 档)

概述

DeepSeek V4(代号「DSpark」)是深度求索于 2026 年 6 月 27 日发布的新一代模型,分 V4-ProV4-Flash 两档。V4-Pro 为 1.6T 参数、1M 上下文,具备 reasoning 能力;V4-Flash 主打超低价、高吞吐($0.14/$0.28),定位高并发、低延迟的在线服务场景。

如果说 2026 上半年前沿模型的主题是「跑分内卷」,DeepSeek V4 把叙事拉回了成本——它再次扮演了「价格锚」的角色。

2026-08 更新(V4 Pro 正式 GA):V4-Pro 于 8-13 正式 GA(General Availability),启用峰谷定价,价格从预览期的约 $1.74/$3.48 大幅下调至 $0.435 / $0.87 每百万 token,1M 上下文不变。同期 DeepSeek 开源首款 Agent 产品 Harness(dsh)(AGENT = MODEL + HARNESS,一切皆插件),把模型之外的工程化能力做成可组装运行时——V4 系列因此既是便宜的底座模型,也是 Harness 的默认后端之一。

核心能力

击穿行业底价

V4-Flash 的 $0.14/$0.28 定价,让大规模 Agent 任务、批量数据处理、在线客服等高频调用场景的账单再降一个数量级。

档位InputOutput上下文
V4-Pro(GA 峰谷价)$0.435/M$0.87/M1M
V4-Flash$0.14/M$0.28/M1M
对比 GPT-5.6 Sol$5/M$30/M1.1M

V4-Pro GA 价较预览期下调明显($1.74/$3.48 → $0.435/$0.87),混合价约 $0.18/M,是业界最低档之一。

双档覆盖

  • V4-Pro:1.6T 参数,提供 reasoning 能力,适合需要深度推理但预算敏感的复杂任务
  • V4-Flash:超低价高吞吐,适合客服、检索增强、内容审核等对单价极度敏感的高频场景

国内直供

作为国产模型,DeepSeek V4 官方 API 国内直供,无需海外账号或中转,配合国产工具链是当下性价比最高的组合之一。

API 调用示例

from openai import OpenAI
client = OpenAI(api_key="sk-...", base_url="https://api.deepseek.com/v1")

resp = client.chat.completions.create(
    model="deepseek-v4-flash",   # 或 deepseek-v4-pro
    messages=[{"role": "user", "content": "批量提取这些文本的关键词"}],
)
print(resp.choices[0].message.content)

定价

见上文双档表格。V4-Flash 的定价几乎重新定义了「便宜」,让此前因成本无法落地的高频 AI 场景变得可行。

与同档模型怎么选

维度DeepSeek V4-FlashGemini 3.5 FlashGrok 4.5
Input$0.14$1.50$2
Output$0.28$9$6
上下文1M1M500K
国内直供

建议:高并发、成本敏感的在线业务首选 V4-Flash;需要深度推理的复杂任务用 V4-Pro;要更强绝对能力选 Kimi K3 或闭源前沿模型。

避坑清单

  • Flash 有能力边界:超低价对应的是「够用」而非「最强」,复杂推理任务用 Pro 或旗舰模型。
  • 算总账 的优势在高频、大批量场景,单次简单调用差异不明显。
  • 多模态弱:纯文本/代码任务是它的主场,多模态需求另选。

FAQ

Q: V4-Pro 和 V4-Flash 怎么选? A: 看任务类型。高频、大批量、成本敏感(客服、检索、审核)选 Flash;需要深度推理的复杂任务(代码分析、多步逻辑)选 Pro。多数在线业务用 Flash 主力 + Pro 兜底难任务即可。

Q: V4 适合做 AI 编程主力吗? A: 适合成本敏感的团队做日常编码和 MVP。绝对能力不如 Sol/Opus/Sonnet 5,但性价比无出其右。对能力要求极高的复杂 Agent 任务,建议用闭源前沿模型。

Q: 国内怎么用? A: DeepSeek 官方 API 国内直供,注册即用,无需中转。

延伸阅读

相关工具

相关对比

Augment Code vs Cursor:企业 AI 编程怎么选?Context Engine vs AI IDE 对比

Augment Code vs Cursor 2026 选型对比:Context Engine 全仓索引的企业 AI 平台 vs SpaceX 收购的 AI IDE 天花板,从形态、Context 覆盖、长任务、价格、合规、中文支持和适合人群 8 个维度判断,帮你选对企业 AI 编程工具。

Cursor vs Aider:GUI IDE 还是 CLI?2026 对比

Cursor vs Aider 2026 选型对比:GUI IDE vs Git 原生 CLI,从 Composer vs Architect 双模型、Tab 补全、多模型 BYOK、价格计费、开源与否和适合人群判断,帮开发者选对。Cursor 是闭源 VS Code fork 月费 $20,Aider 是开源 Apache-2.0 CLI 自带 API key。

Cursor vs Claude Code:什么时候用哪个?(2026 实测选型)

Cursor 和 Claude Code 到底怎么选?一句话结论 + 决策树 + 价格实测 + 国内可用性对比。GUI 派选 Cursor,终端长任务派选 Claude Code,最优解其实是共存。

Cursor vs GitHub Copilot:AI IDE 还是插件?2026 对比

Cursor vs GitHub Copilot 2026 选型对比:AI 原生 IDE vs IDE 插件,从 Composer vs Agent Mode、Tab 补全、多模型、AI Credits 计费、企业版和适合人群判断,帮开发者选对。Cursor 是 VS Code fork 重写交互层,Copilot 是 VS Code 插件继承原生体验。两家都已切 usage 制。

Cursor vs Trae:国内开发者怎么选?价格、模型、网络和真实体验对比

Cursor vs Trae 2026 选型对比:从价格、模型能力、国内访问、Builder/Composer、多文件改写、MCP 生态和适合人群判断,帮国内开发者决定继续用 Cursor,还是切到字节 Trae。

Cursor vs v0:AI 编程 IDE vs AI 前端生成器怎么选?

Cursor vs v0 2026 选型对比:Anysphere 的 AI 原生 IDE vs Vercel 的 AI 前端组件生成器。从定位、工作流、输出物、价格、适合人群 6 个维度帮你选对工具:全栈工程选 Cursor,快速 UI 原型选 v0。