跳到主内容
AIHO 2026 全新改版上线
coding深度求索

DeepSeek V4(V4-Pro / V4-Flash)

DeepSeek 2026 年 6 月 27 日发布的 V4(代号 DSpark),分 Pro/Flash 两档。Pro 1.6T 参数 1M 上下文;Flash 主打超低价高吞吐($0.14/$0.28)。

发布 2026-07-20更新 2026-07-20

规格

厂商
深度求索
发布日期
2026/6/27
类型
coding
上下文窗口
1000K tokens
最大输出
64K tokens
定价
V4-Pro ~$1.74/$3.48 · V4-Flash $0.14/$0.28
API 兼容
openai, deepseek

基准测试

1.6T
V4-Pro 参数
约 $0.18/M
V4-Pro 混合价
1M
上下文

✓ 优势

  • V4-Flash $0.14/$0.28,业界最低价档之一
  • 1M 上下文,Pro/Flash 双档覆盖深度推理与高吞吐
  • V4-Pro 1.6T 参数,混合价约 $0.18/M
  • 高并发低延迟,适合大规模在线业务
  • 国内官方直供,无需中转

⚠ 不足

  • 绝对能力天花板略低于顶级闭源前沿模型
  • 生态与工具集成不如 OpenAI/Anthropic 丰富
  • 多模态能力有限
  • 旗舰级复杂 Agent 任务不如 Sol/Opus

适用场景

高并发在线业务(客服/检索/审核)批量数据处理与内容生成成本受限团队的 MVP 开发需深度推理但预算敏感的任务(Pro 档)

概述

DeepSeek V4(代号「DSpark」)是深度求索于 2026 年 6 月 27 日发布的新一代模型,分 V4-ProV4-Flash 两档。V4-Pro 为 1.6T 参数、1M 上下文,具备 reasoning 能力;V4-Flash 主打超低价、高吞吐($0.14/$0.28),定位高并发、低延迟的在线服务场景。

如果说 2026 上半年前沿模型的主题是「跑分内卷」,DeepSeek V4 把叙事拉回了成本——它再次扮演了「价格锚」的角色。

核心能力

击穿行业底价

V4-Flash 的 $0.14/$0.28 定价,让大规模 Agent 任务、批量数据处理、在线客服等高频调用场景的账单再降一个数量级。

档位InputOutput上下文
V4-Pro~$1.74/M~$3.48/M1M
V4-Flash$0.14/M$0.28/M1M
对比 GPT-5.6 Sol$5/M$30/M1.1M

V4-Pro 混合价约 $0.18/M,是业界最低档之一。

双档覆盖

  • V4-Pro:1.6T 参数,提供 reasoning 能力,适合需要深度推理但预算敏感的复杂任务
  • V4-Flash:超低价高吞吐,适合客服、检索增强、内容审核等对单价极度敏感的高频场景

国内直供

作为国产模型,DeepSeek V4 官方 API 国内直供,无需海外账号或中转,配合国产工具链是当下性价比最高的组合之一。

API 调用示例

from openai import OpenAI
client = OpenAI(api_key="sk-...", base_url="https://api.deepseek.com/v1")

resp = client.chat.completions.create(
    model="deepseek-v4-flash",   # 或 deepseek-v4-pro
    messages=[{"role": "user", "content": "批量提取这些文本的关键词"}],
)
print(resp.choices[0].message.content)

定价

见上文双档表格。V4-Flash 的定价几乎重新定义了「便宜」,让此前因成本无法落地的高频 AI 场景变得可行。

与同档模型怎么选

维度DeepSeek V4-FlashGemini 3.5 FlashGrok 4.5
Input$0.14$1.50$2
Output$0.28$9$6
上下文1M1M500K
国内直供

建议:高并发、成本敏感的在线业务首选 V4-Flash;需要深度推理的复杂任务用 V4-Pro;要更强绝对能力选 Kimi K3 或闭源前沿模型。

避坑清单

  • Flash 有能力边界:超低价对应的是「够用」而非「最强」,复杂推理任务用 Pro 或旗舰模型。
  • 算总账 的优势在高频、大批量场景,单次简单调用差异不明显。
  • 多模态弱:纯文本/代码任务是它的主场,多模态需求另选。

FAQ

Q: V4-Pro 和 V4-Flash 怎么选? A: 看任务类型。高频、大批量、成本敏感(客服、检索、审核)选 Flash;需要深度推理的复杂任务(代码分析、多步逻辑)选 Pro。多数在线业务用 Flash 主力 + Pro 兜底难任务即可。

Q: V4 适合做 AI 编程主力吗? A: 适合成本敏感的团队做日常编码和 MVP。绝对能力不如 Sol/Opus/Sonnet 5,但性价比无出其右。对能力要求极高的复杂 Agent 任务,建议用闭源前沿模型。

Q: 国内怎么用? A: DeepSeek 官方 API 国内直供,注册即用,无需中转。

延伸阅读

相关工具