跳到主内容
规格 · 定价 · 对比

AI 模型库

主流 AI 大模型档案库:上下文窗口、定价、基准测试、优劣分析、适用场景,帮你选对模型。

Qwen-Image-2.1

阿里云通义千问

视觉

阿里通义千问 Qwen-Image-2.1 详解:7B(7.1B DiT)开源权重,生成与编辑合一,原生 RGBA 透明输出,单次最多 10 张参考图,默认 2K 出图。Day-0 支持 ComfyUI / Diffusers / vLLM-Omni / SGLang,RTX 4090 上 1024×1024 约 18.7 秒。采用 Qwen 研究许可,商用需另议。

定价权重免费(Qwen 研究许可,商用需单独授权)
生成与编辑共用一个 7B checkpoint,无需切换模型原生 RGBA 透明输出,免抠图 / 免 matting 节点

Qwen3.8-LiveTranslate

阿里巴巴(通义千问)

多模态

阿里千问 2026-09-19 发布的实时同声传译大模型:Interleave 架构 + Hybrid MoE Thinker–Talker 双模块,字均延迟(LAAL)2.8 秒降至 2.3 秒,支持 60 种语言;新增实时说话人分离、原文译文同帧同出、长上下文消歧三大能力,官方评测在 Omnilingua-MSpeaker 与 FLEURS 上领先主流实时同传系统。

定价API 价格与上一代 Qwen3.5-LiveTranslate 基本持平(北京区四项价格完全相同 · 新加坡区略降)
字均延迟(LAAL)从上代 2.8 秒降至 2.3 秒,官方评测在翻译质量、延迟、ASR、TTS 四维领先主流系统实时说话人分离:多人交替发言可区分说话人,译文语音稳定保留对应音色

阶跃星辰 Step 5 Preview

阶跃星辰

推理

阶跃星辰(StepFun)Step 5 Preview 模型详解:600B 稀疏 MoE(激活约 27B)、92 层窄深结构、1M 上下文,主打长程 Agent 与编程。Artificial Analysis 智能指数 44,API 价 $1/$2.7 每百万 token,BF16 权重计划 2026-10-15 开放。

上下文1000K
定价输入 $1.00/M · 输出 $2.70/M token(API only)
600B 稀疏 MoE、激活约 27B,长程 Agent 与编程定位1M 上下文且输入/输出双向 1M,长任务不必切片

星辰 Xing4.0-29B-A4B

中国电信

编程

中国电信 2026-09-17 发布的星辰 Xing4.0-29B-A4B,MoE 架构总参 29B、激活 4B,是国内首个基于国产算力与国产框架完成训练、面向复杂工程任务深度优化的百亿参数模型;低比特量化后可在消费级显卡本地运行,已开源上线多个社区。

定价开源权重免费自部署(已上线 GitHub / Hugging Face / Gitee / 魔搭 / 魔乐);官方 API 定价待核实
国内首个基于国产算力与国产框架完成训练、面向复杂工程任务深度优化的百亿参数大模型MoE 架构总参 29B、激活仅 4B,配合低比特量化可在消费级显卡上本地运行

Gemini 3.8 Live

Google DeepMind

多模态

Google DeepMind 于 2026-09-15 发布的原生语音到语音(speech-to-speech)实时对话模型,含标准版与 Extended Thinking 两个版本。Extended Thinking 可在说话的同时后台推理、异步调用工具并实时汇报进度,以 82.6 分登顶 Artificial Analysis 语音质量指数;实测每小时输入音频成本 3.50 美元,标准版低至 0.84 美元。支持 97 种语言单次对话内切换、近实时视觉输入、128K 上下文,输出音频带 SynthID 水印。

上下文131K
定价音频输入 $3.00/百万 token($0.005/分钟)·音频输出 $12.00/百万 token($0.018/分钟)·文本输入 $0.75/百万·文本输出 $4.50/百万·图像视频输入 $1.00/百万
原生端到端语音到语音,跳过转写与合成环节,目标端到端延迟 200ms 以内并保留完整声学上下文(语调、重音、迟疑)Extended Thinking 可边推理边说话,工具调用在后台异步执行,用「让我查一下」这类自然回应填充等待,消除对话空白

Grok 4.7

xAI

推理

Grok 4.7 是 xAI 于 2026-09-12 发布的旗舰模型,参数规模 2.1 万亿(较 Grok 4.6 的 1.5 万亿 +40%),马斯克称其工程与科学推理优于所有同类模型、token 效率更高,并以 SpaceX 工程数据补充训练。⚠️ 截至 2026-09-16,xAI 未公开 4.7 的官方 model card、上下文窗口、基准套件与 API 定价,文档库最新条目仍为 grok-4.6,本卡参数与能力口径待核实。

定价⚠️ 待核实:截至 2026-09-16 官方未公开;前代 Grok 4.6 为 $2 / $6 每百万 token
参数规模 2.1 万亿,较 Grok 4.6 的 1.5 万亿增长约 40%,是当前公开参数量最大的前沿模型之一官方口径主打工程与科学推理,并以 SpaceX 真实工程数据做补充训练强化真实世界工程任务

DeepSeek V4.1-Flash

深度求索

编程

DeepSeek V4.1-Flash 是深度求索 2026-09-10 发布的 552B MoE 模型,采用 Causal Encoder–Decoder 非对称架构(输入激活 8B / 输出激活 16B),支持 1M 上下文与原生视觉理解,权重以 MIT 许可开源。API 闲时 $0.15/$0.60 每百万 token,并自 2026-09-14 起接管全部 deepseek-v4-pro 请求。

上下文1000K
定价API 闲时 $0.15/$0.60 每百万 token,峰值 $0.30/$1.20;缓存命中 $0.003/$0.006 · 权重 MIT 免费自部署
MIT 许可开源权重,可私有化部署,源码不出境场景友好闲时 $0.15/$0.60 + 缓存命中 $0.003,长上下文 Agent 跑批成本优势明显

SWE-2

Cognition

编程

Cognition 于 2026 年 9 月 10 日发布的编程模型 SWE-2,基于月之暗面 Kimi K3(2.8T 参数)后训练而来。官方称 FrontierCode 1.1 Main 得 50.0%,距 Claude Fable 5.1 仅 1 分而成本低 64%;Terminal-Bench 2.1 达 92.8%,但 Terminal-Bench 4 仅 27.3%。仅在 Devin 产品线内提供,无开源权重、无独立 API。

定价无独立 API / 无开源权重;随 Devin Desktop / CLI / Web / Fusion 订阅提供
性价比是当前卖点:FrontierCode 1.1 Main 50.0%,距 Claude Fable 5.1 的 50.9% 只差 1 分,官方称成本低 64%Terminal-Bench 2.1 达 92.8%,官方表中为该基准最高分

GPT-6 Astra

OpenAI

编程

OpenAI 2026 年 9 月 3 日发布的新旗舰 GPT-6 Astra,GPT-5.6 Sol 的继任者,1.05M 上下文,主打 computer use 与长程 Agent 任务,OSWorld 2.0 达 72.6%,定价 $10/$50 每百万 token。

上下文1050K
定价$10 输入 / $50 输出 / 百万 token(缓存读 $1、缓存写 $12.50)
computer use 头牌:OSWorld 2.0 达 72.6%,且单任务耗时比 GPT-5.6 Sol 缩短约 47%1.05M 超长上下文,512K-1M 区间检索可靠性 96.3%(MRCR v2)

Gemini 3.8 Flash / Flash Cyber

Google

多模态

Google 2026 年 9 月 2 日发布的 Gemini 3.8 Flash 与安全特化版 Flash Cyber,官方称「迄今最强推理与编程模型」,促销价 $0.75/$3.75 与 3.7 Flash 持平,Flash Cyber 面向 Fairwind 计划受信防御方。

上下文1049K
定价$0.75 / $3.75(促销价至 2026-12-31,之后 $1.50/$7.50)/ 百万 token
Google 自评「迄今最强推理与编程模型」,六周内第三个 Flash 版本,同价提速不涨价DeepSWE v1.1 上以零头成本超过多数更大旗舰,长程软件工程性价比突出

Claude Fable 5.1 / Mythos 5.1

Anthropic

编程

Anthropic 2026 年 9 月 1 日发布的 Claude Fable 5.1,定位高要求推理与长程 agentic 工作,1M 上下文,$10/$50 定价不变但缓存读降至 $0.25,配套受邀制 Mythos 5.1(Project Glasswing)。

上下文1000K
定价$10 输入 / $50 输出 / 百万 token(缓存读 $0.25,较常规降 75%)
官方定位「高要求推理与长程 agentic 工作」,是 Anthropic 当前能力天花板长会话成本优化:缓存读降到 $0.25/MTok(原价 1/4),长程 Agent 的重复上下文成本大幅下降

GLM-5.3

智谱 AI

编程

智谱 AI 2026 年 8 月 14 日发布的 GLM-5.3,总参数 7430 亿,编程与智能体能力逼近 Claude Fable 5,是当前排名最高的开源模型,完整权重将于约两周后开源、API 即将上线。

定价未公布(两周后开源完整权重,API 即将上线)
总参数 7430 亿,当前排名最高的开源模型编程与智能体能力逼近 Claude Fable 5,国产开源第一梯队

Gemini 3.7 Flash

Google

多模态

Google 2026 年 8 月发布的 agent-first Flash 模型,发布价 $0.75/$3.75 每百万 token(约为 3.6 Flash 一半),1M 上下文,编程与 Agent 基准大幅跳升,驱动 Gemini Spark 常驻 Agent。

上下文1049K
定价$0.75 / $3.75(至 2026-12-31,之后 $1.50/$7.50)/ 百万 token
agent-first 定位:更 diligent 地思考、遇阻自适应、指令遵循更忠实发布价较 3.6 Flash 腰斩($0.75/$3.75),直冲「工作马」成本底线

Grok 4.6

xAI

编程

xAI 2026 年 8 月发布的 Grok 4.6,经 agentic RL 训练,AA 智能指数 61 追平 GPT-5.6 Sol,定价维持 $2/$6。配套 Grok Bot——拥有独立电脑、可端到端自主完成任务的 AI 队友。

上下文500K
定价$2 / $6(与 4.5 同价)
经 agentic RL 训练,AA 智能指数 61,追平 GPT-5.6 Sol定价维持 $2/$6,性价比延续 4.5 的优势

Gemini 3.6 Flash

Google

多模态

Google 于 2026 年 7 月 21 日发布的稳定版 Flash 模型,1M 上下文、65K 输出,定价 $1.50/$7.50 每百万 token,定位高吞吐多模态场景,原生支持函数调用与流式。

上下文1049K
定价$1.50 / $7.50(cache $0.15)/ 百万 token
原生多模态:文本 / 图像 / 视频 / 音频统一输入,响应快1M 输入上下文 + 65K 输出,长文档与代码库友好

Kimi K3

月之暗面

编程

Kimi 是月之暗面(Moonshot AI)的旗舰模型系列。最新 Kimi K3 为 2.8T 开源权重、1M 上下文,Arena.ai 编程榜全球第一。本文评测其编程能力、定价与自托管价值,帮你判断是否值得用。

上下文1000K
定价混合价约 $2.3/M(输入 ¥20/M · 输出 ¥100/M)
Arena.ai 编程榜全球第一2.8T 参数,当前最大开源中文大模型

GPT-5.6(Sol / Terra / Luna)

OpenAI

编程

OpenAI 2026 年 7 月 9 日全量 GA 的 GPT-5.6 家族,分 Sol/Terra/Luna 三档,1.1M 上下文,Terminal-Bench 2.1 最高 91.9%,全平台覆盖。

上下文1100K
定价Sol $5/$30 · Terra $2.50/$15 · Luna $1/$6
Terminal-Bench 2.1 最高 91.9%(Sol Ultra),编程与终端 Agent 能力顶尖1.1M 超长上下文,reasoning + vision 全能

Grok 4.5

xAI

编程

xAI 2026 年 7 月 8 日发布的 Grok 4.5,1.5T MoE、最高 500K 上下文,用 Cursor 会话数据联合训练。定价 $2/$6 约为同级一半,主打编程性价比。

上下文500K
定价标准 $2/$6 · fast $4/$18
定价 $2/$6,约为 Opus/Sol 级模型的一半,性价比突出用数万亿 token 的 Cursor 会话数据联合训练,编程与 Agent 强

Claude Sonnet 5

Anthropic

编程

Anthropic 2026 年 6 月 30 日发布的 Claude Sonnet 5,1M 上下文,SWE-bench Verified 85.2%,现为 claude.ai 默认模型,促销期定价 $2/$10。

上下文1000K
定价促销 $2/$10(至 2026-08-31)· 标准 $3/$15
SWE-bench Verified 85.2%,编程能力第一梯队1M 上下文(batch beta 可到 300K 输出)

DeepSeek V4(V4-Pro / V4-Flash)

深度求索

编程

DeepSeek 2026 年 6 月 27 日发布的 V4(代号 DSpark),分 Pro/Flash 两档。⚠️ 2026-09-14 起 V4-Pro 与 V4-Flash 均已退役,请求统一路由至 V4.1-Flash(552B、MIT 开源、闲时 $0.15/$0.60);本卡定价与双档结构已失效,新项目请改用 V4.1-Flash。

上下文1000K
定价V4-Pro 已有序下线:2026-09-14 12:00(北京时间)起请求全部路由至 V4.1-Flash 并按 Flash 价计费(闲时 $0.15/$0.60)· V4-Flash 亦已退役,旧名仅作兼容路由
V4-Flash $0.14/$0.28,业界最低价档之一1M 上下文,Pro/Flash 双档覆盖深度推理与高吞吐

GLM-5.2

智谱 AI

编程

智谱 AI GLM-5.2 旗舰大模型(2026 年发布),国产编程与 Agent 工具调用能力第一梯队,国内直连零延迟,输入 ¥2/M 价格友好,提供慷慨免费 API 额度与开源权重,国内开发者主力选项。

上下文128K
定价Input ¥2/M · Output ¥6/M · 闭源免费 API 额度
国产模型编程能力最强之一,中文代码注释理解优秀国内直连无需翻墙,API 响应快

Kimi K2.7 Code

月之暗面

编程

月之暗面 2026 年 6 月开源的编程专用模型:1.1 万亿参数 MoE、256K 上下文、Token 成本较上代降 30%,编程基准官方称对标 Claude Sonnet 4。官方 API ¥8/¥32 每百万 token,配套 Kimi Code CLI 开箱即用,是国产编程模型第一梯队。

上下文256K
定价官方 API Input ¥8/M · Output ¥32/M(较上代降 30%)· 开源权重免费自部署
1.1T MoE 开源,编程基准官方称对标 Claude Sonnet 4256K 上下文,整仓级代码改造可用

小米 MiMo(编程模型)

小米

编程

小米 2026 年 6 月 11 日随 MiMo Code Agent 开源的自研编程模型:SWE-bench Pro 62%、Terminal Bench 2 73% 双超 Claude Code,内置多模态与记忆系统,是国产 Agent 第一次在权威基准上正面超越 Anthropic 的核心武器。

定价开源(随 MiMo Code Agent 免费提供,权重许可以 GitHub 仓库为准)
SWE-bench Pro 62%、Terminal Bench 2 73%,双超 Claude Code 同期成绩内置多模态能力,截图/UI 也能进工作流

Qwen-Max(qwen3-max)

阿里巴巴

通用大模型

Qwen-Max 是阿里百炼的闭源旗舰档(当前对应 qwen3-max 正式版,等同快照 qwen3-max-2026-01-23),智能体编程与工具调用专项升级。输入 ¥2.4/百万 token(缓存命中 ¥0.48),输出 ¥9.6,国内直连支付宝计费,是国产旗舰里 Agent 场景的稳妥选择。

上下文33K
定价Input ¥2.4/M(缓存命中 ¥0.48/M)· Output ¥9.6/M
千问 3 系 Max 正式版,智能体编程与工具调用专项升级百炼国内直连,支付宝计费,无需代理

TranslateGemma

谷歌

多模态

Google Translate 团队基于 Gemma 3 训练的开源专用翻译模型家族,2026-01-15 发布,提供 4B / 12B / 27B 三个尺寸,WMT24++ 评测覆盖 55 种语言,支持文本与「图片中的文字」两种输入,可在端侧完全离线运行。12B 版本在 WMT24++ 的 MetricX 上超过了参数量两倍于它的 Gemma 3 27B 基线。输入上下文约 2000 token,权重按 Gemma 条款开放。

上下文2K
定价Gemma 条款下免费下载权重(Hugging Face / Kaggle)· 自部署算力自负 · 亦可通过 Vertex AI Model Garden 部署(按云资源计费)
完全离线:权重可下载到本地、NAS 或私有 GPU 节点运行,翻译过程不需要联网,适合数据不出域的合同、病历、政务与技术文档场景专用训练效率高:12B 在 WMT24++ 的 MetricX 上取得 3.60,优于参数量两倍的 Gemma 3 27B 基线(5.32 为 4B、3.09 为 27B;MetricX 越低越好)

Claude Opus 4.5

Anthropic

编程

Anthropic 2025 年 11 月发布的旗舰模型,专为编程/agent/computer use 优化,SWE-bench Verified 发布即 SOTA,新增 effort 参数大幅降本。

上下文200K
定价Input $5/M · Output $25/M
SWE-bench Verified 当时 SOTA,编程能力业界第一梯队新增 effort 参数:medium 档省 76% token 仍持平 Sonnet 4.5

GPT-5.1-Codex-Max

OpenAI

编程

OpenAI 2025 年 11 月发布的专用 agentic 编码模型,首创 compaction 跨窗口机制可连续工作 24+ 小时,SWE-bench Verified 77.9%,首个原生支持 Windows。

上下文400K
定价随 Codex 订阅(Plus/Pro/Business/Enterprise)
专为 agentic 编码训练,SWE-bench Verified 77.9%compaction 机制跨多上下文窗口,可连续工作 24+ 小时

Gemini 3 Pro

Google

多模态

Google 2025 年 11 月发布的旗舰多模态模型,1M 上下文 + LMArena 登顶 + vibe coding 标杆,同步推出 agent 开发平台 Antigravity。

上下文1000K
定价Input $2/M · Output $12/M(≤200K 上下文)
1M token 上下文,原生多模态(文本/图片/音频/视频/代码)推理能力业界顶级,LMArena 1501 Elo 登顶

Kimi K2 Thinking

月之暗面

推理

月之暗面 2025 年 11 月开源的 agent 推理模型,1T/32B MoE,可连续 200-300 次工具调用,原生 INT4 提速 2x,BrowseComp 超过 GPT-5 High。

上下文256K
定价开源可自部署 · 官方 API 按量计费
开源 agent 推理 SOTA,1T 总参 / 32B 激活 MoE可维持 200–300 次连续工具调用不退化

MiniMax M2

MiniMax

编程

MiniMax 2025 年 10 月开源的 agent/编程专用模型,230B/10B MoE,MIT 许可,约 Claude Sonnet 8% 价格 + 2x 速度,性价比之王。

定价Input $0.30/M · Output $1.20/M(约为 Claude Sonnet 的 8%)
专为 agent + 编程设计,MIT 开源可商用极致性价比:约 Claude Sonnet 8% 价格、约 2x 速度

Kimi K2

月之暗面

通用大模型

月之暗面 Kimi K2 超长文本旗舰模型,单次可吞下数百万字上下文,中文长文档分析、合同 / 论文 / 财报理解能力国产最强之一,网页版完全免费可用,API 提供慷慨免费额度,长文场景首选。

上下文128K
定价Input ¥4/M · Output ¥12/M(免费 API 额度)
超长文本处理能力国产最强之一中文阅读理解优秀,适合文档分析

Qwen 3

阿里巴巴

通用大模型

阿里通义千问 Qwen 3 系列开源大模型,0.5B 至 235B 全尺寸覆盖,端侧小模型性能业界领先,多语言(119 种)能力广泛,国内可直连 + 慷慨免费 API 额度,适合从边缘设备到云端 GPU 的全栈部署。

上下文131K
定价Input ¥0.8/M · Output ¥2/M(免费 API 额度)
开源全系列(0.5B 到 235B),覆盖端侧到云端多语言能力强,中英日韩阿法德表现均衡

GPT-5

OpenAI

推理

GPT-5 深度评测:OpenAI 推理旗舰模型,400K 超长上下文,128K 输出窗口,多模态原生支持。数学/科学/代码全面,API 价格低于 Sonnet 4。含编程能力对比、国内可用性、Cursor 实测反馈。

上下文400K
定价Input $1.25/M · Output $10/M · Cached $0.125/M
400K 超长上下文,全项目代码分析无压力128K 输出窗口,长文件一次生成

Llama 4

Meta

通用大模型

Meta Llama 4 开源旗舰大模型,完全免费可商用 + 多模态原生支持,HuggingFace 社区生态与微调工具链最完整,权重开放支持 LoRA / 全参微调与私有化部署,适合学术研究、企业自托管与合规敏感场景。

上下文256K
定价开源免费(自行部署成本仅 GPU)
完全开源,可商用,无使用限制Scout 版本 10M 超长上下文(实验性)

Qwen3-Coder

阿里巴巴

编程

阿里 2025 年 7 月开源的 agentic 编码旗舰,480B/35B MoE,Apache 2.0,256K 上下文(可扩 1M),SWE-bench 开源 SOTA,配套 Qwen Code CLI。

上下文256K
定价开源可自部署 · 阿里云百炼 API 按量计费
开源 agentic 编码旗舰,480B/35B MoE,Apache 2.0 可商用原生 256K 上下文,YaRN 外推可达 1M

Doubao 1.5 Pro

字节跳动

通用大模型

字节跳动豆包(Doubao)1.5 Pro 旗舰模型,256K 超长上下文 + 多模态原生支持,火山引擎稳定服务无境外延迟,输入 ¥0.8/M 极低价,深度集成飞书 / 抖音 / 扣子(Coze)生态,国内合规场景首选。

上下文256K
定价Input ¥0.8/M · Output ¥2/M(火山引擎)
256K 上下文,国产模型中较长价格极低,与 Qwen 3 / DeepSeek 持平

Gemini 2.5 Flash

Google

多模态

Google Gemini 2.5 Flash 极致性价比模型,输入 $0.075/M 全网最低之一,100 万 token 超长上下文 + 原生多模态(图像 / 音频 / 视频),适合高吞吐 RAG、批量文档分析与成本敏感型生产场景。

上下文1000K
定价Input $0.075/M · Output $0.30/M · 闪存 $0.01875/M
全网最便宜的模型,Input 仅 $0.075/M100 万 token 上下文,与 Pro 版一致

Claude Haiku 4

Anthropic

通用大模型

Anthropic Claude Haiku 4 轻量快速模型,价格为 Sonnet 4 的 1/3、推理速度约 3 倍,工具调用与指令跟随保持 Claude 家族水准,适合代码补全、IDE 实时辅助、批量处理与高并发 Agent 场景。

上下文200K
定价Input $1/M · Output $5/M
速度极快,3 倍于 Sonnet 4价格仅为 Sonnet 4 的 1/3

Claude Opus 4

Anthropic

推理

Anthropic Claude Opus 4 旗舰推理模型,复杂代码任务、长文写作、多步规划与 Agent 链路能力业界领先,Output $75/M 为 Sonnet 4 的 5 倍,适合高价值难题、深度研究与企业级关键任务。

上下文200K
定价Input $15/M · Output $75/M
推理能力 Anthropic 系列最强复杂写作质量极高(长文/小说/学术)

Claude Sonnet 4

Anthropic

编程

Claude Sonnet 4 深度评测:Anthropic 编程旗舰模型,200K 上下文窗口,SWE-bench 72.7%。在 Cursor / Claude Code 中编程表现最佳,64K 输出窗口,artifacts 原生支持。含价格、API 兼容、国内可用性分析。

上下文200K
定价Input $3/M · Output $15/M · Prompt Cache $0.30/M
顶级编程能力,SWE-bench 72.7%,在 Cursor / Claude Code 中表现最佳artifacts 原生支持,前端代码生成即时预览

Gemini 2.5 Pro

Google

多模态

Google Gemini 2.5 Pro 旗舰多模态模型,100 万 token 业界最长上下文,图像 / 音频 / 视频 / 代码原生混合推理,Vertex AI 企业级 SLA 集成,Flash 版本提供 1/16 价格兜底。

上下文1000K
定价Input $1.25/M · Output $10/M · 闪存 $0.075/M
100 万 token 上下文,全网最长,可处理整本书/整个代码仓库多模态原生支持(图片/视频/音频/代码)

Google Gemini Robotics

Google DeepMind

多模态

Google DeepMind 基于 Gemini 2.0 的机器人多模态模型家族,能把自然语言指令和摄像头画面直接转成机器人动作;2026 年进一步推出 On-Device 本机推理版本,让模型跑在机器人自己身上。

上下文1000K
定价通过 Vertex AI / Google AI Studio 按 Gemini 2.0 计价;机器人定制版为企业授权,具体以官方为准
基于 Gemini 2.0 多模态底座,原生理解图像/视频/语言能现场生成机器人控制代码(code generation on the fly),不需为每个场景预编程

NVIDIA Isaac GR00T

NVIDIA

多模态

NVIDIA 的开放人形机器人基础模型家族(GR00T N1 / N1.5 / N2),配 Cosmos 世界模型与 Newton 物理引擎,主打跨本体、可定制、可规模化训练,是 2026 年具身智能最核心的开放底座之一。

定价开放模型权重 + 工具链;商业部署按 NVIDIA 企业授权,具体以官方为准
开放人形基础模型,可定制、可微调,社区与高校广泛采用首次提出'机器人灵巧度 Scaling Law',能力可系统性随数据/算力扩张

DeepSeek-R1

深度求索

推理

深度求索 DeepSeek-R1 开源推理大模型,完整暴露思维链(Chain of Thought)推理过程,数学与代码推理能力对标 GPT-5/o3,API 输入仅 ¥1/M 是 OpenAI 同级的 1/30,国内可直连且权重开放,支持私有部署。

上下文128K
定价Input ¥1/M (缓存 ¥0.1/M) · Output ¥4/M(含思维链)
开源推理模型,思维链完全可见数学推理能力接近 GPT-5

DeepSeek-V3

深度求索

通用大模型

深度求索 DeepSeek-V3 开源 MoE 大模型,671B 总参数 / 37B 激活,编程与数学逼近 GPT-4o 第一梯队,API 输入 ¥1/M 全网最低,权重 MIT 协议开放,国内直连无延迟,支持私有化部署。

上下文128K
定价Input ¥1/M (缓存 ¥0.1/M) · Output ¥2/M
开源 671B MoE 模型,可自行部署API 价格全网最低,比 GLM-5.2 还便宜

GPT-4o

OpenAI

多模态

OpenAI GPT-4o 多模态主力模型,文本 / 图像 / 语音原生统一推理,响应速度业界领先,开发者生态最成熟(Function Calling、Assistants API、Structured Outputs 一线适配),适合通用多模态应用与高吞吐生产部署。

上下文128K
定价Input $2.5/M · Output $10/M · Cached $1.25/M
多模态原生支持(图片/音频/视频),速度快性价比高,比 GPT-5 便宜一半