跳到主内容
AIHO 2026 全新改版上线
规格 · 定价 · 对比

AI 模型库

主流 AI 大模型档案库:上下文窗口、定价、基准测试、优劣分析、适用场景,帮你选对模型。

01 / 13Google

Gemini 3.6 Flash

多模态

Google 于 2026 年 7 月 21 日发布的稳定版 Flash 模型,1M 上下文、65K 输出,定价 $1.50/$7.50 每百万 token,定位高吞吐多模态场景,原生支持函数调用与流式。

上下文1049K
定价$1.50 / $7.50(cache $0.15)/ 百万 token
原生多模态:文本 / 图像 / 视频 / 音频统一输入,响应快1M 输入上下文 + 65K 输出,长文档与代码库友好

Gemini 3 Pro

多模态

Google 2025 年 11 月发布的旗舰多模态模型,1M 上下文 + LMArena 登顶 + vibe coding 标杆,同步推出 agent 开发平台 Antigravity。

上下文1000K
定价Input $2/M · Output $12/M(≤200K 上下文)
1M token 上下文,原生多模态(文本/图片/音频/视频/代码)推理能力业界顶级,LMArena 1501 Elo 登顶

Gemini 2.5 Flash

多模态

Google Gemini 2.5 Flash 极致性价比模型,输入 $0.075/M 全网最低之一,100 万 token 超长上下文 + 原生多模态(图像 / 音频 / 视频),适合高吞吐 RAG、批量文档分析与成本敏感型生产场景。

上下文1000K
定价Input $0.075/M · Output $0.30/M · 闪存 $0.01875/M
全网最便宜的模型,Input 仅 $0.075/M100 万 token 上下文,与 Pro 版一致

Gemini 2.5 Pro

多模态

Google Gemini 2.5 Pro 旗舰多模态模型,100 万 token 业界最长上下文,图像 / 音频 / 视频 / 代码原生混合推理,Vertex AI 企业级 SLA 集成,Flash 版本提供 1/16 价格兜底。

上下文1000K
定价Input $1.25/M · Output $10/M · 闪存 $0.075/M
100 万 token 上下文,全网最长,可处理整本书/整个代码仓库多模态原生支持(图片/视频/音频/代码)
02 / 13Google DeepMind
03 / 13NVIDIA
04 / 13Anthropic

Claude Sonnet 5

编程

Anthropic 2026 年 6 月 30 日发布的 Claude Sonnet 5,1M 上下文,SWE-bench Verified 85.2%,现为 claude.ai 默认模型,促销期定价 $2/$10。

上下文1000K
定价促销 $2/$10(至 2026-08-31)· 标准 $3/$15
SWE-bench Verified 85.2%,编程能力第一梯队1M 上下文(batch beta 可到 300K 输出)

Claude Opus 4.5

编程

Anthropic 2025 年 11 月发布的旗舰模型,专为编程/agent/computer use 优化,SWE-bench Verified 发布即 SOTA,新增 effort 参数大幅降本。

上下文200K
定价Input $5/M · Output $25/M
SWE-bench Verified 当时 SOTA,编程能力业界第一梯队新增 effort 参数:medium 档省 76% token 仍持平 Sonnet 4.5

Claude Haiku 4

通用大模型

Anthropic Claude Haiku 4 轻量快速模型,价格为 Sonnet 4 的 1/3、推理速度约 3 倍,工具调用与指令跟随保持 Claude 家族水准,适合代码补全、IDE 实时辅助、批量处理与高并发 Agent 场景。

上下文200K
定价Input $1/M · Output $5/M
速度极快,3 倍于 Sonnet 4价格仅为 Sonnet 4 的 1/3

Claude Opus 4

推理

Anthropic Claude Opus 4 旗舰推理模型,复杂代码任务、长文写作、多步规划与 Agent 链路能力业界领先,Output $75/M 为 Sonnet 4 的 5 倍,适合高价值难题、深度研究与企业级关键任务。

上下文200K
定价Input $15/M · Output $75/M
推理能力 Anthropic 系列最强复杂写作质量极高(长文/小说/学术)

Claude Sonnet 4

编程

Claude Sonnet 4 深度评测:Anthropic 编程旗舰模型,200K 上下文窗口,SWE-bench 72.7%。在 Cursor / Claude Code 中编程表现最佳,64K 输出窗口,artifacts 原生支持。含价格、API 兼容、国内可用性分析。

上下文200K
定价Input $3/M · Output $15/M · Prompt Cache $0.30/M
顶级编程能力,SWE-bench 72.7%,在 Cursor / Claude Code 中表现最佳artifacts 原生支持,前端代码生成即时预览
05 / 13深度求索
06 / 13OpenAI

GPT-5.6(Sol / Terra / Luna)

编程

OpenAI 2026 年 7 月 9 日全量 GA 的 GPT-5.6 家族,分 Sol/Terra/Luna 三档,1.1M 上下文,Terminal-Bench 2.1 最高 91.9%,全平台覆盖。

上下文1100K
定价Sol $5/$30 · Terra $2.50/$15 · Luna $1/$6
Terminal-Bench 2.1 最高 91.9%(Sol Ultra),编程与终端 Agent 能力顶尖1.1M 超长上下文,reasoning + vision 全能

GPT-5.1-Codex-Max

编程

OpenAI 2025 年 11 月发布的专用 agentic 编码模型,首创 compaction 跨窗口机制可连续工作 24+ 小时,SWE-bench Verified 77.9%,首个原生支持 Windows。

上下文400K
定价随 Codex 订阅(Plus/Pro/Business/Enterprise)
专为 agentic 编码训练,SWE-bench Verified 77.9%compaction 机制跨多上下文窗口,可连续工作 24+ 小时

GPT-4o

多模态

OpenAI GPT-4o 多模态主力模型,文本 / 图像 / 语音原生统一推理,响应速度业界领先,开发者生态最成熟(Function Calling、Assistants API、Structured Outputs 一线适配),适合通用多模态应用与高吞吐生产部署。

上下文128K
定价Input $2.5/M · Output $10/M · Cached $1.25/M
多模态原生支持(图片/音频/视频),速度快性价比高,比 GPT-5 便宜一半

GPT-5

推理

GPT-5 深度评测:OpenAI 推理旗舰模型,400K 超长上下文,128K 输出窗口,多模态原生支持。数学/科学/代码全面,API 价格低于 Sonnet 4。含编程能力对比、国内可用性、Cursor 实测反馈。

上下文400K
定价Input $1.25/M · Output $10/M · Cached $0.125/M
400K 超长上下文,全项目代码分析无压力128K 输出窗口,长文件一次生成
07 / 13xAI
08 / 13月之暗面
09 / 13MiniMax
10 / 13阿里巴巴
11 / 13字节跳动
12 / 13智谱 AI
13 / 13Meta