AI 模型库
主流 AI 大模型档案库:上下文窗口、定价、基准测试、优劣分析、适用场景,帮你选对模型。
Claude Opus 4.5
编程Anthropic 2025 年 11 月发布的旗舰模型,专为编程/agent/computer use 优化,SWE-bench Verified 发布即 SOTA,新增 effort 参数大幅降本。
Claude Haiku 4
通用大模型Anthropic Claude Haiku 4 轻量快速模型,价格为 Sonnet 4 的 1/3、推理速度约 3 倍,工具调用与指令跟随保持 Claude 家族水准,适合代码补全、IDE 实时辅助、批量处理与高并发 Agent 场景。
Claude Opus 4
推理Anthropic Claude Opus 4 旗舰推理模型,复杂代码任务、长文写作、多步规划与 Agent 链路能力业界领先,Output $75/M 为 Sonnet 4 的 5 倍,适合高价值难题、深度研究与企业级关键任务。
Claude Sonnet 4
编程Anthropic 旗舰编程模型,200K 上下文 + 64K 输出,SWE-bench 72.7%,目前 AI 编程领域最强模型之一。
Gemini 3 Pro
多模态Google 2025 年 11 月发布的旗舰多模态模型,1M 上下文 + LMArena 登顶 + vibe coding 标杆,同步推出 agent 开发平台 Antigravity。
Gemini 2.5 Flash
多模态Google Gemini 2.5 Flash 极致性价比模型,输入 $0.075/M 全网最低之一,100 万 token 超长上下文 + 原生多模态(图像 / 音频 / 视频),适合高吞吐 RAG、批量文档分析与成本敏感型生产场景。
Gemini 2.5 Pro
多模态Google Gemini 2.5 Pro 旗舰多模态模型,100 万 token 业界最长上下文,图像 / 音频 / 视频 / 代码原生混合推理,Vertex AI 企业级 SLA 集成,Flash 版本提供 1/16 价格兜底。
GPT-5.1-Codex-Max
编程OpenAI 2025 年 11 月发布的专用 agentic 编码模型,首创 compaction 跨窗口机制可连续工作 24+ 小时,SWE-bench Verified 77.9%,首个原生支持 Windows。
GPT-4o
多模态OpenAI GPT-4o 多模态主力模型,文本 / 图像 / 语音原生统一推理,响应速度业界领先,开发者生态最成熟(Function Calling、Assistants API、Structured Outputs 一线适配),适合通用多模态应用与高吞吐生产部署。
GPT-5
推理OpenAI 2025 年旗舰模型,400K 上下文 + 128K 输出 + 多模态,推理能力顶级,API 价格低于 Claude Sonnet 4。
Kimi K2 Thinking
推理月之暗面 2025 年 11 月开源的 agent 推理模型,1T/32B MoE,可连续 200-300 次工具调用,原生 INT4 提速 2x,BrowseComp 超过 GPT-5 High。
Kimi K2
通用大模型月之暗面 Kimi K2 超长文本旗舰模型,单次可吞下数百万字上下文,中文长文档分析、合同 / 论文 / 财报理解能力国产最强之一,网页版完全免费可用,API 提供慷慨免费额度,长文场景首选。
Qwen3-Coder
编程阿里 2025 年 7 月开源的 agentic 编码旗舰,480B/35B MoE,Apache 2.0,256K 上下文(可扩 1M),SWE-bench 开源 SOTA,配套 Qwen Code CLI。
Qwen 3
通用大模型阿里通义千问 Qwen 3 系列开源大模型,0.5B 至 235B 全尺寸覆盖,端侧小模型性能业界领先,多语言(119 种)能力广泛,国内可直连 + 慷慨免费 API 额度,适合从边缘设备到云端 GPU 的全栈部署。
DeepSeek-R1
推理深度求索 DeepSeek-R1 开源推理大模型,完整暴露思维链(Chain of Thought)推理过程,数学与代码推理能力对标 GPT-5/o3,API 输入仅 ¥1/M 是 OpenAI 同级的 1/30,国内可直连且权重开放,支持私有部署。
DeepSeek-V3
通用大模型深度求索 DeepSeek-V3 开源 MoE 大模型,671B 总参数 / 37B 激活,编程与数学逼近 GPT-4o 第一梯队,API 输入 ¥1/M 全网最低,权重 MIT 协议开放,国内直连无延迟,支持私有化部署。