跳到主内容
AIHO 2026 全新改版上线
公开 · 可核验 · 可复现

AIHO 评测方法论

我们的评分怎么打、测试任务是什么、多久更新一次、是否存在利益关系——全部公开。

为什么可信 编辑部独立评测 不收钱改分 数据可核验 持续更新
看我们的评测原则
01 / 05PROMISE · 可信度承诺

中文搜索里的「AI 工具横评」大量存在厂商投放、固定排名、复制话术。 AIHO 的方法只有一句话: 不接软文、不卖排名、收钱不改分、方法全公开。

  • 01公开评分维度与权重:每个工具卡展示五维分数,并在本站说明每一项的含义。
  • 02公开测试任务:编辑部使用统一任务集对同类工具进行横向测试,避免「看官网打分」。
  • 03标注核实日期:每个工具卡都记录 lastVerified,超过 180 天未核实的页面会提示「内容可能已过时」。
  • 04利益披露:存在 affiliate、赞助或利益冲突时,在页面明确标注。
02 / 05DIMENSIONS · 五维评分与权重

每个工具都从五个维度打分

单项 1–5 分,综合分 = 五项算术平均,保留一位小数。我们刻意使用等权重,避免任何单一维度被算法放大。

POWER · 能力

AI 核心能力

代码生成质量、理解复杂需求、跨文件推理、Debug 定位、Agent 自主完成任务的能力。

UX · 易用

用户体验

上手成本、IDE/界面集成度、交互流畅度、文档质量、错误提示是否清晰。

PRICE · 性价比

价格与性价比

免费额度、付费档位合理性、是否有教育/开源优惠、隐藏消费(如按 token 计费)。

CN SUPPORT · 中文

中文支持

中文 prompt 理解、中文注释/变量名处理、界面本地化、国内访问稳定性、支付方式。

STABILITY · 稳定

稳定性

服务可用性、响应速度、版本更新节奏、是否出现过大规模故障或封号事件。

AVERAGE

综合分

五项算术平均,不四舍五入。它不代表「绝对好坏」,只代表编辑部在统一任务下的相对排序。

03 / 05TASKS · 标准测试任务

三类任务覆盖真实开发场景

我们不看 Demo,只看在真实仓库/真实需求下的表现。每类任务使用相同的 prompt 与验收标准,确保横向可比。

任务一:从零实现功能

给定一个明确需求(如「用 Python 实现带 JWT 鉴权的 REST API,包含用户注册/登录/刷新」),评估生成代码的正确性、完整性、边界处理与可维护性。

任务二:在既有代码库中改 Bug / 加需求

给定一个真实存在的开源项目片段,要求定位并修复一个非 trivial 的 bug,或跨多个文件添加一个新功能。评估上下文理解、修改范围控制、回归风险。

任务三:Agent 工作流编排

针对 Agent 平台,使用自然语言描述一个多步骤任务(如「读取飞书表格 → 生成日报 → 发送到钉钉群」),评估工具调用、错误恢复、可观测性与调试体验。

04 / 05PROCESS · 评分与更新流程

分数不是一次性结论,而是持续维护的状态

01 · 入库

编辑部上手使用至少 3 天,填写五维评分、价格、平台、来源等 frontmatter。

02 · 复核

每篇内容至少由两人复核:一人确认评分,一人核对来源链接与价格有效性。

03 · 更新

重大版本/定价变更时立即更新;常规内容每季度回炉,刷新 lastVerified

04 · 公示

每个工具卡展示评分来源与核实日期;本页持续公开方法论的变更历史。

05 / 05DISCLOSURE · 利益披露
Affiliate & 利益关系说明
  • · 部分外链可能带有 utm_source=aiho 等推荐参数,可能产生少量返佣。
  • · 返佣关系不影响评分与排名。如果某工具为付费推广,会在卡片上标注 SPONSORED
  • · 编辑部成员任职或持股的工具,会在该工具页单独声明。
  • · 如发现利益关系未披露,欢迎通过邮件 hi@aiho.net 指出。