Artificial Analysis 综合能力比较
43分
Intelligence Index
收录范围内第 12 名
测试配置:max · 含回退机制
材料读取 · · v4.3.2
各型号取来源页最高已测档位,保留回退设置;只按同一机构的分数排列。该指数主要评估英文文字任务,中文与图像能力另看实际评测。
原始评测与榜单 ↗Anthropic · 发布 2026-10-07
接走频繁的小任务:看独立评分、绘图档位对照和 10 万 token 的价格分界。
模型原始说明 ↗43分
Intelligence Index
收录范围内第 12 名
测试配置:max · 含回退机制
材料读取 · · v4.3.2
各型号取来源页最高已测档位,保留回退设置;只按同一机构的分数排列。该指数主要评估英文文字任务,中文与图像能力另看实际评测。
原始评测与榜单 ↗独立评测解读
官方把 Haiku 5.5 放在摘要、分类、资料提取和子任务的位置:这些工作单次不大,却会反复发生。
作者公开测试
Simon Willison 用“骑自行车的鹈鹕”测试了五个推理档。
厂商客户案例与用途建议
Anthropic 发布页转述 Rogo 的用法:较大的模型制作演示文稿,Haiku 子代理去企业年报里取出需要的分部收入。