模型与能力
Anthropic 发布 Claude Haiku 5.5:100万上下文、价格直降75%,但更费 token
Haiku 5.5 是 Anthropic 一年来首次更新的小模型,支持图文输入、1M 上下文,最大输出约 12K token。官方称平均运行成本比 Haiku 4.5 低 75%,但实测在 max effort 模式下 token 消耗是 GPT-6 Luna 的约 3 倍;短请求(<100K token)确实便宜很多,长请求则因阶梯定价(超 100K 后单价×5)可能反超。
> 相关链接:Anthropic 官宣|第三方评测(Intelligence Index 43,TerminalBench 33%)
Haiku 5.5 实测对比:比 Luna 更准但更啰嗦,知识准确率仅 36%
独立评测显示:Haiku 5.5 在 Intelligence Index(43)上小幅领先 GPT-6 Luna(38),但知识准确率(36%)低于 Luna(44%)和 Gemini 3.8 Flash(55%);它更常回答“不知道”,幻觉率 40%;自动化任务得分仅 35%,因存在预发布安全 bug 导致过度拒绝,Anthropic 正修复。
> 相关链接:AA-Omniscience 对比表|AutomationBench-AA 详情
Haiku 5.5 支持 effort 控制与自适应思考,首次加入 Anthropic 小模型
这是 Haiku 系列首个支持 effort 设置(xhigh/max)和自适应思考的版本,允许开发者按需调节推理深度;在 high effort 下得 38 分用约 55K token,max effort 得 40 分却要用约 162K token,多花 1.8 倍 token 换 2 分提升。
> 相关链接:Anthropic SDK 文档|第三方 effort 效果分析
Agent 与工具链
Claude SDK 内置 browser-use 和 computer-use 工具链
Anthropic 新版 Python/TS SDK 直接集成了 browser-use、Browserbase、E2B、Daytona 等驱动,自动处理点击/键盘操作循环,开发者不用再手写 action loop,开箱即用于网页/桌面自动化任务。
> 相关链接:SDK 快速入门|Cursor 集成示例
Haiku 5.5 明确定位为「子代理」:专干高吞吐、低成本活儿
Anthropic 官方建议将 Haiku 5.5 作为 Opus/Sonnet 的搭档——Opus 负责深度思考,Haiku 负责批量摘要、数据库查询、文档压缩等高频轻量任务;已接入 Claude Code、Devin Fusion、GitHub Copilot 等 Agent 平台。
> 相关链接:Anthropic 博客说明|Devin 官方推荐(Fusion 场景)
基础设施与硬件
Anthropic 推出 tiered token pricing:短文本便宜 5 倍,长文本贵 5 倍
Haiku 5.5 输入/输出定价分两档:≤100K token 时仅 $0.10/$0.50 每百万 token;超 100K 后跳涨至 $0.50/$2.50;缓存读取也分档($0.01/$0.05)。这对长上下文 Agent 流程成本影响很大,需精细设计 prompt 长度。
> 相关链接:Claude Devs 定价公告|技术细节说明
研究与方法
Artificial Analysis 首发 Haiku 5.5 全维度评测:含 AA-Briefcase、OSWorld、ParseBench
第三方机构发布首份深度报告:AA-Briefcase(私有知识工作)1578 Elo,超 Kimi K3;OSWorld 计算机使用达 72%(Haiku 4.5 仅 15%);ParseBench 表格解析强于 Luna,但图表理解弱;TerminalBench 从 0% → 33%。
> 相关链接:完整评测报告|ParseBench 对比
产品与应用落地
Cursor、GitHub Copilot、Devin 已首发集成 Haiku 5.5
Cursor 宣称短请求成本比 Haiku 4.5 低 10 倍;GitHub Copilot 在 VS Code 中编码任务表现接近 Sonnet 5,但用更少 token 和步骤;Devin 在 FrontierCode 1.1 达 58.4%,成本仅 Sonnet 5 的 1/8,推荐作 Opus 5.5 的「副驾」。
> 相关链接:Cursor 性能对比|Copilot 实测反馈
行业与公司动态
Anthropic 同步下调 Sonnet 5.5 缓存价格,并加赠 API 订阅额度
Sonnet 5.5 缓存读取费用从 $0.20 降至 $0.10 每百万 token,整体成本降约 20%;Claude Max/Team 订阅用户每月获赠 $100–$500 API 积分,可通用于 Haiku/Sonnet/Opus,且支持第三方框架调用。
> 相关链接:Sonnet 价格更新|API 积分说明
Anthropic 以 Haiku 5.5 主动挑战 OpenAI Luna:社区喊出「Luna 凉了」
发布当日多家媒体和 KOL 将 Haiku 5.5 直接对标 GPT-6 Luna,称其「便宜又聪明」;kimmonismus 评价「远超 Luna,逼近 Sonnet 5.5」;@scaling01 用「cheap af」概括;@dejavucoder 直言「rip gpt 6 luna」。
> 相关链接:The Rundown AI 评论|kimmonismus 评测推文