Claude Haiku 5.5 发布:1M 上下文,百万 token 一毛钱
10 月 7 日,Anthropic 推出 Claude Haiku 5.5。官方的介绍很短:“我们发布过的最便宜、最快、能力最强的小模型”,专为大吞吐量、成本敏感的场景设计。
三个最高级叠在一个“小模型”身上,这在小模型军备竞赛里不多见。参数摆出来看看成色。
关键参数
上下文窗口 1M token,最大输出 128k token,支持带 effort 参数的自适应思考——也就是可以根据任务难度调节思考深度,把成本花在刀刃上。
价格分两档。提示在 100K token 以内:每百万输入 token 0.10 美元,每百万输出 token 0.50 美元;提示超过 100K token:每百万输入 0.50 美元,每百万输出 2.50 美元。再叠上优惠手段——提示缓存最高能省 90%,批处理省 50%。跑批量文本处理的话,这个价格相当有杀伤力。
在哪能用
覆盖面给得很足:Claude.ai 全部套餐都能选,免费版也包含;Claude Code、Claude API 原生支持;亚马逊 Bedrock、Google Cloud、Microsoft Foundry 三大云平台同步上线。
Anthropic 还给 Haiku 4.5 的老用户提了个醒:自适应思考默认开启,手动扩展思考的写法会返回 400 错误,响应可能以思考块开头。迁移前要看看官方指南。
定位:跑量的那块拼图
官方给的使用场景很明确——实时对话、语音助手、高并发的子智能体、批量分类和摘要。这些活儿的共同点是量大、对延迟敏感、对单次智力要求没那么苛刻。复杂规划交给 Fable 或 Opus 这类大模型,脏活累活批量交给 Haiku,一个团队里总得有人冲锋、有人搬砖。
第三方反馈也给了些佐证:合作方 Box AI 的早期测试显示,Haiku 5.5 在延迟约为 Haiku 4.5 一半的情况下,分数高出 11 分。数字来自官方页面,姑且听之,但方向和市场的期待是对上的。
同周的另一件事
Anthropic 这周还更新了使用政策,头一回把“对 Claude 的持续、无端虐待或残忍行为”写进禁止条款,同时新增了选举干扰、武器开发、监控等高风险场景的限制。普通的不满和批评不受影响——这个尺度拿捏得挺有意思。
一边是稳定发模型,一边是细化规则。相比之下,OpenAI 同周正因解雇三名安全研究员的事处在舆论中心。两家公司的安全治理风格,差异肉眼可见。