Anthropic 公司近日正式推出了 Claude 5.5 系列的最新轻量级模型 Claude Haiku 5.5。对于 10 万 Token 以内的常规请求,其输入和输出价格分别降至每百万 Token 0.10 美元和 0.50 美元,相比前代产品账面价格大幅下降了 90%。
作为当前响应速度最快的模型,Haiku 5.5 主打高并发、低延迟与高性价比场景,非常适合实时客服、摘要提取与数据分类等高频任务。此外系统还首次加入了自适应思考与动态调节功能,能够根据任务复杂度自动平衡推理深度与计算成本。
全新分词机制引关注,实际消耗成本或增加
然而官方同时提醒,由于 Haiku 5.5 采用了与高级模型同款的全新分词器,相同文本输入所转换出的 Token 数量有所上升。测试显示长文本任务可能会多消耗 25% 至 30% 的 Token,因此综合实际工作负载后的整体运行成本降幅约为 75%。
需要注意的是,一旦单次请求超过 10 万 Token 的门槛,其输入与输出单价均会飙升至基础价格的 5 倍。这意味着开发者在享受低单价优势的同时,也必须针对特定工作流精准评估 Token 消耗量,避免陷入隐性成本陷阱。











