Claude Haiku 5.5 降本背后:操作能力暴涨,复杂编程为何仍差一截?
模型开始按任务动态分配推理,超 10 万 Token 后,输入输出单价均涨 5 倍。 作者丨郑佳美 编辑丨岑 峰 刚刚,Anthropic 发布了 Claude Haiku 5.5。这次升级的幅度不小,尤其是在计算机操作方面,OSWorld 2.1 评测成绩从上一代的 15.7% 提升到了 72.4%。知识工作和复杂推理能力也有明显改善,而按照 Anthropic 公布的数据,新模型的平均运行成本还下降了约 75%。除此之外,Haiku 5.5 还加入了自适应推理机制,并支持 100 万 Token 上下文。过去,Haiku 主要用来处理摘要、分类、信息提取这些高频任务,优势一直是速度快、成本低。这次更新后,它能处理的工作明显复杂了不少,部分评测成绩甚至已经接近 Sonnet 5.5。不过,换到复杂编程任务,两者的差距依然明显。再看这次更新的推理机制和价格规则,Haiku 5.5 在不同任
anthropic claude