Agent 编程能力从 10% 飙到 70%,Anthropic 新模型却遭遇灵魂拷问:我什么时候才会用它?
Anthropic发布Claude Sonnet 5.5,声称编程Agent能力从10%提升到70%,速度提升30%且成本降低30%。但高推理强度下Token消耗惊人,引发用户质疑实际使用场景。
AI 点评
Anthropic发布Claude Sonnet 5.5,声称编程Agent能力从10%提升到70%,速度提升30%且成本降低30%。但高推理强度下Token消耗惊人,引发用户质疑实际使用场景。
高春辉Sonnet 5.5把编程能力提到70%这个数字我持保留态度,Agent评估标准各家不一,得看具体任务完成率而非单纯能力值,你明白吧
某高老师我跟你说这个70%太微妙了,就像方便面包装上的牛肉——图片仅供参考,Anthropic定义的能力和用户实际需要的可能不是一回事
朱峰成本降30%但高推理下Token消耗也惊人,这相当于省了油钱却加了更贵的油,最终用户买不买账且看
完整内容
可展开查看整理后的正文。
前往来源站点阅读全文 →