Anthropic 发布 Claude Sonnet 5.5
Anthropic 发布新模型 Claude Sonnet 5.5,官方称其运行速度提升 30% 以上、多数工作成本最多降低 30%,定价与 Sonnet 5 相同但在各项基准上均优于 Sonnet 5。
推荐理由:作者用鹈鹕骑车提示词实测新模型,并对比免费层能力,可看模型速度、成本与编码表现。
Anthropic 发布新模型 Claude Sonnet 5.5,官方称其运行速度提升 30% 以上、多数工作成本最多降低 30%,定价与 Sonnet 5 相同但在各项基准上均优于 Sonnet 5。
推荐理由:作者用鹈鹕骑车提示词实测新模型,并对比免费层能力,可看模型速度、成本与编码表现。
Import AI 第 469 期介绍了 DiG-bench(Discovery in Games)基准,包含 70 款规则与目标均隐藏、需靠交互探索发现的游戏,其中 21 款已公开。
Import AI 第 468 期收录了智库 IFP 提出的 23 条政策建议,分属 7 个类别,旨在帮助政策制定者应对 AI 研发进一步自动化带来的风险。MIT 与 Columbia 的论文《Racing to Ruin》分析认为,竞争对手之间实现协调减速的关键变量是技术开发的透明度,以及能否将对方建模为可信、理性的行为者。