OpenAI 发布 GPT-6.1 Sol,以五分之一成本接近 Astra
OpenAI 发布 GPT-6.1 Sol,称其在智能体编码、计算机使用和办公任务上接近因安全问题推迟发布的旗舰模型 Astra,成本约为其五分之一。
推荐理由:在旗舰 Astra 因安全问题推迟的背景下,读者可对比 Sol 的定价与 OpenAI 自测基准,理解其成本换性能的取舍。
OpenAI 发布 GPT-6.1 Sol,称其在智能体编码、计算机使用和办公任务上接近因安全问题推迟发布的旗舰模型 Astra,成本约为其五分之一。
推荐理由:在旗舰 Astra 因安全问题推迟的背景下,读者可对比 Sol 的定价与 OpenAI 自测基准,理解其成本换性能的取舍。
AINews 汇总 9/24-9/25 动态,指出 Opus 5.5 本周发布后社区反馈积极,尤其在用代码生成讲解视频上表现突出。评测方面,Opus 5.5 在 SimpleBench 以 88.4% 领先,在 Terminal-Bench-Science 上从低推理档的 24% 升至 xhigh 档的 62%,max 档回落至 59%。
推荐理由:汇总 Opus 5.5 发布一周内的评测数据与社区实测,可快速了解前沿模型在视频生成和智能体任务上的位置。
Anthropic 发布新模型 Claude Sonnet 5.5,官方称其运行速度提升 30% 以上、多数工作成本最多降低 30%,定价与 Sonnet 5 相同但在各项基准上均优于 Sonnet 5。
推荐理由:作者用鹈鹕骑车提示词实测新模型,并对比免费层能力,可看模型速度、成本与编码表现。