OpenAI 发布 GPT-6.1 Sol,以五分之一成本接近 Astra
OpenAI 发布 GPT-6.1 Sol,称其在智能体编码、计算机使用和办公任务上接近因安全问题推迟发布的旗舰模型 Astra,成本约为其五分之一。
推荐理由:在旗舰 Astra 因安全问题推迟的背景下,读者可对比 Sol 的定价与 OpenAI 自测基准,理解其成本换性能的取舍。
OpenAI 发布 GPT-6.1 Sol,称其在智能体编码、计算机使用和办公任务上接近因安全问题推迟发布的旗舰模型 Astra,成本约为其五分之一。
推荐理由:在旗舰 Astra 因安全问题推迟的背景下,读者可对比 Sol 的定价与 OpenAI 自测基准,理解其成本换性能的取舍。
OpenAI 发布 GPT-6.1 Sol,官方称其具备接近 Astra 的智能水平,面向编码、计算机操作和专业工作场景。该模型标准 API 的输入与输出 token 价格均为 Astra 的五分之一。
推荐理由:OpenAI 发布 GPT-6.1 Sol,定价降至 Astra 标准 API 的五分之一,可据此判断其成本定位。
AINews 汇总 9/24-9/25 动态,指出 Opus 5.5 本周发布后社区反馈积极,尤其在用代码生成讲解视频上表现突出。评测方面,Opus 5.5 在 SimpleBench 以 88.4% 领先,在 Terminal-Bench-Science 上从低推理档的 24% 升至 xhigh 档的 62%,max 档回落至 59%。
推荐理由:汇总 Opus 5.5 发布一周内的评测数据与社区实测,可快速了解前沿模型在视频生成和智能体任务上的位置。
xAI 的 Grok 4.7 已在 Amazon Bedrock 上线,提供 500K token 上下文窗口和 low、medium、high、xhigh 四档可配置推理强度,支持 Responses、Chat Completions 和 Converse API。
推荐理由:文章给出 Grok 4.7 在 Bedrock 上的接入方式与四档推理强度,读者可据此判断长任务智能体的成本与延迟取舍。
Google DeepMind 发布 Gemini 3.8 Flash 和面向网络安全的 Gemini 3.8 Flash Cyber,称其为目前推理与编码能力最强的模型,速度与成本与 3.7 Flash 持平。
推荐理由:官方给出两款 Flash 变体的基准表现与定价,可据此判断长程编码与网络安全任务的成本取舍。