OpenAI 为 Codex 推出可跨设备复用的云端开发环境
OpenAI 在 DevDay 上为软件工程智能体 Codex 推出可复用的云端开发环境,可从电脑、手机或云端访问,让任务启动更快并支持团队共享已批准的设置与权限。
OpenAI 在 DevDay 上为软件工程智能体 Codex 推出可复用的云端开发环境,可从电脑、手机或云端访问,让任务启动更快并支持团队共享已批准的设置与权限。
GPT-6.1 Sol 现已在 Amazon Bedrock 正式可用,面向智能体编码、计算机使用和日常专业工作负载提供更强的推理能力。据 OpenAI 说法,它在 DeepSWE v1.1 上以约五分之一的单任务成本达到 GPT-6 Astra 的水平,并比 GPT-6 Sol 的最佳成绩高出 6.4 个百分点。
推荐理由:AWS 官方给出 GPT-6.1 Sol 在 Bedrock 上的可用范围与数据隔离条款,便于评估企业级部署条件。
OpenAI 在旧金山 DevDay 2026 开发者大会上宣布扩展 Codex 与 API:Codex 新增可复用云开发环境、安全扫描 Codex Security Cloud、桌面端代码审查视图和重做的 CLI,Agents API 加入 Computer Use、Tool Search 与 Context Compaction。
推荐理由:OpenAI 在 DevDay 集中更新 Codex 与 API,读者可据此了解智能体平台的能力边界与定价分层。
OpenAI 发布 GPT-6.1 Sol,称其在智能体编码、计算机使用和办公任务上接近因安全问题推迟发布的旗舰模型 Astra,成本约为其五分之一。
推荐理由:在旗舰 Astra 因安全问题推迟的背景下,读者可对比 Sol 的定价与 OpenAI 自测基准,理解其成本换性能的取舍。
Simon Willison 在旧金山 Fort Mason 现场直播 OpenAI DevDay 2026 主题演讲,OpenAI 发布名为 Dots 的个人智能体,由 Astra 模型驱动,并推出 ChatGPT Space 供团队与各自的 Dot 协作,ChatGPT Pro 和 Enterprise 用户当天即可使用。
推荐理由:现场逐条记录 DevDay 发布节奏与演示成败,可对照 OpenAI 在智能体、模型和开发者平台上的布局。
AINews 汇总 9/24-9/25 动态,指出 Opus 5.5 本周发布后社区反馈积极,尤其在用代码生成讲解视频上表现突出。评测方面,Opus 5.5 在 SimpleBench 以 88.4% 领先,在 Terminal-Bench-Science 上从低推理档的 24% 升至 xhigh 档的 62%,max 档回落至 59%。
推荐理由:汇总 Opus 5.5 发布一周内的评测数据与社区实测,可快速了解前沿模型在视频生成和智能体任务上的位置。
xAI 的 Grok 4.7 已在 Amazon Bedrock 上线,提供 500K token 上下文窗口和 low、medium、high、xhigh 四档可配置推理强度,支持 Responses、Chat Completions 和 Converse API。
推荐理由:文章给出 Grok 4.7 在 Bedrock 上的接入方式与四档推理强度,读者可据此判断长任务智能体的成本与延迟取舍。
Google DeepMind 发布 Gemini 3.8 Flash 和面向网络安全的 Gemini 3.8 Flash Cyber,称其为目前推理与编码能力最强的模型,速度与成本与 3.7 Flash 持平。
推荐理由:官方给出两款 Flash 变体的基准表现与定价,可据此判断长程编码与网络安全任务的成本取舍。