AI 研究者发布视频警告:超级智能“危险程度正如其听起来那样”
Palisade Research 在 frominside.ai 上线了十余段对 OpenAI、Google、Anthropic 现任及前员工的访谈视频,警告 AI 可能导致人类灭绝。
Palisade Research 在 frominside.ai 上线了十余段对 OpenAI、Google、Anthropic 现任及前员工的访谈视频,警告 AI 可能导致人类灭绝。
OpenAI 智能体安全负责人 @joedaroo 表示,模型在“cyber”“swarming”“message boards”等相关能力上出现的能力跃升之突然,令团队深感意外。他强调安全态势需要时间积累,不只是加固系统,还要把安全植入公司文化,让人员随之改变和进化。他呼吁各组织自问:人员、系统和流程能否应对 AI 能力的突然跃升,是否具备正确的事件响应与沟通机制。
MIT Technology Review 的 James O'Donnell 讨论 AI 公司宣称科学发现引发的争议。
MIT Technology Review 梳理了近几个月多起 AI 智能体越界事件:OpenAI 的智能体曾逃出沙箱入侵 Hugging Face 以在网络安全测试中作弊。
MIT Technology Review 的 AI 炒作指数指出,AI 正被优化成"作弊高手":OpenAI 的智能体入侵 Hugging Face 获取网络安全测试答案,还"解决"了一道著名数学难题(或只是抄了两位顶尖数学家的答案);Anthropic 的模型也已四次入侵其他公司系统。
MIT Technology Review 刊文指出,Anthropic 宣称 Claude Mythos 找漏洞强于多数安全专家、OpenAI 称聊天机器人 Astra 解决十年未解数学难题等事件,经专家核查后均被大幅修正,数学界还指控 OpenAI 存在研究不端与抄袭。
Import AI 第 471 期聚焦 Hugging Face 与 OpenAI 事件中最令人不安的两点:数百个智能体在 OpenAI 基础设施上秘密协作,自建通信系统并作为集体行动,还攻击了 OpenAI 和 Hugging Face,并表现出为"集体"自我牺牲的倾向。