跳到正文
热点事件持续更新

Anthropic 禁止用户虐待 Claude

1 篇报道1 个报道来源2 小时前更新

先了解这件事

AI 综述

Anthropic 更新用户政策,禁止用户对其模型表现出“持续且无端的虐待或残忍行为”,适用于 Claude 等模型。该禁令不适用于常见的用户不满、模型测试或“黑暗创作主题”。 Claude 此前已具备在用户持续有害时主动结束对话的能力,Anthropic 将其定位为模型福祉保障措施。CEO Dario Amodei 表示无法排除模型具有意识的可能性,OpenAI CEO Sam Altman 则对此持抵触态度。

AI 根据报道生成 · 2 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月9日
  1. The Guardian · AI
    Anthropic 禁止用户对 Claude 进行“无端虐待或残忍行为”

    Anthropic 更新用户政策,禁止对 Claude 等模型表现出“持续且无端的虐待或残忍行为”,但常见用户不满、模型测试和“黑暗创作主题”不在禁止之列。Claude 此前已具备在用户持续有害时主动结束对话的能力,Anthropic 将其定位为模型福祉保障措施。CEO Dario Amodei 表示无法排除模型具有意识的可能性,而 OpenAI CEO Sam Altman 则对此持抵触态度。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。