人工智能公司 Anthropic 于 10 月 8 日更新使用政策,新增对选举干预、武器软件和监控的禁止。
据 TechCrunch 报道,此次调整中最受关注的变化,是 Anthropic 明确禁止用户对模型进行长时间言语虐待。Anthropic 表示,自 8 月更新起,Claude 已被训练为在持续有害或虐待性的用户互动中结束对话;新政策则进一步明确,用户不得继续这类对话。
长时间辱骂模型被明确列入禁止范围
政策说明称,这项更新只适用于极端情况,也就是用户反复残忍对待模型,且没有可辨识目的。Anthropic 同时说明,该规定不适用于常见的用户不满、反驳、黑暗创作主题,或模型测试与研究。
新增对欺骗与选举相关行为的限制
使用政策还禁止广泛欺骗活动,例如用 Claude 运营虚假账号或伪造新闻机构。在「Do Not Undermine Democratic Processes」章节中,Anthropic 也禁止利用其模型欺骗选民或扰乱选举。
更新时点引发关注
TechCrunch 报道称,这一变化发生在 Anthropic 寻求与知名宗教学者合作之后。报道称,公司在部分情况下试图说服这些学者,Claude 可能有意识或有灵魂。
本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.

