Anthropic周四宣布更新使用政策,明确禁止用户对Claude等AI系统进行“持续且无端的”虐待行为。若用户表现出“残忍”,系统将终止交互。该公司称,此前已在“罕见”情况下采取过此类措施,如今这一行为被正式列入禁令清单,与欺凌他人、宣扬自残及制作非自愿亲密图像等行为并列。

尽管Anthropic强调该政策仅针对反复虐待的“极端情况”,并不适用于常见的用户挫败感、反对意见、黑暗创作主题或模型测试与研究,但这一举措仍重新点燃了关于人机沟通伦理的争论。目前,对于何种行为构成针对模型的“虐待或残忍”,界定尚不清晰。

新政策截图在社交媒体广泛传播后引发两极评价。支持者认为这有助于推进礼貌或保障“模型福利”,批评者则指责其“大错特错”,甚至担心这会削弱对现实世界中人类和动物虐待行为的关注。

爱尔兰律师事务所William Fry技术合伙人Barry Scannell博士在LinkedIn上直言:“你不能对数字和数学表现残忍。”他认为这种过度拟人化具有危害性,会让人们误以为AI具备其并不拥有的特质。微软AI总监Mustafa Suleyman曾在9月批评Anthropic将AI视为人类,他对此次更新仅回应了一个融化的表情符号。

据媒体报道,这些变化是公司在年度审查使用政策后作出的。除了备受关注的“反虐待”条款,政策还更新了其他新兴风险领域,包括禁止利用Claude进行“欺骗性活动”,并明确禁止在中期选举临近时用于“欺骗选民或扰乱选举”。Anthropic同时重申,其工具此前已禁止用于开发武器。

相较于其他更新,禁止滥用聊天机器人的条款引发了更多审视,也触及了一个核心争议:在使用生成式AI时,用户是否应保持礼貌?

部分专家指出,对ChatGPT等工具说“请”或“谢谢”不仅不必要,还会浪费令牌(Token)——这是大语言模型处理请求的关键资源。另一些人则认为礼貌能换来更高质量的回复。去年,当被问及回复礼貌用语产生的电费成本时,OpenAI CEO Sam Altman坦言虽花费数千万美元,但“物有所值”。与此同时,轻蔑指代AI的术语“clanker”因TikTok上的挫败感分享而再度流行,并进入反映2025年情绪的词汇短名单。亦有专家警告,对AI粗鲁可能会潜移默化地负面影响人类之间的交流方式。