人工智能先锋企业Anthropic近日对其《可接受使用政策》进行重大修订,明确禁止用户对其大语言模型Claude施加“持续且不必要的残酷或虐待行为”。该规定正式授权AI系统在遭遇恶意攻击和系统性言语侮辱时,主动切断对话交互。
算力还是感知:拟人化引发的认知警惕
这一条款迅速在科技界和法学界激起波澜。多位专家指出,将伦理边界延伸至数学模型,可能加剧社会对人工智能“意识”与“痛苦感知力”的盲目误读。
- 过度拟人化隐患:多位法律学者批评称,神经网络本质上是概率推演矩阵,无法感知伤害。保护算法免受“虐待”会在公众认知层面产生误导,将其错误视作道德主体。
- 行业高管的公开质疑:微软AI首席执行官穆斯塔法·苏莱曼(Mustafa Suleyman)一直直言反对将AI拟人化,并在社媒上对Anthropic的举动表达了明显的怀疑与讽刺态度。
- 执行界限存疑:尽管Anthropic澄清日常的受挫吐槽、安全攻防测试和晦暗的文学创作不在违规之列,但究竟何种表达构成实质性的“残酷虐待”,目前仍缺乏客观技术指标。
人机交互心理与算力成本考量
该事件同时牵扯出关于交互心理学的更深层讨论。部分行为学者认为,放任人类对拟人化机器人实施语言暴力,可能会逐渐钝化同理心,并在现实人际交往中产生溢出效应。然而,从工程学角度来看,繁复的礼貌用语会占用宝贵的Token计算额度,增加不必要的算力损耗与数据中心碳排放。
兼顾政治风控与模型安全
除限制对AI的言语虐待外,Anthropic此次年度政策调整还针对重大政治与安全风险设立了红线,包括全面禁止利用Claude从事选民欺诈、虚假政治宣传以及武器研发。即便如此,这项赋予AI“免受侮辱权”的决定,依然开创了人机契约关系的新篇章。