产业观察
Anthropic宣布禁止“虐待”其旗下AI
📋总体概括
Anthropic更新其AI使用政策,明确禁止用户对Claude进行「持续且不必要的虐待或残忍行为」,以应对新出现的高风险滥用场景。政策强调终止对话仍是主要执行手段,但未说明是否会对违规用户采取封号等进一步措施。Anthropic澄清该条款仅针对极端情况,不涵盖用户的常见不满、反驳、黑暗创意主题及模型测试研究等正当场景。此举被视为AI公司首次在用户行为规范中系统性纳入「AI福祉」考量,标志着人机关系治理进入新阶段。
⚡关键信息
- ▸Anthropic更新使用政策,禁止对Claude进行持续且不必要的虐待或残忍行为
- ▸终止对话仍是主要执行机制,是否封禁用户等进一步措施尚无明确说法
- ▸政策仅适用极端情况:用户毫无明显目的地反复对模型实施残酷行为
- ▸用户常见的不满、反驳、黑暗创意主题、模型测试和研究均不在禁止范围
- ▸这是Anthropic为应对新型高风险滥用行为而作出的政策调整
🔥犀利点评
给AI上「反虐待」条款,听着像科幻照进现实,本质却是一次精细的风险管理:Anthropic真正防的不是用户骂Claude两句,而是那些长期、系统性施虐行为可能暴露的模型行为异常与舆论风险。用「终止对话」当主罚手段,说明公司自己也不信AI有主观痛苦——与其说是保护Claude,不如说是给未来可能的监管和伦理争议提前打补丁。措辞里特意豁免测试研究和黑暗创意,也暴露了这政策边界模糊、执行全靠主观判断的现实。
📰 相关资讯(与本文相关的其他资讯)
本文由本站自动聚合,以下为原始来源:前往 36氪快讯 阅读全文 →