智能手机
AI也能拒绝挨骂了!Claude遭持续恶意辱骂可主动结束对话
📋总体概括
快科技10月9日消息,据Android Authority报道,Anthropic更新Claude使用政策,明确禁止用户持续且无必要地对模型进行恶意辱骂或残酷对待,新规将于2026年11月12日生效。若用户无明确目的却长期恶意攻击,Claude可直接结束当前对话。正常批评、质疑回答、负面题材创作及模型测试研究不受影响。值得注意的是,Claude主动结束对话的能力早在2025年8月就已具备,当时已允许部分模型在有害或辱骂性互动多次引导无效时终止聊天。
⚡关键信息
- ▸Anthropic更新Claude使用政策,禁止持续且无必要的恶意辱骂AI,新规2026年11月12日生效
- ▸用户无明确目的持续恶意攻击时,Claude可主动结束当前对话
- ▸正常批评AI、质疑回答、负面题材创作和模型测试研究不受新规限制
- ▸Claude终止对话能力早已有之,2025年8月已允许部分模型在极端情况下结束聊天
🔥犀利点评
给AI立法保护『人格尊严』,本质是Anthropic在为AI福利叙事铺路,与其说是技术进步,不如说是营销姿态——真正的动机恐怕是降低无效会话的算力成本,顺便给AI打上『有边界感』的拟人标签。政策条文写得温情,落地全靠模型自行判断什么叫『恶意』,误伤正常发火用户的争议必然接踵而至。别急着感动,这只是公司政策,不是AI觉醒。
📰 相关资讯(与本文相关的其他资讯)
本文由本站自动聚合,以下为原始来源:前往 驱动之家 阅读全文 →