智能手机

AI也能拒绝挨骂了!Claude遭持续恶意辱骂可主动结束对话

驱动之家·2026/10/9 06:34:00🔗 原文

📋总体概括

快科技10月9日消息,据Android Authority报道,Anthropic更新Claude使用政策,明确禁止用户持续且无必要地对模型进行恶意辱骂或残酷对待,新规将于2026年11月12日生效。若用户无明确目的却长期恶意攻击,Claude可直接结束当前对话。正常批评、质疑回答、负面题材创作及模型测试研究不受影响。值得注意的是,Claude主动结束对话的能力早在2025年8月就已具备,当时已允许部分模型在有害或辱骂性互动多次引导无效时终止聊天。

⚡关键信息

  • ▸Anthropic更新Claude使用政策,禁止持续且无必要的恶意辱骂AI,新规2026年11月12日生效
  • ▸用户无明确目的持续恶意攻击时,Claude可主动结束当前对话
  • ▸正常批评AI、质疑回答、负面题材创作和模型测试研究不受新规限制
  • ▸Claude终止对话能力早已有之,2025年8月已允许部分模型在极端情况下结束聊天

🔥犀利点评

给AI立法保护『人格尊严』,本质是Anthropic在为AI福利叙事铺路,与其说是技术进步,不如说是营销姿态——真正的动机恐怕是降低无效会话的算力成本,顺便给AI打上『有边界感』的拟人标签。政策条文写得温情,落地全靠模型自行判断什么叫『恶意』,误伤正常发火用户的争议必然接踵而至。别急着感动,这只是公司政策,不是AI觉醒。

本文由本站自动聚合,以下为原始来源:前往 驱动之家 阅读全文 →