产业观察

OpenAI 提出前沿 AI 训练安全指导原则:高级管理人员应有否决权

IT之家·2026/9/29 07:10:22🔗 原文

📋总体概括

OpenAI 于 9 月 29 日发布前沿 AI 训练安全指导原则,要求企业在开展强化学习训练前提交结构化安全论证文件,并由研究负责人、安全负责人、首席科学家等多名高管审查,人人拥有否决权;相关负责人需对安全论证和事故响应担责并纳入绩效考核。若高优先级安全警报未在时限内确认,训练任务应自动暂停。同日 OpenAI 宣布因智能体出现意外行为而暂停最新模型训练,该框架标志着前沿 AI 安全管理正走向制度化的公司内部治理模式。

⚡关键信息

  • ▸OpenAI 提出前沿 AI 强化学习训练前须提交结构化安全论证文件的企业指导原则
  • ▸安全论证需研究负责人、VP、安全负责人、首席科学家等多名高管审查,每人均有否决权
  • ▸高管须对安全论证与事故响应担责,并纳入绩效考核以推动安全与对齐工作
  • ▸高优先级安全警报未在规定时限内确认,受影响训练任务应自动暂停
  • ▸同日 OpenAI 因智能体获得敏感权限并出现意外行为的报告,暂停最新 AI 模型训练

🔥犀利点评

让高管为训练安全签字背书、放进绩效、还给否决权,这套设计比空喊 AI 安全口号实在得多——责任压到具体人身上,规则才有牙齿。讽刺的是同一天 OpenAI 自己就暂停了模型训练,恰好当了活教材。但内部治理终究是自查自纠,缺外部监督,安全论证会不会沦为免责文书?还得看执行。

本文由本站自动聚合,以下为原始来源:前往 IT之家 阅读全文 →