产业观察
Anthropic and OpenAI want to embed safety evaluators. Will they really be independent?
📋总体概括
Anthropic和OpenAI计划在自家AI实验室内部引入独立安全评估人员,赋予其对模型开发过程的深度接触权限,这在AI行业尚属首次。研究人员普遍欢迎这种前所未有的开放程度,但同时警告:真正有意义的监督需要透明度、实质性独立性,以及最终的政府监管来保障,仅靠企业自愿安排并不足够。此举反映出头部AI公司在安全治理上的主动姿态,也暴露出自查模式的固有局限。
⚡关键信息
- ▸Anthropic与OpenAI计划将独立安全评估人员嵌入AI实验室内部,属行业首创做法
- ▸研究人员对这种前所未有的内部接触权限表示欢迎
- ▸研究者警告仅有嵌入还不够,有意义监督需要透明度和独立性
- ▸学界认为最终仍需外部监管作为兜底,企业自查存在根本局限
🔥犀利点评
把裁判请进自家球场,听起来进步,本质仍是球员自定规则。评估员拿谁的薪水、能看到什么、结论能否公开,这些没说清之前,「独立」二字就是公关话术。真正值得关注的不是谁先引入评估员,而是谁敢把评估报告原样公开——做不到这一点,再多的内部监督也只是给监管压力买缓冲时间。
📰 相关资讯(与本文相关的其他资讯)
本文由本站自动聚合,以下为原始来源:前往 TechCrunch 阅读全文 →