产业观察
上海市信息安全测评认证中心发布全国首个生成式人工智能安全测试公共服务平台
📋总体概括
上海市信息安全测评认证中心在国家网络安全宣传周上海活动开幕式上发布全国首个生成式人工智能安全测试公共服务平台「智测能手」,由上海市委网信办、市经信委指导建设。平台以公共服务产品思路运作,其大模型安全测评模块可对生成违法违规内容、歧视偏见、事实性错误等风险进行自动化评测,输出测评结论与优化建议,对模型违规输出的判定准确率不低于95%,为国内AI治理提供了上海方案。
⚡关键信息
- ▸全国首个生成式AI安全测试公共服务平台「智测能手」9月14日在上海发布
- ▸平台由上海市信息安全测评认证中心建设,市委网信办、市经信委指导
- ▸测评模块覆盖违法违规内容、歧视偏见、事实性错误等风险,实现自动化评测
- ▸对模型违规输出的判定准确率不低于95%,并输出测评结论与优化建议
🔥犀利点评
大模型备案审核早已是上线刚需,但一直缺独立第三方测评的公共基础设施,上海把这事做成了公共服务,方向是对的。95%的准确率听起来漂亮,可安全测评真正的难点在长尾风险和对抗性绕过,自动化工具能兜住底线,替代不了人工红队。真正要看的是后续有没有强制力——如果只是自愿送测的招牌工程,价值就打了折扣。
📰 相关资讯(与本文相关的其他资讯)
本文由本站自动聚合,以下为原始来源:前往 36氪快讯 阅读全文 →