产业观察

AI models need more data about biology, and OpenAI is paying to create it

MIT科技评论·2026/9/15 12:00:00🔗 原文

📋总体概括

OpenAI正在出资购买生物学数据以训练更强大的AI模型。这一思路源于政策分析师Ruxandra Teslo的提议:竞拍破产生物技术公司的资产,获取通常作为商业机密保密的监管申报文件、生产策略与安全数据。失败公司的数据反而能帮助AI学习药物研发中的真实失败经验,OpenAI的付费行为标志着AI公司开始主动「制造」训练数据而非仅依赖公开语料。

关键信息

  • OpenAI正在花钱创建AI模型所需的生物学数据,而非仅依赖公开数据
  • 想法来自临床政策分析师Ruxandra Teslo,她去年提出收购破产生物技术公司数据
  • 破产拍卖可获取监管申报、生产策略和安全数据,这些通常是保密的商业机密
  • 失败生物技术公司的数据能教会AI模型药物研发中宝贵的失败经验
  • 此举反映AI行业正从挖掘存量数据转向主动付费生产稀缺数据

🔥犀利点评

这才是AI竞争的下一个战场:公开互联网的语料已经快被榨干,OpenAI开始真金白银去买「稀缺数据」了。用破产生物技术公司的失败数据训练模型,本质是花钱购买现实世界 trial-and-error 的经验——这些教训昂贵到只有死人公司才愿意贱卖。谁能系统性获取独占数据,谁的模型护城河就更深,数据本身就是新石油。

本文由本站自动聚合,以下为原始来源:前往 MIT科技评论 阅读全文