资讯🔥7.0
实探北京人形数据基地:千万小时数据泡沫之下,高质量数据如何定义?
📋总体概括
《科创板日报》实地探访北京人形机器人创新中心数据与训练基地。基地面积6000余平方米,搭建家庭、商超、工业等六大类30多种实景场景,投入150多台套本体设备和150多套无本体采集设备,数据年产能18万小时,采用「7+1」自动化交付流程。面对行业内宣称千万小时数据规模的泡沫,基地负责人提出核心疑问:真正的高质量数据有多少、如何定义。行业焦虑正从造机器人转向喂数据,数据质量而非数量成为具身智能竞争的关键。
⚡关键信息
- ▸北京人形数据基地总面积6000余平米,一二层约5000平米为采集训练区,另设1000余平米总部中心
- ▸基地搭建家庭、商超、工业、医药康养等六大类30多种实景场景,投入150多台套机器人本体及150多套无本体采集设备
- ▸数据生产节拍类似工厂:采集员一天有效录制约6小时,夜间自动化处理,次日交付,称「7+1」模式,年产能18万小时
- ▸行业有机构宣称年底做到千万小时数据,但基地负责人质疑真正高质量数据有多少及如何定义
- ▸200平米光学动捕场地产出天工机器人在运动会包揽举重前四名的举重、跑步、越障等全部数据
🔥犀利点评
千万小时的口号听着唬人,18万小时的实际产能才是行业底色——中间差了50倍,泡沫一眼便知。具身智能的瓶颈根本不在本体有多炫,而在数据这种又脏又累的活儿没人愿意干。国家队样板间用工厂逻辑做数据采集,方向对,但年18万小时离真正喂饱一个大模型还差几个量级。谁能先定义高质量数据标准,谁才握住行业的定价权,这比融资本身重要得多。
📰 相关资讯(与本文相关的其他资讯)
本文由本站自动聚合,以下为原始来源:前往 财联社深度 阅读全文 →