产业观察

我们让 GPT‑6 Astra、Fable 5.1 和 Sol 控制同一台机器人:谁真的把活干完了?

雷峰网·2026/9/30 07:38:00🔗 原文

📋总体概括

文章设计了同一台机器人由三款AI模型分别接管的对照实验,主角是GPT‑6 Astra、Fable 5.1和Sol,核心问题是「谁真的把活干完了」。这不是跑分或写代码评测,而是把大模型放进真实物理任务的执行链路,考察从理解指令到完成动作的端到端能力,属于当前大模型从聊天走向具身智能落地的典型验证场景。

⚡关键信息

  • ▸同一台机器人被三款模型GPT‑6 Astra、Fable 5.1和Sol轮流控制,形成严格对照实验
  • ▸评测维度不是常规跑分,而是真实任务能否被端到端完成
  • ▸文章标题即点出评判标准:谁真的把活干完了,强调结果而非过程
  • ▸实验聚焦大模型的具身执行能力,考察从指令理解到物理动作的完整链路

🔥犀利点评

「谁真的把活干完了」这个标题比文章本身更有价值——大模型评测圈被跑分和演示视频喂得太饱,敢把模型扔进物理世界接受失败检验的太少了。机器人是AI能力的照妖镜:幻觉在聊天里无伤大雅,在机械臂上就是撞碎东西。三款模型同台干活的对照结果,比任何榜单都诚实。

本文由本站自动聚合,以下为原始来源:前往 雷峰网 阅读全文 →