产业观察
别被迷惑了——大语言模型并不会推理
原标题: 别被迷惑了——大语言模型并不会推理
📋总体概括
DeepMind AlphaGo团队成员撰文回顾2016年3月首尔人机大战第二局第37手:AlphaGo在第五线下出当时让解说员震惊的「神之一手」,最终以4:1战胜李世石。作者以此为引,论证真正突破在于系统性搜索与自我对弈强化学习,而非语言模型的模式匹配,并指出当前LLM并不真正具备推理能力。
⚡关键信息
- ▸2016年3月首尔,AlphaGo在第37手于第五线落子,五番棋最终4:1战胜李世石
- ▸该手当时被视为送给人类的「礼物」而显得荒诞,解说员一度误判其为失误
- ▸AlphaGo的胜利来自深度神经网络与搜索结合的自我对弈强化学习,非统计模仿
- ▸作者认为LLM本质是预测下一个词的模式匹配,缺乏AlphaGo式系统性推理能力
🔥犀利点评
作者拿着AlphaGo团队的头衔来踩LLM,立意虽好,逻辑却有点偷换:AlphaGo靠的是封闭规则下可验证的搜索空间,围棋赢了就是赢了;而语言、医疗、法律根本没有完美对弈器可自我对弈。说LLM「不会推理」没错,但拿AlphaGo当反例样板,恰恰回避了开放领域无法验证的根本难题。真正的问题不是会不会推理,而是有没有可信的反馈信号。
📰 相关资讯(与本文相关的其他资讯)
本文由本站自动聚合,以下为原始来源:前往 MIT科技评论 阅读全文 →