产业观察
Sutton、OpenAI 联创押注的持续学习,有中国团队带着模型进场了
📋总体概括
「持续学习」正成为硅谷热门AI赛道:7月15日,Thinking Machines Lab发布首款面向持续学习场景的开放权重模型Inkling;图灵奖得主、强化学习之父Richard Sutton本月下场创业,方向为持续学习Agent。国内亦有团队跟进,7月21日专注强化学习的实验室Mind Lab发布基于GLM 5.2后训练的模型Macaron V1,采用混合LoRA架构、原生支持持续学习。这一曾是学术概念的技术路线,正被中美创业公司同步推进,开始成为国内AI创业的「显学」方向。
⚡关键信息
- ▸7月15日,Thinking Machines Lab发布开放权重模型Inkling,为其成立一年后的首款持续学习模型
- ▸图灵奖得主、强化学习之父Richard Sutton本月下场创业,押注持续学习Agent方向
- ▸国内Mind Lab于7月21日发布Macaron V1,基于GLM 5.2后训练并采用混合LoRA架构
- ▸Macaron V1原生支持持续学习,标志着国内团队正式进入这一赛道
- ▸持续学习从学术议题转变为中美同步的热门创业方向
🔥犀利点评
持续学习本质上是冲着大模型最大的软肋去的——训练即冻结、成本高昂。如果Inkling和Macaron V1能让模型边用边学、无需全量重训,动摇的将不只是微调市场,而是整个以参数规模论英雄的训练范式。Sutton亲自下场是个强烈信号:强化学习老人等这一天等了几十年。但热闹之下要看真章——混合LoRA是工程折中还是范式突破,国内团队交出的作业成色还需实测说话。
📰 相关资讯(与本文相关的其他资讯)
本文由本站自动聚合,以下为原始来源:前往 极客公园 阅读全文 →