资讯🔥7.0
基元律动发布模型NeoHorse,探索Harness驱动的RSI路径
📋总体概括
基元律动(TokenRhythm)联合无问芯穹、清华、北大、阿里等机构发布首个Agent-Native模型NeoHorse-1,含4B和9B两个版本。公司由前华为诺亚方舟实验室主任、盘古大模型负责人王云鹤创办。模型训练语料以开源Routing Harness系统OpenSquilla产生的Agent执行轨迹为核心,保留工具调用与环境反馈,经质量评估后用于后训练,并结合路由信号与在策略蒸馏更新模型。在11项基准评测中,NeoHorse 4B在所列4B级模型中未加权平均分最高,并在五项基准上超过Qwen3.5-9B底座,团队称这是递归自我改进(RSI)的单轮工程验证。
⚡关键信息
- ▸基元律动联合无问芯穹、清华、北大、阿里发布Agent-Native模型NeoHorse-1,含4B和9B两版本
- ▸公司由前华为诺亚方舟实验室主任、盘古大模型负责人王云鹤创办,此前开源了Routing Harness系统OpenSquilla
- ▸训练语料以Routing Harness产生的Agent执行轨迹为核心,保留工具调用与环境反馈,经质量评估后用于后训练
- ▸在11项基准评测中,NeoHorse 4B的未加权平均分为4B级模型最高,并在五项基准上超过Qwen3.5-9B底座
- ▸改善集中于流程清晰、结果可验证的任务;大模型在复杂状态维护、长程调试和失败恢复中仍有优势
🔥犀利点评
把Agent执行轨迹喂回模型训练,本质是把Harness的路由经验内化成模型权重,思路不新但工程闭环做得扎实。4B打9B底座的数字好看,可团队自己承认改善集中在可验证的简单任务上,复杂场景仍靠更大模型兜底,说明小模型学的多是流程纪律而非真智能。至于RSI叙事,单轮验证离真正的自我改进还差得远,营销成分大于技术突破,但这条模型与Harness协同的路线值得持续盯着。
📰 相关资讯(与本文相关的其他资讯)
本文由本站自动聚合,以下为原始来源:前往 雷峰网 阅读全文 →