资讯

基元律动发布模型NeoHorse,探索Harness驱动的RSI路径

雷峰网·2026/9/8 06:31:00🔗 原文

📋总体概括

基元律动联合无问芯穹、清华、北大、阿里等机构发布首个Agent-Native模型NeoHorse-1,含4B和9B两版。公司由前华为诺亚方舟实验室主任、盘古大模型负责人王云鹤创办,将此前开源的Routing Harness系统OpenSquilla产生的Agent执行轨迹作为核心训练语料,配合路由信号与在策略蒸馏进行后训练。在11项基准评测中,NeoHorse 4B在同类4B模型中未加权平均分最高,并在五项基准上超过Qwen3.5-9B底座,被视为递归自我改进(RSI)的单轮工程验证。

关键信息

  • 基元律动联合无问芯穹、清华、北大、阿里推出Agent-Native模型NeoHorse-1,含4B和9B两个版本
  • 训练语料以Routing Harness系统OpenSquilla产生的执行轨迹为核心,经完整性检查和质量评估后用于后训练
  • 采用路由信号安排训练顺序,结合Agent执行监督与在策略蒸馏更新模型
  • 11项基准评测中,NeoHorse 4B为4B级未加权平均分最高,五项基准超过Qwen3.5-9B底座
  • 优势集中在流程清晰、结果可验证的任务;复杂状态维护、长程调试等大模型仍占优

🔥犀利点评

把Harness路由轨迹喂回模型训练,本质上是用工程系统的执行数据替代昂贵的专家标注,思路聪明且成本可控。但要泼冷水:所谓RSI目前只是单轮验证,评测优势集中在可验证任务上,这类任务本来就最容易刷分。小模型赢大模型的意义取决于真实Agent场景的失败率,而非基准均分。递归自我改进的叙事大于实质,下一轮闭环能否跑通才是分水岭。

本文由本站自动聚合,以下为原始来源:前往 雷峰网 阅读全文