点击右上角
微信好友
朋友圈

请使用浏览器分享功能进行分享

9月22日,在2026杭州云栖大会企业级Agent实践峰会上,基元律动联合创始人兼CTO韩凯表示,多模型长期异构并存、算力资源多元供给,将成为大模型产业的长期结构。随着Agent承担越来越复杂的任务,如何组织不同模型,并将应用中的反馈转化为模型改进的依据,正在成为新的技术课题。
据国家数据局披露,2026年3月,我国日均Token调用量已超过140万亿,较2024年初增长超千倍。韩凯强调,一次复杂Agent任务往往涉及十余次乃至数十次模型调用。任务表现既取决于模型本身,也取决于支撑任务执行的系统能力,包括模型选择、工具调用与上下文管理等。
“Harness是支撑Agent执行任务的运行框架,模型路由是其中的一项关键能力。”韩凯介绍道,不同模型在能力、成本和响应速度上各有特点,复杂任务需要根据每一步的需求选择合适的模型。模型异构适配与算力异构调度,也需要相应的专业能力支撑。
针对这一技术方向,基元律动依托开源项目OpenSquilla开展深度探索。根据公司公开的端到端Agent评测数据,在特定测试配置条件下,OpenSquilla能够保留固定旗舰模型基线99.96%的任务质量,同时实现88.9%的成本降幅。在DRACO深度研究评测中,其多模型协同配置的得分超越本组实验中性能最优的单模型基线,使用成本仅为后者的三分之一。一系列评测结果,充分验证了智能模型调度在特定任务场景下,兼顾效果提升与成本优化的双重优势。
“路由层的价值,在于让每一步任务用对模型、用得起模型。”韩凯说。
除模型调度能力外,韩凯还重点介绍了面向RSI(递归式自我改进)的反馈闭环机制:以真实场景的能力需求为导向,通过系统化评测精准定位模型与调度策略的优化方向,开展针对性迭代升级,再将优化后的全新能力落地场景进行效果验证。该机制打通了模型应用、能力评测、迭代优化的全链路,为Agent在持续验证、动态优化中稳步提升任务表现,提供了可行路径。
据悉,基元律动与阿里云围绕Qwen系列开展场景测试、评测和应用验证,在自身Harness与Agent产品中持续使用模型、积累反馈,并推动新版本接入TokenRhythm路由平台。同时,基础设施方面,阿里云为相关业务运行提供云服务支持,无问芯穹为NeoHorse-1的训练与推理提供算力支持及基础设施优化。
从Harness到RSI,基元律动希望将模型调度与模型迭代连接起来,一方面,最大化释放现有模型的场景适配能力,让各类模型在适配场景中发挥最优价值;另一方面,将Agent任务执行过程中积累的实战经验,反哺模型训练与评测体系,持续探索AI智能体自主、持续进化的全新路径。(杨亚楠)
