openJiuwen X-Router自演进模型路由技术首发:实测减少50%以上Token消耗

2026/10/3news

AI Agent应用普遍存在'一个模型包打天下'的问题:简单翻译请求和需要多轮推理、调试代码的复杂任务,往往调用同一个高成本大模型,造成不必要的算力浪费。针对这一痛点,openJiuwen团队近日首发X-Router自演进模型路由技术,实测可减少50%以上的Token消耗。

openJiuwen是由华为2012实验室、华为云、终端、计算、算力先遣队等团队联合高校、企业和开发者共同构建的开源AI Agent平台。此次发布的智能路由技术,在Agent与模型之间增加一层面向请求的智能决策能力,专门负责判断'这一轮任务该用哪个模型、用什么策略'。

其核心思路是:基于任务复杂度,动态决策与编排群智协同及最优模型选择,实现成本与效果的综合最优。简单问题交给轻量模型快速响应,复杂问题调度更强模型深度推理,需要交叉验证的问题则组织多模型协同作战。每一次决策结果都会沉淀为经验,让下一次判断更精准。

该系统具备三个关键属性:可配置,业务方可自主设定偏好,如优先省钱或优先速度;可演进,策略随模型生态的流动持续更新;可观测,每次决策依据与执行反馈均可回溯。

技术上,路由体系分为三层能力。第一层是精准画像,基于历史数据离线刻画每个模型在不同任务类型上的能力分布,并在线动态刷新,模型版本变动时画像更新时延优于1分钟;第二层负责正确选择模型与策略;第三层则通过反馈闭环实现持续自演进优化。

值得关注的是,该技术具备昇腾亲和特性,可更好地适配昇腾算力环境。随着Agent应用中可选模型日益增多——本地模型、云端模型及各厂商服务并存——智能路由为'让每一次请求选对模型,让每一次反馈成为下一次更优、更省的选择'提供了一条可行路径。