openJiuwen推出X-Router自演进模型路由技术,实测Token消耗减少超50%

让每一次请求选对模型,让每一次反馈都成为下一次更优、更省的选择。
并非所有任务都需要调用最强模型。当前多数AI应用仍处于"一个模型包打天下"的状态:简单翻译和复杂代码调试可能调用同一个千亿参数云端模型。当Agent同时接入本地模型、云端模型及多家厂商服务时,固定规则难以跟上业务与模型的持续变化。用户真正需要的,是让Agent自行判断请求该由谁处理、为何如此选择,以及下次能否更优。
openJiuwen是由华为2012实验室、华为云、终端、计算、算力先遣队等团队联合高校、企业及开发者共同构建的开源AI Agent平台。此次团队推出的X-Router,在Agent与模型之间增加一层面向请求的智能决策能力,负责判断本轮任务该用哪个模型、用什么策略。其基于任务复杂度动态决策与编排群智协同及最优模型选择,以实现成本与效果的综合最优。
具体而言,简单问题由轻快模型快速响应,复杂问题调度更强模型深度思考,需要多模型互相印证的任务则组织协同作战并统一汇总。每次决策结果都会转化为经验,使后续判断更准确。该路由引擎的关键在于"动态":它不是开关或写死的配置表,而是随任务、用户、负载、成本实时变化的决策系统。
- 可配置:不同业务可带入自身偏好,本轮追求最省或最快由业务方决定,不受固定规则束缚;
- 可演进:模型生态持续流动,新模型不断出现、老模型降价、同模型迭代后能力分布可能改变,策略需随之成长。
本文图片来自互联网,仅供学习交流使用,版权归原作者或原平台所有。如认为图片侵犯了您的权益,请联系我们删除。

