产品与服务/02 BackBy多模型词元智能调度
PRODUCT 02 · 产品

人工智能多模型词元智能调度

针对可等待、可批量的任务(字段抽取、文档分类、单篇摘要等),把可延时处理的业务从实时通道转入低价通道。不更换客户指定的模型,降低整条业务链路的调用综合成本。

业务任务按时效识别 未按时返回自动回退实时通道 在线交互 · 实时通道可等待 · 可批量 · 低价通道 1 分钟15 分钟1 小时24 小时交付窗口档位(客户按业务设定) 交付报告Delivery Report
业务任务 · 按时效识别
实时通道在线交互,保持原有响应速度
低价通道可等待、可批量任务
↺ 低价路径未按时返回,自动回退实时通道
1 分钟15 分钟1 小时24 小时
交付窗口档位(客户按业务设定)
交付报告 · Delivery Report
Direct
保留常规调用方式

保留客户指定模型,调用方式不变。

Auto
系统自动择优执行

仅在已验证任务范围内、通过等价性校验时选用更低价的合格模型,否则保留基准模型。

两种模式都在 Playground 内直接配置。

核心优势

双任务模式

Direct 与 Auto 两种任务模式,按任务类型选择。

价格来源可追溯

低价来自执行方式差异,而非降低模型质量;默认无需更换客户指定的模型。

交付记录可查

输出结构化交付报告,记录非实时执行的模型数量、测试项与准时完成率。

接入门槛低

从单一类任务开始接入,先验证,再扩大范围。

计费基础
底层模型 Token 消耗,按实时 / 非实时执行路径分档定价
节省幅度
随任务量与交付窗口变化,不承诺固定比例
适用任务
字段抽取、文档分类、单篇摘要、批量材料审查等;在线交互仍走实时服务
数据承诺
服务端交互数据不用于模型训练、不对外提供
预约任务验证 →

索取报价方案,或安排一次现场演示

计费标准为通用定价原则,具体报价根据实际需求、使用规模及合作周期另行商定。

联系我们 →
索取报价 · 预约演示联系我们 →