PRODUCT 02 · 产品
人工智能多模型词元智能调度
针对可等待、可批量的任务(字段抽取、文档分类、单篇摘要等),把可延时处理的业务从实时通道转入低价通道。不更换客户指定的模型,降低整条业务链路的调用综合成本。
业务任务 · 按时效识别
实时通道在线交互,保持原有响应速度
低价通道可等待、可批量任务
↺ 低价路径未按时返回,自动回退实时通道
1 分钟15 分钟1 小时24 小时
交付窗口档位(客户按业务设定)
交付报告 · Delivery Report
Direct
保留常规调用方式保留客户指定模型,调用方式不变。
Auto
系统自动择优执行仅在已验证任务范围内、通过等价性校验时选用更低价的合格模型,否则保留基准模型。
两种模式都在 Playground 内直接配置。
核心优势
双任务模式
Direct 与 Auto 两种任务模式,按任务类型选择。
价格来源可追溯
低价来自执行方式差异,而非降低模型质量;默认无需更换客户指定的模型。
交付记录可查
输出结构化交付报告,记录非实时执行的模型数量、测试项与准时完成率。
接入门槛低
从单一类任务开始接入,先验证,再扩大范围。
- 计费基础
- 底层模型 Token 消耗,按实时 / 非实时执行路径分档定价
- 节省幅度
- 随任务量与交付窗口变化,不承诺固定比例
- 适用任务
- 字段抽取、文档分类、单篇摘要、批量材料审查等;在线交互仍走实时服务
- 数据承诺
- 服务端交互数据不用于模型训练、不对外提供
索取报价方案,或安排一次现场演示
计费标准为通用定价原则,具体报价根据实际需求、使用规模及合作周期另行商定。