一、升级概览
2026 年 6 月,云舟智渡对企业 AI API 服务完成本年最大一次版本升级。新版服务围绕统一模型接入、RAG 知识库、Agent 工作流、AutoCost 三级路由四条主线展开,目标是让企业用更短的时间、更低的成本、更高的一致性,把 AI 能力接入到客服、文档、风控、运营等真实业务流程中。
这次升级对应的产品代号为 Yunzhou AI Gateway 3.0,所有现有用户将在 7 月底前完成平滑迁移,新接入用户即开即用。
二、四大升级点
2.1 统一模型路由(Multi-Model Router)
新版网关内建400+ 国内外主流大模型统一接入,覆盖 GPT、Claude、Gemini、DeepSeek、Qwen、GLM 等系列。业务侧不再需要为不同模型维护多套接入代码:
- OpenAI 兼容协议 + Anthropic 原生协议双支持,老业务零改动迁移。
- 智能路由:按问题类型、上下文长度、成本预算自动选模型。
- 自动 Fallback:单家厂商故障时 5 秒内切到备选,目标可用性达 99.95%(基于云舟智渡自有 MaaS 业务测算)。
2.2 RAG 知识库增强
把 RAG 从"能跑"做到"好用",这一版本集中了 3 处增强:
- 多路召回:向量 + BM25 + 图谱,命中率提升 30%+。
- Rerank 二次排序:幻觉率从 30%+ 降到 5% 以下。
- 父子分块 + 语义边界:开箱即用的最佳实践模板。
2.3 Agent 工作流(Yunzhou WorkStation)
新增可视化 Agent 编排:
- 拖拽式搭建多步 Agent,无需写胶水代码。
- 支持工具调用、记忆管理、多智能体协作。
- 与 RAG 网关深度集成,Agent 可直接调用企业知识库。
2.4 AutoCost 三级路由
按问题难度自动选模型(轻量 / 中端 / 旗舰),综合 Token 成本下降 50%–83%。账单实时可查,按调用量/Token 自动归集到企业账号。
三、客户价值
50%–83%
Token 综合成本下降
99.95%
目标 SLA(基于测算)
3 周
平均业务接入周期(POC 验证)
400+
主流大模型统一接入
对客户最直接的三件事:
- 业务接入周期从月级压到周级,3 周(POC 验证)内能看到第一版业务效果。
- 单次 API 成本可预测、可优化,账单和 ROI 一目了然。
- 模型故障不再中断业务,自动 Fallback 让生产环境稳如老狗。
四、典型使用场景
| 场景 | 推荐方案 | 关键能力 |
|---|---|---|
| 智能客服 | 知识库问答 + Agent 工单分流 | 多路召回、强制引用 |
| 合同/制度检索 | RAG 增强检索 | 父子分块、版本管理 |
| 风控研报 | 风控垂类模型 + RAG 知识库 | 微调、审计日志 |
| 批量内容生成 | 多模态接口 + AutoCost 路由 | 成本可控、文图一致 |
| 内部研发助手 | 代码 Agent + RAG 知识库 | 工具调用、记忆管理 |
五、如何接入
企业接入路径极简,三步即可上线:
- Step 1 申请试用:联系商务开通体验版(1–2 团队 Agent),免费 14 天。
- Step 2 业务对齐:3 周(POC 验证)共建,针对具体业务场景调优。
- Step 3 规模化部署:根据并发档位(体验/团队/企业/旗舰)选型,按需扩展。
存量用户:本次升级对所有现有用户完全兼容,无需付费即可享受新功能,迁移工作由云舟智渡技术团队完成。
如需了解升级细节或预约技术对接,欢迎联系我们的产品团队。