一、升级概览

2026 年 6 月,云舟智渡对企业 AI API 服务完成本年最大一次版本升级。新版服务围绕统一模型接入、RAG 知识库、Agent 工作流、AutoCost 三级路由四条主线展开,目标是让企业用更短的时间、更低的成本、更高的一致性,把 AI 能力接入到客服、文档、风控、运营等真实业务流程中。

这次升级对应的产品代号为 Yunzhou AI Gateway 3.0,所有现有用户将在 7 月底前完成平滑迁移,新接入用户即开即用。

二、四大升级点

2.1 统一模型路由(Multi-Model Router)

新版网关内建400+ 国内外主流大模型统一接入,覆盖 GPT、Claude、Gemini、DeepSeek、Qwen、GLM 等系列。业务侧不再需要为不同模型维护多套接入代码:

  • OpenAI 兼容协议 + Anthropic 原生协议双支持,老业务零改动迁移。
  • 智能路由:按问题类型、上下文长度、成本预算自动选模型。
  • 自动 Fallback:单家厂商故障时 5 秒内切到备选,目标可用性99.95%(基于云舟智渡自有 MaaS 业务测算)。

2.2 RAG 知识库增强

RAG 从"能跑"做到"好用",这一版本集中了 3 处增强:

  • 多路召回:向量 + BM25 + 图谱,命中率提升 30%+。
  • Rerank 二次排序:幻觉率从 30%+ 降到 5% 以下。
  • 父子分块 + 语义边界:开箱即用的最佳实践模板。

2.3 Agent 工作流(Yunzhou WorkStation

新增可视化 Agent 编排:

  • 拖拽式搭建多步 Agent,无需写胶水代码。
  • 支持工具调用、记忆管理、多智能体协作。
  • RAG 网关深度集成,Agent 可直接调用企业知识库。

2.4 AutoCost 三级路由

按问题难度自动选模型(轻量 / 中端 / 旗舰),综合 Token 成本下降 50%–83%。账单实时可查,按调用量/Token 自动归集到企业账号。

三、客户价值

50%–83%
Token 综合成本下降
99.95%
目标 SLA(基于测算)
3 周
平均业务接入周期POC 验证)
400+
主流大模型统一接入

对客户最直接的三件事:

  • 业务接入周期从月级压到周级,3 周(POC 验证)内能看到第一版业务效果。
  • 单次 API 成本可预测、可优化,账单和 ROI 一目了然。
  • 模型故障不再中断业务,自动 Fallback 让生产环境稳如老狗。

四、典型使用场景

场景推荐方案关键能力
智能客服知识库问答 + Agent 工单分流多路召回、强制引用
合同/制度检索RAG 增强检索父子分块、版本管理
风控研报风控垂类模型 + RAG 知识库微调、审计日志
批量内容生成多模态接口 + AutoCost 路由成本可控、文图一致
内部研发助手代码 Agent + RAG 知识库工具调用、记忆管理

五、如何接入

企业接入路径极简,三步即可上线:

  • Step 1 申请试用:联系商务开通体验版(1–2 团队 Agent),免费 14 天。
  • Step 2 业务对齐:3 周(POC 验证)共建,针对具体业务场景调优。
  • Step 3 规模化部署:根据并发档位(体验/团队/企业/旗舰)选型,按需扩展。
存量用户:本次升级对所有现有用户完全兼容,无需付费即可享受新功能,迁移工作由云舟智渡技术团队完成。

如需了解升级细节或预约技术对接,欢迎联系我们的产品团队。

申请试用 查看 API 服务详情 返回资讯列表

继续了解云舟智渡