Skip to content

渠道配置

管理后台 → 大模型 → 渠道管理

渠道是平台与上游供应商之间的接入配置:供应商类型 + Base URL + 凭证。请求到达网关后,调度引擎从声明了对应模型能力、且健康可用的渠道中选择一条转发路径,异常时自动切换。接入新供应商只需在此创建渠道,无需改动代码。

管理后台 — 渠道监控

支持的供应商

渠道类型覆盖 30+ 供应商:OpenAI、Claude (Anthropic)、Gemini (Google)、Ali(百炼)、Tencent(混元)、Zhipu(智谱)、DeepSeek、Moonshot、Volcengine(火山)、AWS Bedrock、Azure OpenAI、Vertex AI、Mistral、xAI (Grok)、Lingyi(零一万物)、Baidu V2、Cloudflare Workers AI、Ollama、SiliconFlow(硅基流动)、Xunfei(讯飞)、OpenRouter、XInference、MiniMax、Submodel、Coze(扣子)、Dify、Jimeng(即梦)、Codex、New API、Sub2API 等。

其中 Ollama / XInference 等本地推理框架与云端模型同池调度,适合混合部署。

创建渠道

渠道管理 → 创建渠道,表单分为三段:

基础信息

字段说明
渠道名称自定义,便于识别,如「OpenAI 主力」
供应商类型决定协议适配方式,可搜索选择
Base URL上游地址。留空自动使用该供应商的官方默认地址;中转商填其分发地址
API Key上游密钥,必填。加密存储,不落明文(见安全说明

调度与容量

字段默认值说明
调度层级首选三档固定层级:首选(承接主要流量)/ 备用(零星保温流量,主力饱和时溢出承接)/ 保底(仅前两层不可用时使用)
权重1000–100,同层级内按权重比例分配流量
最大并发1000 = 自动估算(按上游 429 水位动态调整)
严格容量Redis 故障时保守限流(fail-closed),高成本渠道建议开启
状态启用启用 / 禁用 / 测试中(测试中不参与正式调度)
测试模型渠道测试用的默认模型,如 gpt-4o-mini
使用代理开启后该渠道经全局出站代理转发(需先在系统设置 → 渠道配置配置代理地址)
备注选填

VIP 设置(折叠面板)

面向「VIP 专属渠道」的运营玩法:开启 VIP 渠道 后,可配置共享阈值(低于该健康分的非 VIP 租户不进入)、抢占阈值借用冷却(秒)(非 VIP 租户借用后被释放的冷却时间),让高价值租户优先使用优质渠道。

官方渠道授权

对 Claude、OpenAI、Codex、Gemini 官方账号,可免手工粘贴 Key,直接走 OAuth 授权创建渠道:

  • Claude 支持两种模式:浏览器授权(生成授权链接 → 登录并授权 → 把回调 URL 中的 code 粘贴回后台换取令牌)与 Cookie 授权(粘贴 claude.ai 的 sessionKey 直接完成);授权范围可选完整权限或仅推理;
  • OpenAI / Codex / Gemini 走标准授权链接流程。

授权成功后渠道自动创建,令牌由平台托管并自动续期。

渠道列表

列表按渠道 ID、类型、模型名、状态、地址、名称筛选,支持导出 CSV / Excel。关键列与操作:

列 / 操作说明
层级 / 权重行内直接编辑,改完即时保存,用于实时调流
健康度0–100 分:≥80 健康(绿)、50–79 降级(黄)、<50 故障(红)
调度状态正常 / 熔断 / 半开,详见健康度与熔断
启用 / 禁用快捷开关,禁用后立即退出调度
重置健康度熔断复位 + 成功率恢复,渠道立即恢复被调度的资格(上游修复后用它立刻拉起)
详情进入渠道详情
删除二次确认后删除渠道及其 Key、模型能力

调度规则

页面顶部的「了解优先级、权重、亲和与容量如何共同调度」内置于产品,规则概要:

  1. 候选筛选 —— 只在「已启用 + 支持当前模型 + 符合租户范围 + 存在可用 Key」的渠道中选择;健康度低于 20 的渠道通常被排除,若全部低于 20 则保留作降级候选。
  2. 层级与权重 —— 仅最高可用层级的渠道组参与分配;同组内按权重建立分流,权重=0 不参与调度;健康度 50–79 时有效权重减半,20–49 降至 1/4。
  3. 渠道亲和 —— 同一「租户 + 用户 + API Key + 模型」的请求尽量复用同一渠道(默认 30 分钟,成功即刷新),提高上游缓存命中率、避免上下文漂移。
  4. 故障与容量 —— 亲和渠道硬失败时清除绑定并重新选路;渠道达到并发上限时仅当前请求临时溢出到其他渠道,不覆盖原亲和。

典型布局:主力供应商设「首选」,同层级多条渠道按 7:3 权重分流;备用中转设「备用」保温;兜底的高价渠道设「保底」——主力故障时流量逐层下泄,业务无感。

调度引擎的精细参数(层级权重因子、熔断阈值等)可通过系统设置 → 渠道配置的路由策略 JSON 覆盖。

渠道详情

点击「详情」进入单渠道管理页,顶部支持克隆渠道(快速复制配置 + 新 Key)、禁用 / 启用与删除。

基本信息

渠道全量参数的展示与编辑,以及渠道 Key 列表:

  • 每条凭证显示类型(API Key / OAuth)与状态;
  • 凭证冷却:Key 因上游 401/403(密钥无效、账户额度不足)被调度器临时停用,页面显示剩余秒数,到期自动恢复;全部 Key 同时冷却时该渠道暂不可用;
  • 更新 Key:密钥轮换时直接替换;
  • 克隆渠道:复用现有配置新建渠道,适合「同一供应商多账号」场景。

模型能力

声明该渠道能服务哪些平台模型,是模型目录与上游的连接点:

字段说明
平台模型名模型列表选择,即对外的模型标识
上游模型名实际请求上游时使用的名称。留空则与平台模型名相同;上游命名不同时才填(如平台 gpt-4 → 上游 gpt-4-0314
成本比例该渠道相对基准价的成本系数(1.0 为标准)。<1 更便宜、多渠道择优时更优先;>1 更贵、优先级降低。只影响调度选择,不影响对用户的计费
Responses 协议声明该模型在上游支持 OpenAI Responses API:/v1/responses 请求直连上游原生协议转发,且调度时优先选择此类渠道
Chat 经 Responses上游仅有 Responses 协议(responses-only,如 Codex 类中转)时开启:/v1/chat/completions 请求自动桥接转换到 /v1/responses
状态单模型粒度的启用 / 禁用
健康状态 / 熔断模型级健康分与熔断状态,异常时可对单个模型「重置健康」

同一平台模型在多条渠道上都添加能力,即可获得冗余与分流——这正是「模型与渠道解耦」的用法。

测试

以指定模型向该渠道发一条真实对话请求,返回延迟、模型回复内容与 Token 用量,用于验证渠道连通性与协议适配。当前仅支持文本对话类模型。

健康趋势

近 24 小时(可切换时间窗)的健康度曲线 + 延迟柱状图,50 分处有虚线参考线,用于判断渠道质量是抖动还是持续劣化。

调试日志

抓取该渠道的完整四段报文,是协议对接与争议排查的利器:

  1. 客户端 → 系统(原始请求)
  2. 系统 → 上游(协议转换后,凭证已脱敏
  3. 上游 → 系统(响应原文)
  4. 系统 → 客户端(协议转换后)

使用方式:

  • 在基本信息中开启调试日志开关后,新请求开始记录;
  • 可设置捕捉目标:按「租户 → 成员 → 密钥」逐级缩小范围,只抓指定调用方的流量;
  • 列表按 Request ID、模型名、仅看错误、日期区间检索,详情展示状态码、各段耗时、首字延迟、协议转换链路等元信息。

WARNING

调试日志记录完整请求与响应体,体积大且可能包含业务敏感数据——排查完成后及时关闭,并按数据治理的策略清理历史数据。

健康度与熔断

调度状态含义
正常常规调度
熔断渠道(或某模型)被调度器硬排除,请求路由到其他渠道;上游修复后可「重置健康度」立即复位
半开冷却期已过,按窗口放行少量真实请求探活,探测成功即自动闭合

配合两项自动化策略(默认关闭/开启状态见系统设置 → 渠道配置):

  • 渠道自动探测 —— 定期向活跃渠道发测试请求更新健康度(消耗少量 Token);
  • 渠道自动禁用 —— 熔断持续超时未恢复时自动禁用渠道,避免坏渠道反复进出调度。

渠道级错误明细与告警见运维监控的「渠道错误监控」与「告警规则」页面。

相关文档

基于 AGPL-3.0 许可发布