跳到主要内容

发布模型与配置路由

模型部署就绪,或已经接入外部端点后,需要通过发布路由给调用方一个稳定的模型名。入口是管理员控制台 → 基础设施 → 发布中心 → 模型发布。

创建对外模型​

发布模型表单
发布模型的高级设置、供应商绑定与定价
展开“查看更多”后,可设置描述、能力标签、供应商、定价和失败自动切换。
  1. 点击发布模型,在“新建发布”表单中填写对外模型名和模型类型。这个名称是应用请求中的 model,不必与模型文件名或上游模型名相同。
  2. 按需填写最大上下文长度、描述和能力标签。描述与标签会影响模型市场中的展示。
  3. 可在创建时选择要挂载的端点;之后也可从发布记录的“供应商”操作进入绑定管理。
  4. 按需配置输入、输出和缓存命中的每百万 Token 价格,以及失败自动切换与最多重试次数。
  5. 保存后在列表中确认发布状态。可通过“编辑定价”调整发布信息与价格,也可上下架或删除。
已发布的示例模型及其供应商成员数
发布列表显示状态、成员数、定价和失败自动切换配置。

创建成功的记录立即上架。即使尚未绑定端点,它也可能出现在模型列表中,但实际调用会因没有可用来源而失败;完成绑定和验证后再交给调用方。

如果在创建部署的确认步骤选择了自动发布,应先检查发布中心是否已经出现对应的对外名称和端点绑定,避免重复创建。

绑定多个端点​

在发布记录的绑定管理中添加端点,并设置启用状态、优先级和权重:

发布路由的供应商绑定、权重和优先级
“供应商”抽屉展示已挂载端点,也能继续添加来源并设置权重与优先级。
  • 网关先在可用端点中选择优先级数值最大的一组;低优先级组作为候选,不参与同组正常分流。
  • 同一优先级组内按权重分流。权重描述的是相对份额,不保证少量请求严格按比例分配。
  • 上游失败后,若开启故障切换,网关可以排除失败端点并重新选路;最终行为还取决于重试上限和可用端点。

建议先用一个端点验证请求,再逐步增加端点和路由策略。修改权重、优先级或切换策略后,使用调用统计观察实际去向和错误情况。

“编辑定价”还可调整模型描述、能力标签、缓存命中价格与失败自动切换:

编辑发布路由的描述、能力标签、价格与故障切换
价格留空表示该维度不计费;保存前应确认模型描述和故障切换上限。

验证发布结果​

  1. 确认发布记录处于已发布状态,且至少有一个启用、可连接的绑定端点。
  2. 在管理员端 开发者工具 → 模型市场 搜索对外模型名,打开详情核对类型、定价和 API 接入地址。图中的域名已替换为示例地址。
管理员端模型市场详情、定价和 API 接入地址
详情页集中显示对外模型名、定价,以及 OpenAI 与 Anthropic 接入路径。
  1. 点击在线调试,选择该模型并发送简短请求,确认路由能收到上游响应。管理员端调试使用当前登录会话,租户端调试需要租户 API Key。下图的文字由临时 OpenAI 兼容测试服务返回,只验证接入链路,不代表真实模型推理能力。
管理员端在线调试收到临时测试端点的实际响应
管理员端在线调试可设置流式输出、思考强度、温度、Top P 和最大输出 Token。
  1. 用有权访问该模型的 API Key 请求 GET /v1/models,检查列表中是否有对外模型名,再通过推理 API发起真实请求。若失败,先区分鉴权、模型可见性、端点连通和上游返回的错误。

租户 Web 模型市场的可见性取决于发布状态及该租户是否封禁模型;API Key 的授权模型范围则影响数据面 GET /v1/models 和实际调用。概念关系见模型服务的组成。