发布模型与配置路由
模型部署就绪,或已经接入外部端点后,需要通过发布路由给调用方一个稳定的模型名。入口是管理员控制台 → 基础设施 → 发布中心 → 模型发布。
创建对外模型

- 点击发布模型,在“新建发布”表单中填写对外模型名和模型类型。这个名称是应用请求中的
model,不必与模型文件名或上游模型名相同。 - 按需填写最大上下文长度、描述和能力标签。描述与标签会影响模型市场中的展示。
- 可在创建时选择要挂载的端点;之后也可从发布记录的“供应商”操作进入绑定管理。
- 按需配置输入、输出和缓存命中的每百万 Token 价格,以及失败自动切换与最多重试次数。
- 保存后在列表中确认发布状态。可通过“编辑定价”调整发布信息与价格,也可上下架或删除。

创建成功的记录立即上架。即使尚未绑定端点,它也可能出现在模型列表中,但实际调用会因没有可用来源而失败;完成绑定和验证后再交给调用方。
如果在创建部署的确认步骤选择了自动发布,应先检查发布中心是否已经出现对应的对外名称和端点绑定,避免重复创建。
绑定多个端点
在发布记录的绑定管理中添加端点,并设置启用状态、优先级和权重:

- 网关先在可用端点中选择优先级数值最大的一组;低优先级组作为候选,不参与同组正常分流。
- 同一优先级组内按权重分流。权重描述的是相对份额,不保证少量请求严格按比例分配。
- 上游失败后,若开启故障切换,网关可以排除失败端点并重新选路;最终行为 还取决于重试上限和可用端点。
建议先用一个端点验证请求,再逐步增加端点和路由策略。修改权重、优先级或切换策略后,使用调用统计观察实际去向和错误情况。
“编辑定价”还可调整模型描述、能力标签、缓存命中价格与失败自动切换:

验证发布结果
- 确认发布记录处于已发布状态,且至少有一个启用、可连接的绑定端点。
- 在管理员端 开发者工具 → 模型市场 搜索对外模型名,打开详情核对类型、定价和 API 接入地址。图中的域名已替换为示例地址。

- 点击在线调试,选择该模型并发送简短请求,确认路由能收到上游响应。管理员端调试使用当前登录会话,租户端调试需要租户 API Key。下图的文字由临时 OpenAI 兼容测试服务返回,只验证接入链路,不代表真实模型推理能力。

租户 Web 模型市场的可见性取决于发布状态及该租户是否封禁模型;API Key 的授权模型范围则影响数据面 GET /v1/models 和实际调用。概念关系见模型服务的组成。