系统架构
LLMPod 将管理资源和配置与承接推理请求分成两条路径。部署模型时管理员主要使用控制面;应用调用模型时直接访问推理网关。它们可由同一镜像的不同角色运行,但端口、流量和故障排查入口不同。
| 组件 | 主要职责 | 安装脚本默认值 |
|---|---|---|
控制面 webserver | 控制台、/api/v1 管理 API、Manager 节点连接、部署编排 | WEBSERVER_PORT=8080 |
推理网关 proxyserver | /v1/* 鉴权、模型选路、上游转发、计量 | PROXY_PORT=8090 |
计算节点 node | 上报资源、接收任务、运行本地模型的推理容器 | 由管理员引导到目标机器 |
| PostgreSQL | 平台资源、租户、模型、路由和持久记录 | 内部服务 |
| Redis | 运行期状态、限流等协调数据 | 内部服务 |