路由与虚拟密钥
配置中心解决「上游是谁」;这一页解决「客户端看到什么名字、用哪张凭证调用」。
路由
路由页按能力分 Tab:对话、向量、重排、生图、语音、视频、MCP。每条路由有一个 模型别名,客户端请求里的 model 填这个名字。
对话 / 向量等模型路由
| 字段 | 说明 |
|---|---|
| 模型别名 | 客户端 model 参数,如 glm |
| 端点类型 | 决定代理路径:completions → /v1/chat/completions,messages → /v1/messages,以及 embedding / image / tts 等 |
| 目标模型与权重 | 一个别名后面可以挂多个物理模型,按权重挑选 |
| 兜底模型 | 该路由所有目标都不可用时,再单次尝试这个模型,不进入常规重试 |
目标模型的类型、协议必须和端点一致:messages 端点只能挂 protocol=messages 的 chat 模型,生图端点只能挂 type=image 的模型。
权重是相对值。两个目标分别写 3 和 1,长期看大约 3:1。失败时先耗尽当前模型的全部可用密钥,再换下一个目标(hop),次数受 运行设置 里的「单请求最大转移模型数」限制。
路由页能看到目标的健康状态(正常 / 部分禁用 / 限流冷却 / 不可用),也可以从这里解禁。
MCP 路由
端点选 mcp 后,别名对应 /v1/mcp/<别名>。把一个或多个 MCP 后端挂上来:
- 暴露全部工具:该后端当前和以后新增的工具都会出现在
tools/list - 按工具白名单:只暴露勾选的工具
对话测试页挂上 MCP 路由后,可以把这些工具直接注入模型自动调用。后端本身在管理台 MCP 页维护(目标 URL、可选 API Key、探测工具列表)。
虚拟密钥
/v1 调用用虚拟密钥鉴权,不是提供商那把上游 key。在管理台 虚拟密钥 页创建,创建时弹窗给出完整 vk-...,列表默认脱敏,可再查看或复制。
| 字段 | 说明 |
|---|---|
| 名称 | 统计和日志里的标识 |
| RPM | 每分钟请求上限,0 表示不限。进程内按分钟窗口计数 |
| 总预算 | 美元额度,0 表示不限。用量按模型定价累计,超了拒绝新请求 |
| 授权路由 | 空 = 所有逻辑路由和 provider/model 直达;非空 = 只能打白名单里的逻辑路由名,不能用直达语法绕过 |
| 状态 | 可停用,停用后立即不能调 /v1 |
客户端这样带:
Authorization: Bearer vk-xxxx
管理台登录账号(config.yaml 里的 admin.username / password)管的是 Web 界面,和虚拟密钥是两套凭证。本地免登录时,管理台不用密码,但 /v1 仍然建议用虚拟密钥。
预算重置、用量查看都在虚拟密钥页。定价和汇率在 运行设置 和模型的计费字段里配。
和调用方式的关系
- 请求
model: "glm"→ 命中名为glm的路由 → 按权重选物理模型 → 再按密钥权重选一把 key - 请求
model: "openrouter/anthropic/claude-3.5-sonnet"→ 没有同名路由时,直达该提供商下的物理模型 - 受限虚拟密钥不能用第二种写法绕过授权路由
具体 curl 和协议差异见 调用方式。