上游 Token 池负载均衡 · 本地访问 Token 管理 · 实时使用统计
点击模型卡片即可强制所有请求使用该模型。选择后无需重启,立即生效。
代理地址:
代理地址:
http://127.0.0.1:30001 |
兼容 OpenAI Responses API (/v1/responses) 和 Chat Completions API (/v1/chat/completions)
可用模型
加载模型列表中...
管理每个模型的上下文窗口大小、最大输出 Token 等元数据参数。
代理请求时会根据模型元数据自动设置合理的
点击"从上游同步"可自动获取上游模型列表并填充默认参数。
代理请求时会根据模型元数据自动设置合理的
max_tokens 默认值。点击"从上游同步"可自动获取上游模型列表并填充默认参数。
模型元数据列表
| 模型 ID | 厂商 | 上下文窗口 | 最大输出 | 来源 | API 格式 | 更新时间 | 操作 |
|---|---|---|---|---|---|---|---|
| 加载中... | |||||||
配置多个上游 OpenCode Go API Token,代理会按
每个 Token 可设置独立的上游服务器地址(留空使用全局默认)。失败超过阈值自动禁用,定时探测自动恢复。
usage/weight 比值自动负载均衡。每个 Token 可设置独立的上游服务器地址(留空使用全局默认)。失败超过阈值自动禁用,定时探测自动恢复。
上游 Token 列表
| ID | 名称 | Token | 权重 | 上游地址 | 使用量 | 失败 | 优先级 | 状态 | 操作 |
|---|---|---|---|---|---|---|---|---|---|
| 加载中... | |||||||||
生成本地访问 Token,客户端使用这些 Token 调用代理。代理自动从上游 Token 池选择可用的上游 Token 转发请求。
每个本地 Token 的使用量会实时统计,方便监控和计费。
每个本地 Token 的使用量会实时统计,方便监控和计费。
本地 Token 列表
| ID | 名称 | Token | 请求数 | 成功 | 失败 | 输入 Token | 输出 Token | 最后使用 | 状态 | 操作 |
|---|---|---|---|---|---|---|---|---|---|---|
| 加载中... | ||||||||||
概览
总请求数
-
成功请求
-
失败请求
-
累计输入 Token
-
累计输出 Token
-
上游 Token
-
请求日志
暂无请求日志