Prism Bridge

管理台 · 登录以继续

密码为服务端配置的管理密码;登录令牌保存在本浏览器,有效期 30 天。

Prism Bridge

Prism Bridge

Prism 协议桥接网关

监控 总览 请求0 会话
资源 账号池 模型 模型池
接入 API 密钥 接入指南 试跑
系统 设置
版本—
服务器时间—
运行—
在途0
账号—
Sentinel—

总览

服务状态、流量与延迟

实时

最近 24 小时请求

按推理强度的延迟

p50 / p90 · 样本数

账号

管理账号池

最近错误

查看请求

每个账号对应一份 Prism 登录 Cookie。最简单的添加方式:在已登录的浏览器按 F12,把一条请求「Copy as cURL」粘进来(点「添加账号」看图文步骤)。会话 Cookie 约 12 小时、访问令牌约 10 天、刷新令牌约 90 天;服务会自动续期,「登录失效」时用「更新 Cookie」重新粘贴即可。

客户端鉴权

—

密钥列表

默认策略

修改即保存

下方分别显示原生窗口、桥接实测范围和建议上下文。长历史会分段回灌,并可能由上游压缩;实测通过的输入长度不等于模型的原生硬上限。使用建议值时仍需预留工具结果、回复和后续对话的空间。

用模型名指定推理强度

支持全部上游可用模型,指定可用模型时按请求使用;未指定或不在可用列表中的模型名回退到默认模型。客户端可在模型名后加后缀选择强度(优先级最高):gpt-6.1-sol-low、gpt-6.1-sol-medium、gpt-6.1-sol-high、gpt-6.1-sol-xhigh,也支持 :xhigh 写法。未指定强度时使用默认强度;模型名含 haiku / mini / nano / small / flash 时使用「小模型强度」,适合后台小任务。Responses 的 reasoning.effort、Chat 的 reasoning_effort、Anthropic 的 output_config.effort 或 thinking.budget_tokens 同样会被识别。

上游可用模型

状态说明

每行状态 = 本次上游刷新结果 + 当前桥接配置,实时算出

会话前缀复用。Prism 是服务端有状态会话:客户端下一轮请求若与已有会话的历史前缀匹配,就复用该会话、只发送增量。cached_tokens 是桥端对复用前缀的估算,不代表上游 KV 缓存命中或计费节省。删除会话后,下一轮需重新建立。

会话映射

实时事件流 0 条

请求日志

发起试跑

提交后自动轮询进度,可随时中止
系统提示(可选)

结果

等待0.0 s

服务设置

健康自检

检查 Prism 可达性与维护状态、每个账号的登录与沙箱状态,以及 Sentinel 探针(现生成一枚令牌,不占用热池)。不消耗模型额度。

服务日志

读取服务进程日志尾部(默认 200 行),用于排查登录、沙箱、协议转换问题。

数据维护

清空面板里的测试数据,从零开始记录。不会删除账号、API 密钥或任何登录凭证。

选择密钥生成配置

能力说明

支持

  • OpenAI Responses、Anthropic Messages、Chat Completions 三种协议,流式与非流式。
  • 会话上下文:服务端有状态会话 + 前缀匹配复用,匹配成功后只发增量;长历史可能分段回灌或由上游压缩。
  • 桥接客户端工具调用往返(function / custom、Anthropic tool_use、Codex 的 exec / apply_patch);能否正确生成调用取决于所选模型,校验失败会报错。
  • 支持全部上游可用模型,默认模型和强度以「模型」页为准;指定可用模型时按请求使用。
  • 推理强度 low / medium / high / xhigh,可用模型名后缀或各协议自带字段指定;输出推理摘要事件。
  • 上下文实测档位和建议值见「模型」页;测试采用历史分段回灌,可能触发上游压缩,不代表原生窗口。上游目录未公开最大上下文和最大输出。
  • cached_tokens 为会话复用估算,无法据此测原生缓存命中率。
  • 联网搜索:客户端声明 web_search 工具时允许上游内置搜索;回答中的链接本身不证明已联网,桥不提供原生引用事件。
  • 图片输入(vision_mode = inline):压缩为 base64 随提示词传给模型,需要上游解码并调用看图工具;不同模型的识别可靠性需实测。

限制

  • 没有 token 级真流式:文本在一轮结束后按段吐出,中途以 keepalive / 推理摘要维持连接。
  • 图片每张约消耗 1–3 万 token(base64 内联),不需要时可在设置里改为 placeholder。
  • max_output_tokens 小于 6000 时转为提示词软限制;大于等于 6000 时不加入长度提示。它不是上游硬输出预算,填入较大值不证明模型支持该长度。
  • 单轮延迟从数十秒到数分钟属正常(xhigh 更久),客户端请放宽空闲超时。
  • 受 Prism 官方可用性影响;维护期间请求会失败,总览会有横幅提示。