最近 24 小时请求
按推理强度的延迟
p50 / p90 · 样本数客户端鉴权
—密钥列表
默认策略
修改即保存下方分别显示原生窗口、桥接实测范围和建议上下文。长历史会分段回灌,并可能由上游压缩;实测通过的输入长度不等于模型的原生硬上限。使用建议值时仍需预留工具结果、回复和后续对话的空间。
用模型名指定推理强度
支持全部上游可用模型,指定可用模型时按请求使用;未指定或不在可用列表中的模型名回退到默认模型。客户端可在模型名后加后缀选择强度(优先级最高):gpt-6.1-sol-low、gpt-6.1-sol-medium、gpt-6.1-sol-high、gpt-6.1-sol-xhigh,也支持 :xhigh 写法。未指定强度时使用默认强度;模型名含 haiku / mini / nano / small / flash 时使用「小模型强度」,适合后台小任务。Responses 的 reasoning.effort、Chat 的 reasoning_effort、Anthropic 的 output_config.effort 或 thinking.budget_tokens 同样会被识别。
上游可用模型
状态说明
每行状态 = 本次上游刷新结果 + 当前桥接配置,实时算出会话映射
实时事件流 0 条
请求日志
发起试跑
提交后自动轮询进度,可随时中止系统提示(可选)
结果
等待0.0 s
服务设置
健康自检
检查 Prism 可达性与维护状态、每个账号的登录与沙箱状态,以及 Sentinel 探针(现生成一枚令牌,不占用热池)。不消耗模型额度。
服务日志
读取服务进程日志尾部(默认 200 行),用于排查登录、沙箱、协议转换问题。
数据维护
清空面板里的测试数据,从零开始记录。不会删除账号、API 密钥或任何登录凭证。
选择密钥生成配置
能力说明
支持
- OpenAI Responses、Anthropic Messages、Chat Completions 三种协议,流式与非流式。
- 会话上下文:服务端有状态会话 + 前缀匹配复用,匹配成功后只发增量;长历史可能分段回灌或由上游压缩。
- 桥接客户端工具调用往返(function / custom、Anthropic tool_use、Codex 的 exec / apply_patch);能否正确生成调用取决于所选模型,校验失败会报错。
- 支持全部上游可用模型,默认模型和强度以「模型」页为准;指定可用模型时按请求使用。
- 推理强度 low / medium / high / xhigh,可用模型名后缀或各协议自带字段指定;输出推理摘要事件。
- 上下文实测档位和建议值见「模型」页;测试采用历史分段回灌,可能触发上游压缩,不代表原生窗口。上游目录未公开最大上下文和最大输出。
cached_tokens为会话复用估算,无法据此测原生缓存命中率。- 联网搜索:客户端声明 web_search 工具时允许上游内置搜索;回答中的链接本身不证明已联网,桥不提供原生引用事件。
- 图片输入(
vision_mode = inline):压缩为 base64 随提示词传给模型,需要上游解码并调用看图工具;不同模型的识别可靠性需实测。
限制
- 没有 token 级真流式:文本在一轮结束后按段吐出,中途以 keepalive / 推理摘要维持连接。
- 图片每张约消耗 1–3 万 token(base64 内联),不需要时可在设置里改为
placeholder。 max_output_tokens小于 6000 时转为提示词软限制;大于等于 6000 时不加入长度提示。它不是上游硬输出预算,填入较大值不证明模型支持该长度。- 单轮延迟从数十秒到数分钟属正常(xhigh 更久),客户端请放宽空闲超时。
- 受 Prism 官方可用性影响;维护期间请求会失败,总览会有横幅提示。