Skip to content

接入概览

Base URL

https://s1.why01.top

具体端点路径取决于你用的协议(OpenAI / Anthropic / Gemini),下文有矩阵。

鉴权

所有请求在 HTTP header 加:

Authorization: Bearer sk-你的key

sk-... 是控制台「令牌管理」创建的 API Key(详见 创建 / 管理 API Key)。

🔌 各工具接入速查(Base URL 带不带 /v1

最常踩的接入坑就是 Base URL 末尾要不要 /v1一句话规则:走 OpenAI 协议的带 /v1,走 Anthropic 原生协议的不带。 各工具对照(各页填的值都以这张表为准):

工具 / 场景Base URL填 Key 的字段 / 环境变量协议
Claude Codehttps://s1.why01.top不带 /v1ANTHROPIC_BASE_URL + ANTHROPIC_AUTH_TOKENAnthropic
Codex CLIhttps://s1.why01.top/v1~/.codex/config.toml 自定义 providerOpenAI
Gemini CLIhttps://s1.why01.top不带 /v1GEMINI_API_KEYGoogle / OpenAI 兼容
OpenCodehttps://s1.why01.top/v1opencode.json + OPENAI_API_KEYOpenAI
桌面 / 网页客户端(OpenWebUI / Cursor / WorkBuddy 等)https://s1.why01.top/v1客户端设置里的 API Key 字段OpenAI 兼容
Cherry Studiohttps://s1.why01.top(客户端自动补 /v1设置里的 API Key 字段OpenAI 兼容
自己写代码(OpenAI SDK)https://s1.why01.top/v1OPENAI_API_KEYOpenAI
自己写代码(Anthropic SDK)https://s1.why01.top不带 /v1api_keyAnthropic

填错 /v1 通常报 404(端点找不到)或 401。CLI 工具还要在建 Key 时选对分组(Claude Code → Claude-A、Codex → Codex-A)。每个工具的完整步骤见它自己的文档页。

协议兼容矩阵

本站作为 AI 大模型中转网关,支持以下协议路径:

协议端点路径前缀推荐 SDK说明
OpenAI v1(推荐)/v1/...openai (Python/Node/Go/...)通吃所有模型,包括 Claude 和 Gemini
Anthropic 原生/v1/messagesanthropic仅当你的代码已经在用 anthropic SDK 时考虑
Gemini 原生/v1beta/models/{model}:generateContentgoogle-generativeai同上,按需

推荐用 OpenAI 协议跑全部模型

绝大多数情况建议直接用 OpenAI SDK 调所有模型——把 model 字段改成 Claude / Gemini 模型名即可。这样:

  • 一套代码切模型不改 SDK
  • 出问题排查路径单一
  • 上游对 OpenAI 协议的兼容性最好(Anthropic / Gemini 原生协议在中转商之间存在差异)

常用端点

下面端点均以 OpenAI 协议为准。完整字段对齐 OpenAI 官方文档

用途端点详见
对话 / ChatPOST /v1/chat/completionsOpenAI 兼容
流式输出同上,请求体加 "stream": true同上
模型列表GET /v1/models查可用模型
EmbeddingsPOST /v1/embeddingsOpenAI 兼容路径
图像生成POST /v1/images/generations上游需支持,详见控制台
音频转写POST /v1/audio/transcriptions上游需支持
TTSPOST /v1/audio/speech上游需支持
重排序POST /v1/rerank上游需支持

WARNING

Embeddings / 图像 / 音频 / 重排序等非对话端点的支持取决于上游渠道实现。控制台 模型 / 定价页 会标注每个模型支持的能力——以那里展示的为准。如果文档说"应该能用"但调用 404,多半是当前所在用户组的渠道未接入该端点。

限速

本站对令牌不做用户级硬性限速——不需要你在控制台给每个 Key 配「每分钟多少请求」之类。但请求最终会落到上游,上游的限速会以 429 形式返回(OpenAI / Anthropic / Google 各家各自有 RPM / TPM 限制)。

如果你的业务遇到持续 429:

  • 自身侧加 exponential backoff 重试(推荐初始 1s,2 倍递增上限 30s)
  • 联系客服评估升级到更高优先级用户组(更高用户组通常对应更稳的渠道 / 更宽的上游配额)

内容审核

上游的内容审核(OpenAI moderation、Anthropic safety、Gemini safety settings)全部按上游策略执行——本站不附加额外审核,也不绕过任何上游审核。

数据隐私

本站不记录 prompt 内容、不记录响应正文。仅记录调用元数据(时间、模型名、token 用量、IP 段、状态码)用于计费和审计。详见 服务条款 § 隐私

下一步