开发文档
666 AI 同时支持三种主流协议。你现在用的工具几乎都能直接接入——改一个地址、填一个API Key,其余不动。
setup guide to generate the config for you.">下面示例里的
YOUR-ENDPOINT 要换成你自己的接入地址 —— 登录控制台首页就能看到,或者用新手教程自动生成好的配置。三步接入
从注册到跑通第一个请求,通常不超过三分钟。
1. 拿到API Key
在控制台的「API Key」页面新建一个,建议每个项目单独建一个,并设置额度上限。
2. 填入地址
BASE URL
https://YOUR-ENDPOINT/v1
3. 验证一下
curl
curl https://YOUR-ENDPOINT/v1/chat/completions \ -H "Authorization: Bearer $KEY" \ -H "Content-Type: application/json" \ -d '{"model":"666-deepseek", "messages":[{"role":"user","content":"hi"}]}' # A JSON response means it works
支持的协议
同一个API Key、同一个账号余额,三种协议随便用。你不需要为不同工具准备不同的 API Key。
可用
OpenAI
最通用的一种。绝大多数工具和 SDK 默认支持。
/v1/chat/completions
可用
Anthropic
Claude Code、Cline 的原生格式,无需任何适配层。
/v1/messages
筹备中
Gemini
Google 原生格式,适合已有 Gemini 代码的项目。
/v1beta/models
不确定用哪个?用 OpenAI 格式。它兼容性最好,而且换模型时代码不用改。
OpenAI 格式
官方 openai 库直接可用,只改一个 base_url。
Python
from openai import OpenAI client = OpenAI( api_key="YOUR_KEY", base_url="https://YOUR-ENDPOINT/v1" ) resp = client.chat.completions.create( model="666-deepseek", messages=[{"role": "user", "content": "你好"}] ) print(resp.choices[0].message.content)
Node.js
import OpenAI from "openai"; const client = new OpenAI({ apiKey: "YOUR_KEY", baseURL: "https://YOUR-ENDPOINT/v1" }); const resp = await client.chat.completions.create({ model: "666-deepseek", messages: [{ role: "user", content: "你好" }] }); console.log(resp.choices[0].message.content);
Anthropic 格式
如果你在用 Claude Code 或 Anthropic 官方 SDK,用这个格式,不需要任何转换层。注意这里的地址不带 /v1。
Claude Code
# Add to ~/.zshrc or ~/.bashrc export ANTHROPIC_BASE_URL="https://YOUR-ENDPOINT" export ANTHROPIC_AUTH_TOKEN="YOUR_KEY" # Reopen the terminal, then just run claude
Python SDK
from anthropic import Anthropic client = Anthropic( api_key="YOUR_KEY", base_url="https://YOUR-ENDPOINT" ) msg = client.messages.create( model="666-claude", max_tokens=1024, messages=[{"role": "user", "content": "你好"}] ) print(msg.content[0].text)
Gemini 格式
筹备中。在此之前,Gemini 系列模型可以通过上面的 OpenAI 格式调用,功能完全一致。
curl
# Call Gemini like this curl https://YOUR-ENDPOINT/v1/chat/completions \ -H "Authorization: Bearer $KEY" \ -H "Content-Type: application/json" \ -d '{"model":"666-gemini","messages":[{"role":"user","content":"hi"}]}'
编辑器与 Agent
Cursor
- Settings → Models → OpenAI API Key
- 打开 Override Base URL
- 填入地址和API Key,点 Verify
Claude Code
- 设
ANTHROPIC_BASE_URL - 设
ANTHROPIC_AUTH_TOKEN - 重开终端,运行
claude
Cline / Roo Code
- Provider 选
OpenAI Compatible - 填 Base URL 和API Key
- Model ID 填目录里的 ID
Continue
- 编辑
config.json - provider 填
openai - 加上
apiBase字段
客户端与插件
ChatBox / NextChat
- 模型服务选 OpenAI
- API 域名填网关地址
- 模型名手动输入
沉浸式翻译
- 添加自定义 AI 接口
- 地址填
/v1/chat/completions - 建议选便宜的高速模型
Open WebUI
- 设置 → 外部连接
- 添加 OpenAI API 连接
- 填地址和API Key后保存
开发框架
Dify
- 模型供应商选 OpenAI-API-compatible
- 填 API endpoint 和API Key
- 其余节点配置不变
n8n
- 新建 OpenAI 凭据
- Base URL 填网关地址
- 在节点里选这个凭据
LangChain
- 用
ChatOpenAI - 传入
base_url - 其余链路不变
流式 / 工具调用 / 视觉
这三项与官方接口的用法完全一致,参数不用改。是否支持取决于具体模型,模型目录里有标注。
流式输出
stream = client.chat.completions.create(
model="666-deepseek",
messages=[{"role":"user","content":"写一首诗"}],
stream=True
)
for chunk in stream:
print(chunk.choices[0].delta.content or "", end="")
提示词缓存
如果你的请求每次都带着同一段很长的前缀——系统提示、项目代码、文档——命中缓存的部分会按大幅折扣计费。编程和 Agent 场景收益最明显。
把固定不变的内容放在消息最前面,变化的内容放在后面。顺序对了,命中率才高。
错误码
| 状态码 | 含义 | 怎么办 |
|---|---|---|
401 | API Key无效或已停用 | 检查API Key是否复制完整、有没有被删除 |
402 | 余额不足 | 去控制台充值 |
404 | 模型不存在 | 对照模型目录检查 ID 拼写 |
429 | 请求过于频繁 | 降低并发,或稍后重试 |
500 | 上游异常 | 网关会自动重试备用线路,持续报错请联系我们 |
额度与限流
每个API Key都可以单独设置额度上限和可用模型范围。建议每个项目一个API Key——这样任何一个泄露了,损失都是封顶的,删掉重建即可。
请求失败不计费。超时和上游报错都不会进入你的账单。