Documentation

开发文档

666 AI 同时支持三种主流协议。你现在用的工具几乎都能直接接入——改一个地址、填一个API Key,其余不动。

setup guide to generate the config for you.">下面示例里的 YOUR-ENDPOINT 要换成你自己的接入地址 —— 登录控制台首页就能看到,或者用新手教程自动生成好的配置。

三步接入

从注册到跑通第一个请求,通常不超过三分钟。

1. 拿到API Key

在控制台的「API Key」页面新建一个,建议每个项目单独建一个,并设置额度上限。

2. 填入地址

BASE URL
https://YOUR-ENDPOINT/v1

3. 验证一下

curl
curl https://YOUR-ENDPOINT/v1/chat/completions \
  -H "Authorization: Bearer $KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"666-deepseek",
       "messages":[{"role":"user","content":"hi"}]}'

# A JSON response means it works

支持的协议

同一个API Key、同一个账号余额,三种协议随便用。你不需要为不同工具准备不同的 API Key。

可用
OpenAI
最通用的一种。绝大多数工具和 SDK 默认支持。
/v1/chat/completions
可用
Anthropic
Claude Code、Cline 的原生格式,无需任何适配层。
/v1/messages
筹备中
Gemini
Google 原生格式,适合已有 Gemini 代码的项目。
/v1beta/models
不确定用哪个?用 OpenAI 格式。它兼容性最好,而且换模型时代码不用改。

OpenAI 格式

官方 openai 库直接可用,只改一个 base_url。

Python
from openai import OpenAI

client = OpenAI(
    api_key="YOUR_KEY",
    base_url="https://YOUR-ENDPOINT/v1"
)

resp = client.chat.completions.create(
    model="666-deepseek",
    messages=[{"role": "user", "content": "你好"}]
)
print(resp.choices[0].message.content)
Node.js
import OpenAI from "openai";

const client = new OpenAI({
  apiKey: "YOUR_KEY",
  baseURL: "https://YOUR-ENDPOINT/v1"
});

const resp = await client.chat.completions.create({
  model: "666-deepseek",
  messages: [{ role: "user", content: "你好" }]
});
console.log(resp.choices[0].message.content);

Anthropic 格式

如果你在用 Claude Code 或 Anthropic 官方 SDK,用这个格式,不需要任何转换层。注意这里的地址不带 /v1。

Claude Code
# Add to ~/.zshrc or ~/.bashrc
export ANTHROPIC_BASE_URL="https://YOUR-ENDPOINT"
export ANTHROPIC_AUTH_TOKEN="YOUR_KEY"

# Reopen the terminal, then just run
claude
Python SDK
from anthropic import Anthropic

client = Anthropic(
    api_key="YOUR_KEY",
    base_url="https://YOUR-ENDPOINT"
)

msg = client.messages.create(
    model="666-claude",
    max_tokens=1024,
    messages=[{"role": "user", "content": "你好"}]
)
print(msg.content[0].text)

Gemini 格式

筹备中。在此之前,Gemini 系列模型可以通过上面的 OpenAI 格式调用,功能完全一致。

curl
# Call Gemini like this
curl https://YOUR-ENDPOINT/v1/chat/completions \
  -H "Authorization: Bearer $KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"666-gemini","messages":[{"role":"user","content":"hi"}]}'

编辑器与 Agent

Cursor

  1. Settings → Models → OpenAI API Key
  2. 打开 Override Base URL
  3. 填入地址和API Key,点 Verify

Claude Code

  1. 设 ANTHROPIC_BASE_URL
  2. 设 ANTHROPIC_AUTH_TOKEN
  3. 重开终端,运行 claude

Cline / Roo Code

  1. Provider 选 OpenAI Compatible
  2. 填 Base URL 和API Key
  3. Model ID 填目录里的 ID

Continue

  1. 编辑 config.json
  2. provider 填 openai
  3. 加上 apiBase 字段

客户端与插件

ChatBox / NextChat

  1. 模型服务选 OpenAI
  2. API 域名填网关地址
  3. 模型名手动输入

沉浸式翻译

  1. 添加自定义 AI 接口
  2. 地址填 /v1/chat/completions
  3. 建议选便宜的高速模型

Open WebUI

  1. 设置 → 外部连接
  2. 添加 OpenAI API 连接
  3. 填地址和API Key后保存

开发框架

Dify

  1. 模型供应商选 OpenAI-API-compatible
  2. 填 API endpoint 和API Key
  3. 其余节点配置不变

n8n

  1. 新建 OpenAI 凭据
  2. Base URL 填网关地址
  3. 在节点里选这个凭据

LangChain

  1. 用 ChatOpenAI
  2. 传入 base_url
  3. 其余链路不变

流式 / 工具调用 / 视觉

这三项与官方接口的用法完全一致,参数不用改。是否支持取决于具体模型,模型目录里有标注。

流式输出
stream = client.chat.completions.create(
    model="666-deepseek",
    messages=[{"role":"user","content":"写一首诗"}],
    stream=True
)
for chunk in stream:
    print(chunk.choices[0].delta.content or "", end="")

提示词缓存

如果你的请求每次都带着同一段很长的前缀——系统提示、项目代码、文档——命中缓存的部分会按大幅折扣计费。编程和 Agent 场景收益最明显。

把固定不变的内容放在消息最前面,变化的内容放在后面。顺序对了,命中率才高。

错误码

状态码含义怎么办
401API Key无效或已停用检查API Key是否复制完整、有没有被删除
402余额不足去控制台充值
404模型不存在对照模型目录检查 ID 拼写
429请求过于频繁降低并发,或稍后重试
500上游异常网关会自动重试备用线路,持续报错请联系我们

额度与限流

每个API Key都可以单独设置额度上限和可用模型范围。建议每个项目一个API Key——这样任何一个泄露了,损失都是封顶的,删掉重建即可。

请求失败不计费。超时和上游报错都不会进入你的账单。
←