OpenAI / Responses / Anthropic 三协议兼容的 AI 网关 · 免费模型 · 支持思考模式、工具调用、图片输入
下面是接入所需的全部信息。API Key 请向服务提供方领取(看你这份文档的人就是使用者)。
把下面的 <API_KEY> 替换成你的 Key 即可复制使用。三种协议任选其一。
curl https://api.aurara.online/v1/chat/completions \
-H "Authorization: Bearer <API_KEY>" \
-H "Content-Type: application/json" \
-d '{"model":"big-pickle","messages":[{"role":"user","content":"你好,介绍一下你自己"}]}'message.reasoning_content,最终答案在 message.content):
{
"choices": [{
"message": {
"role": "assistant",
"content": "你好!…",
"reasoning_content": "…模型内部的思考过程…"
}
}],
"usage": { "prompt_tokens": 471, "completion_tokens": 14 }
}
curl https://api.aurara.online/v1/responses \
-H "Authorization: Bearer <API_KEY>" \
-H "Content-Type: application/json" \
-d '{"model":"big-pickle","input":"你好,介绍一下你自己"}'curl https://api.aurara.online/v1/messages \
-H "x-api-key: <API_KEY>" \
-H "anthropic-version: 2023-06-01" \
-H "Content-Type: application/json" \
-d '{"model":"big-pickle","max_tokens":1024,"messages":[{"role":"user","content":"你好,介绍一下你自己"}]}'所有模型均为推理型模型。等级从弱到强:minimal → low → medium → high → xhigh → max;none 关闭思考。客户端显式指定的等级永远优先于服务端默认值。
| 协议 | 请求体参数 | 响应中思考内容位置 |
|---|---|---|
| Chat | "reasoning_effort": "high"(顶层字段) | message.reasoning_content |
| Responses | "reasoning": {"effort": "low"} | output 数组里的 type:"reasoning" 项 |
| Anthropic | "thinking":{"type":"enabled","budget_tokens":1024};关闭用 {"type":"disabled"} | content 数组里的 type:"thinking" 块 |
output_config.effort 时以显式等级为准。{
"model": "big-pickle",
"reasoning_effort": "high",
"messages": [{"role": "user", "content": "…"}]
}{
"model": "big-pickle",
"reasoning_effort": "none",
"messages": [{"role": "user", "content": "…"}]
}reasoning.effort(或按模型覆盖 reasoning.effort_by_model)。把下面的信息填进客户端的"自定义 OpenAI 服务"或"添加提供商"设置里,然后选模型即可。
| 客户端 | 填写方式 |
|---|---|
| Cherry Studio | 设置 → 模型服务 → 添加自定义提供商: · API 地址(Base URL):https://api.aurara.online/v1 · API Key:你的 Key · 模型名:从下方模型列表选,如 big-pickle(或点"获取模型列表"自动拉取) |
| Cline / Roo Code | API 提供商选"OpenAI Compatible":Base URL 填 https://api.aurara.online/v1,填入 Key 与模型名。支持工具调用(MCP/函数工具)。 |
| LobeChat | 模型服务商 → OpenAI:自定义 OpenAI 服务地址 https://api.aurara.online/v1 + Key + 模型名。 |
| Claude Code | 命令行设置环境变量后直接使用 Anthropic 协议:export ANTHROPIC_BASE_URL=https://api.aurara.onlineexport ANTHROPIC_AUTH_TOKEN=<API_KEY>(模型名在对话中或配置里写,如 big-pickle) |
from openai import OpenAI
client = OpenAI(
api_key="<API_KEY>",
base_url="https://api.aurara.online/v1",
)
resp = client.chat.completions.create(
model="big-pickle",
messages=[{"role":"user","content":"你好,介绍一下你自己"}],
)
print(resp.choices[0].message.content)from anthropic import Anthropic
client = Anthropic(
api_key="<API_KEY>",
base_url="https://api.aurara.online",
)
resp = client.messages.create(
model="big-pickle",
max_tokens=1024,
messages=[{"role":"user","content":"你好,介绍一下你自己"}],
)
print("".join(b.text for b in resp.content if b.type == "text"))const resp = await fetch("https://api.aurara.online/v1/chat/completions", {
method: "POST",
headers: {
"Authorization": "Bearer <API_KEY>",
"Content-Type": "application/json",
},
body: JSON.stringify({
model: "big-pickle",
stream: true,
messages: [{ role: "user", content: "你好,介绍一下你自己" }],
}),
});
const reader = resp.body.getReader();
const decoder = new TextDecoder();
while (true) {
const { done, value } = await reader.read();
if (done) break;
process.stdout.write(decoder.decode(value));
}当前网关暴露 9 个免费模型,全部支持思考与工具调用,多数支持结构化输出。也可通过 GET /v1/models 实时获取。厂商信息与模型描述依据 OpenCode 官方模型目录。
| 模型 ID(点击复制) | 上下文窗口 | 最大输出 | 能力 | 说明 |
|---|
GET /v1/models 实时数据,与官方目录 models.opencode.ai/api.json 中 [opencode] 条目 limit 字段一致。部分模型厂商原生支持更高规格,但免费通道按上表限额执行,超限会被拒绝或截断:| 模型 | 本网关免费档 (上下文/最大输出) | 厂商原生规格 (官方目录) |
|---|---|---|
| mimo-v2.5-free | 200,000 / 32,000 | 小米 MiMo-V2.5:1,048,576 / 131,072 |
| mimo-v2.6-flash-free | 200,000 / 32,000 | 小米 MiMo-V2.6-Flash:1,048,576 / 131,072 |
| deepseek-v4-flash-free | 200,000 / 128,000 | DeepSeek V4 Flash:1,000,000 / 384,000 |
| ling-3.0-flash-fin-free | 262,144 / 32,768 | InclusionAI Ling 3.0 Flash Fin:262,144 / 235,929 |
| muse-spark-1.2/1.3-contributor-free | 1,048,576 / 131,072 | 与 Meta 官方规格一致 |
| nemotron-3-ultra-free | 1,000,000 / 128,000 | 与 NVIDIA 官方规格一致 |
| nemotron-3.5-lightning-free | 262,144 / 262,144 | 与 NVIDIA 官方规格一致 |
Authorization: Bearer <KEY>(Anthropic 端点用 x-api-key)。max_tokens 调大(如 2048 以上),或换 big-pickle、nemotron-3.5-lightning-free 这类输出行为更稳定的模型。reasoning_content 字段,部分客户端不展示该字段但答案不受影响。"stream": true 即返回 SSE。流式下思考过程以 reasoning_content delta 片段输出。messages 数组即可(当前为无状态网关,不保存会话)。| 项目 | 说明 |
|---|---|
| 网关 | opencode2api v1.3.4 · 自动多上游路由/重试 · 模型目录 5 分钟刷新 |
| 模型目录刷新 | 每 5 分钟自动同步,GET /v1/models 是最新可用集合 |
| 可携带能力 | 文本、图片输入、思考、函数工具与工具结果、结构化输出(JSON Schema) |