API 文档

渡口 AI 提供 OpenAI-compatible API。任何支持自定义 Base URL 的 OpenAI SDK、工具或框架都可以直接接入。

快速上手

控制台创建 API Key 后,把 Base URL 指向渡口即可:

https://api.dukou.ai/v1
Python(OpenAI SDK)
from openai import OpenAI

client = OpenAI(
    base_url="https://api.dukou.ai/v1",
    api_key="sk-dukou-********",  # 控制台创建
)

resp = client.chat.completions.create(
    model="deepseek-chat",
    messages=[{"role": "user", "content": "你好"}],
)
print(resp.choices[0].message.content)
Node.js(OpenAI SDK)
import OpenAI from "openai";

const client = new OpenAI({
  baseURL: "https://api.dukou.ai/v1",
  apiKey: process.env.DUKOU_API_KEY,
});

const resp = await client.chat.completions.create({
  model: "gemini-3-flash",
  messages: [{ role: "user", content: "你好" }],
});
console.log(resp.choices[0].message.content);
AI 编程工具
# Claude Code / Cursor / Cline 等工具中,
# 将 OpenAI-compatible Base URL 与 Key 指向渡口:
export OPENAI_BASE_URL="https://api.dukou.ai/v1"
export OPENAI_API_KEY="sk-dukou-********"

认证

所有请求通过 Authorization: Bearer sk-dukou-... 携带 API Key。Key 仅在创建时展示一次,请妥善保存;泄露后请立即在控制台吊销并创建新 Key(吊销在 30 秒内全网生效)。

接口

首期开放以下 OpenAI-compatible 接口,后续将增加 /v1/responses/v1/embeddings:

GET/v1/models
POST/v1/chat/completions
curl · 模型列表
curl https://api.dukou.ai/v1/models \
  -H "Authorization: Bearer $DUKOU_API_KEY"
curl · 对话补全
curl https://api.dukou.ai/v1/chat/completions \
  -H "Authorization: Bearer $DUKOU_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-5.2",
    "messages": [
      {"role": "system", "content": "You are a helpful assistant."},
      {"role": "user", "content": "介绍一下你自己"}
    ]
  }'

流式输出

设置 "stream": true 后,响应以 SSE(Server-Sent Events)增量返回,与 OpenAI 流式协议一致。

curl · 流式
curl https://api.dukou.ai/v1/chat/completions \
  -H "Authorization: Bearer $DUKOU_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "claude-sonnet-5",
    "stream": true,
    "messages": [{"role": "user", "content": "写一首关于渡口的短诗"}]
  }'

错误与计费

  • 错误响应采用 OpenAI 风格错误体:{"error": {"message", "type", "code"}}
  • 请求发起时按最大可能费用预占余额,结束后按实际 Token 用量结算并释放差额;余额不足会返回 4xx 错误。
  • 每次请求的模型、Token 用量、费用与延迟都可以在控制台的用量统计与账本中查询。