API 文档

接入 Token Hacker 所需的一切——从第一次请求到生产部署。

快速入门

5 分钟内完成你的第一次 AI API 调用。

1. 获取 API Key

GitHub OAuth 一键注册,无需邮箱验证,无需等待。登录后即可在控制台获取你的 API Key。

2. 安装 OpenAI SDK

Token Hacker 完全兼容 OpenAI 接口。直接用已有的 OpenAI SDK——Python、Node.js,或任何带 OpenAI 客户端的语言都可以。

3. 发起第一次请求

把 Base URL 指向 Token Hacker,换上你的 API Key,选一个模型——就这么简单。你现有的 OpenAI 代码可以直接跑。

Python

from openai import OpenAI

client = OpenAI(
    base_url="https://api.aiapisave.xyz/v1",
    api_key="sk-your-api-key",
)

response = client.chat.completions.create(
    model="openai/gpt-4o-mini",
    messages=[
        {"role": "user", "content": "你好,世界!"}
    ],
)

print(response.choices[0].message.content)

Node.js

import OpenAI from 'openai';

const client = new OpenAI({
  baseURL: 'https://api.aiapisave.xyz/v1',
  apiKey: 'sk-your-api-key',
});

const response = await client.chat.completions.create({
  model: 'openai/gpt-4o-mini',
  messages: [
    { role: 'user', content: '你好,世界!' }
  ],
});

console.log(response.choices[0].message.content);

cURL

curl https://api.aiapisave.xyz/v1/chat/completions \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer sk-your-api-key" \
  -d '{
    "model": "openai/gpt-4o-mini",
    "messages": [{"role": "user", "content": "你好,世界!"}]
  }'

Streaming (Python)

from openai import OpenAI

client = OpenAI(
    base_url="https://api.aiapisave.xyz/v1",
    api_key="sk-your-api-key",
)

# 启用流式输出
stream = client.chat.completions.create(
    model="openai/gpt-4o-mini",
    messages=[{"role": "user", "content": "给我讲个短故事"}],
    stream=True,
)

# 逐 Token 打印
for chunk in stream:
    if chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="")

Streaming (Node.js)

import OpenAI from 'openai';

const client = new OpenAI({
  baseURL: 'https://api.aiapisave.xyz/v1',
  apiKey: 'sk-your-api-key',
});

const stream = await client.chat.completions.create({
  model: 'openai/gpt-4o-mini',
  messages: [{ role: 'user', content: '给我讲个短故事' }],
  stream: true,
});

// 逐 Token 打印
for await (const chunk of stream) {
  process.stdout.write(chunk.choices[0]?.delta?.content || '');
}

控制台

认证方式

所有 API 请求都需要在 Authorization 头中携带 Bearer Token 进行认证。请妥善保管你的 API Key——不要在客户端代码或公开仓库中暴露。

接口地址https://api.aiapisave.xyz/v1
认证头Authorization: Bearer sk-your-api-key
内容类型头application/json

控制台.

模型参考

Token Hacker 支持 200+ 模型,覆盖所有主流提供商——OpenAI、Anthropic、Google、DeepSeek、Meta、Mistral 等。完整目录请浏览模型市场页面。

模型 ID 采用 provider/model-name 格式。在 API 请求的 model 参数中使用此格式即可。

提供商格式示例
OpenAIopenai/modelopenai/gpt-4o
Anthropicanthropic/modelanthropic/claude-sonnet
Googlegoogle/modelgoogle/gemini-pro
DeepSeekdeepseek/modeldeepseek/deepseek-v4
Metameta/modelmeta/llama-4-maverick

前往模型市场查看每个模型的定价、上下文窗口和能力详情。

流式传输

逐 Token 流式输出响应,实现实时交互体验。所有模型均支持基于 Server-Sent Events (SSE) 的流式传输——在请求中设置 stream: true,然后遍历响应分块即可。流式传输可大幅降低用户感知延迟,是面向用户应用的推荐方式。

Python

from openai import OpenAI

client = OpenAI(
    base_url="https://api.aiapisave.xyz/v1",
    api_key="sk-your-api-key",
)

# 启用流式输出
stream = client.chat.completions.create(
    model="openai/gpt-4o-mini",
    messages=[{"role": "user", "content": "写一首关于编程的俳句"}],
    stream=True,
)

# 实时打印,同时收集完整响应
full_response = ""
for chunk in stream:
    delta = chunk.choices[0].delta
    if delta.content:
        print(delta.content, end="", flush=True)
        full_response += delta.content

print()  # 最后的换行

Node.js

import OpenAI from 'openai';

const client = new OpenAI({
  baseURL: 'https://api.aiapisave.xyz/v1',
  apiKey: 'sk-your-api-key',
});

const stream = await client.chat.completions.create({
  model: 'openai/gpt-4o-mini',
  messages: [{ role: 'user', content: '写一首关于编程的俳句' }],
  stream: true,
});

// 实时打印,同时收集完整响应
let fullResponse = '';
for await (const chunk of stream) {
  const content = chunk.choices[0]?.delta?.content || '';
  process.stdout.write(content);
  fullResponse += content;
}
console.log();  // 最后的换行

函数调用

让模型调用你的函数来访问外部数据、API 和工具。Token Hacker 完整支持 OpenAI 的函数调用/工具使用 API。定义好工具,随请求一起发送,模型会在需要时返回结构化的函数调用参数。

Python

from openai import OpenAI
import json

client = OpenAI(
    base_url="https://api.aiapisave.xyz/v1",
    api_key="sk-your-api-key",
)

# 定义一个天气查询工具
tools = [{
    "type": "function",
    "function": {
        "name": "get_weather",
        "description": "查询指定城市的当前天气",
        "parameters": {
            "type": "object",
            "properties": {
                "city": {
                    "type": "string",
                    "description": "城市名称,如 北京"
                },
                "unit": {
                    "type": "string",
                    "enum": ["celsius", "fahrenheit"],
                    "description": "温度单位"
                }
            },
            "required": ["city"]
        }
    }
}]

# 模型自行判断是否需要调用函数
response = client.chat.completions.create(
    model="openai/gpt-4o-mini",
    messages=[{"role": "user", "content": "东京今天天气怎么样?"}],
    tools=tools,
    tool_choice="auto",
)

msg = response.choices[0].message
if msg.tool_calls:
    for tool_call in msg.tool_calls:
        func_name = tool_call.function.name
        func_args = json.loads(tool_call.function.arguments)
        print(f"调用 {func_name},参数:{func_args}")
        
        # 在这里调用你的实际函数
        # result = your_weather_function(**func_args)
else:
    print(msg.content)

速率限制

速率限制取决于你的账户等级和当前余额。标准账户的默认限制如下:

  • 每分钟请求数: 60 RPM
  • 每分钟 Token 数: 100K TPM
  • 并发请求数: 10

触发速率限制时,API 返回 HTTP 429 Too Many Requests。建议实现带随机抖动的指数退避策略。团队版账户可获得更高的速率上限。

import time
import random

def call_with_retry(client, max_retries=5, **kwargs):
    """带指数退避的 API 调用,自动处理速率限制"""
    for attempt in range(max_retries):
        try:
            return client.chat.completions.create(**kwargs)
        except Exception as e:
            if "429" in str(e):
                # 指数退避 + 随机抖动
                delay = (2 ** attempt) + random.uniform(0, 1)
                print(f"触发速率限制,{delay:.1f}秒后重试...")
                time.sleep(delay)
                continue
            raise
    raise Exception(f"重试 {max_retries} 次后仍然失败")

错误处理

API 返回标准 HTTP 状态码。以下是常见错误码及处理方法:

状态码含义
401API Key 无效或缺失——请检查 Authorization 头
402余额不足——请充值后继续使用
429超出速率限制——请降低请求频率或实现退避重试
500服务器内部错误——请使用指数退避策略重试
503模型暂时不可用——请稍后重试或切换其他模型

常见问题

API 兼容 OpenAI 吗?

完全兼容。Token Hacker 实现了完整的 OpenAI Chat Completions API。任何为 OpenAI 构建的库或 SDK 直接可用——只需把 base_url 改成 https://api.aiapisave.xyz/v1,换上你的 Token Hacker API Key 就行。

余额会过期吗?

不会。预付费余额永久有效。随时充值任意金额,没有月最低消费,没有订阅制,没有自动续费的烦恼。用多少扣多少,想用多久用多久。

支持哪些支付方式?

目前支持 Stripe(Visa/Mastercard 信用卡)和 USDT-TRC20(加密货币)。支付宝和微信支付正在接入中,敬请期待。支付确认后余额即时到账。

你们会记录我的提示词吗?

不会。我们不记录、不存储、不基于你的提示词和模型输出进行训练。你的数据始终属于你——我们是纯粹的 API 中转层,不是数据平台。

余额可以退款吗?

预付费余额不支持退款。建议先小额充值(¥35 起)体验服务质量,确认满意后再大额充值。绝大多数用户第一次小额体验后就完全放心了。

国内网络能直接访问吗?

Token Hacker 服务器部署在香港,中国大陆用户可以直接访问,无需 VPN 或代理。延迟已针对国内网络环境进行优化,实际使用体验流畅。

可以开发票吗?

目前支持电子收据(Receipt)。增值税发票(Fapiao)功能正在开发中,有需求可以联系客服说明开票信息,我们会优先处理。

哪些模型的中文能力最强?

DeepSeek V4 对中文原生支持最好,价格也最实惠。Claude Opus 4 和 GPT-5.4 的中文输出同样非常出色。建议根据具体任务选择——编程任务用 Claude Sonnet 4,通用对话用 DeepSeek V4,深度推理用 Claude Opus 4。