主流大模型,统一接口

一个 API Key,所有 AI 模型。

聚合通义千问、DeepSeek、Kimi、智谱 GLM 等主流大模型,统一通过 OpenAI 兼容接口调用。灵活充值,按 Token 用量计费。

  • 请求直连上游,不做二次转存
  • 上游密钥 AES-256 加密存储
  • SSE 流式原样透传
新上线

最新模型

按模型发布时间排序,用现有 API Key 即可调用。

deepseek-v4.1-flash新上架
DeepSeek V4.1 Flash
qwen3.7-text-embedding-flash新上架
Qwen3.7 文本向量 Flash
qwen3.7-text-embedding新上架
Qwen3.7 文本向量
glm-5.3新上架
GLM-5.3
qwen3.8-flash新上架
Qwen3.8 Flash
kimi-k3新上架
Kimi K3
qwen3.8-27b新上架
Qwen3.8 27B
deepseek-v4-pro-0813新上架
DeepSeek V4 Pro 0813
qwen-image-3.0新上架
Qwen-Image 3.0
qwen3.8-max新上架
Qwen3.8 Max
deepseek-v4-flash-0731新上架
DeepSeek V4 Flash 0731
qwen3.7-flash新上架
Qwen3.7 Flash
deepseek-v4.1-flash新上架
DeepSeek V4.1 Flash
qwen3.7-text-embedding-flash新上架
Qwen3.7 文本向量 Flash
qwen3.7-text-embedding新上架
Qwen3.7 文本向量
glm-5.3新上架
GLM-5.3
qwen3.8-flash新上架
Qwen3.8 Flash
kimi-k3新上架
Kimi K3
qwen3.8-27b新上架
Qwen3.8 27B
deepseek-v4-pro-0813新上架
DeepSeek V4 Pro 0813
qwen-image-3.0新上架
Qwen-Image 3.0
qwen3.8-max新上架
Qwen3.8 Max
deepseek-v4-flash-0731新上架
DeepSeek V4 Flash 0731
qwen3.7-flash新上架
Qwen3.7 Flash
特性

为生产环境而设计

OpenAI 兼容

将 OpenAI SDK 的 base URL 改为 TokenGP 端点,现有代码无需修改。cURL、Python、Node.js 全部支持。

灵活充值

支付宝 / 微信支付在线充值,付款后实时到账;也可联系客服对公转账。余额通用于全部模型,按量扣费、无订阅。

多通道路由与自动重试

网关支持按加权、故障转移或最低成本策略在多条上游通道间调度;遇到 429 / 5xx 自动重试,模型接入多条通道后即可自动切换。

兼容性

30 秒发起第一次调用

若已使用 OpenAI SDK,仅需修改 base URL 即可。

first-call.py
from openai import OpenAI

client = OpenAI(
    api_key="sk-tokengp-...",
    base_url="https://api.tokengp.com/v1"
)

response = client.chat.completions.create(
    model="deepseek-v4-flash",
    messages=[{"role": "user", "content": "Hello, TokenGP!"}]
)

print(response.choices[0].message.content)
Python·cURL·Node.js·TypeScript·Go
按量计费

按 Token 透明计费

按实际用量结算,流式与非流式定价一致。

模型输入 / 百万 tokens输出 / 百万 tokens
deepseek-v4.1-flash最新
¥1.8起¥7.2起
glm-5.3
¥7.2¥25.2
qwen3.8-flash
¥0.72¥2.43
kimi-k3
¥19¥95
qwen3.8-27b
¥2.7¥10.8

标「起」的模型按上下文长度或思考模式分档计价,表中为起步价,完整档位见定价页。

开始接入 TokenGP

手机号注册后约 1 分钟即可发起首次 API 调用。