标准 API · 按量计费 · 分钟级接入

主流大模型 一站接入
一个 API Key 调用所有模型

OpenAI 兼容协议,无需改造现有代码。本地高性能算力 + 官方模型直连,稳定可靠,用多少付多少。

为什么选择 TokenAI

覆盖接入、转发、计费等核心环节,一站式管理所有 AI 调用需求

统一接入

对外暴露一致的 OpenAI 兼容接口,客户端与 SDK 复用同一套调用方式,只需改 base_url 和 api_key。

令牌体系

Key 粒度授权、余额配额、模型可见范围与审计日志,团队协作与合规有保障。

灵活计费

按 Token 计量,不同模型独立定价,余额与账单可追溯,随用随充。

用量看板

汇总请求量、Token 消耗与费用趋势,辅助容量与预算决策。

高速稳定

本地高性能算力直连,低延迟响应,生产环境可用。

路由容灾

多上游渠道按权重调度,健康检测与自动重试,保障服务可用性。

模型与价格

按 Token 计费(元 / 百万 tokens),输入输出分开计价

模型类型输入价输出价来源
加载中…

三步开始调用

标准 API 协议,无需改动代码即可切换

注册 / 登录

进入控制台,向管理员申请 API Key 并充值。

创建 API Key

控制台「API Keys」页面一键创建,格式 sk-xxxx

复制代码调用

base_url 换成 https://tokenai.biz,填入 Key 即可。

# 第一个请求(curl)
curl https://tokenai.biz/v1/chat/completions \
  -H "Authorization: Bearer sk-你的Key" \
  -H "Content-Type: application/json" \
  -d '{"model": "hy3-295b-q4-mtp", "messages": [{"role": "user", "content": "你好!"}]}'

完美兼容主流工具

标准 OpenAI 协议,开箱即用

Cursor Cline Dify LobeChat OpenCode Hermes Agent OpenCat Continue

常见问题

如何获取 API Key?

登录控制台「API Keys」页面,创建密钥即可。调用接口时在请求头加入 Authorization: Bearer <你的密钥>。请妥善保管密钥,勿泄露。

兼容什么协议?

提供标准 OpenAI Chat Completions REST API(/v1/chat/completions),支持流式(SSE)与非流式响应。常见语言只需把 Base URL 换成 TokenAI 地址并配上 API Key 即可开始调用。

如何查看用量与费用?

在控制台可查看账户余额、充值记录,以及「用量统计」中的每次调用与费用汇总。支持按时间范围、模型、API Key 等条件筛选。

支持哪些模型?

本地高性能算力模型(Hy3、Qwen3.6、GLM、Ornith 等)与官方模型(DeepSeek 等)持续扩充中,详见上方模型价格表。