OpenAI 兼容协议,无需改造现有代码。本地高性能算力 + 官方模型直连,稳定可靠,用多少付多少。
覆盖接入、转发、计费等核心环节,一站式管理所有 AI 调用需求
对外暴露一致的 OpenAI 兼容接口,客户端与 SDK 复用同一套调用方式,只需改 base_url 和 api_key。
Key 粒度授权、余额配额、模型可见范围与审计日志,团队协作与合规有保障。
按 Token 计量,不同模型独立定价,余额与账单可追溯,随用随充。
汇总请求量、Token 消耗与费用趋势,辅助容量与预算决策。
本地高性能算力直连,低延迟响应,生产环境可用。
多上游渠道按权重调度,健康检测与自动重试,保障服务可用性。
按 Token 计费(元 / 百万 tokens),输入输出分开计价
| 模型 | 类型 | 输入价 | 输出价 | 来源 |
|---|---|---|---|---|
| 加载中… | ||||
标准 API 协议,无需改动代码即可切换
进入控制台,向管理员申请 API Key 并充值。
控制台「API Keys」页面一键创建,格式 sk-xxxx。
把 base_url 换成 https://tokenai.biz,填入 Key 即可。
# 第一个请求(curl) curl https://tokenai.biz/v1/chat/completions \ -H "Authorization: Bearer sk-你的Key" \ -H "Content-Type: application/json" \ -d '{"model": "hy3-295b-q4-mtp", "messages": [{"role": "user", "content": "你好!"}]}'
标准 OpenAI 协议,开箱即用
登录控制台「API Keys」页面,创建密钥即可。调用接口时在请求头加入 Authorization: Bearer <你的密钥>。请妥善保管密钥,勿泄露。
提供标准 OpenAI Chat Completions REST API(/v1/chat/completions),支持流式(SSE)与非流式响应。常见语言只需把 Base URL 换成 TokenAI 地址并配上 API Key 即可开始调用。
在控制台可查看账户余额、充值记录,以及「用量统计」中的每次调用与费用汇总。支持按时间范围、模型、API Key 等条件筛选。
本地高性能算力模型(Hy3、Qwen3.6、GLM、Ornith 等)与官方模型(DeepSeek 等)持续扩充中,详见上方模型价格表。