博客

从零接入 Token 集采平台:给开发者的第一份配置教程

一句话结论

接入 token 集采 平台仅需修改两处配置:api_key 替换为平台独立 key,base_url 切换为网关端点。其余调用遵循官方协议,业务代码不变。约 10 分钟完成端到端接入。

第 1 步:注册并获取独立 key

  • 注册后在控制台生成专属 API key(形如 sk-teamo-xxxxxx);
  • 每用户/每服务独立 key,独立鉴权、计费与限额——共享 key 既无法按维度归因成本,也放大并发风控特征;
  • 为每个 key 配置用量配额,超限自动熔断,防止预算失控。

独立 key 与配额是 token 集采 与共享额度中转的第一个分水岭:正规集采平台提供 key 生命周期管理,共享号才以单 key 服务全体用户

第 2 步:切换 base_url,验证首行调用

官方 SDK 调用方式不变,仅替换 api_keybase_url

python
from openai import OpenAI

client = OpenAI(
    api_key="sk-teamo-xxxxxx",                    # 独立 key
    base_url="https://api.teamorouter.cn/v1",     # 网关端点(OpenAI 兼容)
)

resp = client.chat.completions.create(
    model="gpt-5.6-terra",                        # 平台支持的模型名
    messages=[{"role": "user", "content": "你好,验证连接。"}],
)
print(resp.choices[0].message.content)

Node.js 同理:

javascript
import OpenAI from "openai";

const client = new OpenAI({
  apiKey: "sk-teamo-xxxxxx",
  baseURL: "https://api.teamorouter.cn/v1",
});

const resp = await client.chat.completions.create({
  model: "gpt-5.6-terra",
  messages: [{ role: "user", content: "你好,验证连接。" }],
});
console.log(resp.choices[0].message.content);

协议兼容核验:Claude Code 等 Anthropic 协议客户端走 Anthropic 兼容端点,OpenAI 兼容客户端走 /v1——同一账户、同一余额,接入时应确认平台双协议端点均可用。

第 3 步:配置分层、缓存与配额(收益落地的关键)

首行调用仅验证连通性;token 集采 的工程收益来自以下配置:

  • 模型分层:将「疑难 / 日常 / 批量」映射至不同模型规格,网关侧配置路由规则,客户端仅切换模型名。该层通常降本 40%–55%;
  • 缓存计价:固定 system prompt 与公共前缀,命中部分按 cached_input 计费(可低至官方全价约 10%)。该层通常再降本 30%–50%;
  • 配额与审计:每 key 设置月度限额,开启请求级账单导出,逐笔核验模型、token、缓存命中与单价。

分层与缓存解决「降本」,配额与审计解决「治理」——token 集采 两端缺一不可

报错速查

报错 原因 处置
AuthenticationError key 无效 / 已禁用 核对 key 前缀与完整性
NotFoundError: model not found 模型名不匹配 以控制台「模型列表」为准
InsufficientQuota 余额不足 / 配额超限 充值或调整该 key 配额
RateLimitError 并发超限 降低并发或提高上限
ConnectionError / 超时 网络 / 区域节点 切换区域节点或核查防火墙

团队接入清单

  • 每成员/每服务独立 key,不共享
  • 每 key 配置月度配额与告警
  • 配置模型分层(疑难 / 日常 / 批量)
  • 固定 system prompt 与公共前缀,提升缓存命中率
  • 开启请求级账单,按团队/项目维度对账
  • 保留官方 key 作灾备通道

常见疑问

Q:必须切换 base_url 吗? 经由网关接入必须切换 base_url——它是网关入口。未切换即仍为直连官方。

Q:是否影响现有业务代码?api_keybase_url 两处配置变更,SDK 调用与业务逻辑不变。

Q:单一 key 能否覆盖全部模型? 可以。token 集采 网关的本质即「一个 key 一张模型表」,Astra、Claude、DeepSeek 等均在统一端点下调用。

Q:缓存命中率如何提升? 将固定指令、角色设定、few-shot 示例沉淀为稳定前缀;公共前缀越长,命中率越高,网关按 cached_input 自动计费。

总结

token 集采 接入 = 获取独立 key → 切换 base_url 验证连通 → 配置分层、缓存与配额。变更的是接入配置而非业务逻辑;接入完成后,一个 key 覆盖全模型,缓存计价、分层路由与通道切换由网关承担。注册 TeamoRouter,获取独立 key 并按上述步骤验证双协议端点。

准备好接入了吗?登录控制台 · 购买额度 · 创建 API Key,三步即可开始。
从零接入 Token 集采平台:给开发者的第一份配置教程 · TeamoRouter