一、为什么用中转站调用 GPT
直接调用官方接口,需要处理海外网络、支付方式与账号风控;通过中转站 GPT 的方式,接口地址换成国内可直连的中转域名,密钥由中转站统一发放,计费按实际用量结算,接入成本明显降低。
二、接入前的三样准备
- 一把 OjToken 密钥(在控制台创建,形如 sk- 开头);
- 统一端点地址:
https://api.ojtoken.ai/v1; - 要使用的模型 ID,例如
deepseek-v4.1-flash、qwen3.8-max。
三、三步完成第一次调用
第一步,安装官方 SDK,不改任何依赖版本;第二步,把 base_url 指向中转站,api_key 换成中转站密钥;第三步,正常发起 chat.completions 请求即可,返回结构与官方一致。
from openai import OpenAI
client = OpenAI(base_url="https://api.ojtoken.ai/v1", api_key="sk-***")
resp = client.chat.completions.create(
model="deepseek-v4.1-flash",
messages=[{"role": "user", "content": "你好"}],
)四、容易踩的三个坑
一是把密钥写进前端代码,正确做法是放在服务端环境变量里;二是模型 ID 拼错导致 404,建议先查模型目录;三是忽略流式输出与超时设置,长文本场景应打开 stream 并设置合理的 timeout。
五、成本怎么控制
短任务优先用轻量模型,长文档用长上下文模型,配合缓存命中价格可以再降一档。每次上线新功能前,先用价格计算器估算一轮月度用量,避免账单超出预期。