结论先行:如果你在用 OpenAI 的 SDK(或 LangChain / Claude Code / Cursor / Continue),想接国产模型,不用改任何业务代码,只要换一个 base_url。
OpenAI 太贵,国产模型(DeepSeek / Qwen)便宜好几倍,但:
「兼容网关」实现了 OpenAI 的 /v1/chat/completions 协议,所以任何能调 OpenAI 的代码,把 base_url 指过来就能用:
from openai import OpenAI
client = OpenAI(
base_url="https://keheai.com/v1", # 只改这一行
api_key="sk-your-key",
)
resp = client.chat.completions.create(
model="deepseek-chat",
messages=[{"role": "user", "content": "你好"}],
)
print(resp.choices[0].message.content)
model 填 deepseek-chat 就行,网关负责把请求打到后端 DeepSeek,对你完全透明。
deepseek-chat / deepseek-reasoner / qwen 随意切公共网关鱼龙混杂,接之前一定要实测。可以用这个开源小工具自查(stdlib,无依赖):
python bench.py --base-url https://keheai.com/v1 --api-key sk-xxx --model deepseek-chat
会返回:暴露了多少模型、chat 是否 200、延迟多少、tok/s 多少。
网关本身开源(New API 等),一台境外小机器 + Caddy 反代就能跑,成本约 ¥40/月。想省事直接用现成网关也行——重点是你的代码只认 base_url,供应商随时可换,别被绑死。
作者做 AI 基础设施,上面提到的网关和测速工具都是自己跑的。欢迎留言交流迁移踩坑。
← 返回 keheai · 价格对比 · 免费试用:keheai.com · 📧 harvey@keheai.com