用 OpenAI SDK 一行代码接入国产大模型:DeepSeek/Qwen/GLM 实战指南
关键词:DeepSeek API、Qwen API、OpenAI 兼容、大模型接入、API 中转
先说我自己在用什么
我 daily 用国产开源模型干四件事:写代码、做方案文档、跑数据分析、甚至拿它辅助搭网站。原来调 GPT 一个月好几十块,切到 DeepSeek / Qwen 之后降到几块钱。
关键是不用改代码------我手上现有项目只改了一行 base_url,OpenAI SDK 原样跑通了。这篇文章把接入步骤、模型选择、价格算清楚。
你是不是也踩过这些坑
做 AI 应用的同学,几乎都遇到过:
- 每个模型单独注册:DeepSeek 注册一遍、Qwen 注册一遍、GLM 注册一遍,Key 管理一团乱
- 价格扛不住 :GPT-4o 输入
2.50/百万token,输出10/百万token,个人和小团队根本吃不起
- 多模型切换成本高:今天用 DeepSeek 写代码,明天用 Qwen 做 multilingual,后天用 GLM 写中文文案------每换一个就得改一套接入代码
解决方案:OpenAI 兼容的聚合入口
现在市面上有这么一类服务:一个 OpenAI 兼容 的 API 端点,背后聚合了 DeepSeek、Qwen、GLM 等国产开源强模型。你不用挨个去官网注册,改一行 base_url 就能用现有 OpenAI SDK 直接调。
核心能力:
- Drop-in 兼容:OpenAI SDK 原样能用,只换 base_url 和 key
- 智能路由:发一个任务,自动派给最划算的模型------简单分类走便宜小模型,复杂代码生成走最强 coder,综合成本比手动瞎选省 10~20%
- 流式输出:SSE 支持,跟 OpenAI 一样的体验
- 有免费试用额度,不用信用卡,够你跑通整个 demo
打个比方:官网给你一个货架,让你自己挑模型、自己承担选错的代价。聚合服务像个技术导诊台------你只管把任务扔过来,系统帮你匹配到最划算、最不容易出错的那一个。
30 秒接入(三语言代码直接复制)
Python
“python
from openai import OpenAI
client = OpenAI(
base_url="https://guotoken.chat/v1",
api_key="你的APIKey", # 注册后在 dashboard 获取
)
resp = client.chat.completions.create(
model="deepseek-ai/DeepSeek-V3",
messages=[{"role": "user", "content": "用一句话解释什么是 token。"}],
)
print(resp.choices[0].message.content)
Node.js
js
const OpenAI = require("openai");
const client = new OpenAI({
baseURL: "https://guotoken.chat/v1",
apiKey: "你的APIKey",
});
const resp = await client.chat.completions.create({
model: "Qwen/Qwen2.5-7B-Instruct",
messages: [{ role: "user", content: "Hello!" }],
});
console.log(resp.choices[0].message.content);
curl
she11
curl https://guotoken.chat/v1/chat/completions \
-H "Authorization: Bearer 你的APIKey" \
-H "Content-Type: application/json" \
-d '{"model":"deepseek-ai/DeepSeek-V3","messages":[{"role":"user","content":"Hi"}]}'
实战:怎么选模型
按任务类型选(我的个人经验)
| 任务 | 推荐模型 | 为什么 |
|---|---|---|
| 写代码/调试 | DeepSeek-V3 | 代码能力最强,128K上下文可以贴整个文件 |
| 中文写作/文案 | GLM-4-9B | 中文语感好,性价比高 |
| 多语言翻译 | Qwen2.5-7B | 多语言训练充分,速度快 |
| 复杂推理/数学 | DeepSeek-R1 | 链式推理,AIME数学赛超越GPT o1 |
| 日常通用 | Qwen2.5-72B | 综合能力强,不挑任务 |
价格参考(每百万 token,美元)
| 模型 | 输入价 | 输出价 | vs GPT-4o |
|---|---|---|---|
| DeepSeek-V3 | $1.40 | $2.80 | 省 89% |
| DeepSeek-R1 | $0.70 | $2.80 | 省 93% |
| Qwen2.5-7B | $0.35 | $0.35 | 省 97% |
| Qwen2.5-72B | $0.90 | $0.90 | 省 91% |
| GLM-4-9B | $0.40 | $0.40 | 省 96% |
对比 GPT-4o 的 2.50/10,同等任务成本大约只有 1/15 ~ 1/30。
几个坑先说清楚
- 高峰期限流:国产模型的 API 上游在晚高峰可能返回 "System too busy",聚合服务一般会做自动重试或多上游容灾,比自己直连官网稳
- 模型命名规则 :聚合服务的模型名一般是
平台/模型名格式(如deepseek-ai/DeepSeek-V3),跟官网直连的名字不一样,注意看文档
- token 计费 :输入和输出分开计价,比如 DeepSeek-V3 输出比输入贵一倍,写长文时注意控制
max_tokens
适合谁用
- 个人开发者:批量跑脚本、接口调试、自动化,成本敏感
- 小团队/独立开发者:一个 API Key 覆盖所有模型,不用管模型切换
- AI 工具创业者:你的用户每调一次都烧 token,一次接入全搞定
上手试试
挑一家提供免费试用额度的聚合服务,注册后改一行 base_url 就能把现有项目接上。跑通 demo 再决定长期用哪家。
注:文中示例基于 OpenAI 兼容的聚合服务,不训练模型、不拥有模型,只做国产开源模型的中转接入。代码示例中的 base_url 仅供参考,可替换为任意 OpenAI 兼容端点。