给 OpenAI API 调用加上模型切换:GPT-5.1 和 Codex 的配置实践

OpenAI API 接入时,模型名和请求入口最好都放在配置层。这样同一套业务代码可以切换通用模型和编码模型,排查问题时也能快速确认究竟是模型能力、请求参数还是 endpoint 不匹配。

把模型和入口放进配置

通用问答、写作和分析可以使用 GPT 主线模型;仓库级代码修改和编码密集任务可以评估 gpt-5.1-codex。模型对应的 endpoint 可能不同,不能只改模型名后直接复用所有请求方式。

python 复制代码
import os
from openai import OpenAI

client = OpenAI(
    api_key=os.environ["API_KEY"],
    base_url="https://api.highwayapi.ai/openai",
)

model = os.getenv("OPENAI_MODEL", "gpt-5.1")
response = client.chat.completions.create(
    model=model,
    messages=[
        {"role": "user", "content": "把这段需求整理成三条验收标准"}
    ],
)
print(response.choices[0].message.content)

如果使用 jiekou.vip 等兼容入口,只需按照平台文档替换 base_url、密钥和可用模型名。密钥应通过环境变量或密钥管理系统注入,不要直接写入代码。

先确认 endpoint

普通 GPT 模型常见的调用方式是 Chat Completions;Codex 等编码模型可能要求 Responses 接口。把模型名、endpoint 和 SDK 方法做成明确的配置,能避免收到 404 或参数不支持错误后才发现入口不对。

python 复制代码
from openai import OpenAI

client = OpenAI(api_key=os.environ["API_KEY"])

config = {
    "general": {"model": "gpt-5.1", "endpoint": "chat"},
    "coding": {"model": "gpt-5.1-codex", "endpoint": "responses"},
}

def selected_model(kind: str):
    return config["coding" if kind == "coding" else "general"]

具体字段和 SDK 调用方式应以当前接口文档为准,不要假设不同模型永远共享同一组参数。

用同一组任务做验证

模型对比要固定输入和验收标准,至少覆盖真实代码修复、长文档分析、结构化工具调用和批量分类。重点记录成功率、失败类型、响应延迟、输入输出 token 和重试次数。

python 复制代码
import os

model = os.getenv("OPENAI_MODEL", "gpt-5.1")
print(f"evaluating {model}")

如果是高并发的抽取和分类任务,可以单独评估轻量模型;如果是仓库级修改,除了代码能否生成,还应检查补丁是否通过现有测试。

给请求层加有限重试

鉴权失败、参数错误和模型不存在不应反复重试;限流或临时网络故障才适合有限次数退避。重试次数必须有上限,最终错误要保留原始异常,便于定位。

python 复制代码
import time


def retry_call(call, attempts=3):
    for attempt in range(attempts):
        try:
            return call()
        except Exception:
            if attempt == attempts - 1:
                raise
            time.sleep(2 ** attempt)

生产环境应将 Exception 换成 SDK 提供的具体异常类型,并根据状态码区分可重试和不可重试情况。

小结

把模型 ID 和 endpoint 一起配置,先用固定任务集验证,再决定通用模型与编码模型的路由。切换模型后要重新检查请求参数、上下文限制和速率限制;模型目录与接口要求变化时,以当前平台文档为准。

相关推荐
Csvn3 小时前
第 28 章 案例四 多智能体协作系统
人工智能·aigc·agent
IT_陈寒3 小时前
Java中equals方法比了个寂寞?原来这才是正确的重写姿势
前端·人工智能·后端
Thneonl3 小时前
Celery 生产踩坑:1000 任务积压与 acks_late 双重执行
后端·python
清桔3 小时前
模型的调用
python
吴佳浩3 小时前
Agent 怎么做自动化评测?构建端到端的 Agent Evaluation 体系
人工智能·agent·ai编程
火山引擎开发者社区3 小时前
火山引擎云数据库 TiDB 版公测开启,MySQL 架构升级的一站式选择
人工智能
代码方舟3 小时前
Java数据工程:利用天远全网运营商三要素优化线上实名认证合规体验
java·人工智能
小小张说故事3 小时前
Python 多线程为什么跑不快?asyncio 入门指南:异步并发从零上手
后端·python
Csvn3 小时前
第 27 章 案例三 自动化工作流 Agent
人工智能·aigc·agent
知几蜗牛3 小时前
AI眼镜把记忆放上云,怎样证明云端也看不见?
人工智能