OctaFuse Gateway 2.6.0:完善 Vertex AI 鉴权、图片计费与日常调试

OctaFuse Gateway 2.6.0 重点完善项目级 Vertex AI 的服务账号鉴权与文生图计费,让供应商接入、分时定价和异常请求扣费更明确、更容易核验。

管理后台同步优化了路由编辑、Playground 和 Simulator,并新增 BytePlus、阿里云百炼国际站、Meta Model API、Cerebras、SambaNova、DeepInfra、Novita、Command Code、Hugging Face、Vercel 等供应商导入模板。

一句话看懂 2.6.0:

统一项目级 Vertex AI 的服务账号鉴权,明确图片与时段计费规则,并让日常配置和联调更高效。

01|项目级 Vertex AI 统一使用服务账号鉴权

项目级 Vertex AI 现在可以直接在供应商凭证栏粘贴 GCP 服务账号 JSON。Gateway 会在请求发出前自动签名 JWT 并换取 OAuth 2.0 access token,再通过 Authorization: Bearer 调用上游。

同一份服务账号凭证可用于两条 Vertex AI 调用路径:

  • OpenAI 兼容端点.../endpoints/openapi,适合通过 Chat Completions 兼容协议访问 Vertex AI。
  • 原生 Gemini 端点 :项目级 publishers/google/models 路径,保持 Gemini 原生请求和响应格式。

服务账号 JSON 不会被拼接到 ?key=,也不会原样发送给上游。通过 OpenAI 兼容端点调用 Google 模型时,如果路由中的 provider_model_name 缺少 google/,Gateway 会自动补齐;原生 Gemini 路径仍使用原模型名。

Playground 与 Proxy 使用同一套凭证解析和 access token 换取流程,因此可以在正式接入业务流量前先验证项目 ID、服务账号权限和上游模型名。

在 Provider 页面点击 Import 并搜索 Vertex,即可区分 Express Mode API Key 与项目级服务账号两种接入方式。

02|文生图计费规则更明确

图片模型现在通过 image_billing_mode 明确区分两种计费方式:

  • token:根据上游返回的文本和图片 Token 用量计费,适用于 GPT Image、Gemini 图片模型等。
  • per_image:根据确认返回的图片张数计费,可选参考图输入单价,适用于 Seedream、GLM Image、Grok Image 等。

2.6.0 同时统一了失败请求的扣费规则:客户端取消、Gateway 超时、明确的上游 4xx / 5xx、网络错误以及空结果都不扣费。入口预算预检只用于判断请求能否发送到上游,不再作为异常结果的最终扣费依据。

为了避免旧数据被错误解释为按张计费,仅包含旧版 image 块、但没有显式声明 image_billing_mode 的配置将不再扣费;包含有效 image_* Token 单价的旧配置仍按 Token 模式处理。

模型列表会直接标出 /img/M,便于在配置路由前先确认图片模型采用按张还是按 Token 计费。

03|每日时段改为覆盖默认倍率

路由的用户计费倍率(Charged)与供应成本倍率(Metered)现在更容易理解:默认倍率用于未命中任何时段的请求;命中每日时段后,时段中填写的倍率直接覆盖默认值。

新配置使用 schedule.mode: "override"。为了兼容历史数据,未设置 mode 的旧配置仍沿用"默认倍率 × 时段倍率"的叠乘规则。

Routes 工作台也同步优化了倍率格式、时段提示和路由拓扑展示,便于在保存前核对实际生效方式。

在同一个路由编辑器中核对客户端入口、上游映射、目录标准价、默认倍率和每日覆盖时段。

04|Playground、Simulator 与供应商目录升级

Playground 增加了更多 Chat、Responses、Anthropic 与 Gemini 请求样例,并增强对流式响应、终态用量和 Gemini 工具调用参数的观察。Simulator 则根据选择的客户端请求入口确定协议,更贴近真实客户端经过 Proxy 的调用方式。

选择单条路由后可直接载入 Tool stream 等请求样例;Playground 不扣减用户预算、不写请求日志,也不执行路由池故障转移。

Simulator 先选择客户端可见模型和路由组,再按匹配到的请求入口生成协议与请求路径;填写 Proxy 地址和测试密钥后即可验证完整链路。

本次更新还扩充了供应商目录,新增多项国际站、官方模型 API、推理平台和聚合网关预设。官网的供应商目录模型目录已经同步到 v2.6.0。

模型目录中的 gemini-3.1-flash-lite-preview 已调整为 Google 当前使用的 ID gemini-3.1-flash-lite。该模型目前仍处于预览阶段;已导入数据库的旧模型记录不会自动改名,需要删除后重新导入或手动修改。

升级到 2.6.0

本版本没有数据库表结构变更。请拉取同版本的 Proxy、Admin 与 migrate 镜像,按现有流程执行一次 migrate Job,再滚动重启 Proxy 与 Admin。

升级前可查看

小结

2.6.0 没有新增客户端接口,而是集中完善了已有能力的鉴权、计费和运维体验:Vertex AI 凭证不再依赖容易混淆的 ?key= 配置,图片异常请求的扣费边界更加清晰,分时倍率也与管理后台中的实际含义保持一致。

如果 OctaFuse Gateway 对你的项目有帮助,欢迎在 GitHub 上点一个 Star。你的关注和反馈,会帮助我们继续完善路由、协议适配与自托管体验。

相关推荐
阿里云大数据AI技术5 小时前
阿里云PAI发布通用蒸馏框架EasyDistill2.0,提供主流大模型蒸馏场景最佳实践
人工智能·agent
付玉祥7 小时前
Agent 的部署流程:从本地启动到服务化
agent
樊小肆7 小时前
DeepSeeker-Code源码导读05-计划模式与子Agent
人工智能·agent
用户458562068237 小时前
DeepSeek-Harness部署踩坑
llm
百工蜂Agent8 小时前
对话才几轮,上下文窗口怎么就满了?
agent
小四的小六8 小时前
两个Agent同时写同一个Tool,数据被覆盖了——我是怎么用乐观锁修好的
openai·agent·ai编程
可爱的小Cherry8 小时前
DeepSeek Harness 手机版来咯!支持图片识别,一键开启「梁神模式」
agent
宋哥转AI8 小时前
深入理解 AI Agent · MEMORY #03:从设计到落地
人工智能·agent·ai编程
leeyi8 小时前
Langfuse 接入:给 Agent 加“行车记录仪“(第88篇-E74)
llm·aigc·agent