Google发布Gemini 3.7 Flash:企业为何要计算AI智能体的任务总成本——赛柏特AI快讯

8月13日,Google发布Gemini 3.7 Flash,将其称为面向编程和AI智能体的"主力模型",强调它适合频繁执行实际任务。

此次发布除了介绍模型能力,也把多步骤任务表现和使用成本放在了较突出的位置。

自发布日起,新模型开始通过Gemini API、Google AI Studio、Android Studio和Antigravity等开发平台陆续上线,同时进入Gemini Enterprise Agent Platform和Gemini Enterprise应用。

从生成代码到执行多步骤任务

Google称,Gemini 3.7 Flash提升了首次生成代码的准确性、界面设计遵循能力和指令执行效果。

自发布日起,这款模型也开始用于Google个人智能体Gemini Spark。

Google表示,新模型能够提高Spark处理多步骤任务的准确性,并改进其在Gmail、Google Docs等应用中的工具使用表现。

Google把3.7 Flash用在Spark上,也说明这款模型瞄准的不只是一次问答,而是需要连续执行多个步骤的AI智能体任务。

API 优惠价格持续至年底

Gemini API按照模型处理的token数量计费。

到2026年12月31日,Gemini 3.7 Flash每百万输入token的价格为0.75美元,每百万输出token为3.75美元。

从2027年1月1日起,价格计划调整为每百万输入token 1.50美元、每百万输出token 7.50美元。

每百万token的价格不等于完成一项任务的成本。通过API运行的多步骤智能体,可能需要规划、调用工具、检查结果并根据失败信息重试,因此一项任务往往会产生多轮模型请求。

企业需要计算任务总成本

厂商公布的模型测试成绩不能直接代表企业真实任务的成功率。

企业使用的数据、工具、项目结构和任务难度并不相同,实际结果还会受到工作流程设计的影响。

在正式部署前,企业可以选择一组真实任务进行测试,同时记录成功率、完成时间、模型调用轮数、token消耗、工具调用次数和人工修改量。

这些数据可以帮助企业回答一个更实际的问题:模型完成一项工作究竟需要多少时间、多少人工介入和多少费用。

对准备通过API运行AI智能体的企业来说,真正值得比较的并不只是每百万token的价格或一次回答的效果,而是完成同一项真实任务需要消耗多少token、花多长时间、经历多少次返工,以及还需要多少人工介入。

作为全球AI算网基础设施服务商,赛柏特将持续关注AI产业与技术动态,为读者带来及时、专业的AI快讯。

相关推荐
wujian83111 小时前
怎么用千问生成word文档:从「格式崩」到「一键过」,AI导出鸭打通最后半厘米
人工智能·ai·c#·word·豆包·deepseek·ai导出鸭
一拳不是超人1 小时前
DeepSeek Harness 为什么敢说"一切皆插件"?拆透 Cordis 引擎的五大核心机制
前端·人工智能·agent
安全指北针1 小时前
AI编程工具供应链安全实战:当你的AI编码助手成为跳板
人工智能·安全·ai编程
fo安方1 小时前
视频——工具——视频——ppt——AI生成ppt
人工智能·powerpoint
watersink1 小时前
机器学习最大熵模型max_entropy_model
人工智能·机器学习
IT_陈寒1 小时前
Python的GIL让我多写了500行代码
前端·人工智能·后端
迪康Defender1 小时前
AI 重构终端安全运营:智能分析中枢 AI Insight 模块架构与落地场景深度解析
运维·网络·人工智能·其他·安全·重构·架构
IPHWT 零软网络2 小时前
技术方案分享|AI Agent 赋能 IVR 导航,解决传统语音呼叫系统交互瓶颈
人工智能·通信系统·rag·ivr·aiagent·智能语音·语音导航
leijiwen2 小时前
《花尖墨 · 果域宇宙》电影三部曲
人工智能·saas·paas