Google发布Gemini 3.7 Flash:企业为何要计算AI智能体的任务总成本——赛柏特AI快讯

8月13日,Google发布Gemini 3.7 Flash,将其称为面向编程和AI智能体的"主力模型",强调它适合频繁执行实际任务。

此次发布除了介绍模型能力,也把多步骤任务表现和使用成本放在了较突出的位置。

自发布日起,新模型开始通过Gemini API、Google AI Studio、Android Studio和Antigravity等开发平台陆续上线,同时进入Gemini Enterprise Agent Platform和Gemini Enterprise应用。

从生成代码到执行多步骤任务

Google称,Gemini 3.7 Flash提升了首次生成代码的准确性、界面设计遵循能力和指令执行效果。

自发布日起,这款模型也开始用于Google个人智能体Gemini Spark。

Google表示,新模型能够提高Spark处理多步骤任务的准确性,并改进其在Gmail、Google Docs等应用中的工具使用表现。

Google把3.7 Flash用在Spark上,也说明这款模型瞄准的不只是一次问答,而是需要连续执行多个步骤的AI智能体任务。

API 优惠价格持续至年底

Gemini API按照模型处理的token数量计费。

到2026年12月31日,Gemini 3.7 Flash每百万输入token的价格为0.75美元,每百万输出token为3.75美元。

从2027年1月1日起,价格计划调整为每百万输入token 1.50美元、每百万输出token 7.50美元。

每百万token的价格不等于完成一项任务的成本。通过API运行的多步骤智能体,可能需要规划、调用工具、检查结果并根据失败信息重试,因此一项任务往往会产生多轮模型请求。

企业需要计算任务总成本

厂商公布的模型测试成绩不能直接代表企业真实任务的成功率。

企业使用的数据、工具、项目结构和任务难度并不相同,实际结果还会受到工作流程设计的影响。

在正式部署前,企业可以选择一组真实任务进行测试,同时记录成功率、完成时间、模型调用轮数、token消耗、工具调用次数和人工修改量。

这些数据可以帮助企业回答一个更实际的问题:模型完成一项工作究竟需要多少时间、多少人工介入和多少费用。

对准备通过API运行AI智能体的企业来说,真正值得比较的并不只是每百万token的价格或一次回答的效果,而是完成同一项真实任务需要消耗多少token、花多长时间、经历多少次返工,以及还需要多少人工介入。

作为全球AI算网基础设施服务商,赛柏特将持续关注AI产业与技术动态,为读者带来及时、专业的AI快讯。

相关推荐
诸神缄默不语14 分钟前
备战 AI 出海 DAY 0:海外数据采集
大数据·人工智能
Ysn07191 小时前
YOLO-Master工程:experts.py 专家结构详解与目标检测专家设计启发
人工智能·yolo·目标检测
BingoGo1 小时前
使用 GPT-6 Astra 模型 请立刻更新你的 Skill 与提示词
人工智能
香菜+1 小时前
端侧视频分析 · 架构笔记
人工智能
s1ckrain1 小时前
【论文阅读】A Survey on Vision–Language–Action Models for Embodied AI
论文阅读·人工智能·多模态·具身智能
深圳雨林凯AI2 小时前
图案裂变的“风格归一化“设计思路:主体保得住,画风才拉得齐|雨林凯AI技术笔记
人工智能·笔记
DevNo2 小时前
英文会议转中文纪要,三款AI工具实测体验
人工智能
深小乐2 小时前
AI 说话越来越难懂?Anthropic 员工都在用 ELI5 这个图解 Skill
人工智能
问天_观心2 小时前
大模型微调学习(二)
人工智能·python·深度学习·学习·语言模型·transformer
甲维斯2 小时前
我要吹爆GPT6了!实测3列惊为天人!
人工智能