Gemini 2.5模型重大升级:更智能的AI技术

Gemini 2.5:我们的最智能模型变得更强大

Gemini 2.5 Pro持续受到开发者喜爱,成为最佳编程模型,而2.5 Flash通过新更新变得更出色。我们还在模型中引入了新功能,包括Deep Think------2.5 Pro的实验性增强推理模式。

2.5 Pro性能表现

最新版2.5 Pro在WebDev Arena和LMArena排行榜上领先,成为世界顶级模型。凭借100万token的上下文窗口,2.5 Pro拥有最先进的长上下文和视频理解能力。结合LearnLM教育模型家族后,2.5 Pro也成为学习领域的领先模型。

Deep Think模式

我们正在测试名为Deep Think的增强推理模式,该模式采用新技术让模型在回应前考虑多种假设。2.5 Pro Deep Think在2025 USAMO数学竞赛基准测试中表现优异,在LiveCodeBench编程竞赛基准测试中领先,并在MMMU多模态推理测试中获得84.0%的高分。

2.5 Flash改进

2.5 Flash是我们最高效的"工作马"模型,专为速度和低成本设计。新版在推理、多模态、代码和长上下文等关键基准测试中均有提升,同时效率提高20-30%。

新2.5功能

原生音频输出和Live API改进

Live API现在支持音频-视觉输入和原生音频输出对话,可构建更自然的对话体验。模型可以调整语调、口音和说话风格,并支持工具使用。

计算机使用能力

我们将Project Mariner的计算机使用能力引入Gemini API和Vertex AI,多家公司正在探索其潜力。

更强的安全性

我们显著增强了对抗安全威胁的保护,如间接提示注入攻击,使Gemini 2.5成为迄今为止最安全的模型系列。

开发者体验

思维摘要

2.5 Pro和Flash现在在Gemini API和Vertex AI中包含思维摘要功能,将模型的原始思维组织成清晰格式。

思维预算

我们将2.5 Flash的思维预算功能扩展到2.5 Pro,让开发者能控制模型在回应前使用的token数量。

MCP支持

我们在Gemini API中添加了对模型上下文协议(MCP)的原生SDK支持,便于与开源工具集成。

我们持续创新改进模型和开发者体验,同时加倍投入基础研究的广度和深度。更多更新即将到来。

更多精彩内容 请关注我的个人公众号 公众号(办公AI智能小助手)

公众号二维码

相关推荐
CoovallyAIHub2 天前
仿生学突破:SILD模型如何让无人机在电力线迷宫中发现“隐形威胁”
深度学习·算法·计算机视觉
CoovallyAIHub2 天前
从春晚机器人到零样本革命:YOLO26-Pose姿态估计实战指南
深度学习·算法·计算机视觉
CoovallyAIHub2 天前
Le-DETR:省80%预训练数据,这个实时检测Transformer刷新SOTA|Georgia Tech & 北交大
深度学习·算法·计算机视觉
CoovallyAIHub2 天前
强化学习凭什么比监督学习更聪明?RL的“聪明”并非来自算法,而是因为它学会了“挑食”
深度学习·算法·计算机视觉
CoovallyAIHub2 天前
YOLO-IOD深度解析:打破实时增量目标检测的三重知识冲突
深度学习·算法·计算机视觉
用户1474853079743 天前
AI-动手深度学习环境搭建-d2l
深度学习
OpenBayes贝式计算3 天前
解决视频模型痛点,TurboDiffusion 高效视频扩散生成系统;Google Streetview 涵盖多个国家的街景图像数据集
人工智能·深度学习·机器学习
OpenBayes贝式计算3 天前
OCR教程汇总丨DeepSeek/百度飞桨/华中科大等开源创新技术,实现OCR高精度、本地化部署
人工智能·深度学习·机器学习
在人间耕耘4 天前
HarmonyOS Vision Kit 视觉AI实战:把官方 Demo 改造成一套能长期复用的组件库
人工智能·深度学习·harmonyos
homelook4 天前
Transformer与电池管理系统(BMS)的结合是当前 智能电池管理 的前沿研究方向
人工智能·深度学习·transformer