xAI AI 伴侣 Ani 和 Valentine 支持电话实时通话

阿里 AIDC-AI 发布 Ovis2.5:集成NaViT的多模态模型

阿里AIDC-AI 推出了多模态模型 Ovis2.5,提供 9B 和 2B 两种参数量版本。该模型最大亮点是搭载原生视觉变换器(NaViT),突破性地支持直接处理任意原始分辨率图像------既不需要预先切片,也无需统一缩放至固定尺寸。这种创新架构完整保留了图像中的精细像素细节和全局空间布局,特别擅长解析图表、表格等结构化视觉内容。

佬们现在就可以去 Hugging Face Space[1] 调戏这个新模型

xAI AI 伴侣 Ani 和 Valentine 支持电话实时通话

xAI[2] 最新推出的 AI 伴侣 Ani 和 Valentine 现已支持电话实时通话功能!

现在,你可以像给朋友打电话一样,直接拨打 +1 (325) 225-5264(Ani)或 +1 (607) 225-5825(Valentine),与你的 AI 伴侣进行自然流畅的语音交流。

OpenAI 发布生产级 AI 应用开发全栈学习路径

OpenAI最新推出了从入门到生产级的 AI 应用开发学习路径[3],学习后能够掌握AI基础概念,将其融入 AI 应用开发中,评估应用性能,并实施最佳实践以确保AI解决方案稳健且可大规模部署。

教程非常详细,只需要略懂 js 或者 python 就行学习。

字节 Trae 推出内置 Figma-to-code 功能

Trae[4] 在其产品的 Solo 模式中新增了内置 Figma-to-code 功能。

这个功能可以将用户的设计直接转化为可工作的代码,大大提升了开发效率。

不得不说 Trae 这个工具越来越强大了,虽然铺天盖地的宣传确实有点烦

阿里 Wan2.2-I2V-Flash图像转视频模型

阿里巴巴万相(Wan)团队[5]发布了 Wan2.2-I2V-Flash 图像转视频模型。

该模型推理速度相比前代提升了惊人的 12 倍,同时显著增强了指令遵循和风格保持能力,特别适合需要快速生成风格统一视频内容的场景。

不过遗憾的是,目前该模型仅通过 API 提供服务,权重并未公开

ElevenLabs 发布智能视频配乐生成功能

ElevenLabs Studio 中推出了 Video-to-Music 新功能,用户现在可以一键操作,让 Eleven Music 模型根据视频的上下文智能生成定制背景配乐。

这个 AI 能自动分析视频内容,匹配合适的音乐风格和情绪节奏。

详情可以查看官方推文[6],这个功能把视频创作的配乐门槛降到了新低。

相关推荐
大千AI助手1 天前
基于OpenAPI生成的 SDK 的工业级和消费级概念区别
人工智能·python·机器学习·openai·代码生成·openapi·大千ai助手
sdguy1 天前
在 Windows 上正确安装 OpenAI Codex CLI:一次完整的 pnpm 全局环境修复实录
后端·openai
机器之心2 天前
T5Gemma模型再更新,谷歌还在坚持编码器-解码器架构
人工智能·openai
机器之心2 天前
OpenAI最强代码模型GPT-5.2-Codex上线
人工智能·openai
哪吒编程2 天前
炸场!谷歌深夜发布Gemini 3 Flash:速度与智商的完美“怪胎”,GPT-5的噩梦来了?
openai·gemini
HyperAI超神经2 天前
GPT-5全面领先,OpenAI发布FrontierScience,「推理+科研」双轨检验大模型能力
人工智能·gpt·ai·openai·benchmark·基准测试·gpt5.2
攻城狮7号2 天前
OpenAI开源0.4B参数Circuit-Sparsity模型:给AI大脑做次“极简手术”
人工智能·openai·开源模型·circuit·sparsity·0.4b参数模型
Java陈序员2 天前
告别繁琐操作!这款神器用 AI 轻松绘制专业图表!
openai·next.js·deepseek
小皮虾2 天前
别再封装 Axios 了!用 RPC 像调用本地函数一样写接口(支持 Vue/React/Node)
前端·rpc·全栈
Mintopia2 天前
🧭 Next.js 服务器部署摘要
react.js·全栈·next.js