哔哩哔哩开源 IndexTTS-2.0:新一代零样本语音合成模型

Qwen3-ASR-Flash:高精度多语言语音识别模型

Qwen3-ASR-Flash1 是基于 Qwen3 推出的高精度多语言语音识别模型,支持 11 种语言及其多种口音,具备自动语种检测与非人声过滤功能。

目前该模型暂未开源(有点小遗憾),但已上线阿里云百炼平台 API,佬们也可以在 Hugging Face Space 上在线体验2。

哔哩哔哩开源 IndexTTS-2.0:新一代零样本语音合成模型

IndexTTS-2.03 是哔哩哔哩语音团队开源的新一代零样本语音合成模型,基于 55K 小时中英双语语音和 135 小时情感数据训练,实现了对语音时长和情感的精准控制。

目前 SDK 和模型都已开放,有需要的佬可以试试看!

即梦 AI 推出 Seedream 4.0 图像生成模型

即梦 AI 平台官网4的新一代图像生成模型 Seedream 4.0 已逐步向所有用户推送,中国版 Nano Banana 来了。

不过官方尚未发文正式发布,但登录后即可直接体验,一次生成消耗 1 积分。

MCP Registry 发布:开源标准化 MCP 服务器分发与发现

Model Context Protocol(MCP)Registry 预览版5正式发布,这个项目可以理解为 Node.js 的 npm 或者 Python 的 PyPI 的 MCP 版本。

它旨在标准化 MCP 服务器的分发与发现流程,完全开源并支持下游构建公共或私有的子注册表。目前只能通过接口和命令行工具来发布和获取,感觉可以开始抢占几个好名字了!

Vercel 开源 Vibe Coding 平台:集成 AI SDK 的完整开发生态

Vibe Coding Platform6 是 Vercel 发布并开源的基于其公司生态系统(包含 AI SDK、Gateway 和 Sandbox )的编码平台。

有做类似业务的佬们可以好好研究下源码7,学习学习设计思路啥的。

相关推荐
不悔哥4 天前
开源OV-Watch:怎么做一个智能手表
单片机·开源·嵌入式
家和804 天前
Carla仿真系列:4_在 Carla 的 Tesla 上装 4 路摄像头,并创建网格为环视拼接做准备
开源
感谢地心引力4 天前
我用 Doubao-Seed-2.1-pro 做了一个深度融入 AI 功能的本地知识库软件
ai·开源·seed·markdown·豆包
alsmile4 天前
Node-RED 之外,国产规则引擎的新方案:基于标准语法,Go 先行实现
后端·开源·go
瑶山4 天前
开源编程Agent-OpenCode完整使用教程
开源·agent·ai编程·opencode
m4Rk_4 天前
【论文阅读】Agent 记忆机制(77):TSM——让记忆回到事件真正发生的时间
论文阅读·人工智能·学习·开源·github
十六年开源服务商4 天前
2026网站主题打包方案深度解析
开源
小葱运维4 天前
命名与环境规范
运维·开源·云计算
菩提小狗4 天前
每日极客日报 · 2026年09月21日
ai·开源·极客日报·it热点·技术资讯