哔哩哔哩开源 IndexTTS-2.0:新一代零样本语音合成模型

Qwen3-ASR-Flash:高精度多语言语音识别模型

Qwen3-ASR-Flash[1] 是基于 Qwen3 推出的高精度多语言语音识别模型,支持 11 种语言及其多种口音,具备自动语种检测与非人声过滤功能。

目前该模型暂未开源(有点小遗憾),但已上线阿里云百炼平台 API,佬们也可以在 Hugging Face Space 上在线体验[2]。

哔哩哔哩开源 IndexTTS-2.0:新一代零样本语音合成模型

IndexTTS-2.0[3] 是哔哩哔哩语音团队开源的新一代零样本语音合成模型,基于 55K 小时中英双语语音和 135 小时情感数据训练,实现了对语音时长和情感的精准控制。

目前 SDK 和模型都已开放,有需要的佬可以试试看!

即梦 AI 推出 Seedream 4.0 图像生成模型

即梦 AI 平台官网[4]的新一代图像生成模型 Seedream 4.0 已逐步向所有用户推送,中国版 Nano Banana 来了。

不过官方尚未发文正式发布,但登录后即可直接体验,一次生成消耗 1 积分。

MCP Registry 发布:开源标准化 MCP 服务器分发与发现

Model Context Protocol(MCP)Registry 预览版[5]正式发布,这个项目可以理解为 Node.js 的 npm 或者 Python 的 PyPI 的 MCP 版本。

它旨在标准化 MCP 服务器的分发与发现流程,完全开源并支持下游构建公共或私有的子注册表。目前只能通过接口和命令行工具来发布和获取,感觉可以开始抢占几个好名字了!

Vercel 开源 Vibe Coding 平台:集成 AI SDK 的完整开发生态

Vibe Coding Platform[6] 是 Vercel 发布并开源的基于其公司生态系统(包含 AI SDK、Gateway 和 Sandbox )的编码平台。

有做类似业务的佬们可以好好研究下源码[7],学习学习设计思路啥的。

相关推荐
一直会游泳的小猫6 小时前
gstack-guide
开源·安全防护·ai辅助开发·技能工具集·sprint流程
Hical_W7 小时前
Hical 踩坑实录五部曲(五):Boost.MySQL 协程集成的 5 个坑
数据库·mysql·开源
Hical6110 小时前
C++26 反射落地实战
c++·开源
IvorySQL10 小时前
从 repack.c 深入理解 PostgreSQL REPACK 的底层实现
数据库·postgresql·开源
千桐科技11 小时前
qData 数据中台社区开源版 v1.4.0 发布:元数据管理核心模块正式上线
开源·数据治理·数据集成·数据开发·数据中台·元数据管理·qdata
容器魔方13 小时前
“驾驭工程”下一跳?JiuwenClaw AgentTeam开启“协同工程”全新范式
人工智能·云原生·容器·架构·开源
日取其半万世不竭15 小时前
Pixelfed 自建教程:开源去中心化图片社交平台
开源·去中心化·区块链
GitCode官方15 小时前
智能进化觉醒!openvela trunk-5.5 发布:端侧 AI Agent 开源和多方位升级
人工智能·开源
幽络源小助理15 小时前
最新轻量美化表白墙系统源码v2.0_带后台版_附搭建教程
前端·开源·源码·php源码
前端若水16 小时前
智能体开发与传统软件开发的核心区别
网络·人工智能·python·开源·log4j