HeyGen AI 三步创建产品广告视频

Hugging Face 官方教程:消费级显卡实现 FLUX.1-dev 微调

Hugging Face1 官方发布教程《LoRA Fine-Tuning FLUX.1-dev on Consumer Hardware》,详细讲解如何在单张消费级显卡(10GB显存)上,使用 QLoRA 技术和 diffusers 库对 FLUX.1-dev 模型进行高效微调。

佬们可以在这里看完整教程细节2

Kyutai 推出 STT 模型

Kyutai Speech-To-Text 是一款开源的语音转文本模型,支持流式传输和批量推理两种模式,运行速度极快。它提供两个版本:

  1. 纯英语 2.6B 参数模型 - 即使作为流式模型,在基准测试中表现也优于 Whisper Large v3
  2. 轻量级 1B 参数双语模型 - 专为英语/法语实时语音聊天应用优化

可惜没有中文,佬们可以直接在官方渠道3下载模型、查看代码。

Adobe 发布 Self Forcing:基于 Wang 2.1 的实时视频生成

Self Forcing4 是 Adobe 最新推出的基于 Wang 2.1 实现的实时流式视频生成模型。该模型在单张 RTX 4090 显卡上即可实现流式视频生成。

佬们可以试试这个社区实现的在线试用5 Space

NVIDIA 发布 UniRelight:基于扩散模型的通用视频重照明技术

NVIDIA AI 团队最新推出的 UniRelight6 是一项基于扩散模型的通用重照明技术。

该技术能够仅凭单个图像或视频就实现高质量的重新照明效果。

从官方演示来看,效果非常不错,项目的代码即将开源,感兴趣的佬可以先到官网查看示例。

HeyGen 推出 AI 广告生成工具:三步创建产品视频

HeyGen 最新推出的 Product Placement7 功能,只需上传产品照片、选择一个人像、输入文案脚本,即可生成产品介绍视频。

相关推荐
染指11103 小时前
26.RAG进阶(Advanced RAG)-假设性问题索引
人工智能·windows·agent·rag·advanced rag
闵孚龙3 小时前
动态图机制:为什么 PyTorch 调试起来更舒服
人工智能·pytorch·python
甲维斯3 小时前
还要啥Codex!DeepSeek接入Zcode远程连接!
人工智能
百胜软件@百胜软件4 小时前
百胜软件亮相“AI消费新生活”主题日活动,AI智能运营平台入选市级案例征集
人工智能·生活·零售数字化·数智中台·珠宝行业
专注搞钱5 小时前
GPT-4o写设备Recipe:从3小时到10分钟
数据库·人工智能·gpt·半导体
闻道参看5 小时前
贝芯宠AI灵兽 ELFVET 大模型聚焦临床应用,强化宠物诊疗综合能力
人工智能·宠物
MartinYeung55 小时前
[论文学习]重新思考大型语言模型忘却目标:梯度视角与超越
人工智能·学习·语言模型
财经资讯数据_灵砚智能5 小时前
基于全球经济类多源新闻的NLP情感分析与数据可视化(夜间-次晨)2026年6月14日
大数据·人工智能·python·ai·信息可视化·自然语言处理·灵砚智能
m0_380167145 小时前
加密货币价格 API、市场数据 API 与 分析 API 有什么区别?
人工智能·ai·区块链
zyplayer-doc5 小时前
企业知识库安全与权限管理完全指南:从加密到审计的六层防护
人工智能·安全·pdf·编辑器·创业创新