腾讯混元 3D 2.1 发布:首个全链路开源工业级 3D 生成大模型

腾讯混元 3D 2.1 发布:首个全链路开源工业级 3D 生成大模型

腾讯混元3D 2.11开源了业界首个全链路工业级3D生成大模型,本次不仅开源了模型权重、训练代码和数据处理流程,还完整公开了核心架构设计。

通过引入PBR(基于物理的渲染)技术,显著提升了材质细节的真实性,模型在不同光照下更自然、更一致。

MagicTryOn:基于 Wan 2.1 的开源视频虚拟试穿框架

MagicTryOn2 是基于 Wan 2.1 的开源视频虚拟试穿框架,在时空一致性和服装内容保留方面表现出色,生成的试穿效果真实自然且稳定。

从官网演示来看,其服装贴合度和动态效果处理相当惊艳,不过目前暂时没有发布在线试用版本,想体验的话只能自己部署了。

Anthropic 揭秘:如何构建高效的多智能体研究系统

Anthropic3 发布了一篇深度文章,详细介绍了Anthropic 公司构建多智能体研究系统的过程,探讨了其在处理复杂研究任务中的优势、面临的挑战以及相关的工程实践和评估方法,旨在分享如何通过多智能体系统更有效地探索复杂主题的经验教训。

干货满满,值得一看!

ComfyUI 更新:原生支持 LoRA 训练功能

ComfyUI 最新版本已支持原生 LoRA 训练模块!这一更新刚刚合并到主分支,标志着 ComfyUI 在模型微调能力上的重大突破。

开发者现在可以直接在 ComfyUI 框架内完成 LoRA 训练,无需依赖外部工具。查看完整实现细节和功能说明请参考这个PR4

Ming-Omni 开源多模态模型:统一处理图像文本音频视频

Ming-Omni5 是一款统一架构的开源多模态模型,能够无缝处理图像、文本、音频和视频等多种数据模态。

这个全能模型在各种基准测试中都表现亮眼,可以说是开源界的 GPT-4o 平替,完整项目及技术细节可以看官网。

相关推荐
云卷云舒___________12 小时前
谷歌内测Gemini 3.8 Flash,智谱开源GLM-5.3权重,腾讯亮剑Hy4,开源大模型神仙打架 | 8月29日 AI日报
谷歌·腾讯·glm·gemini·混元·智谱·ai日报
云卷云舒___________21 天前
视频抽奖ChatGPT Plus | Cursor迭代Composer3、Sonnet5.5或下月发布、腾讯押注WorkBuddy办公AI 8月9日 AI日报
cursor·腾讯·anthropic·vega·ai日报·composer3·sonnet55
半甜柠檬22 天前
腾讯Workbuddy实战:3次迭代后,我把周会整理变成了一句话
腾讯
产品设计大观24 天前
构建低消耗的产研AI工作流:Workbuddy生态 + 墨刀AI 落地实践
人工智能·ai·产品经理·墨刀·腾讯·产品设计·workbuddy
dong_junshuai25 天前
每天一个开源项目#60 TencentDB Agent Memory:1.4万星的团队记忆中枢
github·腾讯
求真学习1 个月前
腾讯优图Youtu-Parsing开源,无损并行解码让表格解析提速26倍,OmniDocBench 93.22分
ocr·pdf解析·腾讯·文档解析·youtu-parsing
沉默王二1 个月前
腾讯面试官:“你说你做了一个终端Agent,那说说 LLM 和 Agent的区别,ReAct、MCP、Tool、Memory、Skills?”我信誓旦旦开始背了
面试·agent·腾讯
饼干哥哥1 个月前
腾讯会议出AI同传了?这下跨境人开会不用担心哑巴英语了
人工智能·性能优化·腾讯
粤海科技君2 个月前
WorkBuddy CLI 命令行实战:替代 Claude Code 的工作流
claude·workflow·腾讯