技术栈
视觉大模型
深兰科技
19 天前
人工智能
·
科技
·
r语言
·
symfony
·
视觉大模型
·
深兰科技
·
deepagent智能体
深兰科技亮相天津医疗器械创新生态大会,DeepAgent智能体赋能医疗医美并签约天津OPC项目
2026年7月30日,第三届中国(天津)医疗器械创新生态大会暨第九届(2026)中国医疗器械创新创业大赛在天津举行。深兰科技创始人、董事长陈海波出席大会,以“深兰科技医疗企业智能体发布”为主题发表演讲,重点介绍深兰科技大模型、DeepAgent智能体开发平台在医疗、医美等领域的应用,以及DSAgent行业智能体产品的场景落地能力。
杀生丸学AI
20 天前
3d
·
三维重建
·
扩散模型
·
视觉大模型
·
高斯泼溅
·
前馈模型
·
大场景重建
【前馈三维重建】AdaptiveSplat:前馈重建的纹理感知可控3DGS分配方法(ECCV 2026)
图1:概述:给定输入图像和目标高斯预算,AdaptiveSplat可生成稀疏但高质量的重建结果----控制基本图元分配的同时,能够保持场景保真度的能力。相比之下,现有方法在高稀疏度下会出现伪影及过度平滑现象。
杀生丸学AI
1 个月前
人工智能
·
3d
·
数据挖掘
·
aigc
·
三维重建
·
扩散模型
·
视觉大模型
【三维重建】ArtiFixer:自回归扩散增强与扩展3DGS(NVIDIA)
图1. ArtiFixer高效且可扩展地增强3DGS结果。 给定初始重建结果、可选的参考视图及文本提示,该工具可通过自回归方法生成新的内容,同时保持与现有观测数据的高度一致性。ArtiFixer可在单次推理过程中直接生成数百个新视图,或作为伪监督数据用于优化底层三维重建效果。
yichudu
2 个月前
视觉大模型
Qwen-VL模型笔记
Qwen-Visual Langugage, 基于 Qwen-7B 的多模态视觉语言大模型. 支持图文理解、文档解析、OCR、视觉问答等任务.
流放深圳
3 个月前
人工智能
·
视觉大模型
·
图片识别
·
springai
·
vision-language
抓住 AI 人工智能的风口之第 5 章 —— 使用视觉大模型(Vision-Language Model)支持图片识别,完善电商智能客服项目
本篇博客基于第 3 章博客基础上,引入视觉大模型 Vision-Language Model,支持图片文件上传和识别,第 3 章博客地址:https://blog.csdn.net/BiandanLoveyou/article/details/161004907
杀生丸学AI
4 个月前
数码相机
·
aigc
·
扩散模型
·
图像编辑
·
视觉大模型
·
点云分割
【动态重建】SparseCam4D:基于稀疏相机实现时空一致的4D重建技术
SparseCam4D: Spatio-Temporally Consistent 4D Reconstruction from Sparse Cameras 项目主页: 浙大CAD;InSpatio Research
杀生丸学AI
4 个月前
3d
·
aigc
·
扩散模型
·
视觉大模型
·
点云分割
·
高斯泼溅
·
空间智能
【三维重建】Neural Gabor Splatting:基于神经Gabor的增强型3DGS(高频表面重建)
Neural Gabor Splatting: Enhanced Gaussian Splatting with Neural Gabor for High-frequency Surface Reconstruction 来源: 东京大学
深兰科技
5 个月前
人工智能
·
django
·
fastapi
·
pygame
·
httpx
·
视觉大模型
·
深兰科技
深兰科技与宝武集团旗下钢友汇达成国际市场合作,俄罗斯、巴西、阿根廷市场同步推进
2026年4月14日,深兰人工智能科技(上海)股份有限公司与宝武集团旗下上海钢友汇企业发展有限公司在上海张江总部举行国际市场合作签约仪式。双方将围绕俄罗斯、巴西、阿根廷等重点区域市场展开合作,共同推进具身智能及智能装备产品在海外市场的落地应用。此次签约,标志着深兰科技在国际市场拓展方面进一步加速,也为人工智能技术在多区域、多场景中的规模化应用拓展了新的空间。
大数据AI人工智能培训专家培训讲师叶梓
5 个月前
人工智能
·
计算机视觉
·
大模型
·
医疗
·
ct
·
视觉大模型
·
医疗人工智能
Merlin:面向腹部 CT 的三维视觉语言基础模型
腹部 CT 年检查量巨大且放射科医师资源持续短缺,现有医学视觉语言模型多局限于二维图像与短文本处理,难以解析三维容积信息,且高度依赖人工标注,泛化能力与临床实用性不足。斯坦福大学研究团队提出Merlin,构建原生三维视觉语言模型,联合电子健康记录与放射报告进行无标注预训练,突破二维模型在三维医学影像理解中的局限,实现多任务自动化分析。
杀生丸学AI
6 个月前
3d
·
aigc
·
扩散模型
·
视觉大模型
·
世界模型
·
点云分割
·
高斯泼溅
【世界模型】WorldWarp:异步视频扩散的3D重建
标题:《WorldWarp: Propagating 3D Geometry with Asynchronous Video Diffusion》 项目:https://hyokong.github.io/worldwarp-page/ 来源:新加坡国立大学 ;香港理工大学
hhzz
6 个月前
人工智能
·
阿里
·
视觉大模型
·
wan
·
万相
【Vision人工智能设计 】Wan(万相) 内容创作平台与能力
⚡⚡⚡ 新年新文⚡⚡⚡万相网址:https://tongyi.aliyun.com/wan/explore
hhzz
7 个月前
人工智能
·
comfyui
·
视觉大模型
·
wan
【Vision人工智能设计 】ComfyUI 基础文生图设计
⚡⚡⚡ 新年新文⚡⚡⚡本文主要内容是在 ComfyUI 中构建文本生成图像(文生图)工作流的方法,并学习如何通过提示词(Prompt)控制生成图像的风格;如何在 ComfyUI 中将生成的图片高清放大;如何运用模板设计结合 ComfyUI 生成精美海报;ComfyUI 工作流中 LoRA 风格化小模型的使用。
hhzz
7 个月前
人工智能
·
flux
·
comfyui
·
视觉大模型
·
lora模型
【Vision人工智能设计 】ComfyUI 基础图生图设计
⚡⚡⚡ 新年新文⚡⚡⚡本节通过加载图像节点与VAE编码节点实现图像风格转换,重点讲解如何将文生图工作流改造为图生图流程。 内容包括添加图像加载节点、配置VAE编码器,以及使用Image Resize节点调整输出尺寸。 解析降噪参数的调节方法,以0.75–0.8的典型范围为例,说明如何在保留原图特征与生成新风格之间取得平衡,掌握将真实照片转化为 3D CG 风格图像的核心技术。
杀生丸学AI
7 个月前
aigc
·
扩散模型
·
视觉大模型
·
点云分割
·
lora微调
·
空间智能
【点云分割】SNAP:面向任意点云的任意分割
标题:《SNAP: Towards Segmenting Anything in Any Point Cloud》 项目:https://neu-vi.github.io/SNAP/ 来源:东北大学;The Mathworks
杀生丸学AI
7 个月前
aigc
·
三维重建
·
扩散模型
·
图像生成
·
视觉大模型
·
lora微调
·
空间智能
【三维生成】ShapeR:单目视频的条件三维形状生成
标题:《ShapeR: Robust Conditional 3D Shape Generation from Casual Captures》 项目:facebookresearch.github.io/ShapeR 来源:Meta Reality Labs Research;Simon Fraser University
昵称是6硬币
7 个月前
sam
·
三维重建
·
视觉大模型
·
sam3d
SAM3D论文精读(逐段解析)
论文地址:https://arxiv.org/abs/2511.166242025Meta 超级智能实验室
昵称是6硬币
7 个月前
sam
·
蒸馏
·
视觉大模型
·
mobilesam
MobileSAM论文精读(逐段解析)
faster segment anything: towards lightweight sam for mobile applications
昵称是6硬币
7 个月前
sam
·
视觉大模型
·
mobilesam
·
mobilesamv2
MobileSAMv2论文精读(逐段解析)
论文地址:https://arxiv.org/abs/2312.09579官仓地址:https://github.com/ChaoningZhang/MobileSAM
杀生丸学AI
9 个月前
人工智能
·
深度学习
·
3d
·
aigc
·
transformer
·
三维重建
·
视觉大模型
【无标题】VGGT4D:用于4D场景重建的视觉Transformer运动线索挖掘
标题:《VGGT4D: Mining Motion Cues in Visual Geometry Transformers for 4D Scene Reconstruction》 项目:https://3dagentworld.github. io/vggt4d/ 来源:香港科技大学(广州)2Horizon Robotics
昵称是6硬币
9 个月前
图像分割
·
sam
·
实例分割
·
视觉大模型
·
sam3
·
开放词汇检测
SAM3论文精读(逐段解析)
论文地址:https://arxiv.org/abs/2511.167192025Meta 超级智能实验室