stable-zero123模型构建指南

一、介绍

stabilityai出品,能够对有简单背景的物体进行三维视角图片的生成,简单来说也就是通过调整变换观察的视角生成对应视角的图片。

本项目通过comfyui实现。

二、容器构建说明

1. 部署ComfyUI

(1)使用命令克隆ComfyUI

复制代码
git clone https://github.com/comfyanonymous/ComfyUI.git
cd ComfyUI

(2)安装 conda(如已安装则跳过)

下面需要使用 Anaconda 或 Mimiconda 创建虚拟环境,可以输入 conda --version 进行检查。下面是 Mimiconda 的安装过程:

按 Enter 键查看许可证条款,阅读完毕后输入 yes 接受条款,安装完成后,脚本会询问是否初始化 conda 环境,输入 yes 并按 Enter 键。

  • 运行 source ~/.bashrc 命令激活 conda 环境
  • 再次输入 conda --version 命令来验证是否安装成功,如果出现类似 conda 4.10.3 这样的输出就成功了。

(3)创建虚拟环境

输入下面的命令:

复制代码
conda create -n comfyui python=3.10
conda activate comfyui

(4)安装pytorch

复制代码
pip install torch torchvision torchaudio --extra-index-url https://download.pytorch.org/whl/cu121

(5)安装项目依赖

复制代码
pip install -r requirements.txt

此时所需环境就已经搭建完成,通过下面命令进行启动:

复制代码
python main.py

访问网址得到类似下图界面即表示成功启动:

2. 下载zero123模型

(1)下载模型

访问 Hugging Face 搜索"stabilityai/stable-zero123"下载模型。首次访问该页面时,可能需要同意用户协议才能看到模型下载页。

模型:

将模型下载到 ComfyUI/models/checkpoint

(2)下载工作流

进入"3D 示例 |ComfyUI_examples (comfyanonymous.github.io)"需下载图中包含工作流的图片,放置到/comfyui_workflow文件中。

重新启动模型将工作流导入即可:

3. 拓展插件安装(可选)

(1)下载manager管理器

manager 是一个用来加强ComfyUI可用性的扩展,提供了对ComfyUI各种自定义节点的安装、删除、禁用、启用等管理功能。同时还提供了中心功能和便利功能,用来访问 ComfyUI 中各种信息。

复制代码
cd /ComfyUI/custom_nodes
git clone https://github.com/ltdrdata/ComfyUI-Manager.git

成功安装之后重启界面会出现一个"Manager"如图:

(2)界面汉化插件
复制代码
git clone https://github.com/AIGODLIKE/AIGODLIKE-ComfyUI-Translation.git

下载文件之后需要重新启动,重启模型之后:

设置一次之后可点击图中框选出的选项进行语言的切换:

(3)中文提示词插件安装
复制代码
cd /ComfyUI/custom_nodes
git clone https://github.com/thisjam/comfyui-sixgod_prompt.git

然后重启ComfyUI后看到下图的小标志就表示可以了:

使用方法:双击页面,在搜索框中搜索"six"即可出现,点击sixGodPrompts,此时出现的就是提示词的中文输入框可以替代自带的clip输入框,可点击左下角的小标或按"AIT"+"q"打开和隐藏。

使用方法如下:

相关推荐
余俊晖43 分钟前
一套针对金融领域多模态问答的自适应多层级RAG框架-VeritasFi
人工智能·金融·rag
码农阿树1 小时前
视频解析转换耗时—OpenCV优化摸索路
人工智能·opencv·音视频
伏小白白白2 小时前
【论文精度-2】求解车辆路径问题的神经组合优化算法:综合展望(Yubin Xiao,2025)
人工智能·算法·机器学习
应用市场2 小时前
OpenCV编程入门:从零开始的计算机视觉之旅
人工智能·opencv·计算机视觉
星域智链2 小时前
宠物智能用品:当毛孩子遇上 AI,是便利还是过度?
人工智能·科技·学习·宠物
程序员X小鹿3 小时前
谷歌又出黑科技:支持图文混排的AI创意画布来了!1个想法,3秒出图,免费可用!(附教程)
aigc
taxunjishu3 小时前
DeviceNet 转 MODBUS TCP罗克韦尔 ControlLogix PLC 与上位机在汽车零部件涂装生产线漆膜厚度精准控制的通讯配置案例
人工智能·区块链·工业物联网·工业自动化·总线协议
说私域3 小时前
基于多模态AI技术的传统行业智能化升级路径研究——以开源AI大模型、AI智能名片与S2B2C商城小程序为例
人工智能·小程序·开源
万里鹏程转瞬至3 小时前
开源项目分析:wan2.1 VACE 关键设计与实现代码解读
论文阅读·aigc
囚生CY3 小时前
【速写】优化的深度与广度(Adam & Moun)
人工智能·python·算法