Stable diffusion 3.0

Esser P, Kulal S, Blattmann A, et al. Scaling rectified flow transformers for high-resolution image synthesisC//Forty-first International Conference on Machine Learning. 2024.

https://github.com/huggingface/diffusers/releases/tag/v0.29.0

https://huggingface.co/stabilityai/stable-diffusion-3-medium-diffusers

https://huggingface.co/docs/diffusers/main/en/api/pipelines/stable_diffusion/stable_diffusion_3

实验过程

  1. 安装依赖:

    bash 复制代码
    pip install -U diffusers
    pip install transformers
    pip install sentencepiece
  2. 在 huggingface 上申请 SD3 并创建 Token,然后在终端进行登录:

  3. 随后就可以使用 demo 进行推理,第一次下载模型较慢,以后每次调用可以直接加载模型进行推理:

    需要注意的是,预训练模型会下载到 cache 文件夹下,如果想要更改位置,可以提前设置 HF_HOMEHUGGINFACE_HUB_CACHE 环境变量 [1](#1)

实验结果

a photo of an astronaut riding a horse on mars:

a photo of a Lamborghini racing on the track:

a photo of the night scenery of Chongqing:

a photo of the Great Wall:

A poster of Ferrari:

A wallpaper of NBA stars:


  1. Diffusers ↩︎
相关推荐
杀生丸学AI2 天前
【动态重建】Flow4DGS-SLAM:基于光流引导的4DGS-SLAM算法
人工智能·三维重建·扩散模型·4dgs·动态重建
这张生成的图像能检测吗3 天前
(论文速读)Scaling Rectified Flow Transformers:Rectified Flow + MM-DiT 的高分辨率文生图路线
大模型·文生图·多模态·扩散模型·图像生成
月疯9 天前
Stable Diffusion是如何生成视频
人工智能·stable diffusion
thesky12345616 天前
27届大模型面试准备(四十六):多模态生成式架构——扩散与自回归的统一
大模型·文生图·diffusion·扩散模型·dit·自回归生成·多模态生成
Eric.4617 天前
2026 AI 漫剧叙事可控性深度工程:解决逻辑崩坏、镜头错乱、道具漂移的高阶落地方案
人工智能·stable diffusion·comfyui·ai漫剧
Eric.4618 天前
用 Stable Diffusion 做 AI 漫剧:从静态分镜到动态漫视频的完整工程链路
人工智能·深度学习·stable diffusion·音视频·ai漫剧
杀生丸学AI18 天前
【三维重建】QuerySplat:在 3DGS 预测中解耦几何与外观表征
人工智能·3d·三维重建·扩散模型·高斯泼溅·空间智能·室内重建
Eric.4619 天前
AI漫剧量产Prompt参数实操手册:Stable Diffusion+ComfyUI+OpenClaw通用复制即用配置
人工智能·深度学习·stable diffusion·prompt·ai漫剧
Eric.4619 天前
OpenClaw 结合 Stable Diffusion 与 ComfyUI 实现本地离线 AI 漫剧全自动流水线|批量渲染、人设一致性、帧闪烁问题工程实践
人工智能·stable diffusion·comfyui·ai漫剧
白拾19 天前
【arXiv 2026】GenCeption:视频生成模型是通用视觉学习者|从生成式视觉预训练范式视角
扩散模型·前馈模型·arxiv 2026·genception 论文分享·视频生成预训练·通用视觉感知