星海智算:【萤火遛AI-Stable-Diffusion】无需部署一键启动

部署流程

1、注册算力云平台:星海智算

https://gpu.spacehpc.com/

2、创建实例,镜像请依次点击:"镜像市场"->"更换"->"AI绘画"->"萤火遛AI-Stable Diffusion"。

程序首次启动可能需要几分钟,待实例显示"运行中",即可通过点击 "应用WEB-UI" 在浏览器打开使用界面。

使用方法

文生图

文生图可使用文本提示词引导图片的生成。只需要选择生成图片所需要的Stable Diffusion基础模型,填写必要的文本提示词,选择图片参数(宽度、高度等),最后点击"生成",即可生成文本提示词相关的图片。

图生图

图生图可使用一张图片来引导生成新的图片。相比文生图,图生图需要使用一张参考图片,它同样可以使用提示词来引导对参考图片的重绘效果。图生图有多种生成模式,包括:基本的图生图、根据涂鸦重绘、局部重绘、局部重绘时可以使用涂鸦蒙版或者上传的蒙版。

高清化

高清化放大图片,让图片更加清晰。这个功能不需要Stable Diffusion基础模型的参与,只需要上传一张待高清化处理的图片,选择合适的放大方法、放大比例,为了让人物的形象更加和谐,可以选择两种修脸模型:GFPGAN可以尽量保持人物的面部特征,CodeFormer可以让人脸更协调,但是会偏离原始人物的特征。

图像信息

图像信息可以用来提取Stable Diffusion 生成图片中的参数信息,方便我们进行二次创作。

只需要上传一张Stable Diffusion生成的图片,就可以自动显示生成图片的参数,包括提示词、使用的模型等等,然后我们可以复制这些参数,用于自己的图片生成,也可以直接把这些参数发送到"文生图"、"图生图"、"高清化"等相关功能。

SadTalk

SadTalk是一个常用的数字人工具,可以让人物肖像图片说话。

SadTalk 不依赖Stable Diffusion基础模型,只需要上传一张人物肖像图片和声音文件,即可生成一个指定人物说话的视频。这个提供了一些参数,可以让视频中人物的形象更和谐稳定。

Infinite image browsing

生成图片浏览。通过这个功能,我们可以浏览历史生成的图片,方便管理它们。

相关推荐
计算机魔术师29 分钟前
Karpathy:用语音与LLM长谈可提升理解效率
人工智能·ai编程
甲维斯1 小时前
我要开始吹牛逼了!Kimi K3 “宇宙无敌”!
前端·人工智能
周末程序猿1 小时前
图解 120 个大语言模型(LLM)核心概念(61-90)
人工智能
科技圈快迅1 小时前
游戏投影仪和普通投影仪区别是什么?2026游戏投影仪测评
人工智能
陆枫Larry2 小时前
CPU 和 GPU 的核心区别与适用场景
人工智能
Aa99883342 小时前
AI视觉检测设备厂家的技术选型框架——密封件和磁材的缺陷分类与光学成像原理
人工智能
吴佳浩2 小时前
今天我们讲讲大模型的“核心”技术:蒸馏(Model Distillation)
人工智能·llm·agent
阿里云大数据AI技术2 小时前
阿里云 ES AI 引擎版:面向 Agent 场景,为亿级租户、千亿规模向量设计的搜索引擎
人工智能·elasticsearch·agent
郭小铭2 小时前
[开源] 做了一个本地优先的多 Agent 市场研究桌面:Evidence Loom
人工智能