推荐 github 项目:GeminiImageApp(图片生成方向,可以做一定的素材)

推荐 github 项目:GeminiImageApp(图片生成方向,可以做一定的素材)

这个项目能干嘛?

使用 gemini 2.0 的 api 和 google 其他的 api 来做衍生处理

简化和优化了文生图和图生图的行为(我的最主要)

并且有一些目标检测和切割(我用不到)

视频和 imagefx 因为没 api,没试,原则上可以,

imagefx 在 imagefx 的官网免费,veo 免费一天 10 来次,可以使用其他国内视频 ai 替代

++重点!++

这个项目搭建需要梯子

本文详细视频讲解地址:

https://www.bilibili.com/video/BV1DyT9zqEvZ/?vd_source=67d6208fe3d9dfab2f35bd5205001cf0

体验地址:

备注:imagen3 和视频生成缺乏 api,无法使用

随时关闭的依旧搭建地址:(个人免费 api ,gemini 2.0 flash 一天只有 1500 次,每分钟 10 次,基本上同时多人使用要打挤,或者一天次数用超,家庭宽带 +cloudflare 的减速加持,连接缓慢)

https://geminiimageapp.fantacy.online/

这个只是体验一下功能做,你自行搭建是最佳选择

项目地址:

这个项目的 github 地址为 https://github.com/0xsline/GeminiImageApp

环境的安装:

python 环境(建议 3.10 以上) ,官网下载 https://www.python.org/downloads/

Node js 环境(直接装最新的稳定版本) 官网下载 https://nodejs.org/zh-cn

Git ,最好存在,方便后续更新

Google AI API Key (必需),gemini 2.0 的 api 每天免费 1500 次生成,需要 google 账号,

imagefx 和 veo 生成视频的 api 我没搞,首次免费 300 美元赠金,限期三个月,好像需要银行卡

如何部署?

github 的 readme 有点小错误,这里应该是

bash 复制代码
git clone https://github.com/0xsline/GeminiImageApp.git
cd GeminiImageApp

配置 api

复制环境变量模板

bash 复制代码
cp .env.example .env

修改,注意修改的是 GeminiImageApp 目录下的.env 文件,这个文件是需要你自己复制.env.example 出来的

GOOGLE_API_KEY=your_google_ai_api_key_here

GEMINI_API_KEY=your_google_ai_api_key_here

后端配置:

bash 复制代码
cd backend
pip install -r requirements.txt

如果 pip 安装不成功,依赖冲突?可以这样干

因为他指定了特定版本,但是你的 python 又安不上其中一些,那么就可以取消掉所有的版本,手动修改这个文件

然后重新安装即可

后端启动:

终端输入

bash 复制代码
Python ./run.py

前端配置和启动

bash 复制代码
#进入前端目录
cd frontend
#安装依赖
npm install
#启动开发服务器
npm run dev

启动成功,打开你的浏览器,输入

http://localhost:3000/

然后测试一下生成图片和图生图,ok,完工

如果前端页面打不开,把这里修改一下,然后重启

先加这个,然后继续

相关推荐
Goboy6 分钟前
多模态大模型已经能识别和描述视频,为什么仍然缺乏可靠的时序感知能力?
aigc·ai编程
烽火戏诸诸诸侯1 小时前
AI 让我的独门小工具焕发第二春
后端·ai编程·vibecoding
kyriewen2 小时前
Claude Code 的额度今天缩水了17%——官方公告上写的是"永久提高25%"
前端·ai编程·claude
dong_junshuai4 小时前
每天一个开源项目#99 OpenResearch:2.2K星的本地研究Agent工作台
开源·github·agent
程语AI5 小时前
RAG 分块策略实测:chunk\_size 和 overlap 怎么调,检索精度差多少
ai编程
峰向AI5 小时前
背单词太无聊?这个 23K Star 的工具让你边打字边背单词,两不耽误
github
ServBay5 小时前
xAI的 Grok Bot发布,AI 已经学会自己上班了
后端·ai编程·grok
OpenTiny社区5 小时前
码力全开,智启前端新生态|OpenTiny 登陆华为全联接大会2026
前端·github
m4Rk_6 小时前
【论文阅读】Agent 记忆机制(69):STITCH——用上下文意图解决“语义相关但情境错误”的记忆检索
论文阅读·人工智能·学习·开源·github
zzjyr6 小时前
AI 问答的流式响应是怎么实现的?从 fetch 到 SSE 逐字解析
前端·人工智能·ai编程