找回密码
 立即注册
搜索
查看: 11946|回复: 93

[欢乐] AI 本地文生图模型部署不完全指北

[复制链接]
     
发表于 2026-7-30 21:26 | 显示全部楼层 |阅读模式
本帖最后由 查内姆 于 2026-8-4 18:24 编辑

虽然现在AI很火爆,可我除了用AI查资料,帮忙给文档注水,也没不会用其它功能,后来玩上了文生图和酒馆觉得还挺有意思的,能打发一些时间(初步实现涩图自由),所以写个这个帖子分享一点很基础的心得。
做一点基础的本地文生图介绍,最基础最简单的搭建一套文生图环境,算是抛砖引玉

先说硬件要求:6G显存可以玩动漫风格的本地文生图模型,8G显存就可以玩真人风格的文生图模型。
(实际测试4060 8G显卡+32G内存,能跑minimax H3,生成5秒钟的536X736视频,大概需要6分多也可能更长,时间数据我没保存下来,实际效果还行,不过感觉还需要再等等,等各方都完善了再玩,现在也就是尝个鲜,没精力或不愿意折腾的还是等等吧,85楼有跑出来的视频可以看看)

先下载秋葉aaaki的整合包,
https://www.bilibili.com/opus/1159516886456598528,有个下载链接只需要下载其中的“ComfyUI-aki-v3.7z”这个压缩包就好,下载完成后解压,再运行里面的“绘世启动器.exe”,它会帮你安装缺少的环境,有问题问网页版的AI,我记得当初安装时好像没费什么事(可以看看这个https://www.bilibili.com/video/BV1Ew411776J 教程,只有几分钟而已)

秋葉aaaki的整合包在运行前要更新一下内核,主界面版本管理,点进去后更新成最新的内核

1、生成动漫图
然后需要需要下载模型,https://modelscope.cn/models/cir ... /master/split_files,这是个国内的网站所以不用翻墙,下载diffusion_models下的anima-base-v1.0.safetensors模型(4个多G大小),text_encoders和vae下面的文件(都是只有一个,不会下错)。然后把这些文件放到你电脑里 \ComfyUI-aki-v3\ComfyUI\models下面同名文件夹下面,比如从diffusion_models下的anima-base-v1.0.safetensors,就放到 \ComfyUI-aki-v3\ComfyUI\models\diffusion_models下

再打开ComfyUI后,左侧菜单栏有个“模板”,点开它,搜索 anima,会出现"Anima Base v1:文本到图像"这个结果,点一下就会导入一个工作流,这时可能会报错说缺少模型,看看缺少那个模型,手动改一下自己有的模型。
或者下载附件里的“Anima Base v1:文本到图像.json”工作流,然后在ComfyUI中按下ctrl+o,会打开一个窗口, 选择这个附件导入就可以了


2、真人模型推荐Krea-2,另外这个也可以用来生成动漫图
https://modelscope.cn/models/Comfy-Org/Krea-2/tree/master/下载diffusion_models下面的krea2_turbo_int8_convrot.safetensors模型。然后是text_encoders下的qwen3vl_4b_fp8_scaled.safetensors模型,这个尺寸小资源消耗小一些。vae下的qwen_image_vae.safetensors模型,跟上面anima的方式一样,放到自己ComfyUI文件夹下同样的位置。
工作流见附件,下载附件这个▶▶Krea 2-文生图工作流.json,然后在ComfyUI中按下ctrl+o,会打开一个窗口, 选择这个附件导入就会有个krea2的工作流(用B站一个UP黑鹤001的工作流删减来的)

3、提示词,anima模型只认英文提示词,krea 2可以识别中文提示词,不过据说英文提示词更准确。
另外如果能翻墙,那可以去https://civitai.red/这个网站找图,一般都带着对应的提示词(模型和lora也可以在这里找)
还有一个办法,让KIMI或DS网页版给你生成提示词,告诉AI要什么养的场景人物动作服装,让它给你生成对应模型的提示词,当然NSFW自然是不行的(也许可以自己搭建一个本地qwen破限模型试试?)

4、NSFW,anima原生支持各自涩图生成(并且多人运动支持的也还行),而krea 2需要魔改模型,或者魔改的Lora才能支持,如果能翻墙还是去外网的模型社区下比较合适。

5、根据楼里网友回复,还有一个办法是交给AI工具,让它帮你安装缺失的环境,如果会用AI的可以这么搞更省事

6、如果能打开ComfyUI但是运行文生图时报错,查看工作流里的节点和模型是否齐全,或升级ComfyUI版本

最后,为什么推荐这两个模型?
主要是因为模型相对来说要求不高,下载下来自己试用一下,如果觉得文生图也就这样没什么可玩的,那也没有浪费多少时间。
要是觉得还行,那就自己上网学习更多的折腾方式(我现在其实连工作流都不会搭建)

以下都是我用本地模型生成的图片,用的anima模型,NSFW的不方便放出来,所以只有这些







本帖子中包含更多资源

您需要 登录 才可以下载或查看,没有账号?立即注册

×

评分

参与人数 4战斗力 +6 收起 理由
与天争锋_L + 1 好评加鹅
猫出没注意 + 2 好评加鹅
tbone + 2 好评加鹅
ads147147 + 1 好评加鹅

查看全部评分

回复

使用道具 举报

     
发表于 2026-7-30 21:38 | 显示全部楼层
我这个人经验有个啥也不懂的傻瓜式玩法。不用秋叶包,直接去github上下最新的comfyui,解压后启动,随便找个别人的工作流拖进去,这时候肯定会提示缺少节点包和模型,缺什么模型就下什么模型。然后随便找个ai工具,codex、反重力啥的都行,打开comfyui的路径,告诉ai缺什么包让它自动装好,然后重新启动comfyui就可以玩了。
回复

使用道具 举报

     
 楼主| 发表于 2026-7-30 21:42 | 显示全部楼层
再啰嗦两句酒馆SillyTavern
所谓的酒馆其实就是让AI和你一起编故事,玩家扮演主角同时控制故事走向(也有由AI控制走向的卡)。通常是会使用编好的世界书和人物卡导入酒馆SillyTavern中,玩家编写简要情节然后由AI进行扩写,AI有时候会替故事中的人物写反应和对话,比如玩家写“霸总把女主拦住,盯着她看了半分钟,然后问她到底想做什么”。AI会把这段话扩写成几百字乃至上千字的小说章节,编写两人的对话和肢体动作,最后替女主进行回答。

玩这个需要准备一个API,到DS官网买10块钱的可以先试试手,或者硅基流动上有注册送额度的活动(不知道现在还有么有了)。
我因为之前安装过一堆乱七八糟的环境,所以使用部署酒馆时没有遇到什么困难。但是今天别人提醒酒馆安装可能会很麻烦,所以不讲解具体步骤了,没有实际意义。
在网上找找教程吧。

另外酒馆要是想玩的好一点,需要预设、世界书、酒馆助手插件、酒馆提示词插件等等,还基本都**,我回忆了一下还是挺麻烦的,所以以上这一大堆也就是告诉没玩过酒馆,酒馆大概是个什么

最后可以下载个OpenCode,在对话框里输入https://github.com/ai4rpg/tavern-cards,然后对 AI 说:"给我克隆这个github项目,按照README.md安装skill"
等OpenCode安装好了后重启OpenCode,再打开后跟它说根据tavern-cards skill生成世界书,它就开始引导你提供信息,然后生成一个酒馆的世界书
回复

使用道具 举报

     
发表于 2026-7-30 21:57 来自手机 | 显示全部楼层
ななひら 发表于 2026-7-30 21:38
我这个人经验有个啥也不懂的傻瓜式玩法。不用秋叶包,直接去github上下最新的comfyui,解压后启动,随便找 ...

我还真是这样做的
让agent帮我配置comfyui,优化工作流
那个整合包有点太臃肿了
回复

使用道具 举报

     
发表于 2026-7-30 21:58 来自手机 | 显示全部楼层
之前研究过一阵,发现图老是有大块不明色块,研究了半天也不知道如何解决,再加上目前只有个笔记本配置也不行,遂放弃

—— 来自 鹅球 v3.3.96
回复

使用道具 举报

     
发表于 2026-7-30 22:00 | 显示全部楼层
秋叶不行了吧,换其他的整合包吧,会快很多
回复

使用道具 举报

     
发表于 2026-7-30 22:45 | 显示全部楼层
我让 GPT 生成了一个人物的各种图,然后拿去炼丹,z-image 和 krea2 都炼了个 lora,结果感觉 z-image 人物更还原,也更能遵循指令,krea2 就一般。另外我 16G 显存用 z-image turbo 没问题,用 krea2 int8 还是一直爆显存,可能需要用 bf8。
回复

使用道具 举报

     
发表于 2026-7-30 22:57 | 显示全部楼层
julia黑 发表于 2026-7-30 22:45
我让 GPT 生成了一个人物的各种图,然后拿去炼丹,z-image 和 krea2 都炼了个 lora,结果感觉 z-image 人物 ...

我12g显存48g内存用krea2 turbo fp8都没问题,但是一加lora就显示爆显存。
后面查了一下是cuda和troch没升级导致的,你可以看看是不是这个原因
回复

使用道具 举报

     
发表于 2026-7-30 23:01 来自手机 | 显示全部楼层
酒馆用起来感觉有点不方便,也很老旧了
这么久了有没有人开发新的更好用的工具?

—— 来自 vivo V2454A, Android 16, 鹅球 v3.5.99
回复

使用道具 举报

     
发表于 2026-7-30 23:24 | 显示全部楼层
逆转纹章 发表于 2026-7-30 22:57
我12g显存48g内存用krea2 turbo fp8都没问题,但是一加lora就显示爆显存。
后面查了一下是cuda和troch没升 ...

krea2 lora爆显存可以试着启动项 --enable-dynamic-vram
回复

使用道具 举报

     
 楼主| 发表于 2026-7-31 00:03 | 显示全部楼层
我感觉还是krea 2的更遵循指令一些,而且多人运动时也更准确一点,不过多人运动就需要使用魔改版,倒是不能完全说明问题

本帖子中包含更多资源

您需要 登录 才可以下载或查看,没有账号?立即注册

×
回复

使用道具 举报

     
发表于 2026-7-31 00:33 | 显示全部楼层
anima这个跑起来显存要多少?8?
回复

使用道具 举报

     
发表于 2026-7-31 01:20 来自手机 | 显示全部楼层
罐子 发表于 2026-7-30 23:01
酒馆用起来感觉有点不方便,也很老旧了
这么久了有没有人开发新的更好用的工具?

我让Claude(谢谢大善人any)写了个跑团的,还有个写文的网页小软件
正在推进中写作的基本好了。
但是……现在感觉grok太牛逼了,在刘备方面一骑绝尘,我都不想弄了

—— 来自 HUAWEI ALN-AL10, Android 12, 鹅球 v3.5.99
回复

使用道具 举报

发表于 2026-7-31 05:52 来自手机 | 显示全部楼层
本帖最后由 pointer243 于 2026-7-31 05:55 编辑

秋叶的包感觉启动时间比直接git的包启动久,可能是要验证一堆东西。反正我是推荐找GitHub下本体,然后可以抄工作流或者根据comfy自带的anima,krea,qwen或者zimage模板工作流一样一样把缺失的模型,lora等等补全。要抄别人工作流的就一定要下个node manager,能够自动补齐大部分缺失的node

—— 来自 motorola edge 2025, Android 16, 鹅球 v3.5.99
回复

使用道具 举报

发表于 2026-7-31 05:57 | 显示全部楼层
krea2 的动作理解比 z-image 要强上非常多,唯一的问题就是吃显存。fp8 的就 12G,我的 3080 10G 跑本体还行,加上任何 lora 就直接爆显存,生成速度直接降到 15 分钟一张…
回复

使用道具 举报

发表于 2026-7-31 06:01 来自手机 | 显示全部楼层
引流一下隔壁屎黄色论坛的ai创作区吧,有时候有一些有关写词,姿势之类的问题都有人回答,有时候也能够借此迸发灵感

—— 来自 motorola edge 2025, Android 16, 鹅球 v3.5.99
回复

使用道具 举报

发表于 2026-7-31 06:01 | 显示全部楼层
逆转纹章 发表于 2026-7-30 22:57
我12g显存48g内存用krea2 turbo fp8都没问题,但是一加lora就显示爆显存。
后面查了一下是cuda和troch没升 ...

好的谢谢谢谢,我升级下试试,不加 lora 太痛苦了。
回复

使用道具 举报

     
发表于 2026-7-31 07:05 来自手机 | 显示全部楼层
我笔记本才6g显存,我只能对新模型看看了

论坛助手,iPad
回复

使用道具 举报

     
发表于 2026-7-31 07:24 | 显示全部楼层
学习成本还是要的,不过都能问ai,因为我图生视频什么的都用豆包,所以本地部署的什么问题我也都用豆包,google也行,不过**
想要本地涩涩小视频学习成本还是要不少的

本帖子中包含更多资源

您需要 登录 才可以下载或查看,没有账号?立即注册

×
回复

使用道具 举报

     
发表于 2026-7-31 07:31 | 显示全部楼层
学习,现在电脑显卡不行,只有2060s
回复

使用道具 举报

     
发表于 2026-7-31 07:38 | 显示全部楼层
我现在用的是SwarmUI,生成图还过得去吧,只不过我现在的显卡是5060(这还是去年底换的,更早只有1660s),不敢运行太大的模型。
回复

使用道具 举报

     
发表于 2026-7-31 08:32 | 显示全部楼层
我觉得现在comfyui官方桌面版反而对小白友好,几个朋友问我我推荐了他们都自己装完跑起来了,有人8G显存现在跑int4的krea2好的很,5060跑1080P分辨率直出30来秒
回复

使用道具 举报

     
发表于 2026-7-31 09:04 来自手机 | 显示全部楼层
找一个模型分块的节点接在采样器前能**加速跑大体积模型的速度
回复

使用道具 举报

     
发表于 2026-7-31 09:10 | 显示全部楼层
秋叶的整合包已经半年没维护了,如果是用5系显卡,用基于官方包的整合包(比如基于KK启动器的整合包)好一些。

我用的是这位做的:https://www.bilibili.com/video/BV1Q3M86dEvM/
回复

使用道具 举报

     
 楼主| 发表于 2026-7-31 11:52 | 显示全部楼层
本帖最后由 查内姆 于 2026-8-4 19:52 编辑

然后这里放一些krea 2模型生成的,有真人也有动漫风格

本帖子中包含更多资源

您需要 登录 才可以下载或查看,没有账号?立即注册

×
回复

使用道具 举报

     
发表于 2026-7-31 11:59 | 显示全部楼层
MACBOOK是不是玩不了本地部署
回复

使用道具 举报

     
发表于 2026-7-31 12:09 | 显示全部楼层
A卡怎么说,WIN下能跑不
占用空间多少,现在固态空间有点吃紧
回复

使用道具 举报

     
发表于 2026-7-31 13:21 | 显示全部楼层
爆显存的升级cuda那些试试,我8G显存用forgeneo玩krea2三十秒出图

int8是好东西出图快了质量没看出来下降
回复

使用道具 举报

     
发表于 2026-7-31 13:24 | 显示全部楼层
粉色猛男 发表于 2026-7-31 12:09
A卡怎么说,WIN下能跑不
占用空间多少,现在固态空间有点吃紧

a卡有人做适配跑是能跑但是比n麻烦,不知道问ai能不能解决这点

占用的话只用固定一两个模型的话不会很大的50g以内吧?多下几个模型就另说了像krea2十几G一个
回复

使用道具 举报

     
发表于 2026-7-31 14:24 | 显示全部楼层
借楼问一下,目前本地部署生成那种带中文文字(大量密集文字)的海报,用什么大模型比较好呢,至少要什么配置才能跑起来呢
回复

使用道具 举报

     
发表于 2026-7-31 14:37 | 显示全部楼层
哦豁,anima的工作流需要text encoder和Qwen-Image啊,和pony光辉什么的不太一样。是不是更智能啊?
但是Lora也太少了,各种性癖都不全啊。
回复

使用道具 举报

     
 楼主| 发表于 2026-7-31 14:43 | 显示全部楼层
jojog 发表于 2026-7-31 00:33
anima这个跑起来显存要多少?8?

6G应该都可以要求不高,这也是我为什么推荐新手用这是尝尝咸淡的原因
回复

使用道具 举报

     
发表于 2026-7-31 14:46 | 显示全部楼层
有没有什么工作流推荐
回复

使用道具 举报

     
发表于 2026-7-31 14:47 | 显示全部楼层
罐子 发表于 2026-7-30 23:01
酒馆用起来感觉有点不方便,也很老旧了
这么久了有没有人开发新的更好用的工具?

确实,感觉现在酒馆基本上就是在前端美化的路上狂奔,世界书和预设那套感觉越来越臃肿了,效果也基本上没有什么提升
回复

使用道具 举报

     
 楼主| 发表于 2026-7-31 14:49 | 显示全部楼层
粉色猛男 发表于 2026-7-31 12:09
A卡怎么说,WIN下能跑不
占用空间多少,现在固态空间有点吃紧

A卡听说不太行,然后如果只弄一个文生图模型,只用基本的工作流和lora等等,站的空间不大,二三十G应该足够,不过一般玩这个都是越整东西越多,占的空间越大。
回复

使用道具 举报

     
发表于 2026-7-31 15:03 来自手机 | 显示全部楼层
你们二次元生图能不能研究一下画风…二次元模型最大的优势都搞没了
以下全部是anima原生效果











本帖子中包含更多资源

您需要 登录 才可以下载或查看,没有账号?立即注册

×
回复

使用道具 举报

     
发表于 2026-7-31 15:13 | 显示全部楼层
C站上挺多好图的,也带了参数,直接拖入comfyui可以很方便的参考作业





本帖子中包含更多资源

您需要 登录 才可以下载或查看,没有账号?立即注册

×
回复

使用道具 举报

头像被屏蔽
     
发表于 2026-7-31 15:32 来自手机 | 显示全部楼层
提示: 作者被禁止或删除 内容自动屏蔽
回复

使用道具 举报

     
发表于 2026-7-31 19:05 | 显示全部楼层
说到画风就不得不提我的导师(我自己认的这位

我从玩AI图开始就在抄他,就是后来好像用自己的模型就抄不到了,虽然现在用anime但是不知道为啥还原不了
回复

使用道具 举报

发表于 2026-8-1 05:52 来自手机 | 显示全部楼层
不见不散 发表于 2026-7-31 15:32
之前本地部署Stable Diffusion,前面的本体下载、依赖下载都搞定了,就剩下最后一哆嗦启动不起来,把报错贴 ...

因为一开始stable diffusion就是基于cuda来运行的。我也是a卡一开始下的sd一跑就现实检测不到CUDA无法运行。后来好像是通过AMD pro的一个什么东西伪装成CUDA跑的。不过最后秋叶的整合包算是简化整合大部分东西,能够实现下载即用

—— 来自 motorola edge 2025, Android 16, 鹅球 v3.5.99
回复

使用道具 举报

您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

Archiver|手机版|小黑屋|上海互联网违法和不良信息举报中心|网上有害信息举报专区|962110 反电信诈骗|举报电话 021-62035905|Stage1st ( 沪ICP备13020230号-1|沪公网安备 31010702007642号 )

GMT+8, 2026-8-18 17:15 , Processed in 0.159780 second(s), 7 queries , Gzip On, Redis On.

Powered by Discuz! X3.5

© 2001-2026 Discuz! Team.

快速回复 返回顶部 返回列表