葛雷新 发表于 2026-8-5 09:22

想问下MINIMAX文生视频,或者图生视频,单次能生成长一点,比如10-15秒的视频嘛?另外如果想用多个视频拼接成一个视频,如何保证人物或场景的一致性?

七氷 发表于 2026-8-5 09:44

与天争锋_L 发表于 2026-8-5 08:43
巧了,我是64g内存+4080s应该能运行



要放模型大概需要至少几十G的空间

发呆的龙虾 发表于 2026-8-5 09:48

布置环境要几十个g,没流量好烦。

—— 来自 HUAWEI HOP-AL10, Android 16, 鹅球 v4.0-alpha

pointer243 发表于 2026-8-5 09:49

昨天跑了几个18x视频,发现模型对语言识别还是有不少问题。做的一个亲吻起飞视频结果从嘴里吐了一堆。。。

—— 来自 motorola edge 2025, Android 16, 鹅球 v3.5.99

tonyunreal 发表于 2026-8-5 10:24

葛雷新 发表于 2026-8-5 09:22
想问下MINIMAX文生视频,或者图生视频,单次能生成长一点,比如10-15秒的视频嘛?另外如果想用多个视频拼接 ...

模型本身就支持5-15秒,似乎也有人硬上25秒的

人物角色和场景最好是做好图片给它做参考图

发呆的龙虾 发表于 2026-8-5 12:46

果然还是不行,部署完开始跑,卡0%完全不动。

—— 来自 HUAWEI TET-AN00, Android 12, 鹅球 v4.0-alpha

龙骑士尹志平 发表于 2026-8-5 12:47

喷了,完全无甲,5060ti跑个5s的768*384视频才100多秒,以后全是以后av的a就是ai的a了

dualist 发表于 2026-8-5 13:41

葛雷新 发表于 2026-8-5 09:22
想问下MINIMAX文生视频,或者图生视频,单次能生成长一点,比如10-15秒的视频嘛?另外如果想用多个视频拼接 ...

H3最长15,拿4090D我都跑了15s 0.4 10分钟就能出,一致性只能多参里头把角色参考图带进去吧

noneoneone 发表于 2026-8-5 14:28

noneoneone 发表于 2026-8-4 13:20
不知道为什么,图生视频3秒内正常,设置成4秒就运行一半黑屏了。
5070TI 16G+32G内存。 ...

测试下来,问题是sage attention,关掉就不会黑屏,也没看见别人说有类似问题啊,好怪。

爱吃冻鳗的猫 发表于 2026-8-5 14:46

哈哈,挺好,越来越觉得买的显卡值得。

大暴死 发表于 2026-8-5 14:58

结合之前9.9元的Google ai pro,今天让哈基米给我写了个调用Google api,遵循minimax h3官方prompt guide的prompt和reference image生成自建节点,r2v场景下还能分析上传的图片/音视频文件然后调整prompt。晚上回家后试试成色


—— 来自 Xiaomi 25019PNF3C, Android 16, 鹅球 v3.5.99

大暴死 发表于 2026-8-5 14:59

noneoneone 发表于 2026-8-5 14:28
测试下来,问题是sage attention,关掉就不会黑屏,也没看见别人说有类似问题啊,好怪。 ...

是不是sage attention下的版本不匹配啊

—— 来自 Xiaomi 25019PNF3C, Android 16, 鹅球 v3.5.99

tonyunreal 发表于 2026-8-5 15:09

Spectrum试过了,能提速1/3左右,代价是提示词遵循度会稍微跑偏一点,随便写着玩的时候倒不是坏事

两天没看,autodl.art上冒出五个现成可部署的H3应用,看来很受欢迎

TuzDoDez 发表于 2026-8-5 15:49

测试完毕,RTX A6000,comfyui官方int8量化模型,comfyui官方工作流,1080p视频5s大概10分钟出,768p视频5s大概三四分钟,1080p 15s就要一个多小时了。
效果相当不错。

noneoneone 发表于 2026-8-5 15:50

本帖最后由 noneoneone 于 2026-8-5 15:52 编辑

大暴死 发表于 08-05 14:59
是不是sage attention下的版本不匹配啊

—— 来自 Xiaomi 25019PNF3C, Android 16, 鹅球 v3.5.99


我用的sa是2.2.0.post6,已经是最新的了,而且明确支持cu130。
让ai帮我换成sa3,再加上--reserve-vram 2能跑更长一些,但超过6秒还是会黑屏。
不用sa的话用时会x1.5,但输出视频时间能拉到15秒。

——来自 2410DPN6CC 上的 S1er 客户端

贝恩德塔 发表于 2026-8-5 15:51

确实相当于seedance2或者omini flash的水准

zerona 发表于 2026-8-5 15:52

Dunphy 发表于 2026-8-5 07:21
Anime-style cinematic character film. The character fromin the original
   scene: a dystopian c ...

谢了。我试试去

魔法师lain 发表于 2026-8-5 15:54

虚拟机直通的显卡是a3000 12g,内存需要多少?整机虽然有96g内存,但还有其他虚拟机,无法给太多。

—— 来自 HUAWEI ALT-AL10, Android 12, 鹅球 v3.5.99

hugosol 发表于 2026-8-5 17:19

4070S 12G显存,32G内存可以跑,不过跑的时候显卡都在冒烟,好像可以用SageAttention再优化一下,但是最近没什么时间继续折腾了
comfyui好像可玩性很高的样子,以后都在个人电脑上生成了,想想就很激动

big9999 发表于 2026-8-5 17:38

claymorep 发表于 2026-8-3 14:49
一开始是自己整黄文,然后是黄图,现在终于是小电影了

—— 来自 鹅球 v3.5.99-alpha ...

可以文生图,图生电影,宅宅的好日子还在后面呢

爱吃冻鳗的猫 发表于 2026-8-5 19:03

tonyunreal 发表于 2026-8-3 14:41
国内:
https://modelscope.cn/models/Comfy-Org/MiniMax-H3/



打开第一个链接,好大,最大60G,最小20G,是不是挑一个下就行?

dreamquest 发表于 2026-8-5 19:11

有没有那种可以解压即用的哇,配置comful总是不成功

hugosol 发表于 2026-8-5 19:18

建议装个agent再给deepSeek充3块钱让它帮你装,要看硬件下载不同的依赖包太麻烦了,现在DeepSeekV4fast的能力可以完美解决这类问题

tonyunreal 发表于 2026-8-5 20:20

爱吃冻鳗的猫 发表于 2026-8-5 19:03
打开第一个链接,好大,最大60G,最小20G,是不是挑一个下就行?

17楼解释过了

如果需要多模态输入(角色图,音频,视频)要下fl2va


—— 来自 Xiaomi 25060RK16C, Android 16, 鹅球 v3.5.99

Onelooker 发表于 2026-8-5 20:35

nsfw首帧提示词可以让grok写, 本身就支持多模态
以前只知道grok宽松, 今天用了一下简直是银魔我艹了

聊nsy专用号 发表于 2026-8-6 00:05

龙骑士尹志平 发表于 2026-8-5 12:47
喷了,完全无甲,5060ti跑个5s的768*384视频才100多秒,以后全是以后av的a就是ai的a了 ...

淫商不够 能不能指点一下这个模型能拿来干什么 试着让漫画自动生成动画还是有点抽象

qwased 发表于 2026-8-6 04:50

让DS给我折腾了下,他装了个te speed节点,768x480 5秒的视频生成只要100秒了

requiem116 发表于 2026-8-6 10:50

4090能跑吗,24g是不是小了点

Synopses6087 发表于 2026-8-6 11:10

就像哔哩哔哩+咕咕嘎嘎、抖音+短剧一样,释放 Ai 涩涩视频的生产力需要一个有推荐算法的 R18 视频平台

zerona 发表于 2026-8-6 11:42

qwased 发表于 2026-8-6 04:50
让DS给我折腾了下,他装了个te speed节点,768x480 5秒的视频生成只要100秒了

求个工作流啊。这速度羡慕

qwased 发表于 2026-8-6 12:32

zerona 发表于 2026-8-6 11:42
求个工作流啊。这速度羡慕

TE-speed-minimaxH3 加速高达45%
https://pan.quark.cn/s/9c37b6c9a778

TE MAN 首个为 ComfyUI 打造的漫剧 / 增强使用 / 生图生视频插件,为ComfyUI带来无限画布的功能特性
github:https://github.com/tl2012tl/TE_MAN

ComfyUI TE启动器
https://pan.quark.cn/s/228999e7c788
谢谢支持.


应该是这个

c12hero 发表于 2026-8-6 19:35

请问有啥办法可以搞个本地部署的AI,让它把写好的小黄文片段或者章节转换成视频脚本,最后翻译成脚本提示词范式?

zyj174 发表于 2026-8-7 12:23

有A卡也能玩的整合包吗?

—— 来自 OPPO PCKM00, Android 10, 鹅球 v3.5.99

吴怀在 发表于 2026-8-7 12:25

字节的 SEEDANCE 研发才 10 个人啊。视频模型比大语言模型需要的资源要少
以后估计就加加部署,随便跑涩涩

唯登诗树 发表于 2026-8-7 19:34

下午发现动作不怎么行,然后就在c站发现了狂暴输出Lora

大暴死 发表于 2026-8-7 19:44

有人基于larry大佬的4-step turbo lora改了个适配pruned模型的,昨天我试了一下,5070ti+64g ddr4,0.7mp分辨率8秒FL2VA,280秒左右生成,效果看不出劣化,感觉不错

—— 来自 Xiaomi 25019PNF3C, Android 16, 鹅球 v3.5.99

zktz 发表于 2026-8-7 23:28

我用 3090 显卡怎么最大只能 480p 啊,5 秒就要 7 分钟10 秒钟要 14 分钟 15 秒 要 21 分钟.480P 还容易电脑重启,再低一档才稳定。不过其实效果挺好的,就是输出带中文字还是有点乱。

处男鉴黄师 发表于 2026-8-8 00:00

zktz 发表于 2026-8-7 23:28
我用 3090 显卡怎么最大只能 480p 啊,5 秒就要 7 分钟10 秒钟要 14 分钟 15 秒 要 21 分钟.480P 还容易 ...

更新comfyui、cuda13、torch cu130,开启dynamic vram

处男鉴黄师 发表于 2026-8-8 00:01

大暴死 发表于 2026-8-7 19:44
有人基于larry大佬的4-step turbo lora改了个适配pruned模型的,昨天我试了一下,5070ti+64g ddr4,0.7mp分 ...

lightx2v的加速lora也推出v0.1了,虽然只是早期版本但还是有效果的

希德尼娅 发表于 2026-8-8 10:36

dreamquest 发表于 2026-8-5 19:11
有没有那种可以解压即用的哇,配置comful总是不成功

配置啥?不是官方.30版本自带模板嘛,把权重拷进去就能玩了
页: 1 2 3 4 [5] 6 7
查看完整版本: 新的亚空间打击,MiniMax H3视频模型今日开放下载