手上有一堆PDF漫画,该怎么批量导出图片?
本帖最后由 Unlight 于 2026-7-29 13:56 编辑用PDFPatcher能快速导出,但是出来图片顺序是错的。
用伪在线的网页端转换器能正常转换,但是有时会有容量限制。
大概两百多本吧,肯定得批量处理了,不然累死
试了几个Python的都不太行。可能我这边环境欠佳,毕竟平时用mpv,可能光改变量还不够。
搞个ai agent试试? WPS带的PDF转换可以批量转图片,就是可能要会员,不过也就几块钱吧 https://github.com/pdfcpu/pdfcpu 本帖最后由 暗影将军爱德华 于 2026-7-29 18:55 编辑
啥名字的,如果是别人自制的那种PDF,大概率能找到图片压缩包原档(自制PDF大概率会缩画质); PDFsam试试 福昕PDF Editor 随手让ai写了个,测试没有问题,先pip install PyMuPDF,改下路径直接执行就行。这都2026了,代码的问题不要问百度,问ai
import fitz
from pathlib import Path
pdf = fitz.open('example.pdf')
output_dir = Path('output_images')
output_dir.mkdir(exist_ok=True)
for page_num in range(len(pdf)):
# 获取页面中所有图片
image_list = pdf.get_page_images(page_num)
for img_index, img in enumerate(image_list):
xref = img# 图片引用ID
pix = fitz.Pixmap(pdf, xref)
# 如果图片有透明通道,转换一下
if pix.n - pix.alpha < 4:
pix = fitz.Pixmap(fitz.csRGB, pix)
pix.save(output_dir / f'page_{page_num+1}_img_{img_index+1}.png')
print(f'已提取第 {page_num+1} 页的图片')
pdf.close() 楼上正解,问d指导看看有没有自己搓轮子的好办法 本帖最后由 Unlight 于 2026-7-29 16:30 编辑
木谷高明 发表于 2026-7-29 16:24
楼上正解,问d指导看看有没有自己搓轮子的好办法
我上午就是跟D指导搏斗来着,用的pdfimages,然后出来的乱码标题,还是在根目录下(搞笑的是,独立文件夹生成了,但图片没放进去)。跟D指导讨论了半天,还那样。
当时给的应该是这个:
for %i in (*.pdf) do (mkdir "%~ni" 2>nul & pdfimages -png "%~ni.pdf" "%~ni\page")
—— 来自 S1Fun Unlight 发表于 2026-7-29 16:28
我上午就是跟D指导搏斗来着,用的pdfimages,然后出来的乱码标题,还是在根目录下(搞笑的是,独立文件夹 ...
不要用pdfimages,你要的是提取图片,而不是把pdf每一页转换成图片。
另外windows下面调用开源软件出现中文乱码在正常不过了 怎么还要编程的,photoshop打开直接存 本帖最后由 慕容断月 于 2026-7-29 18:23 编辑
一个简单的办法是让ai写个利用calibre(名字估计打错了)调用pdf转换工具来批量转,连解压后重命名的工序都可以纳入流程
之前买的不少文苑堂的书都是pdf格式,就是写了个脚本做这些事的 WPS充个会员,有PDF提取图片的功能。 通过网盘分享的文件:pdf2img-13.7z
链接: https://pan.baidu.com/s/1Fr8mi41PszT8dAONt5FsJg 提取码: is4x
这个应该可以用
你这些就是类似闲鱼上那些漫画pdf吧,
PDF Image Extraction Wizard V6.0 绿色汉化版
我用的这个,感觉还行。 https://mineru.net/要不看看这个? 丢给 agent 干,非常爽 要不试试office?
不过我是没用过的,因为懒得登录,而且可能要付费
pdf 补丁丁啊,提取图像就行,很快的
—— 来自 Xiaomi 24129RT7CC, Android 16, 鹅球 v4.0-alpha https://gofile.io/d/qqsmr7
去吧,这玩意就是专门针对你这个需求,几千本本韩漫pdf都用这个批量转回jpg
而且提取出来的jpg的md5是不变的 汝者 发表于 2026-7-30 14:12
https://gofile.io/d/qqsmr7
去吧,这玩意就是专门针对你这个需求,几千本本韩漫pdf都用这个批量转回jpg
图都对,顺序是乱的邪了门了 好像找到解决办法了,先用Calibre把pdf转一下pdf,然后再用那些快速提取工具就可以了 https://www.pdf24.org/zh/
我用的这个,能批量提取图片,也可以转成图片 还不如删了直接下PNG版随便转印象中PDF和EPUB版一样都是二次以上有损加工甚至还有水印片源也不好 pdf除了那些原生电子版外基本没必要留和转换,大部分都是贩子的二手产物 Xenor 发表于 2026-7-30 19:04
还不如删了直接下PNG版随便转印象中PDF和EPUB版一样都是二次以上有损加工甚至还有水印片源也不好 ...
自己用原图png/jpg做无损pdf也是可以的,毕竟就一个文件干净清爽, 交给agent工具去干, 缺啥东西让他自己装
GMJ 发表于 2026-7-31 08:33
自己用原图png/jpg做无损pdf也是可以的,毕竟就一个文件干净清爽,
压成ZIP也可以冒充一个文件只要读取软件能支持就好(……为了清爽必须找支持的) Xenor 发表于 2026-7-31 11:54
压成ZIP也可以冒充一个文件只要读取软件能支持就好(……为了清爽必须找支持的) ...
但PDF可以预览第一页啊,在win上管理的时候感觉比看不到内容的ZIP舒服,制作的时候甚至可以把封面做成大图标的预览 本帖最后由 栗悟飯 于 2026-7-31 15:14 编辑
GMJ 发表于 2026-7-31 13:50
但PDF可以预览第一页啊,在win上管理的时候感觉比看不到内容的ZIP舒服,制作的时候甚至可以把封面做成大 ...
后缀改cbz就能看第一页
栗悟飯 发表于 2026-7-31 14:38
后缀改cbz就能看第一页
需要什么插件支持么?rar的中不中? Unlight 发表于 2026-7-30 18:39
好像找到解决办法了,先用Calibre把pdf转一下pdf,然后再用那些快速提取工具就可以了 ...
这不就是我说的办法嘛 GMJ 发表于 2026-7-31 15:16
需要什么插件支持么?rar的中不中?
rar改名cbr,有看图软件关联一下就行了 本帖最后由 Unlight 于 2026-8-1 22:58 编辑
慕容断月 发表于 2026-7-31 15:47
这不就是我说的办法嘛
跟有些epub有问题时,走sigil或者直接calibre自己的编辑器重构一遍就好了一样,估计是原始文档制作不规范 GMJ 发表于 2026-7-31 13:50
但PDF可以预览第一页啊,在win上管理的时候感觉比看不到内容的ZIP舒服,制作的时候甚至可以把封面做成大 ...
WIN确实只显示RAR的图标具体就不清楚了,要用安卓的话ZIP能显示第一页,正规扫本一般正好是封面COVER方面识别
https://img.remit.ee/api/file/BQACAgUAAyEGAASHRsPbAAEYVaNqbgW2tpblbDtleV1XcukUUoKKHgAChScAAh7GcVfLOqJUgoOL9D0E.jpg
页:
[1]