楼主有许多PDF,几千个吧,要批量去掉PDF中的一些图片的水印
然后要将去掉水印的图片把PDF中原来的图片替换掉
想到的一个思路:
将PDF批量转换成docx,然后将docx重命名zip,再解压,图片都在里面了,处理并替换掉,然后再打包成zip,再变为docx格式,然后再转换为PDF
理论上可行,缺点就是速度很慢
另外分享我去水印的方法:
用python的pillow库,由于水印是打在图片上的纯文字水印,把水印的RGB值(其实是一个范围)提出来,批量替换掉就行了.
然后要将去掉水印的图片把PDF中原来的图片替换掉
想到的一个思路:
将PDF批量转换成docx,然后将docx重命名zip,再解压,图片都在里面了,处理并替换掉,然后再打包成zip,再变为docx格式,然后再转换为PDF
理论上可行,缺点就是速度很慢
另外分享我去水印的方法:
用python的pillow库,由于水印是打在图片上的纯文字水印,把水印的RGB值(其实是一个范围)提出来,批量替换掉就行了.