ubuntu pdf转jpg或txt

chenlei posted @ 2009年12月30日 17:22 in Linux , 6405 阅读

呵呵,刚刚在网上定购了一款mp5,后来才发现它不支持PDF!

没办法,只好查一下转换的方法,呵呵,

(1)PDF转JPG:

安装一个软件ImageMagick:

# sudo apt-get install imageMagick

然后就可以转换了,yes!!

# convert XXX.pdf XXX.jpg

样XXX.pdf 就转换成了一大堆的XXX-*.jpg,一页一张JPG。

如果想清晰些(实验中):

# convert -verbose -colorspace RGB -resize 1800 -interlace none -density 300 -quality 100 XXX.pdf XXX.jpg

(2)PDF转txt:

我们要用poppler来做,它是系统自带的,

呵呵,先加一个中文支持:

# sudo apt-get install poppler-data

嘻嘻,转换啦!!

# pdftotext -layout -nopgbrk XXX.pdf

因为pdftotext不支持同时处理多个 pdf,所以用批处理要脚本搞定,打开终端,进入放置 pdf 的目录,运行下面命令

find ./ -name '*.pdf' | while read i; do pdftotext -layout -nopgbrk $i; done

很快就在当前目录下输出很多 txt 文件,“-layout”参数表示保留页面布局,“-nopgbrk”表示不输出换行符,自己对比一下就知道区别了。

  • 无匹配
  • 无匹配
Avatar_small
lywdx 说:
2010年4月21日 22:17

有点慢阿!
把我的机器卡住了,(转换成jpg那个)

不过总比没有办法好,我在网上找了一大圈手机看pdf的软件,准备用手机看psf了,都是s40手机的,
看到这个还是小兴奋了一下下!

Avatar_small
lywdx 说:
2010年4月21日 22:31

不好使!!!!!!!!!!!!!

Avatar_small
lywdx 说:
2010年4月21日 22:37

事实证明:真的不好使~!
机器差点卡死了!

Avatar_small
chenlei 说:
2010年4月24日 23:00

哈哈,人品问题!
我的就好使啊,poppler只能转文字,如果PDF里有图片,那只有文字,没有图片。
呵呵,我这儿也有“事实”啊!

Avatar_small
jj 说:
2011年6月05日 16:21

如果是手工的那更方便了。


登录 *


loading captcha image...
(输入验证码)
or Ctrl+Enter