Mengambil Semua Gambar dari File PDF dengan pdfimages
Solusi praktis untuk mengekstrak gambar dari dokumen PDF menggunakan perintah baris di Linux.
Pernahkah Anda menerima file PDF yang berisi gambar-gambar penting, tetapi Anda hanya ingin menyimpan gambar-gambar tersebut tanpa harus menggunakan perangkat lunak berat seperti Adobe Acrobat? Atau mungkin Anda seorang developer yang sedang mengerjakan proyek otomatisasi dan perlu mengambil aset gambar dari ratusan PDF? Di sinilah pdfimages menjadi penyelamat.
pdfimages adalah command-line tool yang berasal dari paket poppler-utils—sekumpulan utilitas untuk memanipulasi file PDF di lingkungan Linux (dan juga tersedia untuk macOS serta Windows melalui WSL atau Cygwin). Dengan satu baris perintah, Anda bisa mengekstrak semua gambar yang tersimpan di dalam PDF, baik dalam format JPEG, PNG, TIFF, atau bahkan format mentah (raw). Tidak perlu membuka PDF satu per satu, cukup jalankan perintah dan semua gambar akan keluar dengan rapi.

Dalam artikel ini, kita akan membahas secara mendalam cara menggunakan pdfimages, mulai dari instalasi, opsi-opsi penting, hingga contoh kasus nyata. Kami juga akan membagikan tips dan trik untuk menangani berbagai situasi—misalnya saat PDF berisi gambar dengan kompresi yang berbeda, atau ketika Anda ingin mengubah format output. Semua penjelasan disusun dengan bahasa yang santai namun tetap profesional, agar Anda—baik pemula maupun administrator sistem—langsung bisa mempraktikkannya.
⚡ Perintah Dasar pdfimages
Sintaks paling sederhana dari pdfimages adalah:
pdfimages -j file.pdf nama-awalanOpsi -j digunakan untuk menjaga kualitas gambar dengan menyimpannya dalam format JPEG asli (jika gambar di dalam PDF memang berformat JPEG). Hasilnya, semua gambar dari file.pdf akan diekstrak menjadi file-file gambar dengan awalan nama-awalan, misalnya nama-awalan-000.jpg, nama-awalan-001.jpg, dan seterusnya.
Tanpa opsi -j, pdfimages akan mengekstrak gambar dalam format PPM (untuk gambar berwarna) atau PBM (untuk gambar hitam-putih) yang ukurannya jauh lebih besar dan kurang praktis. Oleh karena itu, selalu gunakan -j jika Anda ingin hasil berupa JPEG yang ringan dan kompatibel.
Selain -j, ada beberapa opsi lain yang berguna:
-png– mengekspor gambar dalam format PNG (lossless, cocok untuk grafis dengan teks atau transparansi).-tiff– mengekspor dalam format TIFF (kualitas tinggi, ukuran besar).-all– mengekstrak semua gambar tanpa mengubah format asli (termasuk JPEG2000, JBIG2, dll).-list– hanya menampilkan daftar gambar dalam PDF tanpa mengekstraknya.
Contoh penggunaan opsi -png:
pdfimages -png file.pdf gambarPerintah di atas akan menghasilkan file gambar-000.png, gambar-001.png, dan seterusnya.
Perlu diingat bahwa pdfimages hanya mengekstrak gambar yang disematkan sebagai objek gambar di dalam PDF. Gambar yang merupakan bagian dari latar belakang atau pattern yang dihasilkan oleh teks tidak akan diekstrak. Untuk kasus seperti itu, Anda mungkin perlu menggunakan alat lain seperti pdftoppm yang mengubah seluruh halaman menjadi gambar.
📦 Instalasi poppler-utils
Sebelum bisa menggunakan pdfimages, Anda harus menginstal paket poppler-utils. Paket ini tersedia di hampir semua distribusi Linux dan juga bisa dipasang di macOS melalui Homebrew, serta di Windows melalui WSL atau Cygwin.
Untuk pengguna Debian/Ubuntu dan turunannya:
sudo apt update
sudo apt install poppler-utilsUntuk Fedora/RHEL/CentOS:
sudo dnf install poppler-utilsUntuk Arch Linux:
sudo pacman -S popplerUntuk macOS dengan Homebrew:
brew install popplerSetelah instalasi selesai, verifikasi dengan menjalankan:
pdfimages -vJika muncul versi, maka instalasi berhasil. Paket ini juga menyertakan utilitas lain seperti pdftotext, pdfinfo, dan pdftoppm yang sangat berguna untuk manipulasi PDF.
Bagi pengguna Windows, cara termudah adalah menginstal WSL (Windows Subsystem for Linux) lalu mengikuti langkah untuk Ubuntu. Alternatif lain adalah menggunakan Cygwin atau MSYS2 yang menyediakan paket poppler.
🧪 Contoh File Uji dan Praktik Langsung
Untuk mencoba langsung, kami menyediakan file PDF contoh yang berisi beberapa gambar dengan berbagai format. Anda bisa mengunduhnya dari tautan berikut:
📄 Perintah Teks (download dari Google Drive)
Setelah mengunduh file tersebut (misal bernama contoh.pdf), buka terminal di direktori yang sama, lalu jalankan:
pdfimages -j contoh.pdf hasilPerintah ini akan menghasilkan file-file seperti hasil-000.jpg, hasil-001.jpg, dst. Buka file-file tersebut dengan penampil gambar untuk melihat hasilnya.
Jika Anda ingin mengekspor dalam format PNG (misalnya karena gambar memiliki latar transparan), gunakan:
pdfimages -png contoh.pdf hasil-pngPerhatikan bahwa pdfimages akan memberi nomor urut pada setiap file gambar sesuai urutan kemunculannya di dalam PDF. Jika PDF memiliki halaman yang berisi banyak gambar, semuanya akan diekstrak tanpa kecuali.
Tips: Jika Anda hanya ingin mengekstrak gambar dari halaman tertentu, Anda bisa menggunakan opsi -f (halaman awal) dan -l (halaman akhir). Contoh:
pdfimages -j -f 2 -l 5 contoh.pdf hasilPerintah di atas hanya akan mengekstrak gambar dari halaman 2 sampai 5.
Selain itu, Anda juga bisa menggabungkan pdfimages dengan perintah pipe atau skrip shell untuk memproses banyak file sekaligus. Misalnya, untuk mengekstrak gambar dari semua file PDF di direktori saat ini:
for f in *.pdf; do pdfimages -j "$f" "${f%.pdf}"; doneIni akan menghasilkan folder atau file gambar dengan awalan sesuai nama PDF.
Dengan pemahaman di atas, Anda sekarang memiliki senjata ampuh untuk menangani ekstraksi gambar dari PDF. Selamat mencoba!
pdfimages adalah alat sederhana namun sangat efektif. Dengan satu perintah, Anda bisa menghemat waktu berjam-jam dan menghindari ketergantungan pada aplikasi GUI berat. Kuasai perintah ini, dan pekerjaan Anda dengan PDF akan terasa lebih ringan.