Konverter PDF ke HTML
Konverter ini membaca teks PDF Anda dan membungkusnya dalam berkas HTML yang bersih dan minimal: satu <section> per halaman, judul halaman <h2>, dan paragraf <p>. Semuanya berjalan di browser Anda menggunakan PDF.js, jadi berkas tidak pernah diunggah. Hasilnya adalah HTML sederhana berisi teks saja yang bisa Anda buka, edit, atau tempel ke CMS lalu beri gaya dengan CSS Anda sendiri. Alat ini dibuat untuk memindahkan teks dari PDF ke web, bukan untuk mereproduksi halaman yang sudah didesain.
Cara mengonversi PDF ke HTML
-
1
Pilih PDF Anda
Seret PDF berbasis teks ke dalam kotak atau klik untuk menelusuri. Semuanya tetap berada di browser Anda.
-
2
Konversi ke HTML
PDF.js membaca setiap halaman dan mengekstrak teksnya, mengelompokkan baris menjadi paragraf.
-
3
Tinjau HTML
Markup yang dihasilkan muncul di kotak pratinjau agar Anda dapat memeriksa hasilnya.
-
4
Unduh berkas
Simpan satu berkas `.html` dengan satu bagian per halaman, siap untuk diedit atau diberi gaya ulang.
Seperti apa hasilnya
Konverter menghasilkan satu berkas HTML5 yang valid dengan struktur minimal:
| Elemen | Berasal dari |
|---|---|
Kerangka <!DOCTYPE html> |
Pembungkus HTML5 standar dengan set karakter UTF-8 |
<title> |
Nama berkas PDF Anda |
<section data-page> |
Satu blok per halaman PDF |
<h2>Halaman N</h2> |
Judul yang menandai awal setiap halaman |
<p> |
Baris teks yang dikelompokkan menjadi paragraf berdasarkan jarak vertikal |
Yang tidak dilakukannya
Ini adalah alat ekstraksi teks, bukan mesin tata letak. Secara sengaja, hasilnya tidak menyertakan:
- Gambar, logo, atau ilustrasi dari PDF.
- Tabel, daftar berpoin, atau daftar bernomor sebagai
<table>/<ul>/<ol>HTML. - Font, warna, kolom, atau posisi asli.
- CSS atau gaya inline apa pun.
Anda mendapatkan kata-kata dalam urutan baca, dibungkus dalam paragraf semantik, dan tidak lebih dari itu. Tambahkan CSS Anda sendiri setelahnya.
Hasil terbaik
- Gunakan PDF berbasis teks (PDF yang teksnya bisa Anda seleksi di pembaca). PDF hasil pindai atau yang hanya berupa gambar tidak memiliki lapisan teks; tidak ada OCR di sini, sehingga hasilnya akan kosong untuk halaman-halaman tersebut.
- Jalankan berkas melalui
prettier --parser htmlatau pemformat lain untuk merapikan spasi sebelum Anda commit. - Memindahkannya ke WordPress? Tempel HTML ke blok kode/HTML, bukan ke editor visual, yang akan membungkusnya ulang.
Bukan alat tata letak
Jangan berharap HTML terlihat seperti PDF. Web bersifat cair, sedangkan halaman PDF bersifat tetap. Gunakan alat ini saat Anda ingin konten berada di web, lalu beri gaya ulang dengan CSS milik situs Anda sendiri.
Pertanyaan yang Sering Diajukan
Tidak. Alat ini mengekstrak teks dan menaruhnya dalam paragraf sederhana. Font, warna, kolom, dan posisi tidak direproduksi. Beri gaya pada hasilnya dengan CSS Anda sendiri.
Tidak. Hanya teks yang diekstrak. Gambar, logo, dan ilustrasi tidak dipindahkan ke HTML.
Hanya jika PDF memiliki lapisan teks yang sebenarnya. Halaman hasil pindai atau foto berupa gambar tanpa teks yang bisa diseleksi, dan tidak ada OCR di sini, jadi halaman tersebut tidak menghasilkan teks.
Tidak. Seluruh konversi berjalan di browser Anda dengan PDF.js. PDF tidak pernah meninggalkan perangkat Anda, sehingga aman untuk dokumen rahasia.
Alat Terkait
Redaksi PDF secara lokal
Tutup area sensitif secara manual dan buat PDF baru dari gambar JPEG halaman di perangkat Anda. File tidak diunggah. Semua halaman hasil menjadi gambar yang tidak dapat dicari atau dipilih.
Formulir PDF
Isi kolom AcroForm yang sudah ada secara lokal, pertahankan jawaban bawaan, lalu unduh salinan interaktif atau statis.
Pindai Dokumen ke PDF
Ubah foto dokumen JPEG, PNG, atau WebP menjadi satu PDF di browser. Pilih A4 atau US Letter potret lalu unduh tanpa mengunggah foto Anda.
Pembuat PDF Bisa Dicari
Ubah PDF hasil pindai menjadi dokumen yang bisa dicari dan dipilih dengan menambahkan lapisan teks OCR tak terlihat. Sepenuhnya di browser Anda; 7 bahasa beraksara Latin.
Ekstrak Gambar dari PDF
Ekstrak setiap gambar yang terkandung dalam berkas PDF dan unduh secara terpisah atau sebagai satu file ZIP, sambil mempertahankan resolusi aslinya.
OCR PDF
Ekstrak teks biasa dari cetakan yang dipindai dalam PDF dengan OCR di browser. Mendukung 12 bahasa, file hingga 20 MB, dan dokumen hingga 40 halaman.
Alat ini tersedia dalam bahasa lain
- PDF to HTML 변환기 [KO]
- PDF till HTML-omvandlare [SV]
- محوّل PDF إلى HTML [AR]
- Konwerter PDF na HTML [PL]
- PDF-zu-HTML-Konverter [DE]
- Convertisseur PDF en HTML [FR]
- โปรแกรมแปลงไฟล์ PDF เป็น HTML [TH]
- PDF naar HTML converter [NL]
- PDFからHTMLへの変換ツール [JA]
- Chuyển đổi PDF sang HTML [VI]
- Conversor de PDF para HTML [PT]
- Conversor de PDF a HTML [ES]
- PDF转HTML转换器 [ZH]
- PDF to HTML Converter [EN]
- Convertitore PDF in HTML [IT]
- Конвертер PDF в HTML [RU]
- PDF'ten HTML'e Dönüştürücü [TR]