Konverter PDF ke Teks
Cara tercepat untuk mengambil kata-kata dari sebuah PDF. Alat ini membaca lapisan teks yang sudah tersimpan di dalam PDF, halaman demi halaman, dan memberi Anda teks polos yang bisa disalin atau disimpan sebagai berkas .txt. Semuanya berjalan di peramban Anda, jadi dokumen Anda tidak pernah diunggah. Satu hal yang perlu diketahui sejak awal: alat ini membaca teks yang sudah ada di dalam berkas, sehingga dokumen hasil pindaian atau foto (gambar tanpa lapisan teks) akan keluar kosong. Untuk kasus seperti itu, gunakan alat OCR sebagai gantinya.
Cara mengekstrak teks dari PDF
-
1
Unggah PDF
Seret ke sini atau klik untuk memilih. Berkas tetap di perangkat Anda dan tidak pernah dikirim ke server.
-
2
Ekstrak teksnya
Alat membaca lapisan teks setiap halaman dan menyatukannya, dengan penanda sebelum tiap halaman.
-
3
Tinjau hasilnya
Teks yang diekstrak muncul dalam kotak, halaman demi halaman, siap diperiksa.
-
4
Salin atau unduh
Salin ke papan klip atau simpan sebagai berkas .txt untuk dipakai di tempat lain.
Apa yang dibaca alat ini, dan apa yang tidak bisa
| Jenis PDF | Hasil |
|---|---|
| Diekspor dari Word, Google Docs, peramban, atau alat desain | Teks lengkap, bersih, dan utuh |
| PDF digital dengan lapisan teks yang benar | Teks diekstrak halaman demi halaman |
| Pindaian atau foto yang disimpan sebagai PDF (hanya gambar) | Kosong atau nyaris kosong: tak ada teks untuk dibaca |
| PDF yang dilindungi kata sandi | Tidak bisa dibaca sampai Anda membukanya lebih dulu |
Tidak ada OCR di sini: pakai alat yang tepat untuk pindaian
Pengekstrak ini tidak menjalankan OCR (pengenalan karakter optis). Ia menyalin teks yang sudah ada di dalam PDF, ia tidak membaca piksel. Jika berkas Anda hasil pindaian dan tidak ada yang keluar, jalankan dulu melalui alat OCR, yang mengubah gambar menjadi lapisan teks sungguhan yang kemudian bisa Anda ekstrak.
Bagaimana teks ditata
Setiap halaman dipisahkan oleh penanda --- Page N ---, sehingga Anda bisa melihat di mana satu halaman berakhir dan berikutnya dimulai. Teks diambil sesuai urutan penyimpanannya di dalam PDF. Sebagian besar dokumen terbaca secara alami; beberapa dengan tata letak multikolom yang tidak lazim bisa menyisipkan kolom secara bergantian, karena alat mengikuti urutan tersimpan di PDF alih-alih menebak alur baca.
Kegunaan umum
- Memberi masukan ke model AI. Model bahasa menerima teks polos, bukan PDF. Mengekstrak lebih dulu membuat semuanya lebih cepat dan mudah diprediksi.
- Mengutip dan mencari. Salin sebuah bagian tanpa bertarung dengan pemilihan pada penampil PDF.
- Memakai ulang konten. Pindahkan teks ke dokumen, email, atau catatan tanpa mengetik ulang.
Pertanyaan yang Sering Diajukan
Tidak. Ia membaca lapisan teks yang tertanam, dan pindaian hanyalah gambar tanpa lapisan teks, jadi hasilnya kosong. Gunakan alat OCR untuk dokumen pindaian atau foto, lalu ekstrak teksnya.
Tidak. Ekstraksi berjalan sepenuhnya di peramban Anda, pada perangkat Anda sendiri. PDF tidak pernah dikirim ke server dan tidak ada yang disimpan.
Beberapa PDF, terutama tata letak multikolom, menyimpan teksnya dalam urutan yang berbeda dari cara Anda membacanya. Alat mengikuti urutan tersimpan di PDF, sehingga kolom bisa bercampur. Dokumen yang diekspor dari pengolah kata hampir selalu keluar dengan benar.
Tidak selama masih terkunci. Hapus dulu kata sandinya dengan alat pembuka kunci PDF, lalu ekstrak teksnya.
Alat Terkait
Redaksi PDF secara lokal
Tutup area sensitif secara manual dan buat PDF baru dari gambar JPEG halaman di perangkat Anda. File tidak diunggah. Semua halaman hasil menjadi gambar yang tidak dapat dicari atau dipilih.
Formulir PDF
Isi kolom AcroForm yang sudah ada secara lokal, pertahankan jawaban bawaan, lalu unduh salinan interaktif atau statis.
Pindai Dokumen ke PDF
Ubah foto dokumen JPEG, PNG, atau WebP menjadi satu PDF di browser. Pilih A4 atau US Letter potret lalu unduh tanpa mengunggah foto Anda.
Pembuat PDF Bisa Dicari
Ubah PDF hasil pindai menjadi dokumen yang bisa dicari dan dipilih dengan menambahkan lapisan teks OCR tak terlihat. Sepenuhnya di browser Anda; 7 bahasa beraksara Latin.
Ekstrak Gambar dari PDF
Ekstrak setiap gambar yang terkandung dalam berkas PDF dan unduh secara terpisah atau sebagai satu file ZIP, sambil mempertahankan resolusi aslinya.
OCR PDF
Ekstrak teks biasa dari cetakan yang dipindai dalam PDF dengan OCR di browser. Mendukung 12 bahasa, file hingga 20 MB, dan dokumen hingga 40 halaman.
Alat ini tersedia dalam bahasa lain
- Conversor de PDF para texto [PT]
- PDF-zu-Text-Konverter [DE]
- PDF テキスト変換ツール [JA]
- PDF 텍스트 변환기 [KO]
- ตัวแปลง PDF เป็นข้อความ [TH]
- محوّل PDF إلى نص [AR]
- Konwerter PDF na tekst [PL]
- PDF till text-konverterare [SV]
- Công cụ chuyển PDF sang văn bản [VI]
- Conversor de PDF a texto [ES]
- Convertisseur PDF en texte [FR]
- PDF-naar-tekst-converter [NL]
- PDF to Text Converter [EN]
- Convertitore da PDF a testo [IT]
- Конвертер PDF в текст [RU]
- PDF'den Metne Dönüştürücü [TR]
- PDF 转文本转换器 [ZH]