Pembuat PDF Bisa Dicari
Sesi OCR ini sudah tidak tersedia
Pilih PDF hasil pindai
Hanya PDF · 10 MB
Hanya PDF, hingga 10 MB dan 10 halaman
PDF hasil pindai sebenarnya hanya tumpukan gambar di dalam wadah PDF, jadi Anda tidak bisa menyorot, menyalin, atau mencari teksnya. Alat ini menjalankan pengenalan karakter optik (OCR) pada setiap halaman di browser Anda dan menambahkan hasilnya sebagai lapisan teks tak terlihat yang disejajarkan dengan halaman asli. Tampilan halaman asli tetap ada, sementara Ctrl+F dan pemilihan teks dapat memakai kata yang dikenali. Pengenalan dapat keliru dan hasil ini bukan PDF aksesibilitas bertag, jadi bandingkan teks penting dengan hasil pindai.
Cara meng-OCR PDF hasil pindai
-
1
Unggah hasil pindai
Seret PDF hasil pindai (kontrak, faktur, laporan arsip). Teks cetak paling cocok; tulisan tangan tidak.
-
2
Pilih bahasa
Pilih bahasa dokumen (Inggris, Spanyol, Prancis, Jerman, Italia, Portugis, atau Belanda) agar mesin OCR memuat model karakter yang tepat.
-
3
Jalankan pengenalan
Setiap halaman dirender dalam resolusi tinggi di browser Anda dan diteruskan ke mesin OCR. Dokumen panjang bisa memakan waktu beberapa menit.
-
4
Lapisan teks disematkan
Kata-kata yang dikenali ditempatkan dalam lapisan tak terlihat yang disejajarkan dengan halaman asli, jadi setiap halaman tampak tidak berubah.
-
5
Unduh PDF baru
Dapatkan PDF yang tetap menyimpan pindaian asli dan kini bisa dicari di pembaca modern mana pun.
Kapan OCR bekerja baik (dan kapan tidak)
Kualitas OCR bergantung pada hasil pindai. Selalu bandingkan nama, angka, dan rumusan hukum yang penting dengan halaman asli.
| Masukan | Yang dapat diharapkan |
|---|---|
| Pindaian cetak bersih | Hasil sering kali baik; periksa teks penting. |
| Foto halaman cetak | Hasil bergantung pada fokus, pencahayaan, dan sudut halaman. |
| Buku tua atau cetakan mesin tik pudar | Tinjau teks yang dikenali dengan teliti. |
| Tulisan tangan atau kursif | Tidak didukung secara andal. |
| Struk atau hasil printer termal | Periksa angka dan karakter yang pudar dengan teliti. |
| Teks dengan tembusan latar yang kuat | Hasil dapat tidak lengkap atau tidak akurat. |
PDF bisa dicari vs PDF hanya gambar
- PDF hanya gambar: bitmap murni, tanpa teks. Inilah yang dihasilkan pemindai Anda secara bawaan.
- PDF bisa dicari: bitmap plus lapisan teks tak terlihat (yang dihasilkan alat ini). Tampilan sama persis, Ctrl+F berfungsi.
- PDF/A: subset PDF untuk pengarsipan yang menyematkan fontnya sendiri dan melarang sumber daya eksternal, sering diwajibkan oleh pengadilan dan arsip. Alat ini menghasilkan PDF bisa dicari biasa, bukan PDF/A bersertifikat; konversi dan validasi dengan alat PDF/A khusus jika alur kerja Anda membutuhkannya.
Tips untuk hasil terbaik
- Mulailah dari sekitar 300 DPI. Ini sering menjadi keseimbangan yang berguna antara detail yang terbaca dan waktu pemrosesan. Resolusi yang lebih tinggi memakai lebih banyak waktu dan memori.
- Luruskan sebelum OCR. Sebagian besar pemindai menyediakan rotasi otomatis; kemiringan kecil pun dapat menurunkan kualitas pengenalan.
- Satu bahasa per proses. Mesin mengenali satu bahasa dalam satu waktu, jadi pilih yang dominan. Untuk dokumen dwibahasa, jalankan sekali per bahasa dan simpan hasil yang lebih baik.
- Selalu simpan aslinya. OCR menimbulkan kesalahan kecil; lapisan tak terlihat adalah kemudahan, bukan bukti.
Pertanyaan yang Sering Diajukan
Isi halaman asli dipertahankan. Teks yang dikenali ditambahkan sebagai lapisan tak terlihat yang disejajarkan dengannya, sehingga tampilan halaman seharusnya tidak berubah. Periksa hasilnya jika kesetiaan visual yang persis penting bagi Anda.
Tujuh bahasa beraksara Latin: Inggris, Spanyol, Prancis, Jerman, Italia, Portugis, dan Belanda. Pilih yang sesuai dengan dokumen Anda. Aksara seperti Kiril, Arab, dan CJK (Tionghoa, Jepang, Korea) tidak tersedia di alat ini.
Tidak secara andal. Alat ini ditujukan untuk teks cetak. Pengenalan tulisan tangan adalah teknologi berbeda, jadi tinjau atau transkripsikan bahan tulisan tangan secara terpisah.
Tidak. Hasilnya adalah PDF bisa dicari biasa: gambar halaman asli Anda plus lapisan teks OCR tak terlihat. Ini bukan berkas PDF/A bersertifikat untuk pengarsipan. Jika alur kerja Anda memerlukan PDF/A, konversi dan validasi hasilnya dengan alat PDF/A khusus.
OCR berjalan sepenuhnya di browser Anda, jadi PDF sumber tidak dikirim ke server untuk pengenalan. Unduhan lokal biasa tetap berada di perangkat Anda. Hanya jika Anda memilih Buat halaman unduhan, PDF hasil yang sudah bisa dicari akan diunggah ke server kami; PDF sumber tetap lokal, dan hasil yang diunggah disimpan hingga 7 hari.
Alat Terkait
Word ke PDF
Konversi dokumen Word .doc dan .docx ke PDF dengan tata letak halaman, gambar, tabel, dan judul yang tetap terjaga. Unggah aman, hapus otomatis setelah 2 jam.
Edit PDF
Tambahkan teks, sorotan, persegi panjang, dan kotak putih ke PDF di peramban. Ekspor PDF baru tanpa menginstal perangkat lunak.
Konverter PDF ke Word
Ubah PDF menjadi dokumen Word yang benar-benar bisa diedit. Judul, daftar, gambar, dan tabel tetap dipertahankan. PDF hasil pindai diproses OCR otomatis.
Kompres PDF
Kompres file PDF di browser dengan merender ulang halaman menjadi PDF berbasis JPEG yang lebih ringan.
Hapus halaman dari PDF
Hapus halaman atau rentang halaman tertentu dari PDF. Masukkan nomor seperti 2, 5-7, sisakan setidaknya satu halaman, lalu unduh PDF yang sudah diringkas.
Konverter PDF ke Excel
Deteksi tabel beraturan dalam PDF berbasis teks lalu unduh XLSX, CSV, atau TSV secara lokal. Periksa setiap tabel sebelum ekspor. Batas: 20 MiB dan 150 halaman.