Dari foto, screenshot, dan PDF hasil scan, Gambar ke teksdan PDF OCR diproses langsung di perangkat Anda. Halaman PDF dengan teks yang bisa dipilih dibaca dari layer teks tanpa OCR.
JPG, PNG, WebP, BMP, PDF · File asli tidak diunggah ke server MISCLAND.
Tidak. Gambar dan PDF asli yang Anda pilih tidak diunggah ke server; semuanya diproses di memori browser yang sedang digunakan.
Perhitungan OCR berjalan di PC atau perangkat seluler Anda menggunakan PaddleOCR.js dan WebAssembly. Server MISCLAND hanya mengirim file statis mesin OCR dan model; server tidak menerima atau menyimpan isi dokumen maupun hasil OCR.
Jika halaman PDF sudah memiliki teks yang dapat dipilih, PDF.js akan mengekstraknya secara langsung. Cara ini lebih cepat daripada OCR dan mempertahankan teks asli dengan lebih akurat.
Hanya halaman hasil pindai atau PDF berbasis gambar yang tidak memiliki lapisan teks yang dirender menjadi gambar di browser lalu diproses dengan OCR. Jika sebuah PDF berisi campuran halaman teks dan halaman hasil pindai, setiap halaman akan ditangani secara otomatis dengan metode yang sesuai.
Anda dapat memilih bahasa Korea, Inggris, Spanyol, Portugis, Prancis, Jerman, Italia, Indonesia, Vietnam, Arab, Hindi, Mandarin Sederhana atau Tradisional, dan Jepang.
Alat ini menggunakan model pengenalan seluler PP-OCRv5 yang sesuai dengan bahasa yang dipilih. Model hanya dimuat setelah Anda memilih bahasa dan benar-benar menjalankan OCR, lalu cache browser digunakan untuk pemakaian berikutnya.
OCR tidak dapat menjamin akurasi 100% karena hasil pengenalan dapat berbeda tergantung kualitas sumber, ukuran teks, kemiringan, latar belakang, dan jenis huruf.
Dokumen cetak dan hasil pindai yang jelas memberikan hasil terbaik. Gunakan Kualitas tinggi untuk teks yang sangat kecil, dan coba Peningkatan dokumen untuk hasil pindai hitam-putih yang samar. Selalu bandingkan hasil penting dengan dokumen asli.
Ya. Alat ini berfungsi di browser seluler modern yang mendukung WebAssembly dan Web Worker.
OCR menggunakan memori dan daya komputasi perangkat Anda, sehingga perangkat berspesifikasi rendah atau dokumen yang sangat besar dapat memerlukan waktu lebih lama. Pada perangkat seluler, batas aman yang lebih rendah diterapkan secara otomatis untuk jumlah file, ukuran total, jumlah halaman PDF, dan resolusi gambar.