Da foto, screenshot e PDF scansionati, Immagine in testoe l’OCR PDF vengono elaborati direttamente sul dispositivo. Le pagine PDF con testo selezionabile vengono lette dal livello testuale invece di usare l’OCR.
JPG, PNG, WebP, BMP, PDF · I file originali non vengono caricati sul server MISCLAND.
No. Le immagini e i PDF originali selezionati non vengono caricati sul server; vengono elaborati nella memoria del browser corrente.
I calcoli OCR vengono eseguiti sul PC o dispositivo mobile tramite PaddleOCR.js e WebAssembly. Il server MISCLAND fornisce solo i file statici del motore OCR e dei modelli; non riceve né memorizza il contenuto dei documenti o i risultati OCR.
Se una pagina PDF contiene già testo selezionabile, PDF.js lo estrae direttamente. Questo metodo è più veloce dell'OCR e conserva il testo originale con maggiore precisione.
Solo le pagine scansionate o i PDF basati su immagini senza livello di testo vengono renderizzati come immagini nel browser e poi elaborati con OCR. Se un PDF contiene sia pagine di testo sia pagine scansionate, ogni pagina viene gestita automaticamente con il metodo appropriato.
Puoi selezionare coreano, inglese, spagnolo, portoghese, francese, tedesco, italiano, indonesiano, vietnamita, arabo, hindi, cinese semplificato o tradizionale e giapponese.
Lo strumento usa un modello mobile di riconoscimento PP-OCRv5 adatto alla lingua selezionata. Il modello viene caricato solo dopo aver scelto la lingua e avviato realmente l'OCR; per gli utilizzi successivi viene sfruttata la cache del browser.
L'OCR non può garantire una precisione del 100%, perché il riconoscimento varia in base alla qualità dell'originale, alla dimensione del testo, all'inclinazione, allo sfondo e al carattere.
Documenti stampati e scansioni nitide offrono i risultati migliori. Usa Alta qualità per testi molto piccoli e prova Miglioramento del documento per scansioni in bianco e nero poco contrastate. Confronta sempre i risultati importanti con il documento originale.
Sì. Funziona nei browser mobili moderni che supportano WebAssembly e Web Worker.
L'OCR utilizza la memoria e la potenza di calcolo del dispositivo, quindi su dispositivi meno potenti o con documenti molto grandi può richiedere più tempo. Sui dispositivi mobili vengono applicati automaticamente limiti di sicurezza più bassi al numero di file, alla dimensione totale, alle pagine PDF e alla risoluzione delle immagini.