写真・スクリーンショット・スキャンPDFから、画像からテキスト抽出とPDF OCRを端末上で処理します。選択可能なテキストを含むPDFページはOCRせず、テキストレイヤーを直接読み取ります。
JPG、PNG、WebP、BMP、PDF · 元ファイルはMISCLANDサーバーへアップロードされません。
いいえ。選択した元の画像やPDFはサーバーへアップロードされず、現在のブラウザーのメモリ内で処理されます。
OCRの計算はPaddleOCR.jsとWebAssemblyを使用して、お使いのPCまたはモバイル端末上で実行されます。MISCLANDサーバーは静的なOCRエンジンとモデルファイルを配信するだけで、文書内容やOCR結果を受信・保存しません。
PDFページに選択可能なテキストがすでに含まれている場合、PDF.jsで直接抽出します。OCRより高速で、元の文字もより正確に保持できます。
テキストレイヤーがないスキャンページや画像型PDFだけをブラウザー内で画像として描画し、その後OCRを実行します。1つのPDFにテキストページとスキャンページが混在している場合も、ページごとに適切な方法へ自動的に振り分けます。
韓国語、英語、スペイン語、ポルトガル語、フランス語、ドイツ語、イタリア語、インドネシア語、ベトナム語、アラビア語、ヒンディー語、簡体字・繁体字中国語、日本語を選択できます。
選択した言語に適したPP-OCRv5モバイル認識モデルを使用します。モデルは言語を選択して実際にOCRを開始したときだけ読み込まれ、2回目以降はブラウザーキャッシュを利用します。
OCRは100%の精度を保証できません。元画像の品質、文字サイズ、傾き、背景、フォントによって認識結果が変わるためです。
鮮明な印刷文書やスキャン画像ほど良い結果が得られます。非常に小さな文字には高品質モードを使い、薄い白黒スキャンには文書補正もお試しください。重要な内容は必ず原本と照合してください。
はい。WebAssemblyとWeb Workerに対応した最新のモバイルブラウザーで使用できます。
OCRはお使いの端末のメモリと計算資源を使用するため、低スペック端末や非常に大きな文書では時間がかかることがあります。モバイルでは、ファイル数、合計サイズ、PDFページ数、画像解像度に対して、より低い安全上限を自動適用します。