من الصور ولقطات الشاشة وملفات PDF الممسوحة، صورة إلى نصوPDF OCR يعملان مباشرة على جهازك. صفحات PDF التي تحتوي نصًا قابلاً للتحديد تُقرأ من طبقة النص بدل استخدام OCR.
JPG، PNG، WebP، BMP، PDF · لا يتم رفع الملفات الأصلية إلى خادم MISCLAND.
لا. لا تُرفع الصور وملفات PDF الأصلية التي تحددها إلى الخادم؛ بل تتم معالجتها داخل ذاكرة المتصفح الحالي.
تُجرى حسابات OCR على جهاز الكمبيوتر أو الجهاز المحمول لديك باستخدام PaddleOCR.js وWebAssembly. لا يفعل خادم MISCLAND سوى تقديم ملفات محرك OCR والنماذج الثابتة؛ ولا يستقبل محتوى المستندات أو نتائج OCR ولا يخزنها.
إذا كانت صفحة PDF تحتوي أصلًا على نص قابل للتحديد، فإن PDF.js يستخرجه مباشرة. هذه الطريقة أسرع من OCR وتحافظ على النص الأصلي بدقة أكبر.
تُحوَّل إلى صور داخل المتصفح فقط الصفحات الممسوحة ضوئيًا أو ملفات PDF المعتمدة على الصور التي لا تحتوي على طبقة نص، ثم تُعالج بتقنية OCR. وإذا احتوى ملف PDF على صفحات نصية وصفحات ممسوحة معًا، فسيتم اختيار طريقة المعالجة المناسبة لكل صفحة تلقائيًا.
يمكنك اختيار الكورية والإنجليزية والإسبانية والبرتغالية والفرنسية والألمانية والإيطالية والإندونيسية والفيتنامية والعربية والهندية والصينية المبسطة أو التقليدية واليابانية.
تستخدم الأداة نموذج تعرف محمول PP-OCRv5 مناسبًا للغة المحددة. ولا يتم تحميل النموذج إلا بعد اختيار اللغة وبدء OCR فعليًا، ثم تُستخدم ذاكرة التخزين المؤقت للمتصفح في المرات التالية.
لا يمكن لـ OCR ضمان دقة 100% لأن التعرف يتأثر بجودة المصدر وحجم النص وميله والخلفية ونوع الخط.
تعطي المستندات المطبوعة والمسح الواضح أفضل النتائج. استخدم وضع الجودة العالية للنصوص الصغيرة جدًا، وجرّب تحسين المستند للمسح الأبيض والأسود الباهت. قارن دائمًا النتائج المهمة بالمستند الأصلي.
نعم. تعمل الأداة في متصفحات الأجهزة المحمولة الحديثة التي تدعم WebAssembly وWeb Workers.
تستخدم تقنية OCR ذاكرة جهازك وقدرته الحاسوبية، لذلك قد تستغرق الأجهزة منخفضة المواصفات أو المستندات الكبيرة جدًا وقتًا أطول. وعلى الأجهزة المحمولة تُطبق تلقائيًا حدود أمان أقل لعدد الملفات والحجم الإجمالي وعدد صفحات PDF ودقة الصور.