تحويل الصورة إلى نص (OCR)
OCR مجاني عبر الإنترنت: استخرج النص من الصور ولقطات الشاشة وملفات PDF الممسوحة ضوئيًا بـ24 لغة. يعمل في متصفحك دون رفع أي ملف.
ما الذي تفعله
تستخدم هذه الأداة تقنية OCR (التعرّف الضوئي على الحروف) لتحويل النص الموجود في الصورة إلى نص يمكنك نسخه وتحريره والبحث فيه. تعمل مع لقطات الشاشة وصور المستندات والصفحات الممسوحة ضوئيًا وملفات PDF المكوّنة من صور فقط. يتولى التعرّفَ Tesseract، وهو محرك OCR مفتوح المصدر يعمل داخل متصفحك، لذا لا تغادر الملفات جهازك أبدًا. ويُكبَّر النص الصغير تلقائيًا قبل قراءته، مما يقلل الأخطاء بشكل ملحوظ.
طريقة الاستعمال
- اختر صورة أو أكثر أو ملف PDF، أو اسحبها إلى هنا، أو الصق لقطة شاشة.
- تحقق من لغة النص. تبدأ القراءة تلقائيًا؛ وإذا غيّرت اللغة فاضغط على استخراج النص مرة أخرى.
- راجع النتيجة وصحّح ما قُرئ خطأً، ثم انسخه أو نزّله كملف .txt.
الأسئلة الشائعة
هل تُرفع صوري؟
لا. يُنزَّل محرك التعرّف وبيانات اللغة إلى متصفحك، وتُعالَج الصور وملفات PDF هناك. لا يُرسَل شيء إلى أي خادم، لذا فاستخدامه آمن مع المستندات الخاصة.
ما مدى دقته؟
مع النصوص المطبوعة الواضحة، تتجاوز الدقة في اللغات المكتوبة بالحروف اللاتينية عادةً 99% من الحروف، وتتراوح في أنظمة الكتابة الأخرى غالبًا بين 93% و99%. وتنخفض الدقة مع الصور الضبابية والتباين المنخفض والصفحات المنحنية والخطوط الزخرفية والكتابة اليدوية. للحصول على أفضل نتيجة، استخدم صورة واضحة ومستقيمة وجيدة الإضاءة، واختر اللغة الصحيحة.
ما اللغات المدعومة؟
24 لغة: الإنجليزية والبرتغالية والإسبانية والفرنسية والألمانية والإيطالية والسويدية والأفريكانية والتركية والإندونيسية والملايوية والفلبينية والفيتنامية والروسية والعربية والأردية والهندية والتاميلية والتايلاندية والخميرية واليابانية والكورية والصينية المبسطة والتقليدية. ويمكنك الجمع بين لغتين إذا كان النص يمزج بينهما.
هل يمكنه قراءة الكتابة اليدوية؟
بشكل ضعيف فقط. المحرك مُدرَّب على النصوص المطبوعة: قد تنجح الحروف المنفصلة المرتّبة أحيانًا، لكن الخط اليدوي المتصل يخرج عادةً خاطئًا.
هل يعمل مع ملفات PDF الممسوحة ضوئيًا؟
نعم. تُعرَض كل صفحة بدقة عالية وتُقرأ بالتتابع، ويمكنك تمييز بداية كل صفحة. إذا كان ملف PDF يحتوي بالفعل على نص قابل للتحديد، فإن أداة تحويل PDF إلى نص أسرع وأدق.
Wikipedia — Optical character recognition
Wikipedia — Tesseract (software)