Imagen a texto (OCR)
OCR en línea gratis: extrae texto de imágenes, capturas de pantalla, fotos y PDF escaneados en 24 idiomas. Funciona en tu navegador y no se sube nada.
Qué hace
Esta herramienta usa OCR (reconocimiento óptico de caracteres) para convertir el texto de una imagen en texto que puedes copiar, editar y buscar. Funciona con capturas de pantalla, fotos de documentos, páginas escaneadas y PDF que son solo imágenes. El reconocimiento lo hace Tesseract, un motor de OCR de código abierto que se ejecuta en tu propio navegador, así que los archivos nunca salen de tu dispositivo. El texto pequeño se amplía automáticamente antes de leerlo, lo que reduce notablemente los errores.
Cómo usarla
- Elige una o más imágenes o un PDF, arrástralos aquí o pega una captura de pantalla.
- Revisa el idioma del texto. La lectura empieza sola; si cambias el idioma, vuelve a pulsar Extraer texto.
- Revisa el resultado, corrige lo que se haya leído mal y luego cópialo o descárgalo como archivo .txt.
Preguntas frecuentes
¿Se suben mis imágenes?
No. El motor de reconocimiento y los datos del idioma se descargan en tu navegador, y las imágenes y los PDF se procesan ahí. No se envía nada a ningún servidor, así que es seguro usarlo con documentos privados.
¿Qué tan preciso es?
En texto impreso claro, los idiomas escritos en alfabeto latino suelen acertar más del 99% de los caracteres, y otras escrituras normalmente entre el 93% y el 99%. La precisión baja con fotos borrosas, poco contraste, páginas curvadas, fuentes decorativas y escritura a mano. Para el mejor resultado, usa una imagen nítida, bien iluminada y derecha, y elige el idioma correcto.
¿Qué idiomas se admiten?
24 idiomas: inglés, portugués, español, francés, alemán, italiano, sueco, afrikáans, turco, indonesio, malayo, filipino, vietnamita, ruso, árabe, urdu, hindi, tamil, tailandés, jemer, japonés, coreano y chino simplificado y tradicional. Puedes combinar dos idiomas cuando un texto los mezcla.
¿Puede leer letra manuscrita?
Solo con dificultad. El motor está entrenado con texto impreso: las mayúsculas de imprenta bien hechas a veces funcionan, pero la letra cursiva suele salir mal.
¿Funciona con PDF escaneados?
Sí. Cada página se renderiza en alta resolución y se lee por turno, y puedes marcar dónde empieza cada página. Si el PDF ya contiene texto que puedes seleccionar, la herramienta PDF a texto es más rápida y exacta.
Wikipedia — Optical character recognition
Wikipedia — Tesseract (software)