OCR Gratis · sin registro · sin marca de agua

Convertir imagen a texto (OCR)

Convierte fotos, capturas de pantalla y páginas escaneadas en texto editable. El motor OCR funciona dentro de tu navegador, así que tus imágenes nunca salen de tu dispositivo.

Updated Krawly Editorial TeamIn-house engineers, writers & reviewers

o suelta los archivos aquí · pega con Ctrl+V

JPG, PNG, WEBP, BMP, GIF · hasta 50 MB cada uno · máx. 20 archivos

Se procesa en tu navegador: los archivos nunca se suben

Respuesta rápida

Para pasar una imagen a texto, suelta un archivo JPG, PNG, WebP, BMP o GIF en la herramienta Imagen a texto de Krawly, elige el idioma del texto (hasta 3 a la vez) y pulsa «Extraer texto». El motor Tesseract lee la imagen en local en tu navegador y devuelve texto editable que puedes copiar o descargar como archivo .txt. No se sube nada y no hace falta registrarse.

Cómo usar la herramienta Imagen a texto (OCR)

  1. 1

    Añade tus imágenes

    Arrastra archivos JPG, PNG, WebP, BMP o GIF a la zona de carga, o haz clic para elegirlos. Puedes añadir hasta 20 imágenes por tanda, por ejemplo una serie de capturas o de páginas fotografiadas.

  2. 2

    Elige el idioma del texto

    El inglés viene seleccionado por defecto. Elige el idioma en el que está escrito el texto, o hasta tres idiomas si la imagen los mezcla, como inglés y español en una carta de restaurante bilingüe.

  3. 3

    Ejecuta el OCR

    Pulsa «Extraer texto». En la primera ejecución, tu navegador descarga el motor OCR y el modelo de idioma, y luego los guarda en caché. Cada imagen se procesa en tu dispositivo y recibe su propio cuadro de texto con un porcentaje de confianza medio.

  4. 4

    Revisa y corrige

    Los resultados son editables. Corrige cualquier carácter mal leído directamente en el cuadro de texto antes de usarlo; un porcentaje de confianza bajo indica que conviene revisar esa parte con más atención.

  5. 5

    Copia o descarga

    Pulsa «Copiar todo» para copiar texto de una imagen directamente al portapapeles, o «Descargar .txt» para guardar los resultados. Si procesas varias imágenes, la descarga las combina en un único archivo .txt con un encabezado para cada imagen.

¿Cómo funciona el paso de imagen a texto (OCR)?

OCR significa reconocimiento óptico de caracteres: un programa analiza los píxeles de una imagen, localiza las zonas que contienen escritura y deduce qué caracteres representan. El resultado es texto real que puedes buscar, editar, pegar en un documento o llevar a una hoja de cálculo, en lugar de una imagen de texto que tendrías que volver a teclear a mano. Es la forma más rápida de extraer texto de una imagen.

Krawly usa Tesseract, un motor OCR de código abierto con una larga trayectoria. Se desarrolló primero en Hewlett-Packard, se publicó como código abierto en 2005 y más tarde siguió desarrollándose con el patrocinio de Google. Aquí funciona como Tesseract.js, una versión compilada a WebAssembly para que pueda ejecutarse dentro de una página web sin ningún servidor. A grandes rasgos, el motor limpia la imagen hasta dejar texto oscuro sobre fondo claro, divide la página en bloques, líneas y palabras, y después reconoce cada línea con un modelo entrenado para el idioma que hayas seleccionado.

Ese último paso explica por qué importa elegir bien el idioma. Cada idioma tiene su propio modelo, con su alfabeto, sus letras acentuadas y sus formas de palabra habituales. Si le pides al motor que lea inglés mientras la imagen está en español, polaco o vietnamita, lo intentará igualmente, pero las letras con tildes y otros signos saldrán mal: la «ñ» o la «á» acaban convertidas en otros caracteres. Elegir el idioma correcto, o una combinación de hasta tres, es una de las formas más sencillas de conseguir un resultado más limpio.

Cómo sacar texto preciso de una foto o una captura de pantalla

El OCR funciona mejor con texto impreso, claro, con buen contraste y en líneas rectas. Las capturas de pantalla suelen ser ideales porque el texto es nítido y perfectamente horizontal. Para escaneos, unos 300 DPI son un buen objetivo: suficiente para que las letras pequeñas tengan bordes limpios sin generar archivos enormes. Si quieres pasar foto a texto desde el móvil, haz que el documento ocupe todo el encuadre, sujeta la cámara paralela al papel y evita las sombras de tu mano o del propio teléfono.

El contraste importa más que el color. Texto negro sobre papel blanco es fácil; texto gris claro sobre fondo beige, o texto blanco encima de una foto recargada, es mucho más difícil. Si el resultado es pobre, prueba a recortar la imagen para dejar solo la zona de texto, girarla para que las líneas queden rectas y aumentar el contraste en cualquier editor de fotos antes de volver a ejecutar el OCR. Las líneas torcidas, curvas o deformadas por la perspectiva, como en una página fotografiada cerca del lomo de un libro, son una causa habitual de palabras perdidas.

El texto muy pequeño es otro problema frecuente. Cuando las letras miden solo unos pocos píxeles de alto, no hay detalle suficiente para distinguir una e de una c o una l de un 1. Ampliar la página antes de hacer la captura, o escanear a más resolución, suele ayudar más que cualquier retoque posterior. Ten en cuenta que agrandar una imagen que ya es pequeña no puede añadir el detalle que nunca se capturó.

Lo que el OCR no puede hacer: letra manuscrita, tablas y maquetación

Tesseract está pensado para texto impreso. La letra manuscrita, las notas en cursiva, las firmas y las tipografías muy estilizadas o decorativas suelen dar resultados pobres o inservibles. Lo mismo ocurre con fotos de baja resolución, borrosas o muy comprimidas. Si tu imagen entra en alguno de estos grupos, cuenta con tener que corregir buena parte del resultado a mano, o con volver a teclear el texto.

El resultado es texto plano. No se conservan columnas, tablas, negritas ni cursivas, tamaños de letra ni imágenes. Un artículo a dos columnas se aplana en líneas de texto y una tabla se convierte en filas de palabras separadas por espacios, así que quizá tengas que ordenar la estructura después de pegarla en otro sitio. Esta herramienta no genera documentos de Word ni hojas de cálculo.

Cada imagen recibe además un porcentaje de confianza medio. Es la propia estimación del motor sobre lo seguro que estaba de las palabras reconocidas, no una garantía de precisión, pero es una señal útil: una puntuación claramente más baja suele indicar que la imagen tiene que estar más nítida, más recta o mejor recortada.

¿Es seguro pasar por OCR capturas, documentos de identidad y tickets?

Es habitual usar OCR con material delicado: tickets para notas de gastos, capturas de chats o de apps bancarias, facturas, contratos, documentos de identidad y cartas. Muchos servicios de OCR online suben esas imágenes a un servidor para procesarlas. Krawly no lo hace. El reconocimiento se ejecuta íntegramente en tu navegador con JavaScript y WebAssembly, y tus imágenes nunca se envían a los servidores de Krawly.

Lo único que descarga tu navegador son archivos de programa: el motor Tesseract y el modelo de cada idioma que elijas, de unos pocos megabytes cada uno. Tras la primera ejecución quedan en caché, así que las siguientes empiezan antes. La imagen y el texto reconocido se quedan en la memoria de la página, no se guarda nada y al cerrar la pestaña todo desaparece.

Como el trabajo se hace en tu dispositivo, la velocidad depende de tu hardware. Un portátil reciente procesa una captura rápidamente; un móvil antiguo tarda más con fotos grandes. La herramienta funciona en las versiones actuales de Chrome, Edge, Firefox y Safari, tanto en escritorio como en móvil, y es gratis, sin registro, sin correo electrónico y sin límite diario.

Consejos para obtener los mejores resultados

  • Recorta la imagen para dejar solo el texto que necesitas antes de ejecutar el OCR. Quitar logotipos, fotos y bordes de página le da al motor menos cosas que leer mal.
  • Selecciona todos los idiomas que aparezcan en la imagen, hasta tres. Un documento en español con citas en inglés se lee mejor con ambos seleccionados.
  • En capturas de pantalla, amplía la página antes de capturar para que las letras sean más grandes y nítidas.
  • Revisa las líneas con caracteres poco habituales, números y signos de puntuación: 0 y O, 1 y l, o rn y m son confusiones clásicas del OCR.
  • ¿Tienes una foto de iPhone en formato HEIC? Conviértela antes con la herramienta HEIC a JPG y después pasa el OCR al JPG.
  • Para un PDF escaneado, usa PDF a texto en lugar de hacer una captura de cada página. Lee el texto incrustado cuando lo hay y solo aplica OCR donde hace falta.

Preguntas frecuentes

¿Puede leer letra manuscrita?

No de forma fiable. El motor Tesseract está diseñado para texto impreso, así que las notas a mano, la cursiva y las firmas suelen salir como caracteres rotos o equivocados. Las mayúsculas de imprenta muy cuidadas a veces funcionan en parte. Con letra manuscrita, volver a teclear el texto suele ser más rápido que corregir el resultado del OCR.

¿Qué idiomas admite?

Inglés, español, portugués, francés, alemán, italiano, neerlandés, turco, polaco, ruso, ucraniano, árabe, hindi, japonés, chino (simplificado), chino (tradicional), coreano, vietnamita e indonesio. Puedes seleccionar hasta tres idiomas a la vez para imágenes que los mezclan.

¿Se suben mis imágenes a un servidor?

No. El OCR se ejecuta en tu navegador con Tesseract compilado a WebAssembly. Tu navegador descarga el motor y los archivos de idioma, pero tus imágenes y el texto extraído nunca salen de tu dispositivo. No se guarda nada y al cerrar la pestaña se borra todo.

¿Por qué la primera vez tarda más?

La primera vez que usas la herramienta, tu navegador descarga el motor OCR y el modelo de cada idioma seleccionado, unos pocos megabytes por idioma. Después esos archivos quedan en caché, así que las siguientes ejecuciones con los mismos idiomas empiezan mucho antes. Elegir un idioma nuevo provoca una única descarga de ese modelo.

¿Cuántas imágenes puedo convertir a la vez?

Hasta 20 imágenes por tanda, de hasta 50 MB cada una. Cada imagen tiene su propio cuadro de texto editable, y «Descargar .txt» combina todos los resultados en un único archivo de texto con un encabezado por imagen. No hay límite diario, así que puedes empezar otra tanda enseguida.

¿Qué formatos de imagen puedo usar?

JPG, PNG, WebP, BMP y GIF, de hasta 50 MB cada uno. Las capturas guardadas en PNG suelen ser la entrada más limpia porque el texto es nítido. Las fotos HEIC del iPhone no se aceptan directamente; conviértelas antes con la herramienta HEIC a JPG y después pasa el OCR al JPG.

¿Conserva las tablas y el formato?

No. El resultado es texto plano. Las columnas se aplanan, las tablas se convierten en líneas de palabras separadas por espacios y se pierden las fuentes, las negritas y las imágenes. Puedes editar el texto en el cuadro de resultados antes de copiarlo, u ordenarlo en tu propio editor.

¿Qué significa el porcentaje de confianza?

Es la confianza media del motor en las palabras que reconoció en esa imagen. No es una medida de precisión, pero una puntuación baja es una buena señal de que la imagen está borrosa, torcida, tiene poco contraste o está en un idioma distinto del seleccionado.

Privado por diseño. Todos los conversores de Krawly funcionan dentro de tu navegador con JavaScript y WebAssembly. Tus archivos no se suben, no se guardan y nadie los ve: cuando cierras la pestaña, desaparecen.

Convertidores relacionados

Ver los 21 convertidores gratuitos