← Herramientas de Imagen

OCR de imágenes

Imagen actualSube una imagen para desbloquear la configuración de OCR

Pasar el texto de una imagen a TXT o Markdown

Extrae texto editable de una captura, una foto o una imagen escaneada. Elige TXT para copiarlo en un formulario o Markdown para conservar encabezados y tablas. Comprueba el texto con el original antes de utilizarlo: los caracteres pequeños, el desenfoque y las sombras pueden cambiar letras, cifras o códigos.

Coste: Hay opciones gratuitas. Las opciones Pro o el uso que supere la cuota gratuita pueden requerir créditos; consulta la guía de abajo.

Cómo extraer texto de una imagen

  1. Selecciona una imagen

    Pulsa Sube una imagen para extraer texto o arrastra el archivo a la vista previa. Se admiten JPG, PNG, WebP, HEIC, HEIF, AVIF, BMP y TIFF de hasta 200 MB. Files permite reutilizar imágenes subidas o creadas con otras herramientas.

  2. Decide el formato del texto

    En OCR, conserva TXT para texto plano o selecciona Markdown para representar la estructura del documento. El formato se aplica durante la extracción: elígelo antes de iniciar el trabajo.

  3. Revisa el idioma orientativo

    Idioma orientativo empieza en Auto-detect, detección automática. Puedes dejarlo así para una primera lectura. Si eliges un idioma concreto, se utilizará otro motor, con ese idioma como ayuda para reconocer caracteres ambiguos.

  4. Inicia la extracción

    Pulsa Extract text, que es el texto visible del botón. La imagen permanece en la vista previa y el resultado aparece debajo, en Texto extraído, junto al número de caracteres. Cada trabajo lee una imagen.

  5. Corrige y guarda el texto

    Compara nombres, importes, fechas y códigos con la imagen. Copiar coloca el resultado en el portapapeles. Descargar guarda un archivo UTF-8 llamado ocr-result.txt o ocr-result.md, según el formato elegido.

Formato de texto e idioma orientativo

El panel OCR tiene dos ajustes: formato e idioma. Ninguno modifica la imagen original.

TXT
Es la opción inicial. Devuelve texto plano, sin adornos de Markdown. Las tablas reconocidas se convierten en filas con tabulaciones entre celdas, útiles para pegarlas en una hoja de cálculo. Los caracteres que pertenecen al texto, como #hashtags, __init__ o <div> en una captura de código, se mantienen. Sirve para cartas, recibos, conversaciones y citas.
Markdown
Representa la estructura mediante sintaxis: encabezados con #, listas, énfasis y tablas. Elígelo cuando quieras conservar esa organización en una aplicación de notas o una wiki. Abre el archivo .md en un editor compatible con Markdown para ver la presentación; un editor de texto plano muestra la sintaxis.
Idioma orientativo: Auto-detect
La imagen se envía a GLM-OCR, un modelo específico de reconocimiento de texto que detecta el idioma y la escritura automáticamente. Este motor no recibe un idioma manual como pista.
Idioma orientativo: selección manual
El selector muestra English (inglés), German (alemán), Spanish (español), French (francés), Italian (italiano), Portuguese (portugués), Russian (ruso), Japanese (japonés), Chinese (chino), Arabic (árabe) y Hindi. La imagen pasa a Gemini, que recibe el idioma, la escritura y la dirección de lectura como pistas. Ayudan, por ejemplo, con caracteres compartidos por chino y japonés o con árabe de derecha a izquierda. El texto en otros idiomas se conserva; no se pide traducir, resumir ni corregir.

Qué servicio reconoce los caracteres

El trabajo se procesa desde nuestros servidores. La imagen completa se envía a un servicio externo: GLM-OCR de Z.ai con Auto-detect, o la API de Google Gemini con un idioma seleccionado. Si Gemini alcanza un límite de solicitudes o cuota, la misma petición pasa al modelo de Gemini mediante OpenRouter. La extracción no ocurre únicamente en tu navegador.

Cambiar entre Auto-detect y un idioma concreto permite comparar dos motores de reconocimiento, no solo ajustar una pista del mismo motor. Si una línea sale mal, la otra lectura puede ser útil para comprobarla. Cada nueva extracción cuenta por separado para el uso de la herramienta.

Cómo preparar una imagen legible

Una fuente clara facilita la lectura, pero conviene revisar siempre el texto reconocido.

Recorta la zona que necesitas

Los menús, letreros o etiquetas del fondo también pueden transcribirse. Usa Recortar imagen para conservar solo la parte que quieres leer. Así reduces el texto ajeno al documento.

Endereza el documento

Las líneas verticales o inclinadas complican la lectura. Si la página aparece girada, corrígela antes con Girar imagen. Comprueba que el texto se vea recto y completo.

Prefiere una captura de pantalla

Para texto que ya está en una pantalla, una captura suele mostrar caracteres más definidos y uniformes que una foto del monitor. La foto puede añadir reflejos, franjas de muaré y perspectiva, dificultando distinguir letras y cifras.

Usa OCR de PDF para varias páginas

Aquí se procesa una imagen por trabajo. Si tus páginas ya forman un PDF, OCR de PDF permite reconocer todo el documento o un intervalo de páginas en una misma solicitud.

Formatos, uso y conservación

Entrada
JPG, PNG, WebP, HEIC, HEIF, AVIF, BMP y TIFF.
Salida
Texto plano (.txt) o Markdown (.md), en UTF-8, además de copia al portapapeles.
Tamaño por imagen
Hasta 200 MB.
Archivos por trabajo
Una imagen.
Procesamiento
Desde nuestros servidores, con GLM-OCR de Z.ai o Google Gemini; OpenRouter como alternativa ante límites de Gemini. Un trabajo puede durar hasta 30 minutos, sin reintento automático.
Uso y créditos
Cada imagen cuenta como una ejecución. Al agotar el cupo gratuito, los visitantes deben iniciar sesión y cada imagen adicional cuesta 1 crédito.
Marca de agua
No se añade al texto.
Conservación de archivos
Las subidas y archivos de resultado guardados en nuestros servidores se eliminan automáticamente tras 48 horas para visitantes y 30 días para cuentas gratuitas. Los planes de pago pueden conservarlos más tiempo.

Preguntas frecuentes

¿El OCR traduce el texto de la imagen?

No. El resultado mantiene el idioma escrito en la imagen. Elegir un valor en Idioma orientativo ayuda a distinguir caracteres ambiguos, sin pedir traducción. Los fragmentos en otros idiomas también se conservan en su idioma original.

¿Por qué hay letras o números equivocados?

El texto pequeño, borroso o con poco contraste es más difícil de leer, igual que las sombras o las fotos inclinadas. Compara especialmente 0 y O, 1 y l, o rn y m en importes y códigos. Prueba una fuente más nítida, recorta el texto o compara una extracción con el otro motor mediante Idioma orientativo.

¿Cuándo conviene TXT y cuándo Markdown?

Elige TXT para pegar texto en un correo, un formulario o una hoja de cálculo: las tablas reconocidas usan filas separadas y tabulaciones. Elige Markdown para conservar la organización de encabezados, listas y tablas en un editor que interprete ese formato.

¿Un proveedor externo recibe mi imagen?

Sí. Auto-detect envía la imagen a GLM-OCR de Z.ai. Un idioma concreto la envía a Google Gemini, mediante OpenRouter si Gemini alcanza un límite. Nuestros archivos guardados siguen los plazos indicados arriba; esos plazos del sitio no establecen la conservación de datos de los proveedores externos.

¿Qué hago si no se extrae ningún texto?

Si no hay texto legible, el trabajo termina indicando que no se ha extraído texto. Revisa si los caracteres están definidos y tienen tamaño suficiente. Recorta elementos que no necesitas con Recortar imagen y realiza una nueva extracción con una fuente que permita leerlos.