OCR gratuito y local · 21 idiomas · páginas mixtas · sin subir nada
Convertir imagen a Markdown (OCR)
Este conversor de imagen a Markdown transforma una foto o una captura de pantalla con texto impreso en Markdown sin subir la imagen a ningún sitio. El motor OCR funciona dentro de tu navegador en 21 idiomas y lee páginas mixtas: eliges el idioma principal del texto, si hace falta un segundo, y en los sistemas de escritura que no reconocen bien el inglés, el paquete de inglés se carga automáticamente. La imagen se queda en tu dispositivo, y una vez descargados el motor y los paquetes que uses, el conversor sigue funcionando sin conexión.
Imagen → Markdown
Elige una imagen con texto impreso
Elige una foto o captura que tu navegador pueda leer, suéltala aquí o pégala con Ctrl+V / ⌘V. LensUp no la sube.
Solo texto impreso. Una página puede tener dos idiomas: elige el principal, añade un segundo y el inglés se suma a las escrituras que lo necesitan. Las tablas con líneas se convierten en tablas Markdown; la letra manuscrita, las tablas sin líneas, las fórmulas y las columnas son aproximadas: revísalas antes de fiarte.
Pro envía esta foto completa, una sola vez, a través del servidor de LensUp a Mathpix —un reconocedor comercial que lee fórmulas y tablas— y sustituye el Markdown por su resultado (fórmulas como $…$). LensUp no guarda la foto; Mathpix la procesa según sus propias condiciones. Cada corrección consume un uso; 50 usos cuestan 4,99 USD, pago único, sin suscripción.
¿Cómo paso una imagen a Markdown?
Abre el conversor de imagen a Markdown, elige una foto o captura con texto impreso, comprueba el idioma del texto y pulsa «Reconocer texto». LensUp hace el OCR en tu propio dispositivo —con un segundo idioma si la página mezcla dos, y con inglés añadido a las escrituras que lo necesitan—, convierte párrafos, viñetas y listas numeradas en bloques Markdown, y te deja corregir el resultado, copiarlo o descargarlo como .md. La imagen nunca se sube.
Está pensado para el texto que quieres guardar como notas y no como imagen: la página de un libro o de unos apuntes, una diapositiva proyectada, el resumen de una pizarra escrito con letra de imprenta clara, una receta impresa, la etiqueta de un producto, un formulario o el párrafo de un cartel. El texto reconocido llega como Markdown editable, listo para Obsidian, Notion, un issue de GitHub o cualquier cuaderno de texto plano.
Está pensado a propósito para una tarea muy concreta. Solo lee texto impreso, en el idioma que eliges más un segundo opcional; conserva la estructura que puede ver —párrafos, viñetas, listas numeradas, títulos grandes y tablas con líneas— y deja las columnas, la letra manuscrita y la notación matemática como texto aproximado que conviene revisar línea a línea. Pasar imagen a Markdown, imagen a MD, foto a Markdown, captura a Markdown, JPG a Markdown, OCR de foto a texto: el nombre cambia, la tarea es la misma, y el resultado es siempre un Markdown que revisas antes de fiarte de él.
Cómo pasar una imagen a Markdown
- Elige una imagenEscoge una foto o captura con texto impreso, arrástrala a la herramienta o pégala desde el portapapeles con Ctrl+V / ⌘V. JPG, PNG, WebP, HEIC de iPhone y TIFF se leen en local; la página muestra la imagen y su tamaño sin subir nada.
- Confirma el idioma y reconoce el textoElige el idioma del texto impreso (el menú preselecciona el de esta página), añade un segundo idioma si la página mezcla dos y pulsa «Reconocer texto». La primera vez se descargan el motor OCR (unos 1,5 MB) y los paquetes de idioma necesarios (de 0,4 a 3 MB cada uno); después quedan en caché. La lectura se hace en tu dispositivo, con barra de progreso.
- Revisa, copia o descargaEl Markdown aparece en un cuadro editable junto a la foto, con el recuento de palabras o caracteres y la confianza media. Corrige lo que el motor haya leído mal y cópialo al portapapeles o descárgalo como archivo .md.
Qué se convierte en Markdown y qué no
Cada párrafo impreso pasa a ser un párrafo Markdown: los saltos de línea se unen y las palabras partidas con guion al final de línea se recomponen; las líneas en chino, japonés o tailandés se unen sin espacios y se cuentan en caracteres, no en palabras. Las líneas que empiezan con un símbolo de viñeta forman una lista; las que empiezan con 1., 2., 3. —o con 一、二、三 y 1、2、3 en textos de Asia oriental— forman una lista numerada; y una línea corta, sola, impresa claramente más grande que el cuerpo o toda en mayúsculas, se convierte en un título de segundo nivel. Todo lo demás se conserva como texto plano en orden de lectura.
Una tabla dibujada con líneas se convierte en tabla Markdown: la cuadrícula se borra antes del reconocimiento, cada fila impresa pasa a ser una fila y los huecos que comparten las filas definen las columnas; por eso las celdas combinadas y las tablas sin líneas salen como líneas de texto. Las fórmulas matemáticas no se reconocen —fracciones, exponentes y símbolos salen desordenados—; los textos a dos columnas pueden quedar entremezclados; la letra manuscrita, las tipografías decorativas, la letra muy pequeña y el texto sobre fondos cargados se leen mal o se omiten. Cifras, nombres y códigos merecen una segunda mirada: un carácter equivocado ahí pesa más que en un párrafo. La confianza media que aparece bajo el resultado es la estimación del propio motor, no una garantía.
Cómo sacar una lectura limpia con la cámara del móvil
El reconocimiento óptico de caracteres rinde mejor con una página plana, texto nítido, bien iluminado y fotografiado de frente, con una nitidez parecida a la de un escaneo a 300 ppp. Llena el encuadre con el texto, evita sombras y reflejos y no muevas el móvil hasta que enfoque. Las fotos muy grandes se reducen a 2600 px de lado mayor antes de reconocerlas: el texto normal de un libro o un documento sigue siendo perfectamente legible y se ahorra memoria y tiempo.
Si la página está torcida o con sombras, pásala antes por el escáner de LensUp: la corrección de perspectiva y la eliminación de sombras dan una página plana y de alto contraste, y el JPG o PNG descargado del escáner es una entrada excelente aquí. El reconocedor también acepta capturas de pantalla, que suelen ser el caso más fácil de todos.
Cuando el motor local no basta: corregir con Pro
Tesseract, el motor de código abierto detrás de la opción gratuita, no lee notación matemática y sufre con las tablas sin líneas o con celdas combinadas. Para esas páginas, el cuadro de resultado puede ofrecer «Corregir con Pro», una opción de pago que aparece cuando los pagos están activos en el sitio: la foto completa se envía una sola vez, a través del servidor de LensUp, a Mathpix —un reconocedor comercial hecho para fórmulas y tablas— y su Markdown sustituye al resultado local, con las fórmulas en LaTeX entre signos de dólar y las tablas como tablas Markdown. LensUp no guarda nada por el camino (Mathpix procesa la foto según sus propias condiciones); el resultado local queda a un clic.
Pro se paga por uso precisamente para que la opción gratuita siga siendo gratuita y local: mientras se ofrece, inicias sesión con un enlace por correo (sin contraseña), compras 50 usos mediante un pago único de 4,99 USD, sin suscripción y cada corrección con Pro consume uno. Si la llamada al proveedor falla, no se descuenta ningún uso.
Idiomas mezclados, en tu dispositivo, a propósito
La página ofrece 21 idiomas: inglés, francés, alemán, español, portugués, italiano, polaco, turco, indonesio, vietnamita, chino (simplificado y tradicional), japonés, coreano, ruso, árabe, persa, urdu, hindi, bengalí y tailandés, los mismos que habla LensUp. Cada idioma es un paquete aparte que solo se descarga cuando lo eliges: una página en francés requiere descargar un paquete de 0,7 MB y una en chino unos 1,7 MB, nunca el conjunto entero. Elige el idioma que de verdad está impreso y añade un segundo si la página mezcla dos; el paquete de inglés se carga automáticamente junto con los paquetes de coreano, ruso, árabe, persa, urdu, hindi, bengalí y tailandés, cuyos paquetes convierten las palabras inglesas en letras parecidas. Con el paquete equivocado salen fragmentos en vez de Markdown, la línea de estado lo avisa, y «Detectar el idioma» encuentra el paquete correcto probando uno por sistema de escritura, así que una página mixta también acaba en Markdown limpio.
Todo se ejecuta en local con un motor de código abierto, igual que el resto de LensUp procesa imágenes: sin subida, sin cuenta, sin copia de tu foto ni de su texto en ningún servidor. Los archivos del motor y los paquetes se sirven desde lensup.ai y tu navegador los guarda en caché, así que el segundo reconocimiento en un idioma empieza al instante. Las herramientas del escáner siguen sin incluir OCR y no generan PDF con texto buscable.
Preguntas frecuentes
¿La imagen sale de mi dispositivo al convertir una imagen a Markdown?
En la opción gratuita, no: el motor OCR y el paquete del idioma que elijas se descargan a tu navegador y el reconocimiento ocurre ahí, así que ni la foto, ni el texto reconocido, ni el archivo .md llegan a un servidor de LensUp. La única excepción es explícita y voluntaria: cuando el cuadro de resultado ofrece «Corregir con Pro» (una opción de pago que aparece con los pagos activos), ese clic envía la foto completa a través de LensUp a Mathpix (un reconocedor comercial para fórmulas y tablas) y devuelve su Markdown; LensUp no guarda nada por el camino (Mathpix la procesa según sus propias condiciones), requiere iniciar sesión con el correo y usos de pago (50 usos por 4,99 USD, pago único), y el resultado local se puede restaurar.
¿Qué idiomas admite el conversor de imagen a Markdown?
Veintiún idiomas impresos: inglés, francés, alemán, español, portugués, italiano, polaco, turco, indonesio, vietnamita, chino (simplificado y tradicional), japonés, coreano, ruso, árabe, persa, urdu, hindi, bengalí y tailandés. Una página puede tener dos: elige el principal, añade un segundo si está mezclada, y el inglés se lee automáticamente junto al coreano, ruso, árabe, persa, urdu, hindi, bengalí y tailandés, porque esos paquetes por sí solos convierten las palabras inglesas en letras parecidas. La letra manuscrita no se admite en ningún idioma.
¿Por qué hay texto mal leído o que falta?
Lo primero es comprobar el paquete de idioma: el aviso bajo el Markdown ofrece «Detectar el idioma», que prueba un paquete por sistema de escritura y se queda con el mejor. Después, la foto: desenfoque, reflejos, sombras, inclinación, letra pequeña, tipografías decorativas y fondos cargados bajan la calidad, y las tablas o las páginas a varias columnas pueden salir en otro orden. Vuelve a fotografiar la página bien plana y procura que salga nítida, o límpiala antes en el escáner, y revisa el Markdown antes de usarlo.