Saltar al contenido
Portada » Blog » OCR gratis en Android sin conexión ni cuenta: la app que no sube tus docs

OCR gratis en Android sin conexión ni cuenta: la app que no sube tus docs

Adobe Scan te pide cuenta. Microsoft Lens sube tus tickets a OneDrive aunque no quieras. Google Lens necesita conexión sí o sí. Y tú solo querías copiar el texto de una foto. Hay una app en F-Droid que lleva años haciendo exactamente eso sin pedirte nada a cambio. El problema es que casi nadie sabe configurarla bien.

Qué hace esta app y qué no hace (por mucho que insistas)

La app se llama OCR, la firma Subham Tyagi, y está en F-Droid desde hace años. Usa el motor Tesseract mediante la librería tess-two, y todo el procesamiento ocurre dentro de tu móvil. Sin conexión. Sin cuenta. Sin que un servidor en California vea tu DNI.

El flujo es simple: seleccionas una imagen de la galería, eliges el idioma del texto, y obtienes el resultado en texto plano que puedes copiar o compartir. Soporta más de 50 idiomas descargables. El APK pesa 14,7 MB en su versión 2.0.3 (comprobado en mi Pixel 8 con GrapheneOS, abril de 2026). Los paquetes de idioma se descargan aparte: el de español son 4,2 MB.

Pero esta app no es un escáner. No corrige perspectiva. No endereza documentos torcidos. No mejora la iluminación. Si le pasas la foto de un ticket arrugado tomada con prisa en un bar con luz de vela, el resultado será basura. Tesseract es un motor de OCR estadístico, no una red neuronal entrenada con millones de documentos. En 2026 eso se nota.

Lo que sí hace bien: extraer texto de capturas de pantalla, PDFs exportados como imagen, fotos tomadas en plano con buena luz, documentos impresos escaneados con una app de cámara decente. Para eso es casi perfecta.

Instalación y primera configuración (sin esto no funciona)

La app no está en Google Play. Solo en F-Droid. Si nunca has instalado nada fuera de Play, necesitas habilitar fuentes desconocidas para F-Droid. El proceso completo:

  1. 1
    Instala F-Droid desde f-droid.org. Tu navegador te pedirá permiso para instalar APKs. Concédeselo solo para esta descarga.
  2. 2
    Abre F-Droid, busca OCR. El desarrollador aparece como Subham Tyagi. Pulsa Instalar.
  3. 3
    Abre la app. Ve al icono del engranaje → Idioma de OCRDescargar idioma → selecciona Spanish. Sin este paso la app no reconocerá texto en español. La descarga pesa 4,2 MB.
  4. 4
    Vuelve a la pantalla principal, pulsa Seleccionar imagen, elige tu foto y pulsa Obtener texto. El procesamiento tarda entre 2 y 10 segundos según el dispositivo y el tamaño de la imagen.

Un detalle que no vi en ningún tutorial: si descargas varios idiomas, la app usa el último que seleccionaste, no detecta el idioma automáticamente. Si procesas una imagen en inglés después de haber configurado español, el resultado será un galimatías. Tienes que cambiar el idioma manualmente cada vez.

Comparativa con las alternativas que sí suben tus documentos

Probé las tres. Adobe Scan en un Pixel 8, Microsoft Lens en el mismo dispositivo, y OCR de F-Droid durante dos semanas con los mismos 20 documentos. Esto es lo que encontré:

Alternativa
Adobe Scan
Gratis con Adobe ID / Creative Cloud desde 54,99 €/mes
OCR muy preciso con IA
Corrige perspectiva automáticamente
Requiere cuenta Adobe
Sube documentos a servidores Adobe
Sin conexión no funciona

Alternativa
Microsoft Lens
Gratis / Microsoft 365 desde 7 €/mes
Buena corrección de perspectiva
Integración con OneNote
Requiere cuenta Microsoft
Datos en OneDrive por defecto
Telemetría de uso activada

Recomendada
OCR (Subham Tyagi)
Gratis / Código abierto (MIT)
100% offline
Sin rastreo
Sin cuenta
Código auditable
Sin corrección de perspectiva
Precisión menor en imágenes malas

Adobe Scan y Microsoft Lens son técnicamente superiores en precisión. Eso es indiscutible. Sus motores de OCR con redes neuronales entrenadas durante años sacan texto de imágenes que Tesseract simplemente no puede procesar. Pero ambas envían tus imágenes a servidores externos. Adobe Scan ni siquiera funciona sin conexión. Microsoft Lens permite modo offline pero la configuración de privacidad está a tres menús de profundidad y la telemetría sigue activa aunque la desactives (lo comprobé con un análisis de tráfico en mi red local).

Si estás digitalizando tu DNI, una nómina, un contrato o cualquier documento con datos personales, la diferencia no es técnica: es legal y de privacidad.

Lo que nadie te cuenta sobre el rendimiento real

He pasado 47 imágenes por esta app en las últimas dos semanas. Capturas de pantalla de artículos, fotos de documentos impresos, tickets de compra, incluso la etiqueta de ingredientes de un bote de mermelada. Esto es lo que aprendí:

Con capturas de pantalla el resultado es prácticamente perfecto. Cero errores en texto nítido sobre fondo blanco. El procesamiento tarda 2-3 segundos en un Pixel 8.

Con fotos de documentos impresos tomadas en plano y con buena luz, la precisión ronda el 95%. Algún carácter suelto falla, pero el texto es perfectamente usable.

Con tickets de compra la cosa cambia. El papel térmico, los caracteres pequeños, la falta de contraste: Tesseract sufre. De 10 tickets que probé, solo 3 dieron un resultado aceptable sin necesidad de retocar la imagen antes.

El cuello de botella no es la app. Es la calidad de la imagen que le pasas. Tesseract espera texto negro sobre fondo claro, bien alineado, sin distorsiones. Cualquier desviación de ese ideal y el resultado se degrada rápido.

Dos cosas que mejoran drásticamente la precisión y que no he visto en ninguna reseña de esta app:

Recorta la imagen antes de procesar

Si la foto tiene margen, fondo de mesa, dedos o cualquier elemento que no sea texto, el motor se confunde. Usa el editor de tu galería para recortar solo la zona con texto. En un test con 10 imágenes, el recorte previo redujo los errores de caracteres en un 40% de media. El tiempo de procesamiento también baja porque la imagen es más pequeña.

Cambia el modo de segmentación de página

Entra en Ajustes → Page Segmentation Mode. El valor por defecto es 3 (Auto). Para documentos de una sola columna, usa el valor 6 (Assume a single uniform block of text). Para texto disperso con espacios irregulares, usa 11 (Sparse text). Probé el modo 6 con 15 documentos de texto corrido y la precisión mejoró notablemente frente al modo automático, que tendía a fusionar líneas o insertar saltos donde no correspondía.

Un caso límite que probé: una foto de una pizarra en una sala de reuniones con luz fluorescente, texto escrito a mano con rotulador azul sobre fondo blanco sucio. La app devolvió un 30% de caracteres correctos. El resto era ruido. Para eso necesitas un OCR con IA, no Tesseract.

Privacidad real: qué permisos pide y qué hace con ellos

Según Exodus Privacy, la app tiene 0 trackers. Cero. Ni uno. El análisis de la versión 2.0.3 disponible en F-Droid lo confirma.

Los permisos que solicita son:
CAMERA: solo si quieres capturar la foto desde la app. Si usas imágenes de la galería, no necesitas concederlo.
READ_EXTERNAL_STORAGE / READ_MEDIA_IMAGES: para acceder a las imágenes que seleccionas. En Android 13 y superior usa el selector de fotos del sistema, que no requiere este permiso.
INTERNET: únicamente para descargar los paquetes de idioma. Una vez descargados, puedes revocar este permiso y la app sigue funcionando perfectamente offline. Lo comprobé: desactivé datos móviles y WiFi, procesé 10 imágenes, sin problemas.

No hay permisos de ubicación, no hay acceso a contactos, no hay telemetría. El código fuente está en GitHub con licencia MIT. El repositorio tiene 1.200 estrellas y el último commit es de marzo de 2025. Hay 23 issues abiertos, la mayoría sobre problemas con idiomas específicos o solicitudes de nuevas funciones. No es un proyecto abandonado, pero tampoco tiene un ritmo de desarrollo frenético.

Un detalle que solo ves si revisas el código: la app usa la librería tess-two, que es un fork de Tesseract para Android mantenido por la comunidad. Tess-two tampoco ha recibido actualizaciones mayores desde 2023. Eso significa que el motor de OCR subyacente está congelado en el tiempo mientras los OCR comerciales avanzan con redes neuronales. Para documentos limpios no importa. Para casos difíciles, sí.

El dato que más me importa: ni un solo píxel de tus imágenes sale del dispositivo. Puedes verificarlo tú mismo con una app como NetGuard o RethinkDNS: la app no genera tráfico de red al procesar imágenes. Solo se conecta para descargar idiomas.

Cuándo merece la pena y cuándo es mejor buscar otra cosa

Uso esta app desde 2019. La tengo instalada en todos mis dispositivos. Pero no es para todo.

Merece la pena si:
– Procesas capturas de pantalla con texto
– Digitalizas documentos impresos en condiciones decentes
– Te importa la privacidad más que la precisión absoluta
– Necesitas OCR sin conexión (viajes, zonas sin cobertura)
– Quieres extraer texto de PDFs basados en imagen

No merece la pena si:
– Tus fotos son de tickets arrugados, pizarras, carteles en la calle
– Necesitas corrección de perspectiva automática
– Procesas documentos con tipografías decorativas o texto manuscrito
– La precisión del 100% es crítica para tu flujo de trabajo

Para esos casos, Adobe Scan o Microsoft Lens son técnicamente superiores. Pero asume que tus documentos viajan a servidores que no controlas.

No es la app de OCR más precisa de 2026. Pero es la única que no te obliga a elegir entre tu privacidad y extraer texto de una imagen. Para el 80% de los casos cotidianos funciona sin pedirte nada a cambio. A veces eso es exactamente lo que necesitas.