Scan Empire és una aplicació Android robusta i moderna dissenyada per a la digitalització de documents en paper, el reconeixement òptic de caràcters (OCR) avançat i la conversió de fitxers multiformat a PDF. Desenvolupada a Kotlin utilitzant el marc de treball declaratiu d'interfície d'usuari Jetpack Compose, segueix una arquitectura MVVM estricta i principis de codi net. La major part del processament es realitza localment al dispositiu, garantint la màxima privadesa i seguretat de les dades de l'usuari.
⚙️ Característiques principals i arquitectura del sistema
1. Sistema OCR híbrid (fora de línia i en línia)
L'aplicació ofereix flexibilitat a través de dos modes de reconeixement de text:
OCR local (Tesseract): utilitza una TessBaseAPI personalitzada (Tesseract4Android) per al reconeixement de text completament fora de línia. L'aplicació descarrega models d'idioma en temps real si no hi són presents. Google ML Kit està integrat per a la detecció automàtica d'idiomes i s'implementa un algoritme de comparació de puntuacions de confiança per al reconeixement automàtic d'escriptures (ciríl·lic vs. llatí).
OCR al núvol (Google Cloud Vision): s'utilitza per a dissenys complexos o documents de baixa qualitat. Integrat mitjançant un sistema de crèdits, permet un reconeixement avançat basat en núvol sense degradar el rendiment del dispositiu.
2. Processament avançat d'imatges i integració amb OpenCV
Abans d'executar l'OCR, la imatge se sotmet a un procés avançat de filtratge i correcció geomètrica:
Correcció geomètrica (desinclinació): OpenCV redreça automàticament els documents inclinats i detecta les vores.
Optimització visual: S'eliminen les ombres i s'aplica la binarització adaptativa (llindar d'Otsu) per maximitzar el contrast entre el text i el fons.
Gestió de memòria: A causa de les grans mides d'imatge, l'aplicació utilitza objectes Mat compartits i gestiona acuradament els recursos per evitar errors OutOfMemory (OOM).
3. Reconstrucció intel·ligent de PDF (PdfReconstructor)
Utilitzant la biblioteca PDFBox-Android, l'aplicació converteix el text reconegut en documents PDF amb capacitat de cerca:
Espaiat intel·ligent: L'algoritme calcula la disposició i l'espaiat exactes entre les paraules en funció de les seves coordenades de la imatge, preservant l'estructura original del document.
Superposició híbrida (PDF amb capacitat de cerca): El text es representa com una capa invisible directament a sobre de la imatge original. L'usuari veu visualment el document escanejat, però pot cercar, seleccionar i copiar text.
4. Conversions i manipulació de fitxers
Totes les conversions es realitzen localment per protegir la privadesa de l'usuari:
Conversors locals: Converteix documents DOCX, Excel i TXT a PDF.
Fusió de documents: Combina diverses imatges o fitxers PDF existents en un sol document PDF.
5. Seguretat, emmagatzematge i monetització
L'aplicació està dissenyada com un producte comercial sostenible:
Autenticació: Inici de sessió segur i vinculació de comptes mitjançant Google Credential Manager.
Emmagatzematge: Utilitza Android Storage Access Framework (SAF), que permet als usuaris triar la seva ruta de desament preferida al dispositiu o a la targeta SD.
Monetització: Facturació de Google Play integrada per a la compra de crèdits o subscripcions a la botiga Premium. L'ús gratuït és compatible amb anuncis no intrusius (AdManager).
📐 Pila tècnica
Processament asíncron: Coroutines i fluxos de Kotlin per executar processos pesats (escaneig, OCR, descàrrega de models) en segon pla.
Injecció de dependències: Hilt (Dagger) garanteix una separació clara de les preocupacions, proves més fàcils i extensibilitat de l'aplicació.
💡 Resum
Scan Empire és un ecosistema complet de digitalització mòbil. Combinant el processament local d'OpenCV, l'OCR híbrid i la reconstrucció intel·ligent de PDF, ofereix capacitats d'escaneig professionals en una interfície moderna i optimitzada.
Converteix imatge a PDF, extreu text, inicia la sessió al document, fusiona, protegeix.
S'ha actualitzat el dia:
26 de set. 2026