AndroidHarness es un agente de programación que reside en tu teléfono. Trabaja en proyectos reales directamente desde el dispositivo: lee y edita archivos, ejecuta comandos de shell, controla Git, gestiona un navegador y ejecuta herramientas MCP. No requiere PC.
Código abierto bajo licencia MIT: https://github.com/Sanuu7/AndroidHarness
ENTORNO DE EJECUCIÓN DEL AGENTE
Chatea con un agente de programación: respuestas en tiempo real, bloques de ideas y tarjetas de herramientas interactivas. Adjunta habilidades, código y PDF. Organiza seguimientos durante las ejecuciones o aprueba acciones desde las notificaciones. Los puntos de control se conservan tras reiniciar la aplicación. La planificación dual inspecciona y planifica antes de la ejecución. El servicio en primer plano mantiene las ejecuciones activas incluso con la pantalla apagada.
57 HERRAMIENTAS INTEGRADAS
- Archivos: leer, escribir y editar archivos, edición múltiple (búsqueda y reemplazo aproximada), aplicar parches con reversión, grep, buscar archivos, información de archivos, copiar, mover y eliminar archivos por lotes.
- Shell: shell con tiempos de espera y limpieza de grupos de procesos, gestor de demonios en segundo plano (shell_background, bg_list, bg_kill).
- Git: git_status, git_diff, git_log, git_show (vista de parches), git_commit, git_branch, git_branch_manage, git_checkout, git_push con reparación de repositorio remoto, git_pull.
- Sistema y Diagnóstico: read_logcat con filtros de paquetes y etiquetas, suite de autodiagnóstico doctor, sonda env_status.
- Visión y Web: read_image para modelos de visión, extracción de texto de PDF, búsqueda web (keyless, Brave, Tavily), web_fetch, http_request con detección de binarios.
- Agente y Memoria: memory_read, memory_write, memory_search, seguimiento en tiempo real de todo_write, solicitudes ask_user, tarea (subagentes paralelos), pkg_search, pkg_install, pkg_list.
PROTOCOLO DE CONTEXTO DEL MODELO (MCP)
Conecta ecosistemas de herramientas externas mediante MCP:
- Conecta servidores a través de stdio, HTTP y Server-Sent Events (SSE).
- Importa configuraciones pegando archivos JSON de Claude Desktop o MCP.
- Los servidores exponen herramientas personalizadas dinámicamente al entorno de ejecución del agente.
- Autenticación OAuth 2.0 integrada mediante pestañas personalizadas de Chrome para servicios autenticados.
- Las aprobaciones por espacio de trabajo y la validación de integridad HMAC protegen la ejecución.
NAVEGADOR DEL AGENTE (13 HERRAMIENTAS)
Automatización del navegador sin interfaz gráfica en 13 herramientas: browser_navigate, browser_click, browser_type, browser_scroll, browser_wait_for, browser_eval, browser_get_logs, browser_screenshot, browser_back, browser_forward, browser_refresh, browser_get_url, browser_get_dom. Previsualiza aplicaciones web con DevTools, marcos de dispositivo y corrección de errores con un solo toque en el agente.
ARCHIVOS, EDITOR, TERMINAL
Gestor de archivos con selección múltiple y procesamiento por lotes. Editor de código con resaltado de sintaxis (Kotlin, Java, Python, JS, TS, HTML, Shell), numeración de líneas, deshacer ilimitado, búsqueda con expresiones regulares y guardado con conservación de la codificación. Visualizador de diferencias en paralelo. Sesiones de terminal interactivas.
AUTOMATIZACIONES Y COMPILACIÓN
Automatizaciones programadas en segundo plano mediante WorkManager: planificador de programación, intervalos preestablecidos, historial de ejecución y alertas. Panel de control de compilación y pruebas para comandos Gradle y conjuntos de pruebas con registros en tiempo real y corrección de errores con un solo toque para compilaciones fallidas.
MODELOS Y CACHÉ
Acceso sin clave mediante el proveedor Harness integrado o con claves API para Anthropic, Gemini, OpenAI o URL personalizadas. Catálogo en tiempo real con sondeos de latencia, precios exactos y seguimiento de costes en tiempo real. Monitorización de caché de solicitudes: aciertos, fallos, tokens de lectura/escritura y tasas de acierto. Escalas de pensamiento desde lo básico hasta lo avanzado.
SEGURIDAD POR DISEÑO
Niveles de ejecución: Shizuku, conjunto de herramientas de Linux (bash, git, python, node), alternativa de shell de Toybox. La política de shell limita las operaciones al espacio de trabajo. El sistema de filtrado de secretos elimina las claves API. Cuatro modos de permisos: confirmar todo, confirmar riesgos, automático completo, acceso completo. Bloqueo biométrico de la aplicación.
HABILIDADES Y MEMORIA
23 habilidades Markdown integradas (planificación, TDD, depuración, arquitectura) más habilidades personalizadas. Seguimiento de tareas en tiempo real, indexación del código fuente mediante el mapa del repositorio, entrada de voz Groq Whisper, bifurcación de sesiones, memoria persistente.
PRIMEROS PASOS
1. Otorgar acceso de almacenamiento a los archivos del proyecto.
2. Usar el proveedor sin clave integrado o introducir una clave API en Configuración.
3. Opcional: conectar Shizuku para la ejecución de shell con privilegios.
Sin análisis, anuncios ni rastreadores. Los datos solo fluyen a los puntos finales configurados. Informar de los problemas en GitHub.
Plataforma de codificación de IA en tu dispositivo: shell, archivos, editor de código, git y MCP.
Actualización
26 sept 2026