Ejecuta LLMs locales en tu teléfono con Observer: agentes sin conexión para monitoreo y registro

Observer es una aplicación iOS de código abierto que te permite ejecutar LLM locales en tu teléfono en una configuración completamente offline. Utiliza un bucle de agente simple de n segundos: captura una imagen a través de la cámara (usando modelos multimodales), la procesa con un LLM local y luego ejecuta acciones basadas en la respuesta del modelo. El agente puede iniciarse y detenerse por sí mismo, cumpliendo con la definición de agente de Anthropic (no solo un flujo de trabajo).
Características principales
- 100% offline — no requiere inicio de sesión, no hay llamadas de red para inferencia.
- Soporte de modelos multimodales: el agente ve imágenes y responde con texto.
- Las notificaciones de Discord funcionan sin conexión (otros canales como WhatsApp, Correo electrónico, SMS, Llamadas de voz y Telegram no están disponibles en modo offline debido a la falta de autenticación).
- Registra eventos y puede escribir descripciones en la memoria del agente.
- Intervalo de bucle personalizable (por ejemplo, cada n segundos).
Limitaciones
Debido a que el modo offline no tiene autenticación, las notificaciones push a través de WhatsApp, Correo electrónico, SMS, Llamadas de voz y Telegram no funcionarán. Sin embargo, las notificaciones de Discord funcionan perfectamente.
Disponibilidad
- iOS: Disponible ahora en la App Store.
- Android: Lanzamiento esperado en ~3 días (después del período de prueba de dos semanas).
Cómo funciona (según el tutorial)
El tutorial (enlace abajo) guía la configuración de Observer en modo offline. El bucle central es:
capturar imagen → inferencia LLM multimodal → acción (registrar / notificar por Discord) → repetir cada n segundos
El autor demuestra el uso de la aplicación para monitorear cualquier cosa (por ejemplo, registrar cuándo ocurre algo, escribir descripciones en la memoria).
Primeros pasos
GitHub: github.com/Roy3838/Observer
App Store: Observer AI en la App Store
Para quién es: Desarrolladores que quieran ejecutar agentes de IA privados y offline en su teléfono para monitoreo, registro o alertas, sin dependencias en la nube.
📖 Lee la fuente completa: r/LocalLLaMA
👀 Ver también

Calmkeep: Una Capa de Continuidad Externa para Contrarrestar la Deriva de LLM en Sesiones Extendidas
Calmkeep es una capa de continuidad externa diseñada para contrarrestar la deriva de los LLM en sesiones extendidas, mostrando un 85% de integridad frente al 60% de Claude estándar en una prueba de construcción de backend de 25 turnos y 100% frente al 50% en una sesión legal.

Krasis LLM Runtime Muestra Mejoras de Velocidad de 8.9x en Prellenado y 4.7x en Decodificación en Comparación con Llama.cpp
El runtime Krasis LLM ahora ejecuta tanto el prellenado como la decodificación completamente en GPU con diferentes estrategias de optimización, logrando un prellenado 8.9 veces más rápido y una decodificación 4.7 veces más rápida que llama.cpp en Qwen3.5-122B con una sola GPU 5090.

Orchino: Sistema Local de Orquestación Multi-Agente para Windows con Automatización Paralela de Navegador e Interfaz de Usuario
Orchino es un sistema local de orquestación multiagente para Windows que ejecuta tareas paralelas en el navegador y en Windows sin secuestrar la interfaz de usuario. Una demostración muestra a 4 agentes completando 'Buscar auriculares Sony en Flipkart y Amazon, enviar los resultados por correo electrónico, guardar en el Bloc de notas' en 29.5 segundos utilizando ejecución verdaderamente paralela.

Escalando la Investigación Automatizada de Karpathy con 16 GPUs: Resultados y Métodos
El equipo de SkyPilot le dio a Claude Code acceso a 16 GPUs en un clúster de Kubernetes para ejecutar el proyecto Autoresearch de Karpathy. En 8 horas, el agente envió ~910 experimentos, redujo los bits por byte de validación de 1.003 a 0.974 (una mejora del 2.87%), y alcanzó la mejor pérdida de validación 9 veces más rápido que la ejecución secuencial.