TextGen (text-generation-webui) se convierte en aplicación de escritorio nativa con compilaciones portátiles
TextGen (anteriormente text-generation-webui, también conocido como oobabooga) ha lanzado una versión nativa de aplicación de escritorio. El proyecto, en desarrollo desde diciembre de 2022, ahora ofrece versiones portátiles: solo descarga, descomprime y haz doble clic en textgen. Sin instalación ni archivos fuera de la carpeta extraída. Todo el historial de chats y configuraciones residen en una carpeta user_data incluida.
Características principales
- Privacidad: Cero solicitudes salientes. A diferencia de LM Studio, no envía información del sistema operativo, CPU, versión de la aplicación o selección de backend.
- Compilaciones ik_llama.cpp: Incluye tipos de cuantización personalizados como IQ4_KS e IQ5_KS para mayor precisión en comparación con vanilla llama.cpp utilizado por LM Studio y Ollama.
- Búsqueda web integrada: Utiliza la biblioteca Python
ddgs. Dos modos: llamada a herramientas con la herramientaweb_search(funciona con Qwen 3.6 y Gemma 4) o una casilla de verificación que obtiene resultados de búsqueda como archivos de texto adjuntos. - Llamada a herramientas: Soporta herramientas .py de un solo archivo (funciones personalizadas fáciles), servidores HTTP MCP y servidores stdio MCP. Opción para requerir aprobación/rechazo antes de ejecutar llamadas a herramientas. Guía aquí.
- Personajes personalizados: Crea personajes para chats casuales junto con conversaciones de instrucciones.
- Compatibilidad de API: API compatible con las especificaciones de OpenAI y Anthropic. Funciona con Claude Code:
ANTHROPIC_BASE_URL=http://127.0.0.1:5000 claude. - Extracción de PDF: Utiliza PyMuPDF para una extracción precisa de texto.
- Obtención de páginas web: Utiliza
trafilaturapara eliminar navegación y contenido superfluo, ahorrando tokens en bucles agentivos. - Plantillas Jinja2: Renderiza plantillas de chat mediante Python Jinja2, evitando fallos en la reimplementación de jinja en C++ de llama.cpp.
Versiones disponibles
CUDA, Vulkan, solo CPU, Mac (Apple Silicon e Intel) y ROCm. Todas portátiles.
Licencia: AGPLv3. Fuente: https://github.com/oobabooga/textgen
📖 Leer la fuente completa: r/LocalLLaMA
👀 Ver también

Desarrollador Crea la Aplicación LibraHQ para Resolver el Problema de Memoria de Agentes de IA
Un desarrollador creó LibraHQ, una aplicación gratuita de notas que sirve como una capa de memoria compartida entre chatbots y agentes de programación. La aplicación registra notas y decisiones importantes de los chats y las almacena para sesiones futuras, abordando el problema de que los agentes de IA olviden decisiones previamente tomadas.

Prefex: Un Proxy Local para Claude Code que Automatiza el Almacenamiento en Caché de Prompts y la Memoria de Sesión
Prefex es un proxy local que se sitúa entre Claude Code y la API de Anthropic, inyectando automáticamente el encabezado requerido para la función beta de caché de prompts de Anthropic. También implementa memoria de sesión para evitar reenviar el historial completo de la conversación e incluye un enrutador de modelos para optimizar costos.

El Complemento de Código Claude Lanza DOOM en la Terminal Mientras la IA Piensa
Un desarrollador ha creado un complemento de Claude Code que muestra DOOM como una superposición emergente de tmux durante el procesamiento de IA. El complemento utiliza doom-ascii, una versión adaptada de DOOM basada en terminal, y se inicia/cierra automáticamente con las solicitudes.

JavaClaw Beta: Asistente de IA Basado en Java Construido sobre Spring AI y JobRunr
El equipo de JobRunr lanzó JavaClaw beta, una versión Java de OpenClaw que se ejecuta localmente con soporte multicanal, elección de LLM y procesamiento de trabajos en segundo plano mediante JobRunr. Construido con Spring Boot 4, Spring AI y Spring Modulith.