TextGen (text-generation-webui) torna-se aplicativo desktop nativo com versões portáteis
O TextGen (antigo text-generation-webui, também conhecido como oobabooga) lançou uma versão nativa para desktop. O projeto, em desenvolvimento desde dezembro de 2022, agora oferece versões portáteis — basta baixar, descompactar e clicar duas vezes em textgen. Sem instalação ou arquivos fora da pasta extraída. Todo o histórico de chats e configurações ficam em uma pasta user_data inclusa.
Principais Recursos
- Privacidade: Nenhuma requisição externa. Ao contrário do LM Studio, ele não envia informações sobre SO, CPU, versão do app ou backends escolhidos.
- Builds ik_llama.cpp: Inclui tipos de quantização personalizados como IQ4_KS e IQ5_KS para melhor precisão em comparação com o llama.cpp padrão usado pelo LM Studio e Ollama.
- Pesquisa web integrada: Usa a biblioteca Python
ddgs. Dois modos: chamada de ferramenta com a ferramentaweb_search(funciona com Qwen 3.6 e Gemma 4) ou uma caixa de seleção que busca resultados como anexos de texto. - Chamada de ferramentas: Suporta ferramentas .py de arquivo único (funções personalizadas fáceis), servidores HTTP MCP e servidores stdio MCP. Opção de exigir confirmação de aprovação/rejeição antes de executar chamadas de ferramenta. Guia aqui.
- Personagens personalizados: Crie personagens para chats casuais junto com conversas de instrução.
- Compatibilidade de API: API compatível com as especificações OpenAI e Anthropic. Funciona com Claude Code:
ANTHROPIC_BASE_URL=http://127.0.0.1:5000 claude. - Extração de PDF: Usa PyMuPDF para extração precisa de texto.
- Busca de páginas web: Usa
trafilaturapara remover navegação/ conteúdo irrelevante, economizando tokens em loops agentes. - Templates Jinja2: Renderiza templates de chat via Python Jinja2, evitando travamentos na reimplementação em C++ do jinja do llama.cpp.
Versões Disponíveis
CUDA, Vulkan, apenas CPU, Mac (Apple Silicon e Intel) e ROCm. Todas portáteis.
Licença: AGPLv3. Fonte: https://github.com/oobabooga/textgen
📖 Leia a fonte completa: r/LocalLLaMA
👀 See Also

Duas Habilidades Gratuitas do Claude Code: Gerador de Tutoriais e Corretor de Prompts
Duas novas habilidades gratuitas do Claude Code: create-tutorial gera tutoriais de leitura de código a partir dos arquivos reais do seu projeto, e prompter reescreve prompts cheios de erros de digitação em instruções acionáveis. Ambas são licenciadas MIT e instaladas via GitHub.

Homebutler: Habilidade OpenClaw para Gerenciamento de Homelab via Telegram
Homebutler é um binário único em Go (~13MB, sem dependências) que funciona como uma habilidade do OpenClaw para gerenciar homelabs a partir do chat do Telegram. Ele monitora servidores, reinicia contêineres Docker, liga máquinas, escaneia redes e alerta sobre picos de recursos sem sessões SSH ou logins em painéis.

MoltNow.app: Plataforma de Implantação OpenClaw com Um Clique Surge
Um novo serviço promete simplificar a implantação do OpenClaw para apenas um clique, com interface personalizada e automação de navegador.
VMs macOS com Apple Silicon: Inferência de LLM 11–16× mais rápida com Shim de Capacidade Metal
O shim de capacidade Metal com escopo de processo da Cua desbloqueia kernels mais novos em VMs macOS, acelerando a inferência do llama.cpp em até 16× no Apple Silicon. Lançamento de pesquisa em código aberto.