Feynman: Agente de Investigación de Código Abierto con Herramienta de Auditoría de Base de Código de Artículos

Qué hace Feynman
Feynman es un agente de investigación CLI de código abierto que maneja preguntas de investigación a través de una arquitectura multiagente. Cuando haces una pregunta de investigación, despacha cuatro subagentes en paralelo:
- Investigador: Busca artículos y en la web
- Revisor: Ejecuta una revisión por pares simulada con calificación de severidad
- Escritor: Produce resultados estructurados
- Verificador: Verifica cada cita y elimina enlaces rotos
Características clave de la fuente
La característica destacada mencionada en la fuente es la herramienta de auditoría: Feynman audit [arxiv-id] extrae las afirmaciones de un artículo y las compara con el repositorio de código público real. Esto aborda el problema común de preguntarse si el código publicado realmente implementa lo que se afirma en el artículo.
Otras capacidades incluyen:
- Replicación de experimentos en GPUs locales o en la nube a través de modal/runpod
- Revisiones de literatura que muestran consenso vs desacuerdos vs preguntas abiertas
- Modo de investigación profunda con investigación paralela multiagente
- Opción de instalar solo las habilidades de investigación en Claude Code o Codex sin la aplicación completa de terminal
Detalles técnicos
- Instalación de un solo comando
- Licencia MIT
- Construido sobre pi para el tiempo de ejecución del agente
- Utiliza alphaxiv para la búsqueda de artículos
- 2.3k estrellas en GitHub al momento de la publicación de la fuente
- El tweet de lanzamiento recibió 2,768 marcadores de una cuenta con 1,400 seguidores
La arquitectura aborda específicamente los problemas de alucinación comunes en las herramientas de investigación de IA dedicando un agente completo a detectar citas incorrectas antes de que lleguen al usuario.
📖 Read the full source: r/LocalLLaMA
👀 Ver también

NLA transforma las activaciones internas de Gemma 3 en texto legible para cualquier token
Anthropic publicó Natural Language Autoencoders (NLA) que decodifican el estado interno de un modelo en texto. Combinado con Gemma 3, el Auto Verbalizer explica lo que el modelo "pensaba" para cualquier token generado. Los pesos están en Hugging Face; demo en Neuronpedia.

Arquitecto de Agentes: Herramienta Gratuita Genera Archivos Completos de Espacio de Trabajo para Agentes de IA
Agent Architect es una herramienta interactiva gratuita que guía a los usuarios a través de más de 40 preguntas sobre su agente de IA, luego compila todo en un prompt formateado para generar siete archivos de espacio de trabajo de calidad de producción: SOUL.md, IDENTITY.md, AGENTS.md, OPERATIONS.md, TOOLS.md, MEMORY.md y HEARTBEAT.md.

Pruebas de referencia de tonterías: resistencia de LLM a indicaciones sin sentido
El Bullshit Benchmark evalúa si los modelos de IA identifican y rechazan indicaciones obviamente absurdas en lugar de generar respuestas incorrectas con confianza. Los resultados muestran que los modelos Claude tienen un rendimiento significativamente mejor que los modelos Gemini en la detección de preguntas sin sentido.

memv: Sistema de Memoria de Código Abierto para Agentes de IA
memv es un sistema de memoria de código abierto diseñado para agentes de IA que solo almacena información inesperada de las interacciones, reduciendo el ruido y la redundancia.