Mercurio 2: Modelo Basado en Difusión para Codificación con IA en Tiempo Real

Qué es Mercury 2
Mercury 2 es un modelo de IA basado en difusión que genera tokens en paralelo en lugar de secuencialmente, utilizando un proceso que refina la salida a lo largo de múltiples pasos. Este enfoque difiere de los modelos autorregresivos tradicionales que decodifican tokens uno por uno.
Especificaciones Técnicas
- Método de generación: Generación basada en difusión en lugar de decodificación secuencial token por token
- Enfoque de procesamiento: Genera tokens en paralelo y los refina a lo largo de unos pocos pasos
- Rendimiento: Afirma 1,009 tokens/seg en GPUs NVIDIA Blackwell
- Precios: $0.25 por 1 millón de tokens de entrada, $0.75 por 1 millón de tokens de salida
- Ventana de contexto: 128K tokens
- Capacidad de razonamiento: Razonamiento ajustable
- Integración de herramientas: Uso nativo de herramientas con salida JSON alineada con esquema
- Compatibilidad API: Compatible con API OpenAI
Casos de Uso Objetivo
Los desarrolladores están posicionando Mercury 2 para:
- Asistentes de codificación
- Bucles agentes (cadenas de inferencia de múltiples pasos)
- Sistemas de voz en tiempo real
- Pipelines RAG/búsqueda con recuperación multi-salto
📖 Read the full source: r/LocalLLaMA
👀 Ver también

Normalización de la desviación en la IA: Por qué fallará tu sistema agentivo
La industria de la IA repite fallos culturales como el del Challenger: tratar las salidas no fiables de los LLM como seguras porque aún no ha ocurrido nada malo. Ejemplos reales de agentes formateando discos duros, borrando bases de datos y creando issues en GitHub.

sseanliu/VisionClaw trae asistencia de IA en tiempo real a las gafas inteligentes Meta Ray-Ban.
La VisiónClaw de sseanliu ofrece un asistente de IA revolucionario para las gafas inteligentes Meta Ray-Ban, combinando voz, visión y acciones autónomas impulsadas por Gemini Live y OpenClaw.

El Efecto Casa Embrujada: Cinco Modos de Falla en el Código Generado por IA
El análisis de las experiencias de los desarrolladores con Claude AI revela un patrón consistente: ganancias iniciales de productividad de 10x seguidas de una deuda técnica acumulativa. La fuente identifica cinco modos de falla específicos, incluyendo dependencias ocultas y parálisis por ventana de contexto.

Claude Sonnet 4.6 Revelado: Capacidades Mejoradas de Codificación y Uso de Computadoras
Claude Sonnet 4.6 presenta una ventana de contexto de 1M de tokens y mejora las habilidades de codificación y uso de computadoras, convirtiéndolo en una fuerte alternativa a los modelos de clase Opus para una gama más amplia de tareas.