RTX 5000 PRO 48GB ofrece 4400 tok/s de almacenamiento en caché de precisión para Qwen3.6-27B

✍️ OpenClawRadar📅 Publicado: 14 de mayo de 2026🔗 Source
RTX 5000 PRO 48GB ofrece 4400 tok/s de almacenamiento en caché de precisión para Qwen3.6-27B
Ad

Un desarrollador se la jugó con la RTX 5000 Pro 48GB ($4300 impuestos incluidos) frente a una Mac Studio, y los números justifican el salto: hasta 4400 tokens/segundo en procesamiento de prompt (PP) y 50–80 tok/s en generación de texto (TG) con Qwen3.6-27B-FP8 y un caché KV de precisión completa BF16.

Desglose de hardware y costos

  • Costo de la GPU: $4300 (impuestos incluidos)
  • Costo total del equipo: $5600 con 64 GB de RAM
  • Límite de contexto: 200K tokens a precisión completa (caché KV BF16)

Puntos de referencia de rendimiento

  • Procesamiento de prompt: 4400 tok/s
  • Generación de texto: 50–60 tok/s para prompts muy grandes, hasta 80 tok/s para prompts más pequeños
  • Modelo: Qwen3.6-27B-FP8 con caché de precisión completa
  • Consumo de energía: Aproximadamente la mitad de una configuración con dos RTX 5090
Ad

Observaciones clave

El usuario armó la PC sin experiencia previa, apoyándose en Claude Code (gastando el 50% de los límites semanales de Claude Code Max en la configuración de vLLM/Linux). Una publicación en Reddit con los ajustes exactos de vLLM para Qwen3.6-27B-FP8 con caché BF16 fue la referencia principal. El autor señala que dos RTX 5090 rendirían mejor, pero con un costo, ruido y consumo de energía significativamente mayores.

📖 Lee la fuente completa: r/LocalLLaMA

Ad

👀 Ver también

🦀
Noticias

Claude Code v2.1.210 corrige el aislamiento de worktree, la opción de aceptación de Ultracode y docenas de errores

Los aspectos destacados incluyen la corrección del aislamiento del worktree del subagente, la corrección de la activación de ultracode, un nuevo contador de tiempo transcurrido y la desaprobación de reglas de permisos.

OpenClawRadar
Los Términos del Contrato del Pentágono con OpenAI Permiten 'Cualquier Uso Legal', Incluyendo Posible Vigilancia
Noticias

Los Términos del Contrato del Pentágono con OpenAI Permiten 'Cualquier Uso Legal', Incluyendo Posible Vigilancia

OpenAI negoció nuevos términos con el Pentágono que incluyen la frase 'cualquier uso legal', lo que según fuentes permite al ejército utilizar la tecnología de OpenAI para programas de vigilancia masiva si son técnicamente legales. Anthropic fue incluida en la lista negra por negarse a ceder en dos líneas rojas: no a la vigilancia masiva de estadounidenses y no a las armas autónomas letales.

OpenClawRadar
Los costos de la API de OpenClaw alcanzaron $275 en 5.5 horas, lo que se proyecta en más de $200K anuales.
Noticias

Los costos de la API de OpenClaw alcanzaron $275 en 5.5 horas, lo que se proyecta en más de $200K anuales.

Un desarrollador que probó OpenClaw con la API GPT-5.4 de OpenAI gastó $275 entre las 11 a.m. y las 4:30 p.m., lo que anualizado supera los $200,000 por año a esa tasa de uso.

OpenClawRadar
Sistema del Agente OpenClaw Roto Después de Actualizaciones Recientes
Noticias

Sistema del Agente OpenClaw Roto Después de Actualizaciones Recientes

Las actualizaciones recientes de OpenClaw han roto la funcionalidad central de los agentes, con usuarios reportando que los agentes no se pueden crear o ejecutar de manera confiable. El sistema anteriormente permitía crear agentes, que aparecían correctamente, ejecutar flujos de trabajo y usarlos para tareas reales.

OpenClawRadar