Desarrollador Considera Cambiar de DeepSeek a Grok para Agente de IA Financiera

✍️ OpenClawRadar📅 Publicado: 19 de marzo de 2026🔗 Source
Desarrollador Considera Cambiar de DeepSeek a Grok para Agente de IA Financiera
Ad

Problemas de Rendimiento del Agente de IA Financiera y Posible Cambio

Un desarrollador ha construido una aplicación web de IA financiera en FastAPI/Python que funciona de manera similar a Perplexity pero para acciones. La aplicación ejecuta un pipeline paralelo antes de que el LLM procese las consultas, incluyendo cotizaciones de acciones en vivo de varias API financieras, búsqueda web en vivo de API de búsqueda financiera y datos del calendario de ganancias. Todo este contexto estructurado se inyecta en el prompt del sistema, con el modelo manejando solo el razonamiento y el formato mientras los hechos provienen de las API, lo que hace que las tasas de alucinación sean menos relevantes para este caso de uso.

Problemas de Rendimiento del Modelo Actual

El desarrollador está utilizando actualmente DeepSeek V3.2 Reasoning e informa problemas de rendimiento significativos:

  • TTFT (Tiempo para el Primer Token): ~70 segundos
  • Velocidad de salida: ~25 tokens por segundo
  • La experiencia de streaming se describe como "terrible"
  • El tiempo de espera para el inicio del streaming se establece en 75 segundos para evitar tiempos de espera constantes
Ad

Requisitos de la Aplicación

El agente de IA financiera tiene dos características principales:

  • Chat en streaming: Análisis financiero al estilo Perplexity con citas de fuentes en línea
  • Verificación de operaciones en streaming: Entrenador de operaciones que emite GO/NO-GO/WAIT con entrada, stop-loss, objetivo y relación R:R

Los requisitos del modelo incluyen:

  • Rendimiento rápido con TTFT bajo y alta velocidad de tokens por segundo para la experiencia de usuario en streaming
  • Bajo costo para un proyecto pequeño
  • Suficientemente inteligente para el razonamiento de operaciones de múltiples pasos
  • Buena capacidad para seguir instrucciones para formatos de salida estrictos en las verificaciones de operaciones

Considerando Grok 4.1 Fast Reasoning

El desarrollador está considerando cambiar a Grok 4.1 Fast Reasoning basándose en estas comparaciones:

  • TTFT: ~15 segundos (vs ~70s de DeepSeek)
  • Velocidad de salida: ~75 tokens por segundo (vs ~25 t/s de DeepSeek)
  • Puntuación de inteligencia AA: 64 vs 57 de DeepSeek
  • Costo de entrada: $0.20 vs $0.28 por millón de tokens

Otros Modelos Considerados

El desarrollador también ha considerado Minimax 2.5, Kimi K2.5, los nuevos modelos Qwen 3.5 y Gemini 3 Flash, pero señala que la mayoría son relativamente caros y no mejores para su caso de uso específico.

📖 Leer la fuente completa: r/LocalLLaMA

Ad

👀 Ver también

Diseñador de Producto Lanza Aplicación de Grabación de Pantalla para macOS Usando Claude Code
Casos de uso

Diseñador de Producto Lanza Aplicación de Grabación de Pantalla para macOS Usando Claude Code

Un diseñador de productos con experiencia mínima en Xcode utilizó Claude Code para construir y lanzar Drishti Studio, una aplicación de grabación de pantalla para macOS. El desarrollador comenzó con pequeñas funciones, refinó su flujo de trabajo con Claude con el tiempo y lanzó la aplicación con una prueba gratuita disponible en drishtistudio.app.

OpenClawRadar
Investigador Independiente Utiliza Claude AI para Escribir un Artículo de Mecánica Cuántica y 30-50k Líneas de Código Rust
Casos de uso

Investigador Independiente Utiliza Claude AI para Escribir un Artículo de Mecánica Cuántica y 30-50k Líneas de Código Rust

Un investigador independiente utilizó Claude AI como colaborador para escribir un artículo de investigación titulado 'Geometría de Clifford como fundamento de la mecánica cuántica' y desarrollar 30-50 mil líneas de código Rust sin dependencias externas. El código verifica correlaciones de Bell y dinámica de ondas en un retículo de fase.

OpenClawRadar
Probando OpenClaw para la Planificación de Viajes Multipaís con Integración de MoLOS
Casos de uso

Probando OpenClaw para la Planificación de Viajes Multipaís con Integración de MoLOS

Un desarrollador probó OpenClaw con MoLOS para planificar un viaje entre China y Japón, generando itinerarios día por día, sugerencias de vuelos/hoteles y más de 50 tareas automatizadas, mientras identificaba limitaciones en los tiempos de transporte y la validación de atracciones.

OpenClawRadar
Usando a Claude como Interrogador Estructural para Proyectos Creativos
Casos de uso

Usando a Claude como Interrogador Estructural para Proyectos Creativos

Un desarrollador utilizó a Claude de manera interrogativa para escribir una novela de ciencia ficción de 63,000 palabras y crear un juego de navegador, haciendo que la IA identificara lagunas en la lógica del mundo y las motivaciones de los personajes en lugar de generar contenido directamente.

OpenClawRadar