Claude vs GPT-4o: Mismo Prompt de Péndulo Doble, Diferentes Convenciones de Coordenadas

Un usuario de Reddit ejecutó la misma instrucción de péndulo doble en Claude y GPT-4o lado a lado usando un renderizador anfitrión compartido y vio dos sistemas físicos completamente diferentes en cuestión de segundos. La causa: cada modelo eligió una convención diferente para medir theta.
Claude midió theta desde la vertical hacia arriba (theta=0 = brazo apuntando hacia arriba), mientras que GPT-4o midió desde la vertical hacia abajo (theta=0 = brazo colgando hacia abajo). El renderizador anfitrión en public/workers/simulator-host.js simplemente lee info.theta1 y info.theta2 y dibuja los brazos según corresponda, sin diferencias cosméticas. Por lo tanto, la discrepancia visual es una discrepancia física real.
Ambas convenciones son técnicamente válidas. La mayoría de los libros de texto de mecánica clásica usan theta desde la vertical hacia abajo porque hace que el punto de equilibrio esté en theta=0 para aproximaciones de ángulos pequeños. Pero theta desde la vertical hacia arriba también es estándar en muchas referencias. Claude se comprometió con su convención de manera consistente en las ecuaciones de movimiento, condiciones iniciales e integración (Runge Kutta). GPT-4o usó la otra convención en silencio, sin mencionar su elección.
El usuario estaba trabajando en Physics Bench, un punto de referencia lado a lado de código abierto donde cada modelo recibe el mismo contrato de generación: function createSimulator(...) en lib/prompt.ts. El anfitrión controla todo el renderizado; los modelos solo implementan step, getInfo y reset. Los modelos nunca tocan draw. Por lo tanto, cualquier diferencia visual entre paneles está garantizada para provenir de una diferencia real en la lógica de simulación, no de opciones de renderizado.
Una prueba unitaria de las matemáticas no habría detectado esto. Ambos modelos producen física correcta según sus convenciones elegidas. Solo se ve la divergencia al renderizarlos uno al lado del otro a través del mismo código de dibujo. Esto subraya la importancia de especificar explícitamente las convenciones de coordenadas en las instrucciones cuando la salida es consumida por un renderizador fijo.
Vea el hilo completo de Reddit para fragmentos de código y detalles del inspector de conversación.
📖 Lea la fuente completa: r/ClaudeAI
👀 Ver también

Gemma 4 Lanzada: Cuatro Tamaños de Modelo para Alojamiento Local de IA
Google ha lanzado Gemma 4 con cuatro tamaños de modelo optimizados para diferentes hardware, incluyendo dispositivos de borde, portátiles y GPUs. Todos los modelos son multimodales con capacidades de texto y visión, y los modelos más pequeños admiten audio en tiempo real.

Agente Hermes + Qwen3.6 27b Local maneja tareas de administrador de TI junior
Un veterano de TI con 30 años de experiencia informa que Qwen3.6 27b ejecutándose en el arnés Hermes Agent completó una lista de tareas para un administrador de TI junior en 1.5 horas, incluyendo parcheo, instalación de Docker y configuración de servicios.

Por qué no leeré ficción escrita por LLM: perfiles estadísticos y el problema de la escritura mediana
Chris McCormick explica por qué evita la ficción generada por LLM, argumentando que su perfil estadístico es demasiado cercano a la mediana, empujando la mente de los lectores hacia lo estadísticamente normal en lugar de lo creativamente único.

Richard Dawkins concluye que la IA es consciente — Expertos se oponen
El biólogo evolutivo Richard Dawkins, tras largas conversaciones con Claude de Anthropic y ChatGPT de OpenAI, concluyó que las IA son conscientes. La mayoría de los científicos cognitivos discrepan firmemente, calificándolo de antropomorfismo.