TryAI realizó una prueba comparativa entre Grok 4.5, GPT-5.5, Claude Opus 4.8 y Claude Fable 5, solicitándoles la creación de tres aplicaciones HTML autónomas sin librerías externas: un Cubo de Rubik en 3D, un simulador de gravedad de partículas y un juego de Breakout.
Los resultados fueron mixtos. Los modelos de Claude lideraron la tarea del cubo 3D, mientras que GPT-5.5 destacó por la calidad visual de la simulación de gravedad. En el caso del juego Breakout, los cuatro modelos lograron resultados profesionales y funcionales en el primer intento.
En cuanto a eficiencia, Grok 4.5 fue el ganador, registrando un rendimiento de aproximadamente 110 tokens/s, el doble que sus competidores, y el coste más bajo (0,002 $ por respuesta). GPT-5.5 fue el más rápido en respuestas cortas, mientras que Claude Fable 5 resultó ser el modelo más lento y costoso (0,009 $ por respuesta).
Comentarios
Aún no hay comentarios — escribe el primero.
Inicia la conversación
Sin cuenta ni contraseña — introduce tu correo y te enviamos un enlace de acceso de un solo uso. ¿Primera vez? Todo se configura automáticamente.
Tu valoración se aplicará automáticamente al iniciar sesión.
Revisa tu bandeja de entrada
Hemos enviado un enlace de acceso a …. Ábrelo en este dispositivo — esta pestaña te conectará automáticamente.
Esperando tu clic …
·