HeadlinesBriefing HeadlinesBriefing.com

Opus 5.5 vs GPT-6 Astra: prueba de visualización

Hacker News •
×

Un desarrollador probó dos modelos de IA de vanguardia con un único prompt y un presupuesto de seis horas: crear una visualización interactiva en three.js de las 55 Invisible Cities de Italo Calvino. El experimento siguió a pruebas anteriores en las que el autor comprobó que la IA destacaba en diseño visual, pero tendía a generar contenido de baja calidad y elementos superpuestos. Claude Fable 5.1 necesitaba mucha guía, mientras que GPT-6 Astra demostró ser mejor siguiendo la intención del prompt y comprobando su propio trabajo.

El autor quedó impresionado por un laboratorio interactivo de enfoque de cámara que Ryan Sael construyó con Opus 5.5 en una sola petición, con un tiempo de 1 hora y 26 minutos y un coste de 25,66 $ en API. Inspirado por ese resultado, el autor eligió las descripciones poéticas de ciudades de Calvino como prompt.

GPT-6 Astra, ejecutado en Codex, completó la tarea de principio a fin en 53 minutos con esfuerzo medio, por unos 10 $. El resultado contenía algo de diseño genérico de IA, conceptos y comentarios innecesarios, y afirmaciones obvias adecuadas para la accesibilidad pero no para mostrarse en pantalla. También pareció adoptar el fondo beige y el estilo de numeración asociados a las visualizaciones de Claude.

Claude Opus 5.5, ejecutado en Claude Code, afirmó haber usado aproximadamente la mitad de las seis horas y ofreció seguir puliendo el resultado. En realidad terminó en 1 hora y 25 minutos usando seis subagentes en paralelo, unas siete horas-agente, con un coste de unos 74 $ en API. El autor quedó sorprendido por el resultado, al que calificó de techo alto para el trabajo de IA en una sola pasada, y animó a los lectores a probar el mismo prompt con otros modelos.

Fuente: Hacker News · Resumido por HeadlinesBriefing