I gave Opus 5.5 one prompt and six hours to visualize Invisible Cities
🇬🇧 English
A developer tested two frontier AI models with a single prompt and a six-hour budget: build an interactive three.js visualization of all 55 Invisible Cities by Italo Calvino. The experiment followed earlier trials in which the author found AI strong at visual design yet prone to slop and overlapping elements, with Claude Fable 5.1 needing hand-holding and GPT-6 Astra proving better at following prompt intent and checking its own work.
The author was impressed by an interactive camera-focus lab that Ryan Sael built with Opus 5.5 in one shot, taking 1 hour 26 minutes and $25.66 in API costs. Inspired by that result, the author chose Calvino's poetic city descriptions as a prompt.
GPT-6 Astra, run in Codex, completed the task end-to-end in 53 minutes at medium effort for about $10. The output contained some AI design slop, unnecessary concepts and comments, and obvious statements that suited accessibility but not on-screen display. It also seemed to adopt the beige background and numbering style associated with Claude's visualizations.
Claude Opus 5.5, run in Claude Code, claimed it had used about half of the six hours and offered to keep polishing. It actually finished in 1 hour 25 minutes using six parallel subagents, roughly seven agent-hours, at about $74 in API tokens. The author was struck by the result, calling it a high ceiling for one-shot AI work, and encouraged readers to run the same prompt on other models.
🇪🇸 Español
Opus 5.5 vs GPT-6 Astra: prueba de Invisible Cities
Un desarrollador probó dos modelos de IA de vanguardia con un único prompt y un presupuesto de seis horas: crear una visualización interactiva en three.js de las 55 Invisible Cities de Italo Calvino. El experimento siguió a pruebas anteriores en las que el autor comprobó que la IA destacaba en diseño visual, pero tendía a generar contenido de baja calidad y elementos superpuestos. Claude Fable 5.1 necesitaba mucha guía, mientras que GPT-6 Astra demostró ser mejor siguiendo la intención del prompt y comprobando su propio trabajo.
El autor quedó impresionado por un laboratorio interactivo de enfoque de cámara que Ryan Sael construyó con Opus 5.5 en una sola petición, con un tiempo de 1 hora y 26 minutos y un coste de 25,66 $ en API. Inspirado por ese resultado, el autor eligió las descripciones poéticas de ciudades de Calvino como prompt.
GPT-6 Astra, ejecutado en Codex, completó la tarea de principio a fin en 53 minutos con esfuerzo medio, por unos 10 $. El resultado contenía algo de diseño genérico de IA, conceptos y comentarios innecesarios, y afirmaciones obvias adecuadas para la accesibilidad pero no para mostrarse en pantalla. También pareció adoptar el fondo beige y el estilo de numeración asociados a las visualizaciones de Claude.
Claude Opus 5.5, ejecutado en Claude Code, afirmó haber usado aproximadamente la mitad de las seis horas y ofreció seguir puliendo el resultado. En realidad terminó en 1 hora y 25 minutos usando seis subagentes en paralelo, unas siete horas-agente, con un coste de unos 74 $ en API. El autor quedó sorprendido por el resultado, al que calificó de techo alto para el trabajo de IA en una sola pasada, y animó a los lectores a probar el mismo prompt con otros modelos.
¿Qué modelo produjo la mejor visualización de Invisible Cities en esta prueba?
El autor consideró que Claude Opus 5.5 produjo el resultado más impresionante, terminando en 1 hora y 25 minutos por unos 74 $ en API, mientras que GPT-6 Astra completó la tarea en 53 minutos por unos 10 $, con más contenido genérico de diseño y ruido visual innecesario.
🇨🇳 简体中文
Opus 5.5 对比 GPT-6 Astra:Invisible Cities 测试
一位开发者用一条提示词和六小时的时间,测试了两款前沿 AI 模型:构建卡尔维诺《看不见的城市》中全部 55 座城市的交互式 three.js 可视化。此前的试验中,作者发现 AI 在视觉设计方面表现出色,但容易产生冗余元素和重叠问题;Claude Fable 5.1 需要人工反复指导,而 GPT-6 Astra 在理解提示意图和检查自身工作方面表现更好。
作者对 Ryan Sael 借助 Opus 5.5 一次性构建的交互式镜头焦距实验室印象深刻,该作品耗时 1 小时 26 分钟,API 成本为 25.66 美元。受此启发,作者选择了卡尔维诺充满诗意的城市描写作为提示词。
GPT-6 Astra 在 Codex 中运行,以中等强度端到端完成任务,耗时 53 分钟,费用约 10 美元。输出结果中存在一些 AI 设计的冗余痕迹,包含不必要的概念和注释,还有一些适合无障碍访问、但不适合直接展示在屏幕上的显而易见的说明。它似乎还采用了与 Claude 可视化作品相关的米色背景和编号风格。
Claude Opus 5.5 在 Claude Code 中运行,它声称已用掉约一半的六小时,并表示愿意继续打磨。实际上它耗时 1 小时 25 分钟,使用了六个并行子代理,合计约七个代理小时,API 费用约为 74 美元。作者对结果印象深刻,称其代表了一次性 AI 工作的较高上限,并鼓励读者用同一提示词在其他模型上进行尝试。
Opus 5.5 在本次测试中表现更为突出。
在本次测试中,哪款模型生成的《看不见的城市》可视化效果更好?
作者认为 Claude Opus 5.5 的成果更为出色,耗时 1 小时 25 分钟,API 费用约 74 美元;而 GPT-6 Astra 耗时 53 分钟,费用约 10 美元,但存在更多设计冗余和多余的视觉噪声。