HeadlinesBriefing HeadlinesBriefing.com

Opus 5.5 对比 GPT-6 Astra 可视化测试

Hacker News •
×

一位开发者用一条提示词和六小时的时间,测试了两款前沿 AI 模型:构建卡尔维诺《看不见的城市》中全部 55 座城市的交互式 three.js 可视化。此前的试验中,作者发现 AI 在视觉设计方面表现出色,但容易产生冗余元素和重叠问题;Claude Fable 5.1 需要人工反复指导,而 GPT-6 Astra 在理解提示意图和检查自身工作方面表现更好。

作者对 Ryan Sael 借助 Opus 5.5 一次性构建的交互式镜头焦距实验室印象深刻,该作品耗时 1 小时 26 分钟,API 成本为 25.66 美元。受此启发,作者选择了卡尔维诺充满诗意的城市描写作为提示词。

GPT-6 Astra 在 Codex 中运行,以中等强度端到端完成任务,耗时 53 分钟,费用约 10 美元。输出结果中存在一些 AI 设计的冗余痕迹,包含不必要的概念和注释,还有一些适合无障碍访问、但不适合直接展示在屏幕上的显而易见的说明。它似乎还采用了与 Claude 可视化作品相关的米色背景和编号风格。

Claude Opus 5.5 在 Claude Code 中运行,它声称已用掉约一半的六小时,并表示愿意继续打磨。实际上它耗时 1 小时 25 分钟,使用了六个并行子代理,合计约七个代理小时,API 费用约为 74 美元。作者对结果印象深刻,称其代表了一次性 AI 工作的较高上限,并鼓励读者用同一提示词在其他模型上进行尝试。

Opus 5.5 在本次测试中表现更为突出。

来源: Hacker News · 由HeadlinesBriefing整理摘要