
TL;DR:Piotr Migdał 在 2026 年 10 月 7 日记录了一次把《看不见的城市》变成交互作品的实验:给模型六小时,Opus 5.5 却在作者记录的 1 小时 25 分钟后结束。这是个人创作案例,不是模型排行榜;更快交出作品之后,是否忠于表达、是否值得继续修改,仍需要人来判断。
如果给 AI 一个模糊的创作要求,它不仅能做出来,还做到了让你惊艳,你下一步会做什么?
这次实验里,作者原本想追问模型为什么提前收工,看完作品却先被吸引住了。“有没有遵守要求”和“我喜不喜欢”,忽然成了两个问题。
🎬 视频版(B站) | 🎧 音频版(4 分 22 秒)| 🟢 Spotify 订阅 | 📖 偏好阅读?文字版就在下方 👇
一个创作要求,留下多少判断空间
作者在原文中选了卡尔维诺的《看不见的城市》,要求用 Three.js 和 pnpm 把书里的全部城市做成可视化,不提问、一次完成,并给出六小时预算,要求继续做到成为“杰作”。
工具和交付方式有了,但审美标准仍然宽泛。这里的“杰作”是一个愿望,既没有说明希望观众感受到什么,也没有给出判断是否完成的办法。
这并不意味着实验无效。开放的要求可以让人观察模型会主动选择什么。只是评价结果时,要记住:模型补充了需求里没有写明的东西,不能自动视为它准确理解了作者全部意图。
预算、经过时间和代理工时不是同一回事
作者分别记录了两次尝试:
| 本次实验配置 | 作者记录的经过时间 | 作者报告的 API token 费用 |
|---|---|---|
| GPT-6 Astra,Codex,medium 推理档 | 53 分钟 | 约 10 美元 |
| Claude Opus 5.5,Claude Code,6 个子代理并行 | 1 小时 25 分钟 | 约 74 美元 |
作者还称,Opus 的并行工作累计约七个代理小时。模型自己却说,大约用掉了六小时的一半;这个说法与作者记录的经过时间并不相符。
并行工作时,多名代理的时长可以累计,但这不是同样长度的现实等待,也不是硬件计算时长。六小时预算、用户等了多久,以及代理累计工作多久,应分别记录。
更不能用累计工时解释掉所有指令偏差:即使并行投入很多,也不等于模型已经按要求持续修改了六小时。是否应该提前停止,需要另一套完成标准。
惊艳是重要反馈,但不是通用得分
作者认为 Astra 的结果已经能从头到尾工作,但某些说明和概念增加了视觉噪声;他对 Opus 的作品则表达了强烈赞赏。这些是作者的体验判断,不是盲评或重复试验的统计结果。
两次运行还同时改变了模型、编程工具和并行方式,不能把差异全部归给模型本身。费用不同也不直接说明哪个更划算,因为“好到什么程度”尚未被量化。
作者公开了 Astra 版本代码和 Opus 版本代码,读者有机会继续检查。本文核对了公开入口,没有运行代码、开展浏览器交互测试或独立复现账单,不能把“资料可访问”说成“作品所有功能已验收”。
把城市做出来之后,还要检查表达
这一段是本文的编辑分析。文学作品的交互改编,不只需要可看的建筑,还需要决定让观众以什么顺序探索、何时停留,以及怎样理解不同城市。
可以把审阅分成三个问题:
- 能否使用:入口、导航和交互是否让人知道下一步能做什么?
- 是否有助于理解:视觉差异有没有传达作品中的区别,还是只增加装饰?
- 是否符合创作意图:观众记住的是画面,还是作者希望表达的感受?
这三个问题可能得到不同答案。能用不代表表达合适,喜欢第一眼也不代表愿意继续探索。它们不是原文已经验证的结论,而是进一步评价作品的角度。
看 AI 生成结果时,删掉什么也值得认真考虑。每一段说明、每一个控件和视觉元素,都应有存在的理由。没有必要为了显示“做了很多”,把所有内容留在画面上。
六小时不应成为唯一的完成标准
时间上限可以限制成本,却不能单独定义质量。一个目标含糊的任务,继续运行可能发现问题,也可能只是堆叠装饰、反复修改已经合适的部分。
如果继续类似实验,可以先保留第一次交付,再针对具体问题安排下一轮:哪些操作难以理解?哪些视觉内容与主题无关?哪个场景没有表达预期感受?这样才能区分修改带来的收益,而不是只比较多运行了多久。
还应分别记录经过时间、费用和人工审阅时间。作品生成得快,如果后面需要长时间纠错,也未必节省整个创作过程的时间。
这些是编辑提出的后续检查办法,不是本文已经跑过的实验,也不意味着一定应该耗尽预算。
人的工作,可能从实现转向选择
作者最后问到自己在交互媒体创作中的位置。这种困惑可以理解:当技术实现不再是最难的一步,创作者就更难用“暂时做不出来”推迟表达上的决定。
但这篇个人案例不足以证明设计师会被替代。它更直接展示了另一件事:一个原本模糊的念头,可以较快变成可供讨论的作品。
作品出来之后,决定保留什么、拒绝什么、为什么要这样表达,仍是一项具体工作。惊艳可以成为讨论的开始,却不必成为审阅的终点。
收看本期节目
原始资料与延伸阅读
本文由《听懂 AI》第 047 期 AI 访谈节目编辑整理,并非对 Piotr Migdał 的真人采访。运行时间、费用、代理数量和作品评价来自其个人记录,不是厂商基准或独立复测;评价框架与后续实验建议为编辑补充。资料核对日期为 2026 年 10 月 11 日。
- 原始文章:I gave Opus 5.5 one prompt and six hours to visualize Invisible Cities,Piotr Migdał,Quesma,2026 年 10 月 7 日。
- 编辑核对的公开代码:Astra 版本、Opus 5.5 版本,均由原文提供入口。公开可读不等于本文已核验其可复用许可或全部运行行为。
- 原文提供的作品入口:Opus 5.5 交互作品。本文未进行实际交互验收,建议带着自己的设计问题查看,而非只按模型名称选择喜欢的版本。