今天看到的三个可编辑 AI 实验
有意思的 AI 原型,开始把结果、输入和调整过程一起交给使用者。
快速概览
- 三种模型用同一提示词做出了能在浏览器中运行的月球基地施工模拟器,差异体现在场景组织和交互重点。
- 一个 UI 术语词典试图解决人知道自己想要什么,却说不出界面元素名称的输入摩擦。
- ARDY 展示了动作进行时仍可修改文字、路径点和关键帧的动画控制方式。
我更关心的是生成之后的控制权:人是否还能表达意图、观察变化并继续修正结果。
今天有趣的信息
1. 三个模型,各自做了一座可运行的月球施工模拟器
- 发生了什么:作者把同一要求交给 Claude Fable 5、GPT-5.6 Sol 和 Grok 4.5:在浏览器中做一页 Three.js 月球基地施工模拟器。三份结果都有 3D 场景、施工阶段、进度动画和交互控制;视觉组织与空间关系各不相同。
- 为什么值得关注:模型差异被放进了可操作的界面。它们要处理的不只是画面,还包括状态如何变化、用户在哪里介入。
- 我应该关注什么点:帖子没有公开代码或后续迭代过程。真正的差异会在功能变复杂、需求被修改时才更清楚。
- 相关帖子:同一提示词生成三种月球基地施工模拟器(akiraxtwo)
- 你的判断:这是很好的比较素材。别急着用单个演示判断模型的工程能力,先看它能否继续被编辑。
2. 把“叫不出名字的 UI”做成可搜索词典
- 发生了什么:argofowl 做了一个 UI 词典,服务于看得见界面元素却不知道如何命名的人。用户可以用自己的描述检索;作者称搜索行为会补充网站认识的新词,内置词典会随使用不断扩展。
- 为什么值得关注:很多 agent 协作卡在输入表达。人想要一个交互,却不知道该用什么关键词告诉模型,这个工具就在补这层共同语言。
- 我应该关注什么点:词条审核、检索准确率和长期噪声控制都还没有答案。它目前是有价值的早期产品信号。
- 相关帖子:为难以命名的 UI 元素建立检索词典(argofowl)
- 你的判断:这条很小,也很实用。设计语言被整理好以后,提示词和代码生成的质量都更容易提升。
3. 动作过程中继续改指令的动画控制
- 发生了什么:Stefan_3D_AI 介绍了 NVIDIA 的 ARDY 演示。角色开始运动后,使用者仍能修改文字指令、点击路径点或添加关键帧,系统会即时重新规划动作;帖子称代码、权重和演示都已公开,运行需要约 20–24GB 显存。
- 为什么值得关注:它把动画从一次性生成变成连续调节。文字、路径和关键帧可以共同约束动作,人的控制没有在第一轮生成后结束。
- 我应该关注什么点:信息来自体验者,项目的真实开放程度、稳定性和复杂角色表现还需核验。长序列、碰撞和多角色约束更能说明问题。
- 相关帖子:可实时重规划的文字与路径动画控制(Stefan_3D_AI)
- 你的判断:这是三条里最接近新创作界面的一个。持续可编辑比一次生成更接近实际工作流。
关于这个日报
这份内容基于 X 上的公开搜索结果,由 AI 先做过滤和初步总结,再由半庄整理、取舍和补充判断。

