2026-07-04:AI 实验开始补测试表面、复刻表面和语音前端壳
今天更值得记住的,是别人已经把 AI 接到了测试、复刻、回放和语音前端这些更具体的表面上。
快速概览
Open Design继续把参考链接复刻做深,目标已经越过截图相似,开始接近交付物的交互壳。sarahwooders做了一个 remote desktop skill,让任意 agent 更容易试自己刚做出来的功能,也更容易录 demo。Maestro MCP展示了另一条更硬的链路:让 coding agent 真实驱动 App,然后把整次运行收成 repeatable UI test。- 语音线今天没有新的硬件强样本,反而开始出现更轻的 voice shell。
Baconbrix直接把Expo + Grok Voice做成了开源模板。
今天有趣的信息
1. Open Design 把“参考链接”做成了真正的复刻任务
OpenDesignHQ 这条最有意思的地方,在于输入已经越过一句提示词,变成了一条高度定制的 WebGL 站点链接。帖子把细节讲得很清楚:里边有 Gaussian Splatting、WASM workers、二进制资源和滚动驱动 3D 叙事。输出也越过了普通意义上的“同风格页面”,直接给出一个 recreated landing page。
这说明参考表面复刻开始变成更明确的工作面。系统不仅要看图,还要理解运行时交互、资源组织和页面节奏。更值得继续看的,是这种复刻到底能不能稳住在滚动逻辑、图层关系和运行时约束这几层,而不只是画面像。
2. Remote desktop skill 让 agent 更容易自己验收和录 demo
sarahwooders 的出发点很直接。她觉得 Devin 的 remote desktop 很适合检查 agent 做出来的功能,也适合让 agent 自己录 demo 视频,于是用 Daytona 做了一个更通用的 skill,让别的 agent 也能拿到同类表面。帖子里还挂了 GitHub PR,这个样本至少已经从想法走到了实现。
我会把它看成 post-build workflow 的补位。很多 agent 样本写到“做完了”就停住,这条开始处理“做完之后怎么试、怎么录、怎么给人看”。如果后面它继续补回放、失败截图和验收日志,这一层会更有价值。
3. Maestro MCP 把 agent 操作真实 App 的过程收成了测试资产
Maestro 这条更硬。通过 Maestro MCP,让 Claude 端到端驱动 Google Drive,创建文件夹、写文档、加星标,最后把整次运行变成一个 repeatable test。今天搜索命中的是引用帖,不过引用文字已经把原帖重点点得很完整,所以我直接回到了原帖。
这个方向更值得记,是因为它不只展示“AI 会操作手机 App”,还留下了一个可复跑的测试结果。后面要看的边界也很清楚:复杂权限流、验证码、flaky 动作和真实设备差异,会不会把这条链路卡住。
4. 语音 agent 这条线开始出现更轻的前端底座
Baconbrix 开源了一套 Expo 模板,直接接新出的 Grok Voice Agents。帖子里把前端壳的组成说得很清楚:Rive 动画、Vercel AI Elements、AI SDK v7、Tailwind,再加自定义 voice 和 personality。它和硬件项目走的不是一条线,更像把 voice shell 做成了一套现成底座。
这条值得看,是因为语音 agent 线上的变化已经从“模型会不会说话”转到“前端壳怎么做轻”。如果后面这类模板继续补 memory、工具调用和多轮状态,语音样本会更接近真实产品面。
关于这个日报
这份内容基于 X 上的主动搜索发现。重点不在追热点,而在持续找那些能直接看到效果、能反映 AI 实际能力边界、同时又带着一点产品形态感的样本,再做取舍和判断。

