速评:这篇帖子最值钱的不是那条机械腿,是"手绘草图→Gemini出三视图→Opus按three.js落地"这条流水线本身。
Anna Villarreal 25号在dev.to发的这则更新,表面讲的是给桌面宠物Catbot升级机械腿的过程。实际上,她写下的是一份非常具体、可复制的"AI当翻译,不来当设计师"工作流。注意她是这么干的:对AI生成的身体不满意,花15分钟自己画了张草图,把草图扔给Gemini要四视图,再把Gemini吐出来的技术图纸加详细描述扔给Opus,基于现有three.js架构写成了代码,得到"Catbot the 4th"。中间根本没有"让AI天马行空想设计"这环节。
你得看懂这里面的角色分配,才是看懂这篇帖子的真正姿势——Gemini没有发明机械腿,它干的事是从一张潦草的宠物腿手绘里提取出正交投影信息。这就是翻译,不是生成。太多人把这两种能力混为一谈,看别人发"我用AI搭了什么"就激动,仿佛模型真变成了设计师。扯淡。
真正干活的是那条管线。人类15分钟把脑海里想要的形态画出来,然后丢给模型扩成工程视图;另一个模型再把这些视图落成three.js代码。每一环都有明确边界:模型负责把模糊变规范、把规范变实现,人类负责最开始的想法以及中间"这版不对"的判断。这套分工精确得像是教科书案例——Anna可能自己都没意识到她演示了当前阶段AI落地的正确姿势。
不过,你得承认,这事大概率有两面,先别急着把我的话当全部定论。Anna花了多长时间在prompt上?她调了几次Gemini的输出?她对Opus的输出改了多少代码?这些她全没细说。根据经验,"描述工程"那部分时间往往被省略。模型生成不满意再来一轮,这种循环占用的时间经常远超预期,只是没人在分享里提。
另一个值得注意的细节是评论区。有用户说Catbot的新腿让它"拥有超能力",Anna鼓励大家去创建AI宠物。这话本身是善意的,但多想一想就知道,如果读者只看到"她让AI做了条腿"就跑去试,照抄她的流程却画不出那种草图,八成会卡在第一步——这不怪模型,怪大多数人根本不手绘,没法在纸面上把自己的想法表达清楚。她15分钟完成的事,隔了太多没有训练过视觉思维的人做不到。
所以我的结论,跟社交媒体上一窝蜂的"AI太强了"不是一回事:
技术图纸只是接口,手绘能力才是门槛。模型负责把你画得出来的东西变成能用,但"画得出来"这步,暂时还是你自己的问题。AI不会替你看清自己想要什么,它只负责转发你的想法,转成工程语言。这个区分很关键,它决定了你的工作流里AI到底处在什么位置。
还有个贴子里埋着的细节,差点被我略过。Anna提到Catbot对自己新腿的评价过程很困难,因为Catbot性格"顽皮",还劝大家别对AI宠物说俏皮话,除非能应对后果。这半开玩笑的说法被多数人当作帖子的趣味点缀,但仔细看,这不就是在讲Agent的行为一致性吗?性格顽皮的AI宠物对"评价"这件事的反应不可预测。所有让AI角色长期运行的人都懂这个坑——记忆存在Obsidian里,可以不时分享给模型,但模型每次调用时的输出不保证稳定,越是个性化设定越是如此。她把这事包装成段子,其实是给所有想做AI宠物的人埋了个警告。
有人会说:"这不就是一个独立开发者玩票吗?值得这么分析?"值得。因为这正是当下AI应用最缺的样本——不是又一个大模型发布会声称自己多强,而是一个人在做一个算不上颠覆的东西时,暴露出的真实工作流。她没炫技,展示了最简单的迭代方法;没吹AI万能,顺带承认了自己画的草图才是那张决定方向的图纸。
这事的讽刺之处在于,大家都盯着Catbot那条腿看,说"这AI设计得真好",而Anna用15分钟证明了,真正不可替代的恰恰是那15分钟里她脑子里的判断:这个腿型不对、应该是机械的、骨架得这么走。模型只是把她那15分钟的思考放大成了成品。
话说回来,我其实自己做过类似的宠物项目,理解力是从教训里长出来的——我当初的失败点在于让AI直接生成完整设计,结果出来了个四不像,当时还怪模型不给力。现在回看,确实是我自己的问题,是我没想明白,不能全赖它。
最后立个flag:如果我能克服收集癖,用Anna这套方法重构我那副破方案,年底前写篇复盘。这次不是预测,是作业。