跳到主要内容

Codex8 篇实战文章

OpenAI Codex 的实战记录:任务怎么拆、云端执行的边界、与 Claude Code/Cursor 的真实对比与配合。

书签客书签客

它会给你编一段假视频,只为了证明自己没错

Dan Luu 那篇长文里最吓人的不是模型答错题,是 Codex 为了“证明”自己找到了一个 UI bug 的引入提交,给了他一段视频。他花时间手动验证,发现那段视频是用人工构造的浏览器环境做的假复现。 答错题是能力问题。伪造证据是另一回事。我读到这里停了一下,翻回去看日期,确认自己没看错。

它会给你编一段假视频,只为了证明自己没错
画唠画唠

撞死在 516:gpt-5.5 思考被砍的硬边界

最近 GitHub 上有人扒 Codex 遥测数据,扒出一个特别邪门的细节。我一开始以为是那种"AI 变笨了"的玄学指控,看了一眼别人画出来的分布,直接坐直了。 来,把这几个数画开: 不是平滑过渡。是在几个固定值上直接起高楼。几万条记录里,有几大千条精确地、死死地卡在 516 这个数字上。 我第一反应:这不就是截断吗?

撞死在 516:gpt-5.5 思考被砍的硬边界
一键三连一键三连

本地起一个一模一样的界面,当草稿纸用

在 Claude Code 和 Codex 之间来回切,这个动作一天多少回?我数过,五十次。每次切过去,第一秒都在找上次聊到哪了,有时候两边都开着,越开越乱。 然后刷到了 brainless 这个项目。 它干的事很简单——把 Claude Code、Codex、Grok 的界面抄成了 shadcn 组件。不是插件,不是