没有验收的自进化,会把错的教训写进 harness

用 Claude Code、Codex 等 Coding Agent 久了,多半都干过一件事:agent 犯了个错,我有可能在 AGENTS.md 或 CLAUDE.md 里补一条规则,“以后别这样xxx”。补完感觉下次它也许就不会犯了,不过说实话的确犯的概率变小了。但多数时候没关注后续带来的其他影响。

用 Claude Code、Codex 等 Coding Agent 久了,多半都干过一件事:agent 犯了个错,我有可能在 AGENTS.md 或 CLAUDE.md 里补一条规则,“以后别这样xxx”。补完感觉下次它也许就不会犯了,不过说实话的确犯的概率变小了。但多数时候没关注后续带来的其他影响。
上周五,DeepSeek Harness 发布。不到几个小时,就在国内外 AI 爱好者的社区里刷屏了。
我第一时间下载试了下。只看默认界面,它给人的第一印象其实有点粗糙。功能入口不算丰富,甚至连个客户端都没有,交互细节也没有 Codex、Claude Code 或者 WorkBuddy 那么完整。后面这几个产品已经打磨了一段时间,打开就能用,很多工作流也替你想好了。DeepSeek Harness 目前仍处在 Developer Preview 阶段,官方直接在 README 里提醒,接下来可能出现破坏兼容性的更新。
今天读到一篇很有意思的数学小论文,来自于牛津大学最近的一场数学竞赛,题目是 Mathematics Behind Jujutsu Kaisen: Gojo Satoru’s Infinity。它做了一件很有意思的事:把《咒术回战》里五条悟的“无下限术式”当成一个数学对象来分析。
今天在 Hacker News 上看到一个很好玩的项目:Performative UI。
它的自我介绍就简单一句话:一个 “AI-native React Components” 组件库。但你点进去看几秒钟就会发现,每个组件都是那么的熟悉,因为它压根就没打算正经做一个类似 shadcn/ui 这样相对严谨稳重一点的组件,而是现在那些高度同质化的 AI startup 网站风格。
前几天 Hacker News 上有个帖子挺火,标题叫《I’m tired of talking to AI》。原文很短,一分钟就能看完。可这篇文章描述的场景,让我很有感触。

上周一些美国大学毕业典礼上,一旦嘉宾开始夸AI,台下就嘘声一片,也许这个结果让演讲嘉宾很意外,但我相信很多我们这样的普通打工人或者学生其实是很能理解的。