实测安装 DeepSeek Harness:343MB、255 个包、490 行插件树。cordis 创造模式让模型自己写插件热装进正在跑的主进程;但装插件就是 pnpm install 一份进程内全权限代码——最漂亮的部分和最没锁的部分,是同一处。
博客
个人原创博客日志 · 第 2 页
为 handdraw.store 接入 Creem 订阅,代码跑通了,合规审核却打回 8 条整改意见,含 1 条硬门槛。记录 test/live 完全隔离、webhook 验签四个细节、moderation 来回改两次的弯路,以及切 live 上线清单。
8 月 14 日起 Claude Code 默认进 auto mode。1053 名测试员里只有 13.6% 拦住了被换成危险命令的弹窗,auto mode 是 89%。我翻了自己的配置,正好落在那 43% 里。附四个今天就该动的设置。
两篇文章给了同一道题两个相反的答案:一个人抹了台闲置 Mac 全开权限,一个人在 GitHub Actions 里把工具收成只读白名单。它们其实用的是同一个公式——爆炸半径 = 你丢不起的东西 × agent 碰到它的概率。附几个自己摸绝对要栽的坑。
Anthropic 把 Claude Code 的系统提示词删掉了 80% 以上,编码评测没有可测量的性能损失。我拿这套标准审了自己的 CLAUDE.md 和 Skills,找出三处硬伤——全都是「写得很认真」的产物。附一个判断哪条该删的粗暴判据。
没有验证器的 Loop,就是印钞机在印废钞。这篇讲清楚验证器到底是什么——它就是你每次替 AI 手动补的那个动作,以及怎么用 Claude Code 的内置能力和 Skill,把它从手动喊一步步自动化到每个 PR 强制跑。
Peter Steinberger 九个字的推点破了整个 Agent 圈:我们还在聊 Loop,还是已经在聊 Graph?但两者根本不是对立——图里本就包含循环。单循环会以四种方式翻车,答案是拓扑;可比拓扑更根本的,是给图钉一个「现实锚点」。
过度依赖 AI 编码,工程师的调试能力平均下降 47%——这是造 Claude Code 的公司自己承认的。编码 Agent 带来的「认知债务」不会当场报错,却在悄悄拿走你判断代码好坏的能力。这篇聊聊它为什么危险,以及我自己在用的 5 条对冲纪律。
从「输入一句话生成手绘图」到部署上线,踩遍额度、SDK、产品形态的坑,再把假登录、假账单补成真能跑的东西——一个小项目从 Demo 到能用的 SaaS 的完整记录。
AI 写了我大半个项目,但核心重构我一直不敢让它自己跑。后来我想通了:卡住我的不是 AI 的能力,是我从没把'什么叫对'做成一个能自动跑的检查。AI 时代真正稀缺的,是把判断编译成可执行代码的能力。