Anthropic 访谈十多家 AI 原生创业公司后总结出的五条规则:人人都能发版、把繁琐自动化、信任但要验证、为「重建」而构建、原型—内部试用—产品化。
老金的分享
全部文章 · 第 2 页
最新文章
怀旧重玩宝可梦,查攻略太麻烦,于是用 Next.js + AI SDK + PokeAPI 做了个能用任何语言提问的攻略助手。这篇是从空目录到上线的完整过程:工具调用怎么写、一次提问为什么会打出十几次请求、怎么教它承认自己不知道。
实测安装 DeepSeek Harness:343MB、255 个包、490 行插件树。cordis 创造模式让模型自己写插件热装进正在跑的主进程;但装插件就是 pnpm install 一份进程内全权限代码——最漂亮的部分和最没锁的部分,是同一处。
为 handdraw.store 接入 Creem 订阅,代码跑通了,合规审核却打回 8 条整改意见,含 1 条硬门槛。记录 test/live 完全隔离、webhook 验签四个细节、moderation 来回改两次的弯路,以及切 live 上线清单。
8 月 14 日起 Claude Code 默认进 auto mode。1053 名测试员里只有 13.6% 拦住了被换成危险命令的弹窗,auto mode 是 89%。我翻了自己的配置,正好落在那 43% 里。附四个今天就该动的设置。
两篇文章给了同一道题两个相反的答案:一个人抹了台闲置 Mac 全开权限,一个人在 GitHub Actions 里把工具收成只读白名单。它们其实用的是同一个公式——爆炸半径 = 你丢不起的东西 × agent 碰到它的概率。附几个自己摸绝对要栽的坑。
如何为你的工作负载选择合适的 Claude 模型:比较各模型类别,权衡每任务成本与每 token 成本,并构建评估来做出最终决策。
Anthropic 把 Claude Code 的系统提示词删掉了 80% 以上,编码评测没有可测量的性能损失。我拿这套标准审了自己的 CLAUDE.md 和 Skills,找出三处硬伤——全都是「写得很认真」的产物。附一个判断哪条该删的粗暴判据。
没有验证器的 Loop,就是印钞机在印废钞。这篇讲清楚验证器到底是什么——它就是你每次替 AI 手动补的那个动作,以及怎么用 Claude Code 的内置能力和 Skill,把它从手动喊一步步自动化到每个 PR 强制跑。
Peter Steinberger 九个字的推点破了整个 Agent 圈:我们还在聊 Loop,还是已经在聊 Graph?但两者根本不是对立——图里本就包含循环。单循环会以四种方式翻车,答案是拓扑;可比拓扑更根本的,是给图钉一个「现实锚点」。