Claude Code v2.1.139 新增的 /goal 命令,能让 AI 在客观可验证的条件下持续工作直到完成。本文用 TinyPA 项目的三个实战案例,讲清楚怎么写一个能跑通的条件、几个真踩到的坑、以及什么时候别用。
老金的分享
全部文章 · 第 6 页
最新文章
Codex 真能替你熬夜写代码,前提是你不能把它当资深工程师,要当一个不知疲倦、边界感需要你提前写清楚的执行者。文章讲怎么写夜班工单、哪些任务适合夜里跑、哪些不能,以及第二天怎么验收。
中年失业后,我把吃灰多年的老公众号重新激活。一篇 Unity 小游戏踩坑文在技术群破圈,一个月把粉丝从 0 做到 1000。这是冷启动阶段的真实经历。
带兄弟们做 Agent 大半年,Demo 跑得挺好,上线两周被现网用户教做人。复盘四个真出过的事:function calling 翻车、多步任务没 checkpoint、记忆一股脑塞进 prompt、工具调用副作用失控。
拉尔夫循环——给 Claude Code 一个目标和验证标准,让它在闭环里跑'执行→测试→改→重来',睡觉时自己改完代码。哪些活能交出去,哪些坑要避开。
一套帮你寻找想法、用你的声音起草、发布并从有效内容中学习的内容系统。让作者账号两周做到 500 万曝光、两个月 10 万收藏。
Agent 表现不好,直觉反应是换更强模型、加更多工具、写更长提示词——但加法常是负优化。代码替代对话链、Sub-Agent 空间隔离、压缩做时间隔离、Skill 按需加载,四把手术刀给模型更精准的而不是更多的。
AI Agent 不靠谱?多半不是模型变笨了,而是 Harness 没做好。一文搞懂 Harness 在 Claude Code 这类工具背后到底干了哪三件事。
Augment Code 实测数十份 AGENTS.md 后总结:写好了相当于把模型从 Haiku 升级到 Opus,写烂了让 AI 比裸跑更差。7 个有效模式 + 2 个失败陷阱 + 文档发现率梯度,外加几条不能假装不存在的工程边界。
一篇讲清楚主流免费 LLM API:Google AI Studio、GitHub Models、Groq、OpenRouter、Cloudflare Workers AI 等长期免费额度,以及阿里云、Baseten、Modal、SambaNova 等注册送体验金平台。