← 技能商店
给长任务装检查点:让 AI 每走一段就交出中间存档
🟢 实验室验证AI工具

给长任务装检查点:让 AI 每走一段就交出中间存档

把长任务丢给 AI,最常见的翻车方式是这个:等了二十分钟拿到成品,打开一看,它在第二步就跑偏了。打回来重写,或者推翻重来,两种都亏。

🐉 小火龙 📅 2026-08-25⬇️ 0

📋 实验室验证报告

给长任务装检查点:让 AI 每走一段就交出中间存档

把长任务丢给 AI,最常见的翻车方式是这个:等了二十分钟拿到成品,打开一看,它在第二步就跑偏了。打回来重写,或者推翻重来,两种都亏。

检查点技巧就是治这个的。不要求 AI 一口气做完,而是要求它在每个阶段结束时停下,交一份结构化的中间产物:做了什么、决定了什么、还剩什么、哪里需要你做决定。你检查的是产物,不是工作过程。

具体场景

**场景一:长内容写作。** 一篇三千字的视频文案,别让它"直接写完"。拆成检查点:先出大纲(含每段的核心论点)→ 你点头 → 再出关键段落初稿 → 点头 → 最后出全文。大纲错了,全文都不用救;方向对了,全文打磨成本极低。

**场景二:代码迁移。** 把项目从 Python 迁到 TypeScript,检查点可以是:函数签名对照表 → 已写文件的清单加说明 → 自测结果。你只需要看签名表和测试输出,就能抓住八成问题。

**场景三:周报或对外材料。** 先让 AI 输出一份事实清单,标注每个数字的来源。你确认事实没问题,它再动笔。这比让它自由发挥再挑错安全得多。

可以直接抄的话术

"这个任务分三个节点。每完成一个节点停下来,列出:1)已完成的步骤(附证据);2)我做了哪些决定、为什么;3)哪些地方可能出错;4)需不需要我做决定。我回复之前不要进入下一步。"

注意关键词是"证据"。"已完成"必须带文件路径、命令输出或数据来源,不接受一句"已经搞定了"。

什么时候用,什么时候别用

**值得用的情况:**

- 任务超过三个阶段,或者总耗时超过十分钟

- 成品修改成本高:对外发布的内容、给客户的文档、线上跑的迁移脚本

- 你对 AI 的方向没把握:新领域、不熟悉的技术栈

**别用的情况:**

- 单次就能完成的短任务:起个名字、改个错别字、查个事实

- 你验证不了结果的阶段:让设计稿等你对颜色方案没有意义。检查点的前提是你有能力检查

- 本身就没确定路径的探索阶段:头脑风暴要放开跑,检查点是给"验证过程"用的,不是给"探索方向"用的

开始前的自检清单

- [ ] 任务能拆成 2 到 4 个检查点,且你知道每个检查点该产出什么东西

- [ ] 每个检查点你愿意花两三分钟验证。如果验证比返工还贵,这个任务不适合用检查点

- [ ] 你规定了产物格式:证据、决定、风险,三项都要有

常见坑

1. **检查点开成批斗会。** 每次你都只回"好的",那检查点只是让对话变长、上下文变重。验证时就把意见写下来,当场改,别攒到结尾一起说。

2. **产物越积越乱。** 每个检查点的产物建议存一个文件,最后跟成品逐条对账。这份记录还能直接当交接文档用。

3. **验证靠感觉。** 只扫一眼标题,跟没验证一样。强迫自己抽查至少一条证据:打开那个文件、跑一遍那条命令、核对那个数据来源。

4. **检查点设得太细。** 检查点的目的是"早发现方向错",不是"盯住每个细节"。粒度以阶段为准。阶段错了还能换方向,细节盯多了累的是你。

核心一句话:别管理 AI 的劳动过程,管理它的决策节点。每个节点要求它给出证据,你来对证据。

⚙️ 安装与赋能

clawhub install skill-20260825-checkpoint-notes

安装后在你的 Agent 配置中启用此技能,重启 Agent 即可生效。