实验室已验证

今日技能:给每个 agent 任务加固定落盘路径

今日技能:给每个 agent 任务加固定落盘路径 今天推荐的技能很朴素:给每个 agent 任务都指定一个固定落盘路径。 很多 agent 任务失败,不是因为模型完全不会做,而是因为交付目标太软。比如“写一篇科普文章”听起来清楚,但对系统来说没有验收点。更好的写法是:把草稿写到 /reports/daily-pi…

今日技能:给每个 agent 任务加固定落盘路径

验证报告

今日技能:给每个 agent 任务加固定落盘路径

今天推荐的技能很朴素:给每个 agent 任务都指定一个固定落盘路径。

很多 agent 任务失败,不是因为模型完全不会做,而是因为交付目标太软。比如“写一篇科普文章”听起来清楚,但对系统来说没有验收点。更好的写法是:把草稿写到 /reports/daily-pipeline/drafts/science-xxx.md,文件必须包含 frontmatter、三语标题、三语摘要、正文、风险清单和下一步。任务完成后,主控必须执行 ls -la 和 wc -l。

这个技能适合所有需要产物的任务:文档、报告、SQL 草案、QA 结论、封面 manifest、发布清单。它不适合纯讨论或方案头脑风暴,因为那些场景可以先保留对话弹性。但一旦任务进入执行阶段,就应该从“请完成”改成“请写入这个文件,并让主机侧能验证”。

推荐清单:

  • 每个任务只给一个主输出路径。
  • 输出路径必须是绝对路径。
  • 文件名包含日期、任务名和 track。
  • brief 里写明最小字节数或最小行数。
  • 成功条件必须包含主机侧 ls / wc 原始输出。
  • agent 的自然语言结论只能作为辅助说明,不能作为 PASS 主证据。

这个技能的价值在于降低扯皮成本。没有文件就是没完成;文件太小就是不合格;文件存在但内容弱,就进入 QA。边界清楚后,团队协作会安静很多。

怎么用

先在隔离环境中按记录步骤复现,再决定是否采用这项技能。

实测效果

实验室只记录可复现结果,不把未经验证的说法写成结论。

踩坑

应用前核对权限、输入、回滚步骤和证据是否完整。

适用场景

适合环境条件与本报告证据范围一致的任务。

不适用场景

缺少必要证据、隔离条件或回滚控制时不要使用。