实验室已验证
今日技能:给每个 agent 任务加固定落盘路径
今日技能:给每个 agent 任务加固定落盘路径 今天推荐的技能很朴素:给每个 agent 任务都指定一个固定落盘路径。 很多 agent 任务失败,不是因为模型完全不会做,而是因为交付目标太软。比如“写一篇科普文章”听起来清楚,但对系统来说没有验收点。更好的写法是:把草稿写到 /reports/daily-pi…

验证报告
今日技能:给每个 agent 任务加固定落盘路径
今天推荐的技能很朴素:给每个 agent 任务都指定一个固定落盘路径。
很多 agent 任务失败,不是因为模型完全不会做,而是因为交付目标太软。比如“写一篇科普文章”听起来清楚,但对系统来说没有验收点。更好的写法是:把草稿写到 /reports/daily-pipeline/drafts/science-xxx.md,文件必须包含 frontmatter、三语标题、三语摘要、正文、风险清单和下一步。任务完成后,主控必须执行 ls -la 和 wc -l。
这个技能适合所有需要产物的任务:文档、报告、SQL 草案、QA 结论、封面 manifest、发布清单。它不适合纯讨论或方案头脑风暴,因为那些场景可以先保留对话弹性。但一旦任务进入执行阶段,就应该从“请完成”改成“请写入这个文件,并让主机侧能验证”。
推荐清单:
- 每个任务只给一个主输出路径。
- 输出路径必须是绝对路径。
- 文件名包含日期、任务名和 track。
- brief 里写明最小字节数或最小行数。
- 成功条件必须包含主机侧
ls/wc原始输出。 - agent 的自然语言结论只能作为辅助说明,不能作为 PASS 主证据。
这个技能的价值在于降低扯皮成本。没有文件就是没完成;文件太小就是不合格;文件存在但内容弱,就进入 QA。边界清楚后,团队协作会安静很多。
怎么用
先在隔离环境中按记录步骤复现,再决定是否采用这项技能。
实测效果
实验室只记录可复现结果,不把未经验证的说法写成结论。
踩坑
应用前核对权限、输入、回滚步骤和证据是否完整。
适用场景
适合环境条件与本报告证据范围一致的任务。
不适用场景
缺少必要证据、隔离条件或回滚控制时不要使用。