實驗室已驗證

今日技能:為每個 agent 任務加上固定的檔案儲存路徑

今日技能:為每個 agent 任務加上固定的檔案儲存路徑 今天推薦的技能很樸實:為每個 agent 任務指定一個固定的檔案儲存路徑。 許多 agent 任務失敗,並非因為模型完全不會做,而是因為交付目標太過模糊。例如「寫一篇科普文章」聽起來清楚,但對系統來說沒有驗收標準。更好的寫法是:將草稿寫入 /reports…

今日技能:為每個 agent 任務加上固定的檔案儲存路徑

驗證報告

今日技能:為每個 agent 任務加上固定的檔案儲存路徑

今天推薦的技能很樸實:為每個 agent 任務指定一個固定的檔案儲存路徑。

許多 agent 任務失敗,並非因為模型完全不會做,而是因為交付目標太過模糊。例如「寫一篇科普文章」聽起來清楚,但對系統來說沒有驗收標準。更好的寫法是:將草稿寫入 /reports/daily-pipeline/drafts/science-xxx.md,檔案必須包含 frontmatter、三種語言的標題、三種語言的摘要、正文、風險清單以及下一步行動。任務完成後,主控端必須執行 ls -la 和 wc -l。

這個技能適合所有需要產出實體檔案的任務:文件、報告、SQL 草案、QA 結論、封面 manifest、發布清單。它不適合純討論或方案發想階段,因為那些情境可以先保留對話的彈性。但一旦任務進入執行階段,就應該從「請完成」改為「請寫入這個檔案,並讓主機端能夠驗證」。

推薦清單:

  • 每個任務只給一個主要輸出路徑。
  • 輸出路徑必須是絕對路徑。
  • 檔名包含日期、任務名稱和 track。
  • 在 brief 中写明最小位元組數或最小行數。
  • 成功條件必須包含主機端 ls / wc 的原始輸出。
  • agent 的自然語言結論只能作為輔助說明,不能作為 PASS 的主要證據。

這個技能的價值在於降低溝通扯皮的成本。沒有檔案就是沒完成;檔案太小就是不合格;檔案存在但內容薄弱,就進入 QA 流程。邊界清楚後,團隊協作會安靜許多。

怎麼用

先在隔離環境中按記錄步驟重現,再決定是否採用這項技能。

實測效果

實驗室只記錄可重現結果,不把未經驗證的說法寫成結論。

踩坑

套用前核對權限、輸入、回復步驟和證據是否完整。

適用場景

適合環境條件與本報告證據範圍一致的任務。

不適用場景

缺少必要證據、隔離條件或回復控制時不要使用。