Episode Details

Back to Episodes
AI 老是學不乖?問題不在 prompt!Anthropic 記錄 Warp 用兩個檔案接住回饋

AI 老是學不乖?問題不在 prompt!Anthropic 記錄 Warp 用兩個檔案接住回饋

Published 1 month, 1 week ago
Description


Warp 撞上 AI 重複犯同樣錯誤的老問題,癥結是人類回饋在 session 結束時就消失。Anthropic 官方 blog 記錄這家終端機 AI coding agent 公司怎麼用兩個檔案接住回饋。

⭐ 文章深度讀:如果你今天只想做最小版本
→ https://heymaibao.com/warp-self-improving-agent-two-files/

⚡ 章節重點
開場:你糾正的那句話去哪了 00:00
來源與真正的診斷 00:32
兩個檔案的架構 02:15
一個漏掉的標籤讓迴圈跑起來 04:06
被低估的一句話:skill 是檔案 05:41
這套簡單的隱藏帳單 07:07
只想做最小版本的話 08:31
結語 09:17

📝 懶人包
∙ Warp 內部的程式碼審核 agent 品質很差,工程師抱怨它的意見沒有幫助。團隊試過手動改 prompt、也試過改善 AGENTS.md 這類脈絡檔,兩招都只能治標

∙ 真正的診斷是回饋在 session 結束時消失。解法是兩個 skill 檔:inner skill 帶著領域知識做事,outer improver skill 定期執行、比對人類回饋、提出對 inner skill 的一個小幅編輯

∙ 因為 skill 就是純檔案,這些修改可以走團隊本來就在用的程式碼審核流程,人類在最後一關 review 與合併,決定要不要讓 agent 真的變成這樣

∙ 我的觀察是,這套做法的門檻不在技術,在於你的回饋有沒有落點。多數人給 AI 的回饋是在對話裡罵一句就過去了,Warp 的做法是逼回饋落在檔案上,再讓另一個 agent 去讀那些檔案

📚 參考資料
How Warp builds self-improving agents on Claude
→ https://claude.com/blog/how-warp-builds-self-improving-agents-on-claude

Agent Skills - Claude Platform Docs
→ https://platform.claude.com/docs/en/agents-and-tools/agent-skills/overview

Skill authoring best practices - Claude Platform Docs
→ https://platform.claude.com/docs/en/agents-and-tools/agent-skills/best-practices

Introducing Oz: the orchestration platform for cloud agents
→ https://www.warp.dev/blog/oz-orchestration-platform-cloud-agents

Warp's issue triage agent
→ https://github.com/warpdotdev/warp-agents-demo-github-issue-triage

Listen Now

Love PodBriefly?

If you like Podbriefly.com, please consider donating to support the ongoing development.

Support Us