焦點報導 · ARTICLE

Anthropic 主張別微管 AI:定義目標,放手給模型規劃

Cherny建議明確目標與限制、定義完成標準,放手讓AI自規劃;過度拆步反限縮能力。Ng提倡「懶人提示」但須會評估;Uncle Bob以測試約束代理。

講師團隊整理 AI Academy · 編輯部
2026/07/29 發佈 23 觀看 zh-TW
Anthropic 主張別微管 AI:定義目標,放手給模型規劃 AI 生成示意圖

現代模型更擅長自我規劃與拆解任務,過度細碎指示會綁住手腳。對房仲來說,先說清楚成果、限制與驗收標準,其他交給模型嘗試,通常更快達標。隨模型升級,提示詞越精簡越有效,重點轉為設邊界與驗收機制。

這對第一線房仲的提示詞該怎麼改寫最有效?

明確定義成果與底線,放手給 AI 規劃,是更對應現代模型的寫法。Anthropic 的 Boris Cherny 在 Y Combinator 活動被《Business Insider》引述主張:描述要的結果、邊界與成功條件,步驟交給模型判斷。他提醒,把工作拆成嚴格順序反而抑制模型能力;他直言:「對現代模型來說,這種做法其實真的不太適合。」

在案件文案、帶看訊息與簽約流程指引等常見任務上,先定義輸出樣貌與不該觸碰的界線,再讓模型自行選路。Cherny建議把精力放在「定義完成標準」而非「規定每一步」,並採用先放手、再回頭審核與微調的節奏;他說:「接著就放手讓模型發揮,過一會兒再回來看看。」

要不要寫長提示?還是先丟簡短再補?

先短後補、以審核帶修正,能加速迭代,但需有判讀力。Google Brain 共同創辦人 Andrew Ng 提出「懶人提示」:先送出簡短甚至不夠精確的提示,觀察再補資訊。他提醒這是進階技巧,關鍵在能否快速判斷好壞;遇到複雜任務,他亦會投入較長提示。他曾寫道:「I find it’s sometimes faster to be lazy and dash off a quick, imprecise prompt and see what happens.」—Andrew Ng。

Cherny 的極簡派也體現在他個人使用。據 Y Combinator 訪談,他的 CLAUDE.md 僅兩條規則(自動合併 PR、把 PR 貼到 Slack)。他建議若檔案已塞滿 Token,就刪掉重來,只保留讓模型不脫軌的最低指示;模型若犯錯,再逐條補回,通常會發現需要的額外規則愈來愈少。

我該用哪種代理模式?如何少看細節又能把關?

新版本提升自我規劃力,Auto Mode 更適合成為預設。Cherny 表示自己已全面改用 Auto Mode,不再把 Plan Mode 當預設;他指出 Plan Mode 對 Opus 4 至 4.5 曾經重要,但自 Opus 4.6 起,模型更能自行規劃與執行,使用者不必盯場,能同時切換處理多個任務的 Claude。

表:Anthropic 模式與版本走向(依原文脈絡)

模式/版本重點/使用傾向出處
Plan Mode(Opus 4–4.5)曾相當重要,用於規劃流程Boris Cherny 於 YouTube 談及
Auto Mode(Opus 4.6 之後)模型更會自我規劃,適合作為預設Boris Cherny 於活動與影片提及

把關方法可從「看結果不看過程」著手,改以驗收網兜住品質。《Clean Code》作者 Uncle Bob Martin 在 X 上表示,現階段他「My current strategy is to not read any of the code written by my agents.」,而用單元測試、Gherkin 行為測試、QA 流程、程式碼品質指標、變異測試與測試覆蓋率等多重機制來約束與驗證代理產出。

這對房仲日常流程與團隊協作有什麼實做建議?

以「成果定義+邊界+驗收」重塑流程,比逐步監工更有效率。對房仲經紀團隊,先為常見任務(物件文案、開發話術、帶看確認訊息、合約注意事項彙整)定義完成標準與禁區,再交由模型規劃步驟;初版出來後,針對缺口補充提示或規則。Cherny提醒,沿用舊式微管會限制新模型本可採取的更佳解法。

將時間花在建立可重複的「驗收清單」與「品質檢查」會更有報酬。例如以測試清單驗證資訊完整性、法規措辭邊界與品牌語氣一致,再要求模型自我檢查與修正。Cherny 認為模型用途仍在快速擴張,使用者若持續試驗、調整邊界與標準,將更容易從升級的能力中獲益。


資料來源:INSIDE 硬塞 — 原文連結

原始來源: https://www.inside.com.tw/article/41949-claude-code-boris-cherny-stop-micromanaging-ai