現代模型更擅長自我規劃與拆解任務,過度細碎指示會綁住手腳。對房仲來說,先說清楚成果、限制與驗收標準,其他交給模型嘗試,通常更快達標。隨模型升級,提示詞越精簡越有效,重點轉為設邊界與驗收機制。
這對第一線房仲的提示詞該怎麼改寫最有效?
明確定義成果與底線,放手給 AI 規劃,是更對應現代模型的寫法。Anthropic 的 Boris Cherny 在 Y Combinator 活動被《Business Insider》引述主張:描述要的結果、邊界與成功條件,步驟交給模型判斷。他提醒,把工作拆成嚴格順序反而抑制模型能力;他直言:「對現代模型來說,這種做法其實真的不太適合。」
在案件文案、帶看訊息與簽約流程指引等常見任務上,先定義輸出樣貌與不該觸碰的界線,再讓模型自行選路。Cherny建議把精力放在「定義完成標準」而非「規定每一步」,並採用先放手、再回頭審核與微調的節奏;他說:「接著就放手讓模型發揮,過一會兒再回來看看。」
要不要寫長提示?還是先丟簡短再補?
先短後補、以審核帶修正,能加速迭代,但需有判讀力。Google Brain 共同創辦人 Andrew Ng 提出「懶人提示」:先送出簡短甚至不夠精確的提示,觀察再補資訊。他提醒這是進階技巧,關鍵在能否快速判斷好壞;遇到複雜任務,他亦會投入較長提示。他曾寫道:「I find it’s sometimes faster to be lazy and dash off a quick, imprecise prompt and see what happens.」—Andrew Ng。
Cherny 的極簡派也體現在他個人使用。據 Y Combinator 訪談,他的 CLAUDE.md 僅兩條規則(自動合併 PR、把 PR 貼到 Slack)。他建議若檔案已塞滿 Token,就刪掉重來,只保留讓模型不脫軌的最低指示;模型若犯錯,再逐條補回,通常會發現需要的額外規則愈來愈少。
我該用哪種代理模式?如何少看細節又能把關?
新版本提升自我規劃力,Auto Mode 更適合成為預設。Cherny 表示自己已全面改用 Auto Mode,不再把 Plan Mode 當預設;他指出 Plan Mode 對 Opus 4 至 4.5 曾經重要,但自 Opus 4.6 起,模型更能自行規劃與執行,使用者不必盯場,能同時切換處理多個任務的 Claude。
表:Anthropic 模式與版本走向(依原文脈絡)
| 模式/版本 | 重點/使用傾向 | 出處 |
|---|---|---|
| Plan Mode(Opus 4–4.5) | 曾相當重要,用於規劃流程 | Boris Cherny 於 YouTube 談及 |
| Auto Mode(Opus 4.6 之後) | 模型更會自我規劃,適合作為預設 | Boris Cherny 於活動與影片提及 |
把關方法可從「看結果不看過程」著手,改以驗收網兜住品質。《Clean Code》作者 Uncle Bob Martin 在 X 上表示,現階段他「My current strategy is to not read any of the code written by my agents.」,而用單元測試、Gherkin 行為測試、QA 流程、程式碼品質指標、變異測試與測試覆蓋率等多重機制來約束與驗證代理產出。
這對房仲日常流程與團隊協作有什麼實做建議?
以「成果定義+邊界+驗收」重塑流程,比逐步監工更有效率。對房仲經紀團隊,先為常見任務(物件文案、開發話術、帶看確認訊息、合約注意事項彙整)定義完成標準與禁區,再交由模型規劃步驟;初版出來後,針對缺口補充提示或規則。Cherny提醒,沿用舊式微管會限制新模型本可採取的更佳解法。
將時間花在建立可重複的「驗收清單」與「品質檢查」會更有報酬。例如以測試清單驗證資訊完整性、法規措辭邊界與品牌語氣一致,再要求模型自我檢查與修正。Cherny 認為模型用途仍在快速擴張,使用者若持續試驗、調整邊界與標準,將更容易從升級的能力中獲益。
資料來源:INSIDE 硬塞 — 原文連結
原始來源: https://www.inside.com.tw/article/41949-claude-code-boris-cherny-stop-micromanaging-ai