請更新您的瀏覽器

您使用的瀏覽器版本較舊,已不再受支援。建議您更新瀏覽器版本,以獲得最佳使用體驗。

「叫AI再檢查一次」反而更花錢!Claude Opus 5最新提示詞指南,8項調整一次看

數位時代

更新於 9小時前 • 發布於 9小時前

隨著 Claude Opus 5 上線,Anthropic 官方近日發布開發者文件《Prompting Claude Opus 5》,整理這款模型在提示工程上的調校建議。Claude Opus 5 主打複雜的代理式程式開發與企業工作,特別適合跨多檔案功能、較大規模重構,以及需要長時間執行的任務。

隨著模型能力變強,舊有的提示習慣也需要調整。這份文件提醒開發者,Opus 5 已會主動驗證與修正產出。因此,過去常見的「完成後再檢查一次」或「交給子代理複查」不一定有幫助,反而可能增加工具呼叫與 token 用量。

Anthropic 的建議是,把提示詞用在具體規則上:回覆要多長、工作中何時更新進度、任務範圍到哪裡,以及哪些工作才需要交給子代理。《數位時代》以下整理這份文件中8個 Claude Opus 5 的提示詞調整重點供讀者參考。

(一) 別直接沿用 Opus 4.8 的設定

Anthropic 指出,和 Claude Opus 4.8 相比,Opus 5 更擅長處理複雜的程式工作,例如跨多個檔案開發功能、重構程式碼,以及找出程式中的 bug。它在較低的 effort 設定下,也能維持不錯的表現。

這代表,如果你之前為 Opus 4.8 加了很多提示規則,現在不一定要照用。例如,code review 時若要求模型「只報高嚴重度問題」,它就可能真的只列出少數問題。Anthropic 建議先讓 Opus 5 列出所有發現,再由後續流程決定哪些要處理。

Opus 5 大致能直接沿用既有的 Opus 4.8 提示詞。不過,若團隊沿用了前一代的 effort 預設值,官方建議重新比較不同設定在自身任務中的品質、成本與回應時間;過去為視覺任務加入的提示補強,也可重新確認是否仍有必要。

簡單來說,過去習慣固定使用高 effort 的團隊,也應重新測試 low、medium 是否已足夠;只有特別複雜的程式任務,再提高到 xhigh。

(二)設定回覆篇幅

Anthropic 指出,Claude Opus 5 預設給使用者看的回覆,通常比先前的 Opus 模型更長。這不代表模型想得愈多就一定說得愈多;effort 控制的是模型的思考量,不是畫面上顯示的回答長度。

因此,把 effort 從 high 調低到 medium 或 low,可能減少思考所用的 token 與回應時間,但不保證回覆會跟著縮短。若產品希望模型少寫一點,應直接在提示詞中說明篇幅與說明方式。

例如,Anthropic 建議在面向使用者、需要多輪對話的產品中加入:

回覆請保持聚焦、簡短、精煉。免責說明與注意事項請簡要帶過,主要篇幅用來回答核心問題。若使用者要求解釋,除非明確要求深入說明,否則先提供高層次摘要。

若系統提示本身很長,還可在提示詞接近結尾處加上一句簡短提醒,避免篇幅要求被前面的規則淹沒:

請讓輸出適度維持精簡。

這條規則適合客服、工作助手與產品內的聊天介面;它處理的是使用者實際看到的回答長度,不是模型在背景花多少篇幅思考。

(三) 設定任務進行中的回報規則

Opus 5 在使用工具時,傾向主動說明接下來要做什麼。這對需要透明度的工作流程有幫助,但若沒有規範,使用者可能先看到一串過程說明,最後才看見結果。

第一次使用工具前,用一句話說明接下來要做什麼。工作期間,只有在發現重要資訊或改變方向時才提供簡短更新。完成時,第一句先說明結果,再補充需要的細節。

重點不是禁止模型回報進度,而是定義回報的時機與篇幅。官方也建議,若要調整說明風格,提供你希望看到的正面範例,通常比列出一長串禁止事項更有效。

(四) 報告和文件要另外控制篇幅

除了對話回覆,Claude Opus 5 寫入檔案的報告、Markdown 文件與摘要,篇幅也可能比先前模型更長。若產品會自動產出這類文件,應另外加入長度規則,而不是只在對話提示詞中要求「簡短」。

書面文件的長度應符合任務需要:完整涵蓋必要內容,但不要用填充段落、重複摘要或制式內容湊篇幅。

這條規則處理的是交付文件的長度,不影響模型在聊天介面中的回覆篇幅。

(五) 移除重複驗證,限制任務範圍

官方指出,Opus 5 會自行驗證產出。若提示詞仍要求「每個非簡單任務都要進行最後驗證」或「另派子代理複查」,可能增加不必要的工具呼叫與 token 用量,卻不一定改善結果。

另一個問題是任務範圍擴大:模型可能加入沒有被要求的步驟,或自行改寫任務目標。對範圍明確的工作,可加入:

請依使用者要求,在原定範圍內交付成果。一般的例行判斷請自行處理;只有對需求的不同理解會導致實質不同的工作時,才向使用者確認。若你認為需求有誤,或有更好的做法,請用一句話說明,但仍依原要求繼續執行;不要自行縮小、擴大或改變任務。請完整完成任務,但不要進行明顯超出要求範圍的動作。

(六)設定子代理的啟動條件

Opus 5 能協調多個子代理,適合處理彼此獨立的大型工作,例如跨多檔案的廣泛調查。不過,小任務若也拆分處理,執行時間與成本都會增加。

只有大型、可獨立且可平行處理的工作才委派子代理。不要將可在少量工具呼叫內完成的工作外包,也不要用子代理複查自己的結果。若一個子代理能完成任務,就不要建立多個。

除了提示詞,對成本敏感的系統也應在工具層設定子代理數量上限。

(七)少加「再檢查」指令,只在必要時說明更正

Claude Opus 5 本身就會發現並修正錯誤,不需要再反覆要求它「再三確認答案」或「回覆前重新驗證」。這類指令和模型原有的檢查行為重疊,可能增加 token 用量與執行時間,品質卻不一定更好。

另一個差異是,Opus 5 比先前版本更常主動說明自己修正了前面的說法。這在內部工作流程未必是問題,但面向一般使用者的產品中,若每個小修正都另外解釋,對話容易變得冗長,也會打斷原本的工作。

若希望模型只交代重要更正,可加入:

只有當先前的錯誤會影響使用者的程式碼、結論或決策時,才更正先前的說法。更正時,請直接且簡短地說明,然後繼續完成任務。若錯誤不影響使用者,直接修正即可,不需要另外提起。

(八)不要隨便關閉thinking

Claude Opus 5 預設開啟 thinking,且只有在 high 或更低的 effort 設定下才能關閉。Anthropic 提醒,若關閉 thinking,模型偶爾會在使用者看得到的回覆中出現兩種異常輸出。

工具呼叫被寫成一般文字。

關閉 thinking 後,模型有時會把原本應以結構化格式送出的工具呼叫,直接寫進回覆文字裡。這代表工具其實沒有被執行;在多輪代理式工作中,這段文字還會留在對話紀錄裡,影響後續回合。需要頻繁使用搜尋等工具的任務,較容易出現這種情況。

回覆出現內部 XML 標籤。

模型也可能在可見回覆中輸出 或其他內部 XML 標籤。若系統提示裡有「不要思考」或「不要推理」等規則,建議移除,因為這類指令反而可能增加標籤外洩的機率。

官方的主要建議是:不要為了省 token 直接關閉 thinking,而是保留 thinking、改用較低的 effort 控制成本。多數任務下,開啟 thinking 的 low effort,在相近成本下通常比關閉 thinking 更穩定。

如果整合環境仍必須關閉 thinking,可加入以下規則:

使用工具前,你可以先說一句簡短說明。若沒有工具能完成使用者的要求,請直接說明,不要猜測。回覆中不得包含內部或系統 XML 標籤。

使用前提:先用自己的任務測一次

這份文件主要寫給透過 API 或系統提示整合 Claude Opus 5 的開發者。文中的規則可作為提示詞設計方向,但不代表每個產品都該原封不動套用;回覆長度、子代理數量與驗證流程,仍要看任務類型與產品介面決定,並應用實際任務重新測試。

延伸閱讀:Claude模型怎麼選?Fable、Opus、Sonnet、Haiku一表看懂,選錯可能會多花10倍成本
Graph Engineering是什麼?迴圈工程、Harness Engineering⋯5種AI工程術語差異一次看懂

資料來源:Anthropic

本文初稿為AI編撰,整理.編輯/黃若彤

延伸閱讀

Claude分享功能爆隱私疑慮!一行語法可Google搜出私密對話與個資,4招自保步驟一次看
ChatGPT Chrome擴充功能怎麼用?4步驟安裝、Codex操作、好用提示詞範例一次看
「加入《數位時代》LINE好友,科技新聞不漏接」

查看原始文章

更多理財相關文章

01

台股連兩天重挫 證交所急喊話:回歸基本面

NOWNEWS今日新聞
02

台股2天暴跌3593點 證交所:基本面及資金動能穩健

中央通訊社
03

貸款500萬炒股滿100天!巴逆逆猛曬「帳面真實損益」崩潰了

民視新聞網
04

「街口小霸王」重判7年6月理由曝! 北院狂電胡亦嘉:對檢比中指「藐視司法氣焰高」

太報
05

台股崩跌!財經名嘴邱沁宜「點名1股」:越跌越有價值

民視新聞網
06

為顧客遞上護頭靠墊、免費充電、Wi-Fi!熊本強震後,日本企業「神對應」一次看

數位時代
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...