Claude Code越用越貴?官方揭設定誤區:effort不是拉越滿越好,這樣用才聰明!
Claude Code越用越貴?官方揭設定誤區:effort不是拉越滿越好,這樣用才聰明!

用 Claude Code 的人遲早會遇到這個時刻:產出不如預期,打開設定,畫面上有兩個看起來都能「讓答案變好」的選項,一個是模型(Sonnet、Opus 或 Fable),另一個是努力程度(effort)。不少人的直覺是兩個都拉高,反正越強越好。

Claude Code 團隊技術成員 Lydia Hallie 在 Anthropic 官方部落格撰文,專門拆解這兩個設定。核心訊息是:模型決定 Claude「知道多少」,努力程度決定它「做多少工」,兩者對應完全不同的問題。

換言之,若選錯開關,輕則多付冤枉錢,重則怎麼調都得不到想要的結果。

她先點出一個「半對半錯」的常見認知。大家以為選 Fable 這類大模型會比 Sonnet 聰明;這一半是對的,Anthropic 表示依業界標準基準測試,最大的模型確實更有能力。但大家同時以為調高努力程度只是「讓 Claude 想久一點」,這一半就錯了。

依官方文件的說法,努力程度控制的是「自適應推理」(adaptive reasoning),由模型視任務複雜度決定每一步要不要想、想多深;Hallie 則描述了它的外顯行為:會讀幾個檔案、驗證做多徹底、多步驟任務要自己推進多遠才回頭找你確認。努力調得越高,通常也代表更多 token 消耗。

換模型,換的是一顆訓練完就「凍結」的腦袋

要理解換模型到底換了什麼,Hallie 建議從你按下 Enter 那一刻看起。Claude Code 會把你的訊息、系統提示、工具定義、對話紀錄與相關檔案,打包成一個請求送到 API。但模型從頭到尾不會看到文字,伺服器的第一步是分詞(tokenization),把文字切成小片段,每個片段對應一個固定編號。在那之後,你的提示詞就是一串數字。

模型的工作只有一件:根據這串數字,預測下一個 token(文字片段)該是什麼。而把輸入轉成預測的,是「權重」(weights),也就是數十億個在訓練期間定下來的參數。權重是模型全部知識的所在,而且在你使用時是唯讀的:你的提示詞、CLAUDE.md 設定檔、貼進去的任何文件,都不會改變權重分毫。

這帶出全文最值得記住的區分:把資料放進上下文(context),只能「引導」模型,沒辦法「教會」它。

如果某個程式庫在模型訓練時還不存在,它就不在權重裡;你可以把文件貼給 Claude,它會照著用,但只影響這一次請求,模型本身什麼都沒留下。

Hallie 也順勢解釋了幻覺(hallucination)的本質:當 Claude 自信滿滿地呼叫一個不存在的 API,在沒有外部搜尋或工具驗證的情況下,這通常是權重依照訓練時看過的模式,拼出看似合理但不正確的內容,而不是哪一次「查資料」出了錯;若有接上搜尋或外部資料,錯誤也可能來自找回來的資料或給的脈絡不足。

簡言之,換模型就是把處理你請求的整套凍結權重換掉。嚴格來說,模型影響的不只是知識量,還包括推理、寫程式、長任務處理與驗證的能力;努力程度則是在同一個模型下,調整推理深度與成本的取捨。

努力程度調的不是單純思考時間,而是推理深度與 token 取捨

那努力程度呢?

要先建立一個觀念:Claude 工作時吐出的所有東西,包括思考過程、工具呼叫指令、回覆給你的文字,全都是同一個循環產生的 token,以相同費率計費。模型一次只預測一個 token,把它接上序列後再預測下一個;一段 200 token 的回覆,就是 200 次這樣的生成步驟。回覆越長、步驟越多,你的等待時間與輸出費用通常也跟著增加。

模型設定決定哪套權重來跑、每個 token 單價多少,但它不決定會生成多少 token。左右這件事的,正是努力程度。

努力程度的運作方式可能出乎意料:它是跟你的提示詞一起送進模型的一項輸入,模型在訓練時就學會了各個努力等級該有的行為。

白話說,努力程度設定的是 Claude 要做到多徹底、多有把握才算完工。 在官方的示意例子中,同一個提示詞,高努力路徑生成的 token 數約是低努力的 7 倍,換到的是把握度更高的答案。

在高努力下,Claude 傾向先擬計畫、多讀檔案、跑測試、反覆驗證才回報;在低努力下,它寧可回頭多問你幾句背景,也不花 token 自己推敲。

但 Hallie 強調,調高努力不代表 Claude 會在簡單任務上硬灌用量,「過度思考」(overthinking)是 Anthropic 訓練時特別盯防的行為。她的建議是:多數任務直接用預設值,把努力程度當成依工作型態設定的長期偏好,而不是逐任務調整的旋鈕。

依官方測試,Opus 4.8 的預設努力設定,能用與前代 Opus 4.7 大致相同的 token 量,在同一任務上換到更好的結果。(實務上,努力程度可透過 /effort 指令或模型選單調整;以 Fable 5、Sonnet 5、Opus 4.8 為例,提供 low、medium、high、xhigh、max 五級,級距依模型而異。)

延伸閱讀:Claude Code 提示詞懶人包!官方52組指令一次整理,工程師、PM、設計師都適用

出錯時,先問它是「不知道」還是「不夠認真」

這是全文最實用的判斷框架。Hallie 提醒,當 Claude 做錯,先別急著動設定,回頭檢查你給的脈絡:提示詞是否太模糊?工具接對了嗎?該給的檔案給了嗎? 多數「想調高努力」的情況,病根在上游。

如果脈絡給足了還是錯,再問這個問題:它是不夠認真,還是不夠聰明?

簡單來說,漏讀檔案、沒跑測試、沒複查就交卷,這是不夠認真,調高努力程度;給了完整脈絡、明顯努力過了、仍然錯,這是不夠聰明,建議換更大的模型。

Hallie 補充一個實務差異:大模型更擅長處理模糊指令,小模型則需要明確具體的指示才容易成功。

她用了一個好記的比喻:Fable 是其他人都卡關時才會找上的「疑難雜症專家」,Opus 是資深專家,Sonnet 是非常優秀的通才,努力程度則決定他們花多少時間在你的案子上。

Opus 開低努力,像跟閱歷豐富的專家談五分鐘,他自帶你的程式碼裡沒有的經驗,但五分鐘只夠快速掃一眼;Sonnet 開高努力,像通才花上一整個下午,把你的程式碼全部讀過、跑過、驗證過。

因此可以說,沒有哪種組合是普遍較好的:模型大致對應「多有能力」,努力程度大致對應「多徹底」,多數真實任務兩者都需要一些。

成本的算法也與直覺相反。例行任務上,大小模型都做得對,大模型還會多做驗證、單價又高,這時降級用小模型是純省錢。但在部分真正困難的多步驟任務上,等式可能翻轉:小模型得在能力極限反覆硬磨、燒掉大量來回,大模型幾步就到位,單價雖貴,整個任務的總成本反而可能更低。

Anthropic 並表示,在內部測試中,Fable 能完成 Opus 與 Sonnet 開到最高努力也做不完的工作,這也是它最該被省著用在硬仗上的原因。

要留意的是,官方將 Fable 5 定位為適合長時間、高難度任務的最強模型,但它並非 Claude Code 的預設模型,須手動切換;且它針對資安與生物領域內建安全分類機制,請求被標記時會自動改由 Opus 模型接手。

延伸閱讀:CLAUDE.md這樣寫才對!12條規則一次整理,讓Claude Code錯誤率從41%降至3%

慎選模型,別浪費Token

Anthropic 解釋自家產品之餘,反覆勸用戶「預設值就好」、「把大模型留給難題」,教會用戶把昂貴的運算花在刀口上。

總之,當 AI coding 工具成為日常,「用多大的模型、開多少努力」會變成一門像雲端資源配置一樣的管理學。

建議讀主們先檢查脈絡,再動設定;先分清是知識問題還是執行問題,再決定換模型或調努力。

延伸閱讀:
提示詞越寫越長反而害了你!Anthropic工程師:Claude Code團隊砍掉8成系統提示,模型才真正發揮

資料來源:Anthropic 官方部落格、Claude Code 官方 X 貼文、Claude Code 官方文件

本文初稿為AI編撰,整理.編輯/ 李先泰

往下滑看下一篇文章
OpenAI 重磅講者親臨高雄|掌握前瞻 AI 與產業轉型關鍵趨勢
OpenAI 重磅講者親臨高雄|掌握前瞻 AI 與產業轉型關鍵趨勢

隨著 AI 工具逐漸普及,真正拉開差距的,已不只是技術或算力的強弱,是企業能否整理資料、重新設計流程,並把 AI 融合既有工作方式,持續轉化為營運價值。

Amazon Web Services(AWS)將於10月23日於高雄舉辦「2026 亞馬遜港都 AI 創新日」邀請 OpenAI 與製造、金融、交通、零售及運動育樂等領域的實務代表,從技術趨勢、資料治理、流程設計與組織轉型等面向,拆解 AI 落地前必須處理的現實問題,協助企業重新檢視自身的導入條件與下一步布局。

企業下一步,不只是再導入一套 AI 工具,而是讓 AI 進入日常營運

模型可以採購,系統可以建置,但資料是否整理到位、流程能否重新設計、組織是否清楚由誰負責,才是決定技術能否持續發揮價值的關鍵。

高雄近年推動數位轉型,同樣面對這項核心課題。亞灣周邊聚集扣件、石化、鋼鐵等傳統產業,場域複雜、既有系統眾多,正因如此,更能檢驗一套 AI 導入方法是否具備複製與擴大的條件。城市發展也從建置算力基礎,進一步走向讓技術真正進入產業與治理現場。

AWS 連續六年深耕高雄,今年以「雲騰智慧大南方 齊創 AI 好未來」為主軸,將討論重心從雲端與算力基礎,推進到應用全面升級,協助城市從「有 AI」走向「AI 有感」。

政府治理是否更即時、產業流程是否真正改變、市民與使用者能否感受到服務提升,才是「AI 有感」的具體檢驗。延續「高雄試點、全臺普及、雲端出海國際」的發展路徑,10月 23 日登場的亞馬遜港都 AI 創新日要談的不只是企業「有沒有 AI」,而是導入之後企業的真實改變。

2025 亞馬遜港都 AI 創新日現場,資料照
圖/ AWS

OpenAI 重磅講者親臨高雄,從技術前沿看見企業的關鍵課題

今年活動特別邀請 OpenAI 東南亞暨台灣合作夥伴總監 Mark Jeffrey,以「前瞻 AI 如何助力產業領袖開創新局」為題,分享在 AI 技術快速演進之下,企業應如何重新思考未來布局。

面對 AI 能力邊界持續擴張,哪些應用已具備規模化條件?哪些仍需要更完整的資料、治理與組織準備?這是正在規畫下一階段 AI 投資的企業必須先回答的關鍵課題。

上午議程將從資料、組織與金融三個面向,拆解 AI 落地前必須處理的現實問題。「數據為本,AI 啟航」先回到資料基礎:外部模型跑得再快,若企業自身的欄位定義、存取權限與資料品質尚未整理到位,技術仍難以轉化為可靠判斷。

「打造 AI-Ready 組織的關鍵布局」論壇則聚焦組織當責。AI 專案通常橫跨資訊、營運與管理部門,真正困難的不只是把系統建起來,而是由誰推動流程改造、由誰認列成果,以及當 AI 產出的判斷出現問題時,責任最後應由誰承擔。公部門、製造業與雲端服務業者如何從不同角色處理這些問題,對其他組織同樣具有參考價值。

金融創新論壇將討論 AI、虛擬資產與企業轉型。金融場域對資料安全、合規、風控與可追溯性的高度要求,也提醒企業:效率不能取代治理,AI 更不能成為責任模糊的理由。能否在高監管、高風險環境中建立清楚邊界,將直接影響 AI 應用能不能被長期採用。

2025 年活動論壇現場,資料照
圖/ AWS

從六種產業場景,看 AI 如何走進真實流程

真正具備參考價值的 AI 案例,不只要說明「做了什麼」,還要回答幾個更實際的問題:解決哪一段流程、使用哪些資料、在哪個節點交給 AI、誰負責最後判斷,又如何確認投入確實產生價值。

下午議程規劃橫跨智慧支付、製造、媒體科技、智慧交通、零售製造與運動育樂六種產業場景。每個場景面對的資料條件、即時要求與風險門檻都不相同。

產業場景 議程規劃與關鍵課題
智慧支付 藍新金流運用 AWS AI 自建智能 KYC 與交易監控;處理身份辨識、交易監控與風險判斷
製造 以語意層串接資料孤島,讓 AI Agent 正確理解分散在不同系統的資料
媒體科技 會說台語的 AI Agent:從醫院櫃台到第一線的落地實戰
零售製造 零售製造轉型;把技術接進實際營運與使用者體驗

這些差異進一步說明,AI 沒有一套可以直接複製到所有產業的標準答案。企業真正需要的,不只是更多案例,而是看見不同產業如何依資料條件、即時要求與風險門檻,把 AI 融入實際營運與使用者體驗。

現場同步打造「產業賦能走廊」,邀集超過 15 組雲端生態系夥伴設置展示攤位,聚焦智慧製造、金融科技與城市治理的真實痛點與解法。無論企業目前卡在技術、資料、治理,還是組織協作,不同問題點,都能找到對應的解方。

10 月 23 日,從智慧製造的產線優化、金融科技的風控升級,到運動產業的會員體驗創新,看 AI 如何從概念走進產業現場,成為百工百業轉型升級的實際動能。

10/23高雄展覽館盛大舉行
圖/ AWS

「2026 亞馬遜港都 AI 創新日」,掌握 AI 賦能百工百業、領航產業升級的實務趨勢
立即報名

登入數位時代會員

開啟專屬自己的主題內容,

每日推播重點文章

閱讀會員專屬文章

請先登入數位時代會員

看更多獨享內容

請先登入數位時代會員

開啟收藏文章功能,

請先登入數位時代會員

開啟訂閱文章分類功能,

請先登入數位時代會員

我還不是會員, 註冊去!
追蹤我們
一次搞懂工業AI
© 2026 Business Next Media Corp. All Rights Reserved. 本網站內容未經允許,不得轉載。
106 台北市大安區光復南路102號9樓