Token帳單繳到心痛?官方公開3招優化設定,Claude API成本大省80%、準確率反破9成
Token帳單繳到心痛?官方公開3招優化設定,Claude API成本大省80%、準確率反破9成

Claude API成本怎麼降?Anthropic近期公開一套API成本優化方法,從Prompt Caching(提示快取)、提示詞審查到effort設定,目標都是減少模型不必要的token與推理成本。

Anthropic在一組客服基準測試中,把同一個應用從Opus 4.8搭配預設effort,一路調整到Sonnet 5搭配低effort,再加入任務分流規則。最後在驗收測試題上,**準確率從78.6%升到90.5%,成本只剩原本約五分之一。**這是Anthropic工程師Lance Martin在2026年9月8日公布的實測案例。

Anthropic把常見的成本浪費歸納成三種:

  1. 每次API請求都重複處理相同內容
  2. Prompt裡保留大量為舊模型撰寫的多餘指令
  3. 簡單任務也使用過高的effort

對應的解法分別是Prompt Caching(提示快取)、Prompt Audit(提示詞審查)與Effort設定。以下逐一說明怎麼設定,以及各自適合什麼情境。

Claude Prompt Caching怎麼用?用提示快取降低重複Token成本

先講什麼情況用得到。只要你的應用每次呼叫API時,開頭都帶著同一份說明或工具定義,例如一段幾千字的系統提示,這段每次都相同的內容就叫「前綴」。

舉例來說,一個客服機器人每次都會先送上同一份產品說明與退換貨規則,再接上使用者的問題,前面那份說明就是前綴。沒有快取時,模型每次都要重新處理一遍,也每次都照全價收費。

提示快取做的事,是把模型處理過這段前綴的中間結果暫存起來,下一次請求只要前綴完全一致,就直接沿用,這叫「快取命中」。它存的不是答案,而是處理過程的中間狀態,不會改變回答內容。

要注意的是「完全一致」就是字面上的意思:前綴依tools、system、messages的順序建立,中間只要有一個字不同,後面全部得重算。

要做的只有兩件事。

第一,把不會變的內容排在最前面,會隨對話增長的部分放最後。
第二,在API請求頂層加一個cache_control設定,系統會自動在最後一個可快取的位置設下斷點。

下面是示意寫法,不能直接執行。括號裡的中文說明代表你原本的內容,實際請求要換成自己的資料:

{
  "model": "claude-sonnet-5",
  "max_tokens": 4096,
  "cache_control": {"type": "ephemeral"},
  "tools": [ "(工具清單,例如查訂單、查庫存的功能定義,每次相同)" ],
  "system": "(系統提示,例如產品說明與退換貨規則,每次相同)",
  "messages": [ "(這次的對話內容,含使用者剛問的問題,每次不同)" ]
  }

對照前面說的排序原則:tools與system每次相同,就是會被快取的前綴;messages每次不同,放在最後。你要加的只有cache_control那一行,其他欄位都是原本請求裡就有的,內容不用改。

價格方面,依Anthropic提示快取文件截至9月11日的規格,寫入快取時按基本輸入價的1.25倍計費,之後每次命中只收0.1倍,也就是原價的一折。token是模型計算文字用量的單位,快取有最低門檻,以Sonnet 5為例,前綴至少要1,024個token才會被快取,太短的提示詞用不到這項功能。

快取預設保留5分鐘,這段保留時間叫TTL,5分鐘內沒有新請求就會清掉;可以付2倍寫入價延長到1小時,但划不划算要看重複內容有多長、會被重用幾次、請求之間隔多久,不是由對話長短決定。同一段對話裡,前面已處理過的歷史內容也算前綴,一樣可以被重用。

最常見的失敗原因是系統提示裡放了時間戳或每次不同的編號,這等於在前綴最前面插了一個永遠對不上的內容,後面全部白算。設好之後不用自己猜有沒有命中,Claude Console的快取診斷會顯示命中率與沒命中的原因。

Claude Prompt怎麼優化?升級模型後先刪掉3種多餘指令

換新模型時,很多人只把模型名稱改掉,提示詞原封不動。問題是舊提示詞裡常有很多叮嚀,像「回答前再檢查一次」「一定要非常仔細」「請照這幾個步驟想」,那是以前模型不夠聰明時加的保險。

新模型自己就會推理,這些叮嚀變成多餘的工作。Lance Martin舉例,「再檢查一次」會讓模型把同一筆訂單查兩遍;兩條互相矛盾的退款規則,會讓它不敢退本來該退的錢。Anthropic實測,把這類叮嚀刪掉後,同一個新模型平均成本降14.6%、準確率升5.3%。

做法是升級前把提示詞從頭讀一遍。跟業務有關的規則要留,例如退款前要確認訂單狀態;純粹叫模型「再想一次」「再確認一次」的可以刪。用Claude Code的人,可以直接跑 /claude-api prompt-audit,它會把這類叮嚀找出來。

Claude Effort怎麼設定?簡單任務不用每次都開High

Claude API的effort設定,用來控制模型在任務上投入多少推理資源。 等級越高,模型通常會投入更多推理與工具使用,因此也可能帶來更高成本。

不設定的話,預設是high,也就是幾乎每個任務都會投入較多推理。如果只是分類、摘要、格式轉換等簡單任務,使用high就可能花掉不必要的成本。

要調整,只要在API請求裡加一個output_config欄位,填low、medium、high、xhigh、max其中一級。示意如下,省略號代表你原本的內容:

{
  "model": "claude-opus-5",
  "max_tokens": 4096,
  "messages": [ ... ],
  "output_config": {"effort": "medium"}
}

要改的只有effort那個值。要留意的是,effort調低不等於回答變短,它影響的是模型思考和查資料的多寡,不是字數。

該調到哪一級,沒有公式,只能試。拿一組固定的題目,每一級都跑一遍,看準確率從哪一級開始明顯掉下來,就停在它的前一級。Anthropic自己測出一個有趣的結果:新模型Fable 5.1用low,成績和前一代Fable 5用high差不多,費用卻只要三分之一。

也就是說,換新模型時不用急著開高effort,先從低的試起可能更划算。

兩個提醒。第一,調低之後要確認答案品質有沒有掉,尤其是需要多想幾步的任務,太低會讓模型還沒查完就下結論。第二,同一段對話中途改effort,前面存好的快取會失效,所以一開始就選定,不要邊聊邊改。

Claude API成本怎麼評估?用固定測試題比較準確率與費用

三招做完,要拿同一組固定的題目再跑一次,看費用有沒有降、答案有沒有變差。Anthropic的做法是把題目分兩份,一份拿來反覆調設定,另一份留到最後驗收,避免設定只對練習題有效。

用Claude Code的人可以直接跑 /claude-api hillclimb,它會自動反覆試設定;/claude-api cost-optimize則是先幫你盤點錢花在哪,再逐項試省錢做法。

Claude Message Batches:非即時任務還能再省50%

還有一招適合不急著拿結果的工作,例如凌晨把一整天的客服對話統一做摘要。改用Message Batches API把請求打包送出,多數1小時內完成,最慢24小時,費用直接打五折,還能和快取折扣疊加。

最後提醒,文中的省錢幅度都是Anthropic自己測的,你的情況不一定一樣。建議順序是先看錢花在哪,再清提示詞,接著試effort,最後才用批次,每改一項就驗一次。

延伸閱讀:Claude官方課程有中文版了!22門全免費,涵蓋入門到API開發,完課還能拿證書

Claude API省錢3招怎麼選?

如果每次API請求都有大量重複內容,先使用Prompt Caching;如果是從舊模型升級,先檢查Prompt裡是否留下多餘指令;如果大量任務只是分類、摘要或格式轉換,則可以優先測試降低effort。

三種方法不需要一次全部套用。比較穩妥的方式,是先建立一組固定測試題,每改一項設定,就重新比較成本與準確率,確認省下來的token沒有換來明顯的品質下降。

延伸閱讀:
Gemini Notebook別只拿來摘要!8組讀書指令,讓AI幫你出題、抓重點、做模擬考
Gemini Notebook教學地圖!AI筆記本、簡報製作、財報解讀27篇精華用法一次看

資料來源:Anthropic官方部落格Anthropic提示快取文件Anthropic快取診斷文件Anthropic effort文件Anthropic批次處理文件

本文初稿為AI編撰,整理.編輯/ 李先泰

往下滑看下一篇文章
迎戰大缺工時代!德國凱馳在台首推「智慧自主洗地機器人」,開啟商用清潔革命
迎戰大缺工時代!德國凱馳在台首推「智慧自主洗地機器人」,開啟商用清潔革命

在少子化與高齡化的雙重夾擊下,台灣勞力結構正面臨前所未有的嚴峻挑戰,預估從2020至2030年間,15至64歲的勞動人口將減少約10.3%。「缺工」不再是短期波動,而是長期影響各行各業的結構性危機,尤以高度依賴人力的清潔產業為甚。

然而在後疫情時代,社會對場域的衛生標準只增不減,加上大型商場、交通樞紐、物流中心與高科技廠房的建設面積每年持續擴增,清潔人員招募困難且年齡漸趨中高齡,有限人力難以扛起龐大的日常清潔工作。

面對亟待填補的市場空缺,全球清潔設備領導品牌德國凱馳,憑藉深厚的專業底蘊與嚴謹的研發標準,首次在台推出「KIRA BR 50智慧自主洗地機器人」,為台灣大型商用場域提供劃時代的智慧清潔解方。

凱馳總經理李恒毅觀察,少子化與高齡化衝擊清潔產業,透過更省時省力的「人機協作」模式,可大幅減輕第一線清潔人員負擔。
凱馳總經理李恒毅觀察,少子化與高齡化衝擊清潔產業,透過更省時省力的「人機協作」模式,可大幅減輕第一線清潔人員負擔。
圖/ 數位時代

凱馳總經理李恒毅強調,「KIRA BR 50並非要取代清潔人員,而是建立更省時省力的『人機協作』模式。」在傳統模式下,清潔人員必須拖著重達數十公斤的水桶與設備,在大面積區域來回奔波,耗時費力。有了KIRA BR 50後,機器人能精準且獨立承接大面積地板的頻繁清掃與洗刷,讓清潔人員將珍貴時間與專注力轉移至桌面、扶手及高接觸頻率的精細區域清潔,大幅減輕第一線負擔。

集結百年洗地技術與智慧科技,四大特點樹立清潔標竿

事實上,市場不乏新創科技公司推出清潔機器人,但凱馳業務總監李敍均指出,大多新創公司擅長科技部分,但對於「如何把地洗乾淨」的清潔本質缺乏經驗。德國凱馳成立近百年來,早已是這方面的專家,歷經總部反覆打磨,KIRA BR 50結合凱馳的專業工藝與前沿科技,以四大特點樹立智慧清潔標竿。

凱馳業務總監李敍均指出,「KIRA BR 50智慧自主洗地機器人」經過德國總部嚴格打磨才正式問世,展現德國工藝的嚴謹與專業。
凱馳業務總監李敍均指出,「KIRA BR 50智慧自主洗地機器人」經過德國總部嚴格打磨才正式問世,展現德國工藝的嚴謹與專業。
圖/ 數位時代

首先是「高效清潔」,相較一般清潔機器人使用盤刷,容易讓污垢在地面旋轉滯留,KIRA BR 50採用獨家滾刷技術,一次完成預掃、收集垃圾、洗地與擦乾,搭配側刷貼近牆角,完成零死角邊緣清潔。每分鐘超過1300轉的高轉速刷頭,加上業界最高刷壓,大幅提升清潔效果,最高每小時可自主清潔高達2365平方公尺,相當於5.6座籃球場,一小時即可完成約兩次台北車站大廳的清潔作業,非常適合面積廣大的車站、機場、物流中心等大型場域使用。

第二是「極致安全」,隨著智慧設備進入高科技產業與政府機關等敏感場域,企業對設備安全與隱私防護的要求也日益提高,KIRA BR 50配備「3D點陣式影像偵測技術」,當機器人在環境感知與避障時僅呈現去識別化的點陣雲,不記錄或上傳實體影像,從源頭杜絕案場影像與隱私資訊被記錄或外洩的疑慮。此外資料傳輸裝置均支援AES-256位元高規格加密,並通過IEC與Syss等多項國際認證的自主導航、電氣安全與防駭客入侵設計,領先競品,建立清潔機器人極致安全的新標準。

第三是「解放人力」,大面積且重複的洗地工作交給機器人後,第一線員工便能投入更多需要專業服務的細緻清潔工作;同時搭配四合一自動工作基站,能自動高速充電、補充清水、排放汙水、清洗水箱,讓清潔人員更加省事。

第四是「友善操作」,考量許多清潔人員為中高齡族群,機身特別以簡單顏色和圖形化介面標示清潔人員可獨立操作的簡易按鈕,直覺易懂。針對開放式大面積,僅需人工操作一次,機器人便可在短時間內自主完成地圖掃描與路徑規劃,並具備智慧記憶功能,能自動回補因臨時障礙物而漏洗的區域,無須專業工程師提前設定地圖與電子圍籬,大幅降低使用門檻。

第一線清潔龍頭實測驗證,人機協作打造清潔新紀元

這套智慧清潔方案在正式推向市場前,也已在台灣機場等第一線大型場域實地驗證,與凱馳合作長達10多年的台灣清潔產業龍頭——信實集團,正是這場科技變革的最佳見證者。

信實集團副總經理趙雪吟相當期待未來在大型公共場域中引進KIRA BR 50,藉此提升清潔效率。
信實集團副總經理趙雪吟相當期待未來在大型公共場域中引進KIRA BR 50,藉此提升清潔效率。
圖/ 數位時代

信實集團承攬機場、車站等眾多大型公共標案,對設備品質與安全極為挑剔,信實集團副總經理趙雪吟坦言,「服務業缺工已經是全面性挑戰,第一線清潔產業長期面臨人力招募困境,引進自動化設備是不可逆趨勢。」

早在一、兩年前他親赴德國凱馳,看到KIRA BR 50後,便非常期待正式在台上市的一天。此次信實率先參與驗證,對KIRA BR 50展現出的穩定度與清潔效率印象深刻,不僅能高效自主洗地,完成後還會返回工作站維護充電,讓有限人力集中於精細工作上。

「KIRA BR 50智慧自主洗地機器人」具備四大特點,以高效清潔與極致安全協助企業穩定清潔量能。
「KIRA BR 50智慧自主洗地機器人」具備四大特點,以高效清潔與極致安全協助企業穩定清潔量能。
圖/ 數位時代

趙雪吟也特別強調,公家機關與大型企業標案對設備的製造品質、電氣安全與資安防護有嚴格標準,凱馳耗費數年進行嚴謹測試與多項國際認證,正是信實能放心將機器人引入重要案場的關鍵,期望未來導入至更多大型公共場域。

隨著KIRA BR 50正式登台,凱馳不僅為缺工時代提供最佳解方,也展現作為全球清潔設備領導品牌的前瞻視野,敏銳洞察清潔產業缺工、高齡化的必然趨勢,從第一線人員與企業實際需求出發,提前佈局研發對應智慧產品。未來凱馳將持續以領航者之姿,引進多元的專業清潔機型,讓「人機協作」不再只是前瞻概念,而是兼顧品質、安全與人本價值的最佳幫手,全力助攻台灣清潔產業邁向更高效、智慧、也更有溫度的全新紀元。

在2026台北國際自動化工業大展中,凱馳也將「KIRA BR 50智慧自主洗地機器人」帶到現場,展示人機協作的智慧清潔模式。
在2026台北國際自動化工業大展中,凱馳也將「KIRA BR 50智慧自主洗地機器人」帶到現場,展示人機協作的智慧清潔模式。
圖/ 數位時代
關鍵字: #機器人

登入數位時代會員

開啟專屬自己的主題內容,

每日推播重點文章

閱讀會員專屬文章

請先登入數位時代會員

看更多獨享內容

請先登入數位時代會員

開啟收藏文章功能,

請先登入數位時代會員

開啟訂閱文章分類功能,

請先登入數位時代會員

我還不是會員, 註冊去!
追蹤我們
台達電全解讀
© 2026 Business Next Media Corp. All Rights Reserved. 本網站內容未經允許,不得轉載。
106 台北市大安區光復南路102號9樓