Anthropic推出Claude Sonnet 5:效能逼近旗艦Opus4.8,定價卻更低的中階模型有多強?
Anthropic推出Claude Sonnet 5:效能逼近旗艦Opus4.8,定價卻更低的中階模型有多強?

重點一:Anthropic 發布中階模型 Claude Sonnet 5,效能逼近旗艦 Opus 4.8 但更便宜,即日起為免費版與 Pro 版預設模型。

重點二:較前代 Sonnet 4.6 多項評估提升,SWE-bench Pro(agentic 程式撰寫)由 58.1% 升至 63.2%;Anthropic 部署前評估顯示安全亦改善。

重點三:介紹價每百萬 token 輸入 2、輸出 10 美元(至 8 月 31 日),9 月起調為 3、15 美元,低於數款旗艦模型。

Anthropic 在 6 月 30 日發布新一代中階模型 Claude Sonnet 5,主打「史上最會做 agentic(自主代理)任務的 Sonnet」。

所謂 agentic,指模型能自己擬定計畫、操作瀏覽器與終端機等工具、在無人盯著的情況下自主完成一連串工作。官方部落格指出,Sonnet 5 能達到的自主程度,「幾個月前還得動用更大、更貴的模型才辦得到。」

上線範圍分層開放:Free 與 Pro 版即日起以 Sonnet 5 為預設模型;Max、Team、Enterprise 版可選用;開發端則提供於 Claude Code 與 Claude 開發平台(Claude Platform)。

定價方面,即日起至 8 月 31 日採介紹價,每百萬輸入 token 2 美元、每百萬輸出 token 10 美元(token 是模型計費的文字單位,約略對應字數);9 月起轉為正式價,輸入 3 美元、輸出 15 美元。

這組正式價雖與前代 Sonnet 4.6 的原牌價相同,但由於 Sonnet 5 換了一套處理文字的方式(業界稱為 tokenizer),同樣一段文字可能產生約 1 到 1.35 倍的 token,因此單次任務的實際花費未必和舊版相同。

據科技媒體《TechCrunch》報導,Sonnet 5 的定位本身就是一個訊號:agentic 能力已成各價位帶的基本盤,競爭的分水嶺不再是「誰做得最好」,而是「誰能用更低成本、在越少人為監督下越可靠地完成」。

這與 OpenAI 上週預覽的 GPT-5.6 Sol、Google 5 月推出的 Gemini 3.5 Flash 的訴求如出一轍。

和前代 Sonnet 4.6 差在哪?

對照今年 2 月發布的前代 Sonnet 4.6,Anthropic 表示,Sonnet 5 在推理、工具使用、程式撰寫與知識工作等多項重要評估中都有所提升,而非在所有測試上全面勝出。

幾個關鍵測試成績

以下為 Anthropic 公布的 SWE-bench Pro(軟體工程實測,衡量模型自主寫程式的能力)測試結果:

測驗 Sonnet 4.6 Sonnet 5 Opus 4.8
SWE-bench Pro(agentic 程式撰寫) 58.1% 63.2% 69.2%

在這項測試上,Sonnet 5 從前代的 58.1% 提升到 63.2%;旗艦 Opus 4.8 則以 69.2% 仍居領先(上述分數與各測驗的 effort、測試設定,可查 Claude Sonnet 5 System Card 與 SWE-bench Pro 榜單)。使用者可在模型的「effort(思考力度)」設定間調整,於成本與效能間取得平衡。

和旗艦 Opus 4.8 差在哪?

Anthropic 的定調很清楚:Opus 4.8 依舊是高準確度、高難度任務的首選;Sonnet 5 則提供「品質遠優於過往、但價格更低」的中階選項。兩者可透過 effort 等級切換,讓使用者依任務難度在成本與效能間找平衡。

安全評估與限制

在安全性方面,Anthropic 的部署前評估顯示,Sonnet 5 出現「不良行為」(例如配合濫用、欺瞞)的比率低於前代,更擅長拒絕惡意請求,也更能抵禦「prompt injection」(在指令中夾帶惡意內容以劫持模型)的攻擊;產生幻覺(一本正經地捏造事實)與諂媚附和的機率也比 Sonnet 4.6 低。

要注意的是,Anthropic 也指出,Sonnet 5 在「錯位行為」上的表現仍不及 Opus 4.8 與 Claude Mythos Preview。

早期測試夥伴的回饋,大致指向「更會做事、也更知道何時該拒絕」。例如自動化工具商 Zapier 資深工程師 Daniel Shepard舉例,團隊把一件兩段式任務(更新 Salesforce 帳戶分級、再對企業客戶發出上線通知)交給 Sonnet 5,它一次做完,「這種事以前做到一半就會卡住」;AI 應用開發平台 Lovable 共同創辦人 Fabian Hedin則強調,它拒絕不安全請求「乾淨又一致」。

定價低於數款旗艦模型,但高於 Gemini 3.5 Flash

若把各家模型的 API 每百萬 token 公告牌價擺在一起,《TechCrunch》整理指出,Sonnet 5 的介紹價低於旗艦 Opus 4.8(輸入 5 美元、輸出 25 美元)、OpenAI 的 GPT-5.5與 Google 的 Gemini 3.1 Pro,但仍高於主打低價的 Gemini 3.5 Flash。

要留意的是,不同模型的 tokenizer 不同,同一段文字換算出的 token 數有落差,因此牌價高低不等於單次任務成本的高低。

延伸閱讀:Fable 5要解禁了!Anthropic三周攻防懶人包:從模型停用到秘密談判,時間線一次看懂

資料來源:Anthropic 官方公告《TechCrunch》Anthropic 系統卡Morph SWE-bench Pro 榜單Anthropic 定價OpenAI 定價Gemini 定價

本文初稿為AI編撰,整理.編輯/ 李先泰

關鍵字: #Anthropic #Claude
往下滑看下一篇文章
迎戰大缺工時代!德國凱馳在台首推「智慧自主洗地機器人」,開啟商用清潔革命
迎戰大缺工時代!德國凱馳在台首推「智慧自主洗地機器人」,開啟商用清潔革命

在少子化與高齡化的雙重夾擊下,台灣勞力結構正面臨前所未有的嚴峻挑戰,預估從2020至2030年間,15至64歲的勞動人口將減少約10.3%。「缺工」不再是短期波動,而是長期影響各行各業的結構性危機,尤以高度依賴人力的清潔產業為甚。

然而在後疫情時代,社會對場域的衛生標準只增不減,加上大型商場、交通樞紐、物流中心與高科技廠房的建設面積每年持續擴增,清潔人員招募困難且年齡漸趨中高齡,有限人力難以扛起龐大的日常清潔工作。

面對亟待填補的市場空缺,全球清潔設備領導品牌德國凱馳,憑藉深厚的專業底蘊與嚴謹的研發標準,首次在台推出「KIRA BR 50智慧自主洗地機器人」,為台灣大型商用場域提供劃時代的智慧清潔解方。

凱馳總經理李恒毅觀察,少子化與高齡化衝擊清潔產業,透過更省時省力的「人機協作」模式,可大幅減輕第一線清潔人員負擔。
凱馳總經理李恒毅觀察,少子化與高齡化衝擊清潔產業,透過更省時省力的「人機協作」模式,可大幅減輕第一線清潔人員負擔。
圖/ 數位時代

凱馳總經理李恒毅強調,「KIRA BR 50並非要取代清潔人員,而是建立更省時省力的『人機協作』模式。」在傳統模式下,清潔人員必須拖著重達數十公斤的水桶與設備,在大面積區域來回奔波,耗時費力。有了KIRA BR 50後,機器人能精準且獨立承接大面積地板的頻繁清掃與洗刷,讓清潔人員將珍貴時間與專注力轉移至桌面、扶手及高接觸頻率的精細區域清潔,大幅減輕第一線負擔。

集結百年洗地技術與智慧科技,四大特點樹立清潔標竿

事實上,市場不乏新創科技公司推出清潔機器人,但凱馳業務總監李敍均指出,大多新創公司擅長科技部分,但對於「如何把地洗乾淨」的清潔本質缺乏經驗。德國凱馳成立近百年來,早已是這方面的專家,歷經總部反覆打磨,KIRA BR 50結合凱馳的專業工藝與前沿科技,以四大特點樹立智慧清潔標竿。

凱馳業務總監李敍均指出,「KIRA BR 50智慧自主洗地機器人」經過德國總部嚴格打磨才正式問世,展現德國工藝的嚴謹與專業。
凱馳業務總監李敍均指出,「KIRA BR 50智慧自主洗地機器人」經過德國總部嚴格打磨才正式問世,展現德國工藝的嚴謹與專業。
圖/ 數位時代

首先是「高效清潔」,相較一般清潔機器人使用盤刷,容易讓污垢在地面旋轉滯留,KIRA BR 50採用獨家滾刷技術,一次完成預掃、收集垃圾、洗地與擦乾,搭配側刷貼近牆角,完成零死角邊緣清潔。每分鐘超過1300轉的高轉速刷頭,加上業界最高刷壓,大幅提升清潔效果,最高每小時可自主清潔高達2365平方公尺,相當於5.6座籃球場,一小時即可完成約兩次台北車站大廳的清潔作業,非常適合面積廣大的車站、機場、物流中心等大型場域使用。

第二是「極致安全」,隨著智慧設備進入高科技產業與政府機關等敏感場域,企業對設備安全與隱私防護的要求也日益提高,KIRA BR 50配備「3D點陣式影像偵測技術」,當機器人在環境感知與避障時僅呈現去識別化的點陣雲,不記錄或上傳實體影像,從源頭杜絕案場影像與隱私資訊被記錄或外洩的疑慮。此外資料傳輸裝置均支援AES-256位元高規格加密,並通過IEC與Syss等多項國際認證的自主導航、電氣安全與防駭客入侵設計,領先競品,建立清潔機器人極致安全的新標準。

第三是「解放人力」,大面積且重複的洗地工作交給機器人後,第一線員工便能投入更多需要專業服務的細緻清潔工作;同時搭配四合一自動工作基站,能自動高速充電、補充清水、排放汙水、清洗水箱,讓清潔人員更加省事。

第四是「友善操作」,考量許多清潔人員為中高齡族群,機身特別以簡單顏色和圖形化介面標示清潔人員可獨立操作的簡易按鈕,直覺易懂。針對開放式大面積,僅需人工操作一次,機器人便可在短時間內自主完成地圖掃描與路徑規劃,並具備智慧記憶功能,能自動回補因臨時障礙物而漏洗的區域,無須專業工程師提前設定地圖與電子圍籬,大幅降低使用門檻。

第一線清潔龍頭實測驗證,人機協作打造清潔新紀元

這套智慧清潔方案在正式推向市場前,也已在台灣機場等第一線大型場域實地驗證,與凱馳合作長達10多年的台灣清潔產業龍頭——信實集團,正是這場科技變革的最佳見證者。

信實集團副總經理趙雪吟相當期待未來在大型公共場域中引進KIRA BR 50,藉此提升清潔效率。
信實集團副總經理趙雪吟相當期待未來在大型公共場域中引進KIRA BR 50,藉此提升清潔效率。
圖/ 數位時代

信實集團承攬機場、車站等眾多大型公共標案,對設備品質與安全極為挑剔,信實集團副總經理趙雪吟坦言,「服務業缺工已經是全面性挑戰,第一線清潔產業長期面臨人力招募困境,引進自動化設備是不可逆趨勢。」

早在一、兩年前他親赴德國凱馳,看到KIRA BR 50後,便非常期待正式在台上市的一天。此次信實率先參與驗證,對KIRA BR 50展現出的穩定度與清潔效率印象深刻,不僅能高效自主洗地,完成後還會返回工作站維護充電,讓有限人力集中於精細工作上。

「KIRA BR 50智慧自主洗地機器人」具備四大特點,以高效清潔與極致安全協助企業穩定清潔量能。
「KIRA BR 50智慧自主洗地機器人」具備四大特點,以高效清潔與極致安全協助企業穩定清潔量能。
圖/ 數位時代

趙雪吟也特別強調,公家機關與大型企業標案對設備的製造品質、電氣安全與資安防護有嚴格標準,凱馳耗費數年進行嚴謹測試與多項國際認證,正是信實能放心將機器人引入重要案場的關鍵,期望未來導入至更多大型公共場域。

隨著KIRA BR 50正式登台,凱馳不僅為缺工時代提供最佳解方,也展現作為全球清潔設備領導品牌的前瞻視野,敏銳洞察清潔產業缺工、高齡化的必然趨勢,從第一線人員與企業實際需求出發,提前佈局研發對應智慧產品。未來凱馳將持續以領航者之姿,引進多元的專業清潔機型,讓「人機協作」不再只是前瞻概念,而是兼顧品質、安全與人本價值的最佳幫手,全力助攻台灣清潔產業邁向更高效、智慧、也更有溫度的全新紀元。

在2026台北國際自動化工業大展中,凱馳也將「KIRA BR 50智慧自主洗地機器人」帶到現場,展示人機協作的智慧清潔模式。
在2026台北國際自動化工業大展中,凱馳也將「KIRA BR 50智慧自主洗地機器人」帶到現場,展示人機協作的智慧清潔模式。
圖/ 數位時代
關鍵字: #機器人

登入數位時代會員

開啟專屬自己的主題內容,

每日推播重點文章

閱讀會員專屬文章

請先登入數位時代會員

看更多獨享內容

請先登入數位時代會員

開啟收藏文章功能,

請先登入數位時代會員

開啟訂閱文章分類功能,

請先登入數位時代會員

我還不是會員, 註冊去!
追蹤我們
台達電全解讀
© 2026 Business Next Media Corp. All Rights Reserved. 本網站內容未經允許,不得轉載。
106 台北市大安區光復南路102號9樓