Anthropic推出Claude Sonnet 5:效能逼近旗艦Opus4.8,定價卻更低的中階模型有多強?
Anthropic推出Claude Sonnet 5:效能逼近旗艦Opus4.8,定價卻更低的中階模型有多強?

重點一:Anthropic 發布中階模型 Claude Sonnet 5,效能逼近旗艦 Opus 4.8 但更便宜,即日起為免費版與 Pro 版預設模型。

重點二:較前代 Sonnet 4.6 多項評估提升,SWE-bench Pro(agentic 程式撰寫)由 58.1% 升至 63.2%;Anthropic 部署前評估顯示安全亦改善。

重點三:介紹價每百萬 token 輸入 2、輸出 10 美元(至 8 月 31 日),9 月起調為 3、15 美元,低於數款旗艦模型。

Anthropic 在 6 月 30 日發布新一代中階模型 Claude Sonnet 5,主打「史上最會做 agentic(自主代理)任務的 Sonnet」。

所謂 agentic,指模型能自己擬定計畫、操作瀏覽器與終端機等工具、在無人盯著的情況下自主完成一連串工作。官方部落格指出,Sonnet 5 能達到的自主程度,「幾個月前還得動用更大、更貴的模型才辦得到。」

上線範圍分層開放:Free 與 Pro 版即日起以 Sonnet 5 為預設模型;Max、Team、Enterprise 版可選用;開發端則提供於 Claude Code 與 Claude 開發平台(Claude Platform)。

定價方面,即日起至 8 月 31 日採介紹價,每百萬輸入 token 2 美元、每百萬輸出 token 10 美元(token 是模型計費的文字單位,約略對應字數);9 月起轉為正式價,輸入 3 美元、輸出 15 美元。

這組正式價雖與前代 Sonnet 4.6 的原牌價相同,但由於 Sonnet 5 換了一套處理文字的方式(業界稱為 tokenizer),同樣一段文字可能產生約 1 到 1.35 倍的 token,因此單次任務的實際花費未必和舊版相同。

據科技媒體《TechCrunch》報導,Sonnet 5 的定位本身就是一個訊號:agentic 能力已成各價位帶的基本盤,競爭的分水嶺不再是「誰做得最好」,而是「誰能用更低成本、在越少人為監督下越可靠地完成」。

這與 OpenAI 上週預覽的 GPT-5.6 Sol、Google 5 月推出的 Gemini 3.5 Flash 的訴求如出一轍。

和前代 Sonnet 4.6 差在哪?

對照今年 2 月發布的前代 Sonnet 4.6,Anthropic 表示,Sonnet 5 在推理、工具使用、程式撰寫與知識工作等多項重要評估中都有所提升,而非在所有測試上全面勝出。

幾個關鍵測試成績

以下為 Anthropic 公布的 SWE-bench Pro(軟體工程實測,衡量模型自主寫程式的能力)測試結果:

測驗 Sonnet 4.6 Sonnet 5 Opus 4.8
SWE-bench Pro(agentic 程式撰寫) 58.1% 63.2% 69.2%

在這項測試上,Sonnet 5 從前代的 58.1% 提升到 63.2%;旗艦 Opus 4.8 則以 69.2% 仍居領先(上述分數與各測驗的 effort、測試設定,可查 Claude Sonnet 5 System Card 與 SWE-bench Pro 榜單)。使用者可在模型的「effort(思考力度)」設定間調整,於成本與效能間取得平衡。

和旗艦 Opus 4.8 差在哪?

Anthropic 的定調很清楚:Opus 4.8 依舊是高準確度、高難度任務的首選;Sonnet 5 則提供「品質遠優於過往、但價格更低」的中階選項。兩者可透過 effort 等級切換,讓使用者依任務難度在成本與效能間找平衡。

安全評估與限制

在安全性方面,Anthropic 的部署前評估顯示,Sonnet 5 出現「不良行為」(例如配合濫用、欺瞞)的比率低於前代,更擅長拒絕惡意請求,也更能抵禦「prompt injection」(在指令中夾帶惡意內容以劫持模型)的攻擊;產生幻覺(一本正經地捏造事實)與諂媚附和的機率也比 Sonnet 4.6 低。

要注意的是,Anthropic 也指出,Sonnet 5 在「錯位行為」上的表現仍不及 Opus 4.8 與 Claude Mythos Preview。

早期測試夥伴的回饋,大致指向「更會做事、也更知道何時該拒絕」。例如自動化工具商 Zapier 資深工程師 Daniel Shepard舉例,團隊把一件兩段式任務(更新 Salesforce 帳戶分級、再對企業客戶發出上線通知)交給 Sonnet 5,它一次做完,「這種事以前做到一半就會卡住」;AI 應用開發平台 Lovable 共同創辦人 Fabian Hedin則強調,它拒絕不安全請求「乾淨又一致」。

定價低於數款旗艦模型,但高於 Gemini 3.5 Flash

若把各家模型的 API 每百萬 token 公告牌價擺在一起,《TechCrunch》整理指出,Sonnet 5 的介紹價低於旗艦 Opus 4.8(輸入 5 美元、輸出 25 美元)、OpenAI 的 GPT-5.5與 Google 的 Gemini 3.1 Pro,但仍高於主打低價的 Gemini 3.5 Flash。

要留意的是,不同模型的 tokenizer 不同,同一段文字換算出的 token 數有落差,因此牌價高低不等於單次任務成本的高低。

延伸閱讀:Fable 5要解禁了!Anthropic三周攻防懶人包:從模型停用到秘密談判,時間線一次看懂

資料來源:Anthropic 官方公告《TechCrunch》Anthropic 系統卡Morph SWE-bench Pro 榜單Anthropic 定價OpenAI 定價Gemini 定價

本文初稿為AI編撰,整理.編輯/ 李先泰

關鍵字: #Anthropic #Claude
往下滑看下一篇文章
2026 Meet Taipei徵展開跑!11/19台北圓山花博七大展區,早鳥優惠8/31截止
2026 Meet Taipei徵展開跑!11/19台北圓山花博七大展區,早鳥優惠8/31截止

2026年,是Meet Taipei舉辦的第13年。這段期間,《創業小聚》與全台灣的新創團隊一起成長。就算過了13年,我們仍為新技術感到興奮(相信你也是),但更在意它能不能真正落地變成訂單、變成合作、變成收入,甚至變成台灣新創圈重要的里程碑和養分。

這也是Meet Taipei的價值所在,持續放大媒合密度與商業轉換率,比單純的曝光聲量更值得關注。

2025年,我們用數字交出成績單:三天觀展人次突破5.5萬人、超過400家新創齊聚台北,促成536組商機媒合。這代表什麼?意味著走進Meet Taipei攤位前的人,愈來愈多是帶著明確需求而來,他們在找趨勢、找技術、找供應商、找投資標的、找尋下一個合作夥伴。

#4 2026 Meet Taipei
2025 Meet Taipei 三天吸引超過 5.5 萬人次觀展
圖/ Meet

今年的Meet Taipei以「Founders of Tomorrow: Shaping the AI Age」為主題。當AI把每一位創業者、每一家企業都放回同一條起跑線,真正拉開差距的關鍵,是誰先一步看見機會,並且有勇氣把手弄髒。

所以,別只是站在展場外看這場AI轉型。站上場成為造浪者,讓市場看見你怎麼定義它。

為什麼你應該來參展?

第一,掌握具有含金量的人流

Meet Taipei不只是一場開放給大眾的創新創業嘉年華,更是一個由中央部會、地方城市、全球新創、企業專館、跨國企業共同組成的產業現場。走進展場的觀眾,早已被論壇議程、產業專區與媒合機制分流引導到與自己需求相符的展區。來到你攤位前的,很可能就是正在找你這類解方的人。

第二,媒合已成為機制

展期間我們透過投資人媒合會、企業創投會客室等閉門機制,主動把你和潛在投資人、企業採購方安排到同一張桌子。2025年,投資人媒合會邀集近20家指標創投與企業創投進行一對一媒合;企業創投會客室則促成19家企業創投與52家參展新創的深度對談。

#1 2026 Meet Taipei
Meet Taipei 透過一對一媒合,促成新創與投資人、企業深入交流
圖/ Meet

第三,國際買家與夥伴不必你自己開發

2025年國際館匯聚來自20個國家、超過100組國際新創與加速器夥伴,日本、香港、加拿大、韓國團隊尤其活躍。想找跨境合作或驗證海外市場的團隊,這裡讓你一次接觸到平常要花數月才能約到的國際窗口。

第四,曝光紅利近新台幣5,000萬元

2025年Meet Taipei會後網路報導達603則,是前一年的兩倍;展會期間也有重要公部門代表到場,帶動主流媒體同步報導。你的品牌能量會自然搭上這波媒體聲量,但這不該是你來參展的主要理由,真正的理由,還是攤位前那些帶著問題走進來的人。

#3 2026 Meet Taipei
國際新創與生態系夥伴齊聚 Meet Taipei,拓展跨境合作機會
圖/ Meet

七大展區,對應七種市場機會

2026年,Meet Taipei展區整併為七大主題,聚焦當前最具成長動能的產業方向:

行銷與零售科技:給正在協助品牌與零售商提升行銷效果、顧客體驗與電商營運的團隊。

企業營運效率:給人資、財務、法務、資安等企業內部流程數位化工具的團隊,這是跨產業需求最廣的一區。

醫療與健康科技:給醫療器材、健康管理、遠距醫療與生技數位化應用的團隊。

綠色永續:給節能減碳、ESG合規與永續供應鏈解方的團隊,供應鏈碳盤查壓力正快速壓向各產業。

#1 2026 Meet Taipei
多元創新團隊齊聚展區,與市場需求直接交流
圖/ Meet

數位資產與新金融:給加密貨幣、Web3、數位資產與新金融服務的團隊。
智慧製造與軟硬整合:給工業IoT、智慧工廠、機器人與製造業數位化解方的團隊,含電動車與車用電子。

AI基礎建設:給GPU伺服器、雲端運算、地端部署與AI訓練推論基礎設施的團隊。

新創團隊之外,Meet Taipei也保留企業專屬的「創新驅動」展區,以及生態系夥伴(創投、加速器、共享辦公室)專屬展區,讓不同角色都能在對的位置被看見。

方案及徵展資訊

參展方案 點此,早鳥優惠將在8月31日截止,之後將調整為晚鳥價。

2026 Meet Taipei 創新創業嘉年華
• 日期:11/19(四)-11/21(六)
• 地點:台北圓山花博園區
• 報名管道:Meet Online 新創線上社群平台 點此
• 聯繫窗口:meettaipei@bnext.com.tw

#0 2026 Meet Taipei
在 Meet Taipei 相遇,讓一次交流成為下一次合作的開始
圖/ Meet

AI重寫了規則,你來定義時代!
早鳥優惠8月31日截止,11月19~21日,台北圓山花博園區見。

關鍵字: #創業小聚

登入數位時代會員

開啟專屬自己的主題內容,

每日推播重點文章

閱讀會員專屬文章

請先登入數位時代會員

看更多獨享內容

請先登入數位時代會員

開啟收藏文章功能,

請先登入數位時代會員

開啟訂閱文章分類功能,

請先登入數位時代會員

我還不是會員, 註冊去!
追蹤我們
台達電全解讀
© 2026 Business Next Media Corp. All Rights Reserved. 本網站內容未經允許,不得轉載。
106 台北市大安區光復南路102號9樓