「這是地表最強編碼模型!」Claude Sonnet 4.5上線:更快更穩不加價,它是GPT‑5 Codex最大剋星?
「這是地表最強編碼模型!」Claude Sonnet 4.5上線:更快更穩不加價,它是GPT‑5 Codex最大剋星?

重點一:Anthropic 發布 Claude Sonnet 4.5,稱其為迄今最強;可在長時程任務中連續執行超過 30 小時,並在多項基準測試領先同業。

重點二:Sonnet 4.5 在 SWE-bench Verified 取得 77.2%、在 OSWorld 取得 61.4%,超過 OpenAI 的 GPT-5 Codex 與 Google 的 Gemini 2.5 Pro;並強化電腦操作與代理能力。

重點三:Anthropic 同步推出 Claude Code 2.0 與 Claude Agent SDK,並為網頁與 App 新增程式執行、檔案建立與文件/試算表/簡報生成功能;API 價格延續 Sonnet 4。

Anthropic 推出中階旗艦模型 Claude Sonnet 4.5,官方稱其為「迄今最強」版本;能在複雜的多步長任務中「連續專注」超過 30 小時,同時在多項公開基準測試刷新成績,展現程式開發、電腦操作與推理計算的整體提升。

相較前代 Sonnet 4.0,4.5 在 OSWorld 電腦使用測試由 42.2% 大幅躍升至 61.4%,並於 SWE-bench Verified 取得 77.2%;整體表現超越 OpenAI 的 GPT-5 Codex 與 Google 旗下的 Gemini 2.5 Pro,凸顯其在實務開發與代理任務上的即戰力。

程式、電腦操作、多語知識⋯同步進化

Anthropic 指出,Claude Sonnet 4.5 的核心強項在於「可在真實環境中更穩定地完成長鏈任務」。雖然公司未披露 30 小時連續工作的具體任務內容,但強調其代理行為在長時間情境下維持一致性,減少過去常見的上下文遺失與錯誤累積。

就量化表現,該模型於 SWE-bench Verified 拿下 77.2%,在 OSWorld 取得 61.4% 並居於領先,分別高於 OpenAI 的 GPT-5 Codex 的 74.5% 與 Google 的 Gemini 2.5 Pro 的 67.2%。同時,在 AIME 2024(數學競賽基準)、MMMLU(14 種非英語科目知識)與 Vals AI Finance Agent(金融分析代理)等評測亦見進步,其中金融代理測試達 92%。

Claude Sonnet 4.5 基準測試
Sonnet 4.5 在 SWE-bench Verified 得分77.2%、OSWorld 61.4%,超過 OpenAI GPT-5 Codex 與 Google Gemini 2.5 Pro。
圖/ Anthropic

此外,Anthropic 表示已降低模型在「sycophancy(逢迎)」「deception(欺瞞)」「power-seeking(權力尋求)」與「鼓勵妄想傾向」等風險行為,回應外界對聊天機器人社會化使用的關注。

Claude Sonnet 4.5 更老實了
Anthropic指出,已降低模型在逢迎、欺瞞、權力尋求等AI風險行為。
圖/ Anthropic

根據《Ars Technica》報導,儘管業界對廠商自行公布的基準成績向來持審慎態度(可能受資料汙染或設計偏誤影響),Sonnet 4.5 仍相較 4.0 呈現實質躍進;並獲知名開發者 Simon Willison 初步肯定,稱其在程式能力上優於其近週常用的 GPT-5 Codex。

速度即智慧!Claude Sonnet 4.5 更快、更簡潔

Willison 引述 Cora(cora.computer)總經理 Kieran Klaassen 的說法指出,Claude Sonnet 4.5 在 Claude Code/App 中「體感快約 50%」。同樣的大型程式碼評審任務,Sonnet 4.5 約 2 分鐘完成,GPT-5 Codex 約 10 分鐘。在「速度也是智慧的一個維度」的前提下,更利於長時間配對工作。亦即, 能在大型上下文與多檔案間保持專注、不亂飄,並且更可引導、結果更一致、回覆更簡潔。

Willison 舉例,他將三份營運試算表交給模型,便能迅速生成可用的第三季投資人更新 Word 文件。至於 Klaassen 則指出,在 Cora(Every 的郵件管理工具)專案裡有一個程式錯誤,先用 Claude Opus 4.1 嘗試未能解決,但換成 Claude Sonnet 4.5 後約 20 分鐘就修復。

Willison 總結指出,若使用者以 Claude Code 為日常編程主力,Sonnet 4.5 是更快、更可靠、可引導性更優的新夥伴;但若是 GPT-5 Codex 擁護者,編程難題仍建議以 Codex 為先。若是新專案、vibe coding,或需要 Claude「勤勉+速度」組合的任務,就值得考慮 Sonnet 4.5。

用價格換市占!Claude Sonnet 4.5「加速不加價」

為配合模型升級,Anthropic 同步發布 Claude Code 2.0(命令列 AI 代理)與 Claude Agent SDK(代理開發套件),瞄準開發者打造客製化程式代理的需求。Claude Code 2.0 引入「checkpoint(檢查點)」以保存進度並可回滾,更新終端介面,並上線原生 VS Code 擴充;API 端亦新增「context editing(脈絡編輯)」與更佳的長任務記憶工具,改善長流程代理工作的穩定性。

在使用者端,Claude 網頁與 App 介面新增「程式碼執行」與「檔案建立」,並可在對話中直接產生試算表、投影片與文件;「Claude for Chrome」擴充則強化瀏覽器內的網站導航與表單/資料處理。

此外,Anthropic 推出為期五天的研究預覽「Imagine with Claude(與 Claude 想像)」供 Max 訂閱者體驗,展示模型在即時產生軟體上的潛力。

值得注意的是,Anthropic 以兩段式階梯定價包裝 Claude Sonnet 4.5。第一段針對標準 200K 上下文長度:輸入每百萬 token 3 美元、輸出 15 美元。

這個價位直接把同家前代旗艦 Opus 4.1(輸入 15 美元、輸出 75 美元)的成本拉低到約五分之一,形成「以中檔價格提供近旗艦能力」的攻勢,目標明確對準主流對手如 GPT‑5 等。

Claude Sonnet 4.5 API價格
Anthropic指出,對標準 200K 上下文長度:輸入每百萬 token $3、輸出 $15。
圖/ Anthropic

第二段則針對超長上下文(超過 200K):輸入每百萬 6 美元、輸出 22.5 美元。這是「超長加價、但仍維持性價比」的設計,讓需要長文脈的用例有合理成本,同時透過輸出端維持較高單價,以控制推理時間與算力消耗。

其策略核心是以「低輸入價」促進更多資料餵入與多步推理,並以輸出價差回收算力成本;配合「混合推理/擴展思考模式」,當開啟更長思考與高準確度輸出時,價格結構自然引導開發者優化 token 使用,避免不必要的長輸出。

簡單來說,這種定價策略的總體效果,是以極致性價比快速搶佔編程與 Agent 場景,讓開發者在可控成本下獲得高階能力,並對競品形成明顯的價格壓力。

延伸閱讀:因為AI,他成了身價1830億美元的CEO!Anthropic開發出最會寫程式的模型,為何又變AI頭號黑粉?

自掏腰包買書訓練AI合法嗎?Anthropic獲關鍵勝訴:「合理使用」原則是什麼?

資料來源:Ars TechnicaSimon willison01 Founder

本文初稿為AI編撰,整理.編輯/ 李先泰

關鍵字: #Anthropic #Claude
往下滑看下一篇文章
一文看懂 AI 電視可以幹嘛?不只有 AI 演算法,頂級硬體帶來高畫質表現
一文看懂 AI 電視可以幹嘛?不只有 AI 演算法,頂級硬體帶來高畫質表現

火熱的 AI 風潮掀起客廳革命,到底 AI 電視可以幹嘛?簡單來說,AI 電視透過 AI 處理器與演算法,即時進行 AI 畫質優化、音效調整、智慧語音搜尋和極致的個人化推薦,全面顛覆傳統智慧電視。在 AI 電視功能中,最讓消費者有感的是 AI 畫質優化,但許多人往往忽略了,畫質提升不只關乎演算法,更取決於底層的背光、色彩與控光技術。Sony BRAVIA True RGB LED 電視,正是將軟體思維與硬體工藝深度結合的最好示範。透過創新的 XR 認知智慧處理器搭配 True RGB 技術,精準呈現 AI 電視的畫質優化能力。

AI 電視是什麼?不只是能上網看串流的智慧電視

要理解 AI 電視可以幹嘛,首先必須釐清 AI 電視與一般智慧電視的差異。傳統智慧電視是為電視接上網路,讓使用者單向觀看連網影音。AI 電視則是在智慧電視的基礎上,導入了 AI 處理器與先進演算法,讓智慧電視具備「主動分析與學習」的能力,可即時判斷每一幀影像的畫質特徵、聲音頻率、觀看環境(如白天強光或夜晚暗光),甚至是家庭成員的使用習慣,進而動態調整視聽呈現。簡單來說,傳統智慧電視解決的是「能不能連網看內容」的問題,而 AI 電視解決的是「如何讓內容呈現得最好」的體驗問題。

但當 AI 演算法分析出最佳的畫面設定後,如果硬體無法精準跟上,優化效果就會大打折扣。這也是為什麼高階顯示技術 True RGB 開始受到市場矚目,確保 AI 算出的極致色彩與對比,能精準落地在觀眾眼前。

傳統電視容易出現暗部發灰或亮處過曝。Sony BRAVIA 9 II 透過 True RGB 三色獨立背光,能將 AI 算出的極致對比與飽和色彩精準落地。
傳統電視容易出現暗部發灰或亮處過曝。Sony BRAVIA 9 II 透過 True RGB 三色獨立背光,能將 AI 算出的極致對比與飽和色彩精準落地。
圖/ 數位時代

AI 電視可以幹嘛?從畫質、場景、音效到個人化推薦的四大核心進化

面對消費者的核心疑問「AI 電視可以幹嘛?」,可從四大 AI 電視功能深入拆解。

AI 畫質升頻與降噪:讓低解析度內容更清晰

透過 AI 升頻與降噪技術,可分析解析度較低或經過壓縮的影音內容,改善線條、紋理與雜訊,使畫面在 4K 螢幕上呈現得更清晰。True RGB 則能協助 AI 優化後的畫面亮度、色彩與對比度精準呈現。不過實際效果仍會受到原始片源解析度與壓縮品質影響。

智慧場景辨識:依電影、球賽、遊戲自動調整畫面

AI 電視能即時辨識播放內容,自動調整畫面呈現,比如看電影時調整為劇院感色溫、看球賽即時插幀消除動態殘影、玩遊戲時自動切換至低延遲模式。在不同場景轉換時,True RGB 讓亮度與色彩對比表現依然精準自然。

左圖為電影模式,右圖為遊戲模式。智慧場景辨識功能會根據電影、球賽或遊戲自動切換最佳模式。搭配 True RGB 技術,即使在動態或暗部場景下,色彩依然自然不失真。
左圖為電影模式,右圖為遊戲模式。智慧場景辨識功能會根據電影、球賽或遊戲自動切換最佳模式。搭配 True RGB 技術,即使在動態或暗部場景下,色彩依然自然不失真。
圖/ 數位時代

AI 音效優化:讓人聲與環境音更清楚

AI 音效演算法能分離出人聲對白與背景音效。看動作大片時,能放大環繞立體感;看新聞時,則優化人聲頻率,甚至能根據客廳結構進行空間音效校正。

除了頂級畫質,Sony 將 AI 音效演算法與機身背部揚聲器深度結合,能根據客廳結構進行空間校正,分離出清晰人聲與震撼環繞音效。
除了頂級畫質,Sony 將 AI 音效演算法與機身背部揚聲器深度結合,能根據客廳結構進行空間校正,分離出清晰人聲與震撼環繞音效。
圖/ 數位時代

語音互動與個人化推薦:減少尋找內容時間

AI 語音互動更能理解複雜語意,當你說出「我想看適合週末晚上的搞笑電影」時,AI 便會結合使用者的觀看偏好推薦清單,真正做到懂你所想。

整體而言,在眾多 AI 電視功能中,消費者最能直觀感受到的是 AI 畫質升頻與場景優化。但不論軟體演算法如何強大,都需要有對應的硬體執行力,而 True RGB 正是讓這些高階 AI 畫質能精準落地的關鍵技術。

AI 畫質優化的關鍵:不只靠演算法,硬體也是決勝點

在討論 AI 電視時,大眾常有一種迷思,認為只要電視內建強大的 AI 處理器和演算法就行,事實上,AI 電視的畫質優化不是靠單一演算法完成,而是包含「AI 判斷」與「硬體呈現」兩大層次:

首先由 AI 負責辨識畫面中的主體物件、人眼焦點、光影分佈及動態物體的移動軌跡等。根據 AI 判斷結果,演算法在底層即時計算出一套優化藍圖,決定哪些區域需要進行 AI 升頻、降噪、提高畫質、調整亮度、對比或色彩飽和度等。而硬體則負責最終畫面呈現,包含電視的背光、面板、控光技術與色彩控制技術,才是真正決定這張優化藍圖能被實現到什麼程度的關鍵。

而 Sony BRAVIA True RGB LED 電視便精準示範,硬體如何賦予 AI 電視極致表現。傳統 LED 電視使用單一藍色 LED,再搭配濾光片混色的方式,容易產生色彩混濁或亮度減損,True RGB 技術則以獨立驅動紅(Red)、綠(Green)、藍(Blue)三原色 LED 作為背光源,當 XR 認知智慧處理器分析影像內容,發出畫面調整指令後,True RGB 能精準響應,讓紅、綠、藍三色背光以極高精度進行獨立控光,將 AI 畫面調整的判斷精準呈現。

一般智慧電視、AI 電視、搭載 True RGB 的 AI 電視差在哪?

跳脫複雜的規格參數,一次搞懂三代智慧電視有何不同。簡單來說,一般 AI 電視可以做到升頻、降噪與場景辨識;搭載 True RGB 的 AI 電視則進一步把 AI 判斷延伸到背光與色彩控制,真實還原亮度、色彩與對比。

一般智慧電視 AI電視 搭載 True RGB 的 AI 電視
核心定位 解決「連網與內容獲取」 解決「基礎畫面自動優化」 解決「極致高階畫質精準執行」
畫質處理能力 支援基本的數位降噪,無法因應訊號源差而改善 具備 AI 升頻技術,能動態辨識場景並優化低解析度影片 結合 XR 認知智慧處理器與硬體優勢,進行深度的 AI 畫面優化
背光技術 傳統常亮背光,容易產生漏光與局部發灰現象 具備區域控光,但演算法與硬體匹配度較為普遍 採用 True RGB 三色獨立背光,控光精準度極高,無溢光與色偏
色彩與亮度表現 色彩表現較為平淡,高亮處易過曝,暗部細節容易丟失 色彩飽和度高,但有時因演算法過度補償而顯得不夠自然 實現豐富飽和的色彩表現層次,精準還原真實色彩
主要適合情境 看第四台、日常追劇 看 4K 串流,希望電視能自動適應不同影音內容 追求劇院級體驗,喜歡高畫質影音、球賽、遊戲的用戶
跳脫傳統電視容易漏光與發灰的痛點,Sony BRAVIA 9 II 結合旗艦級 XR 認知智慧處理器與 True RGB 背光技術,從底座美學到內在核心,皆為追求劇院級體驗的頂級用戶而生。
跳脫傳統電視容易漏光與發灰的痛點,Sony BRAVIA 9 II 結合旗艦級 XR 認知智慧處理器與 True RGB 背光技術,從底座美學到內在核心,皆為追求劇院級體驗的頂級用戶而生。
圖/ 數位時代

買 AI 電視時,真正該看哪些規格?

當你準備為家裡添購 AI 電視時,除了關心它是否支援智慧語音、刷新率有多高、個人化推薦好不好用之外,以下四個核心 AI 電視功能才是決定長期觀看品質的關鍵指標:

AI 處理器

大腦優劣決定電視表現,挑選時認準旗艦級的 AI 處理器,如 Sony 的 XR 認知智慧處理器,不只單純堆疊算力,而能模擬人類大腦的認知方式,打造身歷其境的畫面真實感。

AI 升頻能力

優秀的 AI 升頻能力應能精準區分「影像噪訊」與「畫面原生紋理」,在去除雜訊的同時保留皮膚毛孔、衣服編織等細節,而非一味抹平。

背光與控光技術

若重視高階畫質,True RGB 可作為判斷 AI 畫質能否精準呈現的重要顯示技術,徹底告別傳統畫面暗部發灰、亮部慘白的通病。

色彩與亮度表現

不能只看標榜的 HDR 規格,更要檢視硬體能否真實呈現。True RGB 能賦予 AI 電視更強悍的畫面執行力,銳利呈現 AI 算出的明暗對比與色彩飽和度。

關於 AI 電視與 True RGB 的常見問答

Q1:AI 電視適合哪些人?
AI 電視適合所有對影音品質有追求的人。不論你是愛看高畫質影音的追劇族、追求畫面流暢不殘影的運動迷、重視高刷新率與低延遲的遊戲玩家,AI 電視都能大幅提升觀影體驗。

Q2:AI 升頻會把影片變成 4K 嗎?
無法完全等同原生 4K,但能讓畫面更接近高解析度的觀看效果。AI 升頻利用比對與像素補插,將原本模糊線條變得銳利清晰,結合 True RGB 的高精細控光後,視覺表現會非常接近 4K 原生畫質。

Q3:買 AI 電視時,只看 AI 處理器夠嗎?
絕對不夠。演算法算出的完美畫面需要顯示硬體來執行,電視的背光技術、控光與色彩管理能力(如 True RGB)同樣重要。軟硬完美結合,才是高畫質的保障。

Q4:AI 電視對看球賽或玩遊戲有什麼差別?
AI 電視能根據不同場景優化畫面表現,觀看球賽時,能動態識別高速移動對象,即時插幀消除動態殘影;玩遊戲時,能自動切換至低延遲模式和強化暗部細節。

Q5:白天和晚上看電視,AI 電視會自動切換不同的畫質設定嗎?
Sony 搭載 True RGB 的 AI 電視內建環境光感測器,能根據環境光線變化動態調節畫面呈現,在白天明亮時自動增亮、晚上變暗時調降亮度並柔化對比,省去手動切換的麻煩。

登入數位時代會員

開啟專屬自己的主題內容,

每日推播重點文章

閱讀會員專屬文章

請先登入數位時代會員

看更多獨享內容

請先登入數位時代會員

開啟收藏文章功能,

請先登入數位時代會員

開啟訂閱文章分類功能,

請先登入數位時代會員

我還不是會員, 註冊去!
追蹤我們
台達電全解讀
© 2026 Business Next Media Corp. All Rights Reserved. 本網站內容未經允許,不得轉載。
106 台北市大安區光復南路102號9樓