
Claude Opus 5.5 完整解析:價格與切換時機
Claude Opus 5.5 於 2026 年 9 月 22 日發布,標準價 US$4/US$20,快取讀取降 60%,預設 effort 改 medium,本文整理新價格、評測證據、四個相容性變更與切換時機。
- Claude Opus 5.5
- Claude Opus 5.5 價格
- Opus 5.5 API 計價
- Claude 5.5 家族
- Opus 5.5 與 Opus 5 差異
- Claude Opus 5.5 effort
- Opus 5.5 切換時機
約 33 分鐘閱讀作者:Whoops 編輯團隊
本頁目錄
- 重點速覽
- 目錄
- 1. Opus 5.5 是什麼:5.5 家族首款、定位與 model ID
- 2. 新價格拆解:標準、快取、Batch 與 Fast mode
- 3. 帳單降幅 40% 怎麼來:單價乘上 token 用量
- 4. 能力升級的證據:官方評測怎麼讀
- 5. 預設 effort 改 medium:對成本與品質的實際意義
- 6. 開發者的四個相容性變更與遷移清單
- 7. 安全與防護:分類器、回退與驗證計畫
- 8. 訂閱端同步變動:五小時上限與 rate limit reset
- 9. 相對 Fable 5.1 的取捨
- 10. 相對 Opus 5 的取捨與切換時機
- 11. 在台灣的取得方式與配額
- 12. 什麼情況不要急著切換
- 13. 切換評估:五個問題與行動順序
- 常見問題
- Opus 5.5 和 Opus 5 的價格差多少?
- 台灣可以用 Claude Opus 5.5 嗎?
- 既有 Opus 5 的程式可以直接換 model ID 嗎?
- 訂閱 Pro 的用戶需要做什麼?
- thinking 不能停用,成本會不會變貴?
- 跟 GPT-5.6 Sol 或 GPT-6 Astra 相比該怎麼選?
- Opus 5.5 的上下文視窗與輸出上限有變嗎?
- 要不要等 Sonnet 5.5 與 Haiku 5.5 到齊再一起評估?
- 結論與下一步
Claude Opus 5.5 於 2026 年 9 月 22 日發布,是 Anthropic 新一代 Claude 5.5 家族的第一款模型,直接接在 7 月上市的 Claude Opus 5 之後。依當日官方公告的定位,它在多數工作上達到 Claude Fable 5.1 的水準,整體運行成本比 Opus 5 低約 40%,API 標準單價降為每百萬輸入 token US$4、輸出 token US$20。同一週 OpenAI 發表 GPT-6 Sol 與 Luna,兩家旗艦正面的成本與能力競爭進入新回合。
站上已有 Opus 5 的深度解析談 effort 五階與計價取捨,也有Claude 完整指南涵蓋生態全貌;本文不重複那些內容,聚焦 Opus 5.5 的增量事實:新價格結構、帳單降幅的來源、官方評測怎麼讀、開發者要處理的相容性變更、訂閱方案的同步調整,以及「現在切、等一輪再切、暫不切」三種情境的判斷。文內價格與規格以 2026 年 9 月 27 日查核的官方文件為準,模型市場改版速度快,採購前請再核對當日官方頁。
重點速覽
- Opus 5.5 於 2026 年 9 月 22 日發布,Claude API model ID 為
claude-opus-5-5,Amazon Bedrock 為anthropic.claude-opus-5-5;上下文視窗 100 萬 token、單次最大輸出 12.8 萬 token,與 Opus 5 相同。 - 標準價格每百萬輸入 US$4、輸出 US$20,比 Opus 5 低 20%;快取讀取 US$0.20,比 Opus 5 的 US$0.50 低 60%;官方測試稱預設設定下典型工作負載的整體成本低約 40%。
- 輸出速度比 Opus 5 快 30% 以上;Fast mode 維持兩倍價(US$8/US$40),輸出速度最高 2.5 倍。
- effort 仍有 low 到 max 五階,但 API 預設值從 high 改為 medium;官方內部測試稱編碼與知識工作評測上 5.5 的 medium 相當或優於 5 的 high。
- 開發端有四個必須處理的變更:thinking 無法停用、強制 tool_choice 被 400 拒絕、preserved thinking 綁定、computer use 只收新版工具集。
- 訂閱端同步調高 Pro、Max、Team 與按席位計費 Enterprise 方案的五小時用量上限,並新增可儲存、自選時機使用的 rate limit reset。
目錄
- Opus 5.5 是什麼:5.5 家族首款、定位與 model ID
- 新價格拆解:標準、快取、Batch 與 Fast mode
- 帳單降幅 40% 怎麼來:單價乘上 token 用量
- 能力升級的證據:官方評測怎麼讀
- 預設 effort 改 medium:對成本與品質的實際意義
- 開發者的四個相容性變更與遷移清單
- 安全與防護:分類器、回退與驗證計畫
- 訂閱端同步變動:五小時上限與 rate limit reset
- 相對 Fable 5.1 的取捨
- 相對 Opus 5 的取捨與切換時機
- 在台灣的取得方式與配額
- 什麼情況不要急著切換
- 切換評估:五個問題與行動順序
- 常見問題
- 結論與下一步
1. Opus 5.5 是什麼:5.5 家族首款、定位與 model ID
Opus 5.5 是 Claude 5.5 家族的第一款模型。官方公告明言 Sonnet 5.5 與 Haiku 5.5 會在數週內跟進,承接相同的效能、效率與安全改進。這代表 5.5 是一條產品線的起點,而非單發改版;採購時與其問「這一代值不值得換」,更實用的問題是整條 5.5 線何時補齊、現有流程要分幾步跟上。
開發端的識別碼延續既有慣例:Claude API 用 claude-opus-5-5,沒有日期後綴;Amazon Bedrock 加上 anthropic. 前綴。依官方模型總覽與公告的可用性說明,Claude API、Amazon Bedrock、Claude Platform on AWS、Google Cloud 與微軟雲端平台(公告行文稱 Microsoft Azure,技術文件稱 Microsoft Foundry)都列為供應管道,Opus 5 也持續供應,兩代並存。
規格面延續 Opus 5:上下文視窗 100 萬 token 且預設值就是上限,單次最大輸出 12.8 萬 token,tokenizer 與 Opus 5 相同。tokenizer 這一點對遷移很實用,既有文字的 token 計數基礎可以直接沿用,不必重新校準換算基礎;但完成任務的 token 用量會隨行為改變,帳單預估仍要重測輸入、輸出、thinking 與快取用量。模型文件標示的知識截止為 2026 年 6 月。
這次發布的背景也值得知道。Opus 5.5 是 Anthropic 執行長 Dario Amodei 發表前沿節奏(pacing the frontier)主張後的第一款模型,發布前經 METR 與 Frontier Design 等外部機構評測。對企業採購而言,這層外部稽核紀錄是供應商評估表格裡可以具體引用的項目。
2. 新價格拆解:標準、快取、Batch 與 Fast mode
標準 API 價格為每百萬輸入 token US$4、輸出 token US$20,比 Opus 5 的 US$5/US$25 低 20%。公告同時列出快取價格:快取讀取每百萬 US$0.20,低於 Opus 5 的 US$0.50 達 60%;5 分鐘快取寫入 US$5,低於 Opus 5 的 US$6.25,1 小時快取寫入 US$8,低於 Opus 5 的 US$10。官方特別把快取讀取出來講,原因在於代理式與程式開發工作的成本有大半落在快取讀取,這項折扣對長對話、長任務帳單的影響比標準單價更深。
Batch 維持標準價五折的計價方式,換算為每百萬 US$2/US$10,適合分類、摘要、抽取與大量評測等可非同步處理的工作,多數批次會在二十四小時內完成、屆期未處理而回傳 expired 的請求不計費(已完成的照常計費),規則與前代相同,細節見Batch API 文件。Fast mode 目前是第一方 Claude API 的研究預覽功能、須申請存取,取得權限後可在支援的 Claude Code 與 Platform 流程使用,價格為標準兩倍的 US$8/US$40,輸出速度最高可達 2.5 倍,定位與前代相同:為輸出速度支付溢價,且加速集中在每秒輸出量,不保證第一個 token 提早出現。

| 計價項目 | Opus 5.5(每百萬 token) | Opus 5 | 降幅 |
|---|---|---|---|
| 輸入 | US$4 | US$5 | 20% |
| 輸出 | US$20 | US$25 | 20% |
| 快取讀取 | US$0.20 | US$0.50 | 60% |
| 快取寫入(5 分鐘) | US$5 | US$6.25 | 20% |
| 快取寫入(1 小時) | US$8 | US$10 | 20% |
| Batch(輸入/輸出) | US$2/US$10 | US$2.50/US$12.50 | 五折規則不變 |
| Fast mode(輸入/輸出) | US$8/US$40 | US$10/US$50 | 兩倍價規則不變 |
價格以官方定價頁為準,雲端平台的計價由各平台自訂,不能直接把第一方單價套到 Bedrock 或 Vertex 的帳單上。
3. 帳單降幅 40% 怎麼來:單價乘上 token 用量
「便宜 20%」與「省 40%」是兩個不同層次的數字,混用會高估或低估預算。20% 指的是每百萬 token 的牌價調降;40% 出自官方公告的測試說法:在預設設定下的典型工作負載,整體運行成本比 Opus 5 低約 40%。兩者的差距來自第二個因子,Opus 5.5 完成同樣任務通常用掉更少 token。
官方公告與早期測試者的量測都指向同一方向:Kiro 在公開指令列任務基準上量到約少 40% 的呼叫次數與約一半的 token;Box 量到約三分之一的 token 用量與減少 40% 的冗長輸出;Optiver 在代理式編碼任務上量到約一半的往返、時間與輸出 token,該工作負載成本下降 40% 到 50%。這些是特定工作負載的量測結果,你的任務不會自動等比例受益,但機制可以拆開驗證:單價降幅是確定的,token 用量降幅要用自己的測資量。
用一個純算術練習把兩個因子分開。假設某批次工作在 Opus 5 上每天消耗 100 萬輸入與 50 萬輸出 token,牌價成本為 US$17.50;若 token 用量完全不變、只換模型,新單價降到 US$14.00,省 20%。要達到官方說的 40% 級距,token 用量需再降約四分之一,這在有實測支撐的代理式工作上是常見幅度,在高吞吐的簡單任務上則未必。快取再疊一層:長對話與代理任務若快取讀取占比高,60% 的讀取折扣會把實際降幅再往上推。
還有一個速度端的紅利:官方量測 Opus 5.5 的輸出速度比 Opus 5 快 30% 以上。對等模型回覆的互動場景,這直接縮短每輪等待;對長代理任務,速度與更少的步驟數相乘,實際耗時的改善常大於單項數字。
要把降幅真的吃進帳單,量測單位要換。多數團隊的報表以每百萬 token 成本呈現,這在單價變動時會失真;改用單位任務成本,追蹤一批固定測資完成時的平均輸入、輸出與快取 token、重試次數與人工修正分鐘數,再把失敗重跑的成本攤進去。遷移前後用同一批測資各跑一次,兩個數字相除才是你的實際降幅,官方的 40% 與別人的量測都只是參考值。快取命中率要單獨看:讀取價打了四折之後,同樣的命中率對帳單的貢獻變大,把系統提示、工具定義與長文件固定在前綴、把會變動的內容放在對話後段的舊原則,價值比前一代更高。

4. 能力升級的證據:官方評測怎麼讀
官方公告列出主要評測結果。未註明者為 adaptive thinking 最高 effort 下的分數,已註明者依公告條件呈現。
| 評測 | 衡量什麼 | Opus 5.5 | 對照組 |
|---|---|---|---|
| Terminal-Bench 4.0 | 指令列多步驟專業任務 | 66.4%(xhigh) | Fable 5.1 55.8%;Opus 5 52.3%;GPT-6 Astra 57.9% |
| FrontierCode v1.1 主集 | 程式碼變更可否被合併 | 54.6%(預設 medium) | GPT-6 Astra 最高 53.3% |
| CursorBench 4.0 | 真實多檔案模糊任務 | 52.5%(medium)/57.8%(max) | Fable 5.1(max)51.8%;Opus 5(max)46.6%;GPT-5.6 Sol 41.7% |
| GDPval-AA v2.1 | 44 種職業的真實工作 | 1846 Elo | Fable 5.1 1735;Opus 5 1708;GPT-6 Astra 1542 |
| OSWorld 2.0 | 電腦操作 | 81.8%(partial) | Opus 5 74.0%(partial) |
| AutomationBench(Zapier) | 跨應用商業流程 | 40.0% | GPT-6 Astra 41.4%;GPT-5.6 Sol 28.8% |
誠實面也要看。AutomationBench 上 GPT-6 Astra 的 41.4% 高於 Opus 5.5 的 40.0%,且該次執行由 Zapier 完成、未掛 fallback 模型,安全防護介入被計為失敗,官方自己也註明實務分數會更高;Terminal-Bench-Science 0.1 上 Astra 的 64.6% 也高於 5.5 的 58.7%。官方公告甚至直說:在這個能力水準,benchmark 差距對實務差異的預測力已經下降,內部使用感受到的 5.5 與 Fable 5.1 差距比分數顯示的更小。把榜單當候選篩選,把自家盲測當決策依據,這個順序在 5.5 世代比前幾代更重要。
成本對比是這份成績單裡最強的部分。官方口徑:FrontierCode 上預設 effort 的 5.5 以約五分之一的每任務成本超過 GPT-6 Astra 的最高分;Terminal-Bench 4.0 在預設 effort 的成本比較中,以約 40% 的每任務成本與 Astra 成績相當(上表 66.4% 為 xhigh 條件);CursorBench 4.0 以約三分之一的成本贏 GPT-5.6 Sol 十一個百分點;GDPval 上預設 effort 的 5.5 以約五分之一成本勝過最高 effort 的 Astra。想理解 GPT 陣營的模型分工,可參考站上的 GPT-5.6 家族介紹;跨陣營比較的條件差異永遠要先核對再引用。
知識工作與長任務的證據比單項分數更有說服力。內部測試要求三個模型只用網頁副本上的資料寫季度績效報告,並由自動評閱器逐項核對數字與引文,18 份報告有 16 份通過門檻,Fable 5.1 與 Opus 5 則無任何嘗試通過;兩個虛構公司的併購分析任務上,5.5 用 63 分鐘完成優於 Opus 5 的 93 分鐘,成本少 50%。編碼側的早期測試包含一天內完成 68 萬行遷移、三小時內稽核修復 20 萬行程式碼(Opus 5 超過 20 小時且用 2.5 倍 token),以及把 HAProxy 從 C 轉寫成 Rust 用時 9.5 小時、比 Fable 5.1 的 12 小時省 51% 成本。這些是單點案例,引用時保留原始條件,不要泛化成保證。
早期測試者的企業量測出自官方公告引述的客戶自述,當量化線索讀、別當獨立驗證。Deloitte 在程式碼審查量到 5.5 最低 effort 抓到 72% 的已知臭蟲,優於 Opus 5 在 high effort 的 56%,且誤報更少;Hebbia 在專家評分的研究工作流上量到 86.6% 的涵蓋率,對比 Opus 5 的 60.3%;金融圈的 Rogo 回報最低 effort 就能在自家基準勝過前代 high effort,輸出 token 約省六成。通訊品質的改進也被多方單獨點名:重點放前面、行話變少、遵守給定的寫作規則,Box 量到答案減少 40% 的冗長度而不損準確率。對把模型輸出直接交給客戶或主管看的團隊,這類「可讀性紅利」的價值不會出現在榜單上,卻會出現在審閱工時裡。
讀任何一個評測數字,養成核對五件事的習慣:比較對象是誰、雙方各用什麼 effort、成本是牌價還是每任務成本、由官方或第三方執行、評測領域與你的工作是否相近。這份清單在 Opus 5 時代就適用,在分數差距縮小的 5.5 世代更是唯一能避免被數字誤導的方法。跨模型的成本比較還要留意各家的 safety 介入條件不同,官方註明 5.5 的評測是在正式防護開啟下跑的,資安任務回退 Opus 4.8、生物與前沿模型任務回退 Opus 5 執行,這些回退會壓低榜單分數,卻不代表你的日常任務會被擋。

5. 預設 effort 改 medium:對成本與品質的實際意義
五個 effort 等級 low、medium、high、xhigh、max 都還在,行為意義依官方 effort 文件:控制整份回應願意投入多少推理資源。真正的變化在預設值:Claude API 對 Opus 5.5 的預設是 medium,Opus 5 是 high。省略參數的既有程式碼直接換 model ID,行為會降一階,這是無聲的行為變更,帳單與品質都會動。
降一階不等於降級。官方內部測試的說法是:在編碼與知識工作評測上,5.5 的 medium 相當或優於 5 的 high,數個編碼評測上 low 就接近 5 的水準且成本低得多;早期測試者 Factory 直接說這是第一款他們敢預設用 medium 的模型,品質對齊 Opus 5 的 high 而輸出 token 少 20% 到 25%。反面也要記:同一級之下 5.5 每輪思考得更多,xhigh 與 max 的回合更長,若直接沿用為 Opus 5 調好的 effort 值,token 與延遲可能不降反升。
三個實務調整跟上這個變化。第一,遷移後把 effort 明確寫出來,不要靠預設值,並用固定測資重掃一遍各階的成功率、token 與延遲,掃描範圍務必包含 low 與 medium,這兩階在 5.5 上的性價比與前代不同。第二,thinking 計入 max_tokens,為 Opus 5 關閉思考路線設定的上限會把回應攔腰截斷,xhigh 與 max effort 的長代理回合,官方建議 max_tokens 至少從 64K 起步再依實測調整。第三,頂層 effort 在請求之間變更會使 prompt cache 前綴失效,快取讀取折扣又比前代更深,長對話流程把 effort 固定、把變動的內容放在後段,帳單才吃得到 60% 的折扣。

重掃的執行方式建議沿用固定流程,結果才有可比性。從真實工作抽一批含困難長尾的測資,全部先以 medium 跑出基準,記錄成功率、輸出 token 中位數與尾端值、端到端延遲與人工修正分鐘數;再把 medium 已通過的簡單任務往下測 low,把失敗或勉強通過的困難任務往上測 high 與 xhigh,同時放大 max_tokens。找出成功率改善趨緩、token 卻明顯上漲的級距,那一階就是你的預設值。測資若偏簡單,low 會看起來萬能,等長尾任務上線才會破功,抽樣時保留難題是整個方法成立的前提。

6. 開發者的四個相容性變更與遷移清單
對直接寫 API 的團隊,公告與模型新功能文件列出四個會回傳 400 錯誤的變更,其中前三項在 Fable 5.1 上同樣適用,computer use 一項則依平台而異。
第一,thinking 無法停用。thinking: {type: "disabled"} 與 budget_tokens 寫法在每個 effort 階都會被拒絕,控制思考量的唯一旋鈕是 effort;需要短思考就走 low,需要看推理過程就把 display 設為 summarized。為前代寫的「請把推理寫進回應」這類提示詞應移除,官方新增的 reasoning_extraction 防護會拒絕這類要求。第二,強制工具呼叫被拒。tool_choice 的 any 與 tool 兩種強制形式回傳 400,token 計數與 Batch 端點一體適用;替代做法是 auto 加上 strict 工具定義與提示詞引導,或改用結構化輸出,並在程式裡檢查該次是否真的發起呼叫、沒有就重試。第三,preserved thinking。思考區塊綁定模型與對話,防的是以編輯上下文抽取推理內容的蒸餾攻擊;5.5 讀得懂 Opus 5 及更早模型的思考區塊,反向只有 Fable 5.1 與 Mythos 5.1 讀得懂它的,路由切換或 fallback 後續回合會在沒有原思考的情況下執行。2026 年 8 月 31 日之後新建的 API 帳號強制執行前綴檢查(僅在訊息含 thinking 區塊且前綴被改動時觸發),自建訊息陣列的整合要先跑過官方preserved thinking 文件的三步檢查。第四,在 Claude API 與 Google Cloud,computer use 只收 computer_toolset_20260801 工具集,舊版 computer_20251124 工具回傳 400,Amazon Bedrock 則仍支援舊版工具,動作改以工具集成員名稱回傳、一批可含多個動作,先在 Opus 5 上完成改寫測試再切型號最穩。
回應結構還有一個不擋請求的變化:工具呼叫之間的進度文字改以 thinking 區塊回傳,預設為空字串,要顯示進度就開 updates 或 summarized。安全分類器也擴編,cyber 之外新增 bio 與 reasoning_extraction 類別,拒絕以 HTTP 200 搭配 stop_reason: "refusal" 回傳,讀取回應前先檢查 stop_reason;reasoning_extraction 不會經 fallback 重試,其餘類別官方建議從第一天就掛 fallback 設定。基礎功能面,任務預算、compaction、對話中系統訊息、Files API、PDF、視覺輸入與結構化輸出都延續,詳情以文件為準。

值得開發者知道的還有兩個行為差異。提示詞要重校:為 Opus 5 的冗長、過度驗證傾向寫的抑制指令,在 5.5 上可能已經多餘甚至反效果,官方建議逐條重測再決定留存;前端與視覺輸入的腳手架也要重驗,5.5 讀圖表、截圖與技術圖面的精準度大幅提升,為前代搭的裁切、縮放預處理可能可以拆掉,互動式任務在低階 effort 就能讀準密集圖表。至於對話中途改 effort 的需求,頂層變更會打掉快取,per-message effort 的做法可避免這個代價,依官方文件的適用範圍使用。
| 遷移項目 | 必要或調校 | 動作 |
|---|---|---|
model ID 改 claude-opus-5-5 |
必要 | Bedrock 加 anthropic. 前綴;token 計數基礎可沿用 |
| 移除 thinking 停用與 budget_tokens | 必要 | 改用 effort 控制;加大 max_tokens;依區塊型別讀回應 |
| tool_choice any/tool | 必要 | 改 auto+strict+提示詞引導或結構化輸出;補呼叫檢查 |
| computer use | 必要 | 改宣告 computer_toolset_20260801(Claude API/Google Cloud;Bedrock 仍收舊版),先在 Opus 5 驗證 |
| 自建訊息陣列的歷史編輯 | 必要 | 跑 preserved thinking 三步檢查;改附加式寫法 |
| effort 顯式設定並重掃 | 調校 | 預設變 medium;掃描含 low/medium;注意快取失效 |
| refusal 處理與 fallback | 調校 | 先查 stop_reason;掛 fallback;reasoning_extraction 不重試 |
| 成本與延遲重新基準化 | 調校 | 新單價、新 token 分布、分開監看的速率限制 |
7. 安全與防護:分類器、回退與驗證計畫
安全敘事在這次發布占的篇幅特別重,採購端值得整理成三層。模型層:在 Anthropic 橫跨數千個模擬情境的自動行為稽核上,Opus 5.5 是迄今得分最好的模型;在專門測試越界傾向的評估中,嘗試突破封閉邊界的次數比 Opus 5 與 Mythos 5.1 少約 85%,且每次嘗試都屬低嚴重度並自行回報;提示注入防護在 Gray Swan 的基準上與 Fable 5.1 並列受測模型最低成功率。對讓代理長時間無人值守操作系統的團隊,這些是直接相關的指標,完整方法論見Opus 5.5 系統卡。
防護層因能力上升而加嚴。資安面,多數資安任務會被導向 Opus 4.8 執行,日常軟體開發生命週期中的找臭蟲與修漏洞不受影響;Anthropic 預告會把 Cyber Verification Program 擴充到 Opus 5.5,但截至 9 月 27 日查核,5.5 尚未納入,資安從業人員暫時無法藉該計畫取得 5.5 的放寬權限。生技面,5.5 在生物學的能力被評為匹配或超越 Mythos 5.1,因此掛上與 Fable 5.1 相同的生物防護,學研單位與藥廠可申請Life Sciences Verification Program 取得為研發工作設計的存取。合規面,Opus 5.5 的一般 API 流量可依核准條件採零資料保留,並依 EU AI Act 帶上文字水印措施;但要留意 Life Sciences Verification Program 核准的流量須保留三十天,且該計畫目前不支援 BAA 組織與第三方平台。對受產業監管的台灣企業,零資料保留可用與否常是供應商初篩的硬條件,實際條件要按使用的計畫與管道逐一核對(Fable 5.1 預設保留三十天、符合特定企業條件者有例外)。
對抗蒸餾的 preserved thinking 前一節談過開發端影響,採購端只需記住一件事:它是防護機制而非功能,不要為了繞過它設計整合流程。官方同步發布的威脅情報報告揭露了工業級蒸餾攻擊的查緝現況,說明這套防護不是理論需求。
一般開發團隊要把「防護」與「可用性」分開看。日常寫程式找臭蟲、修依賴、做程式碼審查都在允許範圍,公告明言這類軟體開發生命週期的工作不受資安防護影響;會被導向 Opus 4.8 的是滲透、攻擊工具這類多數企業用不到的任務。生物防護同理,一般衛教、寫作與商業分析不受影響,被擋下的是雙用途研究情境。真正要在程式裡處理的是誤判的可能性:分類器仍可能對無惡意請求說不,這正是官方建議為適用的拒絕類別掛 fallback 的原因,可降低部分誤判造成的中斷;仍要監看最終拒絕與回退後模型的輸出,Batch 端點也不支援伺服器端 fallback。評測期間若發現特定正當任務被擋,先確認提示詞沒有要求模型重現內部推理,再考慮調整措辭,錯誤的重現推理要求是最常見的自找拒絕。
8. 訂閱端同步變動:五小時上限與 rate limit reset
純訂閱用戶也有兩個直接相關的變動。公告明言調高 Pro、Max、Team 與按席位計費 Enterprise 方案的五小時用量上限,並提供訂閱用戶 rate limit reset,這次可以儲存起來、自選時機使用,把一次寶貴的重置留給真正衝刺的時段。特定方案能看到哪些模型、實際上限多少,依帳號與方案顯示為準,官方方案頁與設定內資訊是最終依據。
額度觸頂後的付費接續機制也在此順道整理。付費方案可開啟 usage credits,超過內含量後以標準 API 牌價按量計費繼續工作,網頁對話與 Claude Code 的用量計入同一套限制;啟用方式依方案而異,個人方案由本人設定,Team 與席位制 Enterprise 由組織管理員管理,詳細的月支出上限與自動儲值設定見官方 usage credits 說明與組織方案說明。Claude 的五小時滾動窗與每週上限怎麼計算、與 ChatGPT 計量邏輯的根本差異,站上方案與額度完整比較有專文拆解,這裡不重複。
若你主要在 Claude Code 裡工作,模型換代的體感會最明顯:更少的步驟數意味著同樣的五小時窗能推進更多工作,官方對 Claude Code 使用者的習慣建議(換任務清空對話、長任務交給代理、用 compact 控制上下文)在新模型上依然適用,入門設定可看Claude Code 中文教學。
9. 相對 Fable 5.1 的取捨
Fable 5.1 的標準價是每百萬 US$10/US$50,輸入輸出單價都是 5.5 的 2.5 倍。官方對 5.5 的定位一句話講完:多數工作上與 Fable 5.1 同級。評測面上 5.5 在 Terminal-Bench 4.0、CursorBench(預設 effort)與 GDPval 都領先,科學終端任務上 GPT-6 Astra 仍領先 5.5;官方自己補了但書,內部使用的感受差距比分數小。採購上這幾乎是把預設模型往 5.5 推:同級能力、四成的標準單價、更深的快取折扣。
仍會留下 Fable 5.1 的位置有三類。第一,最高難度的長程代理工作,失敗成本遠大於價差時,用自家測資確認 Fable 是否仍佔優。第二,需要 Mythos 管道或特定驗證計畫存取的組織。第三,資料保留條件:Fable 5.1 預設保留三十天(符合特定企業條件者有例外),5.5 一般流量支援零資料保留、經驗證計畫的流量例外;合約與法規的保留要求,要對照兩款模型各自的條件與例外核實,別只比單價。Fable 5 的深度解析對長程任務的判斷方法有完整整理,換代後的選型結論仍適用:用任務分流,而非全有或全無。
一個務實的路由起點:把 5.5 設為預設,把評測顯示它未達標的少數任務送到 Fable 5.1,並為兩種模型分開保留快取命名空間。模型間的快取不共用,路由切換本身會犧牲快取命中,分流規則寧粗勿細。供應風險也要計入:Fable 5 曾因出口管制全面暫停存取的前例提醒我們,重要流程不該綁死單一模型,5.5 與 Opus 5 兩代並存正好提供一條同家族的備援路徑,切換成本低於跨陣營備援。
10. 相對 Opus 5 的取捨與切換時機
Opus 5 沒有退場,所有管道持續供應,因此切換是經濟與工程節奏的判斷,沒有被迫升級的時鐘。往 5.5 移動的理由很集中:單價低 20%、快取讀取低 60%、同任務 token 更少、輸出快 30% 以上、tokenizer 相同讓遷移成本極低,多數沒有踩到相容性地雷的整合,改一個 model ID 字串就能拿到降價。
該放慢的四種情況對應第 6 節的清單。程式碼裡有停用 thinking 的路線、有強制 tool_choice 的呼叫、有舊版 computer use 工具,或自建訊息陣列且會編輯歷史,這四類要先改寫再切換。平台面還有兩個限制要知道:Priority Tier 的支援模型清單未包含 5.5(與 Opus 5 同),依賴容量承諾的流程要先規劃;Fast mode 與部分功能在第三方雲端平台的供應時程依各平台文件。速率限制方面,5.5 的額度池與 Opus 5 分開計算,各組織實際上限依使用等級而定,搬家前重看一次速率限制文件。
建議的切換順序:先在低流量環境改 ID 並跑通相容清單,用固定測資重掃 effort 階梯,確認品質、token 分布與延遲;把監看面板分成新舊兩個模型各自觀察一至兩週,重點看快取命中率、refusal 發生率與截斷事件;穩定後再把預設路由切過去,並保留切回 Opus 5 的開關。已經為 Opus 5 精調過提示詞的團隊,記得官方的提醒:為前代寫的冗長與驗證類指令可能已經多餘,逐條重測再決定去留。

提示詞重校有個具體的先後次序。先移除明確要求「不要思考」的規則,5.5 無法遵行這類指令,留著只會增加標籤外洩的機率;再檢查要求把推理過程寫進答案的段落,改由 display 選項閱讀摘要;接著把控管輸出長度、格式的規則保留,因為 5.5 對寫作規則的遵從度更好,這類規則的效益反而放大。整份系統提示詞動過之後,快取前綴全部失效,重校與快取觀察要安排在同一個窗口完成,免得帳單出現一段沒有快取折扣的過渡期。
11. 在台灣的取得方式與配額
Anthropic 的支援國家與地區清單持續將台灣列入商用 API 與 Claude.ai 的支援範圍。地區可用不等於特定方案、付款方式與帳號配額保證,實際狀態以登入後顯示與官方條款為準;初次上手的使用者可從Claude 中文使用指南開始。
開發端五條管道:Claude API 直連(claude-opus-5-5)、Amazon Bedrock(anthropic.claude-opus-5-5)、Claude Platform on AWS、Google Cloud,以及公告所稱的 Microsoft Azure(技術文件稱 Microsoft Foundry)。各平台的區域端點、資料駐留、折扣與計價基礎不同,Bedrock 與 Vertex 由平台方計價,不能直接套用第一方牌價;企業若已簽 AWS 或 GCP 的消費承諾,把 Claude 用量放進既有帳單結構常比直連更容易走內部採購流程。
訂閱端的取得與升級都在帳號內完成,方案差異與額度結構前文已提。官方公開方案頁以美元列價,實際結帳幣別、稅費與跨境手續費依結帳頁與付款機構而定,預算規劃時把匯差與手續費抓進去。
組織採購在直連與雲端平台之間的選擇,實務上常由既有基礎設施決定而非單價。已重度使用 AWS 的公司走 Bedrock,用量併入既有帳單與折抵結構,採購與資安審核走同一套流程;沒有雲端綁定的團隊直連 Claude API 最單純,新功能與 Fast mode 也最先到位。兩者混合是常態:開發與評測走直連拿最新功能,正式環境流量走雲端平台換取採購安定性。無論哪條路,都要先確認組織的資料保留政策與各平台的資料駐留選項相容,特別是金融、醫療與政府相關單位。

台灣的學術單位若要接觸生物醫學相關研究應用,前述 Life Sciences Verification Program 的審核明言對學研實驗室、新創與藥廠開放,需要相關研究存取的團隊可由計畫主持人層級先行了解申請條件;注意該計畫核准的流量須保留三十天,與一般 API 流量的零資料保留選項不同,且目前不支援 BAA 組織與第三方平台,申請前先核對資料保留與平台條件。一般教學與商業研究不受此限。
12. 什麼情況不要急著切換
降價訊息會製造急迫感,以下幾種情境值得先按住評估。第一,高吞吐的簡單任務:分類、摘要、格式轉換這類工作,Sonnet 5.5 與 Haiku 5.5 數週內就到,屆時整條 5.5 線的中低階也會換代,急著把簡單流量搬上 Opus 級模型反而花冤枉錢;任務範圍明確的也可以評估小型語言模型路線。第二,流程裡有第 6 節四個相容點的程式碼,改寫與測試沒完成前,Opus 5 是更穩的選擇。第三,依賴容量承諾或特定平台功能的整合,等平台文件確認支援再動。第四,剛穩定的 Opus 5 管線:模型行為有微調,精調過的提示詞與路由規則要重驗,若近期有重大交付,交付後再開遷移窗口。
還有一個反向情境:以為不換就安全。Opus 5 持續供應沒錯,但 5.5 的單價與 token 效率差距會隨用量累積,月帳單千美元級的 API 使用者,20% 到 40% 的差距就是每月數百美元,放著不評估也是一種成本。折衷做法是雙軌並行:新專案與新功能直接用 5.5 開發,既有流量按第 10 節的順序分批搬,風險與收益都能控制在窗口內。
再一種不急的情況最容易忽略:還沒建立評測能力的團隊。沒有固定測資、沒有成功率與成本的基準線,換模型只是換一種感覺,降價的效益既驗證不了也守不住。這類團隊的第一步不是切換,是先把十到二十個真實任務的測資集與計分方式建起來,有了基準線,任何模型的進退都有依據,這個投資的回報週期比想像中短。
13. 切換評估:五個問題與行動順序
把前文收斂成五個問題,依序回答就能定位自己的切換節奏。
| 問題 | 傾向立即切換 | 傾向觀望或分流 |
|---|---|---|
| 任務型態是什麼? | 代理式編碼、長文件分析、知識工作 | 高吞吐簡單任務、單輪問答 |
| 月 API 帳單規模多少? | 量大,單價與快取折扣直接見效 | 量小,差額不值得改工程 |
| 程式碼踩到幾個相容點? | 零個,改 ID 即可 | 有 thinking 停用、強制工具、舊電腦操作或歷史編輯 |
| 有沒有容量或平台依賴? | 無,走第一方 API | 需要 Priority Tier、特定雲端功能 |
| 近期有沒有重大交付? | 空檔充足可重掃 effort | 交付在即,交付後再遷 |
行動順序照第 10 節的三步走:低流量驗證、雙模型監看、正式切換留退路。訂閱用戶的行動更簡單,到設定的 Usage 頁看看新的上限與 reset 按鈕,把衝刺時段對準五小時窗的節奏,模型選單裡出現 5.5 時用同一批實際工作試一輪,比較完成度與速度的體感差異。
評估節奏也值得固定下來。模型家族的補齊、價格的再調整與平台的功能跟進都會在未來數週到數月內陸續發生,與其追逐每次公告,不如設定自己的再評估觸發點:家族補齊時重畫一次分流表、單價變動時重跑一次成本模型、用量成長超過三成時重掃一次 effort。把評估變成有節奏的例行工作,模型市場的噪音就擋在門外。
常見問題
Opus 5.5 和 Opus 5 的價格差多少?
標準單價從每百萬 US$5/US$25 降到 US$4/US$20,降幅 20%;快取讀取從 US$0.50 降至 US$0.20,降幅 60%;Batch 五折與 Fast mode 兩倍價的規則不變。官方另稱預設設定下的典型工作負載整體成本低約 40%,多出來的部分來自更少的 token 用量,需以自家測資驗證。
台灣可以用 Claude Opus 5.5 嗎?
可以。官方支援國家清單持續列出台灣,商用 API 與 Claude.ai 都在範圍內;具體方案、付款與配額以帳號登入後顯示為準,雲端平台版本依各平台區域供應。
既有 Opus 5 的程式可以直接換 model ID 嗎?
沒有踩到四個相容點就可以:thinking 停用寫法、強制 tool_choice、舊版 computer use 工具、自建訊息陣列的歷史編輯。都沒有的話改 claude-opus-5-5 字串即可,token 估算沿用,但記得 effort 預設值從 high 變成 medium,建議顯式設定並重掃。
訂閱 Pro 的用戶需要做什麼?
不用做任何事,五小時上限已依方案調高,帳號內會出現可儲存的 rate limit reset。想壓低觸頂頻率,維持換任務清空對話、長任務開新 session 的習慣,必要時開啟 usage credits 以 API 牌價接續。
thinking 不能停用,成本會不會變貴?
思考量改由 effort 控制,low 階就能把思考壓短;官方量測顯示在編碼與知識工作評測上 5.5 的 medium 相當或優於前代 high、low 在多個編碼評測接近前代水準,搭配更低單價,多數任務的單位成本是下降的。要調整的是把 max_tokens 加大到涵蓋思考與回應。
跟 GPT-5.6 Sol 或 GPT-6 Astra 相比該怎麼選?
官方評測口徑下,5.5 在 FrontierCode 以約五分之一每任務成本超過 Astra 最高分,在 CursorBench 以約三分之一成本贏 GPT-5.6 Sol 十一個百分點;Astra 在部分科學與自動化基準仍有勝場。跨陣營選型用自家盲測決定,榜單只當候選篩選。
Opus 5.5 的上下文視窗與輸出上限有變嗎?
沒有變。上下文視窗維持 100 萬 token 且預設即上限,單次最大輸出 12.8 萬 token,tokenizer 與 Opus 5 相同,既有文字的 token 計數可直接沿用;帳單預估仍須重測實際 token 用量與快取命中率。
要不要等 Sonnet 5.5 與 Haiku 5.5 到齊再一起評估?
不必綁在一起。Opus 級任務的切換判斷現在就能做,因為降價與相容清單都是即時生效的;中低階流量的確可以等數週後的家族補齊一次評估,屆時中階模型的單價與能力也會更新,分流表重畫一次反而省事。兩批評估共用同一套測資與計分方式,第二輪的成本就會低很多。
結論與下一步
Claude Opus 5.5 的核心訊息可以用一句話收攏:多數工作上前旗艦的能力,快取讀取價格降六成、標準單價降兩成,加上更少的 token 用量與快 30% 的輸出。它把「要不要用最強模型」的糾結往下拉了一層,因為帳單上最貴的那段代理式工作,正好是它降最多的地方。
行動依身分分流。API 開發者:過一次第 6 節的相容清單,零命中就換 ID,有命中先改寫,然後重掃 effort,這一步的收益常被低估,預設值降一階加上每輪思考量變多,不重掃就拿不到帳單降幅。訂閱用戶:確認新上限與 reset 的位置,模型選單出現 5.5 時用實際工作試一輪。採購與技術主管:把零資料保留、驗證計畫與平台計價三件事放進供應商評估表,5.5 在第一項上與 Fable 5.1 的條件不同。
時點聲明:本文價格、評測與規格依 2026 年 9 月 22 日官方公告與 9 月 27 日查核的模型文件整理;Sonnet 5.5 與 Haiku 5.5 數週內到位後,整條產品線的選型圖會再變一次,屆時以官方定價頁與模型總覽的當日內容為準。



