DeltaMedia
2026-10-08
模型動態

Haiku 5.5 便宜只是假象?沒寫在價目表上的三大隱性成本曝光

2026 年 10 月 7 日,Anthropic 推出 Claude Haiku 5.5,前 10 萬 token 定價 $0.10/$0.50,與 OpenAI GPT-6 Luna 相同;但超過 10 萬 token 後跳 5 倍至 $0.50/$2.50,Luna 要到 27.2 萬 token 才漲、且只到 $0.20/$0.75。

Haiku 5.5 便宜只是假象?沒寫在價目表上的三大隱性成本曝光

重點摘要

  • 2026 年 10 月 7 日,Anthropic 推出 Claude Haiku 5.5,前 10 萬 token 定價 $0.10/$0.50,與 OpenAI GPT-6 Luna 相同;但超過 10 萬 token 後跳 5 倍至 $0.50/$2.50,Luna 要到 27.2 萬 token 才漲、且只到 $0.20/$0.75。
  • Haiku 5.5 換用新分詞器,同一段長提示詞比 Haiku 4.5 多消耗約 1.25 倍 token ,是未標示在定價頁的隱性成本。
  • 同日,Anthropic 宣佈 Sonnet 5.5 快取讀取費用腰斬,並對 Max/Team 訂閱用戶每月提供 $100 至 $500 的 API 額度,看起來是把訂閱用戶導向 API 平台的配套動作。

Haiku 4.5 推出將近一年,定價 $1/百萬輸入 token 、$5/百萬輸出 token ,在同期競品來看已算偏高;GPT-6 Luna 上個月出現後,這個差距被放大成整整 10 倍。2026 年 10 月 7 日,Anthropic 推出 Claude Haiku 5.5,前 10 萬 token 的定價直接對齊 Luna:$0.10/$0.50。數字雖然好看,但藏在後面的三個變數,才是決定新價格划不划算的關鍵。

Haiku 5.5 和 GPT-6 Luna 標價相同,落差在哪裡?

這個平價只在 10 萬 token 以內成立。Haiku 5.5 超過門檻後,費率跳 5 倍到 $0.50/$2.50;Luna 的分界點在 27.2 萬 token ,漲幅只到 $0.20/$0.75,不到 Haiku 5.5 新費率的一半。

換個方式算:如果你的上下文長度習慣跑在 15 萬 token ,Haiku 5.5 的輸入成本是每百萬 $0.50,Luna 還在 $0.10;輸出差距更大,$2.50 對 $0.50。這個成本比,光靠基準測試分數的差異很難補回來。

Haiku 5.5 還內建了推理能力且無法關閉,預設等級為 medium。根據 Simon Willison 的實測,low 等級跑一個 SVG 生成任務花了 7 秒、0.0936 美分;max 等級同一任務跑了 5 分 9 秒、3.3826 美分。相比之下,Haiku 4.5 不支援推理等級,同類任務只消耗 0.7583 美分。強制開啟推理這件事,對高吞吐量批次處理的延遲和 token 消耗都有影響,要額外計算進去。

新分詞器把隱性成本藏在哪?

定價頁只有一行數字,分詞器版本不會標在上面。Willison 用自己的 Claude Token Counter 工具比對後發現,Haiku 5.5 處理同一段長提示詞,消耗的 token 數大約是 Haiku 4.5 的 1.25 倍。

這代表即使標價從 $1/$5 降到 $0.10/$0.50,實際成本也不能只看表面倍數。來看一個具體情境:原本用 Haiku 4.5 跑 9 萬 token (輸入)的工作,換到 Haiku 5.5 之後,同樣內容可能膨脹到 11.2 萬 token ,直接越過 10 萬的分界點,觸發跳漲後的費率。這個滑動效果,會讓部分「剛好卡在門檻邊緣」的工作負載付出比預期高很多的費用。

工程上的建議是:遷移前先拿真實的提示詞集跑 token 計數,不要用 Haiku 4.5 的歷史消耗直接乘比例換算。1.25x 是平均值,長提示詞的實際偏移可能更大,而且新舊分詞器之間沒有線性換算捷徑。

長上下文工作負載怎麼選?

把上面兩個變數疊在一起,Haiku 5.5 的甜蜜點就清楚了:提示詞短、工作量完整跑在 10 萬符記以內的任務。分類標注、短文摘要、API 呼叫包裝這類場景,Haiku 5.5 和 Luna 的成本幾乎一樣,而 Haiku 5.5 的基準測試分數據 Willison 觀察是比較高的(brief 沒有揭露具體數字)。

換到長上下文就不同了。RAG 系統把大量文件塞進上下文、多輪對話累積記憶、程式碼審查帶入整份儲存庫,這些場景都容易超過 10 萬 token 。10 萬到 27.2 萬 token 這個區間,Luna 維持 $0.10/$0.50,Haiku 5.5 已在 $0.50/$2.50;即使最終超過 27.2 萬,Luna 也只漲到 $0.20/$0.75,比 Haiku 5.5 的跳漲費率低超過一半。理論上,提示詞穩定超過 15 萬 token 的工作,Luna 的輸入成本大約是 Haiku 5.5 的 1/5,這個差距也很難靠功能優勢填平。

Sonnet 5.5 降價加訂閱額度,策略上在做什麼?

同一天的公告,Anthropic 宣佈 Sonnet 5.5 的快取讀取費用腰斬,並對訂閱用戶推出每月 API 額度:Max 5x 每月 $100、Max 20x 每月 $200、Team 訂閱最高每月 $500(用戶共享)。

這套額度機制,顯然是為了將僅使用網頁介面的訂閱用戶,全面引流至 API 平台。$100 的月度額度對正在做個人專案的工程師不小,足以養活相當量的測試呼叫。一旦習慣在 API 跑工作負載,用戶黏性的本質就從固定月費轉化為用量計費,對平台長期的每用戶平均收入更有想像空間。

Sonnet 5.5 快取讀取降價則對另一群人說話:快取通常在長上下文或重複呼叫的情境用得最多,降低這塊成本,讓過去嫌 Sonnet 貴的工程師重新評估它的使用場景。兩個動作加起來,Anthropic 這次的組合技比單推一個新模型複雜:定價壓低一層,用額度把訂閱用戶導向 API,再用 Sonnet 5.5 快取降價守住中高端用量。

Haiku 5.5 填補了與 Haiku 4.5 之間的定價懸差,也把正面競爭壓力重新拉回 Luna 的同一水位。但「標價相同」只是入場條件:你的上下文落在 10 萬 token 的哪一側、新分詞器對你的提示詞實際多吃多少、以及訂閱額度能不能攤掉部分使用成本,這三個數字算清楚之前,標價都只是一個起點。

相關公司 OpenAI Anthropic
本文由 DeltaMedia 編輯團隊審核後發布 · 編輯原則