選對模型,不多花冤枉錢
模型每個月都在換,但「哪個適合我」沒人講清楚。這裡自己跑測試、公開方法與原始輸出, 讓你用得起的成本做出判斷。
實測,不是規格表搬運
每個結論都來自實際跑過的題目,原始輸出附在文章裡供查核。
成本算到底
不只看誰答得準,一起算實際 token 花費,因為滿分不代表划算。
最新文章
Claude Opus 5.5 vs Opus 5:牌價降兩成,實測帳單降三成
Claude Opus 5.5 牌價比 Opus 5 便宜 20%,快取讀取便宜 60%。本站用同一套 Claude Code 任務各跑 18 次、只換 model ID,Opus 5.5 的帳單少 32.9%,比只換牌價多省 9.5 個百分點,多的主要來自思考 token 少了一半。代價是它更照字面:摘要字數 9 次全達標,修 bug 時有 3 次沒順手處理題目沒要求的邊界。
Gemini 3.1 Pro Preview vs GPT-6 Sol:輸入省一成,長文先變貴
兩顆輸入都是 $2、快取讀取都是 $0.20,輸出 Gemini 3.1 Pro Preview 貴兩成。換算成繁體中文之後,輸入反而是 Gemini 便宜 10.7%,輸出只貴 7.2%;但它的長 context 門檻比 GPT-6 Sol 早 3.7 萬字到,夾在兩道門檻中間的那一段,GPT-6 Sol 的輸入便宜 44%。
GPT-6 Astra vs Claude Fable 5.1:牌價一樣,繁中帳單差 24%
兩家最旗艦的標準價逐格相同:輸入 $10、輸出 $50、快取寫入 $12.50、Batch $5 與 $25,連最大輸出都是 128K。定價表上只有快取讀取那一格不一樣,而真正決定帳單的三件事有兩件不在表上,方向還不一致:繁中偏 Astra、超過 20.9 萬字偏 Fable 5.1、快取則看回合間隔有沒有超過 13 分鐘。