
同樣的腦力活,帳單差 190 倍
AI 模型的智商差距正在縮小,帳單差距正在爆炸。
2026 年 9 月,獨立評測機構 Artificial Analysis 的 Intelligence Index v4.2 榜單上:第一名 Claude Fable 5.1 拿 57 分,第十名 DeepSeek V4 Flash 拿 41 分——差距 28%。
但把兩家牌價丟進同一個用量試算:智商差 28%,月費差 58 倍。吃到快取折讓後差距更狠:同樣 95% 命中率,貴族實付 NT$33-35 萬,DeepSeek Flash 只要 NT$1,600 (或不到)——190 倍。
這篇文章用「每月 10 億 Token」做統一口徑(約 8 億輸入 + 2 億輸出,一般開發者與中小團隊的重度用量),把 2026 年 9 月的模型階級一次算清。
用量是這個數字的 10 倍或 1/10,自己乘除即可。
階級表:10 億 Token 月費
模型 | AA 智商 | 月費牌價(台幣) | 實際帳單* | 開源 |
|---|---|---|---|---|
Claude Fable 5.1 | 57(#1) | NT$55.8 萬 | NT$33 萬 | ✗ |
GPT-6 Astra | 55 | NT$55.8 萬 | NT$35 萬 | ✗ |
Muse Spark 1.3(Meta) | 53 | NT$5.7 萬 | — | ✓ |
Kimi K3(月之暗面) | 50 | NT$16.7 萬 | — | ✓ |
GLM-5.3(智譜) | 49 | NT$10.9 萬 | — | ✓ |
Gemini 3.8 Flash(Google) | 47 | NT$4.2 萬** | — | ✗ |
GLM-5.3-Flash(智譜) | 46 | NT$1.2 萬 | 數千 | ✓ |
DeepSeek V4 Pro | 42 | NT$1.4 萬 | — | ✓ |
DeepSeek V4 Flash | 41 | NT$1.0 萬 | NT$1,600 | ✓ |
「實際帳單」= 同樣 10 億 Token、95% 快取命中率的價(貴族用各自的快取價:Fable $0.25、Astra $1.00;DS 用 $0.018)。若你的任務是輸入重的 cron 型結構(9.5 億輸入/0.5 億輸出、99% 命中),DeepSeek V4 Flash 更可壓到 NT$1,600 以下——實證帳單見下文。 *Gemini 3.8 Flash 是早鳥價($0.75/$3.75),只到 2026/12/31,之後漲 2 倍到 NT$8.4 萬以上。
定價來源皆為各官方公布之 API 牌價:Fable 5.1 與 Astra 同為輸入 $10 / 輸出 $50(每百萬 Token);Kimi K3 為 $3/$15;GLM-5.3-Flash 為 $0.2/$1.1;DeepSeek V4 Flash 為 $0.22/$0.66。
三個階級,三種人生
真貴族(NT$50 萬+/月):Claude 與 OpenAI 旗艦。兩家牌價完全相同($10/$50),一分錢不讓——寡頭定價的默契。買的是智商榜前兩名,以及「一個任務值幾千美金」的客戶:法律盡職調查、資安審計、頂級研究。
開源中產(NT$5-17 萬/月):中國開源模型已經殺進這個區間。Meta 的 Muse Spark 1.3(53 分)一個月只要貴族的十分之一;Kimi K3(50 分)是開源智商冠軍,還能自己架伺服器跑——權重是你的,推論成本由你的硬體決定。
平民的王(NT$1 萬/月):GLM-5.3-Flash(46 分)和 DeepSeek V4 Flash(41 分)。只比貴族低 11-16 分(約 20-28%),帳單是 1/58。這個區間的真實威力還要加上快取:DeepSeek 快取折讓 97%,實測高重複性任務(cron、批量掃描、管線)命中率 99%,10 億 Token 實際帳單可以壓到幾千到一萬台幣。
智商在收斂,價格在爆炸
把數字畫成一條線:智商每高 1 分,你多付的錢是加速度的。
Fable 5.1(57 分)→ 每 1 分智商月費 NT$9,800
Kimi K3(50 分)→ NT$3,300
GLM-5.3-Flash(46 分)→ NT$260
DeepSeek V4 Flash(41 分)→ NT$250
貴族的「每分智商單價」是平民的 38 倍。模型能力每追上 1 分,貴族的溢價就崩一分——這正是為什麼 Anthropic 估值能衝到 $9,650 億超車 OpenAI 的 $8,520 億:它必須一直拿智商第一,才能一直收 $50/M 的輸出費。
中國開源追上貴族,只是時間問題
看看榜單的中段:53、50、49、47、46——Muse Spark、Kimi K3、GLM-5.3、Gemini 3.8 Flash、GLM-Flash 全擠在 7 分之內,裡面四個是中國團隊的開源模型。
而開源模型的追趕速度是結構性的:
權重公開,全世界的工程師幫它找問題
蒸餾與強化學習的方法論外溢,貴族每出一代,開源半年內就有對位產品
定價自由,沒有毛利敘事要顧,可以貼著成本賣
AA 榜單本身就是加速器——每個月刷新的智商排名,讓開源陣營知道自己差哪裡
半年前 GLM-Flash 還在 52 分的舊制掙扎,今天 46 分的新制已經摸到貴族 57 分的八成。照這個斜率,2027 年內開源模型摸到 55 分是合理預期——到時候貴族的 $50/M 就不是奢侈,是孤獨。
新手第一週實錄:¥62.35 / 4.15 億 tokens / NT$275
理論試算看膩了?來一張真實帳單。
一位剛入門 AI 開發的朋友,第一週用 Hermes Agent + DeepSeek 跑了 4.15 億 tokens、2,204 次 API 請求——帳單 ¥62.35 人民幣,約 NT$293。一頓午餐的價格。
有效單價 $0.021/百萬 Token,對應快取命中率 95% 以上。平均每個請求 18.8 萬 tokens 的長 context agent 任務,DeepSeek V4 Flash 全部接住。
三個重點:
這 4 億 tokens 有一半是新手繞路與嘗試錯誤。探索期的浪費在 Flash 上無所謂,在貴族上每個錯誤都是真金白銀
同一用量若用 GPT-6 Astra:約 NT$8.8 萬——一週燒掉一台 iPhone,入門熱情大概撐不過三天
換 Flash 的建議本身就值幾千塊:他前幾天還在用 V4 Pro,改用 Flash 後單價直接砍半再打折
AI 開發的入門門檻從來不是智商,是帳單。選對階級,新手可以盡情犯錯——而犯錯正是學會的唯一方式。
給開發者的實用結論
重複性任務(cron、掃描、批量管線):DeepSeek V4 Flash 或 GLM-5.3-Flash,吃滿快取折讓,10 億 Token 一萬台幣有找
要更強的腦但不貴:Kimi K3 自己架,或 GLM-5.3 API,都是貴族三成的智商、兩成的價
單一高價值任務(一份審計、一次訴訟分析):才輪得到 Fable 5.1 / Astra 上場
永遠別用貴族跑量:10 億 Token 55 萬台幣,這錢夠雇一個工程師
結論
平民階級已經夠用:GLM-Flash(46 分)與 DeepSeek Flash(41 分)月費 NT$1 萬出頭,智商達貴族的 72-81%,快取命中後實際帳單更低
階級差在價格不在腦:智商差 28%,帳單差 58 倍(10 億 Token 口徑,NT$55.8 萬 vs NT$1.0 萬)
開源追上是時間表不是問句:Kimi K3、GLM、Muse Spark 已擠進 49-53 分區間,2027 年摸到 55 分的貴族門檻是合理預期
新手實證:入門第一週 4.15 億 tokens 實付 NT$275(Hermes + DS Flash)——同用量在 Astra 是 NT$8.8 萬,320 倍
貴族賣的是「現在最強」,平民買的是「夠用就好」——當追趕的速度用月計算,現在的智商差價,是貴族最後的護城河。
౨ৎ Anthony 不負責任編輯 ~
留言 (0)