Vanilla Lab

← 回文章列表

貴族與平民:10 億 Token 的 AI 模型階級表

2026-09-06

同樣的腦力活,帳單差 190 倍

AI 模型的智商差距正在縮小,帳單差距正在爆炸。

2026 年 9 月,獨立評測機構 Artificial Analysis 的 Intelligence Index v4.2 榜單上:第一名 Claude Fable 5.1 拿 57 分,第十名 DeepSeek V4 Flash 拿 41 分——差距 28%。

但把兩家牌價丟進同一個用量試算:智商差 28%,月費差 58 倍。吃到快取折讓後差距更狠:同樣 95% 命中率,貴族實付 NT$33-35 萬,DeepSeek Flash 只要 NT$1,600 (或不到)——190 倍。

這篇文章用「每月 10 億 Token」做統一口徑(約 8 億輸入 + 2 億輸出,一般開發者與中小團隊的重度用量),把 2026 年 9 月的模型階級一次算清。
用量是這個數字的 10 倍或 1/10,自己乘除即可。

階級表:10 億 Token 月費

模型

AA 智商

月費牌價(台幣)

實際帳單*

開源

Claude Fable 5.1

57(#1)

NT$55.8 萬

NT$33 萬

GPT-6 Astra

55

NT$55.8 萬

NT$35 萬

Muse Spark 1.3(Meta)

53

NT$5.7 萬

Kimi K3(月之暗面)

50

NT$16.7 萬

GLM-5.3(智譜)

49

NT$10.9 萬

Gemini 3.8 Flash(Google)

47

NT$4.2 萬**

GLM-5.3-Flash(智譜)

46

NT$1.2 萬

數千

DeepSeek V4 Pro

42

NT$1.4 萬

DeepSeek V4 Flash

41

NT$1.0 萬

NT$1,600

「實際帳單」= 同樣 10 億 Token、95% 快取命中率的價(貴族用各自的快取價:Fable $0.25、Astra $1.00;DS 用 $0.018)。若你的任務是輸入重的 cron 型結構(9.5 億輸入/0.5 億輸出、99% 命中),DeepSeek V4 Flash 更可壓到 NT$1,600 以下——實證帳單見下文。 *Gemini 3.8 Flash 是早鳥價($0.75/$3.75),只到 2026/12/31,之後漲 2 倍到 NT$8.4 萬以上。

定價來源皆為各官方公布之 API 牌價:Fable 5.1 與 Astra 同為輸入 $10 / 輸出 $50(每百萬 Token);Kimi K3 為 $3/$15;GLM-5.3-Flash 為 $0.2/$1.1;DeepSeek V4 Flash 為 $0.22/$0.66。

三個階級,三種人生

真貴族(NT$50 萬+/月):Claude 與 OpenAI 旗艦。兩家牌價完全相同($10/$50),一分錢不讓——寡頭定價的默契。買的是智商榜前兩名,以及「一個任務值幾千美金」的客戶:法律盡職調查、資安審計、頂級研究。

開源中產(NT$5-17 萬/月):中國開源模型已經殺進這個區間。Meta 的 Muse Spark 1.3(53 分)一個月只要貴族的十分之一;Kimi K3(50 分)是開源智商冠軍,還能自己架伺服器跑——權重是你的,推論成本由你的硬體決定。

平民的王(NT$1 萬/月):GLM-5.3-Flash(46 分)和 DeepSeek V4 Flash(41 分)。只比貴族低 11-16 分(約 20-28%),帳單是 1/58。這個區間的真實威力還要加上快取:DeepSeek 快取折讓 97%,實測高重複性任務(cron、批量掃描、管線)命中率 99%,10 億 Token 實際帳單可以壓到幾千到一萬台幣。

智商在收斂,價格在爆炸

把數字畫成一條線:智商每高 1 分,你多付的錢是加速度的。

  • Fable 5.1(57 分)→ 每 1 分智商月費 NT$9,800

  • Kimi K3(50 分)→ NT$3,300

  • GLM-5.3-Flash(46 分)→ NT$260

  • DeepSeek V4 Flash(41 分)→ NT$250

貴族的「每分智商單價」是平民的 38 倍。模型能力每追上 1 分,貴族的溢價就崩一分——這正是為什麼 Anthropic 估值能衝到 $9,650 億超車 OpenAI 的 $8,520 億:它必須一直拿智商第一,才能一直收 $50/M 的輸出費。

中國開源追上貴族,只是時間問題

看看榜單的中段:53、50、49、47、46——Muse Spark、Kimi K3、GLM-5.3、Gemini 3.8 Flash、GLM-Flash 全擠在 7 分之內,裡面四個是中國團隊的開源模型。

而開源模型的追趕速度是結構性的:

  • 權重公開,全世界的工程師幫它找問題

  • 蒸餾與強化學習的方法論外溢,貴族每出一代,開源半年內就有對位產品

  • 定價自由,沒有毛利敘事要顧,可以貼著成本賣

  • AA 榜單本身就是加速器——每個月刷新的智商排名,讓開源陣營知道自己差哪裡

半年前 GLM-Flash 還在 52 分的舊制掙扎,今天 46 分的新制已經摸到貴族 57 分的八成。照這個斜率,2027 年內開源模型摸到 55 分是合理預期——到時候貴族的 $50/M 就不是奢侈,是孤獨。

新手第一週實錄:¥62.35 / 4.15 億 tokens / NT$275

理論試算看膩了?來一張真實帳單。

一位剛入門 AI 開發的朋友,第一週用 Hermes Agent + DeepSeek 跑了 4.15 億 tokens、2,204 次 API 請求——帳單 ¥62.35 人民幣,約 NT$293。一頓午餐的價格。

有效單價 $0.021/百萬 Token,對應快取命中率 95% 以上。平均每個請求 18.8 萬 tokens 的長 context agent 任務,DeepSeek V4 Flash 全部接住。

三個重點:

  • 這 4 億 tokens 有一半是新手繞路與嘗試錯誤。探索期的浪費在 Flash 上無所謂,在貴族上每個錯誤都是真金白銀

  • 同一用量若用 GPT-6 Astra:約 NT$8.8 萬——一週燒掉一台 iPhone,入門熱情大概撐不過三天

  • 換 Flash 的建議本身就值幾千塊:他前幾天還在用 V4 Pro,改用 Flash 後單價直接砍半再打折

AI 開發的入門門檻從來不是智商,是帳單。選對階級,新手可以盡情犯錯——而犯錯正是學會的唯一方式。

給開發者的實用結論

  • 重複性任務(cron、掃描、批量管線):DeepSeek V4 Flash 或 GLM-5.3-Flash,吃滿快取折讓,10 億 Token 一萬台幣有找

  • 要更強的腦但不貴:Kimi K3 自己架,或 GLM-5.3 API,都是貴族三成的智商、兩成的價

  • 單一高價值任務(一份審計、一次訴訟分析):才輪得到 Fable 5.1 / Astra 上場

  • 永遠別用貴族跑量:10 億 Token 55 萬台幣,這錢夠雇一個工程師

結論

  • 平民階級已經夠用:GLM-Flash(46 分)與 DeepSeek Flash(41 分)月費 NT$1 萬出頭,智商達貴族的 72-81%,快取命中後實際帳單更低

  • 階級差在價格不在腦:智商差 28%,帳單差 58 倍(10 億 Token 口徑,NT$55.8 萬 vs NT$1.0 萬)

  • 開源追上是時間表不是問句:Kimi K3、GLM、Muse Spark 已擠進 49-53 分區間,2027 年摸到 55 分的貴族門檻是合理預期

  • 新手實證:入門第一週 4.15 億 tokens 實付 NT$275(Hermes + DS Flash)——同用量在 Astra 是 NT$8.8 萬,320 倍

貴族賣的是「現在最強」,平民買的是「夠用就好」——當追趕的速度用月計算,現在的智商差價,是貴族最後的護城河。

౨ৎ Anthony 不負責任編輯 ~

留言 (0)