← AI 研究地圖

主題儀表板1地圖第 ① 站|需求端

Token 價格:中美調價行為與分層定價

這一板回答四件事:token 單價還在跌嗎、誰在漲誰在降、漲的是哪一層、每單位智慧的成本怎麼走。

這一板的判讀:名目價格 2025 下半年止跌,每單位智慧的成本還在崩跌;9/22 之後旗艦帶沒動、主力帶換代降價,算力緊的訊號留在旗艦帶與中國廠商的漲價。

美系旗艦最低價

$4

2026/9|混合單價,每百萬 token

DeepSeek 主力價

$1.98

2026/9|尖峰價口徑

智慧 40 分的最低成本

$0.237

2026/9|AA 智慧指數,混合單價

中國系 token 份額

77.2% / 28.7%

2026-09-27|量/錢,Vercel 閘道 7 日均

怎麼看這一板

核心看法:2023 年到 2025 年上半年,token 一路變便宜,而且掉得很快。轉折在 2025 年下半年:旗艦模型出新一代不再更便宜,反而更貴,OpenAI 5.6 Sol 首發 $11.25,Anthropic 的 Fable 5 與 Opus 5 站上 $20。算力成本不再往下掉,模型商就不再降價,這是算力吃緊在價格上留下的證據,也是我們 8 月定價文寫的:貴的更貴,去年的智慧趨近免費。2026 年 9 月 22 日之後要分兩層看:$20 的旗艦帶沒動,主力帶三家同一天換代降價(Opus 5.5 混合單價 $8、比 Opus 5 少兩成;GPT-6 Sol $4、比 5.6 Sol 首發少六成多),主力帶回到搶量,旗艦帶還在收費。

  1. 美系的規則是同一個模型的標價幾乎不動,要調價就發新模型。所以只看「同一個模型有沒有調價」會以為美系只降不漲,漲價都藏在換代裡。
  2. 中國的規則是上市先給促銷價,之後再依事件調整。DeepSeek 同一個主力模型兩年內漲了三次。
  3. 標價止跌,不代表智慧變貴。做同樣能力的事,最便宜的那個選項還在一路變便宜;應用層的帳單變少,很可能只是換了便宜的同能力模型,不是用量變少。
  4. 標價也不等於做完一件事的成本。話多的模型標價便宜,做完同一件事可能更貴;同一個模型不同的用力程度(effort 檔位),做同一件事的成本可以差五倍。

名詞:混合單價 =(3 × input + 1 × output)÷ 4 的每百萬 token 標價,是標價不是成交價,未含快取、批次與企業折扣。主力帶指 $3 到 $8 的主流模型,旗艦帶指 $10 到 $20。

1定價事件全口徑:同模型調價+換代改價

深色是同一個模型直接改價,淺色是換代時新一代比上一代的價差。只看同模型會以為美系只降不漲,因為美系的漲全走換代。兩張圖同刻度,期間都是 2025 年 7 月到 2026 年 9 月。美系 13 漲 19 降,13 次漲有 12 次來自 OpenAI 與 Google 的主力與中價帶;中國同期 12 漲 4 降,方向更一致。9 月 22 日三筆換代降價是主力帶第一次一起往下。

中國五家:12 漲 4 降#

資料來源:FinSight 彙整與估算 · 更新日期 2026-10-02

美系四家:13 漲 19 降#

資料來源:FinSight 彙整與估算 · 更新日期 2026-10-02

2換代首發價階梯:美系 vs 中國

每條線是同一個產品級距歷代的上市月標價。美系:OpenAI 主力從 GPT-5 的低點逐代上行到 $11.25,9 月 22 日 GPT-6 Sol 換代降到 $4,是 2025 年 8 月以來第一次往下;Google Flash 從 $0.175 漲到 $3 再腰斬到 $1.5;Anthropic 反向,Opus 降到 $10 再降到 $8,但另開 $20 的 Fable 價位帶;xAI 逐代降價搶市。中國三家旗艦線逐代單調上行:Kimi 漲五倍、GLM 漲一倍多、Qwen 漲五成後換代回落。 菱形是 Fable 5 與 GPT-6 Astra,兩家都在主力之上另開 $20 的旗艦帶,所以主力線最後一段往下,是最貴的那一代被分出去了,旗艦帶本身守住 $20,主軸不變。

美系同級距換代首發價(USD/百萬 token,log)#

怎麼看這張圖

每條線是同一產品級距歷代的上市月標價,不是同模型調價。菱形是 20 美元的高階 SKU。

資料來源:模型商公開定價與 Artificial Analysis 公開指數,FinSight 彙整 · 更新日期 2026-10-02

中國旗艦線換代首發價(USD/百萬 token,log)#

怎麼看這張圖

縱軸範圍跟左圖一樣,方便對照。Kimi K2 到 K3 從 1 美元到 6 美元;GLM 4.6 到 5.2 從 0.96 到 2.15 美元;Qwen Max 3.8 換代回落到 3 美元。

資料來源:模型商公開定價與 Artificial Analysis 公開指數,FinSight 彙整 · 更新日期 2026-10-02

3DeepSeek 漲價之後:價與量

左:主力鏈從 deepseek-chat 歷代接力到 V4-Pro,虛線是定價事件:① 2025 年 2 月促銷到期恢復原價(+173%)、② 9 月 V3.1 輸出漲 50% 並取消夜間優惠、③ 12 月 V3.2 降價 64%、④ 2026 年 6 月換代 V4-Pro、⑤ 7 月尖峰時段兩倍計價、⑥ 8 月 16 日尖峰五倍離峰 2.5 倍、⑦ 9 月標價反映後混合價 $0.544 到 $1.98,主力鏈創新高。右:漲價之後中國系在 Vercel 閘道的份額,量升到 77% 後高檔持平、錢連兩週抬頭到 29%、件數 44%。量不掉、價上去、錢進來,漲價主因是供給接不住,是供給緊的價格出清,不是需求轉弱。右圖是方向計不是全市場量表:樣本是海外 app 開發者,不含企業直連合約與中國境內流量,看方向不看水準。

DeepSeek 主力模型混合單價與定價事件(USD/百萬 token,log)#

怎麼看這張圖

主力鏈是 deepseek-chat 從 V2 到 V3.2 再接 V4-Pro。虛線是定價事件:2025 年 2 月促銷到期恢復原價、9 月漲價並取消夜間優惠、12 月降價、2026 年 6 月換代、7 月起尖峰時段兩倍計價、8 月再漲價。

資料來源:模型商公開定價與 Artificial Analysis 公開指數,FinSight 彙整 · 更新日期 2026-10-02

中國系合計份額:量 vs 錢 vs 件(7 日 MA)#

怎麼看這張圖

中國系模型合計。漲價後五週 token 份額從 53% 升到 78%,幾乎全由 DeepSeek 新版貢獻;錢的份額從 15% 升到 22%,件數 44%。記得這是份額,樣本是 Vercel 的海外開發者。

資料來源:Vercel AI Gateway 開放資料 (CC BY 4.0),FinSight 彙整 · 更新日期 2026-10-02

4量與錢分家:閘道上誰拿到量、誰收到錢

兩張都是方向計:資料是 Vercel AI Gateway 的開放資料,樣本是海外 app 開發者,不含企業直連合約與中國境內流量,看變化方向不看水準。左:量的王是 DeepSeek,8 月 16 日漲價後量沒掉,9 月 10 日 V4.1 Flash 上線後翻倍到六成以上,之後高檔持平;因為畫的是份額,其他家跟著被壓,不代表他們的量在掉。右:錢的王是 Anthropic,份額從六成多退到四成以下,接走的是 Kimi(K3 定價 $6 真的在收錢)、Google 與 OpenAI;錢的移動對應的事件是美系的新模型與降價,不是 DeepSeek 漲價:7 月 9 日 ChatGPT Work 與 5.6 Sol、8 月 21 日 5.6 Sol 限時降價 29% 加上 Luna 降價 80%(OpenAI 的份額從 8 月下旬就開始升)、9 月 3 日 GPT-6 Astra、9 月 22 日 Opus 5.5 降到 $8。Anthropic 退的是份額不一定是金額,要對 Ramp 9 月的支出份額再看一次。

閘道每日份額:量(token,7 日移動平均)#

怎麼看這張圖

資料來自 Vercel AI Gateway 的開放資料,量的口徑,畫到 2026/9/20。DeepSeek 已是第一,9/10 新版上線後份額翻倍。因為畫的是份額,其他家跟著被壓:Anthropic 從 19% 到 7%、OpenAI 從 13% 到 8%,不等於他們的量在掉。

資料來源:Vercel AI Gateway 開放資料 (CC BY 4.0),FinSight 彙整 · 更新日期 2026-10-02

閘道每日份額:錢(spend,7 日移動平均)#

怎麼看這張圖

錢的口徑。Anthropic 退的是份額不一定是金額,要再對 Ramp 的 9 月支出份額看一次。DeepSeek 的錢從 3.7% 升到 6.9%,是漲價加上新版放量,錢跟著量一起來。

資料來源:Vercel AI Gateway 開放資料 (CC BY 4.0),FinSight 彙整 · 更新日期 2026-10-02

5中美旗艦帶對照:花多少錢買幾分

每列一個模型,x 是混合單價,括號是 Artificial Analysis 的智慧指數。藍帶是主力帶 $3 到 $8,橘帶是旗艦帶 $10 到 $20。9 月 30 日的讀法:$20 旗艦帶的 Fable 5.1 與 Astra 分數都低於 $8 的 Opus 5.5 和 $4 的 Sonnet 5.5,旗艦帶第一次不是分數最高的地方;主力帶一個月內擠進四個新代;DeepSeek V4-Pro 尖峰價 $1.98 只有 36 分。

中美旗艦帶對照(2026/9/30 快照+9/22 定價)#

怎麼看這張圖

每列一個模型,橫軸是混合單價(對數),括號是智慧指數。藍帶是主力帶 3 到 5.6 美元,橘帶是旗艦帶 10 到 20 美元。

資料來源:模型商公開定價與 Artificial Analysis 公開指數,FinSight 彙整 · 更新日期 2026-10-02

6用錢買時間:快速通道成了標準計價軸

左:同一模型快速或尖峰通道相對標準價的倍數,大多收斂在 2 倍。右:誰在什麼時候開賣快速通道,從 xAI 2025 年 4 月首創到 2026 年 9 月 Astra 上市即附快速通道,18 個月內從一家變六家。token 定價已經裂解成智慧 × 速度 × 時段 × 資料權的多維結構。

「用錢買時間」:快速通道的價格倍數#

怎麼看這張圖

同一模型的快速通道相對標準價的倍數。速度收益只有 OpenAI 給官方數字(2 到 2.5 倍速度、2 倍價格、智慧不變)。

資料來源:模型商公開定價與 Artificial Analysis 公開指數,FinSight 彙整 · 更新日期 2026-10-02

「用錢買時間」的擴散時間線:誰在什麼時候開賣快速通道#

怎麼看這張圖

橫軸是該通道第一次出現的時間,縱軸是相對標準價的倍數。

資料來源:模型商公開定價與 Artificial Analysis 公開指數,FinSight 彙整 · 更新日期 2026-10-02

7智慧單價:名目止跌,每單位智慧還在崩跌

左:每個點一個模型,顏色是上市時期,虛線是各時期的價格前緣;9 月 30 日前緣頂第一次不在 $20 帶,Opus 5.5 用 $8 買到最高分。右:達到智慧指數 30、40、50 分的最低成本,≥40 線四個月從 $10 掉到 $0.24,≥50 線兩個月從 $10 掉到 $4。應用層帳單下降可能只是換了便宜的同能力模型,不等於用量衰退。注意低價前緣多是中國系與開源模型,美系企業實際採購仍集中在四大。

智慧指數 vs 混合單價(AA 指數 v4.3 尺,2026/9/30 快照)#

怎麼看這張圖

每點一個模型(智慧指數 20 分以上,共 246 個)。顏色是上市時期,虛線是各時期的累積性價比前緣(標價口徑)。

資料來源:模型商公開定價與 Artificial Analysis 公開指數,FinSight 彙整 · 更新日期 2026-10-02

同能力門檻的最低成本演進(log)#

怎麼看這張圖

達到智慧指數 30、40、50、60 分的歷史最低混合單價,依模型發布日、用現價計。60 分以上這條線:6 月 20 美元、7 月 8 美元、8 月 3 美元、9 月 2 美元。

資料來源:模型商公開定價與 Artificial Analysis 公開指數,FinSight 彙整 · 更新日期 2026-10-02

8效能 vs 價格前緣:同能力越來越便宜

左:每半年一條性價比前緣,前緣持續往左上移動代表同能力越來越便宜、同價格能力越來越強。右:達到固定正確率門檻的最低成本,對數軸,線往下走的斜率就是價格通縮的速度。這是演算法和架構的效率,和算力頁上硬體單價止跌是兩件事同時成立。

WeirdML:正確率 vs 每次執行成本(log)#

怎麼看這張圖

顏色是發布時期(半年),每期各畫一條性價比前緣。

資料來源:Epoch AI (CC BY 4.0),FinSight 彙整與估算 · 更新日期 2026-10-01

同能力門檻的最低成本演進(log)#

資料來源:Epoch AI (CC BY 4.0),FinSight 彙整與估算 · 更新日期 2026-10-01

9任務口徑:做完一件事要花多少錢

左:x 軸是跑完整套智慧指數基準的實際花費(含 reasoning token),左上是又強又省;虛線是各時期的前緣。換成任務口徑後排名大翻轉:GPT-6.1 Sol 用 Astra 八分之一的錢拿到只差 1.7 分的分數。右:每一分智慧的任務成本,最貴仍是 Fable 5.1 最高檔,每分 $246;最省的是 GPT-6 Luna、MiMo 與 GLM 5.3 Flash,每分 $2 到 $7。同一模型不同 effort 檔位要同檔位比才公平。

智慧指數 vs 任務成本(Cost to Run Intelligence Index,AA 指數 v4.3 尺,2026/9/30 快照)#

怎麼看這張圖

橫軸是跑完整套智慧指數基準的實際花費,含推理 token,對數軸;左上是又強又省。虛線是各時期的累積前緣。

資料來源:模型商公開定價與 Artificial Analysis 公開指數,FinSight 彙整 · 更新日期 2026-10-02

每點智慧的任務成本(USD/智慧點,log)#

怎麼看這張圖

任務成本除以智慧指數,跟上一張用標價除以智慧點的排名對照,會大幅翻轉。

資料來源:模型商公開定價與 Artificial Analysis 公開指數,FinSight 彙整 · 更新日期 2026-10-02

10話多稅與任務成本:標價和實際花費可以脫鉤

左:跑同一套基準吃掉多少 token,Grok 4.7 標價 $3 卻話最多,任務成本反而高;GPT-6.1 Sol 用最少的 token 拿到高分。右:CursorBench 4.0 代理編程實戰,同一條線是同一模型掃 effort 檔位;Opus 5.5 高檔以三成的錢拿到幾乎同分,是新的性價比甜點;任務成本與標價可以差到 17 倍。

話多程度:跑同一套基準吃掉多少 token(隱含,百萬)#

怎麼看這張圖

隱含消耗等於任務成本除以標價,取智慧 40 分以上的 17 個模型。紅色是中國模型,藍色是美系。

資料來源:模型商公開定價與 Artificial Analysis 公開指數,FinSight 彙整 · 更新日期 2026-10-02

CursorBench 4.0:代理編程實戰的分數 × 每任務成本(effort 掃描,2026/9/29 快照)#

怎麼看這張圖

Cursor 官方基準,題目取自真實的多檔案模糊任務。4.0 版 2026/9/10 改版加入長任務題型,分數跟 3.2 版不能直接比:榜首從 73% 降到 52% 是題變難,不是模型退步。橫軸是每任務實際成本(對數),縱軸是解題得分;同色同線是同一個模型掃不同的 effort 檔位,由低到高。中國模型與上一代模型在 4.0 版都沒有入榜。

資料來源:Cursor 公開基準,FinSight 彙整 · 更新日期 2026-10-02

11延伸:旗艦鏈與小模型鏈

左:各家歷代旗艦接力的混合單價,2023 到 2025 上半年陡峭通縮,2025 下半年起旗艦新代不再更便宜。右:小模型線是大量低價值 token 的成本地板,決定 AI 功能塞不塞得進免費產品;小模型也在漲,Haiku 4.5 比 3 Haiku 貴四倍,只有 OpenAI 持續壓低小模型價格。

各家旗艦鏈:混合單價(USD/百萬 token,log)#

怎麼看這張圖

每條線是該公司歷代旗艦接力,換代處會跳動;滑鼠停留可以看到當月的旗艦型號。標價不含快取和批次折扣。

資料來源:模型商公開定價與 Artificial Analysis 公開指數,FinSight 彙整 · 更新日期 2026-10-02

小模型鏈:混合單價(log)#

資料來源:FinSight 彙整與估算 · 更新日期 2026-10-02

12明細:正式版同模型調價事件

來源是 LiteLLM 月度標價史,幅度是混合單價月對月的變動。中國廠商的限時促銷與錯峰折扣多半不進標價,實際調價次數被低估。

正式版同模型調價事件明細#

陣營時間模型幅度
中國2025/02deepseek-chat(V3 促銷到期)+173%
中國2025/09deepseek-chat(V3.1、取消夜間優惠)+83%
中國2025/12deepseek-chat(V3.2)-64%
中國2025/09deepseek-reasoner(V3.1 統一定價)-9%
中國2025/12deepseek-reasoner(V3.2)-64%
中國2026/09deepseek-v4-pro(8/16 漲價,尖峰價口徑)+264%
中國2026/09deepseek-v4-flash(同上)+277%
美系2023/11claude-2-27%
美系2023/11claude-instant-1.2-90%
美系2024/07gemini-1.5-pro(預覽價轉正式價)+900%
美系2024/09gemini-1.5-flash-75%
美系2024/11gpt-4o-42%
美系2025/01o1-mini-63%
美系2025/02claude-3-5-haiku-20%
美系2025/06o3-80%
美系2025/09gpt-3.5-turbo-54%
美系2026/03gemini-1.5-flash-57%
美系2026/08gpt-5.6-luna-80%
美系2026/08gpt-5.6-terra-20%
美系2026/09gpt-5.6-sol(8/21 起限時 3 個月,美系首見促銷價)-29%

資料來源:模型商公開定價與 Artificial Analysis 公開指數,FinSight 彙整 · 更新日期 2026-10-02