2026 年 9 月主要 AI 模型與訂閱方案的實用定價指南。比較 OpenAI、Anthropic、Google、xAI、DeepSeek、Qwen、Kimi、豆包、GLM、混元、MiniMax 等服務的個人方案、程式設計/Token 方案與按用量計費 API。

比較 AI 價格看似簡單,直到三種完全不同的計費模式被放進同一張表格中。
第一種是消費者應用程式訂閱方案。你每月付費,取得一個可直接使用的介面,以及聊天、搜尋、檔案處理、研究、簡報、記憶和智能體工作流程等功能。
第二種是程式設計或 Token 方案。這類方案通常也按月計費,但費用購買的是配額或額度池,通常限於供應商的官方程式設計工具、智能體產品或支援的整合服務。
第三種是按用量計費的 API。你需要根據輸入和輸出 Token 付費。當模型需要整合到自有產品、應用程式、後端或面向客戶的服務時,這通常是標準方式。
這三種「帳戶」每月都可能花費數十或數百美元,但它們不能互相替代。
ChatGPT 訂閱不包含一般 OpenAI API 用量。對某位開發者而言,程式設計方案可能比 API 計費更便宜,但不一定適合生產服務。API 每百萬 Token 的價格看似昂貴,卻可能是企業取得並發能力、可觀測性、發票管理與整合控制權的唯一方式。
本指南保留原文章的結構,並將分散的價格整理成更適合採購決策的參考資料。
價格說明: 價格經常變動。部分方案具有地區限制、促銷性質,或可能暫時無法使用。以下表格反映 2026 年 9 月 18 日至 20 日的價格快照,並在可行時與官方定價頁面交叉核對。
當使用者只是想使用官方應用程式時,消費者訂閱方案是最簡單的選擇。
| 供應商 | 免費方案 | 入門方案 | 主要方案 | 最高個人方案 |
|---|---|---|---|---|
| OpenAI ChatGPT | 免費 | 美國每月 8 美元的 Go | Plus 每月 20 美元 | Pro 100 美元;現有訂閱者可使用 Pro 200 美元方案 |
| Anthropic Claude | 免費 | Pro 每月 20 美元或每年 200 美元 | Max 5x 每月 100 美元 | Max 20x 每月 200 美元 |
| Google Gemini | 免費 | AI Plus,依地區定價 | 美國 AI Pro 每月 19.99 美元 | 美國 AI Ultra 每月 99.99 美元 |
| xAI Grok | 免費 | — | SuperGrok 每月 30 美元 | SuperGrok Plus 每月 100 美元 |
| Perplexity | 免費 | 符合資格者可使用教育/折扣方案 | Pro | Max |
OpenAI 目前提供 Free、Go、Plus 和 Pro 個人方案。
在美國:
2026 年 9 月有一項重要限制:OpenAI 在 9 月 10 日暫停了 Pro 200 美元方案的新註冊與升級。現有 Pro 200 美元訂閱者不受影響,Pro 100 美元方案仍可使用。
目前,Free 和 Go 使用者在標準 ChatGPT 體驗中使用 GPT-5.6 Luna,符合資格的付費方案則可以使用 GPT-5.6 Sol。由 GPT-6 Astra 驅動的 GPT-6 Pro,可在符合資格的 Pro、Business 和 Enterprise 方案中使用。
Claude 的個人定價相對直接:
Pro 包含 Claude Code、Cowork、Design 以及更廣泛的模型存取權。Max 方案主要提高用量上限並提供優先存取權。
Google AI 的定價依市場而異,但目前美國定價頁面列出:
Google AI Plus 是較低階的方案,但其顯示價格可能依國家而異,且並非每個地區的定價頁面都會一致顯示。
這些方案將 Gemini 存取權與 Google 儲存空間及其他 Google 服務綁定,因此不應被視為純粹的 Token 訂閱方案比較。
xAI 目前的消費者定價頁面列出:
這與網路上仍在流傳的舊方案名稱與價格不同。進行採購決策時,應以 xAI 即時定價頁面為準,而不是舊版比較表。
對產品整合而言,API 定價比消費者訂閱更重要。
以下表格列出與一般 API 採購最相關的標準短上下文價格。
| 供應商 | 模型 | 輸入 | 快取輸入 | 輸出 |
|---|---|---|---|---|
| OpenAI | GPT-6 Astra | 10.00 美元 | 1.00 美元 | 50.00 美元 |
| OpenAI | GPT-5.6 Sol | 4.00 美元 | 0.40 美元 | 20.00 美元 |
| OpenAI | GPT-5.6 Terra | 2.00 美元 | 0.20 美元 | 12.00 美元 |
| OpenAI | GPT-5.6 Luna | 0.20 美元 | 0.02 美元 | 1.20 美元 |
| Anthropic | Claude Fable 5.1 | 10.00 美元 | 0.25 美元 | 50.00 美元 |
| Anthropic | Claude Opus 5 | 5.00 美元 | 0.50 美元 | 25.00 美元 |
| Anthropic | Claude Sonnet 5 | 2.00 美元 | 0.20 美元 | 10.00 美元 |
| Anthropic | Claude Haiku 4.5 | 1.00 美元 | 0.10 美元 | 5.00 美元 |
| Gemini 3.5 Flash | 1.50 美元 | 0.15 美元 | 9.00 美元 | |
| Gemini 3.1 Pro Preview(輸入少於 200K) | 2.00 美元 | — | 12.00 美元 | |
| Gemini 3.8 Flash 導入價格 | 0.75 美元 | 0.075 美元 | 3.75 美元 | |
| xAI | Grok 4.6 | 2.00 美元 | 0.50 美元 | 6.00 美元 |
| xAI | Grok 4.3 | 1.25 美元 | 0.20 美元 | 2.50 美元 |
原文章的 OpenAI 表格大致符合目前官方價格。
目前標準短上下文價格為:
GPT-6 Astra 每 1M Token 輸入 10 美元/輸出 50 美元
GPT-5.6 Sol 每 1M Token 輸入 4 美元/輸出 20 美元
GPT-5.6 Terra 每 1M Token 輸入 2 美元/輸出 12 美元
GPT-5.6 Luna 每 1M Token 輸入 0.20 美元/輸出 1.20 美元
以上價格均以每 100 萬 Token 計算。
GPT-5.6 Sol 的 4/20 美元價格屬於促銷價格,至少持續至 2026 年 11 月 21 日。長上下文請求也可能採用不同價格,因此採購試算表不應假設每個請求都使用短上下文價格。
Anthropic 目前的第一方定價為:
Claude Fable 5.1 每 1M Token 輸入 10 美元/輸出 50 美元/快取命中 0.25 美元
Claude Opus 5 每 1M Token 輸入 5 美元/輸出 25 美元/快取命中 0.50 美元
Claude Sonnet 5 每 1M Token 輸入 2 美元/輸出 10 美元/快取命中 0.20 美元
Claude Haiku 4.5 每 1M Token 輸入 1 美元/輸出 5 美元/快取命中 0.10 美元
修正舊版比較表時,一項值得注意的內容是:Fable 5.1 的快取命中價格為每百萬 Token 0.25 美元,而不是 1.00 美元。
Anthropic 也提供批次處理折扣與獨立的快取寫入價格,因此長上下文智能體工作負載的實際成本,可能與表面的輸入/輸出價格有很大差異。
Gemini 3.8 Flash 目前的價格為:
每 1M 輸入 Token 0.75 美元
每 1M 快取輸入 Token 0.075 美元
每 1M 輸出 Token 3.75 美元
導入價格持續至 2026 年 12 月 31 日。Google 表示,2027 年 1 月 1 日起,標準價格將變為每百萬 Token 輸入 1.50 美元、輸出 7.50 美元。
Gemini 3.5 Flash 仍維持每百萬 Token 輸入 1.50 美元、輸出 9.00 美元。
目前短上下文價格為:
Grok 4.6 每 1M Token 輸入 2.00 美元/快取 0.50 美元/輸出 6.00 美元
Grok 4.3 每 1M Token 輸入 1.25 美元/快取 0.20 美元/輸出 2.50 美元
xAI 對 Grok 4.6 及相關模型的超長上下文收取更高費用,因此每次請求使用數十萬 Token 的團隊,應單獨估算長上下文價格。
中國市場由免費消費者應用程式、辦公室訂閱、智能體方案與程式設計訂閱方案組成。
原文章將主要產品整理如下。
| 產品 | 來源快照 | 目前主要模型/定位 | 第三方模型 |
|---|---|---|---|
| Kimi | 免費,另有 ¥49/¥99/¥199/¥699 方案 | Kimi K3 系列與 Kimi Work | 主要為 Kimi 模型 |
| Qwen 辦公產品 | 免費,另有付費辦公方案 | Qwen3.8 系列 | 部分產品提供第三方模型 |
| 豆包 | 來源快照中為免費,另有 ¥68/¥200/¥500 方案 | 豆包 Seed 2.1 系列 | 部分智能體流程可使用 DeepSeek |
| 智譜清言 | 免費,另有付費連續訂閱方案 | GLM-5.3 系列 | 主要為 GLM 模型 |
| MiniMax Token 方案 | ¥49/¥119/¥469 | MiniMax M3/M2.x 系列 | 主要為 MiniMax 模型 |
| DeepSeek | 網頁與應用程式免費 | DeepSeek V4.1 Flash/V4 Pro | 沒有一般性的第三方模型選擇器 |
| 騰訊元寶 | 免費 | 混元+DeepSeek | 可與混元並列使用 DeepSeek |
關鍵的採購區分很簡單:
由於消費者應用程式價格會受到促銷、App Store 計費、地區和帳戶資格影響,因此將原文章的訂閱金額視為 2026 年 9 月的價格快照,而不是永久價格表,會更加穩妥。
API 計費的單位標準化,因此更容易比較。
以下表格保留原文章結構,並針對目前官方頁面已變動的內容進行修正。
| 供應商 | 模型 | 輸入 | 輸出 | 快取輸入 |
|---|---|---|---|---|
| DeepSeek | deepseek-flash/V4.1 Flash,非尖峰 | ¥1 | ¥4 | ¥0.02 |
| DeepSeek | deepseek-flash/V4.1 Flash,尖峰 | ¥2 | ¥8 | ¥0.04 |
| DeepSeek | deepseek-v4-pro,非尖峰 | ¥4.5 | ¥13.5 | ¥0.15 |
| DeepSeek | deepseek-v4-pro,尖峰 | ¥9 | ¥27 | ¥0.30 |
| 阿里巴巴 Qwen | qwen3.8-flash | ¥0.8 | ¥2.7 | ¥0.1 |
| 阿里巴巴 Qwen | qwen3.8-max | ¥12 | ¥36 | ¥1.5 |
| 阿里巴巴 Qwen | qwen3.7-flash,0–32K | ¥0.2 | ¥0.8 | ¥0.04 |
| Kimi | Kimi K3 | ¥20 | ¥100 | ¥2 |
| 字節跳動 | 豆包 Seed 2.1 Pro | ¥6 | ¥30 | 引用供應商定價中的 ¥1.2 |
| 騰訊 | Hy4 預覽版 | ¥6 | ¥18 | ¥0.3 |
| 智譜 | GLM-5.3 | 視平台/渠道而定,約 ¥8–10 | 視平台/渠道而定,約 ¥28–32 | 視平台而定 |
| 智譜 | GLM-5.3 Flash | 視平台/渠道而定,約 ¥0.8–1.1 | 視平台/渠道而定,約 ¥2.8–3.6 | 視平台而定 |
| MiniMax | MiniMax-M3,輸入最高 512K | ¥2.1 | ¥8.4 | Tencent TokenHub 為 ¥0.42 |
DeepSeek V4.1 Flash 現在是 deepseek-flash 背後使用的模型。
目前官方價格為:
非尖峰:
快取命中 每 1M 輸入 Token ¥0.02
快取未命中 每 1M 輸入 Token ¥1.00
輸出 每 1M Token ¥4.00
尖峰:
快取命中 每 1M 輸入 Token ¥0.04
快取未命中 每 1M 輸入 Token ¥2.00
輸出 每 1M Token ¥8.00
DeepSeek 目前的尖峰時段為北京時間週一至週五 09:00–12:00 及 14:00–18:00。其他時段採用非尖峰價格。
官方文件也表示,舊版 V4 Flash 和 V4 Flash Vision Exp 模型名稱現在會導向 V4.1 Flash。
Qwen3.8-Max 目前的價格為:
每 1M 輸入 Token ¥12
每 1M 快取輸入 Token ¥1.5
每 1M 輸出 Token ¥36
Qwen3.8-Flash 目前的價格為:
每 1M 輸入 Token ¥0.8
每 1M 快取輸入 Token ¥0.1
每 1M 輸出 Token ¥2.7
Qwen3.7-Flash 會根據輸入長度採用分級定價,因此以一行「輸入價格」概括,可能會誤導需要處理大型上下文的使用者。
輸入一句想法,We0 AI 即可生成展示站、頁面與 CMS。發佈上線後並幫你獲取客戶和流量。
用戶註冊贈送一次完整項目生成
適合先體驗一次完整生成流程,快速看到專案初稿。
騰訊雲 TokenHub 目前並列列出多個模型,包括:
Hy4 預覽版 輸入 ¥6/輸出 ¥18/快取 ¥0.3
DeepSeek V4.1 輸入 ¥1–2/輸出 ¥4–8/快取 ¥0.02–0.04
GLM-5.3 輸入約 ¥10.08/輸出約 ¥31.67
Kimi K3 輸入約 ¥21.97/輸出約 ¥109.87
MiniMax-M3 輸入不超過 512K 時,輸入 ¥2.1/輸出 ¥8.4
這對比較很有用,但它不一定與第一方直接定價完全相同。採購團隊在比較價格前,應先決定要採用第一方合約、雲端市場,還是多模型閘道服務。
程式設計方案很有吸引力,因為對互動式工作的單一使用者而言,它可能提供遠高於一般 API 計費的用量。
同樣重要的限制是:配額通常與支援的程式設計產品或智能體工具綁定。
原文章的 9 月快照包括:
| 平台 | 來源快照價格 | 常見配額結構 | 限制 |
|---|---|---|---|
| 阿里巴巴 Model Studio Token 方案 | Lite ¥39/Standard ¥139/Pro ¥499 | 每週額度 | 依方案限制智能體並發 |
| 智譜 GLM Coding 方案 | Lite ¥118/Pro ¥538/Max ¥1,078 | 每週/五小時時段 | API 金鑰與席位限制 |
| 百度千帆 Token 方案 | Mini/Lite/Pro/Max | 每月 Token 池 | 依產品規則而定 |
| 騰訊雲 Token 方案 | Hy Lite ¥28/Standard ¥78/Pro ¥238/Max ¥468 | 訂閱月份額度 | 個人方案金鑰限制 |
| MiniMax Token 方案 | ¥49/¥119/¥469 | 面向智能體的配額 | 智能體並發限制 |
| Kimi Code | 來源快照中包含於符合資格的 Kimi 會員 | 共用額度+每週限制 | 與會員資格綁定 |
| 字節跳動 Trae | 從免費到 Ultra 方案 | 每月額度 | 依方案限制雲端任務並發 |
| 騰訊 CodeBuddy | 從免費到旗艦方案 | 每月額度 | 與相關產品共用額度 |
確切數字與促銷折扣可能快速變動,因此應在購買前立即確認程式設計方案的最新資訊。
這是原文章中最重要的採購提醒。
程式設計訂閱通常是為以下場景設計:
它通常不是為以下場景設計:
嘗試將個人程式設計方案當作生產 API 的替代品,往往會開始出現帳戶限制、速率限制與授權問題。
避免採購錯誤最簡單的方法,是在比較價格前先決定工作負載屬於哪一個「帳本」。
原文章用一個推廣段落介紹 NoneLinear(非线智能),這是一個將海外模型價格轉換成人民幣,並透過單一閘道提供多個供應商協定的國內聚合平台。
即使你不使用該特定供應商,這類實用服務仍值得討論。
模型聚合平台可以透過以下方式降低營運摩擦:
但實際價格不是唯一需要確認的因素。
使用任何聚合平台前,請確認:
原文章表示,其介紹的聚合平台支援 OpenAI、Anthropic 和 Gemini 相容協定,以及按請求計算 Token。這些都是有用功能,但採購團隊仍應直接核實供應商目前的合約與安全條款,而不應將文章視為對該平台的背書。
如果服務無法購買、開立發票、整合,或無法符合企業的合規規則,那麼低廉的 Token 價格就沒有意義。
原文章指出,還有四個採購面向需要考慮。
許多中國第一方模型平台要求完成實名或企業驗證後,才能取得 API 金鑰、充值,或使用部分模型。
個人驗證與企業發票不一定可以互換。
需要企業發票的公司,應確認是否必須先將帳戶轉換為企業主體,才能開始使用服務。
確認供應商是否支援:
價格較低但並發量較低的模型,在營運成本上可能反而高於價格較高、但能滿足應用程式延遲與吞吐量要求的模型。
對生產工作負載,務必確認:
| 你的情況 | 建議先使用的計費模式 | 首先確認的三件事 |
|---|---|---|
| 日常聊天、文件處理、研究 | 應用程式訂閱 | 免費方案是否足夠;付費功能是否符合固定任務;取消條款 |
| 具有中等程式設計用量的個人開發者 | 程式設計/Token 方案 | 五小時與每週限制;智能體並發;使用是否限於核准工具 |
| 有真實使用者的產品整合 | 按用量計費的 API | 輸出價格;快取命中經濟性;速率限制與並發量 |
| 需要從中國大陸使用海外模型 | 第一方國際計費或合規聚合平台 | 價格同步;貨幣轉換;按請求計費與資料條款 |
| 高用量智能體工作負載 | API+快取最佳化 | 快取輸入價格;上下文長度;輸出 Token 用量 |
| 企業採購 | 直接企業合約或核准的雲端市場 | SLA、發票、資料處理條款、支援服務 |
採購規則很直接:
先選擇計費模式,再在同一模式內比較價格。
如果把消費者訂閱、程式設計配額和生產 API 混在同一個排名中,最便宜的數字通常沒有意義。
對偶爾使用的個人而言,免費消費者方案通常最便宜。對生產整合而言,最便宜的選項取決於輸入長度、輸出長度、快取命中率、並發量,以及模型能否在不重試的情況下完成任務。
不包含。ChatGPT Plus 是消費者訂閱方案,而 OpenAI API 用量需要另外計費。大多數 AI 供應商也採用同樣的區分方式。
對使用支援的程式設計工具進行大量工作的單一開發者而言,通常可能更便宜。不過,程式設計方案通常具有時間區間、並發限制、額度池與使用限制,因此不適合面向客戶的生產服務。
長時間執行的智能體會反覆傳送系統提示、指令、程式碼庫上下文與過往對話狀態。如果其中大部分上下文都可以快取,快取輸入價格可能成為總成本最大的驅動因素之一。
DeepSeek 對 V4.1 Flash 與 V4 Pro 採用按時間區分的價格。彈性批次或離線工作負載可以安排在指定尖峰時段之外執行,以節省成本。
是,該價格持續至 2026 年 12 月 31 日。Google 表示這是導入價格,2027 年 1 月 1 日起,標準價格預計將提高至每百萬 Token 輸入 1.50 美元、輸出 7.50 美元。
現有 Pro 200 美元訂閱會繼續有效,但 OpenAI 在 2026 年 9 月 10 日暫停了 200 美元方案的新註冊與升級。Pro 100 美元方案仍然可以使用。
聚合平台可以簡化計費與多模型存取,但決策應取決於安全性、資料保留條款、發票、SLA、路由透明度,以及供應商是否準確傳遞第一方價格與模型行為。
AI 定價比較只有在區分三種不同產品後才真正有用:消費者訂閱方案、程式設計/Token 方案,以及生產 API。20 美元的應用程式訂閱、139 元的程式設計方案與按 Token 計費的 API,解決的是不同的採購問題。
對 API 而言,輸出 Token 與快取輸入往往比表面的輸入價格更重要。對程式設計方案而言,配額時段與工具限制更重要。對企業採購而言,計費主體、發票支援、並發量、SLA 與資料條款的重要性可能不亞於 Token 成本。
原始的 9 月 18 日比較在方向上具有參考價值,但多項價格與可用性細節仍需要即時確認,尤其是促銷價格與消費者訂閱方案的可用性。
先選對計費模式;只有這樣,「哪個 AI 更便宜?」才會成為有意義的問題。
從一句話開始,幾分鐘內拿到完整網站。