現況更新(2026-08-05)
OpenAI 調降 GPT-5.6 兩檔價格
本文原於 2026-07-27 發布。2026-08-05 重新比對三家官方定價頁時發現,Anthropic 與 Google 的價格全部維持不變,OpenAI 則調降了 GPT-5.6 的中間檔與平價檔。以下為新舊對照,內文各表格已同步更新為新價。
| 模型 | 原價(2026-07-27) | 現價(2026-08-05) | 變動 |
|---|---|---|---|
| gpt-5.6-terra | $2.50 / $15 | $2 / $12 | 輸入降 20%,輸出降 20% |
| gpt-5.6-luna | $1 / $6 | $0.20 / $1.20 | 輸入降 80%,輸出降 80% |
這次調降改變了兩個原本的結論。第一,全表最低價換人:原本是 gpt-5.4-nano($0.20 / $1.25),現在 gpt-5.6-luna 輸入同價、輸出更低($1.20),成為本文涵蓋範圍內最便宜的選項。連帶讓輸出端的最高最低價差從 144 倍拉大到 150 倍。第二,原文寫「GPT-5.6 三檔沿用前一代同檔位價格,賣的是效率不是降價」——這個說法現在只對最上面的 Sol 成立,Terra 與 Luna 都已經低於前一代對應檔位。
此外,OpenAI 現行定價頁已為 GPT-5.6 三檔標示長文脈分級(超過門檻後單價翻倍,例如 Sol 由 $5 / $30 變為 $10 / $45),本次一併補入下方「標價的陷阱」一節。
摘要
摘要
發布日期:2026-07-27 最新價格查證日期:2026-08-05
這篇只做一件事:把 Anthropic、OpenAI、Google 三家 API 的每百萬 token 牌價列出來對照。三家在 2026 年 7 月都推出了新的主力模型——OpenAI 的 GPT-5.6(Sol/Terra/Luna 三檔,7 月 9 日)、Google 的 Gemini 3.6 Flash(7 月 21 日)、Anthropic 的 Claude Opus 5(7 月 24 日)——所以現在是重新算一次帳的時間點。以牌價論,同級距的價格其實咬得很緊:旗艦級輸入落在每百萬 5 至 10 美元,主力級落在 1.5 至 5 美元,輕量級落在 0.2 至 1 美元。真正的差距不在標價,而在同一家廠商內部:OpenAI 的 gpt-5.5-pro 每百萬輸出 token 要 180 美元,同門的 gpt-5.6-luna 只要 1.20 美元,相差 150 倍。另外有一個容易被忽略的前提:token 不是共通單位。Anthropic 官方文件寫明,Claude 4.7 之後的模型(含 Opus 5)改用新 tokenizer,同一段文字約會多產生 30% 的 token。所以把三家的標價直接相減比大小,結論不會準。
同級距對照:三家各出什麼牌
把三家的模型按定位排在同一張表上。價格單位一律為「美元/每百萬 token」,格式為輸入 / 輸出。
| 級距 | Claude(Anthropic) | GPT(OpenAI) | Gemini(Google) |
|---|---|---|---|
| 最高階 | Fable 5 $10 / $50 |
gpt-5.5-pro $30 / $180 |
(無對應層級) |
| 旗艦 | Opus 5 $5 / $25 |
gpt-5.6-sol $5 / $30 |
Gemini 3.1 Pro Preview $2 / $12(逾 20 萬 token 為 $4 / $18) |
| 主力 | Sonnet 5 $2 / $10(優惠價至 8/31) |
gpt-5.6-terra $2 / $12 |
Gemini 3.6 Flash $1.50 / $7.50 |
| 輕量 | Haiku 4.5 $1 / $5 |
gpt-5.6-luna $0.20 / $1.20 |
Gemini 3.5 Flash-Lite $0.30 / $2.50 |
| 最低價 | (無更低層級) | gpt-5.4-nano $0.20 / $1.25 |
Gemini 3.1 Flash-Lite $0.25 / $1.50 |
「級距」是本文為了對照而做的歸類,不是廠商官方分類。Google 目前沒有與 Fable 5、gpt-5.5-pro 對應的超高階收費層級;而 Gemini 的最新 Pro 仍停在 3.1 Pro Preview——7 月 21 日那批新模型全是 Flash 系列,沒有 3.5 或 3.6 Pro。
OpenAI 這一欄有個反常之處值得注意:「輕量」的 gpt-5.6-luna($0.20 / $1.20)在 2026-08-05 調降後,已經比更下面那層的 gpt-5.4-nano($0.20 / $1.25)還便宜。表中仍照廠商的模型定位排列,但若純粹以價格挑選,luna 現在是 OpenAI 全線最低的選項,而不是 nano。
Claude 完整價目
| 模型 | 輸入 | 輸出 | 備註 |
|---|---|---|---|
| Claude Fable 5 | $10 | $50 | 最高階 |
| Claude Opus 5 | $5 | $25 | 2026-07-24 發布;快速模式為 $10 / $50 |
| Claude Opus 4.8 | $5 | $25 | 快速模式同為 $10 / $50 |
| Claude Opus 4.7 / 4.6 / 4.5 | $5 | $25 | — |
| Claude Sonnet 5 | $2 | $10 | 優惠價至 2026-08-31,之後為 $3 / $15 |
| Claude Sonnet 4.6 / 4.5 | $3 | $15 | — |
| Claude Haiku 4.5 | $1 | $5 | 文脈上限 20 萬 token |
Anthropic 的折扣結構:批次處理五折;提示詞快取寫入為標準輸入價的 1.25 倍(5 分鐘)或 2 倍(1 小時),快取命中則只要一成。指定美國境內推論會有 1.1 倍加價。
GPT 完整價目
| 模型 | 輸入 | 輸出 | 備註 |
|---|---|---|---|
| gpt-5.5-pro | $30 | $180 | 全表最高價 |
| gpt-5.4-pro | $30 | $180 | 同價 |
| gpt-5.6-sol | $5 | $30 | 2026-07-09 發布,主打旗艦檔 |
| gpt-5.5 | $5 | $30 | — |
| gpt-5.6-terra | $2 | $12 | 中間檔;2026-08-05 查得已由 $2.50 / $15 調降 |
| gpt-5.4 | $2.50 | $15 | — |
| gpt-5.6-luna | $0.20 | $1.20 | 平價檔;2026-08-05 查得已由 $1 / $6 調降,現為全表最低價 |
| gpt-5.4-mini | $0.75 | $4.50 | — |
| gpt-5.4-nano | $0.20 | $1.25 | 輸入與 luna 同價,輸出略高 |
GPT-5.6 剛發布時(2026-07-09),三檔價格與前一代 5.5、5.4 的對應檔位完全相同,賣的是同價位下的效率提升。但到 2026-08-05 查證時,情況已經變了:Sol 仍與 5.5 同價($5 / $30),Terra 與 Luna 則雙雙低於前一代對應檔位——Terra 由 $2.50 / $15 降為 $2 / $12,Luna 由 $1 / $6 降為 $0.20 / $1.20。也就是說這一代從「不降價」轉為實質降價,而且降在中低價位。
另外兩點:GPT-5.6 三檔設有長文脈分級,超過門檻後單價翻倍(Sol $10 / $45、Terra $4 / $18、Luna $0.40 / $1.80);以及 2026 年 3 月 5 日之後發布、且支援資料落地的模型,走區域處理端點會有一成加價。
Gemini 完整價目
| 模型 | 輸入 | 輸出 | 備註 |
|---|---|---|---|
| Gemini 3.1 Pro Preview | $2(逾 20 萬 token:$4) | $12(逾 20 萬 token:$18) | 目前最高階,仍為預覽版 |
| Gemini 3.6 Flash | $1.50 | $7.50 | 2026-07-21 發布 |
| Gemini 3.5 Flash | $1.50 | $9 | 輸出比 3.6 貴 |
| Gemini 3 Flash Preview | $0.50(音訊 $1) | $3 | — |
| Gemini 3.5 Flash-Lite | $0.30 | $2.50 | 2026-07-21 發布 |
| Gemini 3.1 Flash-Lite | $0.25(音訊 $0.50) | $1.50 | 比 3.5 Flash-Lite 便宜 |
Google 的價目表有兩個地方要注意。一是版號大不等於價格高:3.1 Flash-Lite 比 3.5 Flash-Lite 便宜,3.6 Flash 的輸出也比 3.5 Flash 便宜——新版本在這裡是往下打的。二是音訊輸入另計,部分模型的音訊輸入費率是文字的兩倍。批次與 Flex 層一律五折。
為什麼標價不能直接相減
價目表是牌價,不是帳單。以下三件事會讓實際花費偏離表面數字,而且幅度不小。
一、token 不是共通單位
Anthropic 官方文件明確記載:Claude 4.7 以後的模型(含 Opus 5、Fable 5)改用新的 tokenizer,同一段文字約會多產生 30% 的 token,確切幅度依內容而定。也就是說同一份文件送進不同廠商的模型,被計費的 token 數本來就不同。跨廠商比較單價,等於在比兩個不同單位的數字。
二、輸出 token 的量差異更大
輸出通常是帳單的大宗(費率是輸入的 5 至 6 倍),而各家模型完成同一個任務要吐多少 token,差異可以很可觀——這正是 OpenAI 與 Google 在 2026 年 7 月的發布中主打的宣傳點。牌價便宜但話多的模型,總帳未必比較省。
三、長文脈的加價規則各家不同
三家的做法完全不同。Anthropic 的 Claude 4.6 以後模型把完整 100 萬 token 文脈納入標準價,不因請求長度加價。Google 相反:Gemini 3.1 Pro Preview 在提示詞超過 20 萬 token 時,輸入從 $2 跳到 $4、輸出從 $12 跳到 $18。OpenAI 也有分級,而且幅度最大——GPT-5.6 三檔的長文脈價格一律是短文脈的兩倍左右(Sol $5 / $30 → $10 / $45,Terra $2 / $12 → $4 / $18,Luna $0.20 / $1.20 → $0.40 / $1.80)。做長文件處理時,這個級距差對總帳的影響可能超過模型本身的牌價差。
結論是老話一句:要知道實際成本,只能拿自己的真實工作負載跑一遍,看帳單。價目表的用途是抓量級、排除明顯不合理的選項,不是拿來算出精確預算。
常見問題(查證日期:2026-08-05)
AI API 有免費額度嗎?
本文列的都是付費牌價。Anthropic 給新用戶少量試用額度,正式使用一律依 token 計費。Google 的 Gemini API 有免費層級(有速率與用途限制),本文列的是付費 Standard 層。OpenAI 沒有常態性的免費 API 層級。三家都不收月租,用多少付多少,但都需要先綁定付款方式。
最便宜和最貴的分別是哪個?
截至 2026-08-05 查證,最便宜是 OpenAI 的 gpt-5.6-luna($0.20 / $1.20),同廠的 gpt-5.4-nano 緊接在後($0.20 / $1.25,輸入同價、輸出略高),Google 的 Gemini 3.1 Flash-Lite 第三($0.25 / $1.50)。最貴是 OpenAI 的 gpt-5.5-pro 與 gpt-5.4-pro($30 / $180)。輸出端最貴與最便宜相差 150 倍,而且兩端都出自同一家廠商。
為什麼不能直接把三家標價相減?
因為 token 不是共通單位。Claude 4.7 以後的模型改用新 tokenizer,同一段文字約多產生 30% token;各家模型完成同一任務的輸出量也不同。跨廠商比單價只能抓量級,不能當預算。
有哪些方法可以降低費用?
三家都有兩種標準折扣:批次處理一律五折;提示詞快取讓重複送出的長提示或文件在第二次之後以極低費率讀取(Anthropic 的快取命中價是標準輸入價的一成)。但實務上最有效的還是選對層級——分類、摘要這類任務用輕量模型就夠,不需要動用旗艦。
長文脈會不會加價?
看廠商。Anthropic 的 Claude 4.6 以後模型把完整 100 萬 token 文脈納入標準價,不因長度加價。Google 的 Gemini 3.1 Pro Preview 則在超過 20 萬 token 時,輸入從 $2 跳到 $4、輸出從 $12 跳到 $18。OpenAI 的 GPT-5.6 三檔同樣有長文脈分級,單價約為短文脈的兩倍(例如 Sol 由 $5 / $30 變為 $10 / $45)。三家之中只有 Anthropic 不因長度加價。
結論
2026 年 7 月三家的新模型讓價目表重排了一次,但同級距之間其實咬得很緊——真正的價差來自選錯層級,不是選錯廠商。而八月初 OpenAI 的調降也說明了一件事:這種表格的保鮮期只有幾週。
- 旗艦級輸入落在每百萬 $5 至 $10,主力級 $1.50 至 $2,輕量級 $0.20 至 $1
- Claude Opus 5 是旗艦級最便宜的選項($5 / $25)
- 全表最低價與最高價都出自 OpenAI,輸出端相差 150 倍
- GPT-5.6 發布時與前一代同價,但 8 月初 Terra 與 Luna 已實質降價,Luna 降幅達八成
- Gemini 版號大不等於價格高,新版是往下打的
- Claude 4.7 以後換了 tokenizer,同一段文字多約 30% token,跨家比價要打折看
- 批次五折、提示詞快取是三家共通、且立即可用的省錢手段