2026 年,一項 AI 任務的真實成本是多少?
把一份 40 頁報告做成摘要,成本介乎 0.02 至 0.13 美元,約合 0.15 至 1.00 港元,差別只在於你把它送去哪一個模型。同一項工作,最便宜與最昂貴的選項相差約七倍,而對大多數例行工作而言,昂貴的那個並不會好上七倍。
只透過月費訂閱使用 AI 的人,通常會對這個數字感到意外,因為訂閱制把每項任務的成本完全隱藏起來。一旦你把 AI 放進自動化流程、試算表腳本,或 Make、n8n 這類工具,你就開始按 token 付費,帳目也隨之浮現。
本文就是這筆帳。截至 2026 年 8 月 19 日的官方公布價格、一個完整計算示例,以及這些數字何時會失效的誠實說明。
GPT-5.6、Gemini 3.7 Flash 與 Claude Sonnet 5 每百萬 tokens 收費多少?
以下為截至 2026 年 8 月 19 日的 API 公布價格,單位為每一百萬 tokens 的輸入與輸出。一百萬 tokens 約相當於 75 萬個英文字。價格全部來自各供應商本身的公告,而非第三方追蹤網站。
現行公布價格
--- Gemini 3.7 Flash:輸入 0.75 美元 / 輸出 3.75 美元。2026 年 8 月 13 日公布的優惠價,有效至 2026 年 12 月 31 日。按 Google 官方註腳,2027 年 1 月 1 日起將調整為 1.50 / 7.50 美元。
--- GPT-5.6 Luna:輸入 1 美元 / 輸出 6 美元。OpenAI 速度最快、成本最低的一級。
--- Claude Sonnet 5:輸入 2 美元 / 輸出 10 美元。Anthropic 於 2026 年 8 月 10 日宣布此優惠價正式成為長期價格,取消原定 9 月 1 日起實施的 3 / 15 美元收費。
--- GPT-5.6 Terra:輸入 2.50 美元 / 輸出 15 美元。OpenAI 定位為日常工作的均衡一級,官方形容其表現可與 GPT-5.5 競爭,價格則為一半。
--- GPT-5.6 Sol:輸入 5 美元 / 輸出 30 美元。旗艦一級,為長時程代理式工作而設。
五個價格之中,有兩個附帶到期日。對於任何打算在 2027 年仍然運行的工作流程,這是本文最重要的一項事實。
一項真實任務要多少錢:一份 40 頁報告的摘要
一份 40 頁報告約 15,000 字,換算約 20,000 個輸入 tokens;一份 800 字摘要約 1,100 個輸出 tokens。把這兩個數字乘以各自價格,就得出單次執行的真實成本。
單次 40 頁摘要的成本
--- Gemini 3.7 Flash:0.019 美元,約 0.15 港元
--- GPT-5.6 Luna:0.027 美元,約 0.21 港元
--- Claude Sonnet 5:0.051 美元,約 0.40 港元
--- GPT-5.6 Terra:0.067 美元,約 0.52 港元
--- GPT-5.6 Sol:0.133 美元,約 1.04 港元
港元數字以約 7.8 匯率換算,並不包括支付手續費,以及自動化工具本身另行收取的平台費用。
值得留意哪一項主導成本。輸入是 20,000 tokens,輸出只有 1,100,所以在摘要類任務中,是輸入價格決定帳單。若換成產出長篇內容的任務,例如把一份簡報擴寫成十頁,主導的就變成輸出價格,比例會完全不同。
用量到達什麼水平,API 帳單才比月費訂閱划算?
每月 100 份報告摘要,API 成本由 Gemini 3.7 Flash 的約 1.91 美元,到 GPT-5.6 Sol 的約 13.30 美元,即約 15 至 104 港元。而一個 20 美元的消費者訂閱席位,無論你一個月執行一次還是 400 次,都是約 156 港元。
每月 100 份摘要,按模型計算
--- Gemini 3.7 Flash:約 1.91 美元,15 港元
--- GPT-5.6 Luna:約 2.66 美元,21 港元
--- Claude Sonnet 5:約 5.10 美元,40 港元
--- GPT-5.6 Terra:約 6.65 美元,52 港元
--- GPT-5.6 Sol:約 13.30 美元,104 港元
誠實的結論並不是「取消你的訂閱」。訂閱買到的是應用程式、檔案處理、圖像生成、語音,以及一張你不會在凌晨兩點意外爆掉的固定帳單。API 買到的是按任務計算的單位經濟,以及把模型放進無人看管流程的能力。
判斷點在於工作是否重複而且有排程。一次性的思考工作,留在你已經付費的對話應用程式裡;每月重複一百次的同一項任務,才屬於按 token 計費的自動化流程。
提示快取(prompt caching)如何改變帳單?
提示快取會以大幅折扣計算重複的上下文。對於每次執行都重新傳送同一份品牌指南、價目表或系統提示的流程來說,這通常是最大的一筆可節省開支。OpenAI 說明,由 GPT-5.6 及之後的模型起,快取讀取享有輸入價格 90% 折扣,而快取寫入則按未快取輸入費率的 1.25 倍計算。
GPT-5.6 同時引入明確的快取斷點,以及 30 分鐘的最短快取存活時間。實際後果是:每 20 分鐘觸發一次的流程可以維持快取有效,而每小時才觸發一次的流程,每次都要重新支付寫入溢價。
由此得出的設計原則很簡單:把穩定不變的內容放在提示前段,包括品牌指南、範例與規則,把會變動的內容放在最後。快取針對的是未改變的前綴,所以單是調整提示的次序,就能在一字未改的情況下降低輸入帳單。
一個實例:一份 4,000 tokens 的風格指南,每月在 GPT-5.6 Luna 上重新傳送 500 次,未快取為 2 美元,走快取讀取則約 0.20 美元。絕對金額細小,比例卻極大,而這正是這類帳單在無人察覺下膨脹的方式。
每項工作應該分派給哪個模型?
按「出錯的後果」分派,而不是按名氣分派。分類、標籤、例行摘要與初稿,交給有能力完成的最便宜一級;任何未經編輯就送到客戶眼前的內容,或需要跨多個步驟無人看管執行的流程,才值得旗艦價格。
按使用者類型的建議
--- 執行排程內容工作的獨立市場推廣人員或自由工作者:Gemini 3.7 Flash 或 GPT-5.6 Luna。在這種用量下每月帳單維持在 50 港元以下,而例行文字的質素差距很小。
--- 產出由客戶直接閱讀的長篇文字者:Claude Sonnet 5。它的價格處於中段,也是實務工作者最常提及、行文需要較少後期修飾的模型。
--- 把多步驟業務流程自動化的營運負責人:以 GPT-5.6 Terra 作預設,只在答錯代價高昂的步驟才升級到 Sol。
--- 需要處理複雜 PDF 與結構化文件者:Gemini 3.7 Flash。Google 公布它在 GDP.pdf 文件理解基準上取得 34.0%,而 3.6 Flash 為 22.0%。
--- 跨大量工具呼叫的長時程代理工作:GPT-5.6 Sol。這是 OpenAI 專為持續性任務打造的一級,也是唯一一個在例行工作上仍能為溢價辯護的選擇。
這些數字在什麼情況下不再成立?
本文每一個數字,都是標準級別、純文字 tokens 的公開牌價,而不少真實成本落在這個範圍之外。請把這張表當作下限,而不是預測。
--- 五個價格中有兩個會到期。按 Google 自己公布的時間表,Gemini 3.7 Flash 於 2027 年 1 月 1 日起價格翻倍。Claude Sonnet 5 的價格雖已成為長期價格,但「長期」是一項企業聲明,不是合約。
--- 推理 tokens 按輸出計費。把推理強度設為高或最高時,模型產生的計費 tokens 可以是可見答案的數倍。GPT-5.6 新增了最高等級的推理設定,而它並不免費。
--- 圖像、音訊與影片另有計費方式。本文內容完全不適用於圖像生成或多模態輸入,兩者使用獨立費率,並且往往按件計費。
--- 你的自動化平台會另外收費。Make、Zapier 與 n8n 按操作數或執行次數收費,與底層 token 成本無關。在小型任務上,平台費用經常高於模型費用。
--- 消費者訂閱層級是另一種產品。對話方案的速率限制、模型存取權與功能,與 API 存取並不相同,你無法從其中一個價格推算另一個。
如果你根本不想管理模型呢?
那麼按 token 計價的表格就不是適合你的工具,而誠實的替代方案,是一套已經由別人替你選好模型的現成配置。UD 的 AI 員工招聘處正是其中之一:8 位預先建置的 AI 員工,涵蓋 24 項專業技能,月費 0 港元,免費提供予香港企業使用。
這些角色相當具體,而非籠統的助手。Amy 負責社交媒體,David 負責 SEO 與內容,Eva 處理日程、文檔與會議紀錄,Frank 建立數據儀表板,Henry 則負責安全審計,包括 PDPO 合規與漏洞掃描。
請清楚了解取捨。招聘處不會讓你選擇底層模型,不會給你一張可供優化的 token 帳單,也不會幫你在 Luna 與 Terra 之間作決定。如果按成本分派模型才是你真正的問題,招聘處解決不了,本文那張表才可以。
它解決的是相反的問題:你要的是產出,而不是基礎設施上的決策。如果你為了一項每星期只執行兩次的工作,花了兩個晚上比較 token 價格,那正是你在優化錯誤層次的訊號。
簡短版本
2026 年,一項 AI 任務的成本是以「仙」計算而非以「元」計算,而在例行工作上,不同模型之間的差距是每月數十港元,而不是數百港元。真正昂貴的失誤都是結構性的:一份未經快取、被重複傳送數千次的系統提示、一個長期停留在最高等級的推理設定,又或者用旗艦模型去做分類工作。
在建立任何你預期明年仍在運行的流程之前,先確認那兩個附帶到期日的價格。然後按後果分派模型、為穩定內容啟用快取,並停止為從來不需要旗艦規格的任務支付旗艦價格。
如果你想在輸出質素而非成本上再深入一層,我們關於驗證鏈提示法的指南,講解了一個四分鐘流程,用來揪出較便宜模型答錯的事實。懂AI的冷,更懂你的難 UD 同行28年,讓科技成為有溫度的陪伴。
由 UD AI 團隊審閱。
直接跳過模型比較
如果你想要的是能立即上工的 AI 員工,而不是一張 token 價格試算表,不如由 8 位月費 0 港元的現成 AI 員工開始。UD 團隊手把手帶你完成每一步,由挑選合適角色,到在你現有工具中完成安裝。