我花了 165 美金,買到 35 萬台幣的 AI 工作量——攤開兩個月的帳單與 82 億 token

這個系列的六篇文章、網站上的工具、每一張配圖,都是同一套自動化系統做出來的。這篇不談方法,只攤帳:四筆實際付款總共 165.30 美金(約新台幣 5,344 元),同一段時間跑掉的工作量按官方單價估算是 10,857 美金(約 35 萬台幣),倍數 65.7 倍。而這 35 萬還是有快取的價錢——同樣的 token 量若不做快取要 4.8 萬美金,約 156 萬台幣。逐筆金額、逐個模型、四張後台截圖全部公開。

AI agent 開發閱讀 11 分鐘·2026 年 7 月 28 日·Kasim
左邊是四張收據,右邊是兩個月跑掉的工作量。同一件事的兩種計價方式,差了 65 倍。
左邊是四張收據,右邊是兩個月跑掉的工作量。同一件事的兩種計價方式,差了 65 倍。
AI agent 開發7/7看完整系列 →

談 AI 成效的文章,最後幾乎都停在同一句話:「效率大幅提升」。這篇不這樣寫。這篇把兩個月的信用卡收據、每一個模型的用量、82 億 token 的明細全部攤在桌上,你自己看划不划算。

先講結論:兩個月,實付 165.30 美金(約新台幣 5,344 元),跑掉的工作量按官方公開單價估算是 10,857.64 美金(約新台幣 35 萬元),倍數 65.7 倍。

而且這 35 萬還是「有快取折扣」的價錢。同樣的 token 量若完全不做快取,估算金額是 48,495.63 美金——約新台幣 156 萬。

先把一件事講在前面,免得誤會:實付金額是帳單,理論金額是我自己按官方公開單價乘實際 token 量算出來的估算。 它不是任何官方對帳數字,也不代表我「省下」了 1 萬美金——這兩件事的差別,我在文末〈這些數字的三個假設〉那節會拆開講。

另外,這篇文章本身、這個系列前面六篇、你在這個網站上看到的工具與配圖,全部是這套系統做出來的。所以這不是評測,是自己的帳。

從 20 美金到 Max:四個階段,四筆收據

這兩個月的支出不是一次決定的,是被工作推著走的四個階段。

第一階段:20 美金,先試會不會動。 2026 年 6 月 2 日,我付了 20 美金開 Pro,目的很單純——想知道「讓 AI 自己跑一整套流程」到底是行銷話術還是真的可行。這個階段的產出很粗糙,大部分時間在學怎麼把要求講清楚。

第二階段:45 美金,撞到上限就加購。 6 月 7 日,因為想加快開發速度、又撞到用量上限,加購了 AI 點數。這筆錢的性質跟訂閱不同:訂閱買的是「大致夠用」,加購買的是「現在不要停」。當你正在解一個問題、思路正熱的時候,等額度重置的代價比 45 美金貴得多。

第三階段:20 美金續期,然後遇到 Fable 5。 7 月 2 日 Pro 續期。這個月的關鍵不是花了多少錢,而是新一代模型讓我決定把整套自動化系統重寫一次——不是修,是重寫。原因寫在系列的鬆綁那篇:舊系統裡有大量指令是在防上一代模型會犯的錯,新模型不犯了,那些指令從保險變成累贅。

第四階段:80.30 美金升 Max,開始大量並行。 7 月 3 日,補了 80.30 美金的差額升上 Max。理由只有一個:我要同時跑很多條工作線。系統重寫完之後,瓶頸從「AI 夠不夠聰明」變成「我一次能派幾件事出去」,而那受限於方案的並行額度。

兩個月的四筆付款明細:2026 年 6 月 2 日 20 美金、6 月 7 日 45 美金、7 月 2 日 20 美金、7 月 3 日 80.30 美金,狀態皆為已付款。
四筆收據,合計 165.30 美金。這是整件事唯一真正花出去的錢。
日期金額(USD)約台幣用途
2026-06-02$20.00NT$647Pro 起步,試可行性
2026-06-07$45.00NT$1,455加購點數,撞上限不想停
2026-07-02$20.00NT$647Pro 續期
2026-07-03$80.30NT$2,596升 Max 差額,開始並行
合計$165.30NT$5,344

匯率以 2026 年 7 月 28 日 1 美金 ≈ 32.33 元台幣換算,取整數。

這 165 美金換到了多少工作量

後台的總覽長這樣:2026 年 6 月 7 日到 7 月 28 日之間,140 個工作階段、90,651 則往返訊息、39 個有實際工作的日子。最下面那行是它自己開的玩笑——這段時間讀寫的 token 量,是《小王子》全書的 5,684 倍。

Claude Code 用量後台總覽:140 個工作階段、90,651 則訊息、總計 1.251 億 token、39 個活躍日,最愛的模型是 Opus 4.8。
後台總覽。這裡顯示的 1.251 億,和「要付錢的量」是兩個不同的口徑。

這裡有一個關鍵的坑要先講:畫面上的 1.251 億 token,不是計費的量。 後台這個數字大致是「我打的字+它寫的字」,但實際計費還要加上兩件看不見的事——把脈絡存起來(快取寫入)、以及每次對話重新讀一遍先前的脈絡(快取讀取)。把這兩項算進去,同一段時間的計費總量是 82.78 億,是畫面數字的 66 倍。

類別數量說明
輸入(未快取)4,919 萬真正第一次讀進去的內容
輸出8,002 萬系統實際寫出來的字與程式碼
快取寫入5.41 億把脈絡存起來備用
快取讀取76.08 億重複讀先前存好的脈絡
計費總量82.78 億以上四項相加

76.08 億這一格,佔了計費總量的 91.9%。 它同時是帳單膨脹的主因,也是折扣最大的地方——後面會回到這一點。

按官方公開單價乘上各模型的實際用量,逐個模型的估算金額是:

模型估算金額(USD)約台幣
Opus 4.8$4,772.05NT$154,281
Fable 5$4,310.39NT$139,357
Sonnet 5$923.12NT$29,842
Opus 5$728.02NT$23,536
Sonnet 4.6$112.09NT$3,624
Haiku 4.5$11.97NT$387
合計$10,857.64NT$350,999
Claude Code 用量後台的模型分布:Opus 4.8 佔 52.8%、Fable 5 佔 27.6%、Sonnet 5 佔 13.6%、Opus 5 佔 4.4%、Sonnet 4.6 佔 1.5%、Haiku 4.5 佔 0.2%。
模型分布。八成的量集中在兩個頂級模型,剩下的雜事由中階與便宜模型接掉。

拆成兩個月看,比總數更有意思:

月份實付估算工作量倍數
2026-06$65.00(NT$2,101)$790.42(NT$25,552)12.2×
2026-07$100.30(NT$3,242)$10,067.22(NT$325,447)100.4×
全期$165.30(NT$5,344)$10,857.64(NT$350,999)65.7×

兩個月之間,我多付了 35 美金,產出的量差了 12.7 倍。 這中間沒有任何魔法,就是我在第二個月才真的學會怎麼發包、怎麼分層、怎麼讓工作並行。這也是這個系列存在的理由——同一張訂閱,用法不同差兩個數量級。

成本收窄圖解:滿水塔代表同樣的工作量,經過快取、模型分層等三道閥門後,只滴出一小杯實付金額
工作量沒有變少,是中間三道閥門把「要付錢的部分」一路收窄,最後只滴出一小杯。

65 倍的差距是怎麼來的:三個機制

訂閱制不是慈善事業。倍數會拉到這種程度,是三個機制疊乘的結果,而三個都是可以刻意經營的。

機制一:快取讓重複的脈絡只算一折。 每次對話都要把先前的脈絡重讀一遍——專案規則、檔案內容、前面的討論。這部分若每次都當新內容算,是最貴的一筆;但只要脈絡穩定、命中快取,讀取單價只有原價的一折。我的快取讀取佔了計費總量的 91.9%,這就是折扣最集中的地方。

機制二:分層讓便宜模型接掉雜事。 從模型分布可以看到,重活集中在兩個頂級模型,但大量瑣事(格式整理、機械性檢查、簡單查找)是丟給中階與便宜模型的。頂級與最便宜模型的單價差 5 到 10 倍,這件事等於把工作按難度定價。判斷方法寫在模型分層那篇

機制三:並行讓同一段時間塞進好幾條線。 這是升 Max 唯一的理由。當工作被拆成互不依賴的小塊,就可以同時派出去,總時間取決於最慢的那一塊,而不是全部加總。

Claude Code 執行畫面,狀態列顯示 5 分 32 秒、67 萬 9 千 token、29 個正在執行的任務。
5 分 32 秒內 29 條工作線同時在跑。這個畫面是升級 Max 唯一想買的東西。

那張截圖是實際跑出來的:5 分 32 秒、67.95 萬 token、29 個任務同時執行,同時開著 8 個工作階段。這段時間裡我在做的事只有一件——看結果,決定哪些收、哪些退回重做。

順帶說一個從紀錄裡看到、有點意外的數字:那 140 個工作階段裡,真的用到並行發包的只有 36 個——大約四分之一。也就是說即使是我自己,大部分時間還是在用單線的方式使用一個支援並行的工具。這件事的改善空間,比再多付一版訂閱大得多。

那個 156 萬台幣的數字:快取到底省了多少

前面說 35 萬是「有快取折扣」的價錢。那不做快取是多少?

我把同樣的 token 量重算一次,把所有快取讀取當成一般輸入計價:48,495.63 美金,約新台幣 156 萬元。 也就是說快取這一件事,在這兩個月讓估算金額少了 37,638 美金(約新台幣 122 萬),降幅 77.6%。

這個數字很吸引人,但它需要正確的框,否則會誤導:

  • 不是我省下的錢。我沒有付過那 156 萬,也沒有付過 35 萬。
  • 它是一個反事實:如果同樣的工作方式改成按 API 逐筆計費、且完全不使用快取,帳面會長成什麼樣子。
  • 它真正的用途是告訴你優先順序:在一個 AI 工作流裡,最值得投資的技術細節不是換更貴的模型,而是把脈絡整理到能穩定命中快取。同樣的產出,這一件事就能決定帳單相差四倍以上。

換句話說,前面那個 65.7 倍裡面,最大的一塊貢獻不是訂閱優惠,是脈絡管理

這些數字的三個假設

要把帳攤開,就得把假設也攤開,不然這篇文章跟「效率大幅提升」沒兩樣。

假設一:所有理論金額都是估算,不是官方帳單。 算法是「本機執行紀錄裡的實際 token 量 × 官方公開單價」。實付的 165.30 美金有收據,其餘所有金額——10,857.64、48,495.63、每一個模型那一行——都是我自己乘出來的。官方沒有提供這種對帳,我也沒有辦法驗證到分毫。

假設二:快取寫入一律以短效期單價計算。 快取存放時間長短單價不同,我的紀錄裡沒有區分,全部以較便宜的短效期計。如果實際上有一部分是長效期,這個估算會偏低。

假設三:其中一個模型套用的是牌價,不是推廣價。 Sonnet 5 在統計期間有推廣價。我保守地用了牌價計算;若改用推廣價,那一行會從 923.12 美金降到 615.42 美金,總額約降到 10,550 美金。差異約 3%,不影響量級判斷。

還有一個界線也要說明:29 條工作線同時執行那個數字,是執行畫面的一手截圖,不是我從紀錄統計出來的。本機紀錄裡沒有「同時幾條」這個欄位,我只能算出每分鐘的密度(尖峰時單分鐘 311 則往返),密度可以佐證那個畫面不誇張,但不能反過來當成那個數字的來源。

我寧可把這些邊界寫出來,也不要用一個算不清楚的大數字換一次點擊。

如果你要照著做,順序是這樣

看完帳,實際的行動順序建議是:

  1. 先買最便宜的方案,用一個月找出「可以交出去的工作」。 這個月的目標不是產出,是清單。我第一個月的倍數只有 12 倍,代價就是這件事。
  2. 把脈絡固定下來,讓快取有東西可以命中。 把專案規則、慣例、紅線寫成穩定的檔案,而不是每次對話重新交代一遍。這一步的報酬率是全部裡面最高的。
  3. 開始分層:先問「這件事最便宜的模型做得來嗎」。 預設用頂級模型處理所有事情,是帳單膨脹最常見的原因。
  4. 等你的瓶頸變成「我一次只能派一件事」,再考慮升級。 在這之前升級只是買了用不到的並行額度。
  5. 每個月看一次逐模型用量,而不是只看有沒有超額。 超額是結果,分布才是原因。

這兩個月真正買到的東西,不是 82 億 token,是「不必為每一次嘗試算錢」的自由——因為敢重跑、敢並行、敢丟掉重做,產出才會出現數量級的差別。

收束成一句話

便宜的不是 AI,是你有沒有把工作講清楚。 同一張 165 美金的收據,第一個月換到 12 倍,第二個月換到 100 倍,中間沒有換工具、沒有加預算,只是我終於學會怎麼開口。

如果你想從第一步開始,這個系列的第一篇就是講怎麼把三個成本源變成一個你每天能看的數字。


本文所有實付金額為作者本人帳單,理論金額為依官方公開單價與本機執行紀錄自行估算,非官方對帳數據,不構成任何服務商的官方成本說明。匯率採 2026 年 7 月 28 日約 1 美金 = 32.33 元台幣換算,僅供量級參考。文中做法為作者自身工作流程紀錄,不同工作性質適用性不同,請自行評估。

帶得走的重點

  1. 兩個月四筆付款,總共 165.30 美金(約新台幣 5,344 元):20 美金試水、45 美金加購點數、20 美金續期、80.30 美金升 Max。同一段時間跑掉的 token 量按官方公開單價估算是 10,857.64 美金(約 35 萬台幣),倍數 65.7 倍。
  2. 倍數會這麼大,不是因為訂閱制佛心,而是三個機制疊在一起:快取讓重複的脈絡只算一折、分層讓便宜模型接掉大部分雜事、並行讓同一段時間塞進好幾條工作線。
  3. 快取是最大的那一項:兩個月讀進去的 76 億 token 有九成以上是快取命中,只算一折。同樣的量若完全不做快取,估算金額會從 1.08 萬美金跳到 4.85 萬美金——省掉的 3.76 萬美金約等於新台幣 122 萬。
  4. 月別對照更能說明「工具怎麼用」比「買哪一版」重要:第一個月 65 美金換到 790 美金的量(12.2 倍),第二個月 100.30 美金換到 10,067 美金的量(100.4 倍)。多付的是 35 美金,差別是這一個月學會了發包與分層。
  5. 這裡所有理論金額都是「依官方公開單價 × 實際 token 量」自行估算,不是官方帳單數字;實付金額才是帳單。看倍數時請把它當量級參考,不要當精準會計。
Kasim

Kasim

Cardo Logic 站長。生醫背景的顧問,喜歡把黑盒子拆成看得見的邏輯。

常見問題

這 1 萬多美金是你「省下來」的錢嗎?
不是,這點必須講清楚。它是「同樣的 token 量,若改成按 API 單價逐筆計費會是多少」的估算值。如果我一開始就是按 API 計費,我不可能跑掉這麼多量——我會自己節制,實際用量大概只有現在的零頭。所以正確的讀法不是「我省了 1 萬美金」,而是「訂閱制讓我做了原本不會做的事」:因為邊際成本感覺是零,我才敢讓系統整天跑、敢重跑三次比對結果、敢讓十幾條工作線並行。真正被買下來的不是 token,是「不必為每次嘗試算錢」的自由。
為什麼一個人兩個月會用掉 82 億 token?這數字看起來不合理。
因為計費的 token 量和「我打了多少字」是兩件完全不同的事。這 82 億裡面有 76 億是快取讀取——也就是每一次對話都要把先前的脈絡(專案規則、檔案內容、前面的對話)重新讀一遍,讀十次就算十次。後台介面顯示的「對話用量」同一段時間只有 1.251 億,兩者差了 66 倍。這也是為什麼理解快取這件事這麼重要:它同時是帳單膨脹的主因,也是折扣最大的地方。
我是一個人的公司/小團隊,這套值得投嗎?
先看你的工作裡有多少是「規則清楚但很花時間」的部分——整理資料、寫初稿、改格式、比對文件、跑重複流程。如果這類事情佔你一週超過十小時,投一個月的訂閱去試是划算的,因為你要驗證的不是工具好不好,而是你有沒有辦法把工作講清楚到可以發包。我第一個月的倍數只有 12 倍,第二個月才跳到 100 倍,差別完全在這件事上。反過來說,如果你的工作大部分是需要現場判斷、跟人來回、或高度依賴你個人關係的,那先別急著升級版本,用最便宜的方案把「哪些事可以交出去」找出來就好。

延伸閱讀

喜歡這種拆法?每週再看懂一個

隨時可以取消,我們就不會再寄信給你。