Skip to content
所有標籤

#pricing

23 篇文章
daily digest AI Pricing Watch

定價追蹤|Anthropic Cache 讀取砍 75%,Google Gemini 3.8 Flash 促銷價上路

Anthropic 9/1 發布 Claude Fable 5.1,基礎 input/output 價格不變($10/$50,每百萬 tokens),但 cache read 從 $1.00 砍到 $0.25(↓75%),高度依賴重複 context 的 agent workload 最多可省 45%。Google 9/2 發布 Gemini 3.8 Flash,促銷價 $0.75/$3.75 只到 2026-12-31,2027-01-01 起漲回 $1.50/$7.50(雙倍)。兩家同一週都在用 cache/促銷窗口而非基礎牌價競爭。

daily digest AI Pricing Watch

定價追蹤|OpenAI Assistants API 正式停用,遷移選模型牽動成本

OpenAI Assistants API(/v1/assistants、/v1/threads、/v1/threads/runs)已於 2026-08-26 正式停用,一年前公告、零延長、無自動遷移工具。這本身不是定價變動,但停用逼你重新選模型——原本掛在 Assistants 上的 o3($2.00/$8.00,每百萬 tokens input/output)沒有直接替代品,官方建議換成 GPT-5.6 Sol($4.00/$20.00,成本 ↑129%),但實務上 Terra($2.00/$12.00,↑29%)在多數場景已經夠用,兩者差 44%。

daily digest AI Pricing Watch

定價追蹤|DeepSeek 週末全時段降到離峰價,上週漲價的另一半故事

DeepSeek 自 2026-08-23 00:00(北京時間)起,週六、週日全天不再區分尖峰/離峰,一律以離峰價計費——原本週末仍套用平日的尖峰/離峰時段表,尖峰時段 V4-Pro Output 要價 $3.96/1M tokens,現在週末全天都是 $1.98/1M。平日計費規則不變。距 8/16 那次尖峰漲價(Output 漲 355%-371%)僅一週。

daily digest AI Pricing Watch

定價追蹤|Google 不砍價,改砍帳單結構:Gemini Enterprise 推出承諾折扣與離峰費率

Google Cloud 為 Gemini Enterprise 新增 Flexible Savings Plans(月支出承諾制,1 年期折 10%、3 年期折 20%,無上下限)、新的 pay-as-you-go 消費方案,以及即將推出的離峰批次處理(最高省 50% inference 成本),2026-08-26 生效。這不是像 OpenAI GPT-5.6 Sol 那樣調降標價,而是新增一整套帳單結構工具——對比 OpenAI 打的是標價戰,Google 打的是 FinOps 治理戰。

ai deep-dive 認識 AI 模型

LLM API 怎麼買最划算:直連、聚合、雲端三條路的實際價差

同一個模型透過不同管道存取,價差可以到 2-5 倍。直連最簡單、聚合器(OpenRouter)最靈活、雲端平台(Bedrock/Vertex)最適合企業。這篇用 2026 年 8 月實際價格做橫向比較,附選擇決策樹。

tech deep-dive AI 模型家族

MiniMax:聊天機器人公司做出的 Coding 模型,性價比碾壓閉源

MiniMax 從消費級聊天 App 起家,M2.5 在 SWE-bench Verified 拿 80.2% 但 API 價格只有 Claude Opus 的 1/10-1/20;M3(456B 總量 / 45.9B 啟用)是首個在 SWE-bench Pro 突破 59% 的開源權重模型,還有 1M context。

daily digest AI Pricing Watch

定價追蹤|OpenAI 親自出手,GPT-5.6 Sol 官方標準價砍 20-33%

OpenAI 官方將 GPT-5.6 Sol 標準費率從 $5.00/$30.00 降到 $4.00/$20.00(每百萬 tokens input/output,input ↓20%、output ↓33%),2026-08-21 生效,促銷期至少到 11/21。這是 OpenAI 自己動手降價,不是 OpenRouter/Cloudflare 那種平台促銷(見前篇),且兩者現在疊加——OpenRouter 的 50% 折扣已改套用在新的 $4/$20 基準價上,變成 $2.00/$10.00。

daily digest AI Pricing Watch

定價追蹤|GPT-5.6 Sol 雙平台打對折,OpenRouter 與 Cloudflare 同步降價至 9/18

GPT-5.6 Sol 標準費率透過 OpenRouter 與 Cloudflare AI Gateway 都從 $5.00/$30.00 降到 $2.50/$15.00(每百萬 tokens input/output,↓50%),Flex 最低到 $1.25/$7.50,促銷跑到 2026-09-18。折扣只適用兩平台的代管計費(Unified Billing/非 BYOK)流量,OpenAI 自家 API 直接叫用價格不變。

ai deep-dive

免費搜尋、爬取與瀏覽器 API 怎麼選:週期額度、限速、試用與自架成本

免費方案有每日或每月額度、餘額補回、持續限速與一次性試用;有些 API 沒有免費額度,必須預付或按量計費。

Amp:靠「砍功能」定義自己的 coding agent

Amp 已於 2025 年 12 月從 Sourcegraph 獨立為 Amp Frontier Corporation,npm 套件也從 @sourcegraph/amp 改為 @ampcode/cli。它的識別特徵是持續砍功能:editor 擴充、Amp Tab、TODO 清單、Fork、custom commands、public threads 全部刪掉。2026-07-18 才首度推出月費訂閱(Megawatt $20、Gigawatt $200),此前只有 pay-as-you-go。現在主軸是 orbs——關掉筆電也會繼續跑的遠端機器。

GitHub Copilot CLI:把 agent 開在 GitHub 這個平台上

Copilot CLI 於 2026-02-25 正式 GA,所有 Copilot 方案(含 Free)都包含。差異化不在 agent 本身,而在 GitHub 平台整合:內建 GitHub MCP server 直接操作 issue 與 PR、組織政策自動繼承、`&` 前綴把工作丟給雲端 coding agent。計費走 GitHub AI Credits(1 credit = $0.01),Pro $10/mo 含 $15、Pro+ $39 含 $70、Max $100 含 $200。

Cloudflare Workers AI 模型選型指南:依用途、價格與 context 挑模型

Workers AI 目錄目前 84 個模型。通用對話選 glm-4.7-flash($0.06 / $0.40 per M、131K context),要 vision 選 gemma-4-26b-a4b-it($0.10 / $0.30、256K),極省成本選 granite-4.0-h-micro($0.017 / $0.112),embedding 選 qwen3-embedding-0.6b 或 bge-m3(同為 $0.012 per M)。這篇會定期跟著官方目錄更新。

daily digest AI Pricing Watch

定價追蹤|Claude Sonnet 5 漲價喊卡,$2/$10 定價變永久

Claude Sonnet 5 原訂 9/1 從促銷價 $2/$10 漲回標準價 $3/$15,Anthropic 8/10 在官方定價頁面宣布這次調漲「不會發生」,$2/$10 變成永久定價。以每月 30 萬則客服對話的 workload 試算,等於避開了每月 $1,200(↓33%)的成本上升,也讓 Sonnet 5 從此永久比前代 Sonnet 4.6($3/$15)便宜。

CS146S Week 9:一個人接 MCP 沒問題,三百個人接就需要一座門

個人怎麼接工具是偏好問題,組織怎麼接是治理問題——誰能碰什麼資料、金鑰放哪、成本算誰的。Anthropic 自己公布的十個團隊使用紀錄裡有個好指標:安全工程團隊佔了整個 monorepo 自訂 slash command 的 50%。採用不是均勻擴散的,它先在會自己造工具的團隊裡起飛。

daily digest AI Pricing Watch

定價追蹤|DeepSeek V4 全面調漲,尖峰時段最高漲 1,100%

DeepSeek V4-Pro 尖峰 Output 從 $0.87 漲到 $3.96/1M tokens(↑355%),V4-Flash 從 $0.28 漲到 $1.32(↑371%),2026-08-16 16:00 UTC 生效,同時導入離峰半價機制(01:00-04:00、06:00-10:00 UTC 為尖峰)。漲價後價格仍低於 GPT-5.6/Claude,但低價護城河明顯收窄。

ai deep-dive

數位員工:可靠度來自 harness,不來自模型

「數位員工」不是技術,是計價與課責單位。Anthropic Project Vend 讓 Claude 真的開了三家店,發現最有效的介入不是換更強的模型,而是強迫走流程——官方原話是「我們重新發現了 bureaucracy matters」。Gartner 估計數千家自稱 agentic 的廠商中只約 130 家是真的。

product deep-dive

數位產品的價值驗證:從假設地圖到 AI 產品的 M3 留存基準

價值驗證的單位是假設不是點子。Kohavi 的資料顯示產業中位數只有 10% 的實驗會成功,這代表在 p<0.05 下約 22% 的「獲勝實驗」其實是假陽性;Sean Ellis 的 40% 門檻查不到任何公開資料集;AI 產品的留存要從 M3 而非 M0 起算,且 <$50/mo 的 GRR 只有 23%、>$250/mo 有 70%。

ai deep-dive

2026 年 LLM Inference 服務商免費額度與定價:40+ 家分梯整理

個人專案、玩具 demo、做 RAG 原型,不想第一步就掏卡。整理 2026/05 還在運作的 40+ 家 LLM inference 服務商,按免費資源「是持續補充還是一次性」分梯,標註綁卡需求、模型清單、付費起價,數字全部從官方 pricing 頁驗證。中國原廠含智谱 GLM(永久免費)、豆包(每日 200 萬 tokens)、Kimi、百煉、Ollama 本地跑法一併收錄。

ai guide Agent CLI 選型指南

Claude Code 完整方案分析:終端 Agent 的深度推理之王

Claude Code 從 $20/mo Pro 到 $200/mo Max 20x,額度以 5 小時滾動視窗計算並疊加週上限,Claude 網頁/桌面/終端共用同一個池子。額度用完可選擇改走 API 費率的 usage credits 繼續做事,而不是硬停。

ai guide Agent CLI 選型指南

Cursor CLI 完整方案分析:從 IDE Agent 延伸到終端的全能選手

Cursor CLI 把 IDE 的 Agent 帶進終端,支援 interactive TUI 與 headless、Plan/Ask/Agent 三種模式、Cloud Handoff、CI/CD 整合。計費改為兩個獨立額度池:Cursor 自家模型(Grok 4.6/4.5、Composer 2.5)與第三方模型(Pro 含 $20、Pro+ $70、Ultra $400)。

ai guide Agent CLI 選型指南

Google 終端 Agent 方案分析:個人免費那條路已經沒了

Google 這條線的付費路徑對照:個人免費層與 Google AI Pro / Ultra 的 Gemini CLI 存取已於 2026/6/18 終止,個人只剩 Antigravity CLI 或自備付費 API key;企業授權與 Google Cloud 不受影響。零成本起步的選項已經換人。

ai guide Agent CLI 選型指南

Kiro (AWS) 完整方案分析:Spec-Driven 開發的 Agentic IDE

Kiro 分五層:Free 50 credits、Pro $20/1,000、Pro+ $40/2,000、Pro Max $100/5,000、Power $200/10,000,加購 credit 一律 $0.04。Auto 模式混合模型省成本(同一任務走 Sonnet 要 1.3 倍 credit),Spec-Driven 流程把 vibe coding 變成可追蹤的結構化開發。

ai guide Agent CLI 選型指南

OpenAI Codex 完整方案分析:ChatGPT 生態系的 Agent 整合

Codex 綁定 ChatGPT 訂閱(Free / Go $8 / Plus $20 / Pro 5x $100 / Pro 20x $200),2026/4/2 起計費改為按 token 計 credit。模型主線是 GPT-5.6 Sol / Terra / Luna;GPT-5.4 與 5.4 mini 將於 2026/8/31 在 ChatGPT 登入模式下退場。