top of page
DeepSeek V4.1-Flash 上線:官方定價不漲反降,V4-Pro 將被悄悄取代,帳單怎麼跟著變?
DeepSeek 已於 2026 年 9 月 10 日 04:00 UTC 正式推出新一代模型 V4.1-Flash,同步生效的新定價不是漲價,而是比一個月前才調整過的 V4-Flash 價格再往下降:輸出 token 便宜約 9%,快取未命中(cache-miss)輸入 token 便宜約 32%。更關鍵的是,DeepSeek 官方已經宣布從 9 月 14 日中午(北京時間)起,所有打到 deepseek-v4-pro 的請求都會自動轉送給 V4.1-Flash 處理,並且直接按 Flash 的價格計費——換句話說,就算你完全不改一行程式碼,帳單也會自動變便宜。這篇文章把新舊價格、架構為什麼能做到「更聰明還更便宜」,以及你現在該做的準備都拆給你看。 DeepSeek V4.1-Flash 到底是什麼?三個重點先記住 DeepSeek 官方公告將 V4.1-Flash 定位為「新架構家族中最小的模型」,同時具備原生視覺理解能力。三個對開發者最實際的重點:第一,模型名稱改為 deepseek-flash,舊的 deepseek-v4-flash 與
6天前讀畢需時 6 分鐘
SpaceXAI(原xAI)Grok 4.6 API 官方定價全解析:輸出價每M僅$6,比 Claude、GPT-6 便宜多少?
Grok 4.6 的 API 定價是短內容(低於20萬token)輸入每百萬token 2美元、輸出6美元,超過20萬token的長內容則整段請求改按輸入4美元、輸出12美元計費;如果你只看輸出token的價格,Grok 4.6 比 Claude Fable 5.1、GPT-6 Astra 便宜超過八成,是目前主流旗艦模型裡數一數二便宜的選擇。你可能也發現,現在查詢這些資料時,官方文件網域已經不叫「xAI」了——這背後是一筆規模兆元的併購案。這篇文章帶你把 Grok 4.6 的官方定價拆解清楚,並跟 Claude、GPT、Gemini 現有報價放在一起比較。 Grok 4.6 官方定價:短內容跟長內容差在哪 根據 SpaceXAI 官方文件(docs.x.ai/developers/pricing,最後更新於2026年9月7日),Grok 4.6 的計費採用「短內容/長內容」雙軌制,門檻設在20萬token: 短內容(prompt 低於20萬token):輸入 2.00 美元/百萬token、快取輸入 0.50 美元、輸出 6.00 美元 長內容
9月10日讀畢需時 7 分鐘
GLM-5.3、Kimi K3 官方定價曝光:除了 DeepSeek,這兩款中國大模型你也該認識
如果你對中國大模型的認識還停留在「DeepSeek 很便宜」,那你可能漏掉了兩個這半年陸續上線、定價同樣壓得很低的競爭者:Zhipu(智譜)旗下的 GLM-5.3,以及 Moonshot AI 的 Kimi K3。GLM-5.3 官方標準定價是每百萬 token 輸入 1.4 美元、輸出 4.4 美元,其中鎖定輕量任務的 GLM-5.3-Flash 目前還在五折優惠期,但優惠將在今天(2026 年 9 月 9 日,UTC+8 午夜 12 點)截止;Kimi K3 則是每百萬 token 輸入 3 美元、輸出 15 美元的旗艦模型,價格正好卡在 Claude Sonnet 5(2 美元/10 美元)與 Claude Opus 5(5 美元/25 美元)之間。這篇文章把兩家官方定價頁的數字攤開來給你看,並拆解 Kimi K3「開源」背後藏著的授權門檻。 GLM-5.3 是什麼?跟 GLM-5.2 差在哪 GLM-5.3 是智譜於 2026 年 8 月 14 日發布的新版本,官方公告開宗明義只用一句話定調:「Scaling post-training
9月9日讀畢需時 8 分鐘
GPT-6 Astra 正式上線:$10/$50 官方定價全解析,跟 Claude Fable 5.1、Gemini 3.8 Flash 該選誰?
GPT-6 Astra 是 OpenAI 於 2026 年 9 月 3 日發布的新一代旗艦模型,API 標準定價是每百萬輸入 token 10 美元、輸出 50 美元——比目前促銷中的 GPT-5.6 Sol(輸入 4 美元/輸出 20 美元)貴上一倍以上,但官方公布的多項跑分顯示它常常用更少的輸出 token 就完成同一件任務。它同時也是 OpenAI 第一個被自家「Preparedness Framework」列為「Critical(危急)」等級網路安全能力的模型。如果你正在評估要不要換模型、每月 API 帳單會不會失控,這篇用官方公佈的數字幫你算清楚。 GPT-6 Astra 是什麼?跟 GPT-5.6 Sol 差在哪裡 GPT-6 Astra(API 模型代號 gpt-6-astra)於 2026 年 9 月 3 日先開放給少數組織測試,官方表示未來幾天內會陸續開放給 ChatGPT Plus、Pro、Business、Enterprise 用戶,以及透過 OpenAI API、Microsoft Azure、AWS Bedrock 使用
9月7日讀畢需時 6 分鐘
Claude Fable 5.1 正式上線:定價沒漲,帳單卻可能省 25%~45%?一次搞懂新模型改了什麼
Claude Fable 5.1 是 Anthropic 於 2026 年 9 月 1 日推出的最新旗艦模型,接替 Claude Fable 5 成為官方目前最強、也最貴的模型。它的每百萬 token 牌價維持不變:輸入 10 美元、輸出 50 美元,但透過把「快取讀取」(cache read)費率大砍 75%,官方估計典型工作負載的整體成本可降低約 25%,高度倚賴 AI Agent、長時間自主作業的工作負載,省下的幅度最高可到約 45%。同時上線的還有僅限受邀對象使用的 Claude Mythos 5.1。如果你的團隊已經在用 Fable 5,這篇文章一次講清楚:定價實際上怎麼變、規格差在哪、升級要不要改程式碼,以及企業導入時該留意的新規定。 Claude Fable 5.1 是什麼?跟 Fable 5、Mythos 5.1 差在哪裡 根據 Anthropic 官方公告,Claude Fable 5.1 與 Claude Mythos 5.1 是「同一個模型,只是安全防護層級不同」。Fable 5.1 是一般開發者與企業都能使用的公開版本;M
9月3日讀畢需時 8 分鐘
DeepSeek API 漲價全解析:尖峰時段最高漲逾11倍,為什麼台灣開發者比歐美更有感?
DeepSeek 從 2026 年 8 月 16 日 16:00 UTC 起,把 V4-Flash 與 V4-Pro 的計費方式從單一固定費率,改成「尖峰/離峰」兩段式收費:一般輸出 token 在尖峰時段漲了 1.3 倍到 3.7 倍,快取命中(cache-hit)輸入 token 在部分級距漲幅更超過 11 倍。關鍵是,DeepSeek 定義的尖峰時段是北京時間上午 9 點到中午、下午 2 點到 6 點——而台灣跟北京用的是同一個時區(UTC+8)。也就是說,美國開發者的正常上班時間大多落在 DeepSeek 的離峰區,但台灣開發者的正常上班時間,剛好就是 DeepSeek 的尖峰區。這篇文章把新舊價格、漲價原因,以及跟 GPT-5.6、Claude 的比較都拆給你看。 DeepSeek 這次到底漲了多少?V4-Flash、V4-Pro 新舊價格全對照 新制上線前,V4-Flash 與 V4-Pro 都是單一固定費率;上線後拆成尖峰、離峰兩級,離峰價格正好是尖峰的一半: V4-Flash:輸出 token 從原本固定 0.28 美元/百萬 t
8月27日讀畢需時 7 分鐘
AI Token 文章專區
整理 AI Token 入門、計算方式、費用理解、模型比較與平台採購等文章,幫助你更快找到適合自己的學習入口。
bottom of page
