top of page
DeepSeek V4.1-Flash 上線:官方定價不漲反降,V4-Pro 將被悄悄取代,帳單怎麼跟著變?
DeepSeek 已於 2026 年 9 月 10 日 04:00 UTC 正式推出新一代模型 V4.1-Flash,同步生效的新定價不是漲價,而是比一個月前才調整過的 V4-Flash 價格再往下降:輸出 token 便宜約 9%,快取未命中(cache-miss)輸入 token 便宜約 32%。更關鍵的是,DeepSeek 官方已經宣布從 9 月 14 日中午(北京時間)起,所有打到 deepseek-v4-pro 的請求都會自動轉送給 V4.1-Flash 處理,並且直接按 Flash 的價格計費——換句話說,就算你完全不改一行程式碼,帳單也會自動變便宜。這篇文章把新舊價格、架構為什麼能做到「更聰明還更便宜」,以及你現在該做的準備都拆給你看。 DeepSeek V4.1-Flash 到底是什麼?三個重點先記住 DeepSeek 官方公告將 V4.1-Flash 定位為「新架構家族中最小的模型」,同時具備原生視覺理解能力。三個對開發者最實際的重點:第一,模型名稱改為 deepseek-flash,舊的 deepseek-v4-flash 與
6天前讀畢需時 6 分鐘
SpaceXAI(原xAI)Grok 4.6 API 官方定價全解析:輸出價每M僅$6,比 Claude、GPT-6 便宜多少?
Grok 4.6 的 API 定價是短內容(低於20萬token)輸入每百萬token 2美元、輸出6美元,超過20萬token的長內容則整段請求改按輸入4美元、輸出12美元計費;如果你只看輸出token的價格,Grok 4.6 比 Claude Fable 5.1、GPT-6 Astra 便宜超過八成,是目前主流旗艦模型裡數一數二便宜的選擇。你可能也發現,現在查詢這些資料時,官方文件網域已經不叫「xAI」了——這背後是一筆規模兆元的併購案。這篇文章帶你把 Grok 4.6 的官方定價拆解清楚,並跟 Claude、GPT、Gemini 現有報價放在一起比較。 Grok 4.6 官方定價:短內容跟長內容差在哪 根據 SpaceXAI 官方文件(docs.x.ai/developers/pricing,最後更新於2026年9月7日),Grok 4.6 的計費採用「短內容/長內容」雙軌制,門檻設在20萬token: 短內容(prompt 低於20萬token):輸入 2.00 美元/百萬token、快取輸入 0.50 美元、輸出 6.00 美元 長內容
9月10日讀畢需時 7 分鐘
GLM-5.3、Kimi K3 官方定價曝光:除了 DeepSeek,這兩款中國大模型你也該認識
如果你對中國大模型的認識還停留在「DeepSeek 很便宜」,那你可能漏掉了兩個這半年陸續上線、定價同樣壓得很低的競爭者:Zhipu(智譜)旗下的 GLM-5.3,以及 Moonshot AI 的 Kimi K3。GLM-5.3 官方標準定價是每百萬 token 輸入 1.4 美元、輸出 4.4 美元,其中鎖定輕量任務的 GLM-5.3-Flash 目前還在五折優惠期,但優惠將在今天(2026 年 9 月 9 日,UTC+8 午夜 12 點)截止;Kimi K3 則是每百萬 token 輸入 3 美元、輸出 15 美元的旗艦模型,價格正好卡在 Claude Sonnet 5(2 美元/10 美元)與 Claude Opus 5(5 美元/25 美元)之間。這篇文章把兩家官方定價頁的數字攤開來給你看,並拆解 Kimi K3「開源」背後藏著的授權門檻。 GLM-5.3 是什麼?跟 GLM-5.2 差在哪 GLM-5.3 是智譜於 2026 年 8 月 14 日發布的新版本,官方公告開宗明義只用一句話定調:「Scaling post-training
9月9日讀畢需時 8 分鐘
Meta Muse Spark 1.3 上線:標準價不變,但用程式碼換 12~21 倍折扣的 Contributor Tier 划算嗎?
Meta 在 2026 年 9 月 2 日透過 Muse Code 與 Meta API 同步推出新一代程式碼與代理模型 Muse Spark 1.3。標準版 API 定價維持在每百萬 token 輸入 1.25 美元、輸出 4.25 美元,跟前一代 1.2 完全相同,沒有調漲也沒有調降;但如果你同意讓 Meta 把送進去的提示詞與模型輸出拿去改進未來產品,官方會用「Contributor Tier」把價格砍到輸入 0.10 美元、輸出 0.20 美元——輸入便宜 12.5 倍,輸出便宜超過 21 倍。這筆「用資料換折扣」的交易划不划算,答案取決於你要處理的是練習題等級的程式碼,還是客戶的正式專案。 Muse Spark 1.3 是什麼?跟上一版差在哪 Muse Spark 是 Meta 今年主打的程式碼與代理(agentic)模型系列,1.3 版於 9 月 2 日透過 Muse Code(Meta 自家程式碼工具)與 Meta API 同步開放。Meta 表示這一版在長時間執行的代理任務上有明顯進步:模型會在長對話中同時追蹤多條工作流、在遇到衝
9月8日讀畢需時 6 分鐘
GPT-6 Astra 正式上線:$10/$50 官方定價全解析,跟 Claude Fable 5.1、Gemini 3.8 Flash 該選誰?
GPT-6 Astra 是 OpenAI 於 2026 年 9 月 3 日發布的新一代旗艦模型,API 標準定價是每百萬輸入 token 10 美元、輸出 50 美元——比目前促銷中的 GPT-5.6 Sol(輸入 4 美元/輸出 20 美元)貴上一倍以上,但官方公布的多項跑分顯示它常常用更少的輸出 token 就完成同一件任務。它同時也是 OpenAI 第一個被自家「Preparedness Framework」列為「Critical(危急)」等級網路安全能力的模型。如果你正在評估要不要換模型、每月 API 帳單會不會失控,這篇用官方公佈的數字幫你算清楚。 GPT-6 Astra 是什麼?跟 GPT-5.6 Sol 差在哪裡 GPT-6 Astra(API 模型代號 gpt-6-astra)於 2026 年 9 月 3 日先開放給少數組織測試,官方表示未來幾天內會陸續開放給 ChatGPT Plus、Pro、Business、Enterprise 用戶,以及透過 OpenAI API、Microsoft Azure、AWS Bedrock 使用
9月7日讀畢需時 6 分鐘
Claude Fable 5.1 正式上線:定價沒漲,帳單卻可能省 25%~45%?一次搞懂新模型改了什麼
Claude Fable 5.1 是 Anthropic 於 2026 年 9 月 1 日推出的最新旗艦模型,接替 Claude Fable 5 成為官方目前最強、也最貴的模型。它的每百萬 token 牌價維持不變:輸入 10 美元、輸出 50 美元,但透過把「快取讀取」(cache read)費率大砍 75%,官方估計典型工作負載的整體成本可降低約 25%,高度倚賴 AI Agent、長時間自主作業的工作負載,省下的幅度最高可到約 45%。同時上線的還有僅限受邀對象使用的 Claude Mythos 5.1。如果你的團隊已經在用 Fable 5,這篇文章一次講清楚:定價實際上怎麼變、規格差在哪、升級要不要改程式碼,以及企業導入時該留意的新規定。 Claude Fable 5.1 是什麼?跟 Fable 5、Mythos 5.1 差在哪裡 根據 Anthropic 官方公告,Claude Fable 5.1 與 Claude Mythos 5.1 是「同一個模型,只是安全防護層級不同」。Fable 5.1 是一般開發者與企業都能使用的公開版本;M
9月3日讀畢需時 8 分鐘
AI Token 文章專區
整理 AI Token 入門、計算方式、費用理解、模型比較與平台採購等文章,幫助你更快找到適合自己的學習入口。
bottom of page
