top of page
DeepSeek V4.1-Flash 上線:官方定價不漲反降,V4-Pro 將被悄悄取代,帳單怎麼跟著變?
DeepSeek 已於 2026 年 9 月 10 日 04:00 UTC 正式推出新一代模型 V4.1-Flash,同步生效的新定價不是漲價,而是比一個月前才調整過的 V4-Flash 價格再往下降:輸出 token 便宜約 9%,快取未命中(cache-miss)輸入 token 便宜約 32%。更關鍵的是,DeepSeek 官方已經宣布從 9 月 14 日中午(北京時間)起,所有打到 deepseek-v4-pro 的請求都會自動轉送給 V4.1-Flash 處理,並且直接按 Flash 的價格計費——換句話說,就算你完全不改一行程式碼,帳單也會自動變便宜。這篇文章把新舊價格、架構為什麼能做到「更聰明還更便宜」,以及你現在該做的準備都拆給你看。 DeepSeek V4.1-Flash 到底是什麼?三個重點先記住 DeepSeek 官方公告將 V4.1-Flash 定位為「新架構家族中最小的模型」,同時具備原生視覺理解能力。三個對開發者最實際的重點:第一,模型名稱改為 deepseek-flash,舊的 deepseek-v4-flash 與
6天前讀畢需時 6 分鐘
SpaceXAI(原xAI)Grok 4.6 API 官方定價全解析:輸出價每M僅$6,比 Claude、GPT-6 便宜多少?
Grok 4.6 的 API 定價是短內容(低於20萬token)輸入每百萬token 2美元、輸出6美元,超過20萬token的長內容則整段請求改按輸入4美元、輸出12美元計費;如果你只看輸出token的價格,Grok 4.6 比 Claude Fable 5.1、GPT-6 Astra 便宜超過八成,是目前主流旗艦模型裡數一數二便宜的選擇。你可能也發現,現在查詢這些資料時,官方文件網域已經不叫「xAI」了——這背後是一筆規模兆元的併購案。這篇文章帶你把 Grok 4.6 的官方定價拆解清楚,並跟 Claude、GPT、Gemini 現有報價放在一起比較。 Grok 4.6 官方定價:短內容跟長內容差在哪 根據 SpaceXAI 官方文件(docs.x.ai/developers/pricing,最後更新於2026年9月7日),Grok 4.6 的計費採用「短內容/長內容」雙軌制,門檻設在20萬token: 短內容(prompt 低於20萬token):輸入 2.00 美元/百萬token、快取輸入 0.50 美元、輸出 6.00 美元 長內容
9月10日讀畢需時 7 分鐘
MCP 為什麼改成無狀態?2026-07-28 規格逐項拆解,以及它和 A2A 的分工
Model Context Protocol(MCP)在 2026 年 7 月 28 日發布的規格版本,做了一件範圍很大的事:把整個協定改成無狀態。initialize 握手被移除,協定層的 session 與 Mcp-Session-Id 標頭一起被拿掉,每一個請求從此自我完備、彼此獨立。 這不是一次相容性修補,是協定核心的置換。官方版本頁把 2026-07-28 標為目前的 current,並註明帶握手的舊版是 2025-11-25 以前的版本。本文逐項整理這一版改了什麼、代價落在哪裡,以及它在整個 Agent 協定版圖(含 A2A)裡的位置。 規格細節我們已回查 MCP 官方的 Versioning 與 2026-07-28 Key Changes 兩頁核對;實務觀察與踩坑經驗來自六支公開技術影片,出處與證據強度見文末。 一、被移除的是什麼:兩個提案,一個結構性改變 官方 changelog 的兩項主要變更如下: SEP-2575:移除 initialize / notifications/initialized 握手。協定版本與客戶端能力
9月9日讀畢需時 9 分鐘
GLM-5.3、Kimi K3 官方定價曝光:除了 DeepSeek,這兩款中國大模型你也該認識
如果你對中國大模型的認識還停留在「DeepSeek 很便宜」,那你可能漏掉了兩個這半年陸續上線、定價同樣壓得很低的競爭者:Zhipu(智譜)旗下的 GLM-5.3,以及 Moonshot AI 的 Kimi K3。GLM-5.3 官方標準定價是每百萬 token 輸入 1.4 美元、輸出 4.4 美元,其中鎖定輕量任務的 GLM-5.3-Flash 目前還在五折優惠期,但優惠將在今天(2026 年 9 月 9 日,UTC+8 午夜 12 點)截止;Kimi K3 則是每百萬 token 輸入 3 美元、輸出 15 美元的旗艦模型,價格正好卡在 Claude Sonnet 5(2 美元/10 美元)與 Claude Opus 5(5 美元/25 美元)之間。這篇文章把兩家官方定價頁的數字攤開來給你看,並拆解 Kimi K3「開源」背後藏著的授權門檻。 GLM-5.3 是什麼?跟 GLM-5.2 差在哪 GLM-5.3 是智譜於 2026 年 8 月 14 日發布的新版本,官方公告開宗明義只用一句話定調:「Scaling post-training
9月9日讀畢需時 8 分鐘
Meta Muse Spark 1.3 上線:標準價不變,但用程式碼換 12~21 倍折扣的 Contributor Tier 划算嗎?
Meta 在 2026 年 9 月 2 日透過 Muse Code 與 Meta API 同步推出新一代程式碼與代理模型 Muse Spark 1.3。標準版 API 定價維持在每百萬 token 輸入 1.25 美元、輸出 4.25 美元,跟前一代 1.2 完全相同,沒有調漲也沒有調降;但如果你同意讓 Meta 把送進去的提示詞與模型輸出拿去改進未來產品,官方會用「Contributor Tier」把價格砍到輸入 0.10 美元、輸出 0.20 美元——輸入便宜 12.5 倍,輸出便宜超過 21 倍。這筆「用資料換折扣」的交易划不划算,答案取決於你要處理的是練習題等級的程式碼,還是客戶的正式專案。 Muse Spark 1.3 是什麼?跟上一版差在哪 Muse Spark 是 Meta 今年主打的程式碼與代理(agentic)模型系列,1.3 版於 9 月 2 日透過 Muse Code(Meta 自家程式碼工具)與 Meta API 同步開放。Meta 表示這一版在長時間執行的代理任務上有明顯進步:模型會在長對話中同時追蹤多條工作流、在遇到衝
9月8日讀畢需時 6 分鐘
金融業導入 Agentic AI:為什麼治理速度跟不上部署速度?從四位真實高管的座談看落差
在一場由印度財經媒體 Mint 主持的座談節目中,來自 Salesforce、Mirae Asset Investment Managers、Godrej Capital、Nivara Housing Finance 四家金融與科技公司的高管一致點出一個問題:金融業導入 Agentic AI 目前卡住的地方,不是「AI 好不好用」,而是「治理跟不上部署的速度」。 Godrej Capital 的 CTO Jyotirlata B 在座談中直言,企業目前普遍缺乏成熟的 GRC(治理、風險、合規)框架去回答一個具體問題:AI Agent 在跟客戶對話、幫忙核貸的過程中,到底洩漏了什麼資料、給出的答案是否真的符合公司政策與法規?這篇文章整理這場座談裡三個真實的金融業 Agentic AI 導入案例,以及這幾位高管自己攤開來講的治理缺口,談的不是「AI 趨勢展望」,而是幾家真的已經在用 Agentic AI 處理核貸、投資與客戶服務的公司,正在面對什麼問題。 這場座談在談什麼:一群真的在部署 Agentic AI 的金融業高管 這場座談由 Mint 旗下
9月7日讀畢需時 10 分鐘
AI Token 文章專區
整理 AI Token 入門、計算方式、費用理解、模型比較與平台採購等文章,幫助你更快找到適合自己的學習入口。
bottom of page
