top of page

DeepSeek V4.1-Flash 上線:官方定價不漲反降,V4-Pro 將被悄悄取代,帳單怎麼跟著變?

6天前
讀畢需時 6 分鐘

DeepSeek 已於 2026 年 9 月 10 日 04:00 UTC 正式推出新一代模型 V4.1-Flash,同步生效的新定價不是漲價,而是比一個月前才調整過的 V4-Flash 價格再往下降:輸出 token 便宜約 9%,快取未命中(cache-miss)輸入 token 便宜約 32%。更關鍵的是,DeepSeek 官方已經宣布從 9 月 14 日中午(北京時間)起,所有打到 deepseek-v4-pro 的請求都會自動轉送給 V4.1-Flash 處理,並且直接按 Flash 的價格計費——換句話說,就算你完全不改一行程式碼,帳單也會自動變便宜。這篇文章把新舊價格、架構為什麼能做到「更聰明還更便宜」,以及你現在該做的準備都拆給你看。

DeepSeek V4.1-Flash 到底是什麼?三個重點先記住

DeepSeek 官方公告將 V4.1-Flash 定位為「新架構家族中最小的模型」,同時具備原生視覺理解能力。三個對開發者最實際的重點:第一,模型名稱改為 deepseek-flash,舊的 deepseek-v4-flash 與 deepseek-v4-flash-vision-exp 兩個名稱仍可呼叫,但會自動轉送到 V4.1-Flash 並按新價計費,等於原本的 V4-Flash 與視覺實驗版已經正式退役。第二,官方測試顯示 V4.1-Flash 在效能、成本、速度與總執行時間上全面超越 V4-Pro,因此 DeepSeek 已宣布要有秩序地淘汰 V4-Pro。第三,新模型支援 100 萬 token 上下文、最大輸出 384K token,併發限制達 2,500(V4-Pro 只有 500),對高併發的正式環境是明顯升級。

新舊定價全對照:這次是降價,不是漲價

以下數字全部來自 DeepSeek 官方定價頁(api-docs.deepseek.com/quick_start/pricing),單位為每百萬 token:

  • 輸出 token:V4.1-Flash 尖峰 1.2 美元、離峰 0.6 美元。相較於本站 8 月 27 日文章查證的 V4-Flash 舊價(尖峰 1.32 美元、離峰 0.66 美元),降幅約 9%。

  • 快取未命中(cache-miss)輸入 token:V4.1-Flash 尖峰 0.3 美元、離峰 0.15 美元,相較舊價(尖峰 0.44 美元、離峰 0.22 美元)降幅約 32%。

  • 快取命中(cache-hit)輸入 token:V4.1-Flash 尖峰 0.006 美元、離峰 0.003 美元。官方 8 月調整當時只附了價目圖片、未提供這個級距在 V4-Flash 舊制下的精確文字數字,本文因此不對這一項做新舊比較,僅呈現目前官方現行價。

尖峰/離峰制度本身沒有取消:官方尖峰時段仍是週一到週五 UTC 01:00–04:00 與 06:00–10:00(換算台灣/北京時間為上午 9 點到中午、下午 2 點到 6 點),離峰價維持尖峰價的一半。新價格從 2026 年 9 月 10 日 04:00 UTC 起生效。

V4-Pro 會被悄悄取代:時間表跟你該做的準備

這是本次公告裡對既有 V4-Pro 用戶影響最大的一段。DeepSeek 官方明確寫道:從 2026 年 9 月 14 日 12:00(北京時間)起,直到未來 V4.1-Pro 推出為止,所有呼叫 deepseek-v4-pro 的請求都會被路由到 V4.1-Flash,並且按 V4.1-Flash 的價格計費。也就是說 9 月 14 日之後,V4-Pro 目前尖峰 3.96 美元、離峰 1.98 美元的輸出報價會被 V4.1-Flash 的尖峰 1.2 美元、離峰 0.6 美元取代——對還停留在 deepseek-v4-pro 這個模型名稱、沒有主動遷移的專案來說,這是一次不需要改程式碼就會發生的大降價,但也代表你實際呼叫到的模型能力與行為,會從現在的 V4-Pro 換成 V4.1-Flash,建議提前用你自己的測試集跑一輪回歸測試,確認輸出品質符合預期。

為什麼架構改了,價格反而更低?

官方技術說明指出,V4.1-Flash 採用新的「Causal Encoder-Decoder」非對稱架構:模型總參數量約 5,520 億(MoE),但輸入端只啟用約 80 億活躍參數、輸出端約 160 億活躍參數,用更小的啟用參數量做更多事。另一個關鍵是 KV 快取大幅壓縮:官方數字顯示新架構的 KV 快取只需要前一代的四分之一 HBM 顯存與八分之一 SSD 儲存空間。由於快取命中的計費在許多重度使用 prompt caching 的應用(例如客服機器人、長文件 RAG)裡經常占總成本的大宗,快取本身變小,等於從底層成本結構上就替官方省下一筆,這也是官方公告裡把「更聰明」與「更便宜」放在同一句話裡的原因。

放進全球定價地圖:DeepSeek 現在站在哪裡

把幾家主要供應商目前的官方輸出 token 報價(每百萬 token)放在一起看:GPT-5.6 Luna 0.2 美元最低,DeepSeek V4.1-Flash 尖峰 1.2 美元/離峰 0.6 美元,GPT-5.6 Terra 2 美元、Claude Sonnet 5 2 美元輸入對應 10 美元輸出,GPT-5.6 Sol 促銷價 4 美元輸入對應 20 美元輸出,Claude Opus 5 5 美元輸入對應 25 美元輸出,GPT-6 Astra 與 Claude Fable 5.1 皆是 10 美元輸入對應 50 美元輸出的旗艦價位。V4.1-Flash 離峰輸出價(0.6 美元)已經逼近 GPT-5.6 Terra 與 Claude Sonnet 5 這類主流中階模型的十分之一以下水準;就算是尖峰時段(1.2 美元),也仍明顯低於 Terra、Sonnet 5。但要提醒的是,這裡比的是官方公開計費規則,不代表任務品質或推理能力也在同一個排名上,實際導入前仍建議用自己的任務跑基準測試。

給台灣企業與開發者的具體建議

如果你目前用的是 deepseek-v4-flash 或 deepseek-v4-flash-vision-exp 這兩個舊名稱,不需要做任何事,系統會自動導向新模型並套用新的(更低的)價格。如果你用的是 deepseek-v4-pro,建議在 9 月 14 日前先用測試環境試跑 V4.1-Flash,確認輸出品質與延遲符合你的應用需求,因為屆時你的正式流量會被自動轉接過去。如果你的應用大量依賴 context caching,新架構的 KV 快取壓縮理論上對你更有利,值得重新估算一次月度帳單。最後,尖峰/離峰制度沒有取消,台灣與北京同屬 UTC+8 時區,如果你的服務在台灣正常上班時間(上午 9 點到中午、下午 2 點到 6 點)大量呼叫 API,仍然會落在官方定義的尖峰區間,可評估把非即時任務排到離峰時段執行。

常見問題

V4.1-Flash 是漲價還是降價?

是降價。相較本站 8 月 27 日文章查證的 V4-Flash 舊價,輸出 token 降幅約 9%,快取未命中輸入 token 降幅約 32%,新價自 2026 年 9 月 10 日 04:00 UTC 生效。

我還在用 deepseek-v4-flash 這個模型名稱,會發生什麼事?

deepseek-v4-flash 與 deepseek-v4-flash-vision-exp 兩個名稱目前仍可呼叫,但官方已將對應模型退役,請求會自動路由到 V4.1-Flash,並按 V4.1-Flash 的新價計費,你不需要修改程式碼。

deepseek-v4-pro 之後會消失嗎?

官方目前的說法是「有秩序地淘汰」,並宣布從 2026 年 9 月 14 日 12:00 北京時間起,deepseek-v4-pro 的請求會轉送給 V4.1-Flash 並按 V4.1-Flash 價格計費,直到官方推出 V4.1-Pro 為止。這不代表 V4-Pro 模型本身立刻下架,但實際計費與服務行為會換成 V4.1-Flash。

尖峰、離峰時段這次有改變嗎?

沒有。官方尖峰時段仍是週一到週五 UTC 01:00–04:00 與 06:00–10:00(台灣/北京時間上午 9 點到中午、下午 2 點到 6 點),離峰價維持尖峰價的一半,這個制度是 2026 年 8 月調整時建立的,這次只調整了絕對價格,沒有調整時段規則。

V4.1-Flash 比 Claude、GPT 便宜多少?

以離峰輸出價計算,V4.1-Flash 的 0.6 美元/百萬 token 明顯低於 Claude Sonnet 5、GPT-5.6 Terra 的 10~12 美元輸出報價;但價格比較不等於任務品質比較,實際選型仍建議搭配自己的任務跑基準測試。

資料來源聲明

本文內容於 2026 年 9 月 11 日查證下列官方頁面:DeepSeek 官方公告《DeepSeek-V4.1-Flash: Smarter, Faster, More Efficient》(api-docs.deepseek.com/news/news260910)、DeepSeek 官方《Models & Pricing》定價頁 (api-docs.deepseek.com/quick_start/pricing)、DeepSeek 官方 Change Log (api-docs.deepseek.com/updates)。V4-Flash 舊制定價(8 月 16 日生效)數字沿用本站 2026 年 8 月 27 日文章當時對同一份官方定價頁的查證結果。跨廠比較數字分別查證自 Anthropic 官方定價頁 platform.claude.com/docs/en/about-claude/pricing(2026-09-11 直接擷取,確認 Sonnet 5/Opus 5/Fable 5.1/Haiku 4.5 現行報價與 09-01 調漲取消維持現價)與 OpenAI 官方文件 developers.openai.com/api/docs/pricing 及 developers.openai.com/api/docs/models/gpt-6-astra(透過官方頁面摘要確認 GPT-5.6 Sol/Terra/Luna 與 GPT-6 Astra 現行報價)。

延伸閱讀

想更有系統地掌握每次模型定價異動對你團隊的實際帳單影響嗎?立即免費試用 AITokenKing,讓工具幫你即時追蹤跨供應商的 Token 成本。

最新文章

查看全部
SpaceXAI(原xAI)Grok 4.6 API 官方定價全解析:輸出價每M僅$6,比 Claude、GPT-6 便宜多少?

Grok 4.6 的 API 定價是短內容(低於20萬token)輸入每百萬token 2美元、輸出6美元,超過20萬token的長內容則整段請求改按輸入4美元、輸出12美元計費;如果你只看輸出token的價格,Grok 4.6 比 Claude Fable 5.1、GPT-6 Astra 便宜超過八成,是目前主流旗艦模型裡數一數二便宜的選擇。你可能也發現,現在查詢這些資料時,官方文件網域已經不叫

 
 
 
GLM-5.3、Kimi K3 官方定價曝光:除了 DeepSeek,這兩款中國大模型你也該認識

如果你對中國大模型的認識還停留在「DeepSeek 很便宜」,那你可能漏掉了兩個這半年陸續上線、定價同樣壓得很低的競爭者:Zhipu(智譜)旗下的 GLM-5.3,以及 Moonshot AI 的 Kimi K3。GLM-5.3 官方標準定價是每百萬 token 輸入 1.4 美元、輸出 4.4 美元,其中鎖定輕量任務的 GLM-5.3-Flash 目前還在五折優惠期,但優惠將在今天(2026 年

 
 
 
Meta Muse Spark 1.3 上線:標準價不變,但用程式碼換 12~21 倍折扣的 Contributor Tier 划算嗎?

Meta 在 2026 年 9 月 2 日透過 Muse Code 與 Meta API 同步推出新一代程式碼與代理模型 Muse Spark 1.3。標準版 API 定價維持在每百萬 token 輸入 1.25 美元、輸出 4.25 美元,跟前一代 1.2 完全相同,沒有調漲也沒有調降;但如果你同意讓 Meta 把送進去的提示詞與模型輸出拿去改進未來產品,官方會用「Contributor Tie

 
 
 

留言


bottom of page