DeepSeek V4.1-Flash 上線:官方定價不漲反降,V4-Pro 將被悄悄取代,帳單怎麼跟著變?
DeepSeek 已於 2026 年 9 月 10 日 04:00 UTC 正式推出新一代模型 V4.1-Flash,同步生效的新定價不是漲價,而是比一個月前才調整過的 V4-Flash 價格再往下降:輸出 token 便宜約 9%,快取未命中(cache-miss)輸入 token 便宜約 32%。更關鍵的是,DeepSeek 官方已經宣布從 9 月 14 日中午(北京時間)起,所有打到 deepseek-v4-pro 的請求都會自動轉送給 V4.1-Flash 處理,並且直接按 Flash 的價格計費——換句話說,就算你完全不改一行程式碼,帳單也會自動變便宜。這篇文章把新舊價格、架構為什麼能做到「更聰明還更便宜」,以及你現在該做的準備都拆給你看。
DeepSeek V4.1-Flash 到底是什麼?三個重點先記住
DeepSeek 官方公告將 V4.1-Flash 定位為「新架構家族中最小的模型」,同時具備原生視覺理解能力。三個對開發者最實際的重點:第一,模型名稱改為 deepseek-flash,舊的 deepseek-v4-flash 與 deepseek-v4-flash-vision-exp 兩個名稱仍可呼叫,但會自動轉送到 V4.1-Flash 並按新價計費,等於原本的 V4-Flash 與視覺實驗版已經正式退役。第二,官方測試顯示 V4.1-Flash 在效能、成本、速度與總執行時間上全面超越 V4-Pro,因此 DeepSeek 已宣布要有秩序地淘汰 V4-Pro。第三,新模型支援 100 萬 token 上下文、最大輸出 384K token,併發限制達 2,500(V4-Pro 只有 500),對高併發的正式環境是明顯升級。
新舊定價全對照:這次是降價,不是漲價
以下數字全部來自 DeepSeek 官方定價頁(api-docs.deepseek.com/quick_start/pricing),單位為每百萬 token:
輸出 token:V4.1-Flash 尖峰 1.2 美元、離峰 0.6 美元。相較於本站 8 月 27 日文章查證的 V4-Flash 舊價(尖峰 1.32 美元、離峰 0.66 美元),降幅約 9%。
快取未命中(cache-miss)輸入 token:V4.1-Flash 尖峰 0.3 美元、離峰 0.15 美元,相較舊價(尖峰 0.44 美元、離峰 0.22 美元)降幅約 32%。
快取命中(cache-hit)輸入 token:V4.1-Flash 尖峰 0.006 美元、離峰 0.003 美元。官方 8 月調整當時只附了價目圖片、未提供這個級距在 V4-Flash 舊制下的精確文字數字,本文因此不對這一項做新舊比較,僅呈現目前官方現行價。
尖峰/離峰制度本身沒有取消:官方尖峰時段仍是週一到週五 UTC 01:00–04:00 與 06:00–10:00(換算台灣/北京時間為上午 9 點到中午、下午 2 點到 6 點),離峰價維持尖峰價的一半。新價格從 2026 年 9 月 10 日 04:00 UTC 起生效。
V4-Pro 會被悄悄取代:時間表跟你該做的準備
這是本次公告裡對既有 V4-Pro 用戶影響最大的一段。DeepSeek 官方明確寫道:從 2026 年 9 月 14 日 12:00(北京時間)起,直到未來 V4.1-Pro 推出為止,所有呼叫 deepseek-v4-pro 的請求都會被路由到 V4.1-Flash,並且按 V4.1-Flash 的價格計費。也就是說 9 月 14 日之後,V4-Pro 目前尖峰 3.96 美元、離峰 1.98 美元的輸出報價會被 V4.1-Flash 的尖峰 1.2 美元、離峰 0.6 美元取代——對還停留在 deepseek-v4-pro 這個模型名稱、沒有主動遷移的專案來說,這是一次不需要改程式碼就會發生的大降價,但也代表你實際呼叫到的模型能力與行為,會從現在的 V4-Pro 換成 V4.1-Flash,建議提前用你自己的測試集跑一輪回歸測試,確認輸出品質符合預期。
為什麼架構改了,價格反而更低?
官方技術說明指出,V4.1-Flash 採用新的「Causal Encoder-Decoder」非對稱架構:模型總參數量約 5,520 億(MoE),但輸入端只啟用約 80 億活躍參數、輸出端約 160 億活躍參數,用更小的啟用參數量做更多事。另一個關鍵是 KV 快取大幅壓縮:官方數字顯示新架構的 KV 快取只需要前一代的四分之一 HBM 顯存與八分之一 SSD 儲存空間。由於快取命中的計費在許多重度使用 prompt caching 的應用(例如客服機器人、長文件 RAG)裡經常占總成本的大宗,快取本身變小,等於從底層成本結構上就替官方省下一筆,這也是官方公告裡把「更聰明」與「更便宜」放在同一句話裡的原因。
放進全球定價地圖:DeepSeek 現在站在哪裡
把幾家主要供應商目前的官方輸出 token 報價(每百萬 token)放在一起看:GPT-5.6 Luna 0.2 美元最低,DeepSeek V4.1-Flash 尖峰 1.2 美元/離峰 0.6 美元,GPT-5.6 Terra 2 美元、Claude Sonnet 5 2 美元輸入對應 10 美元輸出,GPT-5.6 Sol 促銷價 4 美元輸入對應 20 美元輸出,Claude Opus 5 5 美元輸入對應 25 美元輸出,GPT-6 Astra 與 Claude Fable 5.1 皆是 10 美元輸入對應 50 美元輸出的旗艦價位。V4.1-Flash 離峰輸出價(0.6 美元)已經逼近 GPT-5.6 Terra 與 Claude Sonnet 5 這類主流中階模型的十分之一以下水準;就算是尖峰時段(1.2 美元),也仍明顯低於 Terra、Sonnet 5。但要提醒的是,這裡比的是官方公開計費規則,不代表任務品質或推理能力也在同一個排名上,實際導入前仍建議用自己的任務跑基準測試。
給台灣企業與開發者的具體建議
如果你目前用的是 deepseek-v4-flash 或 deepseek-v4-flash-vision-exp 這兩個舊名稱,不需要做任何事,系統會自動導向新模型並套用新的(更低的)價格。如果你用的是 deepseek-v4-pro,建議在 9 月 14 日前先用測試環境試跑 V4.1-Flash,確認輸出品質與延遲符合你的應用需求,因為屆時你的正式流量會被自動轉接過去。如果你的應用大量依賴 context caching,新架構的 KV 快取壓縮理論上對你更有利,值得重新估算一次月度帳單。最後,尖峰/離峰制度沒有取消,台灣與北京同屬 UTC+8 時區,如果你的服務在台灣正常上班時間(上午 9 點到中午、下午 2 點到 6 點)大量呼叫 API,仍然會落在官方定義的尖峰區間,可評估把非即時任務排到離峰時段執行。
常見問題
V4.1-Flash 是漲價還是降價?
是降價。相較本站 8 月 27 日文章查證的 V4-Flash 舊價,輸出 token 降幅約 9%,快取未命中輸入 token 降幅約 32%,新價自 2026 年 9 月 10 日 04:00 UTC 生效。
我還在用 deepseek-v4-flash 這個模型名稱,會發生什麼事?
deepseek-v4-flash 與 deepseek-v4-flash-vision-exp 兩個名稱目前仍可呼叫,但官方已將對應模型退役,請求會自動路由到 V4.1-Flash,並按 V4.1-Flash 的新價計費,你不需要修改程式碼。
deepseek-v4-pro 之後會消失嗎?
官方目前的說法是「有秩序地淘汰」,並宣布從 2026 年 9 月 14 日 12:00 北京時間起,deepseek-v4-pro 的請求會轉送給 V4.1-Flash 並按 V4.1-Flash 價格計費,直到官方推出 V4.1-Pro 為止。這不代表 V4-Pro 模型本身立刻下架,但實際計費與服務行為會換成 V4.1-Flash。
尖峰、離峰時段這次有改變嗎?
沒有。官方尖峰時段仍是週一到週五 UTC 01:00–04:00 與 06:00–10:00(台灣/北京時間上午 9 點到中午、下午 2 點到 6 點),離峰價維持尖峰價的一半,這個制度是 2026 年 8 月調整時建立的,這次只調整了絕對價格,沒有調整時段規則。
V4.1-Flash 比 Claude、GPT 便宜多少?
以離峰輸出價計算,V4.1-Flash 的 0.6 美元/百萬 token 明顯低於 Claude Sonnet 5、GPT-5.6 Terra 的 10~12 美元輸出報價;但價格比較不等於任務品質比較,實際選型仍建議搭配自己的任務跑基準測試。
資料來源聲明
本文內容於 2026 年 9 月 11 日查證下列官方頁面:DeepSeek 官方公告《DeepSeek-V4.1-Flash: Smarter, Faster, More Efficient》(api-docs.deepseek.com/news/news260910)、DeepSeek 官方《Models & Pricing》定價頁 (api-docs.deepseek.com/quick_start/pricing)、DeepSeek 官方 Change Log (api-docs.deepseek.com/updates)。V4-Flash 舊制定價(8 月 16 日生效)數字沿用本站 2026 年 8 月 27 日文章當時對同一份官方定價頁的查證結果。跨廠比較數字分別查證自 Anthropic 官方定價頁 platform.claude.com/docs/en/about-claude/pricing(2026-09-11 直接擷取,確認 Sonnet 5/Opus 5/Fable 5.1/Haiku 4.5 現行報價與 09-01 調漲取消維持現價)與 OpenAI 官方文件 developers.openai.com/api/docs/pricing 及 developers.openai.com/api/docs/models/gpt-6-astra(透過官方頁面摘要確認 GPT-5.6 Sol/Terra/Luna 與 GPT-6 Astra 現行報價)。
延伸閱讀
想更有系統地掌握每次模型定價異動對你團隊的實際帳單影響嗎?立即免費試用 AITokenKing,讓工具幫你即時追蹤跨供應商的 Token 成本。

留言