曾以「極致性價比」打破市場格局的 AI 新星 DeepSeek,早前因大幅調漲 API 調用費用而引發社群強烈反彈,更傳出嚇退無數個人開發者與企業用戶、導致算力需求流失。在遭遇市場冷遇的現實下,DeepSeek 近日終於吹起「救亡」號角,釋出最新定價調整通知,宣布針對旗下的 Flash 系列展開局部降價,試圖以「最高下殺 60%」的宣傳挽回流失的用戶信心。

根據最新公布的方案,DeepSeek 將於北京時間 9 月 10 日 12:00 起實施新的 Flash 系列 API 定價。本次降價主要集中在非尖峰時段(Off-peak):

快取命中輸入(Cache Hit Input):由 0.05 元下調至 0.02 元(每百萬 Token/人民幣),降幅達 60%

快取未命中輸入(Cache Miss Input):由 1.5 元降至 1 元,降幅約 33%

輸出價格(Output):由 4.5 元微調至 4 元,降幅僅約 11%

至於尖峰時段(Peak hours),仍維持離峰費率的「翻倍計費」,即快取命中 0.04 元、未命中輸入 2 元、輸出 8 元。

分析觀察: 業界普遍認為,這場看似聲勢浩大的「救亡」降價其實暗藏玄機。宣傳中所主打的「最高降 60%」,僅限於單價本就極低的快取命中(Cache Hit)部分;然而在實際調用中佔據開發者大部分帳單開銷的「輸出 Token」,僅僅下修了 11%。換言之,用戶是否真能感到「回血」,完全取決於自身應用的 Prompt 快取率與輸入輸出比例,被不少開發者直指是「表面誠意滿滿、實際精打細算」的挽救手段。

為了配合這波挽救行動、重塑「性價比之王」的招牌,DeepSeek 同步釋出了最新模型 DeepSeek V4.1-Flash 的基準測試圖表:

編程測試勝出:在 DeepSWE v1.1 與 mini-SWE 軟體工程評測環境下,V4.1-Flash 在最高配置下拿下了 75.1% 的 Pass@1 準確率,些微領先同榜對標的 GPT-6 Astra 與 Claude Opus 5。

調用成本壓低:根據圖表估算,其平均每次任務嘗試(task attempt)的成本被壓縮至約 0.25 美元,在圖表中的性價比分布處於領先位置。

從早前的強勢漲價導致用戶群體動搖,到如今端出「局部降價+跑分秀肌肉」的組合拳,DeepSeek 顯然正急於平息社群不滿,並證明自己依然具備「低成本、高算力」的護城河優勢。

然而,經歷過先前漲價風波的開發者如今變得更加務實。在帳單結構改善有限的情況下,V4.1-Flash 能否在真實世界複雜的代碼庫與長上下文調用中維持跑分水準,將是這波「救亡行動」能否成功的關鍵考驗。