DeepSeek 發布 V4.1-Flash,具原生視覺理解

DeepSeek 發布 V4.1-Flash,具原生視覺理解

DeepSeek 發布 V4.1-Flash,具原生視覺理解

DeepSeek 以原生支援圖像理解的 DeepSeek-V4.1-Flash 取代前代 V4-Flash 及實驗性視覺模型,兩款舊模型已在 API 下線。據該公司公布,新模型於2026年9月10日發布,是其新架構系列中規模最小的模型,API 價格同日下調。

DeepSeek 以原生支援圖像理解的 DeepSeek-V4.1-Flash 取代前代 V4-Flash 及實驗性視覺模型,兩款舊模型已在 API 下線。據該公司公布,新模型於2026年9月10日發布,是其新架構系列中規模最小的模型,API 價格同日下調。

業界動態

2026年9月10日

手持智能手機特寫,屏幕顯示 DeepSeek 應用程式的新對話畫面,可見藍色鯨魚標誌及「Hi, I'm DeepSeek.」字樣,背景全黑。

手持智能手機特寫,屏幕顯示 DeepSeek 應用程式的新對話畫面,可見藍色鯨魚標誌及「Hi, I'm DeepSeek.」字樣,背景全黑。 圖片來源:Unsplash/Solen Feyissa

DeepSeek 以原生支援圖像理解的 DeepSeek-V4.1-Flash 取代前代 V4-Flash 及實驗性視覺模型 V4-Flash-Vision-Exp,兩款舊模型已在 API 下線。據該公司公布,新模型於2026年9月10日發布,是其新架構系列中規模最小的模型;新 API 價格同日起生效。

重點一覽

  • 552B 參數混合專家(MoE)模型,輸入階段激活8B參數、輸出階段激活16B參數

  • 原生支援圖像理解,前代兩款 Flash 模型已下線

  • KV 快取所需 HBM 減至上一代的四分之一,SSD 儲存減至八分之一

  • 每百萬個 token 輸出價格:閒時人民幣4元,高峰人民幣8元

  • 模型權重以 MIT 授權在 Hugging Face 公開

架構與視覺能力

據 DeepSeek 公布,V4.1-Flash 採用新的因果編碼器-解碼器(Causal Encoder-Decoder)架構,輸入與輸出所激活的參數量不同,並以新的預訓練方法及更大規模的強化學習後訓練提升表現。Hugging Face 模型頁指,圖像與文字自預訓練階段起一併處理,上下文長度達100萬個 token。

該公司公布的基準測試顯示,V4.1-Flash 在 Terminal-Bench 2.1 得90.6分,高於 V4-Pro 的87.9分;視覺測試 BabyVision(配合工具)得89.6分。同一測試表中,GPQA Diamond 一項 V4.1-Flash 為90.9分,低於 V4-Pro 的92.4分。

型號安排

  • API 模型名稱改為 deepseek-flash,舊模型名稱暫時轉由 V4.1-Flash 處理

  • 發布頁表示計劃逐步下線 V4-Pro,由2026年9月14日起把相關請求轉至 V4.1-Flash 並按其價格收費,直至 V4.1-Pro 推出

  • API 更新日誌則表示,應用戶需求,9月14日後繼續提供 V4-Pro 的 API 服務,計費方式不變

  • 官方合作夥伴 WorkBuddy(包括 CodeBuddy)及 OpenCode 已全面支援 V4.1-Flash

V4.1-Pro 的推出時間未有說明。

API 價格

DeepSeek 表示,新架構令其能以較低成本服務更多用戶,因此下調 API 價格,並維持峰谷定價,閒時價格為高峰時段的一半。V4.1-Flash 每百萬個 token 的價格(據中文價格頁,以人民幣計)如下:

  • 輸入(快取命中):閒時人民幣0.02元,高峰人民幣0.04元

  • 輸入(快取未命中):閒時人民幣1元,高峰人民幣2元

  • 輸出:閒時人民幣4元,高峰人民幣8元

高峰時段為北京時間星期一至五(內地法定節假日除外)9:00至12:00及14:00至18:00,其餘時段包括週末及內地法定節假日均屬閒時。發布頁未有列出調整前的價格及降幅。

本會將持續關注 V4.1-Pro 的推出安排及 V4-Pro 服務的後續公布。

資料來源:DeepSeek 發布公告DeepSeek API 價格頁(中文)DeepSeek API 更新日誌Hugging Face 模型頁