關(guān)注+星標(biāo)公眾號,不錯過精彩內(nèi)容
來源 | 新智元
早在4月份的時候,官方發(fā)布了DeepSeek-V4 預(yù)覽版:邁入百萬上下文普惠時代。
今天,DeepSeek官宣了重磅消息:DeepSeek-V4-Flash 正式版 API 開啟公測!

消息一出,開發(fā)者圈直接沸騰了,因為這次有三大爆點——
首先,Agent能力大幅升級,比V4 pro預(yù)覽版還要強!

而且,模型架構(gòu)完全沒變,全靠后訓(xùn)練硬生生把性能拔高了一大截。
現(xiàn)在,OpenAI開源的Codex現(xiàn)在能接入deepseek-v4-flash,而deepseek-v4-pro預(yù)計2026年8月初支持接入 Codex。
此外,還有好消息——DeepSeek Harness即將公布。

消息一出,全球開發(fā)者圈都炸鍋了。
有人驚呼:這是魔法?有人在調(diào)侃「友商臉疼不疼」,甚至,已經(jīng)有人在考慮要不要退訂ChatGPT和Claude了。
就在GPT-5.6大降價的今天,DeepSeek-V4-Flash來了一次暴擊。


從此,人人都能用Agent了!

本來,「Flash」代表著輕量、便宜、快,「Pro」代表著貴、全能、算力猛獸。
DeepSeek-V4-Flash正式版,直接把這個潛規(guī)則給掀了。
結(jié)果現(xiàn)在,200B輕量級模型就把前代模型干翻了。
甚至在某些測試上,趕上了Opus 4.8了!

另外兩項內(nèi)部測試成績也相當(dāng)硬核:DSBench-FullStack和DSBench-Hard。
在這倆專門針對真實開發(fā)環(huán)境和復(fù)雜代碼設(shè)計的測試?yán)铮琕4-Flash正式版的分?jǐn)?shù)不僅比預(yù)覽版「好很多」,甚至讓同行側(cè)目。


開發(fā)者們滿意點評道:現(xiàn)在,V4-Flash對我的使用場景來說,簡直是性能溢出了。
還有人說,這就是我想要的模型——夠便宜,也夠聰明。
平民化的Agent時代,真的來了。

V4-Flash的跑分已經(jīng)夠讓人震驚了,但官方透露的另一個細(xì)節(jié)更讓人覺得「不可思議」。
DeepSeek特別注明:
DeepSeek-V4-Flash-0731 的模型結(jié)構(gòu)、尺寸和 DeepSeek-V4-Flash-Preview 保持一致,僅重新進(jìn)行了后訓(xùn)練。

有人說:這是魔法吧?

這跨越式的性能提升關(guān)鍵,就在當(dāng)前大模型領(lǐng)域最核心的技術(shù)——后訓(xùn)練。
有人一針見血點評:誰說后訓(xùn)練沒用的?

還有人說:「光靠后訓(xùn)練就能有這樣的提升,太厲害了,說明這方面還有巨大的挖掘空間。」
顯然,DeepSeek在后訓(xùn)練上找到了某種「不二法門」,硬生生把一個200B的模型調(diào)教出了遠(yuǎn)超它體型的高智商。

而且,DeepSeek太懂開發(fā)者的痛點了。
這次更新里,官方宣布V4-Flash原生支持Responses API格式,并且全面適配Codex。

對開發(fā)者,這簡直是久旱逢甘霖。
Responses API徹底解決了大模型開發(fā)里最讓人頭疼的問題:JSON格式解析失敗。
以前輸出嚴(yán)格格式的數(shù)據(jù),就跟抽盲盒似的。
現(xiàn)在原生支持Responses API,V4-Flash可以100%穩(wěn)定、精準(zhǔn)地輸出開發(fā)者定義好的數(shù)據(jù)結(jié)構(gòu)。
再加上它本身「性能溢出」的Agent規(guī)劃能力,開發(fā)者完全可以放心地讓V4-Flash去調(diào)用外部工具、讀寫數(shù)據(jù)庫、控制RPA機器人。
全面適配Codex,則意味著V4-Flash在代碼生成、代碼審查、自動補全等方面已經(jīng)達(dá)到了專業(yè)編程助手的水平。
這意味著,你可以直接將它無縫接入VS Code、Codex CLI或ChatGPT桌面端。
macOS / Linux用戶在終端中執(zhí)行:
bash <(curl -fsSL https://cdn.deepseek.com/api-docs/codex-deepseek-setup.sh)Windows 用戶在 PowerShell 中執(zhí)行:
irm https://cdn.deepseek.com/api-docs/codex-deepseek-setup-en.ps1 | iex
很多人說要退訂GPT和Claude,真不是玩笑。
性價比這塊,200B的V4-Flash靠后訓(xùn)練魔法,在Agent和代碼能力上「性能溢出」,足夠橫掃所有長文本、高并發(fā)、多Agent協(xié)同的日常任務(wù)。
而在極致性能那邊,真正的「大魔王」DeepSeek-V4-Pro還在路上。
官方說了:「今天升級只針對V4-Flash API。V4-Pro API和App/Web模型暫時不變。DeepSeek-V4-Pro正式發(fā)布很快會來,敬請期待!」
如果200B參數(shù)的Flash,只靠后訓(xùn)練就能達(dá)到這個高度;那傳說中1.6T的V4-Pro正式版,有多驚人?

大家都在等,V4-Pro是不是能跟地表最強Claude 3.5 Opus正面碰一碰。
如果那天真來了,就是國產(chǎn)大模型重塑全球AI格局的時刻。
參考資料:
編輯:Aeneas 大衛(wèi)
------------ END ------------

基于MCU的輕量級AI模型TFLite和TFLM的差別

做嵌入式項目,選RTOS要考慮哪些問題?