DeepSeek昨日深夜正式推出V4 Pro正式版模型DeepSeek-V4-Pro-0813,API及Chat端已同步完成更新,調(diào)用模型名不變,開發(fā)者使用deepseek-v4-pro即可調(diào)用最新版本。
根據(jù)官方公布的評(píng)測(cè)數(shù)據(jù)顯示,該模型在多項(xiàng)Agent相關(guān)評(píng)測(cè)集上超越Opus 4.8,與Fable 5(w/ fallback)互有勝負(fù)。
根據(jù)DeepSeek官方API文檔,DeepSeek-V4-Pro-0813支持1M上下文長(zhǎng)度,最大輸出長(zhǎng)度達(dá)384K Token,同時(shí)支持非思考模式與思考模式,其中思考模式默認(rèn)開啟。對(duì)于長(zhǎng)代碼庫(kù)分析、大規(guī)模文檔處理以及需要連續(xù)執(zhí)行大量步驟的Agent任務(wù)而言,這樣的上下文和輸出規(guī)格意味著單次調(diào)用的承載能力相當(dāng)可觀。
配套能力方面,新模型支持JSON Output、Tool Calls、Responses API和Anthropic API,對(duì)話前綴續(xù)寫與FIM補(bǔ)全處于Beta階段,其中FIM補(bǔ)全僅限非思考模式使用。API接入同時(shí)兼容OpenAI和Anthropic兩套格式,官方還明確新版本增強(qiáng)了Agent能力,支持Codex接入。
性能方面,從官方公布的對(duì)比表來看,V4-Pro-0813相比預(yù)覽版提升顯著:HLE(帶工具)從48.2升至60.0,Terminal Bench 2.1從72.1升至87.9,DeepSWE從12.8躍升至62.7,DSBench-Hard從31.1升至67.2。
橫向?qū)Ρ戎校撃P驼w表現(xiàn)超越Opus 4.8,在Terminal Bench 2.1(87.9對(duì)88.0)、Cybergym(83.3對(duì)83.1)等項(xiàng)目上與Fable 5幾乎打平,但在DSBench-FullStack(71.1對(duì)77.2)等項(xiàng)目上仍有差距。
價(jià)格方面,deepseek-v4-pro當(dāng)前每百萬(wàn)Token定價(jià)為:緩存命中輸入0.025元、緩存未命中輸入3元、輸出6元,三項(xiàng)主要計(jì)費(fèi)標(biāo)準(zhǔn)均為deepseek-v4-flash(0.02元、1元、2元)的3倍。并發(fā)限制上,Pro版為500,F(xiàn)lash版為2500。相比之下,F(xiàn)lash主打高頻大規(guī)模調(diào)用,Pro則面向規(guī)格要求更高的任務(wù)。
值得一提的是,DeepSeek此前已公告稱計(jì)劃近期整體上調(diào)API服務(wù)定價(jià)且"預(yù)計(jì)漲幅較大",但目前價(jià)格頁(yè)面仍維持原價(jià),具體調(diào)價(jià)方案尚未公布。