
NVIDIA 發(fā)布了 Nemotron 3 Ultra,這是一個專為長時間運行的智能體構建的開放模型,并由 Nemotron Coalition 協同開發(fā)。
為長時間運行的智能體提供支持的模型,其作用遠不止是生成文本。它們需要解釋信息、規(guī)劃后續(xù)步驟、調用工具、評估結果并進行反復迭代,以完成復雜的編碼、研究和企業(yè)級任務。這就需要高效模型能夠在更短的時間內探索更廣的搜索空間,從而更快地提供更高準確度的結果。
Nemotron 3 Ultra 專為這種新工作負載而打造。這是一款前沿智能模型,推理速度可提升高達 5 倍,并可將復雜智能體任務的成本降低高達 30%。這使智能體能夠在更短的時間內完成相同的工作,或在相同時間內完成更多工作。

Nemotron 3 Ultra 是一個具有 5,500 億參數的混合專家模型,能夠處理自主工作流中的編排和高難度的推理調用:在長時間運行的編碼會話中做出架構決策、跨數百個研究來源進行合成,以及對數千個相互依賴的約束進行驗證。
這些模型目前已在 Hugging Face、魔搭社區(qū)、OpenRouter 以及 NVIDIA 官網以 NVIDIA NIM 的形式提供,并通過 NVIDIA 云合作伙伴、推理平臺和云服務提供商構成的廣泛的生態(tài)系統(tǒng)供用戶使用。
以上為摘要內容,請點擊“閱讀原文”或掃描下方二維碼閱讀完整內容:

掃描下方海報二維碼,觀看 NVIDIA CEO 黃仁勛在 GTC 臺北大會現場發(fā)表的主題演講回放,深入了解推動新一代 AI 的突破性成果。
