1月5日,國芯科技發(fā)布自愿性披露公告,宣布其研發(fā)的神經網絡處理器DPNPU(Dataflow Parallel NPU)新IP產品順利通過內部測試,該產品面向端側與邊緣計算場景,將為各類智能設備提供高效靈活的AI算力支持。
據(jù)公告披露,國芯科技DPNPU新IP產品是一款高性能AI處理器,針對人工智能應用中復雜多變的計算任務進行多維度優(yōu)化,核心目標是實現(xiàn)功耗、性能與靈活性的最佳平衡。在核心性能方面,該產品單核支持0.5~4.8TOPS的靈活算力配置,且支持算力線性擴展,可根據(jù)不同應用場景提供定制化AI算力解決方案。
架構設計上,DPNPU采用符合RISC-V指令集架構標準的創(chuàng)新開放架構,通過將RISC-V核心與高性能神經網絡加速單元進行架構層面深度優(yōu)化,搭配專用的TDS(Task Distribution & Synchronization)硬件調度引擎,能將網絡模型中的算子序列轉化為高效節(jié)點化任務流,實現(xiàn)任務管理、數(shù)據(jù)流控制與AI專用計算的統(tǒng)一高效調度。同時,產品采用脈動陣列高效動態(tài)融合技術,保障設備長時間運行的穩(wěn)定性與卓越能效。

功能覆蓋方面,DPNPU內置90余種神經網絡算子,全面兼容CNN、RNN等主流神經網絡架構,并支持LSTM、GRU等RNN變體,通過RISC-V指令和硬件通用性設計可擴展支持更多新型算子,適配未來AI模型發(fā)展需求。量化技術上,該產品支持訓練后量化(PTQ)的四種主流方式,同時兼容INT8和FP16混合精度量化,在保持模型精度的前提下,大幅降低計算資源與存儲空間占用。此外,產品集成自研PCD(Parameter Compression & Decompression)模塊,通過參數(shù)壓縮與硬件自動解壓縮技術,有效緩解數(shù)據(jù)吞吐瓶頸,提升系統(tǒng)整體性能。
為降低AI應用開發(fā)門檻,國芯科技圍繞DPNPU構建了完整的軟件生態(tài)——C*Core NPU Studio,涵蓋工具套件、驅動和運行時軟件三大核心組成。其中,工具套件提供模型轉換、預處理、量化、編譯、仿真等端到端模型部署能力;運行時軟件包含推理框架軟件和擴展軟算子庫;驅動則適配RISC-V等主流CPU平臺,支持Linux/RTOS/Bare-metal等多種應用環(huán)境,可顯著縮短AI應用從開發(fā)到部署的周期,提升落地效率。
公告指出,當前人工智能技術正加速滲透至工業(yè)控制、智能家電、汽車電子、醫(yī)療健康等關鍵領域,端側與邊緣側AI因具備實時響應、數(shù)據(jù)隱私保護、低網絡依賴等優(yōu)勢,對芯片能效比和算力密度提出了更高要求。此次DPNPU新IP產品的架構可行性、能效表現(xiàn)及軟件棧均已完成驗證,為公司NPU技術持續(xù)研發(fā)及端側、邊緣側AI芯片的發(fā)展與應用奠定了堅實基礎。
國芯科技表示,公司對DPNPU新IP產品擁有完整知識產權,該產品研發(fā)成功是公司在人工智能領域堅持創(chuàng)新驅動的重要成果,預計將對公司未來市場拓展和業(yè)績成長性產生積極影響。
