2026年8月20日,第六屆集成電路設(shè)計(jì)創(chuàng)新會(huì)議暨應(yīng)用展(ICDIA 2026)在南京舉行。國(guó)科微受邀參會(huì),AI算法開(kāi)發(fā)部部長(zhǎng)倪亞宇發(fā)表《端側(cè)AI技術(shù)挑戰(zhàn)與落地實(shí)踐》主題演講。“強(qiáng)芯TOP100”榜單同期揭曉,國(guó)科微再度斬獲這一權(quán)威獎(jiǎng)項(xiàng),充分彰顯了業(yè)界對(duì)其在端側(cè)AI領(lǐng)域加速技術(shù)攻關(guān)及產(chǎn)品落地實(shí)踐的高度認(rèn)可與肯定。
隨著大模型加速?gòu)脑贫讼蚪K端滲透,端側(cè)AI正迅速成為芯片產(chǎn)業(yè)競(jìng)爭(zhēng)的全新制高點(diǎn)。自2024年全面擁抱AI以來(lái),國(guó)科微將“ALL IN AI”確立為戰(zhàn)略核心,明確提出打造“端側(cè)AI芯引擎”的發(fā)展目標(biāo)。公司深度聚焦端側(cè)AI市場(chǎng),已構(gòu)建起覆蓋基礎(chǔ)IP、芯片產(chǎn)品到應(yīng)用解決方案的完整技術(shù)閉環(huán)。
GKNPU4.0:夯實(shí)端側(cè)AI算力基石
神經(jīng)網(wǎng)絡(luò)處理器(NPU)是國(guó)科微端側(cè)AI戰(zhàn)略的技術(shù)核心。面對(duì)自動(dòng)駕駛、邊緣計(jì)算、智能終端及AIGC等多元化的端側(cè)智能場(chǎng)景,國(guó)科微正聚焦FlashAttention等前沿技術(shù)在NPU平臺(tái)上的深度適配與優(yōu)化,持續(xù)推進(jìn)NPU架構(gòu)與配套工具鏈的演進(jìn),為產(chǎn)業(yè)提供高效的算力支撐。
當(dāng)前,大模型在終端部署的最大挑戰(zhàn)并非算力絕對(duì)值,而是受限于內(nèi)存帶寬和功耗約束下的綜合解決方案,特別是Transformer架構(gòu)中注意力機(jī)制(Attention)帶來(lái)的計(jì)算負(fù)載已成為推理性能的主要瓶頸。國(guó)科微在第四代NPU架構(gòu)(GKNPU4.0)中重點(diǎn)突破注意力機(jī)制的計(jì)算效率,使芯片能夠在本地高效完成大模型推理,顯著減少對(duì)外部?jī)?nèi)存帶寬的依賴,有效提升推理速度,緩解“內(nèi)存墻”壓力,真正讓大模型在終端“跑得動(dòng)、跑得順”。

尤為關(guān)鍵的是,GKNPU 4.0原生支持FlashAttention等前沿推理加速技術(shù),從架構(gòu)層面突破了“大模型難以落地終端”的難題。倪亞宇在演講中指出,NPU從初期受爭(zhēng)議到如今成為端側(cè)AI算力的基石,經(jīng)歷了清晰的價(jià)值自證過(guò)程。國(guó)科微始終堅(jiān)持自主研發(fā)路線,在4.0版本中更加貼近量產(chǎn)工程實(shí)際,以務(wù)實(shí)、可落地的設(shè)計(jì)助力端側(cè)AI芯片真正實(shí)現(xiàn)規(guī)模化部署。
全棧設(shè)計(jì)能力:打造體系化端側(cè)AI方案
國(guó)科微端側(cè)AI戰(zhàn)略并非單一技術(shù)的疊加,而是一套貫通“芯片—算法—軟件”的體系化全棧方案。
硬件底層,國(guó)科微自研NPU、編解碼、圖像處理及高速接口等核心IP,搭配先進(jìn)多核異構(gòu)芯片架構(gòu)與國(guó)產(chǎn)工藝協(xié)同優(yōu)化,構(gòu)筑了兼具高能效與快速量產(chǎn)能力的堅(jiān)實(shí)底座。軟件及算法方面,國(guó)科微通過(guò)全鏈路工具鏈,使AI算法與ISP、行業(yè)垂直應(yīng)用實(shí)現(xiàn)高效協(xié)同。硬件高性能與軟件靈活性的雙向賦能,共同構(gòu)成國(guó)科微端側(cè)AI完整的技術(shù)閉環(huán)。
依托全棧端側(cè)芯片設(shè)計(jì)能力,國(guó)科微已形成媒體顯示、AI視覺(jué)、車載電子與人機(jī)交互四大端側(cè)AI產(chǎn)品系列,并積累了豐富的規(guī)模化量產(chǎn)經(jīng)驗(yàn)。目前,相關(guān)芯片與解決方案已在智慧家庭、智能安防、工業(yè)控制、智能家居、輔助駕駛、消費(fèi)電子等領(lǐng)域?qū)崿F(xiàn)規(guī)模化商用。在大會(huì)現(xiàn)場(chǎng),國(guó)科微重點(diǎn)展示了媒體顯示、AI視覺(jué)與車載電子的量產(chǎn)芯片,受到與會(huì)觀眾的關(guān)注。
面向未來(lái),國(guó)科微正以前所未有的力度加大端側(cè)AI投入。2026年7月,公司發(fā)布定增預(yù)案,擬募資不超過(guò)50.61億元,用于端側(cè)AI芯片等三大產(chǎn)業(yè)化項(xiàng)目,基于傳感接入、媒體處理、AI推理以及控制等方面的核心技術(shù),實(shí)現(xiàn)“感知—決策—執(zhí)行—反饋”的閉環(huán),為端側(cè)智能應(yīng)用落地提供持續(xù)的動(dòng)能。
從安防視覺(jué)到車載智能,從媒體交互到具身智能,國(guó)科微以自研NPU為技術(shù)原點(diǎn),持續(xù)拓寬端側(cè)AI的想象邊界。在端側(cè)AI這一新興賽道上,國(guó)科微正加速奔跑,以豐富多元的端側(cè)AI芯片及解決方案,助力AI算力快速落地每一終端,矢志成為端側(cè)智能時(shí)代值得信賴的“芯”伙伴。

