![]()
芯東西(公眾號:aichip001)
作者 ZeR0
編輯 漠影
芯東西7月27日報道,7月25日,天津端側(cè)智能計算GPU芯片及解決方案供應(yīng)商速顯微電子發(fā)布國內(nèi)首款面向物理AI及具身智能場景的GPGPU處理器“天衡1100”(TH1100),以及面向下一代AI與異構(gòu)計算的雷神統(tǒng)一計算架構(gòu)TUCA。
速顯微電子由中國科大團隊創(chuàng)立于2015年,專注于嵌入式GPU芯片及相關(guān)系統(tǒng)解決方案的研發(fā),并創(chuàng)新地將數(shù)字存算設(shè)計與GPU IP結(jié)合,同時開展大模型參數(shù)硬化在GPU芯片的技術(shù)研發(fā)。
“天衡1100”支持最高128GB板載高速內(nèi)存配置,內(nèi)存帶寬85.3GB/s,支持FP32、FP16、FP8、INT8、INT4、FP4等多種精度計算,通過混合精度算力配置覆蓋從高精度計算到低功耗推理的多類需求,在AI推理常用的FP4混合精度計算方面可提供50TOPS算力,在支持稀疏計算的場景下,F(xiàn)P4稀疏算力可達100TOPS。
該芯片內(nèi)置24個Tensor Core(TC),可高效執(zhí)行矩陣運算;Tensor Memory Accelerator(TMA)支持多維張量數(shù)據(jù)搬運,可減少數(shù)據(jù)搬運與計算執(zhí)行之間的等待開銷。TC與TMA協(xié)同,有助于提升AI算子的執(zhí)行效率,使系統(tǒng)在處理復(fù)雜模型和高吞吐推理任務(wù)時具備更好的性能表現(xiàn)。
這些設(shè)計使得“天衡1100”可應(yīng)對邊緣AI推理、多路視頻處理、大模型推理和復(fù)雜數(shù)據(jù)處理任務(wù),并能在機器人、工業(yè)視覺和自動駕駛等場景中支持更大的模型、更復(fù)雜的中間特征緩存和更多路傳感器數(shù)據(jù)處理。
從整體芯片架構(gòu)來看,“天衡1100”采用一體化異構(gòu)SoC架構(gòu),通過CPU和GPU協(xié)同設(shè)計及軟硬件聯(lián)合調(diào)度,實現(xiàn)計算任務(wù)合理分配,提升能效與吞吐能力,增強多場景泛化能力。
它集成了高性能GPU計算簇、通用CPU簇、多媒體處理子系統(tǒng)和豐富的系統(tǒng)接口,經(jīng)高速互聯(lián)總線形成統(tǒng)一片上系統(tǒng),可顯著降低數(shù)據(jù)交互延遲,提高傳輸效率,面向邊緣AI推理場景構(gòu)建國產(chǎn)可控方案。
其中,高性能多媒體子系統(tǒng)可向多路攝像頭輸入、高清視頻處理、圖像增強、視頻分析和AI感知任務(wù)提供支撐,通過雙路ISP、多媒體處理單元和豐富外設(shè)接口,能夠為機器人、工業(yè)檢測、自動駕駛和智慧醫(yī)療等應(yīng)用提供更強的環(huán)境感知和數(shù)據(jù)處理能力。
“天衡1100”具有雙路ISP設(shè)計以及豐富的外設(shè)接口匹配等特性,可連接攝像頭、顯示設(shè)備、存儲設(shè)備、網(wǎng)絡(luò)模塊、工業(yè)控制接口和多類傳感器,用于視覺感知、AI推理、路徑規(guī)劃、任務(wù)決策和控制反饋,以及缺陷檢測、質(zhì)量分析和實時圖像處理。
TUCA架構(gòu)是速顯微電子自主研發(fā)、面向下一代AI與異構(gòu)計算場景的軟硬件協(xié)同計算架構(gòu),可結(jié)合速顯微電子自研GPGPU、AI加速芯片及異構(gòu)計算硬件,覆蓋從應(yīng)用開發(fā)、算子編譯、運行時調(diào)度到硬件執(zhí)行的關(guān)鍵計算鏈路,構(gòu)建統(tǒng)一、高效、可擴展的異構(gòu)計算軟件底座,有助于提升效率和實現(xiàn)平滑生態(tài)遷移。
近年來,速顯微電子相關(guān)產(chǎn)品聚焦云端或車規(guī)級高端市場,以及面向消費級物聯(lián)網(wǎng)的低功耗、低成本解決方案,相關(guān)產(chǎn)品已廣泛應(yīng)用于汽車智能座艙、工業(yè)控制、國防軍工等領(lǐng)域。
其研發(fā)的GC系列是全球第一款集成GPU的MCU芯片,2019年量產(chǎn)的GC9003是國內(nèi)第一款能跑3D圖形的車規(guī)MCU。
目前,GC90系列芯片已形成完整產(chǎn)品矩陣:GC9003芯片通過AEC-Q100車規(guī)級認證并累計出貨超百萬顆;GC9002芯片獲評“玄鐵優(yōu)選芯片”;GC9005芯片可同時處理1080P渲染和語音人臉識別。
今年,速顯微電子在“天衡”GPGPU為代表的IP內(nèi)核產(chǎn)品上實現(xiàn)了圖形處理與AI增強計算的深度融合。
速顯微電子創(chuàng)始人兼董事長項天博士宣布,速顯微電子將以天津總部為新立足點,加碼布局全國市場,并將與南開大學(xué)、天津大學(xué)等高校結(jié)成產(chǎn)學(xué)研合作機構(gòu),為具身智能產(chǎn)業(yè)提供自主可控、生態(tài)友好、高效節(jié)能的算力GPU產(chǎn)品。
速顯微電子聯(lián)合創(chuàng)始人兼總經(jīng)理王攀博士談道,速顯微堅持自研GPU全棧技術(shù),正在數(shù)字存算一體以及將大模型參數(shù)硬化在GPU芯片上的“模型即芯片”等先進技術(shù)領(lǐng)域進行攻關(guān)。
特別聲明:以上內(nèi)容(如有圖片或視頻亦包括在內(nèi))為自媒體平臺“網(wǎng)易號”用戶上傳并發(fā)布,本平臺僅提供信息存儲服務(wù)。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.