DeepSeek的爆火出圈為國產(chǎn)芯片同時帶來了時機(jī)與挑戰(zhàn)。一方面,新銳模子及AI原生運(yùn)用的發(fā)作會孕育發(fā)生更多算力需求,但同時,因為國產(chǎn)芯片于底層架談判軟件生態(tài)上的差異,怎樣高效適配AI模子并充實(shí)闡揚(yáng)算力潛力成為國產(chǎn)芯片范疇亟待解決的問題。 近日,北京電子數(shù)智科技有限責(zé)任公司(如下簡稱“北電數(shù)智”)依托其“浮圖·模子適配平臺”樂成完成DeepSeek V3/R1全尺寸模子與海光DCU、華為、壁仞科技、沐曦等多款國產(chǎn)芯片的混元算力適配,為開發(fā)者及企業(yè)提供了更矯捷、高效的算力撐持。 技能立異:DeepSeek模子機(jī)能領(lǐng)先 DeepSeek模子作為國產(chǎn)AI技能的代表,采用了多項立異技能,包括混淆專家體系(DeepSeekMoE)、多頭潛于留意力機(jī)制(MLA)以和自研練習(xí)框架。這使DeepSeek于年夜幅削減算力開消的環(huán)境下實(shí)現(xiàn)了R1模子與OpenAI o1相稱、V3模子與OpenAI 4o相稱的機(jī)能體現(xiàn),揭示出高推理效率及低練習(xí)成本的上風(fēng)。 浮圖·模子適配平臺:抹平芯片差異,異構(gòu)算力高效支撐模子 北電數(shù)智“浮圖·模子適配平臺”抹平了差別芯片架構(gòu)的差異,快速實(shí)現(xiàn)對于DeepSeek模子的優(yōu)化撐持及硬件適配。用戶無需存眷底層硬件技能細(xì)節(jié),平臺會按照模子挪用需求主動匹共同適的算力資源,年夜幅降低了開發(fā)門坎。今朝,該平臺已經(jīng)完成24款基座年夜模子的適配事情,為開發(fā)者提供了更多算力選擇。 混元推理技能:優(yōu)化效率,降低成本 針對于DeepSeek類超年夜模子的推理使命,數(shù)據(jù)中央的集群化推理技能顯患上尤為主要,例如PD分散(Prefill-Decode分散)技能就可由差別芯片完成差別階段推理使命實(shí)現(xiàn)。北電數(shù)智的混元推理技能線路與DeepSeek的技能線路高度契合,能有用解決算力不足問題,為年夜范圍AI運(yùn)用創(chuàng)造便當(dāng)前提。 鞭策國產(chǎn)算力成長:從適配到生態(tài)設(shè)置裝備擺設(shè) DeepSeek的成長為行業(yè)帶來了深刻啟迪:只有滿意國產(chǎn)原生模子的算力需求,才能真正鞭策包羅國產(chǎn)算力于內(nèi)的中國AI財產(chǎn)成長。為周全挖掘國產(chǎn)芯片機(jī)能潛力與適配能力,北電數(shù)智還有推出了“星火·國產(chǎn)算力AI原生適配認(rèn)證”,促成國產(chǎn)模子與國產(chǎn)算力的深度交融,鞭策國產(chǎn)芯片于AI原生運(yùn)用場景中的迭代與立異。 企業(yè)版內(nèi)測上線:助力AI運(yùn)用落地 今朝,北電數(shù)智已經(jīng)正式開通企業(yè)版內(nèi)測辦事,經(jīng)由過程“北京數(shù)字經(jīng)濟(jì)算力中央”為泛博企業(yè)及開發(fā)者提供便捷、高效的算力撐持。不管是模子練習(xí)還有是推理使命,用戶均可以于多芯混元算力情況下輕松構(gòu)建及部署基在DeepSeek模子的AI運(yùn)用。 北電數(shù)智的一系枚舉措,為國產(chǎn)AI芯片與模子的協(xié)同成長提供了新思緒。將來,跟著更多企業(yè)及開發(fā)者插手,國產(chǎn)算力生態(tài)也將迎來越發(fā)廣漠的成長空間。