“藏語言文化正在AI技術(shù)驅(qū)動下,經(jīng)歷一場從‘?dāng)?shù)字化保護’走向‘?dāng)?shù)智化重構(gòu)’的深刻變革。”中國工程院院士、西藏大學(xué)教授尼瑪扎西近日接受中新社記者采訪時說。
30多年前,藏文還無法在計算機系統(tǒng)中正常顯示與信息交換,自1997年藏文編碼國際標(biāo)準(zhǔn)獲通過起,藏語言文字走向了數(shù)字世界。如今,藏語大模型“陽光清言”讓藏語智能信息從“能顯示、能交換”到“能理解、能思考”。
尼瑪扎西說,過去30余年,計算機操作系統(tǒng)和移動操作系統(tǒng)的藏文處理、自然語言處理、語音處理、多場景多風(fēng)格文字識別等,曾被認(rèn)為是遙不可及的技術(shù)愿景,如今都已落地成具體可感的應(yīng)用。其中,不少成果源于新一代人工智能國家科技重大專項“藏語言文字自動識別技術(shù)研發(fā)和應(yīng)用”。
“陽光清言”藏語大模型V1.0便是該項目成果之一,它是一個千億參數(shù)級的大模型,大模型的訓(xùn)練數(shù)據(jù)使用了約288億token(詞元)高質(zhì)量藏語數(shù)據(jù)。
“該項目還構(gòu)建了包括藏語衛(wèi)藏、康巴、安多三大方言語音翻譯技術(shù)體系。”尼瑪扎西介紹,研究團隊強化藏語語音數(shù)據(jù)建設(shè),充分研究和利用藏文自身特點,確定語音理解的基礎(chǔ)單元,應(yīng)用深度學(xué)習(xí)技術(shù)不斷訓(xùn)練和優(yōu)化模型,讓AI具備“聽懂”三大方言的能力。在此基礎(chǔ)上,研究團隊將語音識別數(shù)據(jù)定向轉(zhuǎn)換為適用于語音合成的高質(zhì)量數(shù)據(jù),充分發(fā)揮大模型對說話人特征的建模能力,實現(xiàn)了藏語三大方言的高質(zhì)量語音合成,讓AI“會說”藏語。
“藏語言文字承載著青藏高原千年的文明記憶。原來我們更多地說文化的數(shù)字化保護,保護是手段,利用才是目的。”尼瑪扎西說,如今AI技術(shù)為推動藏文化從“數(shù)字化保護”走向“數(shù)智化重構(gòu)”,實現(xiàn)傳統(tǒng)文化多方位多層次的智能處理和融合利用提供了前所未有的契機。
藏語AI技術(shù)已應(yīng)用到多個領(lǐng)域。尼瑪扎西舉例,如教育領(lǐng)域,藏語智能技術(shù)為幼兒看圖識字、中小學(xué)生文化知識學(xué)習(xí)、高層次學(xué)術(shù)研究等提供了便利工具;醫(yī)療領(lǐng)域,語音翻譯技術(shù)正在為醫(yī)患溝通搭建橋梁。
目前,藏語智能技術(shù)已經(jīng)應(yīng)用到鼠標(biāo)、翻譯耳機等終端產(chǎn)品。他坦言,但要讓這些產(chǎn)品真正成為民眾離不開的“生活助手”,仍需要解決相關(guān)產(chǎn)品開發(fā)生產(chǎn)、市場化等現(xiàn)實問題。
尼瑪扎西表示,作為基座模型,“陽光清言”將賦能邊疆治理、文旅、農(nóng)牧科研等多個領(lǐng)域的垂直應(yīng)用。他希望通過不斷建設(shè)青藏高原全域數(shù)據(jù)資源和青藏知識圖譜、迭代大模型技術(shù)、探索大模型市場化運營模式,將來,基于“陽光清言”建設(shè)“西藏大模型”,進而建設(shè)覆蓋更廣闊的“青藏大模型”,并基于這些大模型建設(shè)系列垂域模型,推動西藏經(jīng)濟社會發(fā)展和民生改善,服務(wù)國家戰(zhàn)略。
來源:中新網(wǎng)客戶端
特別聲明:以上內(nèi)容(如有圖片或視頻亦包括在內(nèi))為自媒體平臺“網(wǎng)易號”用戶上傳并發(fā)布,本平臺僅提供信息存儲服務(wù)。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.