當前,人工智能發展借助深度學習技術突破得到了全面關注和助力推動,各國政府高度重視、資本熱潮仍在加碼,各界對其成為發展熱點也達成了共識。本文旨在分析深度學習技術現狀,研判深度學習發展趨勢,并針對我國的技術水平提出發展建議。
一、深度學習技術現狀
深度學習是本輪人工智能爆發的關鍵技術。人工智能技術在計算機視覺和自然語言處理等領域取得的突破性進展,使得人工智能迎來新一輪爆發式發展。而深度學習是實現這些突破性進展的關鍵技術。其中,基于深度卷積網絡的圖像分類技術已超過人眼的準確率,基于深度神經網絡的語音識別技術已達到95%的準確率,基于深度神經網絡的機器翻譯技術已接近人類的平均翻譯水平。準確率的大幅提升使得計算機視覺和自然語言處理進入產業化階段,帶來新產業的興起。
深度學習是大數據時代的算法利器,成為近幾年的研究熱點。和傳統的機器學習算法相比,深度學習技術有著兩方面的優勢。一是深度學習技術可隨著數據規模的增加不斷提升其性能,而傳統機器學習算法難以利用海量數據持續提升其性能。二是深度學習技術可以從數據中直接提取特征,削減了對每一個問題設計特征提取器的工作,而傳統機器學習算法需要人工提取特征。因此,深度學習成為大數據時代的熱點技術,學術界和產業界都對深度學習展開了大量的研究和實踐工作。
深度學習各類模型全面賦能基礎應用。卷積神經網絡和循環神經網絡是兩類獲得廣泛應用的深度神經網絡模型。計算機視覺和自然語言處理是人工智能兩大基礎應用。卷積神經網絡廣泛應用于計算機視覺領域,在圖像分類、目標檢測、語義分割等任務上的表現大大超越傳統方法。循環神經網絡適合解決序列信息相關問題,已廣泛應用于自然語言處理領域,如語音識別、機器翻譯、對話系統等。
深度學習技術仍不完美,有待于進一步提升。一是深度神經網絡的模型復雜度高,巨量的參數導致模型尺寸大,難以部署到移動終端設備。二是模型訓練所需的數據量大,而訓練數據樣本獲取、標注成本高,有些場景樣本難以獲取。三是應用門檻高,算法建模及調參過程復雜繁瑣、算法設計周期長、系統實施維護困難。四是缺乏因果推理能力,圖靈獎得主、貝葉斯網絡之父Judea Pearl指出當前的深度學習不過只是“曲線擬合”。五是存在可解釋性問題,由于內部的參數共享和復雜的特征抽取與組合,很難解釋模型到底學習到了什么,但出于安全性考慮以及倫理和法律的需要,算法的可解釋性又是十分必要的。因此,深度學習仍需解決以上問題。
二、深度學習發展趨勢
深度神經網絡呈現層數越來越深,結構越來越復雜的發展趨勢。為了不斷提升深度神經網絡的性能,業界從網絡深度和網絡結構兩方面持續進行探索。神經網絡的層數已擴展到上百層甚至上千層,隨著網絡層數的不斷加深,其學習效果也越來越好,2015年微軟提出的ResNet以152層的網絡深度在圖像分類任務上準確率首次超過人眼。新的網絡設計結構不斷被提出,使得神經網絡的結構越來越復雜。如:2014年谷歌提出了Inception網絡結構、2015年微軟提出了殘差網絡結構、2016年黃高等人提出了密集連接網絡結構,這些網絡結構設計不斷提升了深度神經網絡的性能。
深度神經網絡節點功能不斷豐富。為了克服目前神經網絡存在的局限性,業界探索并提出了新型神經網絡節點,使得神經網絡的功能越來越豐富。2017年,杰弗里?辛頓提出了膠囊網絡的概念,采用膠囊作為網絡節點,理論上更接近人腦的行為,旨在克服卷積神經網絡沒有空間分層和推理能力等局限性。2018年,DeepMind、谷歌大腦、MIT的學者聯合提出了圖網絡的概念,定義了一類新的模塊,具有關系歸納偏置功能,旨在賦予深度學習因果推理的能力。
深度神經網絡工程化應用技術不斷深化。深度神經網絡模型大都具有上億的參數量和數百兆的占用空間,運算量大,難以部署到智能手機、攝像頭和可穿戴設備等性能和資源受限的終端類設備。為了解決這個問題,業界采用模型壓縮技術降低模型參數量和尺寸,減少運算量。目前采用的模型壓縮方法包括對已訓練好的模型做修剪(如剪枝、權值共享和量化等)和設計更精細的模型(如MobileNet等)兩類。深度學習算法建模及調參過程繁瑣,應用門檻高。為了降低深度學習的應用門檻,業界提出了自動化機器學習(AutoML)技術,可實現深度神經網絡的自動化設計,簡化使用流程。
深度學習與多種機器學習技術不斷融合發展。深度學習與強化學習融合發展誕生的深度強化學習技術,結合了深度學習的感知能力和強化學習的決策能力,克服了強化學習只適用于狀態為離散且低維的缺陷,可直接從高維原始數據學習控制策略。為了降低深度神經網絡模型訓練所需的數據量,業界引入了遷移學習的思想,從而誕生了深度遷移學習技術。遷移學習是指利用數據、任務或模型之間的相似性,將在舊領域學習過的模型,應用于新領域的一種學習過程。通過將訓練好的模型遷移到類似場景,實現只需少量的訓練數據就可以達到較好的效果。
三、未來發展建議
加強圖網絡、深度強化學習以及生成式對抗網絡等前沿技術研究。由于我國在深度學習領域缺乏重大原創性研究成果,基礎理論研究貢獻不足,如膠囊網絡、圖網絡等創新性、原創性概念是由美國專家提出,我國研究貢獻不足。在深度強化學習方面,目前最新的研究成果大都是由DeepMind和OpenAI等國外公司的研究人員提出,我國尚沒有突破性研究成果。近幾年的研究熱點生成式對抗網絡(GAN)是由美國的研究人員Goodfellow提出,并且谷歌、facebook、twitter和蘋果等公司紛紛提出了各種改進和應用模型,有力推動了GAN技術的發展,而我國在這方面取得的研究成果較少。因此,應鼓勵科研院所及企業加強深度神經網絡與因果推理模型結合、生成式對抗網絡以及深度強化學習等前沿技術的研究,提出更多原創性研究成果,增強全球學術研究影響力。
加快自動化機器學習、模型壓縮等深度學習應用技術研究。依托國內的市場優勢和企業的成長優勢,針對具有我國特色的個性化應用需求,加快對深度學習應用技術的研究。加強對自動化機器學習、模型壓縮等技術的研究,加快深度學習的工程化落地應用。加強深度學習在計算機視覺領域應用研究,進一步提升目標識別等視覺任務的準確率,以及在實際應用場景中的性能。加強深度學習在自然語言處理領域的應用研究,提出性能更優的算法模型,提升機器翻譯、對話系統等應用的性能。
作者簡介
趙強,工學碩士,高級工程師,現就職于中國信息通信研究院云計算與大數據研究所人工智能部。主要對人工智能的技術、應用與產業開展研究,并進行相關系統軟件的設計與研發。研究成果獲批國家發明專利4項,軟件著作權5項。
聯系方式:zhaoqiang@caict.ac.cn