《電子技術應用》
您所在的位置:首頁 > 通信与网络 > 业界动态 > LeCun又火了!93年演示首个文本识别CNN视频冲上Reddit热榜

LeCun又火了!93年演示首个文本识别CNN视频冲上Reddit热榜

2021-01-12
來源:雷锋网

 1.png

     提到卷積神經網絡大家可能并不陌生。

  它是深度學習(Deep Learning)的經典算法之一,自20世紀90年代以來,其在計算機視覺、自然語言處理領域不斷取得驚人的結果。

  卷積神經網絡(Convolutional Neural Networks,CNN)首次被用于文本識別演示是在1993年的貝爾實驗室(AT&T Bell Laboratories),其的演示者是有”CNN之父“之稱的Yann LeCun

  今天,LeCun在當年的演示視頻再次被網友們挖出,并迅速登上了Reddit熱搜,收獲了近千人點贊。

  2.png

  有網友評論稱,在演示之前,像通用人工智能(AGI)和其他難題一樣,這種文本識別被認為是不可能的完成的。

  3.png

  還有不少網友留言稱,他們是真正的工程師、向他們致敬!

  4.png

5.png

  據悉,這則視頻展示了世界上首個用于文本識別的卷積神經網絡,是之后CNN被廣泛應用于計算機視覺、自然語言處理領域的重要開端。

  1

  CNN:手寫數字識別任務

  20世紀90年代初,LeCun加入了當時世界上最負盛名的研究機構之一貝爾實驗室。彼時才32歲的他,與同事們創建了一個讀取并識別手寫數字的系統,該系統是一個典型的端到端圖像識別系統。

  微信圖片_20210112135737.gif

  演示視頻中,系統快速且精準地識別出了手寫數字210-949-4038。據說,這是LeCun在貝爾實驗室的電話號碼。

  另外,它在處理更密集更多樣的數字識別任務時也表現出了良好性能,這在90年代是非常難能可貴的。

  微信圖片_20210112135757.gif

微信圖片_20210112135800.gif

  視頻中,參與這項實驗的研究人員還有實驗室負責人Rich Howard、和計算機專家Donnie Henderson。

  微信圖片_20210112135815.gif

  據了解,這項代碼開發主要是為了應用于NCR(National Cash Register Coporation)的支票讀取系統。

  總體而言,由于數值計算能力有限、學習樣本不足,加上同一時期以支持向量機(Support Vector Machine, SVM)為代表的核學習(kernel learning)方法的興起,這一時期為各類圖像處理問題設計的卷積神經網絡還停留在實驗室研究階段。

  不過,到了1998年,Yann LeCun及其合作者共同構建了更加完備的卷積神經網絡LeNet-5,并在手寫數字的識別問題中取得了進一步的成功。截止90 年代末期,該系統已經處理了美國 10%-20%的支票識別。

  其實,LeNet-5神經網絡早在1989年已經被LeCun提出。LeNet的最初版本包含兩個卷積層,2個全連接層,共計6萬個學習參數,規模遠超TDNN和SIANN,且在結構上與現代的卷積神經網絡十分接近 。

  值得一提的是,LeCun 在1989年發表的《使用反向傳播和神經網絡識別手寫數字》的論文中,在論述其網絡結構時首次使用了”卷積“一詞,”卷積神經網絡“由此誕生,之后LeCun便被業內稱為”CNN之父“。

  2

  MNIST數據集

  基于這項實驗,LeCun還創建了經典手寫數據集MNIST,它是用于研究機器學習、模式識別等任務的高質量數據庫,被Hinton稱為”機器學習界的果蠅“。

  10.png

  MNIST 手寫數字圖像數據集作為機器學習基準已經使用了二十余年。它包含訓練集和測試集,訓練集包含 60000 個樣本,測試集包含 10000 個樣本,每個樣本都是一張28 * 28像素的灰度手寫數字圖片。

  11.png

  MNIST數據集包含各種(0~9)手寫數字

  據悉,MNIST 數據集抽取自 NIST 數據庫。其中的訓練數據來自2000 名人口普查局雇員的手寫字符,測試數據來自500名在校生的手寫字符。由于測試集樣本較少,MNIST很難再提供有意義的置信區間。2019年6月,來自 Facebook 和紐約大學的研究者對該數據集進行了擴展和重建,在測試集中新增了50000 個樣本。對此,LeCun在推特上轉發稱,這個新數據集重生、恢復、擴展了MNIST。

  目前該數據集包括以下四個文件內容:

  12.png

  手寫數字識別是計算機視覺領域的一個基本項目,相當于傳說中機器學習入門的”Hello World“,因此MNIST數據集也被開發者廣泛使用。

  3

  深度學習之父Yan LeCun

  自1998年之后,LeCun一直深耕于深度學習領域,還發表了多項重要論文,如OverFeat檢測框架、CNN用于立體匹配、DropConnect方法等,總引用量超過了100000+。

  2015年,他與蒙特利爾大學教授Yoshua Bengio、谷歌副總裁兼工程研究員Geoffrey Hinton合著發表了《深度學習》的綜述論文,并登上了Nature。

  LeCun是CNN的重要推動者。2018年,Yann因”將反向傳播算法引入了CNN(卷積神經網絡),并且發明了權值共享、池化等技巧,讓CNN真正更為可用“還獲得了ACM(Association for ComputingMachinery, 國際計算機協會)頒發的2018圖靈獎。

  13.png

  在宣布獲獎者時,ACM學會稱三位計算機科學家為”深度學習革命之父“,并指出,”三位科學家在概念和工程學方面取得的突破,讓深度神經網絡成為計算的關鍵部分“。

  圖靈獎有”計算機界的諾貝爾獎“之稱,由英國數學家艾倫·圖靈名字而來——因其發明了最早的人造計算機模型”圖靈機“。與之共同獲獎的還有Yoshua Bengio、Geoffrey Hinton。

  值得一提的是,Hinton還是LeCun在多倫多大學讀博期間師的導師。Hinton主要研究使用神經網絡進行機器學習、記憶、感知和符號處理的方法。當時的深度神經網絡學科是個大冷門,LeCun對神經網絡的研究受到了Hinton的不少的指導和幫助。

  除此之外,LeCun還曾獲得IEEE神經網絡先驅獎(2014)、IEEE PAMI杰出研究員獎(2015)。目前他是紐約大學數據科學中心創辦主任、Facebook副總裁兼首席人工智能科學家。

  在2020 AAAI 協會上,LeCun針對AI的未來發表了名為《Self-Supervised Learning》的主題演講,他認為深度學習已至瓶頸,而自監督學習才是AI的光明前景。他說,雖然在自動駕駛、語言翻譯、聊天機器人等方面,深度學習方法有著一席之地,但是卻無法創作出「真正的」人工智能。

  而自監督學習因為能更接近人類的學習程序,將會是未來的發展趨勢。

 


本站內容除特別聲明的原創文章之外,轉載內容只為傳遞更多信息,并不代表本網站贊同其觀點。轉載的所有的文章、圖片、音/視頻文件等資料的版權歸版權所有權人所有。本站采用的非本站原創文章及圖片等內容無法一一聯系確認版權者。如涉及作品內容、版權和其它問題,請及時通過電子郵件或電話通知我們,以便迅速采取適當措施,避免給雙方造成不必要的經濟損失。聯系電話:010-82306118;郵箱:aet@chinaaet.com。
主站蜘蛛池模板: 国产日韩av高清| 国产精品一区二区三| 91成人免费观看| 久久精品色欧美aⅴ一区二区| 91精品网站| 色99中文字幕| 日本精品一区二区三区在线播放视频| 99久久综合狠狠综合久久止| 九九九九免费视频| 欧美精品久久久久久久自慰| 欧美在线一区二区三区四| 欧美大片欧美激情性色a∨久久| 国产精品久久久久久久久粉嫩av| 99国产在线| 日韩av在线综合| 国产尤物91| 不卡伊人av在线播放| 久久精品国产2020观看福利 | 久久精品99| 欧洲视频一区二区三区| 日韩在线精品一区| 欧美一区二区三区精美影视| 久久亚洲精品国产亚洲老地址 | 国产精品亚洲天堂| 日韩一级在线免费观看| 亚洲国产精品毛片| 日韩在线激情视频| 欧美中日韩在线| 国产精品尤物福利片在线观看| 欧美日韩亚洲一区二区三区在线观看| 国产成人av一区二区三区| 国精产品99永久一区一区| 国产精品久久久久7777| 久久在线免费观看视频| 日韩aⅴ视频一区二区三区| 久久精精品视频| 欧美日本高清一区| 日本一区二区三区在线视频| 亚洲专区在线视频| 精品99在线视频| 日本一区视频在线观看|