0
  • 聊天消息
  • 系統(tǒng)消息
  • 評論與回復(fù)
登錄后你可以
  • 下載海量資料
  • 學(xué)習(xí)在線課程
  • 觀看技術(shù)視頻
  • 寫文章/發(fā)帖/加入社區(qū)
會員中心
創(chuàng)作中心

完善資料讓更多小伙伴認識你,還能領(lǐng)取20積分哦,立即完善>

3天內(nèi)不再提示

計算機視覺是否是深度學(xué)習(xí)落地的好賽道

電子工程師 ? 來源:cg ? 2018-12-12 13:34 ? 次閱讀

計算機視覺是目前AI在中國落地最順利的技術(shù)。從目前的落地進展來看,移動互聯(lián)網(wǎng)、安防、零售、物流、醫(yī)療、文娛、無人駕駛的商業(yè)化有待成熟。以曠視科技Face++、商湯科技、極鏈科技Video++為代表的AI頭部企業(yè)戰(zhàn)略,出現(xiàn)向平臺企業(yè)或軟硬一體化企業(yè)發(fā)展的分化趨勢,及零售等新領(lǐng)域快速崛起。

計算機視覺在中國AI市場組成部分占比巨大。根據(jù)中國信通院2018年2月發(fā)布的報告數(shù)據(jù),2017年,中國人工智能市場中計算機視覺占比37%,以80億元的行業(yè)收入排名第一。

2018年信通院11月發(fā)布的《2018人工智能發(fā)展白皮書——技術(shù)篇》中以深度學(xué)習(xí)算法驅(qū)動的人工智能技術(shù)為主,數(shù)據(jù)顯示,在全球人工智能產(chǎn)業(yè)蓬勃發(fā)展的今天,人工智能技術(shù)以機器學(xué)習(xí),特別是深度學(xué)習(xí)為核心,在視覺、語音、自然語言等應(yīng)用領(lǐng)域迅速發(fā)展,已經(jīng)開始滲入到各個行業(yè)。BBC預(yù)測,2020年全球人工智能市場規(guī)模約183億美元,年均增長20%。在人工智能產(chǎn)業(yè)應(yīng)用上,從融資規(guī)模和市場結(jié)構(gòu)來看,中國AI企業(yè)更集中于視覺和語音方向。

目前,深度學(xué)習(xí)幾乎成了計算機視覺領(lǐng)域的標配,也是當(dāng)下人工智能領(lǐng)域最熱門的研究方向。計算機視覺的應(yīng)用場景和深度學(xué)習(xí)背后的技術(shù)原理是什么呢?

深度學(xué)習(xí)背后的技術(shù)原理

機器學(xué)習(xí)

機器學(xué)習(xí)的本質(zhì)其實是為了找到一個函數(shù),讓這個函數(shù)在不同的領(lǐng)域會發(fā)揮不同的作用。像語音識別領(lǐng)域,這個函數(shù)會把一段語音識別成一段文字;圖像識別的領(lǐng)域,這個函數(shù)會把一個圖像映射到一個分類;下圍棋的時候根據(jù)棋局和規(guī)則進行博弈;對話,是根據(jù)當(dāng)前的對話生成下一段對話。機器學(xué)習(xí)離不開學(xué)習(xí)兩個字,根據(jù)不同的學(xué)習(xí)方式,可以分為監(jiān)督學(xué)習(xí)和非監(jiān)督學(xué)習(xí)兩種方式。

監(jiān)督學(xué)習(xí)中,算法和數(shù)據(jù)是模型的核心所在。在監(jiān)督學(xué)習(xí)中最關(guān)鍵的一點是,我們對訓(xùn)練的每個數(shù)據(jù)都要打上標簽,然后通過把這些訓(xùn)練數(shù)據(jù)輸入到算法模型經(jīng)過反復(fù)訓(xùn)練以后,每經(jīng)過一次訓(xùn)練都會減少算法模型的預(yù)計輸出和標簽數(shù)據(jù)的差距。

通過大量的訓(xùn)練,算法模型基本上穩(wěn)定下來以后,我們就可以把這個模型在測試數(shù)據(jù)集上驗證模型的準確性。這就是整個監(jiān)督學(xué)習(xí)的過程,監(jiān)督學(xué)習(xí)目前在圖片分類上應(yīng)用得比較多。

非監(jiān)督學(xué)習(xí)里跟監(jiān)督學(xué)習(xí)不同的地方是,非監(jiān)督學(xué)習(xí)不需要為所有的訓(xùn)練數(shù)據(jù)都打上標簽。非監(jiān)督學(xué)習(xí)主要應(yīng)用在兩個大類,第一類是做聚類分析,聚類分析是把一組看似無序的數(shù)據(jù)進行分類分組,以達到能夠更加更好理解的目的。

另外是做自動編碼器,在數(shù)據(jù)分析的時候,原始數(shù)據(jù)量往往比較大,除了包含一些冗余的數(shù)據(jù),還會包含一些對分析結(jié)果不重要的數(shù)據(jù)。自動編碼器主要是對原始數(shù)據(jù)做降維操作,把冗余的數(shù)據(jù)去掉,提高后面數(shù)據(jù)分析的效率。

通過不同的學(xué)習(xí)方式獲取到數(shù)據(jù)后,算法是接下來非常重要的一環(huán)。算法之于計算機就像大腦對于我們?nèi)祟?,選擇一個好的算法也是特別重要的。

神經(jīng)網(wǎng)絡(luò)

神經(jīng)網(wǎng)絡(luò)是受人腦神經(jīng)元結(jié)構(gòu)的啟發(fā),研究者認為人腦所有的神經(jīng)元都是分層的,可以通過不同的層次學(xué)習(xí)不一樣的特征,由簡單到復(fù)雜地模擬出各種特征。

上圖是計算機應(yīng)用數(shù)學(xué)的方式來模擬人腦中神經(jīng)元的示意圖。a1到ak是信號的輸入,神經(jīng)元會對輸入信號進行兩次變換。第一部分是線性變換,因為神經(jīng)元會對自己感興趣的信號加一個權(quán)重;第二部分是非線性變換。

神經(jīng)網(wǎng)絡(luò)就是由許多的神經(jīng)元級聯(lián)而形成的,每一個神經(jīng)元都經(jīng)過線性變換和非線性變換,為什么會有非線性變換?從數(shù)學(xué)上看,沒有非線性變換,不管你神經(jīng)網(wǎng)絡(luò)層次有多深都等價于一個神經(jīng)元。如果沒有非線性變換,神經(jīng)網(wǎng)絡(luò)深度的概念就沒有什么意義了。

卷積神經(jīng)網(wǎng)絡(luò)

以上所講的都是一般的全連接神經(jīng)網(wǎng)絡(luò),接下來進入卷積神經(jīng)網(wǎng)絡(luò)。卷積神經(jīng)網(wǎng)絡(luò)是專門針對圖片處理方面的神經(jīng)網(wǎng)絡(luò)。卷積神經(jīng)網(wǎng)絡(luò)首先會輸入一張圖片,這張圖片有三個顏色通道的數(shù)據(jù),這是輸入層。下面是卷積層,有一個卷積核的概念,每一個卷積核提取圖片的不同特征。

提取出來以后到池化層,就是把卷積層的數(shù)據(jù)規(guī)??s小,減少數(shù)據(jù)的復(fù)雜度。卷積和池化連起來我們叫做一個隱層,一個卷積神經(jīng)網(wǎng)絡(luò)會包含很多個隱層,隱層之后是全連接層,全連接層的目的是把前面經(jīng)過多個卷積池化層的特征把數(shù)據(jù)平鋪開,形成特征向量,我們把特征向量輸入到分類器,對圖片進行分類。

簡單來說,卷積神經(jīng)網(wǎng)絡(luò)更適合計算機視覺主要有兩個原因,一是參數(shù)共享,另外一個是稀疏連接。

2015年基于深度學(xué)習(xí)的計算機視覺算法在ImageNet數(shù)據(jù)庫上的識別準確率首次超過人類,同年Google在開源自己的深度學(xué)習(xí)算法。這些帶動中美兩國的科學(xué)家把計算機視覺算法運用到安防、金融、互聯(lián)網(wǎng)、物流、零售、醫(yī)療、文娛、制造業(yè)等不同垂直行業(yè)。但在實際的運用當(dāng)中,由于數(shù)據(jù)可得性、算法成熟度、服務(wù)的容錯率等因素的影響,落地的速度開始出現(xiàn)分化。其中,移動互聯(lián)網(wǎng)、安防、醫(yī)療、無人駕駛等發(fā)展較慢。

技術(shù)發(fā)展趨勢

提高預(yù)測精度,降低數(shù)據(jù)標注成本隨著技術(shù)的不斷發(fā)展,計算機視覺能夠識別信息的種類從最初的文字信息,到人臉,人的體態(tài)識別,以及各種不同的物體。

能夠識別的精度也從最初的人1:1比對,到用于門禁系統(tǒng)等1:N比對,以及用在黑名單監(jiān)控等場景的M:N動態(tài)監(jiān)控。除了提高算法精度以外,提高數(shù)據(jù)標注的效率也是計算機視覺公司重要的課題之一。

企業(yè)發(fā)展戰(zhàn)略開始分化,商湯向左,曠視向右,計算機視覺技術(shù)在中國的快速落地,吸引了以曠視科技Face++、商湯科技、極鏈科技Video++為代表的以算法為核心競爭力的AI初創(chuàng)公司,擁有強大數(shù)據(jù)采集及軟件開發(fā)能力的互聯(lián)網(wǎng)公司,以及華為這樣的科技巨頭。經(jīng)過一年多的發(fā)展,各個公司都已經(jīng)根據(jù)自己資源的不同,戰(zhàn)略出現(xiàn)了分化。

各類公司初始時在產(chǎn)業(yè)環(huán)節(jié)中各有偏好,初創(chuàng)企業(yè)在算法與模型訓(xùn)練上占優(yōu),互聯(lián)網(wǎng)企業(yè)則擁有天然的數(shù)據(jù)優(yōu)勢,安防企業(yè)則憑借極強的工程能力加速安防項目落地。

AI頭部初創(chuàng)企業(yè)近年來融資動作頻繁,受到資本市場的青睞,在資金方面暫無瓶頸,然而面臨互聯(lián)網(wǎng)巨頭的挑戰(zhàn),各大初創(chuàng)企業(yè)應(yīng)依托已有的獨立設(shè)計算法的能力,構(gòu)建平臺型解決方案,在研發(fā)能力與方案落地速度上取勝。

聲明:本文內(nèi)容及配圖由入駐作者撰寫或者入駐合作網(wǎng)站授權(quán)轉(zhuǎn)載。文章觀點僅代表作者本人,不代表電子發(fā)燒友網(wǎng)立場。文章及其配圖僅供工程師學(xué)習(xí)之用,如有內(nèi)容侵權(quán)或者其他違規(guī)問題,請聯(lián)系本站處理。 舉報投訴
  • AI
    AI
    +關(guān)注

    關(guān)注

    87

    文章

    31262

    瀏覽量

    269628
  • 計算機視覺
    +關(guān)注

    關(guān)注

    8

    文章

    1699

    瀏覽量

    46050
  • 深度學(xué)習(xí)
    +關(guān)注

    關(guān)注

    73

    文章

    5510

    瀏覽量

    121338

原文標題:深度學(xué)習(xí)下的AI落地,計算機視覺是否一條好賽道

文章出處:【微信號:FPGAer_Club,微信公眾號:FPGAer俱樂部】歡迎添加關(guān)注!文章轉(zhuǎn)載請注明出處。

收藏 人收藏

    評論

    相關(guān)推薦

    【小白入門必看】一文讀懂深度學(xué)習(xí)計算機視覺技術(shù)及學(xué)習(xí)路線

    一、什么是計算機視覺計算機視覺,其實就是教機器怎么像我們?nèi)艘粯?,用攝像頭看看周圍的世界,然后理解它。比如說,它能認出這是個蘋果,或者那邊有輛車。除此之外,還能把拍到的照片或者視頻轉(zhuǎn)換
    的頭像 發(fā)表于 10-31 17:00 ?485次閱讀
    【小白入門必看】一文讀懂<b class='flag-5'>深度</b><b class='flag-5'>學(xué)習(xí)</b><b class='flag-5'>計算機</b><b class='flag-5'>視覺</b>技術(shù)及<b class='flag-5'>學(xué)習(xí)</b>路線

    計算機視覺有哪些優(yōu)缺點

    計算機視覺作為人工智能領(lǐng)域的一個重要分支,旨在使計算機能夠像人類一樣理解和解釋圖像和視頻中的信息。這一技術(shù)的發(fā)展不僅推動了多個行業(yè)的變革,也帶來了諸多優(yōu)勢,但同時也伴隨著一些挑戰(zhàn)和局限性。以下是對
    的頭像 發(fā)表于 08-14 09:49 ?1053次閱讀

    機器視覺計算機視覺有什么區(qū)別

    機器視覺計算機視覺是兩個密切相關(guān)但又有所區(qū)別的概念。 一、定義 機器視覺 機器視覺,又稱為計算機
    的頭像 發(fā)表于 07-16 10:23 ?573次閱讀

    計算機視覺的五大技術(shù)

    計算機視覺作為深度學(xué)習(xí)領(lǐng)域最熱門的研究方向之一,其技術(shù)涵蓋了多個方面,為人工智能的發(fā)展開拓了廣闊的道路。以下是對計算機
    的頭像 發(fā)表于 07-10 18:26 ?1462次閱讀

    計算機視覺的工作原理和應(yīng)用

    計算機視覺(Computer Vision,簡稱CV)是一門跨學(xué)科的研究領(lǐng)域,它利用計算機和數(shù)學(xué)算法來模擬人類視覺系統(tǒng)對圖像和視頻進行識別、理解、分析和處理。其核心目標在于使
    的頭像 發(fā)表于 07-10 18:24 ?2163次閱讀

    計算機視覺與人工智能的關(guān)系是什么

    引言 計算機視覺是一門研究如何使計算機能夠理解和解釋視覺信息的學(xué)科。它涉及到圖像處理、模式識別、機器學(xué)習(xí)等多個領(lǐng)域的知識。人工智能則是研究如
    的頭像 發(fā)表于 07-09 09:25 ?705次閱讀

    計算機視覺與智能感知是干嘛的

    引言 計算機視覺(Computer Vision)是一門研究如何使計算機能夠理解和解釋視覺信息的學(xué)科。它涉及到圖像處理、模式識別、機器學(xué)習(xí)
    的頭像 發(fā)表于 07-09 09:23 ?996次閱讀

    計算機視覺和機器視覺區(qū)別在哪

    計算機視覺和機器視覺是兩個密切相關(guān)但又有明顯區(qū)別的領(lǐng)域。 一、定義 計算機視覺 計算機
    的頭像 發(fā)表于 07-09 09:22 ?486次閱讀

    計算機視覺和圖像處理的區(qū)別和聯(lián)系

    計算機視覺和圖像處理是兩個密切相關(guān)但又有明顯區(qū)別的領(lǐng)域。 1. 基本概念 1.1 計算機視覺 計算機視覺
    的頭像 發(fā)表于 07-09 09:16 ?1392次閱讀

    計算機視覺屬于人工智能嗎

    屬于,計算機視覺是人工智能領(lǐng)域的一個重要分支。 引言 計算機視覺是一門研究如何使計算機具有視覺
    的頭像 發(fā)表于 07-09 09:11 ?1360次閱讀

    計算機視覺怎么給圖像分類

    圖像分類是計算機視覺領(lǐng)域中的一項核心任務(wù),其目標是將輸入的圖像自動分配到預(yù)定義的類別集合中。這一過程涉及圖像的特征提取、特征表示以及分類器的設(shè)計與訓(xùn)練。隨著深度學(xué)習(xí)技術(shù)的飛速發(fā)展,圖像
    的頭像 發(fā)表于 07-08 17:06 ?809次閱讀

    深度學(xué)習(xí)計算機視覺領(lǐng)域的應(yīng)用

    隨著人工智能技術(shù)的飛速發(fā)展,深度學(xué)習(xí)作為其中的核心技術(shù)之一,已經(jīng)在計算機視覺領(lǐng)域取得了顯著的成果。計算機
    的頭像 發(fā)表于 07-01 11:38 ?881次閱讀

    計算機視覺的主要研究方向

    計算機視覺(Computer Vision, CV)作為人工智能領(lǐng)域的一個重要分支,致力于使計算機能夠像人眼一樣理解和解釋圖像和視頻中的信息。隨著深度
    的頭像 發(fā)表于 06-06 17:17 ?1032次閱讀

    計算機行業(yè)深度報告

    電子發(fā)燒友網(wǎng)站提供《計算機行業(yè)深度報告.pdf》資料免費下載
    發(fā)表于 03-04 10:07 ?0次下載

    計算機視覺的十大算法

    隨著科技的不斷發(fā)展,計算機視覺領(lǐng)域也取得了長足的進步。本文將介紹計算機視覺領(lǐng)域的十大算法,包括它們的基本原理、應(yīng)用場景和優(yōu)缺點。這些算法在圖像處理、目標檢測、人臉識別等領(lǐng)域有著廣泛的應(yīng)
    的頭像 發(fā)表于 02-19 13:26 ?1285次閱讀
    <b class='flag-5'>計算機</b><b class='flag-5'>視覺</b>的十大算法