女人自慰AV免费观看内涵网,日韩国产剧情在线观看网址,神马电影网特片网,最新一级电影欧美,在线观看亚洲欧美日韩,黄色视频在线播放免费观看,ABO涨奶期羡澄,第一导航fulione,美女主播操b

0
  • 聊天消息
  • 系統消息
  • 評論與回復
登錄后你可以
  • 下載海量資料
  • 學習在線課程
  • 觀看技術視頻
  • 寫文章/發帖/加入社區
會員中心
創作中心

完善資料讓更多小伙伴認識你,還能領取20積分哦,立即完善>

3天內不再提示

淺析4個計算機視覺領域常用遷移學習模型

新機器視覺 ? 來源:Orhan G. Yal??n ? 2023-04-23 18:08 ? 次閱讀
加入交流群
微信小助手二維碼

掃碼添加小助手

加入工程師交流群

導讀

使用SOTA的預訓練模型來通過遷移學習解決現實的計算機視覺問題。

849ea7fe-daf8-11ed-bfe3-dac502259ad0.png

如果你試過構建高精度機器學習模型,但還沒有試過遷移學習,這篇文章將改變你的生活。至少,對我來說是的。

我們大多數人已經嘗試過,通過幾個機器學習教程來掌握神經網絡的基礎知識。這些教程非常有助于了解人工神經網絡的基本知識,如循環神經網絡,卷積神經網絡,GANs和自編碼器。但是這些教程的主要功能是為你在現實場景中實現做準備。

現在,如果你計劃建立一個利用深度學習人工智能系統,你要么(i)有一個非常大的預算用于培訓優秀的人工智能研究人員,或者(ii)可以從遷移學習中受益。

什么是遷移學習?

遷移學習是機器學習和人工智能的一個分支,其目的是將從一個任務(源任務)中獲得的知識應用到一個不同但相似的任務(目標任務)中。

例如,在學習對維基百科文本進行分類時獲得的知識可以用于解決法律文本分類問題。另一個例子是利用在學習對汽車進行分類時獲得的知識來識別天空中的鳥類。這些樣本之間存在關聯。我們沒有在鳥類檢測上使用文本分類模型。

遷移學習是指從相關的已經學習過的任務中遷移知識,從而對新的任務中的學習進行改進

總而言之,遷移學習是一個讓你不必重復發明輪子的領域,并幫助你在很短的時間內構建AI應用。

遷移學習的歷史

為了展示遷移學習的力量,我們可以引用Andrew Ng的話:

遷移學習將是繼監督學習之后機器學習商業成功的下一個驅動因素

遷移學習的歷史可以追溯到1993年。Lorien Pratt的論文“Discriminability-Based Transfer between Neural Networks”打開了潘多拉的盒子,向世界介紹了遷移學習的潛力。1997年7月,“Machine Learning”雜志發表了一篇遷移學習論文專刊。隨著該領域的深入,諸如多任務學習等相鄰主題也被納入遷移學習領域。“Learning to Learn”是這一領域的先驅書籍之一。如今,遷移學習是科技企業家構建新的人工智能解決方案、研究人員推動機器學習前沿的強大源泉。

84d70df6-daf8-11ed-bfe3-dac502259ad0.png

遷移學習是如何工作的?

實現遷移學習有三個要求:

由第三方開發開源預訓練模型

重用模型

對問題進行微調

開發開源預訓練模型

預訓練的模型是由其他人創建和訓練來解決與我們類似的問題的模型。在實踐中,幾乎總是有人是科技巨頭或一群明星研究人員。他們通常選擇一個非常大的數據集作為他們的基礎數據集,比如ImageNet或Wikipedia Corpus。然后,他們創建一個大型神經網絡(例如,VGG19有143,667,240個參數)來解決一個特定的問題(例如,這個問題用VGG19做圖像分類。)當然,這個預先訓練過的模型必須公開,這樣我們就可以利用這些模型并重新使用它們。

重用模型

在我們掌握了這些預先訓練好的模型之后,我們重新定位學習到的知識,包括層、特征、權重和偏差。有幾種方法可以將預先訓練好的模型加載到我們的環境中。最后,它只是一個包含相關信息的文件/文件夾。然而,深度學習庫已經托管了許多這些預先訓練過的模型,這使得它們更容易訪問:

TensorFlow Hub

Keras Applications

PyTorch Hub

你可以使用上面的一個源來加載經過訓練的模型。它通常會有所有的層和權重,你可以根據你的意愿調整網絡。

對問題進行微調

現在的模型也許能解決我們的問題。對預先訓練好的模型進行微調通常更好,原因有兩個:

這樣我們可以達到更高的精度。

我們的微調模型可以產生正確的格式的輸出。

一般來說,在神經網絡中,底層和中層通常代表一般的特征,而頂層則代表特定問題的特征。由于我們的新問題與原來的問題不同,我們傾向于刪除頂層。通過為我們的問題添加特定的層,我們可以達到更高的精度。

在刪除頂層之后,我們需要放置自己的層,這樣我們就可以得到我們想要的輸出。例如,使用ImageNet訓練的模型可以分類多達1000個對象。如果我們試圖對手寫數字進行分類(例如,MNIST classification),那么最后得到一個只有10個神經元的層可能會更好。

在我們將自定義層添加到預先訓練好的模型之后,我們可以用特殊的損失函數和優化器來配置它,并通過額外的訓練進行微調。

計算機視覺中的4個預訓練模型

這里有四個預先訓練好的網絡,可以用于計算機視覺任務,如圖像生成、神經風格轉換、圖像分類、圖像描述、異常檢測等:

VGG19

Inceptionv3 (GoogLeNet)

ResNet50

EfficientNet

讓我們一個一個地深入研究。

VGG-19

VGG是一種卷積神經網絡,深度為19層。它是由牛津大學的Karen Simonyan和Andrew Zisserman在2014年構建和訓練的,論文為:Very Deep Convolutional Networks for large Image Recognition。VGG-19網絡還使用ImageNet數據庫中的100多萬張圖像進行訓練。當然,你可以使用ImageNet訓練過的權重導入模型。這個預先訓練過的網絡可以分類多達1000個物體。對224x224像素的彩色圖像進行網絡訓練。以下是關于其大小和性能的簡要信息:

大小:549 MB

Top-1 準確率:71.3%

Top-5 準確率:90.0%

參數個數:143,667,240

深度:26

84e90ede-daf8-11ed-bfe3-dac502259ad0.jpg

Inceptionv3 (GoogLeNet)

Inceptionv3是一個深度為50層的卷積神經網絡。它是由谷歌構建和訓練的,你可以查看這篇論文:“Going deep with convolutions”。預訓練好的帶有ImageNet權重的Inceptionv3可以分類多達1000個對象。該網絡的圖像輸入大小為299x299像素,大于VGG19網絡。VGG19是2014年ImageNet競賽的亞軍,而Inception是冠軍。以下是對Inceptionv3特性的簡要總結:

尺寸:92 MB

Top-1 準確率:77.9%

Top-5 準確率:93.7%

參數數量:23,851,784

深度:159

850261ae-daf8-11ed-bfe3-dac502259ad0.jpg

ResNet50 (Residual Network)

ResNet50是一個卷積神經網絡,深度為50層。它是由微軟于2015年建立和訓練的,論文:[Deep Residual Learning for Image Recognition](http://deep Residual Learning for Image Recognition /)。該模型對ImageNet數據庫中的100多萬張圖像進行了訓練。與VGG-19一樣,它可以分類多達1000個對象,網絡訓練的是224x224像素的彩色圖像。以下是關于其大小和性能的簡要信息:

尺寸:98 MB

Top-1 準確率:74.9%

Top-5 準確率:92.1%

參數數量:25,636,712

如果你比較ResNet50和VGG19,你會發現ResNet50實際上比VGG19性能更好,盡管它的復雜性更低。你也可以使用更新的版本,如ResNet101,ResNet152,ResNet50V2,ResNet101V2,ResNet152V2。

8510ac00-daf8-11ed-bfe3-dac502259ad0.jpg

EfficientNet

EfficientNet是一種最先進的卷積神經網絡,由谷歌在2019年的論文“efficient entnet: Rethinking Model Scaling for convolutional neural Networks”中訓練并發布。EfficientNet有8種可選實現(B0到B7),甚至最簡單的EfficientNet B0也是非常出色的。通過530萬個參數,實現了77.1%的最高精度性能。

85210df2-daf8-11ed-bfe3-dac502259ad0.png

EfficientNetB0的特性簡要介紹如下:

尺寸:29 MB

Top-1 準確率:77.1%

Top-5 準確率:93.3%

參數數量:~5,300,000

深度:159

其他的計算機視覺問題的預訓練模型

我們列出了四種最先進的獲獎卷積神經網絡模型。然而,還有幾十種其他模型可供遷移學習使用。下面是對這些模型的基準分析,這些模型都可以在Keras Applications中獲得。

85359d9e-daf8-11ed-bfe3-dac502259ad0.png

總結

在一個我們可以很容易地獲得最先進的神經網絡模型的世界里,試圖用有限的資源建立你自己的模型就像是在重復發明輪子,是毫無意義的。

相反,嘗試使用這些訓練模型,在上面添加一些新的層,考慮你的特殊計算機視覺任務,然后訓練。其結果將比你從頭構建的模型更成功。





審核編輯:劉清

聲明:本文內容及配圖由入駐作者撰寫或者入駐合作網站授權轉載。文章觀點僅代表作者本人,不代表電子發燒友網立場。文章及其配圖僅供工程師學習之用,如有內容侵權或者其他違規問題,請聯系本站處理。 舉報投訴
  • 人工智能
    +關注

    關注

    1806

    文章

    49014

    瀏覽量

    249433
  • 計算機視覺
    +關注

    關注

    9

    文章

    1709

    瀏覽量

    46777
  • 機器學習
    +關注

    關注

    66

    文章

    8503

    瀏覽量

    134601
  • 卷積神經網絡

    關注

    4

    文章

    369

    瀏覽量

    12299

原文標題:4個計算機視覺領域常用遷移學習模型

文章出處:【微信號:vision263com,微信公眾號:新機器視覺】歡迎添加關注!文章轉載請注明出處。

收藏 人收藏
加入交流群
微信小助手二維碼

掃碼添加小助手

加入工程師交流群

    評論

    相關推薦
    熱點推薦

    英飛凌邊緣AI平臺通過Ultralytics YOLO模型增加對計算機視覺的支持

    計算機視覺的支持,擴大了當前對音頻、雷達和其他時間序列信號數據的支持范圍。在增加這項支持后,該平臺將能夠用于開發低功耗、低內存的邊緣AI視覺模型。這將給諸多應用
    的頭像 發表于 03-11 15:11 ?385次閱讀
    英飛凌邊緣AI平臺通過Ultralytics YOLO<b class='flag-5'>模型</b>增加對<b class='flag-5'>計算機</b><b class='flag-5'>視覺</b>的支持

    模型領域常用名詞解釋(近100

    本文總結了大模型領域常用的近100名詞解釋,并按照模型架構與基礎概念,訓練方法與技術,模型優化與壓縮,推理與應用,
    的頭像 發表于 02-19 11:49 ?787次閱讀
    大<b class='flag-5'>模型領域</b><b class='flag-5'>常用</b>名詞解釋(近100<b class='flag-5'>個</b>)

    量子計算機與普通計算機工作原理的區別

    ? 本文介紹了量子計算機與普通計算機工作原理的區別。 量子計算是一新興的研究領域,科學家們利用量子力學,制造出具有革命性能力的
    的頭像 發表于 11-24 11:00 ?1481次閱讀
    量子<b class='flag-5'>計算機</b>與普通<b class='flag-5'>計算機</b>工作原理的區別

    工業計算機類型介紹

    工業領域沒有計算機的世界就像沒有管弦樂隊的交響樂,缺乏實現最佳性能所需的和諧和精確度。計算機徹底改變了工業的運作方式,將效率、準確性和創新推向了新的高度。事實上,根據最近在印度進行的一項研究
    的頭像 發表于 11-04 15:56 ?664次閱讀
    工業<b class='flag-5'>計算機</b>類型介紹

    ROM對計算機性能的影響

    只讀存儲器(ROM)是計算機硬件中的一重要組成部分,它負責存儲計算機啟動時必需的固件和基本輸入輸出系統(BIOS)。ROM的性能和質量對計算機的整體性能有著深遠的影響。 ROM的基本
    的頭像 發表于 11-04 10:31 ?1216次閱讀

    【小白入門必看】一文讀懂深度學習計算機視覺技術及學習路線

    一、什么是計算機視覺計算機視覺,其實就是教機器怎么像我們人一樣,用攝像頭看看周圍的世界,然后理解它。比如說,它能認出這是蘋果,或者那邊有
    的頭像 發表于 10-31 17:00 ?1241次閱讀
    【小白入門必看】一文讀懂深度<b class='flag-5'>學習</b><b class='flag-5'>計算機</b><b class='flag-5'>視覺</b>技術及<b class='flag-5'>學習</b>路線

    晶體管計算機和電子管計算機有什么區別

    晶體管計算機和電子管計算機作為計算機發展史上的兩重要階段,它們在多個方面存在顯著的區別。以下是對這兩類計算機在硬件、性能、應用以及技術發展
    的頭像 發表于 08-23 15:28 ?3606次閱讀

    如何利用ARMxy ARM嵌入式計算機的NPU進行深度學習模型的訓練和優化?

    在正文開始前,我們先大致了解鋇錸的ARMxy ARM嵌入式計算機,再來說說我們如何利用ARMxy ARM嵌入式計算機的NPU來實現深度學習模型的訓練和優化。 ARMxy系列的 ARM?
    的頭像 發表于 08-20 13:43 ?755次閱讀
    如何利用ARMxy ARM嵌入式<b class='flag-5'>計算機</b>的NPU進行深度<b class='flag-5'>學習</b><b class='flag-5'>模型</b>的訓練和優化?

    ARMxy ARM嵌入式計算機搭載 1 TOPS NPU支持深度學習

    ARMxy ARM嵌入式計算機BL410系列內置了1TOPS算力 NPU,它每秒可以執行高達一萬億次的浮點運算,這為復雜的圖像處理和深度學習任務提供了充足的計算資源。在產品缺陷檢測領域
    的頭像 發表于 08-20 11:53 ?849次閱讀
    ARMxy ARM嵌入式<b class='flag-5'>計算機</b>搭載 1 TOPS NPU支持深度<b class='flag-5'>學習</b>

    計算機視覺有哪些優缺點

    計算機視覺作為人工智能領域的一重要分支,旨在使計算機能夠像人類一樣理解和解釋圖像和視頻中的信息。這一技術的發展不僅推動了多個行業的變革,也
    的頭像 發表于 08-14 09:49 ?2043次閱讀

    圖像處理器與計算機視覺有什么關系和區別

    圖像處理器與計算機視覺是兩在圖像處理領域緊密相連但又有所區別的概念。它們之間的關系和區別可以從多個維度進行探討。
    的頭像 發表于 08-14 09:36 ?1045次閱讀

    計算機視覺中的圖像融合

    在許多計算機視覺應用中(例如機器人運動和醫學成像),需要將多個圖像的相關信息整合到單一圖像中。這種圖像融合可以提供更高的可靠性、準確性和數據質量。多視圖融合可以提高圖像分辨率,并恢復場景的三維表示
    的頭像 發表于 08-01 08:28 ?1141次閱讀
    <b class='flag-5'>計算機</b><b class='flag-5'>視覺</b>中的圖像融合

    地平線科研論文入選國際計算機視覺頂會ECCV 2024

    近日,地平線兩篇論文入選國際計算機視覺頂會ECCV 2024,自動駕駛算法技術再有新突破。
    的頭像 發表于 07-27 11:10 ?1465次閱讀
    地平線科研論文入選國際<b class='flag-5'>計算機</b><b class='flag-5'>視覺</b>頂會ECCV 2024

    計算機系統的組成和功能

    計算機系統是一復雜而龐大的概念,它涵蓋了計算機硬件、軟件以及它們之間相互作用的所有元素。為了全面而深入地探討計算機系統,本文將從定義、組成、功能、發展歷程以及未來趨勢等方面進行詳細闡
    的頭像 發表于 07-24 17:41 ?2403次閱讀

    計算機視覺技術的AI算法模型

    計算機視覺技術作為人工智能領域的一重要分支,旨在使計算機能夠像人類一樣理解和解釋圖像及視頻中的信息。為了實現這一目標,
    的頭像 發表于 07-24 12:46 ?1806次閱讀