《電子技術應用》
您所在的位置:首頁 > 其他 > 设计应用 > 基于双注意力和多区域检测的细粒度图像分类
基于双注意力和多区域检测的细粒度图像分类
2022年电子技术应用第8期
潘新辰,杨小健,秦 岭
南京工业大学 计算机科学与技术学院,江苏 南京211816
摘要: 有效地检测具有辨别性的局部区域和更准确地提取图像的细粒度特征有助于提高细粒度图像的分类效果。为此,提出了一种结合双注意力机制和多区域检测的细粒度图像分类方法。多区域检测旨在通过类别标签学习定位到具有辨别性的图像区域,然后通过特征提取网络提取辨别性局部区域的特征并与全局特征相融合。同样,更精确的特征提取网络能够提取图像细粒度的特征。因此,通过将双注意力机制和多区域检测相结合,所提出的方法在3个公开的细粒度图像数据集CUB-200-2011、StanfordCars和FGVC Aircraft上分别达到了88.3%、94.5%和92.3%的准确率。
中圖分類號: TP301.6
文獻標識碼: A
DOI:10.16157/j.issn.0258-7998.211980
中文引用格式: 潘新辰,楊小健,秦嶺. 基于雙注意力和多區域檢測的細粒度圖像分類[J].電子技術應用,2022,48(8):117-122.
英文引用格式: Pan Xinchen,Yang Xiaojian,Qin Ling. Fine-grained image classification based on dual attentions and multi-region detection[J]. Application of Electronic Technique,2022,48(8):117-122.
Fine-grained image classification based on dual attentions and multi-region detection
Pan Xinchen,Yang Xiaojian,Qin Ling
Computer Science and Technology,Nanjing University of Technology,Nanjing 211816,China
Abstract: Effectively detecting discriminative local areas and more accurately extracting fine-grained features of images will help improve the classification effect of fine-grained images. For this reason, a fine-grained image classification method combining dual attention mechanism and multi-region detection is proposed. Multi-region detection aims to locate discriminative image regions through class label learning, and then extract the features of the discriminative local regions through a feature extraction network and merge them with global features. Similarly, a more precise feature extraction network can extract fine-grained features of an image. Therefore, by combining the dual attention mechanism and multi-region detection, the proposed method respectively achieves 88.3%, 94.5% and 92.3% accuracy on three public fine-grained image datasets, CUB-200-2011, StanfordCars and FGVC Aircraft.
Key words : fine-grained image classification;attention mechanism;regional detection;convolutional neural network;feature extraction;feature group

0 引言

    目前,深度學習技術已被廣泛應用于圖像分類領域,細粒度圖像分類旨在區分同種對象的不同類別。相較于傳統圖像分類,細粒度圖像分類的難點在于:(1)不同類別之間的高相似性,難以找到具有辨別性的區域并提取細節特征;(2)同一種類別之間由于圖像視角、光照、背景和遮擋等因素的變化也存在著一定的差異性。因此,如何定位具有辨別性的局部區域,以及如何更精確地提取細粒度特征,成為目前細粒度圖像分類方法的主要研究方向。

    為了檢測具有辨別性的局部區域,一些方法[1-2]通過人工標注的方式對細粒度圖像中具有辨別性的區域進行標注,然后通過網絡學習定位辨別性局部區域,從而提高網絡模型的分類準確性,需要花費大量的時間、人力對圖像進行標注,成本太大。還有一些方法[3-4]利用類別標簽以弱監督的方式來學習具有辨別性的局部區域,這類方法雖然不能夠達到使用人工標注的標簽進行監督學習的效果,但額外成本幾乎為零。

    注意力機制作為提升網絡特征提取能力的重要手段[5]主要分為通道注意力機制和空間注意力機制,通道注意力機制可以學習到不同通道間的權重關系,空間注意力機制可以學習不同像素間的依賴關系。合理利用以上兩個注意力機制能夠更細粒度提取圖像的特征,從而能夠更好地進行分類。




本文詳細內容請下載:http://m.tom3567.com/resource/share/2000004663




作者信息:

潘新辰,楊小健,秦  嶺

(南京工業大學 計算機科學與技術學院,江蘇 南京211816)



wd.jpg

此內容為AET網站原創,未經授權禁止轉載。
主站蜘蛛池模板: 国产中文字幕免费观看| 99高清视频有精品视频| 国产私拍一区| 国产精品久久久久久久av大片| 国产精品亚洲美女av网站| 日本精品一区二区三区不卡无字幕| 国产精品视频在线播放| 国产三区在线视频| 九九久久国产精品| 久久不射电影网| 免费国产成人看片在线| 亚洲综合激情五月| 国产精品av免费观看| 国产精品久久久久国产a级| 国产在线一区二区三区播放| 久久亚洲a v| 欧美精品卡一卡二| 欧美国产激情视频| 久久久久久久97| 欧美日本国产在线| 人妻无码视频一区二区三区 | 久久久久久久久久久久久久久久久久av| 在线免费一区| 亚洲精品免费av| 亚洲人成网站在线播放2019| 午夜精品久久久久久久无码| 日韩精品一区二区三区四| 日韩视频永久免费观看| 日韩在线激情视频| 日本久久久网站| 久久久久中文字幕| 国产狼人综合免费视频| 国内一区二区在线视频观看| 精品激情国产视频| 国产精品久久久久久久久久| 97碰在线观看| 热久久这里只有精品| 国产美女在线精品免费观看| 国产精品91久久久久久| 91精品久久久久| 欧洲精品久久|