《電子技術應用》
您所在的位置:首頁 > 其他 > 设计应用 > 基于注意力机制的无监督单目标跟踪算法
基于注意力机制的无监督单目标跟踪算法
信息技术与网络安全 6期
林志雄,吴丽君,陈志聪
(福州大学 物理与信息工程学院,福建 福州350108)
摘要: 为提升目标跟踪精度,设计一种基于注意力机制的无监督单目标跟踪算法。该算法使用DCFNet网络作为基本网络,通过前向跟踪和后向验证实现无监督跟踪。为结合上下文信息,引入特征融合方法,且将DCFNet网络每一层所提取的特征通过双线性池化调整分辨率以便进行特征融合;为关注不同特征通道上的关系,引入通道注意力机制SENet模块;设计一个反向逐帧验证方法,在反向验证中间帧的基础上再预测第一帧,进而减少判别位置的误差。在公共数据集OTB-2015上的测试结果显示,本算法AUC分数达60.6%,速度达61FPS。与无监督单目标跟踪UDT算法相比,所设计算法取得了更优的目标跟踪性能。
中圖分類號: TP391
文獻標識碼: A
DOI: 10.19358/j.issn.2096-5133.2022.06.009
引用格式: 林志雄,吳麗君,陳志聰. 基于注意力機制的無監督單目標跟蹤算法[J].信息技術與網絡安全,2022,41(6):50-56.
Unsupervised single target tracking algorithm based on attention mechanism
Lin Zhixiong,Wu Lijun,Chen Zhicong
(College of Physics and Information Engineering,Fuzhou University,Fuzhou 350108,China)
Abstract: In order to improve target tracking accuracy, this paper designs an unsupervised single target tracking algorithm based on attention mechanism. The algorithm uses the DCFNet network as the basic network to achieve unsupervised tracking through forward tracking and backward verification. In order to combine the context information, a feature fusion method is introduced, and the features extracted by each layer of the DCFNet network are adjusted for resolution by bilinear pooling for feature fusion; in order to pay attention to the relationship between different feature channels, a channel attention mechanism SENet module is introduced; a reverse frame-by-frame verification method is designed, and the first frame is predicted based on the reverse verification of the intermediate frame, thereby reducing the error of the discriminant position. The test results on the public dataset OTB-2015 show that the AUC score of this algorithm is 60.6% and the speed is 61FPS. Compared with the unsupervised single-target tracking UDT algorithm, the designed algorithm achieves better target tracking performance.
Key words : target tracking;unsupervised learning;feature fusion;attention mechanism

0 引言

目標跟蹤被廣泛應用于視頻監控和自動駕駛等領域。在給定視頻第一幀中目標位置后,目標跟蹤的任務是得到目標在后續幀中的位置信息。在有遮擋、變形和背景混亂等場景下, 準確有效地檢測和定位目標仍然是個難點。

深度網絡由于可以加強特征表示,被廣泛用于視覺目標跟蹤領域。TAO等人提出SINT網絡[1],首次利用孿生網絡提取特征,通過匹配初始目標的外觀識別候選圖像位置,實現目標跟蹤任務;BERTINETTO等人提出SiamFC(Siamses Fully Convolution)網絡[2],使用離線訓練的完全卷積孿生網絡作為跟蹤系統的基本網絡,大大提高了跟蹤性能;LI等人[3]提出了SiamRPN網絡,基于SiamFC網絡引入了區域提案網絡RPN模塊[4],讓跟蹤系統可以回歸位置、形狀,進一步提高性能并加速;在此之前,基于孿生網絡的跟蹤器往往使用較淺的網絡,很大原因在于深層網絡的填充會破壞平移不變性,導致跟蹤性能下降。LI等人[5]提出在訓練過程中引入位置均衡的采樣策略,來緩解網絡在訓練過程中存在的位置偏見問題,進而在SiamRPN網絡基礎上用了ResNet網絡[6]作為主干網絡,讓跟蹤模型性能不再受制于網絡的容量。

以上這些單目標跟蹤模型都是屬于有監督學習,有監督學習需要大量的有標記數據集,但是手動標記既昂貴又耗時。而互聯網上有大量的未標記視頻可供使用,因此無監督目標跟蹤算法具有更好的實際應用價值。WANG等人[7]提出了UDT(Unsupervised Deep Tracking)模型,通過將前向傳播和反向預測的結果進行一致性損失計算,實現在沒有標簽的情況下同樣優化模型。但在前向傳播過程中,跟蹤模型若預測的位置出錯,經過反向修正后可能會再回到正確的位置,這就會導致前向傳播的錯誤預測沒有被懲罰,降低了模型跟蹤性能。為此,WANG等人又進一步提出UDT+模型[8],通過多幀驗證方法懲罰前向傳播的錯誤預測,提升位置預測的準確性。




本文詳細內容請下載:http://m.tom3567.com/resource/share/2000004535





作者信息:

林志雄,吳麗君,陳志聰

(福州大學 物理與信息工程學院,福建 福州350108)




微信圖片_20210517164139.jpg

此內容為AET網站原創,未經授權禁止轉載。
主站蜘蛛池模板: 日日摸天天爽天天爽视频| 中文网丁香综合网| 免费99精品国产自在在线| 久久亚洲私人国产精品va| 亚洲午夜精品一区二区三区| 久久99精品视频一区97| 日韩视频欧美视频| 精品国产中文字幕| 久久最新免费视频| 日韩高清国产一区在线观看| 91九色国产ts另类人妖| 国产精品视频色| 国产日韩欧美日韩大片| 欧美极品日韩| 欧美精品v日韩精品v国产精品| 中文字幕久久一区| 国产精品久久精品| 久久九九视频| 欧美日韩高清在线观看| 日韩视频在线观看国产| 99精品国产高清在线观看| 国产精品美女xx| 国产精品一区二区三区观看| 久久精品美女| 久久av一区二区| 精品国产一区二区三区在线观看| 欧美精品在线一区| 免费91麻豆精品国产自产在线观看| 日本丰满少妇黄大片在线观看 | 日韩在线精品视频| 国产成人精品日本亚洲11| www亚洲精品| 91国自产精品中文字幕亚洲| 99色精品视频| 伊人久久在线观看| 日韩精品视频久久| 久久人人爽亚洲精品天堂| 久久国产精品久久久久久| 国产欧美久久久久| 国产精品99一区| 91国自产精品中文字幕亚洲|