原文:ICCV2021 |重新思考人群中的計數和定位:一個純粹基於點的框架

論文:Rethinking Counting and Localization in Crowds:A Purely Point Based Framework 代碼:https: github.com TencentYoutuResearch CrowdCounting P PNet 獲取:在公眾號CV技術指南中回復關鍵字 可下載此論文 歡迎關注公眾號 CV技術指南 ,專注於計算機視覺的技術總 ...

2021-08-14 19:52 0 126 推薦指數:

查看詳情

ICCV2021 | Vision Transformer相對位置編碼的反思與改進

​前言 在計算機視覺,相對位置編碼的有效性還沒有得到很好的研究,甚至仍然存在爭議,本文分析了相對位置編碼的幾個關鍵因素,提出了一種新的針對2D圖像的相對位置編碼方法,稱為圖像RPE(IRPE)。 本文來自公眾號CV技術指南的論文分享系列 關注公眾號CV技術指南 ,專注於計算機視覺 ...

Sun Nov 21 00:29:00 CST 2021 0 199
ICCV2021 | MicroNet:以極低的 FLOPs 改進圖像識別

​前言:這篇論文旨在以極低的計算成本解決性能大幅下降的問題。提出了微分解卷積,將卷積矩陣分解為低秩矩陣,將稀疏連接整合到卷積。提出了一個新的動態激活函數-- Dynamic Shift Max,通過最大化輸入特征圖與其循環通道移位之間的多個動態融合來改善非線性。 在這兩個新操作的基礎上,得到 ...

Mon Sep 13 07:27:00 CST 2021 0 269
ICCV2021 | SOTR:使用transformer分割物體

​前言 本文介紹了現有實例分割方法的一些缺陷,以及transformer用於實例分割的困難,提出了一個基於transformer的高質量實例分割模型SOTR。 經實驗表明,SOTR不僅為實例分割提供了一個新的框架,還在MS Coco數據集上超過了SOTA實例分割方法。 本文來自公眾號 ...

Fri Nov 26 20:28:00 CST 2021 0 1009
ICCV2021 | 用於視覺跟蹤的學習時空型transformer

​ 前言 本文介紹了一個端到端的用於視覺跟蹤的transformer模型,它能夠捕獲視頻序列中空間和時間信息的全局特征依賴關系。在五個具有挑戰性的短期和長期基准上實現了SOTA性能,具有實時性,比Siam R-CNN快6倍。 本文來自公眾號CV技術指南的論文分享系列 關注公眾號 ...

Sat Dec 11 05:11:00 CST 2021 0 319
ICCV2021 | TOOD:任務對齊的單階段目標檢測

​前言 單階段目標檢測通常通過優化目標分類和定位兩個子任務來實現,使用具有兩個平行分支的頭部,這可能會導致兩個任務之間的預測出現一定程度的空間錯位。本文提出了一種任務對齊的一階段目標檢測(TOOD),它以基於學習的方式顯式地對齊這兩個任務。 TOOD在MS-CoCO上實現了51.1Ap的單模 ...

Wed Dec 08 03:53:00 CST 2021 0 897
ICCV2021 | Swin Transformer: 使用移位窗口的分層視覺Transformer

​ 前言 本文解讀的論文是ICCV2021的最佳論文,在短短幾個月內,google scholar上有388引用次數,github上有6.1k star。 本文來自公眾號CV技術指南的論文分享系列 關注公眾號CV技術指南 ,專注於計算機視覺的技術總結、最新技術跟蹤、經典論文解讀 ...

Sun Nov 28 23:29:00 CST 2021 0 186
ICCV2021 | TransFER:使用Transformer學習關系感知的面部表情表征

​ 前言 人臉表情識別(FER)在計算機視覺領域受到越來越多的關注。本文介紹了一篇在人臉表情識別方向上使用Transformer來學習關系感知的ICCV2021論文,論文提出了一個TransFER模型,在幾個FER基准數據集上取得了SOTA性能。 本文來自公眾號CV技術指南的論文 ...

Fri Nov 19 04:16:00 CST 2021 0 306
 
粵ICP備18138465號   © 2018-2025 CODEPRJ.COM