R2Det: Exploring Relaxed Rotation Equivariance in 2D object detection

Wu, Zhiqiang; Liu, Yingjie; Dong, Hanlin; Tang, Xuan; Yang, Jian; Jin, Bo; Chen, Mingsong; Wei, Xian

Computer Science > Computer Vision and Pattern Recognition

arXiv:2408.11760 (cs)

[Submitted on 21 Aug 2024 (v1), last revised 4 Mar 2025 (this version, v3)]

Title:R2Det: Exploring Relaxed Rotation Equivariance in 2D object detection

Authors:Zhiqiang Wu, Yingjie Liu, Hanlin Dong, Xuan Tang, Jian Yang, Bo Jin, Mingsong Chen, Xian Wei

View PDF HTML (experimental)

Abstract:Group Equivariant Convolution (GConv) empowers models to explore underlying symmetry in data, improving performance. However, real-world scenarios often deviate from ideal symmetric systems caused by physical permutation, characterized by non-trivial actions of a symmetry group, resulting in asymmetries that affect the outputs, a phenomenon known as Symmetry Breaking. Traditional GConv-based methods are constrained by rigid operational rules within group space, assuming data remains strictly symmetry after limited group transformations. This limitation makes it difficult to adapt to Symmetry-Breaking and non-rigid transformations. Motivated by this, we mainly focus on a common scenario: Rotational Symmetry-Breaking. By relaxing strict group transformations within Strict Rotation-Equivariant group $\mathbf{C}_n$, we redefine a Relaxed Rotation-Equivariant group $\mathbf{R}_n$ and introduce a novel Relaxed Rotation-Equivariant GConv (R2GConv) with only a minimal increase of $4n$ parameters compared to GConv. Based on R2GConv, we propose a Relaxed Rotation-Equivariant Network (R2Net) as the backbone and develop a Relaxed Rotation-Equivariant Object Detector (R2Det) for 2D object detection. Experimental results demonstrate the effectiveness of the proposed R2GConv in natural image classification, and R2Det achieves excellent performance in 2D object detection with improved generalization capabilities and robustness. The code is available in \texttt{this https URL}.

Subjects:	Computer Vision and Pattern Recognition (cs.CV); Artificial Intelligence (cs.AI)
Cite as:	arXiv:2408.11760 [cs.CV]
	(or arXiv:2408.11760v3 [cs.CV] for this version)
	https://doi.org/10.48550/arXiv.2408.11760

Submission history

From: Zhiqiang Wu [view email]
[v1] Wed, 21 Aug 2024 16:32:03 UTC (1,359 KB)
[v2] Thu, 27 Feb 2025 08:02:36 UTC (1,420 KB)
[v3] Tue, 4 Mar 2025 14:04:07 UTC (1,420 KB)

Computer Science > Computer Vision and Pattern Recognition

Title:R2Det: Exploring Relaxed Rotation Equivariance in 2D object detection

Submission history

Access Paper:

References & Citations

Bookmark

Bibliographic and Citation Tools

Code, Data and Media Associated with this Article

Demos

Recommenders and Search Tools

arXivLabs: experimental projects with community collaborators

Computer Science > Computer Vision and Pattern Recognition

Title:R2Det: Exploring Relaxed Rotation Equivariance in 2D object detection

Submission history

Access Paper:

References & Citations

BibTeX formatted citation

Bookmark

Bibliographic and Citation Tools

Code, Data and Media Associated with this Article

Demos

Recommenders and Search Tools

arXivLabs: experimental projects with community collaborators