LW-DETR: A Transformer Replacement to YOLO for Real-Time Detection
Fuente:
arXiv
Salvato in:
| Autori principali: | Chen, Qiang, Su, Xiangbo, Zhang, Xinyu, Wang, Jian, Chen, Jiahui, Shen, Yunpeng, Han, Chuchu, Chen, Ziliang, Xu, Weixiang, Li, Fanrong, Zhang, Shan, Yao, Kun, Ding, Errui, Zhang, Gang, Wang, Jingdong |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
OVLW-DETR: Open-Vocabulary Light-Weighted Detection Transformer
di: Wang, Yu, et al.
Pubblicazione: (2024)
di: Wang, Yu, et al.
Pubblicazione: (2024)
MS-DETR: Efficient DETR Training with Mixed Supervision
di: Zhao, Chuyang, et al.
Pubblicazione: (2024)
di: Zhao, Chuyang, et al.
Pubblicazione: (2024)
VRP-SAM: SAM with Visual Reference Prompt
di: Sun, Yanpeng, et al.
Pubblicazione: (2024)
di: Sun, Yanpeng, et al.
Pubblicazione: (2024)
LaMI-DETR: Open-Vocabulary Detection with Language Model Instruction
di: Du, Penghui, et al.
Pubblicazione: (2024)
di: Du, Penghui, et al.
Pubblicazione: (2024)
KD-DETR: Knowledge Distillation for Detection Transformer with Consistent Distillation Points Sampling
di: Wang, Yu, et al.
Pubblicazione: (2022)
di: Wang, Yu, et al.
Pubblicazione: (2022)
FullAnno: A Data Engine for Enhancing Image Comprehension of MLLMs
di: Hao, Jing, et al.
Pubblicazione: (2024)
di: Hao, Jing, et al.
Pubblicazione: (2024)
Add-SD: Rational Generation without Manual Reference
di: Yang, Lingfeng, et al.
Pubblicazione: (2024)
di: Yang, Lingfeng, et al.
Pubblicazione: (2024)
Interpretable Face Anti-Spoofing: Enhancing Generalization with Multimodal Large Language Models
di: Zhang, Guosheng, et al.
Pubblicazione: (2025)
di: Zhang, Guosheng, et al.
Pubblicazione: (2025)
PillarDETR: YOLO-Backbone and RT-DETR Head for Real-Time 3D Object Detection
di: Kadvani, Smit, et al.
Pubblicazione: (2026)
di: Kadvani, Smit, et al.
Pubblicazione: (2026)
Improving Multi-modal Large Language Model through Boosting Vision Capabilities
di: Sun, Yanpeng, et al.
Pubblicazione: (2024)
di: Sun, Yanpeng, et al.
Pubblicazione: (2024)
GGRt: Towards Pose-free Generalizable 3D Gaussian Splatting in Real-time
di: Li, Hao, et al.
Pubblicazione: (2024)
di: Li, Hao, et al.
Pubblicazione: (2024)
Towards Unified Multi-granularity Text Detection with Interactive Attention
di: Wan, Xingyu, et al.
Pubblicazione: (2024)
di: Wan, Xingyu, et al.
Pubblicazione: (2024)
ALoRE: Efficient Visual Adaptation via Aggregating Low Rank Experts
di: Du, Sinan, et al.
Pubblicazione: (2024)
di: Du, Sinan, et al.
Pubblicazione: (2024)
MesonGS: Post-training Compression of 3D Gaussians via Efficient Attribute Transformation
di: Xie, Shuzhao, et al.
Pubblicazione: (2024)
di: Xie, Shuzhao, et al.
Pubblicazione: (2024)
MonoFormer: One Transformer for Both Diffusion and Autoregression
di: Zhao, Chuyang, et al.
Pubblicazione: (2024)
di: Zhao, Chuyang, et al.
Pubblicazione: (2024)
The law of iterated logarithm for numerical approximation of time-homogeneous Markov process
di: Chen, Chuchu, et al.
Pubblicazione: (2025)
di: Chen, Chuchu, et al.
Pubblicazione: (2025)
TinyFormer: Preserving Tiny Objects in YOLO-DETR Hybrid Real-time Detectors
di: Hsieh, Jun-Wei, et al.
Pubblicazione: (2026)
di: Hsieh, Jun-Wei, et al.
Pubblicazione: (2026)
RiO-DETR: DETR for Real-time Oriented Object Detection
di: Hu, Zhangchi, et al.
Pubblicazione: (2026)
di: Hu, Zhangchi, et al.
Pubblicazione: (2026)
DEYO: DETR with YOLO for End-to-End Object Detection
di: Ouyang, Haodong
Pubblicazione: (2024)
di: Ouyang, Haodong
Pubblicazione: (2024)
MM-DETR: An Efficient Multimodal Detection Transformer with Mamba-Driven Dual-Granularity Fusion and Frequency-Aware Modality Adapters
di: Han, Jianhong, et al.
Pubblicazione: (2025)
di: Han, Jianhong, et al.
Pubblicazione: (2025)
XLD: A Cross-Lane Dataset for Benchmarking Novel Driving View Synthesis
di: Li, Hao, et al.
Pubblicazione: (2024)
di: Li, Hao, et al.
Pubblicazione: (2024)
Salience DETR: Enhancing Detection Transformer with Hierarchical Salience Filtering Refinement
di: Hou, Xiuquan, et al.
Pubblicazione: (2024)
di: Hou, Xiuquan, et al.
Pubblicazione: (2024)
Rank-Transformed Dissimilarity Profiles for High-Dimensional Classification
di: Mo, Xiangbo, et al.
Pubblicazione: (2023)
di: Mo, Xiangbo, et al.
Pubblicazione: (2023)
SCMEO-DETR
di: Chen, Shanle
Pubblicazione: (2026)
di: Chen, Shanle
Pubblicazione: (2026)
LayoutDETR: Detection Transformer Is a Good Multimodal Layout Designer
di: Yu, Ning, et al.
Pubblicazione: (2022)
di: Yu, Ning, et al.
Pubblicazione: (2022)
Large Language Models Can Solve Real-World Planning Rigorously with Formal Verification Tools
di: Hao, Yilun, et al.
Pubblicazione: (2024)
di: Hao, Yilun, et al.
Pubblicazione: (2024)
Evaluating Stenosis Detection with Grounding DINO, YOLO, and DINO-DETR
di: Ansari, Muhammad Musab
Pubblicazione: (2025)
di: Ansari, Muhammad Musab
Pubblicazione: (2025)
Dual-R-DETR: Resolving Query Competition with Pairwise Routing in Transformer Decoders
di: Zhang, Ye, et al.
Pubblicazione: (2025)
di: Zhang, Ye, et al.
Pubblicazione: (2025)
Continual SFT Matches Multimodal RLHF with Negative Supervision
di: Zhu, Ke, et al.
Pubblicazione: (2024)
di: Zhu, Ke, et al.
Pubblicazione: (2024)
YOLO-IOD: Towards Real Time Incremental Object Detection
di: Zhang, Shizhou, et al.
Pubblicazione: (2025)
di: Zhang, Shizhou, et al.
Pubblicazione: (2025)
NL2TL: Transforming Natural Languages to Temporal Logics using Large Language Models
di: Chen, Yongchao, et al.
Pubblicazione: (2023)
di: Chen, Yongchao, et al.
Pubblicazione: (2023)
SEED: A Simple and Effective 3D DETR in Point Clouds
di: Liu, Zhe, et al.
Pubblicazione: (2024)
di: Liu, Zhe, et al.
Pubblicazione: (2024)
Decoupled Pseudo-labeling for Semi-Supervised Monocular 3D Object Detection
di: Zhang, Jiacheng, et al.
Pubblicazione: (2024)
di: Zhang, Jiacheng, et al.
Pubblicazione: (2024)
GIR: 3D Gaussian Inverse Rendering for Relightable Scene Factorization
di: Shi, Yahao, et al.
Pubblicazione: (2023)
di: Shi, Yahao, et al.
Pubblicazione: (2023)
VDG: Vision-Only Dynamic Gaussian for Driving Simulation
di: Li, Hao, et al.
Pubblicazione: (2024)
di: Li, Hao, et al.
Pubblicazione: (2024)
Superiority of stochastic symplectic methods via the law of iterated logarithm
di: Chen, Chuchu, et al.
Pubblicazione: (2024)
di: Chen, Chuchu, et al.
Pubblicazione: (2024)
Symplectic methods for stochastic Hamiltonian systems: asymptotic error distributions and Hamiltonian-specific analysis
di: Chen, Chuchu, et al.
Pubblicazione: (2025)
di: Chen, Chuchu, et al.
Pubblicazione: (2025)
Skim then Focus: Integrating Contextual and Fine-grained Views for Repetitive Action Counting
di: Zhao, Zhengqi, et al.
Pubblicazione: (2024)
di: Zhao, Zhengqi, et al.
Pubblicazione: (2024)
Cycle-YOLO: A Efficient and Robust Framework for Pavement Damage Detection
di: Li, Zhengji, et al.
Pubblicazione: (2024)
di: Li, Zhengji, et al.
Pubblicazione: (2024)
MS-DETR: Multispectral Pedestrian Detection Transformer with Loosely Coupled Fusion and Modality-Balanced Optimization
di: Xing, Yinghui, et al.
Pubblicazione: (2023)
di: Xing, Yinghui, et al.
Pubblicazione: (2023)
Documenti analoghi
-
OVLW-DETR: Open-Vocabulary Light-Weighted Detection Transformer
di: Wang, Yu, et al.
Pubblicazione: (2024) -
MS-DETR: Efficient DETR Training with Mixed Supervision
di: Zhao, Chuyang, et al.
Pubblicazione: (2024) -
VRP-SAM: SAM with Visual Reference Prompt
di: Sun, Yanpeng, et al.
Pubblicazione: (2024) -
LaMI-DETR: Open-Vocabulary Detection with Language Model Instruction
di: Du, Penghui, et al.
Pubblicazione: (2024) -
KD-DETR: Knowledge Distillation for Detection Transformer with Consistent Distillation Points Sampling
di: Wang, Yu, et al.
Pubblicazione: (2022)