Scalable and Generalizable Correspondence Pruning via Geometry-Consistent Pre-training
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Liao, Tangfei, Zhang, Xiaoqin, Wang, Tao, Ye, Hao, Li, Min, Xiao, Guobao, Ye, Mang |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
VSFormer: Visual-Spatial Fusion Transformer for Correspondence Pruning
par: Liao, Tangfei, et autres
Publié: (2023)
par: Liao, Tangfei, et autres
Publié: (2023)
CorrAdaptor: Adaptive Local Context Learning for Correspondence Pruning
par: Zhu, Wei, et autres
Publié: (2024)
par: Zhu, Wei, et autres
Publié: (2024)
BCLNet: Bilateral Consensus Learning for Two-View Correspondence Pruning
par: Miao, Xiangyang, et autres
Publié: (2024)
par: Miao, Xiangyang, et autres
Publié: (2024)
CorrMoE: Mixture of Experts with De-stylization Learning for Cross-Scene and Cross-Domain Correspondence Pruning
par: Xia, Peiwen, et autres
Publié: (2025)
par: Xia, Peiwen, et autres
Publié: (2025)
SAM-TTT: Segment Anything Model via Reverse Parameter Configuration and Test-Time Training for Camouflaged Object Detection
par: Yu, Zhenni, et autres
Publié: (2025)
par: Yu, Zhenni, et autres
Publié: (2025)
PacGDC: Label-Efficient Generalizable Depth Completion with Projection Ambiguity and Consistency
par: Wang, Haotian, et autres
Publié: (2025)
par: Wang, Haotian, et autres
Publié: (2025)
Optimizing ID Consistency in Multimodal Large Models: Facial Restoration via Alignment, Entanglement, and Disentanglement
par: Dong, Yuran, et autres
Publié: (2026)
par: Dong, Yuran, et autres
Publié: (2026)
Exploring Deeper! Segment Anything Model with Depth Perception for Camouflaged Object Detection
par: Yu, Zhenni, et autres
Publié: (2024)
par: Yu, Zhenni, et autres
Publié: (2024)
COMPrompter: reconceptualized segment anything model with multiprompt network for camouflaged object detection
par: Zhang, Xiaoqin, et autres
Publié: (2024)
par: Zhang, Xiaoqin, et autres
Publié: (2024)
Consistent-1-to-3: Consistent Image to 3D View Synthesis via Geometry-aware Diffusion Models
par: Ye, Jianglong, et autres
Publié: (2023)
par: Ye, Jianglong, et autres
Publié: (2023)
LLHA-Net: A Hierarchical Attention Network for Two-View Correspondence Learning
par: Lin, Shuyuan, et autres
Publié: (2025)
par: Lin, Shuyuan, et autres
Publié: (2025)
SPOT: Scalable 3D Pre-training via Occupancy Prediction for Learning Transferable 3D Representations
par: Yan, Xiangchao, et autres
Publié: (2023)
par: Yan, Xiangchao, et autres
Publié: (2023)
Pre-training Everywhere: Parameter-Efficient Fine-Tuning for Medical Image Analysis via Target Parameter Pre-training
par: Lei, Xingliang, et autres
Publié: (2024)
par: Lei, Xingliang, et autres
Publié: (2024)
Semi-supervised Text-based Person Search
par: Gao, Daming, et autres
Publié: (2024)
par: Gao, Daming, et autres
Publié: (2024)
DirectEdit: Step-Level Accurate Inversion for Flow-Based Image Editing
par: Yang, Desong, et autres
Publié: (2026)
par: Yang, Desong, et autres
Publié: (2026)
EndoMatcher: Generalizable Endoscopic Image Matcher via Multi-Domain Pre-training for Robot-Assisted Surgery
par: Yang, Bingyu, et autres
Publié: (2025)
par: Yang, Bingyu, et autres
Publié: (2025)
Exploring Generalizable Pre-training for Real-world Change Detection via Geometric Estimation
par: Zhao, Yitao, et autres
Publié: (2025)
par: Zhao, Yitao, et autres
Publié: (2025)
Geometry-aware Reconstruction and Fusion-refined Rendering for Generalizable Neural Radiance Fields
par: Liu, Tianqi, et autres
Publié: (2024)
par: Liu, Tianqi, et autres
Publié: (2024)
MetaDAT: Generalizable Trajectory Prediction via Meta Pre-training and Data-Adaptive Test-Time Updating
par: Wang, Yuning, et autres
Publié: (2026)
par: Wang, Yuning, et autres
Publié: (2026)
Unity in Diversity: Multi-expert Knowledge Confrontation and Collaboration for Generalizable Vehicle Re-identification
par: Kuang, Zhenyu, et autres
Publié: (2024)
par: Kuang, Zhenyu, et autres
Publié: (2024)
Selecting and Pruning: A Differentiable Causal Sequentialized State-Space Model for Two-View Correspondence Learning
par: Fang, Xiang, et autres
Publié: (2025)
par: Fang, Xiang, et autres
Publié: (2025)
PaceVGGT: Pre-Alternating-Attention Token Pruning for Visual Geometry Transformers
par: Li, Haotang, et autres
Publié: (2026)
par: Li, Haotang, et autres
Publié: (2026)
Temporal-Consistent Video Restoration with Pre-trained Diffusion Models
par: Wang, Hengkang, et autres
Publié: (2025)
par: Wang, Hengkang, et autres
Publié: (2025)
ReDiPrune: Relevance-Diversity Pre-Projection Token Pruning for Efficient Multimodal LLMs
par: Yu, An, et autres
Publié: (2026)
par: Yu, An, et autres
Publié: (2026)
ToDRE: Effective Visual Token Pruning via Token Diversity and Task Relevance
par: Li, Duo, et autres
Publié: (2025)
par: Li, Duo, et autres
Publié: (2025)
VQAttack: Transferable Adversarial Attacks on Visual Question Answering via Pre-trained Models
par: Yin, Ziyi, et autres
Publié: (2024)
par: Yin, Ziyi, et autres
Publié: (2024)
Improving Generalizability and Undetectability for Targeted Adversarial Attacks on Multimodal Pre-trained Models
par: Zhang, Zhifang, et autres
Publié: (2025)
par: Zhang, Zhifang, et autres
Publié: (2025)
COVE: Unleashing the Diffusion Feature Correspondence for Consistent Video Editing
par: Wang, Jiangshan, et autres
Publié: (2024)
par: Wang, Jiangshan, et autres
Publié: (2024)
Towards Scalable Pre-training of Visual Tokenizers for Generation
par: Yao, Jingfeng, et autres
Publié: (2025)
par: Yao, Jingfeng, et autres
Publié: (2025)
All in One Framework for Multimodal Re-identification in the Wild
par: Li, He, et autres
Publié: (2024)
par: Li, He, et autres
Publié: (2024)
Multilingual Text-to-Image Person Retrieval via Bidirectional Relation Reasoning and Aligning
par: Cao, Min, et autres
Publié: (2025)
par: Cao, Min, et autres
Publié: (2025)
Pose-Star: Anatomy-Aware Editing for Open-World Fashion Images
par: Dong, Yuran, et autres
Publié: (2025)
par: Dong, Yuran, et autres
Publié: (2025)
Generative Planning with 3D-vision Language Pre-training for End-to-End Autonomous Driving
par: Li, Tengpeng, et autres
Publié: (2025)
par: Li, Tengpeng, et autres
Publié: (2025)
EmoLLM: Multimodal Emotional Understanding Meets Large Language Models
par: Yang, Qu, et autres
Publié: (2024)
par: Yang, Qu, et autres
Publié: (2024)
BUS:Efficient and Effective Vision-language Pre-training with Bottom-Up Patch Summarization
par: Jiang, Chaoya, et autres
Publié: (2023)
par: Jiang, Chaoya, et autres
Publié: (2023)
SurfSurg6D: Geometry Consistent Dense Correspondence for Textureless Surgical Instrument Pose Estimation
par: Shen, Daiyun, et autres
Publié: (2026)
par: Shen, Daiyun, et autres
Publié: (2026)
Point Cloud Unsupervised Pre-training via 3D Gaussian Splatting
par: Liu, Hao, et autres
Publié: (2024)
par: Liu, Hao, et autres
Publié: (2024)
Consistent Story Generation: Unlocking the Potential of Zigzag Sampling
par: Li, Mingxiao, et autres
Publié: (2025)
par: Li, Mingxiao, et autres
Publié: (2025)
Scalable Pre-training of Large Autoregressive Image Models
par: El-Nouby, Alaaeldin, et autres
Publié: (2024)
par: El-Nouby, Alaaeldin, et autres
Publié: (2024)
Lightweight Model Pre-training via Language Guided Knowledge Distillation
par: Li, Mingsheng, et autres
Publié: (2024)
par: Li, Mingsheng, et autres
Publié: (2024)
Documents similaires
-
VSFormer: Visual-Spatial Fusion Transformer for Correspondence Pruning
par: Liao, Tangfei, et autres
Publié: (2023) -
CorrAdaptor: Adaptive Local Context Learning for Correspondence Pruning
par: Zhu, Wei, et autres
Publié: (2024) -
BCLNet: Bilateral Consensus Learning for Two-View Correspondence Pruning
par: Miao, Xiangyang, et autres
Publié: (2024) -
CorrMoE: Mixture of Experts with De-stylization Learning for Cross-Scene and Cross-Domain Correspondence Pruning
par: Xia, Peiwen, et autres
Publié: (2025) -
SAM-TTT: Segment Anything Model via Reverse Parameter Configuration and Test-Time Training for Camouflaged Object Detection
par: Yu, Zhenni, et autres
Publié: (2025)