GeoRef: Referring Expressions in Geometry via Task Formulation, Synthetic Supervision, and Reinforced MLLM-based Solutions
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Liu, Bing, Yv, Wenqiang, Yang, Xuzheng, Wang, Shichang, Liu, Junzhuo, Wang, Peng, Wang, Guoqing, Yang, Yang, Shen, Heng Tao |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
New Dataset and Methods for Fine-Grained Compositional Referring Expression Comprehension via Specialist-MLLM Collaboration
par: Yang, Xuzheng, et autres
Publié: (2025)
par: Yang, Xuzheng, et autres
Publié: (2025)
FineCops-Ref: A new Dataset and Task for Fine-Grained Compositional Referring Expression Comprehension
par: Liu, Junzhuo, et autres
Publié: (2024)
par: Liu, Junzhuo, et autres
Publié: (2024)
Ref-Adv: Exploring MLLM Visual Reasoning in Referring Expression Tasks
par: Dong, Qihua, et autres
Publié: (2026)
par: Dong, Qihua, et autres
Publié: (2026)
Region-aware Distribution Contrast: A Novel Approach to Multi-Task Partially Supervised Learning
par: Li, Meixuan, et autres
Publié: (2024)
par: Li, Meixuan, et autres
Publié: (2024)
OneRef: Unified One-tower Expression Grounding and Segmentation with Mask Referring Modeling
par: Xiao, Linhui, et autres
Publié: (2024)
par: Xiao, Linhui, et autres
Publié: (2024)
RefAlign: Representation Alignment for Reference-to-Video Generation
par: Wang, Lei, et autres
Publié: (2026)
par: Wang, Lei, et autres
Publié: (2026)
Quality Analysis of Curcumae Radix From Different Sources Based on the Three‐Dimensional Evaluation System of “Morphology–Composition–Efficacy”
par: Yv Wang, et autres
Publié: (2025)
par: Yv Wang, et autres
Publié: (2025)
RefDrone: A Challenging Benchmark for Referring Expression Comprehension in Drone Scenes
par: Sun, Zhichao, et autres
Publié: (2025)
par: Sun, Zhichao, et autres
Publié: (2025)
RefEvo: Agentic Design with Co-Evolutionary Verification for Agile Reference Model Generation
par: Zhang, Yifan, et autres
Publié: (2026)
par: Zhang, Yifan, et autres
Publié: (2026)
RefEdit: A Benchmark and Method for Improving Instruction-based Image Editing Model on Referring Expressions
par: Pathiraja, Bimsara, et autres
Publié: (2025)
par: Pathiraja, Bimsara, et autres
Publié: (2025)
Dual-Pathway Geometry-Aware MLLM for Spatial Intelligence
par: Zheng, Yufei, et autres
Publié: (2026)
par: Zheng, Yufei, et autres
Publié: (2026)
MADECM: A Curiosity‐Augmented Evolutionary Algorithm for Multi‐Agent Policy Diversity Optimization
par: Jianyang Wu, et autres
Publié: (2026)
par: Jianyang Wu, et autres
Publié: (2026)
RefRef: A Synthetic Dataset and Benchmark for Reconstructing Refractive and Reflective Objects
par: Yin, Yue, et autres
Publié: (2025)
par: Yin, Yue, et autres
Publié: (2025)
Semi-MedRef: Semi-Supervised Medical Referring Image Segmentation with Cross-Modal Alignment
par: Li, Yuchen, et autres
Publié: (2026)
par: Li, Yuchen, et autres
Publié: (2026)
GeoPurify: A Data-Efficient Geometric Distillation Framework for Open-Vocabulary 3D Segmentation
par: Dou, Weijia, et autres
Publié: (2025)
par: Dou, Weijia, et autres
Publié: (2025)
RefComp: A Reference-guided Unified Framework for Unpaired Point Cloud Completion
par: Yang, Yixuan, et autres
Publié: (2025)
par: Yang, Yixuan, et autres
Publié: (2025)
TransRef: Multi-Scale Reference Embedding Transformer for Reference-Guided Image Inpainting
par: Liu, Taorong, et autres
Publié: (2023)
par: Liu, Taorong, et autres
Publié: (2023)
UniRef-Image-Edit: Towards Scalable and Consistent Multi-Reference Image Editing
par: Wei, Hongyang, et autres
Publié: (2026)
par: Wei, Hongyang, et autres
Publié: (2026)
RefBench-PRO: Perceptual and Reasoning Oriented Benchmark for Referring Expression Comprehension
par: Gao, Tianyi, et autres
Publié: (2025)
par: Gao, Tianyi, et autres
Publié: (2025)
BadRefSR: Backdoor Attacks Against Reference-based Image Super Resolution
par: Yang, Xue, et autres
Publié: (2025)
par: Yang, Xue, et autres
Publié: (2025)
Spatial Transcriptomics Expression Prediction from Histopathology Based on Cross-Modal Mask Reconstruction and Contrastive Learning
par: Liu, Junzhuo, et autres
Publié: (2025)
par: Liu, Junzhuo, et autres
Publié: (2025)
RefTon: Reference person shot assist virtual Try-on
par: Li, Liuzhuozheng, et autres
Publié: (2025)
par: Li, Liuzhuozheng, et autres
Publié: (2025)
The Solution for the 5th GCAIAC Zero-shot Referring Expression Comprehension Challenge
par: Huang, Longfei, et autres
Publié: (2024)
par: Huang, Longfei, et autres
Publié: (2024)
SAM as the Guide: Mastering Pseudo-Label Refinement in Semi-Supervised Referring Expression Segmentation
par: Yang, Danni, et autres
Publié: (2024)
par: Yang, Danni, et autres
Publié: (2024)
Design-MLLM: A Reinforcement Alignment Framework for Verifiable and Aesthetic Interior Design
par: Yang, Yuxuan, et autres
Publié: (2026)
par: Yang, Yuxuan, et autres
Publié: (2026)
SingRef6D: Monocular Novel Object Pose Estimation with a Single RGB Reference
par: Wang, Jiahui, et autres
Publié: (2025)
par: Wang, Jiahui, et autres
Publié: (2025)
SAM4MLLM: Enhance Multi-Modal Large Language Model for Referring Expression Segmentation
par: Chen, Yi-Chia, et autres
Publié: (2024)
par: Chen, Yi-Chia, et autres
Publié: (2024)
Ref-AVS: Refer and Segment Objects in Audio-Visual Scenes
par: Wang, Yaoting, et autres
Publié: (2024)
par: Wang, Yaoting, et autres
Publié: (2024)
RefTok: Reference-Based Tokenization for Video Generation
par: Fan, Xiang, et autres
Publié: (2025)
par: Fan, Xiang, et autres
Publié: (2025)
MAPL: Memory Augmentation and Pseudo-Labeling for Semi-Supervised Anomaly Detection
par: Chen, Junzhuo, et autres
Publié: (2024)
par: Chen, Junzhuo, et autres
Publié: (2024)
WeakMCN: Multi-task Collaborative Network for Weakly Supervised Referring Expression Comprehension and Segmentation
par: Liu, Yang, et autres
Publié: (2025)
par: Liu, Yang, et autres
Publié: (2025)
Ref-SAM3D: Bridging SAM3D with Text for Reference 3D Reconstruction
par: Zhou, Yun, et autres
Publié: (2025)
par: Zhou, Yun, et autres
Publié: (2025)
RefOnce: Distilling References into a Prototype Memory for Referring Camouflaged Object Detection
par: Wu, Yu-Huan, et autres
Publié: (2025)
par: Wu, Yu-Huan, et autres
Publié: (2025)
RefSTAR: Blind Facial Image Restoration with Reference Selection, Transfer, and Reconstruction
par: Yin, Zhicun, et autres
Publié: (2025)
par: Yin, Zhicun, et autres
Publié: (2025)
A Survey on Facial Expression Recognition of Static and Dynamic Emotions
par: Wang, Yan, et autres
Publié: (2024)
par: Wang, Yan, et autres
Publié: (2024)
MultiRef: Controllable Image Generation with Multiple Visual References
par: Chen, Ruoxi, et autres
Publié: (2025)
par: Chen, Ruoxi, et autres
Publié: (2025)
Implicit Counterfactual Learning for Audio-Visual Segmentation
par: Zha, Mingfeng, et autres
Publié: (2025)
par: Zha, Mingfeng, et autres
Publié: (2025)
RefChecker: Reference-based Fine-grained Hallucination Checker and Benchmark for Large Language Models
par: Hu, Xiangkun, et autres
Publié: (2024)
par: Hu, Xiangkun, et autres
Publié: (2024)
RefTool: Reference-Guided Tool Creation for Knowledge-Intensive Reasoning
par: Liu, Xiao, et autres
Publié: (2025)
par: Liu, Xiao, et autres
Publié: (2025)
The Erdős-Ginzburg-Ziv theorem constant of finite groups
par: Zhao, Yang, et autres
Publié: (2026)
par: Zhao, Yang, et autres
Publié: (2026)
Documents similaires
-
New Dataset and Methods for Fine-Grained Compositional Referring Expression Comprehension via Specialist-MLLM Collaboration
par: Yang, Xuzheng, et autres
Publié: (2025) -
FineCops-Ref: A new Dataset and Task for Fine-Grained Compositional Referring Expression Comprehension
par: Liu, Junzhuo, et autres
Publié: (2024) -
Ref-Adv: Exploring MLLM Visual Reasoning in Referring Expression Tasks
par: Dong, Qihua, et autres
Publié: (2026) -
Region-aware Distribution Contrast: A Novel Approach to Multi-Task Partially Supervised Learning
par: Li, Meixuan, et autres
Publié: (2024) -
OneRef: Unified One-tower Expression Grounding and Segmentation with Mask Referring Modeling
par: Xiao, Linhui, et autres
Publié: (2024)