ReasonMap: Towards Fine-Grained Visual Reasoning from Transit Maps
Fuente:
arXiv
Guardado en:
| Autores principales: | Feng, Sicheng, Wang, Song, Ouyang, Shuyi, Kong, Lingdong, Song, Zikai, Zhu, Jianke, Wang, Huan, Wang, Xinchao |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
RewardMap: Tackling Sparse Rewards in Fine-grained Visual Reasoning via Multi-Stage Reinforcement Learning
por: Feng, Sicheng, et al.
Publicado: (2025)
por: Feng, Sicheng, et al.
Publicado: (2025)
PixelThink: Towards Efficient Chain-of-Pixel Reasoning
por: Wang, Song, et al.
Publicado: (2025)
por: Wang, Song, et al.
Publicado: (2025)
PointLoRA: Low-Rank Adaptation with Token Selection for Point Cloud Learning
por: Wang, Song, et al.
Publicado: (2025)
por: Wang, Song, et al.
Publicado: (2025)
Hypergraph-State Collaborative Reasoning for Multi-Object Tracking
por: Song, Zikai, et al.
Publicado: (2026)
por: Song, Zikai, et al.
Publicado: (2026)
VISCO: Benchmarking Fine-Grained Critique and Correction Towards Self-Improvement in Visual Reasoning
por: Wu, Xueqing, et al.
Publicado: (2024)
por: Wu, Xueqing, et al.
Publicado: (2024)
CLiViS: Unleashing Cognitive Map through Linguistic-Visual Synergy for Embodied Visual Reasoning
por: Li, Kailing, et al.
Publicado: (2025)
por: Li, Kailing, et al.
Publicado: (2025)
TaxonRL: Reinforcement Learning with Intermediate Rewards for Interpretable Fine-Grained Visual Reasoning
por: von Klinski, Maximilian, et al.
Publicado: (2026)
por: von Klinski, Maximilian, et al.
Publicado: (2026)
Fine-Grained Preference Optimization Improves Spatial Reasoning in VLMs
por: Shen, Yifan, et al.
Publicado: (2025)
por: Shen, Yifan, et al.
Publicado: (2025)
ASPO: Adaptive Sentence-Level Preference Optimization for Fine-Grained Multimodal Reasoning
por: Wang, Yeyuan, et al.
Publicado: (2025)
por: Wang, Yeyuan, et al.
Publicado: (2025)
Integrating Fine-Grained Audio-Visual Evidence for Robust Multimodal Emotion Reasoning
por: Zhao, Zhixian, et al.
Publicado: (2026)
por: Zhao, Zhixian, et al.
Publicado: (2026)
What Makes for Good Visual Instructions? Synthesizing Complex Visual Reasoning Instructions for Visual Instruction Tuning
por: Du, Yifan, et al.
Publicado: (2023)
por: Du, Yifan, et al.
Publicado: (2023)
ConciseHint: Boosting Efficient Reasoning via Continuous Concise Hints during Generation
por: Tang, Siao, et al.
Publicado: (2025)
por: Tang, Siao, et al.
Publicado: (2025)
VGR: Visual Grounded Reasoning
por: Wang, Jiacong, et al.
Publicado: (2025)
por: Wang, Jiacong, et al.
Publicado: (2025)
Learning Adaptive Reasoning Paths for Efficient Visual Reasoning
por: Huang, Yixu, et al.
Publicado: (2026)
por: Huang, Yixu, et al.
Publicado: (2026)
Latent Visual Reasoning
por: Li, Bangzheng, et al.
Publicado: (2025)
por: Li, Bangzheng, et al.
Publicado: (2025)
ScanReason: Empowering 3D Visual Grounding with Reasoning Capabilities
por: Zhu, Chenming, et al.
Publicado: (2024)
por: Zhu, Chenming, et al.
Publicado: (2024)
Uncertainty-Instructed Structure Injection for Generalizable HD Map Construction
por: Liu, Xiaolu, et al.
Publicado: (2025)
por: Liu, Xiaolu, et al.
Publicado: (2025)
DualToken: Towards Unifying Visual Understanding and Generation with Dual Visual Vocabularies
por: Song, Wei, et al.
Publicado: (2025)
por: Song, Wei, et al.
Publicado: (2025)
MGMap: Mask-Guided Learning for Online Vectorized HD Map Construction
por: Liu, Xiaolu, et al.
Publicado: (2024)
por: Liu, Xiaolu, et al.
Publicado: (2024)
VisualPRM: An Effective Process Reward Model for Multimodal Reasoning
por: Wang, Weiyun, et al.
Publicado: (2025)
por: Wang, Weiyun, et al.
Publicado: (2025)
$A^2R^2$: Advancing Img2LaTeX Conversion via Visual Reasoning with Attention-Guided Refinement
por: Li, Zhecheng, et al.
Publicado: (2025)
por: Li, Zhecheng, et al.
Publicado: (2025)
Hallucination at a Glance: Controlled Visual Edits and Fine-Grained Multimodal Learning
por: Bai, Tianyi, et al.
Publicado: (2025)
por: Bai, Tianyi, et al.
Publicado: (2025)
SafeMap: Robust HD Map Construction from Incomplete Observations
por: Hao, Xiaoshuai, et al.
Publicado: (2025)
por: Hao, Xiaoshuai, et al.
Publicado: (2025)
ViewFusion: Structured Spatial Thinking Chains for Multi-View Reasoning
por: Tao, Xingjian, et al.
Publicado: (2026)
por: Tao, Xingjian, et al.
Publicado: (2026)
Traceable Evidence Enhanced Visual Grounded Reasoning: Evaluation and Methodology
por: Wang, Haochen, et al.
Publicado: (2025)
por: Wang, Haochen, et al.
Publicado: (2025)
Embodied-Reasoner: Synergizing Visual Search, Reasoning, and Action for Embodied Interactive Tasks
por: Zhang, Wenqi, et al.
Publicado: (2025)
por: Zhang, Wenqi, et al.
Publicado: (2025)
Open Vision Reasoner: Transferring Linguistic Cognitive Behavior for Visual Reasoning
por: Wei, Yana, et al.
Publicado: (2025)
por: Wei, Yana, et al.
Publicado: (2025)
Daily-Omni: Towards Audio-Visual Reasoning with Temporal Alignment across Modalities
por: Zhou, Ziwei, et al.
Publicado: (2025)
por: Zhou, Ziwei, et al.
Publicado: (2025)
VAEER: Visual Attention-Inspired Emotion Elicitation Reasoning
por: Man, Fanhang, et al.
Publicado: (2025)
por: Man, Fanhang, et al.
Publicado: (2025)
Interleaved Latent Visual Reasoning with Selective Perceptual Modeling
por: Dong, Shuai, et al.
Publicado: (2025)
por: Dong, Shuai, et al.
Publicado: (2025)
A Coarse-to-Fine Approach to Multi-Modality 3D Occupancy Grounding
por: Shi, Zhan, et al.
Publicado: (2025)
por: Shi, Zhan, et al.
Publicado: (2025)
VisionPangu: A Compact and Fine-Grained Multimodal Assistant with 1.7B Parameters
por: Fan, Jiaxin, et al.
Publicado: (2026)
por: Fan, Jiaxin, et al.
Publicado: (2026)
On Data Synthesis and Post-training for Visual Abstract Reasoning
por: Zhu, Ke, et al.
Publicado: (2025)
por: Zhu, Ke, et al.
Publicado: (2025)
VLM-FO1: Bridging the Gap Between High-Level Reasoning and Fine-Grained Perception in VLMs
por: Liu, Peng, et al.
Publicado: (2025)
por: Liu, Peng, et al.
Publicado: (2025)
Forest Before Trees: Latent Superposition for Efficient Visual Reasoning
por: Wang, Yubo, et al.
Publicado: (2026)
por: Wang, Yubo, et al.
Publicado: (2026)
Efficient Reasoning Models: A Survey
por: Feng, Sicheng, et al.
Publicado: (2025)
por: Feng, Sicheng, et al.
Publicado: (2025)
PROGRESSLM: Towards Progress Reasoning in Vision-Language Models
por: Zhang, Jianshu, et al.
Publicado: (2026)
por: Zhang, Jianshu, et al.
Publicado: (2026)
Forging Spatial Intelligence: A Roadmap of Multi-Modal Data Pre-Training for Autonomous Systems
por: Wang, Song, et al.
Publicado: (2025)
por: Wang, Song, et al.
Publicado: (2025)
Visual Reasoning at Urban Intersections: FineTuning GPT-4o for Traffic Conflict Detection
por: Masri, Sari, et al.
Publicado: (2025)
por: Masri, Sari, et al.
Publicado: (2025)
R-AVST: Empowering Video-LLMs with Fine-Grained Spatio-Temporal Reasoning in Complex Audio-Visual Scenarios
por: Zhu, Lu, et al.
Publicado: (2025)
por: Zhu, Lu, et al.
Publicado: (2025)
Ejemplares similares
-
RewardMap: Tackling Sparse Rewards in Fine-grained Visual Reasoning via Multi-Stage Reinforcement Learning
por: Feng, Sicheng, et al.
Publicado: (2025) -
PixelThink: Towards Efficient Chain-of-Pixel Reasoning
por: Wang, Song, et al.
Publicado: (2025) -
PointLoRA: Low-Rank Adaptation with Token Selection for Point Cloud Learning
por: Wang, Song, et al.
Publicado: (2025) -
Hypergraph-State Collaborative Reasoning for Multi-Object Tracking
por: Song, Zikai, et al.
Publicado: (2026) -
VISCO: Benchmarking Fine-Grained Critique and Correction Towards Self-Improvement in Visual Reasoning
por: Wu, Xueqing, et al.
Publicado: (2024)