Socratic-Geo: Synthetic Data Generation and Geometric Reasoning via Multi-Agent Interaction
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Jiao, Zhengbo, Wang, Shaobo, Zhang, Zifan, Wang, Wei, Zhao, Bing, Wei, Hu, Zhang, Linfeng |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Socratic-Zero : Bootstrapping Reasoning via Data-Free Agent Co-evolution
par: Wang, Shaobo, et autres
Publié: (2025)
par: Wang, Shaobo, et autres
Publié: (2025)
Bridging Visual Representation and Reinforcement Learning from Verifiable Rewards in Large Vision-Language Models
par: Han, Yuhang, et autres
Publié: (2026)
par: Han, Yuhang, et autres
Publié: (2026)
Credit Where It is Due: Cross-Modality Connectivity Drives Precise Reinforcement Learning for MLLM Reasoning
par: Jiao, Zhengbo, et autres
Publié: (2026)
par: Jiao, Zhengbo, et autres
Publié: (2026)
Agentic Proposing: Enhancing Large Language Model Reasoning via Compositional Skill Synthesis
par: Jiao, Zhengbo, et autres
Publié: (2026)
par: Jiao, Zhengbo, et autres
Publié: (2026)
HumanGenesis: Agent-Based Geometric and Generative Modeling for Synthetic Human Dynamics
par: Li, Weiqi, et autres
Publié: (2025)
par: Li, Weiqi, et autres
Publié: (2025)
GeoLoom: High-quality Geometric Diagram Generation from Textual Input
par: Wei, Xiaojing, et autres
Publié: (2025)
par: Wei, Xiaojing, et autres
Publié: (2025)
Compute Only 16 Tokens in One Timestep: Accelerating Diffusion Transformers with Cluster-Driven Feature Caching
par: Zheng, Zhixin, et autres
Publié: (2025)
par: Zheng, Zhixin, et autres
Publié: (2025)
VideoCompressa: Data-Efficient Video Understanding via Joint Temporal Compression and Spatial Reconstruction
par: Wang, Shaobo, et autres
Publié: (2025)
par: Wang, Shaobo, et autres
Publié: (2025)
Efficient Multi-modal Large Language Models via Progressive Consistency Distillation
par: Wen, Zichen, et autres
Publié: (2025)
par: Wen, Zichen, et autres
Publié: (2025)
UNSEEN: Enhancing Dataset Pruning from a Generalization Perspective
par: Xu, Furui, et autres
Publié: (2025)
par: Xu, Furui, et autres
Publié: (2025)
LatentGeo: Learnable Auxiliary Constructions in Latent Space for Multimodal Geometric Reasoning
par: Xu, Haiying, et autres
Publié: (2026)
par: Xu, Haiying, et autres
Publié: (2026)
ImagebindDC: Compressing Multi-modal Data with Imagebind-based Condensation
par: Min, Yue, et autres
Publié: (2025)
par: Min, Yue, et autres
Publié: (2025)
AffectAgent: Collaborative Multi-Agent Reasoning for Retrieval-Augmented Multimodal Emotion Recognition
par: Wang, Zeheng, et autres
Publié: (2026)
par: Wang, Zeheng, et autres
Publié: (2026)
Enhancing Cross-View Geo-Localization Generalization via Global-Local Consistency and Geometric Equivariance
par: Wang, Xiaowei, et autres
Publié: (2025)
par: Wang, Xiaowei, et autres
Publié: (2025)
GenAgent: Scaling Text-to-Image Generation via Agentic Multimodal Reasoning
par: Jiang, Kaixun, et autres
Publié: (2026)
par: Jiang, Kaixun, et autres
Publié: (2026)
Cross-view Domain Generalization via Geometric Consistency for LiDAR Semantic Segmentation
par: Zhao, Jindong, et autres
Publié: (2026)
par: Zhao, Jindong, et autres
Publié: (2026)
Masked Diffusion Vision-Language Models for Temporal Action Localization
par: Wang, Fengshun, et autres
Publié: (2026)
par: Wang, Fengshun, et autres
Publié: (2026)
Socratic Chart: Cooperating Multiple Agents for Robust SVG Chart Understanding
par: Ji, Yuyang, et autres
Publié: (2025)
par: Ji, Yuyang, et autres
Publié: (2025)
Reasoning Physical Video Generation with Diffusion Timestep Tokens via Reinforcement Learning
par: Lin, Wang, et autres
Publié: (2025)
par: Lin, Wang, et autres
Publié: (2025)
Socratic Questioning: Learn to Self-guide Multimodal Reasoning in the Wild
par: Hu, Wanpeng, et autres
Publié: (2025)
par: Hu, Wanpeng, et autres
Publié: (2025)
BGG: Bridging the Geometric Gap between Cross-View images by Vision Foundation Model Adaptation for Geo-Localization
par: Wang, Wei, et autres
Publié: (2026)
par: Wang, Wei, et autres
Publié: (2026)
MagicGeo: Training-Free Text-Guided Geometric Diagram Generation
par: Wang, Junxiao, et autres
Publié: (2025)
par: Wang, Junxiao, et autres
Publié: (2025)
Generation then Reconstruction: Accelerating Masked Autoregressive Models via Two-Stage Sampling
par: Yan, Feihong, et autres
Publié: (2025)
par: Yan, Feihong, et autres
Publié: (2025)
Q-GeoMem: Question-Guided Geometric Memory for Video Spatial Reasoning
par: Gao, Xianqiang, et autres
Publié: (2026)
par: Gao, Xianqiang, et autres
Publié: (2026)
UAV-OVO: Out-of-Viewpoint Generalization in UAV Action Recognition
par: Xia, Yu, et autres
Publié: (2026)
par: Xia, Yu, et autres
Publié: (2026)
GeoTikzBridge: Advancing Multimodal Code Generation for Geometric Perception and Reasoning
par: Sun, Jiayin, et autres
Publié: (2026)
par: Sun, Jiayin, et autres
Publié: (2026)
Not All Samples Should Be Utilized Equally: Towards Understanding and Improving Dataset Distillation
par: Wang, Shaobo, et autres
Publié: (2024)
par: Wang, Shaobo, et autres
Publié: (2024)
Refer-Agent: A Collaborative Multi-Agent System with Reasoning and Reflection for Referring Video Object Segmentation
par: Jiang, Haichao, et autres
Publié: (2026)
par: Jiang, Haichao, et autres
Publié: (2026)
Reliable Reasoning in SVG-LLMs via Multi-Task Multi-Reward Reinforcement Learning
par: Wang, Haomin, et autres
Publié: (2026)
par: Wang, Haomin, et autres
Publié: (2026)
InterAgent: Physics-based Multi-agent Command Execution via Diffusion on Interaction Graphs
par: Li, Bin, et autres
Publié: (2025)
par: Li, Bin, et autres
Publié: (2025)
Perceive, Verify and Understand Long Video: Multi-Granular Perception and Active Verification via Interactive Agents
par: Li, Jiahua, et autres
Publié: (2025)
par: Li, Jiahua, et autres
Publié: (2025)
Visual-Geometric Collaborative Guidance for Affordance Learning
par: Luo, Hongchen, et autres
Publié: (2024)
par: Luo, Hongchen, et autres
Publié: (2024)
CogniVerse: Revolutionizing Multi-Modal Retrieval-Augmented Generation with Cognitive Reflection and Geometric Reasoning
par: Fang, Xiang, et autres
Publié: (2026)
par: Fang, Xiang, et autres
Publié: (2026)
GeoBEV: Learning Geometric BEV Representation for Multi-view 3D Object Detection
par: Zhang, Jinqing, et autres
Publié: (2024)
par: Zhang, Jinqing, et autres
Publié: (2024)
Interactive Occlusion Boundary Estimation through Exploitation of Synthetic Data
par: Xu, Lintao, et autres
Publié: (2024)
par: Xu, Lintao, et autres
Publié: (2024)
GeoSense: Internalizing Geometric Necessity Perception for Multimodal Reasoning
par: Liu, Ruiheng, et autres
Publié: (2026)
par: Liu, Ruiheng, et autres
Publié: (2026)
LazyMAR: Accelerating Masked Autoregressive Models via Feature Caching
par: Yan, Feihong, et autres
Publié: (2025)
par: Yan, Feihong, et autres
Publié: (2025)
SynthSeg-Agents: Multi-Agent Synthetic Data Generation for Zero-Shot Weakly Supervised Semantic Segmentation
par: Wu, Wangyu, et autres
Publié: (2025)
par: Wu, Wangyu, et autres
Publié: (2025)
MMhops-R1: Multimodal Multi-hop Reasoning
par: Zhang, Tao, et autres
Publié: (2025)
par: Zhang, Tao, et autres
Publié: (2025)
A Multi-Agent Framework with Structured Reasoning and Reflective Refinement for Multimodal Empathetic Response Generation
par: Wang, Liping, et autres
Publié: (2026)
par: Wang, Liping, et autres
Publié: (2026)
Documents similaires
-
Socratic-Zero : Bootstrapping Reasoning via Data-Free Agent Co-evolution
par: Wang, Shaobo, et autres
Publié: (2025) -
Bridging Visual Representation and Reinforcement Learning from Verifiable Rewards in Large Vision-Language Models
par: Han, Yuhang, et autres
Publié: (2026) -
Credit Where It is Due: Cross-Modality Connectivity Drives Precise Reinforcement Learning for MLLM Reasoning
par: Jiao, Zhengbo, et autres
Publié: (2026) -
Agentic Proposing: Enhancing Large Language Model Reasoning via Compositional Skill Synthesis
par: Jiao, Zhengbo, et autres
Publié: (2026) -
HumanGenesis: Agent-Based Geometric and Generative Modeling for Synthetic Human Dynamics
par: Li, Weiqi, et autres
Publié: (2025)