On Multi-Step Theorem Prediction via Non-Parametric Structural Priors
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhao, Junbo, Zhang, Ting, Li, Can, He, Wei, Wang, Jingdong, Huang, Hua |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
VisioMath: Benchmarking Figure-based Mathematical Reasoning in LMMs
par: Li, Can, et autres
Publié: (2025)
par: Li, Can, et autres
Publié: (2025)
MVHOI: Bridge Multi-view Condition to Complex Human-Object Interaction Video Reenactment via 3D Foundation Model
par: Tong, Jinguang, et autres
Publié: (2026)
par: Tong, Jinguang, et autres
Publié: (2026)
VINO: Video-driven Invariance for Non-contextual Objects via Structural Prior Guided De-contextualization
par: Yeom, Seul-Ki, et autres
Publié: (2026)
par: Yeom, Seul-Ki, et autres
Publié: (2026)
Scaling Non-Parametric Sampling with Representation
par: Lu, Vincent, et autres
Publié: (2025)
par: Lu, Vincent, et autres
Publié: (2025)
Temporal Continual Learning with Prior Compensation for Human Motion Prediction
par: Tang, Jianwei, et autres
Publié: (2025)
par: Tang, Jianwei, et autres
Publié: (2025)
Fence Theorem: Towards Dual-Objective Semantic-Structure Isolation in Preprocessing Phase for 3D Anomaly Detection
par: Liang, Hanzhe, et autres
Publié: (2025)
par: Liang, Hanzhe, et autres
Publié: (2025)
High-Quality 3D Creation from A Single Image Using Subject-Specific Knowledge Prior
par: Huang, Nan, et autres
Publié: (2023)
par: Huang, Nan, et autres
Publié: (2023)
Video-of-Thought: Step-by-Step Video Reasoning from Perception to Cognition
par: Fei, Hao, et autres
Publié: (2024)
par: Fei, Hao, et autres
Publié: (2024)
VRBench: A Benchmark for Multi-Step Reasoning in Long Narrative Videos
par: Yu, Jiashuo, et autres
Publié: (2025)
par: Yu, Jiashuo, et autres
Publié: (2025)
VoCoT: Unleashing Visually Grounded Multi-Step Reasoning in Large Multi-Modal Models
par: Li, Zejun, et autres
Publié: (2024)
par: Li, Zejun, et autres
Publié: (2024)
LaneDiffusion: Improving Centerline Graph Learning via Prior Injected BEV Feature Generation
par: Wang, Zijie, et autres
Publié: (2025)
par: Wang, Zijie, et autres
Publié: (2025)
Fast ODE-based Sampling for Diffusion Models in Around 5 Steps
par: Zhou, Zhenyu, et autres
Publié: (2023)
par: Zhou, Zhenyu, et autres
Publié: (2023)
One-Step Detection Paradigm for Hyperspectral Anomaly Detection via Spectral Deviation Relationship Learning
par: Li, Jingtao, et autres
Publié: (2023)
par: Li, Jingtao, et autres
Publié: (2023)
Advancing Brain Imaging Analysis Step-by-step via Progressive Self-paced Learning
par: Yang, Yanwu, et autres
Publié: (2024)
par: Yang, Yanwu, et autres
Publié: (2024)
Exploiting Diffusion Prior for Out-of-Distribution Detection
par: Zhu, Armando, et autres
Publié: (2024)
par: Zhu, Armando, et autres
Publié: (2024)
Single Image Reflection Separation via Dual Prior Interaction Transformer
par: Huang, Yue, et autres
Publié: (2025)
par: Huang, Yue, et autres
Publié: (2025)
SnapFlow: One-Step Action Generation for Flow-Matching VLAs via Progressive Self-Distillation
par: Luan, Wuyang, et autres
Publié: (2026)
par: Luan, Wuyang, et autres
Publié: (2026)
SDIGLM: Leveraging Large Language Models and Multi-Modal Chain of Thought for Structural Damage Identification
par: Zhang, Yunkai, et autres
Publié: (2025)
par: Zhang, Yunkai, et autres
Publié: (2025)
RopeTP: Global Human Motion Recovery via Integrating Robust Pose Estimation with Diffusion Trajectory Prior
par: Liang, Mingjiang, et autres
Publié: (2024)
par: Liang, Mingjiang, et autres
Publié: (2024)
Unconstrained Multi-view Human Pose Estimation with Algebraic Priors
par: Qin, Xiaolin, et autres
Publié: (2026)
par: Qin, Xiaolin, et autres
Publié: (2026)
ArcFlow: Unleashing 2-Step Text-to-Image Generation via High-Precision Non-Linear Flow Distillation
par: Yang, Zihan, et autres
Publié: (2026)
par: Yang, Zihan, et autres
Publié: (2026)
CausalStep: A Benchmark for Explicit Stepwise Causal Reasoning in Videos
par: Li, Xuchen, et autres
Publié: (2025)
par: Li, Xuchen, et autres
Publié: (2025)
Jasmine: Harnessing Diffusion Prior for Self-supervised Depth Estimation
par: Wang, Jiyuan, et autres
Publié: (2025)
par: Wang, Jiyuan, et autres
Publié: (2025)
Twisted Convolutional Networks (TCNs): Enhancing Feature Interactions for Non-Spatial Data Classification
par: Lian, Junbo Jacob, et autres
Publié: (2024)
par: Lian, Junbo Jacob, et autres
Publié: (2024)
SocialCVAE: Predicting Pedestrian Trajectory via Interaction Conditioned Latents
par: Xiang, Wei, et autres
Publié: (2024)
par: Xiang, Wei, et autres
Publié: (2024)
OpenGround: Active Cognition-based Reasoning for Open-World 3D Visual Grounding
par: Huang, Wenyuan, et autres
Publié: (2025)
par: Huang, Wenyuan, et autres
Publié: (2025)
TriCLIP-3D: A Unified Parameter-Efficient Framework for Tri-Modal 3D Visual Grounding based on CLIP
par: Li, Fan, et autres
Publié: (2025)
par: Li, Fan, et autres
Publié: (2025)
Boosting Flow-based Generative Super-Resolution Models via Learned Prior
par: Tsao, Li-Yuan, et autres
Publié: (2024)
par: Tsao, Li-Yuan, et autres
Publié: (2024)
CookAnything: A Framework for Flexible and Consistent Multi-Step Recipe Image Generation
par: Zhang, Ruoxuan, et autres
Publié: (2025)
par: Zhang, Ruoxuan, et autres
Publié: (2025)
Socratic-Geo: Synthetic Data Generation and Geometric Reasoning via Multi-Agent Interaction
par: Jiao, Zhengbo, et autres
Publié: (2026)
par: Jiao, Zhengbo, et autres
Publié: (2026)
Towards Unified Multi-granularity Text Detection with Interactive Attention
par: Wan, Xingyu, et autres
Publié: (2024)
par: Wan, Xingyu, et autres
Publié: (2024)
Benchmarking Multi-Organ Segmentation Tools for Multi-Parametric T1-weighted Abdominal MRI
par: Tran, Nicole, et autres
Publié: (2025)
par: Tran, Nicole, et autres
Publié: (2025)
HumanCM: One Step Human Motion Prediction
par: Haojie, Liu, et autres
Publié: (2025)
par: Haojie, Liu, et autres
Publié: (2025)
GS2Pose: Two-stage 6D Object Pose Estimation Guided by Gaussian Splatting
par: Mei, Jilan, et autres
Publié: (2024)
par: Mei, Jilan, et autres
Publié: (2024)
HieraTok: Multi-Scale Visual Tokenizer Improves Image Reconstruction and Generation
par: Chen, Cong, et autres
Publié: (2025)
par: Chen, Cong, et autres
Publié: (2025)
Unsupervised Video Continual Learning via Non-Parametric Deep Embedded Clustering
par: Kurpukdee, Nattapong, et autres
Publié: (2025)
par: Kurpukdee, Nattapong, et autres
Publié: (2025)
Vision-Core Guided Contrastive Learning for Balanced Multi-modal Prognosis Prediction of Stroke
par: Chen, Liren, et autres
Publié: (2026)
par: Chen, Liren, et autres
Publié: (2026)
MolX: Enhancing Large Language Models for Molecular Understanding With A Multi-Modal Extension
par: Le, Khiem, et autres
Publié: (2024)
par: Le, Khiem, et autres
Publié: (2024)
Powerful Teachers Matter: Text-Guided Multi-view Knowledge Distillation with Visual Prior Enhancement
par: Zhang, Xin, et autres
Publié: (2026)
par: Zhang, Xin, et autres
Publié: (2026)
MMReason: An Open-Ended Multi-Modal Multi-Step Reasoning Benchmark for MLLMs Toward AGI
par: Yao, Huanjin, et autres
Publié: (2025)
par: Yao, Huanjin, et autres
Publié: (2025)
Documents similaires
-
VisioMath: Benchmarking Figure-based Mathematical Reasoning in LMMs
par: Li, Can, et autres
Publié: (2025) -
MVHOI: Bridge Multi-view Condition to Complex Human-Object Interaction Video Reenactment via 3D Foundation Model
par: Tong, Jinguang, et autres
Publié: (2026) -
VINO: Video-driven Invariance for Non-contextual Objects via Structural Prior Guided De-contextualization
par: Yeom, Seul-Ki, et autres
Publié: (2026) -
Scaling Non-Parametric Sampling with Representation
par: Lu, Vincent, et autres
Publié: (2025) -
Temporal Continual Learning with Prior Compensation for Human Motion Prediction
par: Tang, Jianwei, et autres
Publié: (2025)