Enregistré dans:
| Auteurs principaux: | Sun, Yuyang, Wu, Yongliang, Zhu, Xingyu, Chen, Yuxia, Jiang, Zhenxiang, Ji, Yangguang, Zhu, Wenbo, Shi, Yanxi, Wu, Jay, Wang, Shuo, Yang, Xu |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2606.01104 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Temporal Evidence Routing with Structured Visual Evidence for TimeLogicQA
par: Sun, Yuyang, et autres
Publié: (2026)
par: Sun, Yuyang, et autres
Publié: (2026)
VRR-QA: Visual Relational Reasoning in Videos Beyond Explicit Cues
par: Swetha, Sirnam, et autres
Publié: (2025)
par: Swetha, Sirnam, et autres
Publié: (2025)
RSVP: Reasoning Segmentation via Visual Prompting and Multi-modal Chain-of-Thought
par: Lu, Yi, et autres
Publié: (2025)
par: Lu, Yi, et autres
Publié: (2025)
VEU-Bench: Towards Comprehensive Understanding of Video Editing
par: Li, Bozheng, et autres
Publié: (2025)
par: Li, Bozheng, et autres
Publié: (2025)
Reframe Anything: LLM Agent for Open World Video Reframing
par: Cao, Jiawang, et autres
Publié: (2024)
par: Cao, Jiawang, et autres
Publié: (2024)
Number it: Temporal Grounding Videos like Flipping Manga
par: Wu, Yongliang, et autres
Publié: (2024)
par: Wu, Yongliang, et autres
Publié: (2024)
OpusAnimation: Code-Based Dynamic Chart Generation
par: Li, Bozheng, et autres
Publié: (2025)
par: Li, Bozheng, et autres
Publié: (2025)
Hierarchical Budget Policy Optimization for Adaptive Reasoning
par: Lyu, Shangke, et autres
Publié: (2025)
par: Lyu, Shangke, et autres
Publié: (2025)
Adapting Point Cloud Analysis via Multimodal Bayesian Distribution Learning
par: Zhu, Xingyu, et autres
Publié: (2026)
par: Zhu, Xingyu, et autres
Publié: (2026)
Zero-Shot Long-Form Video Understanding through Screenplay
par: Wu, Yongliang, et autres
Publié: (2024)
par: Wu, Yongliang, et autres
Publié: (2024)
P‐9.14: A method of Improving Image Quality of VRR Flicker
par: Yizhuo Zhao, et autres
Publié: (2024)
par: Yizhuo Zhao, et autres
Publié: (2024)
Video Repurposing from User Generated Content: A Large-scale Dataset and Benchmark
par: Wu, Yongliang, et autres
Publié: (2024)
par: Wu, Yongliang, et autres
Publié: (2024)
LAPO: Internalizing Reasoning Efficiency via Length-Adaptive Policy Optimization
par: Wu, Xingyu, et autres
Publié: (2025)
par: Wu, Xingyu, et autres
Publié: (2025)
Video-in-the-Loop: Span-Grounded Long Video QA with Interleaved Reasoning
par: Wang, Chendong, et autres
Publié: (2025)
par: Wang, Chendong, et autres
Publié: (2025)
RealFin: How Well Do LLMs Reason About Finance When Users Leave Things Unsaid?
par: Dai, Yuyang, et autres
Publié: (2026)
par: Dai, Yuyang, et autres
Publié: (2026)
ReAgent: Reversible Multi-Agent Reasoning for Knowledge-Enhanced Multi-Hop QA
par: Zhao, Xinjie, et autres
Publié: (2025)
par: Zhao, Xinjie, et autres
Publié: (2025)
Multifunctional agents based on 3‐dicycanovinylindan‐1‐one acceptor: Molecular design and phototheranostic application
par: Najia Zhu, et autres
Publié: (2024)
par: Najia Zhu, et autres
Publié: (2024)
DIBS: Enhancing Dense Video Captioning with Unlabeled Videos via Pseudo Boundary Enrichment and Online Refinement
par: Wu, Hao, et autres
Publié: (2024)
par: Wu, Hao, et autres
Publié: (2024)
Improving Visual Reasoning with Iterative Evidence Refinement
par: Shi, Zeru, et autres
Publié: (2026)
par: Shi, Zeru, et autres
Publié: (2026)
37‐2: Enhancing VRR Flicker Index Using Time‐Domain Analysis
par: Hyosun Kim, et autres
Publié: (2025)
par: Hyosun Kim, et autres
Publié: (2025)
Learning Dual-Arm Push and Grasp Synergy in Dense Clutter
par: Wang, Yongliang, et autres
Publié: (2024)
par: Wang, Yongliang, et autres
Publié: (2024)
A Fano-Style Accuracy Upper Bound for LLM Single-Pass Reasoning in Multi-Hop QA
par: Wan, Kaiyang, et autres
Publié: (2025)
par: Wan, Kaiyang, et autres
Publié: (2025)
Reasoning Portability: Guiding Continual Learning for MLLMs in the RLVR Era
par: Hong, Qiuhe, et autres
Publié: (2026)
par: Hong, Qiuhe, et autres
Publié: (2026)
First Place Solution to the Multiple-choice Video QA Track of The Second Perception Test Challenge
par: Peng, Yingzhe, et autres
Publié: (2024)
par: Peng, Yingzhe, et autres
Publié: (2024)
BiDense: Binarization for Dense Prediction
par: Yin, Rui, et autres
Publié: (2024)
par: Yin, Rui, et autres
Publié: (2024)
Look Carefully: Adaptive Visual Reinforcements in Multimodal Large Language Models for Hallucination Mitigation
par: Zhu, Xingyu, et autres
Publié: (2026)
par: Zhu, Xingyu, et autres
Publié: (2026)
Topical Application of Fluoxetine Improves DNCB‐Induced Atopic Dermatitis in Mice
par: Xue Jiang, et autres
Publié: (2025)
par: Xue Jiang, et autres
Publié: (2025)
Prediction-Augmented Mechanism Design for Weighted Facility Location
par: Shi, Yangguang, et autres
Publié: (2025)
par: Shi, Yangguang, et autres
Publié: (2025)
Nearly invariant subspaces and kernels of Toeplitz operators on the Hardy space over the bidisk
par: Zhu, Senhua, et autres
Publié: (2024)
par: Zhu, Senhua, et autres
Publié: (2024)
rePIRL: Learn PRM with Inverse RL for LLM Reasoning
par: Wu, Xian, et autres
Publié: (2026)
par: Wu, Xian, et autres
Publié: (2026)
30‐1: Development of High‐integration HOP Panel with High‐frequency & VRR Driving
par: Hyeongseok Kim, et autres
Publié: (2024)
par: Hyeongseok Kim, et autres
Publié: (2024)
HCR-Reasoner: Synergizing Large Language Models and Theory for Human-like Causal Reasoning
par: Zhang, Yanxi, et autres
Publié: (2025)
par: Zhang, Yanxi, et autres
Publié: (2025)
Momentum Posterior Regularization for Multi-hop Dense Retrieval
par: Xia, Zehua, et autres
Publié: (2024)
par: Xia, Zehua, et autres
Publié: (2024)
QA-MoE: Towards a Continuous Reliability Spectrum with Quality-Aware Mixture of Experts for Robust Multimodal Sentiment Analysis
par: Zhu, Yitong, et autres
Publié: (2026)
par: Zhu, Yitong, et autres
Publié: (2026)
AWT: Transferring Vision-Language Models via Augmentation, Weighting, and Transportation
par: Zhu, Yuhan, et autres
Publié: (2024)
par: Zhu, Yuhan, et autres
Publié: (2024)
Ultralow H 2 O 2 ‐Triggered Electron Transfer over Single‐Atom Iron Catalysts for Long‐Term Recyclable Fenton‐Like Reactions
par: Yanxi Chen, et autres
Publié: (2025)
par: Yanxi Chen, et autres
Publié: (2025)
Ultralow H 2 O 2 ‐Triggered Electron Transfer over Single‐Atom Iron Catalysts for Long‐Term Recyclable Fenton‐Like Reactions
par: Yanxi Chen, et autres
Publié: (2025)
par: Yanxi Chen, et autres
Publié: (2025)
RAVEN: Robust Advertisement Video Violation Temporal Grounding via Reinforcement Reasoning
par: Ji, Deyi, et autres
Publié: (2025)
par: Ji, Deyi, et autres
Publié: (2025)
A Survey on Causal Inference‐Driven Data Bias Optimization in Recommendation Systems: Principles, Opportunities and Challenges
par: Yongkang Li, et autres
Publié: (2025)
par: Yongkang Li, et autres
Publié: (2025)
Adaptive Testing Environment Generation for Connected and Automated Vehicles with Dense Reinforcement Learning
par: Yang, Jingxuan, et autres
Publié: (2024)
par: Yang, Jingxuan, et autres
Publié: (2024)
Documents similaires
-
Temporal Evidence Routing with Structured Visual Evidence for TimeLogicQA
par: Sun, Yuyang, et autres
Publié: (2026) -
VRR-QA: Visual Relational Reasoning in Videos Beyond Explicit Cues
par: Swetha, Sirnam, et autres
Publié: (2025) -
RSVP: Reasoning Segmentation via Visual Prompting and Multi-modal Chain-of-Thought
par: Lu, Yi, et autres
Publié: (2025) -
VEU-Bench: Towards Comprehensive Understanding of Video Editing
par: Li, Bozheng, et autres
Publié: (2025) -
Reframe Anything: LLM Agent for Open World Video Reframing
par: Cao, Jiawang, et autres
Publié: (2024)