Guardado en:
| Autores principales: | Sun, Yuyang, Wu, Yongliang, Zhu, Xingyu, Chen, Yuxia, Jiang, Zhenxiang, Ji, Yangguang, Zhu, Wenbo, Shi, Yanxi, Wu, Jay, Wang, Shuo, Yang, Xu |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2606.01106 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Adaptive Dense Evidence Refinement for Video Relational Reasoning for VRR-QA Challenge
por: Sun, Yuyang, et al.
Publicado: (2026)
por: Sun, Yuyang, et al.
Publicado: (2026)
RSVP: Reasoning Segmentation via Visual Prompting and Multi-modal Chain-of-Thought
por: Lu, Yi, et al.
Publicado: (2025)
por: Lu, Yi, et al.
Publicado: (2025)
Number it: Temporal Grounding Videos like Flipping Manga
por: Wu, Yongliang, et al.
Publicado: (2024)
por: Wu, Yongliang, et al.
Publicado: (2024)
VEU-Bench: Towards Comprehensive Understanding of Video Editing
por: Li, Bozheng, et al.
Publicado: (2025)
por: Li, Bozheng, et al.
Publicado: (2025)
OpusAnimation: Code-Based Dynamic Chart Generation
por: Li, Bozheng, et al.
Publicado: (2025)
por: Li, Bozheng, et al.
Publicado: (2025)
Reframe Anything: LLM Agent for Open World Video Reframing
por: Cao, Jiawang, et al.
Publicado: (2024)
por: Cao, Jiawang, et al.
Publicado: (2024)
TimeLogic: A Temporal Logic Benchmark for Video QA
por: Swetha, Sirnam, et al.
Publicado: (2025)
por: Swetha, Sirnam, et al.
Publicado: (2025)
Adapting Point Cloud Analysis via Multimodal Bayesian Distribution Learning
por: Zhu, Xingyu, et al.
Publicado: (2026)
por: Zhu, Xingyu, et al.
Publicado: (2026)
TimeLogic Challenge @ CVPR 2026: Strong MLLMs Meet Evidence-Seeking Agents for Temporal-Logic Video Question Answering
por: Xu, Zhaoyang, et al.
Publicado: (2026)
por: Xu, Zhaoyang, et al.
Publicado: (2026)
Performance pressure and annual report text manipulation: Evidence from China
por: Yanxi Li, et al.
Publicado: (2024)
por: Yanxi Li, et al.
Publicado: (2024)
Economic Growth Expectations and Corporate Innovation: Evidence From China
por: Lujun Wang, et al.
Publicado: (2024)
por: Lujun Wang, et al.
Publicado: (2024)
Social Collaboration Does Not Shape the Effects Caused by Self‐Encoding: Evidence From Ongoing and Enduring Collaboration
por: Aiqing Nie, et al.
Publicado: (2025)
por: Aiqing Nie, et al.
Publicado: (2025)
Med-CMR: A Fine-Grained Benchmark Integrating Visual Evidence and Clinical Logic for Medical Complex Multimodal Reasoning
por: Gong, Haozhen, et al.
Publicado: (2025)
por: Gong, Haozhen, et al.
Publicado: (2025)
Firm Digital Transformation and Investment Efficiency: Evidence From China
por: Maoguo Wu, et al.
Publicado: (2026)
por: Maoguo Wu, et al.
Publicado: (2026)
VoQA: Visual-only Question Answering
por: An, Jianing, et al.
Publicado: (2025)
por: An, Jianing, et al.
Publicado: (2025)
Multifunctional agents based on 3‐dicycanovinylindan‐1‐one acceptor: Molecular design and phototheranostic application
por: Najia Zhu, et al.
Publicado: (2024)
por: Najia Zhu, et al.
Publicado: (2024)
Vibroseis Vehicle Routing Problem with Spatio-Temporal Coupled Constraints
por: Zhu, Kexin, et al.
Publicado: (2025)
por: Zhu, Kexin, et al.
Publicado: (2025)
EVIDENT: Routing MLLM Adaptation through Entity-Grounded Visual Evidence for Cross-Domain Video Temporal Grounding
por: Ahn, Geo, et al.
Publicado: (2026)
por: Ahn, Geo, et al.
Publicado: (2026)
NeoQA: Evidence-based Question Answering with Generated News Events
por: Glockner, Max, et al.
Publicado: (2025)
por: Glockner, Max, et al.
Publicado: (2025)
Evidence for a Damped Millisecond Quasi-Periodic Structure in a Fast Radio Burst
por: Xiao, Shuo, et al.
Publicado: (2026)
por: Xiao, Shuo, et al.
Publicado: (2026)
MarkIt: Training-Free Visual Markers for Precise Video Temporal Grounding
por: Fang, Pengcheng, et al.
Publicado: (2026)
por: Fang, Pengcheng, et al.
Publicado: (2026)
The Impact of Customer Environmental Pressure Perception on Supplier Greenwashing: Evidence From Environmental Tone in Annual Reports
por: Yunge Hu, et al.
Publicado: (2026)
por: Yunge Hu, et al.
Publicado: (2026)
HulluEdit: Single-Pass Evidence-Consistent Subspace Editing for Mitigating Hallucinations in Large Vision-Language Models
por: Lin, Yangguang, et al.
Publicado: (2026)
por: Lin, Yangguang, et al.
Publicado: (2026)
Video Repurposing from User Generated Content: A Large-scale Dataset and Benchmark
por: Wu, Yongliang, et al.
Publicado: (2024)
por: Wu, Yongliang, et al.
Publicado: (2024)
Zero-Shot Long-Form Video Understanding through Screenplay
por: Wu, Yongliang, et al.
Publicado: (2024)
por: Wu, Yongliang, et al.
Publicado: (2024)
TimeToM: Temporal Space is the Key to Unlocking the Door of Large Language Models' Theory-of-Mind
por: Hou, Guiyang, et al.
Publicado: (2024)
por: Hou, Guiyang, et al.
Publicado: (2024)
DateLogicQA: Benchmarking Temporal Biases in Large Language Models
por: Bhatia, Gagan, et al.
Publicado: (2024)
por: Bhatia, Gagan, et al.
Publicado: (2024)
Error-Mitigated Quantum Routing on Noisy Devices
por: Shi, Wenbo, et al.
Publicado: (2023)
por: Shi, Wenbo, et al.
Publicado: (2023)
Rumor Detection on Social Media with Temporal Propagation Structure Optimization
por: Peng, Xingyu, et al.
Publicado: (2024)
por: Peng, Xingyu, et al.
Publicado: (2024)
"The Roller Conduction Effect" from the A-share Data Evidence
por: Lyu, Wenbo
Publicado: (2023)
por: Lyu, Wenbo
Publicado: (2023)
A Multi-Expert Structural-Semantic Hybrid Framework for Unveiling Historical Patterns in Temporal Knowledge Graphs
por: Deng, Yimin, et al.
Publicado: (2025)
por: Deng, Yimin, et al.
Publicado: (2025)
Topical Application of Fluoxetine Improves DNCB‐Induced Atopic Dermatitis in Mice
por: Xue Jiang, et al.
Publicado: (2025)
por: Xue Jiang, et al.
Publicado: (2025)
Prediction-Augmented Mechanism Design for Weighted Facility Location
por: Shi, Yangguang, et al.
Publicado: (2025)
por: Shi, Yangguang, et al.
Publicado: (2025)
Nearly invariant subspaces and kernels of Toeplitz operators on the Hardy space over the bidisk
por: Zhu, Senhua, et al.
Publicado: (2024)
por: Zhu, Senhua, et al.
Publicado: (2024)
Look Carefully: Adaptive Visual Reinforcements in Multimodal Large Language Models for Hallucination Mitigation
por: Zhu, Xingyu, et al.
Publicado: (2026)
por: Zhu, Xingyu, et al.
Publicado: (2026)
QA-MoE: Towards a Continuous Reliability Spectrum with Quality-Aware Mixture of Experts for Robust Multimodal Sentiment Analysis
por: Zhu, Yitong, et al.
Publicado: (2026)
por: Zhu, Yitong, et al.
Publicado: (2026)
ROVER: Routing Object-Centric Visual Evidence for Grounded Multi-Image Reasoning
por: Lv, Guannan, et al.
Publicado: (2026)
por: Lv, Guannan, et al.
Publicado: (2026)
CircuitProbe: Tracing Visual Temporal Evidence Flow in Video Language Models
por: Zhang, Yiming, et al.
Publicado: (2025)
por: Zhang, Yiming, et al.
Publicado: (2025)
Look on Demand: A Cognitive Scheduling Framework for Visual Evidence Acquisition in Multimodal Reasoning
por: Zhang, Yang, et al.
Publicado: (2026)
por: Zhang, Yang, et al.
Publicado: (2026)
DocSeeker: Structured Visual Reasoning with Evidence Grounding for Long Document Understanding
por: Yan, Hao, et al.
Publicado: (2026)
por: Yan, Hao, et al.
Publicado: (2026)
Ejemplares similares
-
Adaptive Dense Evidence Refinement for Video Relational Reasoning for VRR-QA Challenge
por: Sun, Yuyang, et al.
Publicado: (2026) -
RSVP: Reasoning Segmentation via Visual Prompting and Multi-modal Chain-of-Thought
por: Lu, Yi, et al.
Publicado: (2025) -
Number it: Temporal Grounding Videos like Flipping Manga
por: Wu, Yongliang, et al.
Publicado: (2024) -
VEU-Bench: Towards Comprehensive Understanding of Video Editing
por: Li, Bozheng, et al.
Publicado: (2025) -
OpusAnimation: Code-Based Dynamic Chart Generation
por: Li, Bozheng, et al.
Publicado: (2025)