A Multi-Agent Perception-Action Alliance for Efficient Long Video Reasoning
Fuente:
arXiv
Salvato in:
| Autori principali: | Xu, Yichang, Liu, Gaowen, Kompella, Ramana Rao, Huang, Tiansheng, Hu, Sihao, Ilhan, Fatih, Tekin, Selim Furkan, Yahn, Zachary, Liu, Ling |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
A Neurosymbolic Agent System for Compositional Visual Reasoning
di: Xu, Yichang, et al.
Pubblicazione: (2025)
di: Xu, Yichang, et al.
Pubblicazione: (2025)
A Survey on Large Language Model-Based Game Agents
di: Hu, Sihao, et al.
Pubblicazione: (2024)
di: Hu, Sihao, et al.
Pubblicazione: (2024)
Attention-aware Inference Optimizations for Large Vision-Language Models with Memory-efficient Decoding
di: Ilhan, Fatih, et al.
Pubblicazione: (2026)
di: Ilhan, Fatih, et al.
Pubblicazione: (2026)
Safety Tax: Safety Alignment Makes Your Large Reasoning Models Less Reasonable
di: Huang, Tiansheng, et al.
Pubblicazione: (2025)
di: Huang, Tiansheng, et al.
Pubblicazione: (2025)
Dynamic Optimizations of LLM Ensembles with Two-Stage Reinforcement Learning Agents
di: Tekin, Selim Furkan, et al.
Pubblicazione: (2025)
di: Tekin, Selim Furkan, et al.
Pubblicazione: (2025)
H3Fusion: Helpful, Harmless, Honest Fusion of Aligned LLMs
di: Tekin, Selim Furkan, et al.
Pubblicazione: (2024)
di: Tekin, Selim Furkan, et al.
Pubblicazione: (2024)
Adversarial Attention Perturbations for Large Object Detection Transformers
di: Yahn, Zachary, et al.
Pubblicazione: (2025)
di: Yahn, Zachary, et al.
Pubblicazione: (2025)
Vision Verification Enhanced Fusion of VLMs for Efficient Visual Reasoning
di: Tekin, Selim Furkan, et al.
Pubblicazione: (2026)
di: Tekin, Selim Furkan, et al.
Pubblicazione: (2026)
Personalized Face Privacy Protection From a Single Image
di: Yahn, Zachary, et al.
Pubblicazione: (2026)
di: Yahn, Zachary, et al.
Pubblicazione: (2026)
LLM-TOPLA: Efficient LLM Ensemble by Maximising Diversity
di: Tekin, Selim Furkan, et al.
Pubblicazione: (2024)
di: Tekin, Selim Furkan, et al.
Pubblicazione: (2024)
FedHFT: Efficient Federated Finetuning with Heterogeneous Edge Clients
di: Ilhan, Fatih, et al.
Pubblicazione: (2025)
di: Ilhan, Fatih, et al.
Pubblicazione: (2025)
Lisa: Lazy Safety Alignment for Large Language Models against Harmful Fine-tuning Attack
di: Huang, Tiansheng, et al.
Pubblicazione: (2024)
di: Huang, Tiansheng, et al.
Pubblicazione: (2024)
Virus: Harmful Fine-tuning Attack for Large Language Models Bypassing Guardrail Moderation
di: Huang, Tiansheng, et al.
Pubblicazione: (2025)
di: Huang, Tiansheng, et al.
Pubblicazione: (2025)
Booster: Tackling Harmful Fine-tuning for Large Language Models via Attenuating Harmful Perturbation
di: Huang, Tiansheng, et al.
Pubblicazione: (2024)
di: Huang, Tiansheng, et al.
Pubblicazione: (2024)
Harmful Fine-tuning Attacks and Defenses for Large Language Models: A Survey
di: Huang, Tiansheng, et al.
Pubblicazione: (2024)
di: Huang, Tiansheng, et al.
Pubblicazione: (2024)
MELT: A Behavioral Trace Dataset for High-Risk Memecoin Launch Detection
di: Hu, Sihao, et al.
Pubblicazione: (2026)
di: Hu, Sihao, et al.
Pubblicazione: (2026)
A Layered Protocol Architecture for the Internet of Agents
di: Fleming, Charles, et al.
Pubblicazione: (2025)
di: Fleming, Charles, et al.
Pubblicazione: (2025)
Robust Few-Shot Ensemble Learning with Focal Diversity-Based Pruning
di: Tekin, Selim Furkan, et al.
Pubblicazione: (2024)
di: Tekin, Selim Furkan, et al.
Pubblicazione: (2024)
LongVideoAgent: Multi-Agent Reasoning with Long Videos
di: Liu, Runtao, et al.
Pubblicazione: (2025)
di: Liu, Runtao, et al.
Pubblicazione: (2025)
PyraVid: Hierarchical Multimodal Memory for Long-Horizon Video Reasoning
di: Yan, Sikuan, et al.
Pubblicazione: (2026)
di: Yan, Sikuan, et al.
Pubblicazione: (2026)
Bridging Perception and Action: A Lightweight Multimodal Meta-Planner Framework for Robust Earth Observation Agents
di: Xu, Jinghui, et al.
Pubblicazione: (2026)
di: Xu, Jinghui, et al.
Pubblicazione: (2026)
Heterogeneous Consensus-Progressive Reasoning for Efficient Multi-Agent Debate
di: Liu, Yiqing, et al.
Pubblicazione: (2026)
di: Liu, Yiqing, et al.
Pubblicazione: (2026)
DemMA: Dementia Multi-Turn Dialogue Agent with Expert-Guided Reasoning and Action Simulation
di: Song, Yutong, et al.
Pubblicazione: (2026)
di: Song, Yutong, et al.
Pubblicazione: (2026)
Large Language Model based Smart Contract Auditing with LLMBugScanner
di: Yuan, Yining, et al.
Pubblicazione: (2025)
di: Yuan, Yining, et al.
Pubblicazione: (2025)
A Blockchain-Monitored Agentic AI Architecture for Trusted Perception-Reasoning-Action Pipelines
di: Jan, Salman, et al.
Pubblicazione: (2025)
di: Jan, Salman, et al.
Pubblicazione: (2025)
Efficient Multitask Dense Predictor via Binarization
di: Shang, Yuzhang, et al.
Pubblicazione: (2024)
di: Shang, Yuzhang, et al.
Pubblicazione: (2024)
Hollywood Town: Long-Video Generation via Cross-Modal Multi-Agent Orchestration
di: Wei, Zheng, et al.
Pubblicazione: (2025)
di: Wei, Zheng, et al.
Pubblicazione: (2025)
Adaptive Coopetition: Leveraging Coarse Verifier Signals for Resilient Multi-Agent LLM Reasoning
di: Huang, Rui Jerry, et al.
Pubblicazione: (2025)
di: Huang, Rui Jerry, et al.
Pubblicazione: (2025)
EnactToM: An Evolving Benchmark for Functional Theory of Mind in Embodied Agents
di: Juneja, Gurusha, et al.
Pubblicazione: (2026)
di: Juneja, Gurusha, et al.
Pubblicazione: (2026)
SpecBench: Evaluating Specification-Level Reasoning for Software Engineering LLM Agents
di: Hamblin, Grant, et al.
Pubblicazione: (2026)
di: Hamblin, Grant, et al.
Pubblicazione: (2026)
Logic of Awareness in Agent's Reasoning
di: Kubono, Yudai, et al.
Pubblicazione: (2023)
di: Kubono, Yudai, et al.
Pubblicazione: (2023)
Real-Time Robot Execution with Masked Action Chunking
di: Wang, Haoxuan, et al.
Pubblicazione: (2026)
di: Wang, Haoxuan, et al.
Pubblicazione: (2026)
Breaking the Communication-Accuracy Trade-off: A Sparsified Information Diffusion Framework for Multi-Agent Collaborative Perception
di: Zha, Jirong, et al.
Pubblicazione: (2026)
di: Zha, Jirong, et al.
Pubblicazione: (2026)
Collaborative Belief Reasoning with LLMs for Efficient Multi-Agent Collaboration
di: Wang, Zhimin, et al.
Pubblicazione: (2025)
di: Wang, Zhimin, et al.
Pubblicazione: (2025)
Efficient Multiagent Planning via Shared Action Suggestions
di: Asmar, Dylan M., et al.
Pubblicazione: (2024)
di: Asmar, Dylan M., et al.
Pubblicazione: (2024)
Intrinsic Action Tendency Consistency for Cooperative Multi-Agent Reinforcement Learning
di: Zhang, Junkai, et al.
Pubblicazione: (2024)
di: Zhang, Junkai, et al.
Pubblicazione: (2024)
Physical AI Agents: Integrating Cognitive Intelligence with Real-World Action
di: Bousetouane, Fouad
Pubblicazione: (2025)
di: Bousetouane, Fouad
Pubblicazione: (2025)
Collaborating Action by Action: A Multi-agent LLM Framework for Embodied Reasoning
di: White, Isadora, et al.
Pubblicazione: (2025)
di: White, Isadora, et al.
Pubblicazione: (2025)
JointPPO: Diving Deeper into the Effectiveness of PPO in Multi-Agent Reinforcement Learning
di: Liu, Chenxing, et al.
Pubblicazione: (2024)
di: Liu, Chenxing, et al.
Pubblicazione: (2024)
From Assumptions to Actions: Turning LLM Reasoning into Uncertainty-Aware Planning for Embodied Agents
di: Seo, SeungWon, et al.
Pubblicazione: (2026)
di: Seo, SeungWon, et al.
Pubblicazione: (2026)
Documenti analoghi
-
A Neurosymbolic Agent System for Compositional Visual Reasoning
di: Xu, Yichang, et al.
Pubblicazione: (2025) -
A Survey on Large Language Model-Based Game Agents
di: Hu, Sihao, et al.
Pubblicazione: (2024) -
Attention-aware Inference Optimizations for Large Vision-Language Models with Memory-efficient Decoding
di: Ilhan, Fatih, et al.
Pubblicazione: (2026) -
Safety Tax: Safety Alignment Makes Your Large Reasoning Models Less Reasonable
di: Huang, Tiansheng, et al.
Pubblicazione: (2025) -
Dynamic Optimizations of LLM Ensembles with Two-Stage Reinforcement Learning Agents
di: Tekin, Selim Furkan, et al.
Pubblicazione: (2025)