LUMINA: Long-horizon Understanding for Multi-turn Interactive Agents
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Rakhsha, Amin, Hehn, Thomas, Mazzaglia, Pietro, Massoli, Fabio Valerio, Behboodi, Arash, Orekondy, Tribhuvanesh |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Simulating, Fast and Slow: Learning Policies for Black-Box Optimization
par: Massoli, Fabio Valerio, et autres
Publié: (2024)
par: Massoli, Fabio Valerio, et autres
Publié: (2024)
Reinforcement Learning of Adaptive Acquisition Policies for Inverse Problems
par: Silvestri, Gianluigi, et autres
Publié: (2024)
par: Silvestri, Gianluigi, et autres
Publié: (2024)
LaneRoPE: Positional Encoding for Collaborative Parallel Reasoning and Generation
par: Cesa, Gabriele, et autres
Publié: (2026)
par: Cesa, Gabriele, et autres
Publié: (2026)
Differentiable and Learnable Wireless Simulation with Geometric Transformers
par: Hehn, Thomas, et autres
Publié: (2024)
par: Hehn, Thomas, et autres
Publié: (2024)
Reasoning as Compression: Unifying Budget Forcing via the Conditional Information Bottleneck
par: Massoli, Fabio Valerio, et autres
Publié: (2026)
par: Massoli, Fabio Valerio, et autres
Publié: (2026)
Variational Learning ISTA
par: Massoli, Fabio Valerio, et autres
Publié: (2024)
par: Massoli, Fabio Valerio, et autres
Publié: (2024)
Memory-Efficient Looped Transformer: Decoupling Compute from Memory in Looped Language Models
par: Vendrell, Victor Conchello, et autres
Publié: (2026)
par: Vendrell, Victor Conchello, et autres
Publié: (2026)
When Cloud Agents Meet Device Agents: Lessons from Hybrid Multi-Agent Systems
par: Rainone, Corrado, et autres
Publié: (2026)
par: Rainone, Corrado, et autres
Publié: (2026)
Fundamental bounds on efficiency-confidence trade-off for transductive conformal prediction
par: Behboodi, Arash, et autres
Publié: (2025)
par: Behboodi, Arash, et autres
Publié: (2025)
An Information Theoretic Perspective on Conformal Prediction
par: Correia, Alvaro H. C., et autres
Publié: (2024)
par: Correia, Alvaro H. C., et autres
Publié: (2024)
PID Accelerated Temporal Difference Algorithms
par: Bedaywi, Mark, et autres
Publié: (2024)
par: Bedaywi, Mark, et autres
Publié: (2024)
Vision-Assisted Digital Twin Creation for mmWave Beam Management
par: Arnold, Maximilian, et autres
Publié: (2024)
par: Arnold, Maximilian, et autres
Publié: (2024)
Information-driven Affordance Discovery for Efficient Robotic Manipulation
par: Mazzaglia, Pietro, et autres
Publié: (2024)
par: Mazzaglia, Pietro, et autres
Publié: (2024)
LUMINA: LLM-Guided GPU Architecture Exploration via Bottleneck Analysis
par: Zhang, Tao, et autres
Publié: (2026)
par: Zhang, Tao, et autres
Publié: (2026)
MAC: A Multi-Agent Framework for Interactive User Clarification in Multi-turn Conversations
par: Acikgoz, Emre Can, et autres
Publié: (2025)
par: Acikgoz, Emre Can, et autres
Publié: (2025)
Focusing on What Matters: Object-Agent-centric Tokenization for Vision Language Action models
par: Bendikas, Rokas, et autres
Publié: (2025)
par: Bendikas, Rokas, et autres
Publié: (2025)
Multi-Agent Interactive Question Generation Framework for Long Document Understanding
par: Wang, Kesen, et autres
Publié: (2025)
par: Wang, Kesen, et autres
Publié: (2025)
Representing Positional Information in Generative World Models for Object Manipulation
par: Ferraro, Stefano, et autres
Publié: (2024)
par: Ferraro, Stefano, et autres
Publié: (2024)
Choreographer: Learning and Adapting Skills in Imagination
par: Mazzaglia, Pietro, et autres
Publié: (2022)
par: Mazzaglia, Pietro, et autres
Publié: (2022)
Neural Lattice Reduction: A Self-Supervised Geometric Deep Learning Approach
par: Marchetti, Giovanni Luca, et autres
Publié: (2023)
par: Marchetti, Giovanni Luca, et autres
Publié: (2023)
Efficient Reasoning on the Edge
par: Bondarenko, Yelysei, et autres
Publié: (2026)
par: Bondarenko, Yelysei, et autres
Publié: (2026)
Local Look-Ahead Guidance via Verifier-in-the-Loop for Automated Theorem Proving
par: Rajaee, Sara, et autres
Publié: (2025)
par: Rajaee, Sara, et autres
Publié: (2025)
LUMINA: Laplacian-Unifying Mechanism for Interpretable Neurodevelopmental Analysis via Quad-Stream GCN
par: Cha, Minkyung, et autres
Publié: (2026)
par: Cha, Minkyung, et autres
Publié: (2026)
SkyRL-Agent: Efficient RL Training for Multi-turn LLM Agent
par: Cao, Shiyi, et autres
Publié: (2025)
par: Cao, Shiyi, et autres
Publié: (2025)
Personalize-then-Store: Benchmarking and Learning Personalized Memory for Long-horizon Agents
par: In, Yeonjun, et autres
Publié: (2026)
par: In, Yeonjun, et autres
Publié: (2026)
Redundancy-aware Action Spaces for Robot Learning
par: Mazzaglia, Pietro, et autres
Publié: (2024)
par: Mazzaglia, Pietro, et autres
Publié: (2024)
Hybrid Training for Vision-Language-Action Models
par: Mazzaglia, Pietro, et autres
Publié: (2025)
par: Mazzaglia, Pietro, et autres
Publié: (2025)
Majority of the Bests: Improving Best-of-N via Bootstrapping
par: Rakhsha, Amin, et autres
Publié: (2025)
par: Rakhsha, Amin, et autres
Publié: (2025)
Asymmetric Actor-Critic for Multi-turn LLM Agents
par: Jiang, Shuli, et autres
Publié: (2026)
par: Jiang, Shuli, et autres
Publié: (2026)
On the Multi-turn Instruction Following for Conversational Web Agents
par: Deng, Yang, et autres
Publié: (2024)
par: Deng, Yang, et autres
Publié: (2024)
KLong: Training LLM Agent for Extremely Long-horizon Tasks
par: Liu, Yue, et autres
Publié: (2026)
par: Liu, Yue, et autres
Publié: (2026)
ACON: Optimizing Context Compression for Long-horizon LLM Agents
par: Kang, Minki, et autres
Publié: (2025)
par: Kang, Minki, et autres
Publié: (2025)
Long-horizon Reasoning Agent for Olympiad-Level Mathematical Problem Solving
par: Gao, Songyang, et autres
Publié: (2025)
par: Gao, Songyang, et autres
Publié: (2025)
Token Statistics Reveal Conversational Drift in Multi-turn LLM Interaction
par: Hafez, Wael, et autres
Publié: (2026)
par: Hafez, Wael, et autres
Publié: (2026)
MedSAM-Agent: Empowering Interactive Medical Image Segmentation with Multi-turn Agentic Reinforcement Learning
par: Liu, Shengyuan, et autres
Publié: (2026)
par: Liu, Shengyuan, et autres
Publié: (2026)
LUMINA-Net: Low-light Upgrade through Multi-stage Illumination and Noise Adaptation Network for Image Enhancement
par: Siddiqua, Namrah, et autres
Publié: (2025)
par: Siddiqua, Namrah, et autres
Publié: (2025)
AgentBoard: An Analytical Evaluation Board of Multi-turn LLM Agents
par: Ma, Chang, et autres
Publié: (2024)
par: Ma, Chang, et autres
Publié: (2024)
GenRL: Multimodal-foundation world models for generalization in embodied agents
par: Mazzaglia, Pietro, et autres
Publié: (2024)
par: Mazzaglia, Pietro, et autres
Publié: (2024)
Thinking by Doing: Building Efficient World Model Reasoning in LLMs via Multi-turn Interaction
par: Shu, Bao, et autres
Publié: (2025)
par: Shu, Bao, et autres
Publié: (2025)
From Self-Evolving Synthetic Data to Verifiable-Reward RL: Post-Training Multi-turn Interactive Tool-Using Agents
par: Gao, Jiaxuan, et autres
Publié: (2026)
par: Gao, Jiaxuan, et autres
Publié: (2026)
Documents similaires
-
Simulating, Fast and Slow: Learning Policies for Black-Box Optimization
par: Massoli, Fabio Valerio, et autres
Publié: (2024) -
Reinforcement Learning of Adaptive Acquisition Policies for Inverse Problems
par: Silvestri, Gianluigi, et autres
Publié: (2024) -
LaneRoPE: Positional Encoding for Collaborative Parallel Reasoning and Generation
par: Cesa, Gabriele, et autres
Publié: (2026) -
Differentiable and Learnable Wireless Simulation with Geometric Transformers
par: Hehn, Thomas, et autres
Publié: (2024) -
Reasoning as Compression: Unifying Budget Forcing via the Conditional Information Bottleneck
par: Massoli, Fabio Valerio, et autres
Publié: (2026)