Online Learning of Deceptive Policies under Intermittent Observation
Fuente:
arXiv
Salvato in:
| Autori principali: | Puthumanaillam, Gokul, Padmanabhan, Ram, Fuentes, Jose, Cruz, Nicole, Padrao, Paulo, Hernandez, Ruben, Jiang, Hao, Schafer, William, Bobadilla, Leonardo, Ornik, Melkior |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
TRACE: A Self-Improving Framework for Robot Behavior Forecasting with Vision-Language Models
di: Puthumanaillam, Gokul, et al.
Pubblicazione: (2025)
di: Puthumanaillam, Gokul, et al.
Pubblicazione: (2025)
GUIDEd Agents: Enhancing Navigation Policies through Task-Specific Uncertainty Abstraction in Localization-Limited Environments
di: Puthumanaillam, Gokul, et al.
Pubblicazione: (2024)
di: Puthumanaillam, Gokul, et al.
Pubblicazione: (2024)
SCoUT: Scalable Communication via Utility-Guided Temporal Grouping in Multi-Agent Reinforcement Learning
di: Vora, Manav, et al.
Pubblicazione: (2026)
di: Vora, Manav, et al.
Pubblicazione: (2026)
Muninn: Your Trajectory Diffusion Model But Faster
di: Puthumanaillam, Gokul, et al.
Pubblicazione: (2026)
di: Puthumanaillam, Gokul, et al.
Pubblicazione: (2026)
TAB-Fields: A Maximum Entropy Framework for Mission-Aware Adversarial Planning
di: Puthumanaillam, Gokul, et al.
Pubblicazione: (2024)
di: Puthumanaillam, Gokul, et al.
Pubblicazione: (2024)
Amortizing Trajectory Diffusion with Keyed Drift Fields
di: Puthumanaillam, Gokul, et al.
Pubblicazione: (2026)
di: Puthumanaillam, Gokul, et al.
Pubblicazione: (2026)
Enhancing Robot Navigation Policies with Task-Specific Uncertainty Managements
di: Puthumanaillam, Gokul, et al.
Pubblicazione: (2025)
di: Puthumanaillam, Gokul, et al.
Pubblicazione: (2025)
Belief-Conditioned One-Step Diffusion: Real-Time Trajectory Planning with Just-Enough Sensing
di: Puthumanaillam, Gokul, et al.
Pubblicazione: (2025)
di: Puthumanaillam, Gokul, et al.
Pubblicazione: (2025)
ComTraQ-MPC: Meta-Trained DQN-MPC Integration for Trajectory Tracking with Limited Active Localization Updates
di: Puthumanaillam, Gokul, et al.
Pubblicazione: (2024)
di: Puthumanaillam, Gokul, et al.
Pubblicazione: (2024)
Virtual Force-Based Routing of Modular Agents on a Graph
di: Casselman, Adam, et al.
Pubblicazione: (2025)
di: Casselman, Adam, et al.
Pubblicazione: (2025)
Ignore Drift, Embrace Simplicity: Constrained Nonlinear Control through Driftless Approximation
di: Padmanabhan, Ram, et al.
Pubblicazione: (2025)
di: Padmanabhan, Ram, et al.
Pubblicazione: (2025)
Energetic Resilience of Linear Driftless Systems
di: Padmanabhan, Ram, et al.
Pubblicazione: (2024)
di: Padmanabhan, Ram, et al.
Pubblicazione: (2024)
Finite-time Reachability for Constrained, Partially Uncontrolled Nonlinear Systems
di: Padmanabhan, Ram, et al.
Pubblicazione: (2026)
di: Padmanabhan, Ram, et al.
Pubblicazione: (2026)
Motion Planning and Control with Unknown Nonlinear Dynamics through Predicted Reachability
di: Zhang, Zhiquan, et al.
Pubblicazione: (2025)
di: Zhang, Zhiquan, et al.
Pubblicazione: (2025)
Weathering Ongoing Uncertainty: Learning and Planning in a Time-Varying Partially Observable Environment
di: Puthumanaillam, Gokul, et al.
Pubblicazione: (2023)
di: Puthumanaillam, Gokul, et al.
Pubblicazione: (2023)
Energetic Resilience under Temporal Logic Specifications
di: Das, Ratnangshu, et al.
Pubblicazione: (2026)
di: Das, Ratnangshu, et al.
Pubblicazione: (2026)
Identity Concealment Games: How I Learned to Stop Revealing and Love the Coincidences
di: Karabag, Mustafa O., et al.
Pubblicazione: (2021)
di: Karabag, Mustafa O., et al.
Pubblicazione: (2021)
Dynamic Regret in Time-varying MDPs with Intermittent Information
di: Musavi, Negin, et al.
Pubblicazione: (2026)
di: Musavi, Negin, et al.
Pubblicazione: (2026)
WOLF: Werewolf-based Observations for LLM Deception and Falsehoods
di: Agarwal, Mrinal, et al.
Pubblicazione: (2025)
di: Agarwal, Mrinal, et al.
Pubblicazione: (2025)
Skill Description Deception Attack against Task Routing in Internet of Agents
di: He, Jiayi, et al.
Pubblicazione: (2026)
di: He, Jiayi, et al.
Pubblicazione: (2026)
Separation is Optimal for LQR under Intermittent Feedback
di: Etcibasi, Abdullah Y., et al.
Pubblicazione: (2026)
di: Etcibasi, Abdullah Y., et al.
Pubblicazione: (2026)
Deception and Communication in Autonomous Multi-Agent Systems: An Experimental Study with Among Us
di: Milkowski, Maria, et al.
Pubblicazione: (2026)
di: Milkowski, Maria, et al.
Pubblicazione: (2026)
Communication-Constrained Multi-Robot Exploration with Intermittent Rendezvous
di: da Silva, Alysson Ribeiro, et al.
Pubblicazione: (2023)
di: da Silva, Alysson Ribeiro, et al.
Pubblicazione: (2023)
How Much Reserve Fuel: Quantifying the Maximal Energy Cost of System Disturbances
di: Padmanabhan, Ram, et al.
Pubblicazione: (2024)
di: Padmanabhan, Ram, et al.
Pubblicazione: (2024)
Distributed Detection of Adversarial Attacks for Resilient Cooperation of Multi-Robot Systems with Intermittent Communication
di: Bahrami, Rayan, et al.
Pubblicazione: (2024)
di: Bahrami, Rayan, et al.
Pubblicazione: (2024)
LLMDR: Large language model driven framework for missing data recovery in mixed data under low resource regime
di: Keshav, Durga, et al.
Pubblicazione: (2026)
di: Keshav, Durga, et al.
Pubblicazione: (2026)
Policy Optimization in Multi-Agent Settings under Partially Observable Environments
di: Zhaikhan, Ainur, et al.
Pubblicazione: (2025)
di: Zhaikhan, Ainur, et al.
Pubblicazione: (2025)
Online Safety under Multiple Constraints and Input Bounds using gatekeeper: Theory and Applications
di: Agrawal, Devansh R., et al.
Pubblicazione: (2025)
di: Agrawal, Devansh R., et al.
Pubblicazione: (2025)
The Traitors: Deception and Trust in Multi-Agent Language Model Simulations
di: Curvo, Pedro M. P.
Pubblicazione: (2025)
di: Curvo, Pedro M. P.
Pubblicazione: (2025)
Bridging Perception and Action: A Lightweight Multimodal Meta-Planner Framework for Robust Earth Observation Agents
di: Xu, Jinghui, et al.
Pubblicazione: (2026)
di: Xu, Jinghui, et al.
Pubblicazione: (2026)
Deceptive Path Planning: A Bayesian Game Approach
di: Rostobaya, Violetta, et al.
Pubblicazione: (2025)
di: Rostobaya, Violetta, et al.
Pubblicazione: (2025)
Joint Optimization of Autonomous Electric Vehicle Fleet Operations and Charging Station Siting
di: Luke, Justin, et al.
Pubblicazione: (2021)
di: Luke, Justin, et al.
Pubblicazione: (2021)
$\aleph$-IPOMDP: Mitigating Deception in a Cognitive Hierarchy with Off-Policy Counterfactual Anomaly Detection
di: Alon, Nitay, et al.
Pubblicazione: (2024)
di: Alon, Nitay, et al.
Pubblicazione: (2024)
From Global Policies to Local Strategies: Multi-Objective Optimization of Resource-Specific Handover Policies
di: Kirchdorfer, Lukas, et al.
Pubblicazione: (2026)
di: Kirchdorfer, Lukas, et al.
Pubblicazione: (2026)
Hierarchical Motion Planning and Control under Unknown Nonlinear Dynamics via Predicted Reachability
di: Zhang, Zhiquan, et al.
Pubblicazione: (2026)
di: Zhang, Zhiquan, et al.
Pubblicazione: (2026)
Finite-State Decentralized Policy-Based Control With Guaranteed Ground Coverage
di: Rastgoftar, Hossein
Pubblicazione: (2026)
di: Rastgoftar, Hossein
Pubblicazione: (2026)
Intertemporal Demand Allocation for Inventory Control in Online Marketplaces
di: Caldentey, Rene, et al.
Pubblicazione: (2026)
di: Caldentey, Rene, et al.
Pubblicazione: (2026)
Teaching an Old Dynamics New Tricks: Regularization-free Last-iterate Convergence in Zero-sum Games via BNN Dynamics
di: Zhang, Tuo, et al.
Pubblicazione: (2026)
di: Zhang, Tuo, et al.
Pubblicazione: (2026)
Analysis of the Unscented Transform Controller for Systems with Bounded Nonlinearities
di: Dinkar, Siddharth A., et al.
Pubblicazione: (2025)
di: Dinkar, Siddharth A., et al.
Pubblicazione: (2025)
Socialized Learning and Emergent Behaviors in Multi-Agent Systems based on Multimodal Large Language Models
di: Akin, Sureyya, et al.
Pubblicazione: (2025)
di: Akin, Sureyya, et al.
Pubblicazione: (2025)
Documenti analoghi
-
TRACE: A Self-Improving Framework for Robot Behavior Forecasting with Vision-Language Models
di: Puthumanaillam, Gokul, et al.
Pubblicazione: (2025) -
GUIDEd Agents: Enhancing Navigation Policies through Task-Specific Uncertainty Abstraction in Localization-Limited Environments
di: Puthumanaillam, Gokul, et al.
Pubblicazione: (2024) -
SCoUT: Scalable Communication via Utility-Guided Temporal Grouping in Multi-Agent Reinforcement Learning
di: Vora, Manav, et al.
Pubblicazione: (2026) -
Muninn: Your Trajectory Diffusion Model But Faster
di: Puthumanaillam, Gokul, et al.
Pubblicazione: (2026) -
TAB-Fields: A Maximum Entropy Framework for Mission-Aware Adversarial Planning
di: Puthumanaillam, Gokul, et al.
Pubblicazione: (2024)