Learning To Help: Training Models to Assist Legacy Devices
Fuente:
arXiv
Salvato in:
| Autori principali: | Wu, Yu, Sarwate, Anand |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Your Data, My Model: Learning Who Really Helps in Federated Learning
di: Abdurakhmanova, Shamsiiat, et al.
Pubblicazione: (2024)
di: Abdurakhmanova, Shamsiiat, et al.
Pubblicazione: (2024)
ME-IGM: Individual-Global-Max in Maximum Entropy Multi-Agent Reinforcement Learning
di: Chen, Wen-Tse, et al.
Pubblicazione: (2024)
di: Chen, Wen-Tse, et al.
Pubblicazione: (2024)
Rewarding Beliefs, Not Actions: Consistency-Guided Credit Assignment for Long-Horizon Agents
di: Tang, Wenjie, et al.
Pubblicazione: (2026)
di: Tang, Wenjie, et al.
Pubblicazione: (2026)
Latent Cache Flow: Model-to-Model Communication Without Text
di: Rossi, Maximillian, et al.
Pubblicazione: (2026)
di: Rossi, Maximillian, et al.
Pubblicazione: (2026)
Towards General Negotiation Strategies with End-to-End Reinforcement Learning
di: Renting, Bram M., et al.
Pubblicazione: (2024)
di: Renting, Bram M., et al.
Pubblicazione: (2024)
When Actions Disappear: Adversarial Action Removal in Self-Play Reinforcement Learning
di: Kujur, Arahan
Pubblicazione: (2026)
di: Kujur, Arahan
Pubblicazione: (2026)
Towards Resource-Efficient Multimodal Intelligence: Learned Routing among Specialized Expert Models
di: Saini, Mayank, et al.
Pubblicazione: (2025)
di: Saini, Mayank, et al.
Pubblicazione: (2025)
Dynamical Priors as a Training Objective in Reinforcement Learning
di: Subaharan, Sukesh
Pubblicazione: (2026)
di: Subaharan, Sukesh
Pubblicazione: (2026)
Optimally Solving Simultaneous-Move Dec-POMDPs: The Sequential Central Planning Approach
di: Peralez, Johan, et al.
Pubblicazione: (2024)
di: Peralez, Johan, et al.
Pubblicazione: (2024)
FlowSteer: Towards Agents Designing Agentic Workflows via Reinforced Progressive Canvas Editing
di: Zhang, Mingda, et al.
Pubblicazione: (2026)
di: Zhang, Mingda, et al.
Pubblicazione: (2026)
Difference Rewards Policy Gradients
di: Castellini, Jacopo, et al.
Pubblicazione: (2020)
di: Castellini, Jacopo, et al.
Pubblicazione: (2020)
Extending NGU to Multi-Agent RL: A Preliminary Study
di: Hernandez, Juan, et al.
Pubblicazione: (2025)
di: Hernandez, Juan, et al.
Pubblicazione: (2025)
Adaptive Latent-Space Constraints in Personalized Federated Learning
di: Ayromlou, Sana, et al.
Pubblicazione: (2025)
di: Ayromlou, Sana, et al.
Pubblicazione: (2025)
Advancing Transformer Architecture in Long-Context Large Language Models: A Comprehensive Survey
di: Huang, Yunpeng, et al.
Pubblicazione: (2023)
di: Huang, Yunpeng, et al.
Pubblicazione: (2023)
FedAttr: Towards Privacy-preserving Client-Level Attribution in Federated LLM Fine-tuning
di: Zhang, Su, et al.
Pubblicazione: (2026)
di: Zhang, Su, et al.
Pubblicazione: (2026)
PARNESS: A Paper Harness for End-to-End Automated Scientific Research with Dynamic Workflows, Full-Text Indexing, and Cross-Run Knowledge Accumulation
di: Wang, Yuchen, et al.
Pubblicazione: (2026)
di: Wang, Yuchen, et al.
Pubblicazione: (2026)
On Convex Optimal Value Functions For POSGs
di: Cunha, Rafael F., et al.
Pubblicazione: (2023)
di: Cunha, Rafael F., et al.
Pubblicazione: (2023)
Client-Conditional Federated Learning via Local Training Data Statistics
di: Brännvall, Rickard
Pubblicazione: (2026)
di: Brännvall, Rickard
Pubblicazione: (2026)
Robust and Diverse Multi-Agent Learning via Rational Policy Gradient
di: Lauffer, Niklas, et al.
Pubblicazione: (2025)
di: Lauffer, Niklas, et al.
Pubblicazione: (2025)
Analysing Factorizations of Action-Value Networks for Cooperative Multi-Agent Reinforcement Learning
di: Castellini, Jacopo, et al.
Pubblicazione: (2019)
di: Castellini, Jacopo, et al.
Pubblicazione: (2019)
A Principle of Targeted Intervention for Multi-Agent Reinforcement Learning
di: Liu, Anjie, et al.
Pubblicazione: (2025)
di: Liu, Anjie, et al.
Pubblicazione: (2025)
MACS: Multi-Agent Reinforcement Learning for Optimization of Crystal Structures
di: Zamaraeva, Elena, et al.
Pubblicazione: (2025)
di: Zamaraeva, Elena, et al.
Pubblicazione: (2025)
Individual Contributions as Intrinsic Exploration Scaffolds for Multi-agent Reinforcement Learning
di: Li, Xinran, et al.
Pubblicazione: (2024)
di: Li, Xinran, et al.
Pubblicazione: (2024)
Networked Agents in the Dark: Team Value Learning under Partial Observability
di: Varela, Guilherme S., et al.
Pubblicazione: (2025)
di: Varela, Guilherme S., et al.
Pubblicazione: (2025)
DualGFL: Federated Learning with a Dual-Level Coalition-Auction Game
di: Chen, Xiaobing, et al.
Pubblicazione: (2024)
di: Chen, Xiaobing, et al.
Pubblicazione: (2024)
Risk-Sensitive Multi-Agent Reinforcement Learning in Network Aggregative Markov Games
di: Ghaemi, Hafez, et al.
Pubblicazione: (2024)
di: Ghaemi, Hafez, et al.
Pubblicazione: (2024)
On the Push-Based Asynchronous Federated Learning: A Bias-Correction Aggregation Approach
di: Bai, Jiahui, et al.
Pubblicazione: (2026)
di: Bai, Jiahui, et al.
Pubblicazione: (2026)
Byzantine-Resilient Federated Learning via QUBO-Based Client Selection on Quantum Annealers
di: Ferenczi, Andras, et al.
Pubblicazione: (2026)
di: Ferenczi, Andras, et al.
Pubblicazione: (2026)
Cost-Aware Diffusion Active Search
di: Banerjee, Arundhati, et al.
Pubblicazione: (2026)
di: Banerjee, Arundhati, et al.
Pubblicazione: (2026)
ChromaFlow: A Negative Ablation Study of Orchestration Overhead in Tool-Augmented Agent Evaluation
di: Mittal, Tarun
Pubblicazione: (2026)
di: Mittal, Tarun
Pubblicazione: (2026)
StatePlane: A Cognitive State Plane for Long-Horizon AI Systems Under Bounded Context
di: Annapureddy, Sasank, et al.
Pubblicazione: (2026)
di: Annapureddy, Sasank, et al.
Pubblicazione: (2026)
Reinforcement Learning for Scalable and Trustworthy Intelligent Systems
di: Lan, Guangchen
Pubblicazione: (2026)
di: Lan, Guangchen
Pubblicazione: (2026)
RL-LLM-DT: An Automatic Decision Tree Generation Method Based on RL Evaluation and LLM Enhancement
di: Lin, Junjie, et al.
Pubblicazione: (2024)
di: Lin, Junjie, et al.
Pubblicazione: (2024)
Decentralized Time Series Classification with ROCKET Features
di: Casella, Bruno, et al.
Pubblicazione: (2025)
di: Casella, Bruno, et al.
Pubblicazione: (2025)
Distributed Value Decomposition Networks with Networked Agents
di: Varela, Guilherme S., et al.
Pubblicazione: (2025)
di: Varela, Guilherme S., et al.
Pubblicazione: (2025)
Representational Collapse in Multi-Agent LLM Committees: Measurement and Diversity-Aware Consensus
di: Patel, Dipkumar
Pubblicazione: (2026)
di: Patel, Dipkumar
Pubblicazione: (2026)
ADF-LoRA: Alternating Low-Rank Aggregation for Decentralized Federated Fine-Tuning
di: Wang, Xiaoyu, et al.
Pubblicazione: (2025)
di: Wang, Xiaoyu, et al.
Pubblicazione: (2025)
Collaboration Promotes Group Resilience in Multi-Agent RL
di: Shraga, Ilai, et al.
Pubblicazione: (2021)
di: Shraga, Ilai, et al.
Pubblicazione: (2021)
Policy Search, Retrieval, and Composition via Task Similarity in Collaborative Agentic Systems
di: Nath, Saptarshi, et al.
Pubblicazione: (2025)
di: Nath, Saptarshi, et al.
Pubblicazione: (2025)
Territory Paint Wars: Diagnosing and Mitigating Failure Modes in Competitive Multi-Agent PPO
di: Singh, Diyansha
Pubblicazione: (2026)
di: Singh, Diyansha
Pubblicazione: (2026)
Documenti analoghi
-
Your Data, My Model: Learning Who Really Helps in Federated Learning
di: Abdurakhmanova, Shamsiiat, et al.
Pubblicazione: (2024) -
ME-IGM: Individual-Global-Max in Maximum Entropy Multi-Agent Reinforcement Learning
di: Chen, Wen-Tse, et al.
Pubblicazione: (2024) -
Rewarding Beliefs, Not Actions: Consistency-Guided Credit Assignment for Long-Horizon Agents
di: Tang, Wenjie, et al.
Pubblicazione: (2026) -
Latent Cache Flow: Model-to-Model Communication Without Text
di: Rossi, Maximillian, et al.
Pubblicazione: (2026) -
Towards General Negotiation Strategies with End-to-End Reinforcement Learning
di: Renting, Bram M., et al.
Pubblicazione: (2024)