Robust Fast Adaptation from Adversarially Explicit Task Distribution Generation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wang, Cheems, Lv, Yiqin, Mao, Yixiu, Qu, Yun, Xu, Yi, Ji, Xiangyang |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments
par: Qu, Yun, et autres
Publié: (2025)
par: Qu, Yun, et autres
Publié: (2025)
Model Predictive Task Sampling for Efficient and Robust Adaptation
par: Wang, Qi, et autres
Publié: (2025)
par: Wang, Qi, et autres
Publié: (2025)
Latent Reward: LLM-Empowered Credit Assignment in Episodic Reinforcement Learning
par: Qu, Yun, et autres
Publié: (2024)
par: Qu, Yun, et autres
Publié: (2024)
Adaptive Neighborhood-Constrained Q Learning for Offline Reinforcement Learning
par: Mao, Yixiu, et autres
Publié: (2025)
par: Mao, Yixiu, et autres
Publié: (2025)
VAO: Validation-Aligned Optimization for Cross-Task Generative Auto-Bidding
par: Lv, Yiqin, et autres
Publié: (2025)
par: Lv, Yiqin, et autres
Publié: (2025)
Doubly Mild Generalization for Offline Reinforcement Learning
par: Mao, Yixiu, et autres
Publié: (2024)
par: Mao, Yixiu, et autres
Publié: (2024)
Offline Reinforcement Learning with OOD State Correction and OOD Action Suppression
par: Mao, Yixiu, et autres
Publié: (2024)
par: Mao, Yixiu, et autres
Publié: (2024)
Dynamics-Predictive Sampling for Active RL Finetuning of Large Reasoning Models
par: Mao, Yixiu, et autres
Publié: (2026)
par: Mao, Yixiu, et autres
Publié: (2026)
RLVR without Ineffective Samples: Group Prioritized Off-Policy Optimization for LLM Reasoning
par: Mao, Yixiu, et autres
Publié: (2026)
par: Mao, Yixiu, et autres
Publié: (2026)
Utility-Diversity Aware Online Batch Selection for LLM Supervised Fine-tuning
par: Zou, Heming, et autres
Publié: (2025)
par: Zou, Heming, et autres
Publié: (2025)
Can Prompt Difficulty be Online Predicted for Accelerating RL Finetuning of Reasoning Models?
par: Qu, Yun, et autres
Publié: (2025)
par: Qu, Yun, et autres
Publié: (2025)
Theoretical Investigations and Practical Enhancements on Tail Task Risk Minimization in Meta Learning
par: Lv, Yiqin, et autres
Publié: (2024)
par: Lv, Yiqin, et autres
Publié: (2024)
Enhancing Generative Auto-bidding with Offline Reward Evaluation and Policy Search
par: Mou, Zhiyu, et autres
Publié: (2025)
par: Mou, Zhiyu, et autres
Publié: (2025)
Small Generalizable Prompt Predictive Models Can Steer Efficient RL Post-Training of Large Reasoning Models
par: Qu, Yun, et autres
Publié: (2026)
par: Qu, Yun, et autres
Publié: (2026)
Gains: Fine-grained Federated Domain Adaptation in Open Set
par: Zhong, Zhengyi, et autres
Publié: (2025)
par: Zhong, Zhengyi, et autres
Publié: (2025)
Enhancing Adversarial Robustness via Uncertainty-Aware Distributional Adversarial Training
par: Dong, Junhao, et autres
Publié: (2024)
par: Dong, Junhao, et autres
Publié: (2024)
Listwise Policy Optimization: Group-based RLVR as Target-Projection on the LLM Response Simplex
par: Qu, Yun, et autres
Publié: (2026)
par: Qu, Yun, et autres
Publié: (2026)
The Pitfalls and Promise of Conformal Inference Under Adversarial Attacks
par: Liu, Ziquan, et autres
Publié: (2024)
par: Liu, Ziquan, et autres
Publié: (2024)
GO4Align: Group Optimization for Multi-Task Alignment
par: Shen, Jiayi, et autres
Publié: (2024)
par: Shen, Jiayi, et autres
Publié: (2024)
On the Effects of Adversarial Perturbations on Distribution Robustness
par: Wang, Yipei, et autres
Publié: (2026)
par: Wang, Yipei, et autres
Publié: (2026)
Stochastic Weakly Convex Optimization Under Heavy-Tailed Noises
par: Zhu, Tianxi, et autres
Publié: (2025)
par: Zhu, Tianxi, et autres
Publié: (2025)
Stop Wandering, Find the Keys: LLMs Discriminate Key States for Efficient Multi-Agent Exploration
par: Qu, Yun, et autres
Publié: (2024)
par: Qu, Yun, et autres
Publié: (2024)
Robust Multi-Task Learning with Excess Risks
par: He, Yifei, et autres
Publié: (2024)
par: He, Yifei, et autres
Publié: (2024)
Are Fast Methods Stable in Adversarially Robust Transfer Learning?
par: Zhao, Joshua C., et autres
Publié: (2025)
par: Zhao, Joshua C., et autres
Publié: (2025)
Ignition Phase : Standard Training for Fast Adversarial Robustness
par: Yu-Hang, Wang, et autres
Publié: (2025)
par: Yu-Hang, Wang, et autres
Publié: (2025)
How Learning Dynamics Drive Adversarially Robust Generalization?
par: Xu, Yuelin, et autres
Publié: (2024)
par: Xu, Yuelin, et autres
Publié: (2024)
Reducing Fine-Tuning Memory Overhead by Approximate and Memory-Sharing Backpropagation
par: Yang, Yuchen, et autres
Publié: (2024)
par: Yang, Yuchen, et autres
Publié: (2024)
Class-wise Federated Unlearning: Harnessing Active Forgetting with Teacher-Student Memory Generation
par: Li, Yuyuan, et autres
Publié: (2023)
par: Li, Yuyuan, et autres
Publié: (2023)
Robust Distribution Learning with Local and Global Adversarial Corruptions
par: Nietert, Sloan, et autres
Publié: (2024)
par: Nietert, Sloan, et autres
Publié: (2024)
Distributionally Robust Learning for Multi-source Unsupervised Domain Adaptation
par: Wang, Zhenyu, et autres
Publié: (2023)
par: Wang, Zhenyu, et autres
Publié: (2023)
Score-Based Model for Low-Rank Tensor Recovery
par: Cheng, Zhengyun, et autres
Publié: (2025)
par: Cheng, Zhengyun, et autres
Publié: (2025)
Distribution Transformers: Fast Approximate Bayesian Inference With On-The-Fly Prior Adaptation
par: Whittle, George, et autres
Publié: (2025)
par: Whittle, George, et autres
Publié: (2025)
Solution for Point Tracking Task of ICCV 1st Perception Test Challenge 2023
par: Pan, Hongpeng, et autres
Publié: (2024)
par: Pan, Hongpeng, et autres
Publié: (2024)
On Generalization and Regularization via Wasserstein Distributionally Robust Optimization
par: Wu, Qinyu, et autres
Publié: (2022)
par: Wu, Qinyu, et autres
Publié: (2022)
Flow-Matching Based Refiner for Molecular Conformer Generation
par: Xu, Xiangyang, et autres
Publié: (2025)
par: Xu, Xiangyang, et autres
Publié: (2025)
Towards Optimal Adversarial Robust Reinforcement Learning with Infinity Measurement Error
par: Li, Haoran, et autres
Publié: (2025)
par: Li, Haoran, et autres
Publié: (2025)
The Price of Implicit Bias in Adversarially Robust Generalization
par: Tsilivis, Nikolaos, et autres
Publié: (2024)
par: Tsilivis, Nikolaos, et autres
Publié: (2024)
FlyLoRA: Boosting Task Decoupling and Parameter Efficiency via Implicit Rank-Wise Mixture-of-Experts
par: Zou, Heming, et autres
Publié: (2025)
par: Zou, Heming, et autres
Publié: (2025)
Distributionally Robust Multi-Task Reinforcement Learning via Adaptive Task Sampling
par: Corrado, Nicholas E., et autres
Publié: (2026)
par: Corrado, Nicholas E., et autres
Publié: (2026)
Continual Domain Adversarial Adaptation via Double-Head Discriminators
par: Shen, Yan, et autres
Publié: (2024)
par: Shen, Yan, et autres
Publié: (2024)
Documents similaires
-
Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments
par: Qu, Yun, et autres
Publié: (2025) -
Model Predictive Task Sampling for Efficient and Robust Adaptation
par: Wang, Qi, et autres
Publié: (2025) -
Latent Reward: LLM-Empowered Credit Assignment in Episodic Reinforcement Learning
par: Qu, Yun, et autres
Publié: (2024) -
Adaptive Neighborhood-Constrained Q Learning for Offline Reinforcement Learning
par: Mao, Yixiu, et autres
Publié: (2025) -
VAO: Validation-Aligned Optimization for Cross-Task Generative Auto-Bidding
par: Lv, Yiqin, et autres
Publié: (2025)