Saved in:
| Main Authors: | Yiyan, Liang, Liu, Sifei, Zhang, Weitong |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | https://arxiv.org/abs/2605.29033 |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Energy-Weighted Flow Matching for Offline Reinforcement Learning
by: Zhang, Shiyuan, et al.
Published: (2025)
by: Zhang, Shiyuan, et al.
Published: (2025)
Return-to-Go Is More Than a Number: Q-Guided Alignment for Return-Conditioned Supervised Learning
by: Yang, Yuxiao, et al.
Published: (2026)
by: Yang, Yuxiao, et al.
Published: (2026)
Q-MMR: Off-Policy Evaluation via Recursive Reweighting and Moment Matching
by: Li, Xiang, et al.
Published: (2026)
by: Li, Xiang, et al.
Published: (2026)
A Few Moments Please: Scalable Graphon Learning via Moment Matching
by: Ramezanpour, Reza, et al.
Published: (2025)
by: Ramezanpour, Reza, et al.
Published: (2025)
Moment Matching Denoising Gibbs Sampling
by: Zhang, Mingtian, et al.
Published: (2023)
by: Zhang, Mingtian, et al.
Published: (2023)
Inductive Moment Matching
by: Zhou, Linqi, et al.
Published: (2025)
by: Zhou, Linqi, et al.
Published: (2025)
Near-Optimal Second-Order Guarantees for Model-Based Adversarial Imitation Learning
by: Li, Shangzhe, et al.
Published: (2025)
by: Li, Shangzhe, et al.
Published: (2025)
Provably Efficient Offline-to-Online Value Adaptation with General Function Approximation
by: Li, Shangzhe, et al.
Published: (2026)
by: Li, Shangzhe, et al.
Published: (2026)
Moment Alignment: Unifying Gradient and Hessian Matching for Domain Generalization
by: Chen, Yuen, et al.
Published: (2025)
by: Chen, Yuen, et al.
Published: (2025)
Your Self-Play Algorithm is Secretly an Adversarial Imitator: Understanding LLM Self-Play through the Lens of Imitation Learning
by: Li, Shangzhe, et al.
Published: (2026)
by: Li, Shangzhe, et al.
Published: (2026)
Neural Tractability via Structure: Learning-Augmented Algorithms for Graph Combinatorial Optimization
by: Li, Jialiang, et al.
Published: (2025)
by: Li, Jialiang, et al.
Published: (2025)
Imitation from Observations with Trajectory-Level Generative Embeddings
by: Qu, Yongtao, et al.
Published: (2026)
by: Qu, Yongtao, et al.
Published: (2026)
Evaluating Uplift Modeling under Structural Biases: Insights into Metric Stability and Model Robustness
by: Yang, Yuxuan, et al.
Published: (2026)
by: Yang, Yuxuan, et al.
Published: (2026)
Janus-Q: End-to-End Event-Driven Trading via Hierarchical-Gated Reward Modeling
by: Li, Xiang, et al.
Published: (2026)
by: Li, Xiang, et al.
Published: (2026)
Optimal Horizon-Free Reward-Free Exploration for Linear Mixture MDPs
by: Zhang, Junkai, et al.
Published: (2023)
by: Zhang, Junkai, et al.
Published: (2023)
Sharper Bounds for Chebyshev Moment Matching, with Applications
by: Musco, Cameron, et al.
Published: (2024)
by: Musco, Cameron, et al.
Published: (2024)
Stiefel Flow Matching for Moment-Constrained Structure Elucidation
by: Cheng, Austin, et al.
Published: (2024)
by: Cheng, Austin, et al.
Published: (2024)
Asymptotically Unbiased Synthetic Control Methods by Moment Matching
by: Kato, Masahiro, et al.
Published: (2023)
by: Kato, Masahiro, et al.
Published: (2023)
Adversarial Moment-Matching Distillation of Large Language Models
by: Jia, Chen
Published: (2024)
by: Jia, Chen
Published: (2024)
OGLS-SD: On-Policy Self-Distillation with Outcome-Guided Logit Steering for LLM Reasoning
by: Yang, Yuxiao, et al.
Published: (2026)
by: Yang, Yuxiao, et al.
Published: (2026)
Q-learning with Adjoint Matching
by: Li, Qiyang, et al.
Published: (2026)
by: Li, Qiyang, et al.
Published: (2026)
Enhancing Financial Market Predictions: Causality-Driven Feature Selection
by: Liang, Wenhao, et al.
Published: (2024)
by: Liang, Wenhao, et al.
Published: (2024)
Unlearning Evaluation through Subset Statistical Independence
by: Zhang, Chenhao, et al.
Published: (2026)
by: Zhang, Chenhao, et al.
Published: (2026)
Nonlinearity and Uncertainty Informed Moment-Matching Gaussian Mixture Splitting
by: Kulik, Jackson, et al.
Published: (2024)
by: Kulik, Jackson, et al.
Published: (2024)
Toward Efficient Data-Free Unlearning
by: Zhang, Chenhao, et al.
Published: (2024)
by: Zhang, Chenhao, et al.
Published: (2024)
Achieving Constant Regret in Linear Markov Decision Processes
by: Zhang, Weitong, et al.
Published: (2024)
by: Zhang, Weitong, et al.
Published: (2024)
Guided Learning: Lubricating End-to-End Modeling for Multi-stage Decision-making
by: Guo, Jian, et al.
Published: (2024)
by: Guo, Jian, et al.
Published: (2024)
Calibrating Deep Neural Network using Euclidean Distance
by: Liang, Wenhao, et al.
Published: (2024)
by: Liang, Wenhao, et al.
Published: (2024)
Trust Region Q Adjoint Matching
by: Dong, Yonghoon, et al.
Published: (2026)
by: Dong, Yonghoon, et al.
Published: (2026)
Training-Free Generative Sampling via Moment-Matched Score Smoothing
by: Yao, Zhenyu, et al.
Published: (2026)
by: Yao, Zhenyu, et al.
Published: (2026)
Asymptotic FDR Control with Model-X Knockoffs: Is Moments Matching Sufficient?
by: Fan, Yingying, et al.
Published: (2025)
by: Fan, Yingying, et al.
Published: (2025)
Sketchy Moment Matching: Toward Fast and Provable Data Selection for Finetuning
by: Dong, Yijun, et al.
Published: (2024)
by: Dong, Yijun, et al.
Published: (2024)
Uncertainty-Aware Reward-Free Exploration with General Function Approximation
by: Zhang, Junkai, et al.
Published: (2024)
by: Zhang, Junkai, et al.
Published: (2024)
Lifting Manifolds to Mitigate Pseudo-Alignment in LLM4TS
by: Zheng, Liangwei Nathan, et al.
Published: (2025)
by: Zheng, Liangwei Nathan, et al.
Published: (2025)
NUM2EVENT: Interpretable Event Reasoning from Numerical time-series
by: Feng, Ninghui, et al.
Published: (2025)
by: Feng, Ninghui, et al.
Published: (2025)
MasRouter: Learning to Route LLMs for Multi-Agent Systems
by: Yue, Yanwei, et al.
Published: (2025)
by: Yue, Yanwei, et al.
Published: (2025)
Exact Gaussian Moment Matching for Residual Networks: a Second-Order Method
by: Kuang, Simon, et al.
Published: (2026)
by: Kuang, Simon, et al.
Published: (2026)
Distributionally Robust Policy Evaluation and Learning for Continuous Treatment with Observational Data
by: Leung, Cheuk Hang, et al.
Published: (2025)
by: Leung, Cheuk Hang, et al.
Published: (2025)
Learning a Diffusion Model Policy from Rewards via Q-Score Matching
by: Psenka, Michael, et al.
Published: (2023)
by: Psenka, Michael, et al.
Published: (2023)
Continuous Q-Score Matching: Diffusion Guided Reinforcement Learning for Continuous-Time Control
by: Hua, Chengxiu, et al.
Published: (2025)
by: Hua, Chengxiu, et al.
Published: (2025)
Similar Items
-
Energy-Weighted Flow Matching for Offline Reinforcement Learning
by: Zhang, Shiyuan, et al.
Published: (2025) -
Return-to-Go Is More Than a Number: Q-Guided Alignment for Return-Conditioned Supervised Learning
by: Yang, Yuxiao, et al.
Published: (2026) -
Q-MMR: Off-Policy Evaluation via Recursive Reweighting and Moment Matching
by: Li, Xiang, et al.
Published: (2026) -
A Few Moments Please: Scalable Graphon Learning via Moment Matching
by: Ramezanpour, Reza, et al.
Published: (2025) -
Moment Matching Denoising Gibbs Sampling
by: Zhang, Mingtian, et al.
Published: (2023)