Salvato in:
| Autori principali: | Li, Yawen, Hu, Tao, Lian, Zhouhui, Tian, Wan, Peng, Yijie, Zhang, Huiming, Li, Zhongyi |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2603.21541 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
A Sharper Picture of Generalization in Transformers
di: Lintilhac, Paul, et al.
Pubblicazione: (2026)
di: Lintilhac, Paul, et al.
Pubblicazione: (2026)
Sharper Error Bounds in Late Fusion Multi-view Clustering Using Eigenvalue Proportion
di: Du, Liang, et al.
Pubblicazione: (2024)
di: Du, Liang, et al.
Pubblicazione: (2024)
Tail-Aware Information-Theoretic Generalization for RLHF and SGLD
di: Zhang, Huiming, et al.
Pubblicazione: (2026)
di: Zhang, Huiming, et al.
Pubblicazione: (2026)
Machine Learning-Assisted High-Dimensional Matrix Estimation
di: Tian, Wan, et al.
Pubblicazione: (2026)
di: Tian, Wan, et al.
Pubblicazione: (2026)
LLM-Inspired Pretrain-Then-Finetune for Small-Data, Large-Scale Optimization
di: Zhang, Zishi, et al.
Pubblicazione: (2026)
di: Zhang, Zishi, et al.
Pubblicazione: (2026)
RiskPO: Risk-based Policy Optimization via Verifiable Reward for LLM Post-Training
di: Ren, Tao, et al.
Pubblicazione: (2025)
di: Ren, Tao, et al.
Pubblicazione: (2025)
From Small to Large: Generalization Bounds for Transformers on Variable-Size Inputs
di: Alokhina, Anastasiia, et al.
Pubblicazione: (2025)
di: Alokhina, Anastasiia, et al.
Pubblicazione: (2025)
FLOPS: Forward Learning with OPtimal Sampling
di: Ren, Tao, et al.
Pubblicazione: (2024)
di: Ren, Tao, et al.
Pubblicazione: (2024)
Why Adam Can Beat SGD: Second-Moment Normalization Yields Sharper Tails
di: Jin, Ruinan, et al.
Pubblicazione: (2026)
di: Jin, Ruinan, et al.
Pubblicazione: (2026)
CAST-CKT: Chaos-Aware Spatio-Temporal and Cross-City Knowledge Transfer for Traffic Flow Prediction
di: Fofanah, Abdul Joseph, et al.
Pubblicazione: (2026)
di: Fofanah, Abdul Joseph, et al.
Pubblicazione: (2026)
HELM: Harness-Enhanced Long-horizon Memory for Vision-Language-Action Manipulation
di: Zeng, Zijian, et al.
Pubblicazione: (2026)
di: Zeng, Zijian, et al.
Pubblicazione: (2026)
Disentanglement of Variations with Multimodal Generative Modeling
di: Zhang, Yijie, et al.
Pubblicazione: (2025)
di: Zhang, Yijie, et al.
Pubblicazione: (2025)
Adaptive Robust Estimator for Multi-Agent Reinforcement Learning
di: Li, Zhongyi, et al.
Pubblicazione: (2026)
di: Li, Zhongyi, et al.
Pubblicazione: (2026)
Representational Homomorphism Predicts and Improves Compositional Generalization In Transformer Language Model
di: An, Zhiyu, et al.
Pubblicazione: (2026)
di: An, Zhiyu, et al.
Pubblicazione: (2026)
Towards Mitigation of Hallucination for LLM-empowered Agents: Progressive Generalization Bound Exploration and Watchdog Monitor
di: Liu, Siyuan, et al.
Pubblicazione: (2025)
di: Liu, Siyuan, et al.
Pubblicazione: (2025)
Selective Reviews of Bandit Problems in AI via a Statistical View
di: Zhou, Pengjie, et al.
Pubblicazione: (2024)
di: Zhou, Pengjie, et al.
Pubblicazione: (2024)
From Uniform to Adaptive: General Skip-Block Mechanisms for Efficient PDE Neural Operators
di: Liu, Lei, et al.
Pubblicazione: (2025)
di: Liu, Lei, et al.
Pubblicazione: (2025)
CHARM: Calibrating Reward Models With Chatbot Arena Scores
di: Zhu, Xiao, et al.
Pubblicazione: (2025)
di: Zhu, Xiao, et al.
Pubblicazione: (2025)
Efficient Generative Model Training via Embedded Representation Warmup
di: Liu, Deyuan, et al.
Pubblicazione: (2025)
di: Liu, Deyuan, et al.
Pubblicazione: (2025)
Task-Aware Harmony Multi-Task Decision Transformer for Offline Reinforcement Learning
di: Fan, Ziqing, et al.
Pubblicazione: (2024)
di: Fan, Ziqing, et al.
Pubblicazione: (2024)
Traj-Transformer: Diffusion Models with Transformer for GPS Trajectory Generation
di: Zhang, Zhiyang, et al.
Pubblicazione: (2025)
di: Zhang, Zhiyang, et al.
Pubblicazione: (2025)
Deep Reinforcement Learning for Solving Management Problems: Towards A Large Management Mode
di: Jiang, Jinyang, et al.
Pubblicazione: (2024)
di: Jiang, Jinyang, et al.
Pubblicazione: (2024)
LIFT: Interpretable truck driving risk prediction with literature-informed fine-tuned LLMs
di: Hu, Xiao, et al.
Pubblicazione: (2025)
di: Hu, Xiao, et al.
Pubblicazione: (2025)
RDesign: Hierarchical Data-efficient Representation Learning for Tertiary Structure-based RNA Design
di: Tan, Cheng, et al.
Pubblicazione: (2023)
di: Tan, Cheng, et al.
Pubblicazione: (2023)
COGNOS: Universal Enhancement for Time Series Anomaly Detection via Constrained Gaussian-Noise Optimization and Smoothing
di: Shang, Wenlong, et al.
Pubblicazione: (2025)
di: Shang, Wenlong, et al.
Pubblicazione: (2025)
Rethinking Reinforcement fine-tuning of LLMs: A Multi-armed Bandit Learning Perspective
di: Hu, Xiao, et al.
Pubblicazione: (2026)
di: Hu, Xiao, et al.
Pubblicazione: (2026)
Prompt Tuning with Diffusion for Few-Shot Pre-trained Policy Generalization
di: Hu, Shengchao, et al.
Pubblicazione: (2024)
di: Hu, Shengchao, et al.
Pubblicazione: (2024)
CodeScaler: Scaling Code LLM Training and Test-Time Inference via Reward Models
di: Zhu, Xiao, et al.
Pubblicazione: (2026)
di: Zhu, Xiao, et al.
Pubblicazione: (2026)
Beyond the Lower Bound: Bridging Regret Minimization and Best Arm Identification in Lexicographic Bandits
di: Xue, Bo, et al.
Pubblicazione: (2025)
di: Xue, Bo, et al.
Pubblicazione: (2025)
Closing the Loop: Coordinating Inventory and Recommendation via Deep Reinforcement Learning on Multiple Timescales
di: Jiang, Jinyang, et al.
Pubblicazione: (2025)
di: Jiang, Jinyang, et al.
Pubblicazione: (2025)
Embedding Reliability Verification Constraints into Generation Expansion Planning
di: Liu, Peng, et al.
Pubblicazione: (2025)
di: Liu, Peng, et al.
Pubblicazione: (2025)
Humanoid-inspired Causal Representation Learning for Domain Generalization
di: Tao, Ze, et al.
Pubblicazione: (2025)
di: Tao, Ze, et al.
Pubblicazione: (2025)
Approximated Likelihood Ratio: A Forward-Only and Parallel Framework for Boosting Neural Network Training
di: Zhang, Zeliang, et al.
Pubblicazione: (2024)
di: Zhang, Zeliang, et al.
Pubblicazione: (2024)
Demystifying Design Choices of Reinforcement Fine-tuning: A Batched Contextual Bandit Learning Perspective
di: Xie, Hong, et al.
Pubblicazione: (2026)
di: Xie, Hong, et al.
Pubblicazione: (2026)
LAC: Graph Contrastive Learning with Learnable Augmentation in Continuous Space
di: Lin, Zhenyu, et al.
Pubblicazione: (2024)
di: Lin, Zhenyu, et al.
Pubblicazione: (2024)
On Vanishing Variance in Transformer Length Generalization
di: Li, Ruining, et al.
Pubblicazione: (2025)
di: Li, Ruining, et al.
Pubblicazione: (2025)
JTreeformer: Graph-Transformer via Latent-Diffusion Model for Molecular Generation
di: Shi, Ji, et al.
Pubblicazione: (2025)
di: Shi, Ji, et al.
Pubblicazione: (2025)
Towards Sharper Risk Bounds for Minimax Problems
di: Zhu, Bowei, et al.
Pubblicazione: (2024)
di: Zhu, Bowei, et al.
Pubblicazione: (2024)
TrafficGPT: Towards Multi-Scale Traffic Analysis and Generation with Spatial-Temporal Agent Framework
di: Ouyang, Jinhui, et al.
Pubblicazione: (2024)
di: Ouyang, Jinhui, et al.
Pubblicazione: (2024)
Generative Models for Synthetic Data: Transforming Data Mining in the GenAI Era
di: Li, Dawei, et al.
Pubblicazione: (2025)
di: Li, Dawei, et al.
Pubblicazione: (2025)
Documenti analoghi
-
A Sharper Picture of Generalization in Transformers
di: Lintilhac, Paul, et al.
Pubblicazione: (2026) -
Sharper Error Bounds in Late Fusion Multi-view Clustering Using Eigenvalue Proportion
di: Du, Liang, et al.
Pubblicazione: (2024) -
Tail-Aware Information-Theoretic Generalization for RLHF and SGLD
di: Zhang, Huiming, et al.
Pubblicazione: (2026) -
Machine Learning-Assisted High-Dimensional Matrix Estimation
di: Tian, Wan, et al.
Pubblicazione: (2026) -
LLM-Inspired Pretrain-Then-Finetune for Small-Data, Large-Scale Optimization
di: Zhang, Zishi, et al.
Pubblicazione: (2026)