Enregistré dans:
| Auteurs principaux: | Yang, Wei, Xie, Hong, Tan, Tao, Li, Xin, Lian, Defu, Chen, Enhong |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2602.01346 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Demystifying Design Choices of Reinforcement Fine-tuning: A Batched Contextual Bandit Learning Perspective
par: Xie, Hong, et autres
Publié: (2026)
par: Xie, Hong, et autres
Publié: (2026)
Analytical and Empirical Study of Herding Effects in Recommendation Systems
par: Xie, Hong, et autres
Publié: (2024)
par: Xie, Hong, et autres
Publié: (2024)
Multi-agent Multi-armed Bandits with Stochastic Sharable Arm Capacities
par: Xie, Hong, et autres
Publié: (2024)
par: Xie, Hong, et autres
Publié: (2024)
Securing Recommender System via Cooperative Training
par: Wang, Qingyang, et autres
Publié: (2024)
par: Wang, Qingyang, et autres
Publié: (2024)
Efficient Machine Unlearning via Influence Approximation
par: Liu, Jiawei, et autres
Publié: (2025)
par: Liu, Jiawei, et autres
Publié: (2025)
Understanding Privacy Risks of Embeddings Induced by Large Language Models
par: Zhu, Zhihao, et autres
Publié: (2024)
par: Zhu, Zhihao, et autres
Publié: (2024)
Refine Large Language Model Fine-tuning via Instruction Vector
par: Jiang, Gangwei, et autres
Publié: (2024)
par: Jiang, Gangwei, et autres
Publié: (2024)
Multiple-play Stochastic Bandits with Prioritized Arm Capacity Sharing
par: Xie, Hong, et autres
Publié: (2025)
par: Xie, Hong, et autres
Publié: (2025)
UniMEL: A Unified Framework for Multimodal Entity Linking with Large Language Models
par: Qi, Liu, et autres
Publié: (2024)
par: Qi, Liu, et autres
Publié: (2024)
Federated Contextual Cascading Bandits with Asynchronous Communication and Heterogeneous Users
par: Yang, Hantao, et autres
Publié: (2024)
par: Yang, Hantao, et autres
Publié: (2024)
Rethinking Reinforcement fine-tuning of LLMs: A Multi-armed Bandit Learning Perspective
par: Hu, Xiao, et autres
Publié: (2026)
par: Hu, Xiao, et autres
Publié: (2026)
PiXTime: A Model for Federated Time Series Forecasting with Heterogeneous Data across Nodes
par: Zhou, Yiming, et autres
Publié: (2026)
par: Zhou, Yiming, et autres
Publié: (2026)
RecExplainer: Aligning Large Language Models for Explaining Recommendation Models
par: Lei, Yuxuan, et autres
Publié: (2023)
par: Lei, Yuxuan, et autres
Publié: (2023)
Do All Individual Layers Help? An Empirical Study of Task-Interfering Layers in Vision-Language Models
par: Liu, Zhiming, et autres
Publié: (2026)
par: Liu, Zhiming, et autres
Publié: (2026)
Recommender AI Agent: Integrating Large Language Models for Interactive Recommendations
par: Huang, Xu, et autres
Publié: (2023)
par: Huang, Xu, et autres
Publié: (2023)
Mitigate Negative Transfer with Similarity Heuristic Lifelong Prompt Tuning
par: Wu, Chenyuan, et autres
Publié: (2024)
par: Wu, Chenyuan, et autres
Publié: (2024)
Efficient and Stable Reinforcement Learning for Diffusion Language Models
par: Liu, Jiawei, et autres
Publié: (2026)
par: Liu, Jiawei, et autres
Publié: (2026)
AgentCAT: An LLM Agent for Extracting and Analyzing Catalytic Reaction Data from Chemical Engineering Literature
par: Yang, Wei, et autres
Publié: (2026)
par: Yang, Wei, et autres
Publié: (2026)
Learning from Emptiness: De-biasing Listwise Rerankers with Content-Agnostic Probability Calibration
par: Lv, Hang, et autres
Publié: (2026)
par: Lv, Hang, et autres
Publié: (2026)
Foundations and Frontiers of Graph Learning Theory
par: Huang, Yu, et autres
Publié: (2024)
par: Huang, Yu, et autres
Publié: (2024)
A Unified Frequency Domain Decomposition Framework for Interpretable and Robust Time Series Forecasting
par: He, Cheng, et autres
Publié: (2025)
par: He, Cheng, et autres
Publié: (2025)
CoSteer: Collaborative Decoding-Time Personalization via Local Delta Steering
par: Lv, Hang, et autres
Publié: (2025)
par: Lv, Hang, et autres
Publié: (2025)
Verifying Large Language Models' Reasoning Paths via Correlation Matrix Rank
par: Liu, Jiayu, et autres
Publié: (2025)
par: Liu, Jiayu, et autres
Publié: (2025)
When Large Language Models Meet Personalization: Perspectives of Challenges and Opportunities
par: Chen, Jin, et autres
Publié: (2023)
par: Chen, Jin, et autres
Publié: (2023)
CeProAgents: A Hierarchical Agents System for Automated Chemical Process Development
par: Yang, Yuhang, et autres
Publié: (2026)
par: Yang, Yuhang, et autres
Publié: (2026)
Foundation Models for Demand Forecasting via Dual-Strategy Ensembling
par: Yang, Wei, et autres
Publié: (2025)
par: Yang, Wei, et autres
Publié: (2025)
InstructTime++: Time Series Classification with Multimodal Language Modeling via Implicit Feature Enhancement
par: Cheng, Mingyue, et autres
Publié: (2026)
par: Cheng, Mingyue, et autres
Publié: (2026)
Learning Complete Topology-Aware Correlations Between Relations for Inductive Link Prediction
par: Wang, Jie, et autres
Publié: (2023)
par: Wang, Jie, et autres
Publié: (2023)
Invariant Representation via Decoupling Style and Spurious Features from Images
par: Li, Ruimeng, et autres
Publié: (2023)
par: Li, Ruimeng, et autres
Publié: (2023)
Learning Partially Aligned Item Representation for Cross-Domain Sequential Recommendation
par: Yin, Mingjia, et autres
Publié: (2024)
par: Yin, Mingjia, et autres
Publié: (2024)
CastFlow: Learning Role-Specialized Agentic Workflows for Time Series Forecasting
par: Pan, Bokai, et autres
Publié: (2026)
par: Pan, Bokai, et autres
Publié: (2026)
HyperTree Planning: Enhancing LLM Reasoning via Hierarchical Thinking
par: Gui, Runquan, et autres
Publié: (2025)
par: Gui, Runquan, et autres
Publié: (2025)
Evaluating Small Language Models for Agentic On-Farm Decision Support Systems
par: Liu, Enhong, et autres
Publié: (2025)
par: Liu, Enhong, et autres
Publié: (2025)
SwiftVLM: Efficient Vision-Language Model Inference via Cross-Layer Token Bypass
par: Qian, Chen, et autres
Publié: (2026)
par: Qian, Chen, et autres
Publié: (2026)
WESE: Weak Exploration to Strong Exploitation for LLM Agents
par: Huang, Xu, et autres
Publié: (2024)
par: Huang, Xu, et autres
Publié: (2024)
Cross-Layer Vision Smoothing: Enhancing Visual Understanding via Sustained Focus on Key Objects in Large Vision-Language Models
par: Zhao, Jianfei, et autres
Publié: (2025)
par: Zhao, Jianfei, et autres
Publié: (2025)
Denoising Pre-Training and Customized Prompt Learning for Efficient Multi-Behavior Sequential Recommendation
par: Wang, Hao, et autres
Publié: (2024)
par: Wang, Hao, et autres
Publié: (2024)
Vision-Language Model Selection and Reuse for Downstream Adaptation
par: Tan, Hao-Zhe, et autres
Publié: (2025)
par: Tan, Hao-Zhe, et autres
Publié: (2025)
Distilling to Hybrid Attention Models via KL-Guided Layer Selection
par: Li, Yanhong, et autres
Publié: (2025)
par: Li, Yanhong, et autres
Publié: (2025)
AHAMask: Reliable Task Specification for Large Audio Language Models without Instructions
par: Guo, Yiwei, et autres
Publié: (2025)
par: Guo, Yiwei, et autres
Publié: (2025)
Documents similaires
-
Demystifying Design Choices of Reinforcement Fine-tuning: A Batched Contextual Bandit Learning Perspective
par: Xie, Hong, et autres
Publié: (2026) -
Analytical and Empirical Study of Herding Effects in Recommendation Systems
par: Xie, Hong, et autres
Publié: (2024) -
Multi-agent Multi-armed Bandits with Stochastic Sharable Arm Capacities
par: Xie, Hong, et autres
Publié: (2024) -
Securing Recommender System via Cooperative Training
par: Wang, Qingyang, et autres
Publié: (2024) -
Efficient Machine Unlearning via Influence Approximation
par: Liu, Jiawei, et autres
Publié: (2025)