Enregistré dans:
| Auteurs principaux: | Yang, Yuhang, Li, Ruikang, Ma, Jifei, Zhang, Kai, Liu, Qi, Han, Jianyu, Bu, Yonggan, Zhou, Jibin, Lian, Defu, Li, Xin, Chen, Enhong |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2603.01654 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
AgentCAT: An LLM Agent for Extracting and Analyzing Catalytic Reaction Data from Chemical Engineering Literature
par: Yang, Wei, et autres
Publié: (2026)
par: Yang, Wei, et autres
Publié: (2026)
Demystifying Design Choices of Reinforcement Fine-tuning: A Batched Contextual Bandit Learning Perspective
par: Xie, Hong, et autres
Publié: (2026)
par: Xie, Hong, et autres
Publié: (2026)
Is Softmax Loss All You Need? A Principled Analysis of Softmax-family Loss
par: Pu, Yuanhao, et autres
Publié: (2026)
par: Pu, Yuanhao, et autres
Publié: (2026)
Beyond Surrogates: A Quantitative Analysis for Inter-Metric Relationships
par: Pu, Yuanhao, et autres
Publié: (2026)
par: Pu, Yuanhao, et autres
Publié: (2026)
WESE: Weak Exploration to Strong Exploitation for LLM Agents
par: Huang, Xu, et autres
Publié: (2024)
par: Huang, Xu, et autres
Publié: (2024)
Model Specific Task Similarity for Vision Language Model Selection via Layer Conductance
par: Yang, Wei, et autres
Publié: (2026)
par: Yang, Wei, et autres
Publié: (2026)
Efficient Machine Unlearning via Influence Approximation
par: Liu, Jiawei, et autres
Publié: (2025)
par: Liu, Jiawei, et autres
Publié: (2025)
LLM Cache Bandit Revisited: Addressing Query Heterogeneity for Cost-Effective LLM Inference
par: Yang, Hantao, et autres
Publié: (2025)
par: Yang, Hantao, et autres
Publié: (2025)
Securing Recommender System via Cooperative Training
par: Wang, Qingyang, et autres
Publié: (2024)
par: Wang, Qingyang, et autres
Publié: (2024)
A3C-S: Automated Agent Accelerator Co-Search towards Efficient Deep Reinforcement Learning
par: Fu, Yonggan, et autres
Publié: (2021)
par: Fu, Yonggan, et autres
Publié: (2021)
Learning to Substitute Components for Compositional Generalization
par: Li, Zhaoyi, et autres
Publié: (2025)
par: Li, Zhaoyi, et autres
Publié: (2025)
Rethinking Reinforcement fine-tuning of LLMs: A Multi-armed Bandit Learning Perspective
par: Hu, Xiao, et autres
Publié: (2026)
par: Hu, Xiao, et autres
Publié: (2026)
Analytical and Empirical Study of Herding Effects in Recommendation Systems
par: Xie, Hong, et autres
Publié: (2024)
par: Xie, Hong, et autres
Publié: (2024)
Multi-agent Multi-armed Bandits with Stochastic Sharable Arm Capacities
par: Xie, Hong, et autres
Publié: (2024)
par: Xie, Hong, et autres
Publié: (2024)
HyperTree Planning: Enhancing LLM Reasoning via Hierarchical Thinking
par: Gui, Runquan, et autres
Publié: (2025)
par: Gui, Runquan, et autres
Publié: (2025)
From Text to Simulation: A Multi-Agent LLM Workflow for Automated Chemical Process Design
par: Tian, Xufei, et autres
Publié: (2026)
par: Tian, Xufei, et autres
Publié: (2026)
UniMEL: A Unified Framework for Multimodal Entity Linking with Large Language Models
par: Qi, Liu, et autres
Publié: (2024)
par: Qi, Liu, et autres
Publié: (2024)
Recommender AI Agent: Integrating Large Language Models for Interactive Recommendations
par: Huang, Xu, et autres
Publié: (2023)
par: Huang, Xu, et autres
Publié: (2023)
ChemHTS: Hierarchical Tool Stacking for Enhancing Chemical Agents
par: Li, Zhucong, et autres
Publié: (2025)
par: Li, Zhucong, et autres
Publié: (2025)
PiXTime: A Model for Federated Time Series Forecasting with Heterogeneous Data across Nodes
par: Zhou, Yiming, et autres
Publié: (2026)
par: Zhou, Yiming, et autres
Publié: (2026)
Breaking Determinism: Fuzzy Modeling of Sequential Recommendation Using Discrete State Space Diffusion Model
par: Xie, Wenjia, et autres
Publié: (2024)
par: Xie, Wenjia, et autres
Publié: (2024)
NDCG-Consistent Softmax Approximation with Accelerated Convergence
par: Pu, Yuanhao, et autres
Publié: (2025)
par: Pu, Yuanhao, et autres
Publié: (2025)
Adaptive Sampled Softmax with Inverted Multi-Index: Methods, Theory and Applications
par: Chen, Jin, et autres
Publié: (2025)
par: Chen, Jin, et autres
Publié: (2025)
Learning Deep Tree-based Retriever for Efficient Recommendation: Theory and Method
par: Liu, Ze, et autres
Publié: (2024)
par: Liu, Ze, et autres
Publié: (2024)
MDAP: A Multi-view Disentangled and Adaptive Preference Learning Framework for Cross-Domain Recommendation
par: Tong, Junxiong, et autres
Publié: (2024)
par: Tong, Junxiong, et autres
Publié: (2024)
Denoising Pre-Training and Customized Prompt Learning for Efficient Multi-Behavior Sequential Recommendation
par: Wang, Hao, et autres
Publié: (2024)
par: Wang, Hao, et autres
Publié: (2024)
A Universal Framework for Compressing Embeddings in CTR Prediction
par: Wang, Kefan, et autres
Publié: (2025)
par: Wang, Kefan, et autres
Publié: (2025)
ProBench: Benchmarking GUI Agents with Accurate Process Information
par: Yang, Leyang, et autres
Publié: (2025)
par: Yang, Leyang, et autres
Publié: (2025)
Auto-Agent-Distiller: Towards Efficient Deep Reinforcement Learning Agents via Neural Architecture Search
par: Fu, Yonggan, et autres
Publié: (2020)
par: Fu, Yonggan, et autres
Publié: (2020)
END4Rec: Efficient Noise-Decoupling for Multi-Behavior Sequential Recommendation
par: Han, Yongqiang, et autres
Publié: (2024)
par: Han, Yongqiang, et autres
Publié: (2024)
ProSoftArena: Benchmarking Hierarchical Capabilities of Multimodal Agents in Professional Software Environments
par: Ai, Jiaxin, et autres
Publié: (2025)
par: Ai, Jiaxin, et autres
Publié: (2025)
A Unified Framework for Adaptive Representation Enhancement and Inversed Learning in Cross-Domain Recommendation
par: Zhang, Luankang, et autres
Publié: (2024)
par: Zhang, Luankang, et autres
Publié: (2024)
OR-Agent: Bridging Evolutionary Search and Structured Research for Automated Algorithm Discovery
par: Liu, Qi, et autres
Publié: (2026)
par: Liu, Qi, et autres
Publié: (2026)
Exploring User Retrieval Integration towards Large Language Models for Cross-Domain Sequential Recommendation
par: Shen, Tingjia, et autres
Publié: (2024)
par: Shen, Tingjia, et autres
Publié: (2024)
Provably Convergent Subgraph-wise Sampling for Fast GNN Training
par: Wang, Jie, et autres
Publié: (2023)
par: Wang, Jie, et autres
Publié: (2023)
Learning from Emptiness: De-biasing Listwise Rerankers with Content-Agnostic Probability Calibration
par: Lv, Hang, et autres
Publié: (2026)
par: Lv, Hang, et autres
Publié: (2026)
Automated Network Protocol Testing with LLM Agents
par: Wei, Yunze, et autres
Publié: (2025)
par: Wei, Yunze, et autres
Publié: (2025)
Memory-Augmented LLM-based Multi-Agent System for Automated Feature Generation on Tabular Data
par: Dong, Fengxian, et autres
Publié: (2026)
par: Dong, Fengxian, et autres
Publié: (2026)
EviAgent: Evidence-Driven Agent for Radiology Report Generation
par: Qi, Tuoshi, et autres
Publié: (2026)
par: Qi, Tuoshi, et autres
Publié: (2026)
Cutscene Agent: An LLM Agent Framework for Automated 3D Cutscene Generation
par: He, Lanshan, et autres
Publié: (2026)
par: He, Lanshan, et autres
Publié: (2026)
Documents similaires
-
AgentCAT: An LLM Agent for Extracting and Analyzing Catalytic Reaction Data from Chemical Engineering Literature
par: Yang, Wei, et autres
Publié: (2026) -
Demystifying Design Choices of Reinforcement Fine-tuning: A Batched Contextual Bandit Learning Perspective
par: Xie, Hong, et autres
Publié: (2026) -
Is Softmax Loss All You Need? A Principled Analysis of Softmax-family Loss
par: Pu, Yuanhao, et autres
Publié: (2026) -
Beyond Surrogates: A Quantitative Analysis for Inter-Metric Relationships
par: Pu, Yuanhao, et autres
Publié: (2026) -
WESE: Weak Exploration to Strong Exploitation for LLM Agents
par: Huang, Xu, et autres
Publié: (2024)