Saved in:
| Main Authors: | Yang, Yuhang, Li, Ruikang, Ma, Jifei, Zhang, Kai, Liu, Qi, Han, Jianyu, Bu, Yonggan, Zhou, Jibin, Lian, Defu, Li, Xin, Chen, Enhong |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | https://arxiv.org/abs/2603.01654 |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
AgentCAT: An LLM Agent for Extracting and Analyzing Catalytic Reaction Data from Chemical Engineering Literature
by: Yang, Wei, et al.
Published: (2026)
by: Yang, Wei, et al.
Published: (2026)
Demystifying Design Choices of Reinforcement Fine-tuning: A Batched Contextual Bandit Learning Perspective
by: Xie, Hong, et al.
Published: (2026)
by: Xie, Hong, et al.
Published: (2026)
Is Softmax Loss All You Need? A Principled Analysis of Softmax-family Loss
by: Pu, Yuanhao, et al.
Published: (2026)
by: Pu, Yuanhao, et al.
Published: (2026)
Beyond Surrogates: A Quantitative Analysis for Inter-Metric Relationships
by: Pu, Yuanhao, et al.
Published: (2026)
by: Pu, Yuanhao, et al.
Published: (2026)
WESE: Weak Exploration to Strong Exploitation for LLM Agents
by: Huang, Xu, et al.
Published: (2024)
by: Huang, Xu, et al.
Published: (2024)
Model Specific Task Similarity for Vision Language Model Selection via Layer Conductance
by: Yang, Wei, et al.
Published: (2026)
by: Yang, Wei, et al.
Published: (2026)
Efficient Machine Unlearning via Influence Approximation
by: Liu, Jiawei, et al.
Published: (2025)
by: Liu, Jiawei, et al.
Published: (2025)
LLM Cache Bandit Revisited: Addressing Query Heterogeneity for Cost-Effective LLM Inference
by: Yang, Hantao, et al.
Published: (2025)
by: Yang, Hantao, et al.
Published: (2025)
Securing Recommender System via Cooperative Training
by: Wang, Qingyang, et al.
Published: (2024)
by: Wang, Qingyang, et al.
Published: (2024)
A3C-S: Automated Agent Accelerator Co-Search towards Efficient Deep Reinforcement Learning
by: Fu, Yonggan, et al.
Published: (2021)
by: Fu, Yonggan, et al.
Published: (2021)
Learning to Substitute Components for Compositional Generalization
by: Li, Zhaoyi, et al.
Published: (2025)
by: Li, Zhaoyi, et al.
Published: (2025)
Rethinking Reinforcement fine-tuning of LLMs: A Multi-armed Bandit Learning Perspective
by: Hu, Xiao, et al.
Published: (2026)
by: Hu, Xiao, et al.
Published: (2026)
Analytical and Empirical Study of Herding Effects in Recommendation Systems
by: Xie, Hong, et al.
Published: (2024)
by: Xie, Hong, et al.
Published: (2024)
Multi-agent Multi-armed Bandits with Stochastic Sharable Arm Capacities
by: Xie, Hong, et al.
Published: (2024)
by: Xie, Hong, et al.
Published: (2024)
HyperTree Planning: Enhancing LLM Reasoning via Hierarchical Thinking
by: Gui, Runquan, et al.
Published: (2025)
by: Gui, Runquan, et al.
Published: (2025)
From Text to Simulation: A Multi-Agent LLM Workflow for Automated Chemical Process Design
by: Tian, Xufei, et al.
Published: (2026)
by: Tian, Xufei, et al.
Published: (2026)
UniMEL: A Unified Framework for Multimodal Entity Linking with Large Language Models
by: Qi, Liu, et al.
Published: (2024)
by: Qi, Liu, et al.
Published: (2024)
Recommender AI Agent: Integrating Large Language Models for Interactive Recommendations
by: Huang, Xu, et al.
Published: (2023)
by: Huang, Xu, et al.
Published: (2023)
ChemHTS: Hierarchical Tool Stacking for Enhancing Chemical Agents
by: Li, Zhucong, et al.
Published: (2025)
by: Li, Zhucong, et al.
Published: (2025)
PiXTime: A Model for Federated Time Series Forecasting with Heterogeneous Data across Nodes
by: Zhou, Yiming, et al.
Published: (2026)
by: Zhou, Yiming, et al.
Published: (2026)
Breaking Determinism: Fuzzy Modeling of Sequential Recommendation Using Discrete State Space Diffusion Model
by: Xie, Wenjia, et al.
Published: (2024)
by: Xie, Wenjia, et al.
Published: (2024)
NDCG-Consistent Softmax Approximation with Accelerated Convergence
by: Pu, Yuanhao, et al.
Published: (2025)
by: Pu, Yuanhao, et al.
Published: (2025)
Adaptive Sampled Softmax with Inverted Multi-Index: Methods, Theory and Applications
by: Chen, Jin, et al.
Published: (2025)
by: Chen, Jin, et al.
Published: (2025)
Learning Deep Tree-based Retriever for Efficient Recommendation: Theory and Method
by: Liu, Ze, et al.
Published: (2024)
by: Liu, Ze, et al.
Published: (2024)
MDAP: A Multi-view Disentangled and Adaptive Preference Learning Framework for Cross-Domain Recommendation
by: Tong, Junxiong, et al.
Published: (2024)
by: Tong, Junxiong, et al.
Published: (2024)
Denoising Pre-Training and Customized Prompt Learning for Efficient Multi-Behavior Sequential Recommendation
by: Wang, Hao, et al.
Published: (2024)
by: Wang, Hao, et al.
Published: (2024)
A Universal Framework for Compressing Embeddings in CTR Prediction
by: Wang, Kefan, et al.
Published: (2025)
by: Wang, Kefan, et al.
Published: (2025)
ProBench: Benchmarking GUI Agents with Accurate Process Information
by: Yang, Leyang, et al.
Published: (2025)
by: Yang, Leyang, et al.
Published: (2025)
Auto-Agent-Distiller: Towards Efficient Deep Reinforcement Learning Agents via Neural Architecture Search
by: Fu, Yonggan, et al.
Published: (2020)
by: Fu, Yonggan, et al.
Published: (2020)
END4Rec: Efficient Noise-Decoupling for Multi-Behavior Sequential Recommendation
by: Han, Yongqiang, et al.
Published: (2024)
by: Han, Yongqiang, et al.
Published: (2024)
ProSoftArena: Benchmarking Hierarchical Capabilities of Multimodal Agents in Professional Software Environments
by: Ai, Jiaxin, et al.
Published: (2025)
by: Ai, Jiaxin, et al.
Published: (2025)
A Unified Framework for Adaptive Representation Enhancement and Inversed Learning in Cross-Domain Recommendation
by: Zhang, Luankang, et al.
Published: (2024)
by: Zhang, Luankang, et al.
Published: (2024)
OR-Agent: Bridging Evolutionary Search and Structured Research for Automated Algorithm Discovery
by: Liu, Qi, et al.
Published: (2026)
by: Liu, Qi, et al.
Published: (2026)
Exploring User Retrieval Integration towards Large Language Models for Cross-Domain Sequential Recommendation
by: Shen, Tingjia, et al.
Published: (2024)
by: Shen, Tingjia, et al.
Published: (2024)
Provably Convergent Subgraph-wise Sampling for Fast GNN Training
by: Wang, Jie, et al.
Published: (2023)
by: Wang, Jie, et al.
Published: (2023)
Learning from Emptiness: De-biasing Listwise Rerankers with Content-Agnostic Probability Calibration
by: Lv, Hang, et al.
Published: (2026)
by: Lv, Hang, et al.
Published: (2026)
Automated Network Protocol Testing with LLM Agents
by: Wei, Yunze, et al.
Published: (2025)
by: Wei, Yunze, et al.
Published: (2025)
Memory-Augmented LLM-based Multi-Agent System for Automated Feature Generation on Tabular Data
by: Dong, Fengxian, et al.
Published: (2026)
by: Dong, Fengxian, et al.
Published: (2026)
EviAgent: Evidence-Driven Agent for Radiology Report Generation
by: Qi, Tuoshi, et al.
Published: (2026)
by: Qi, Tuoshi, et al.
Published: (2026)
Cutscene Agent: An LLM Agent Framework for Automated 3D Cutscene Generation
by: He, Lanshan, et al.
Published: (2026)
by: He, Lanshan, et al.
Published: (2026)
Similar Items
-
AgentCAT: An LLM Agent for Extracting and Analyzing Catalytic Reaction Data from Chemical Engineering Literature
by: Yang, Wei, et al.
Published: (2026) -
Demystifying Design Choices of Reinforcement Fine-tuning: A Batched Contextual Bandit Learning Perspective
by: Xie, Hong, et al.
Published: (2026) -
Is Softmax Loss All You Need? A Principled Analysis of Softmax-family Loss
by: Pu, Yuanhao, et al.
Published: (2026) -
Beyond Surrogates: A Quantitative Analysis for Inter-Metric Relationships
by: Pu, Yuanhao, et al.
Published: (2026) -
WESE: Weak Exploration to Strong Exploitation for LLM Agents
by: Huang, Xu, et al.
Published: (2024)