SpecSteer: Synergizing Local Context and Global Reasoning for Efficient Personalized Generation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Lv, Hang, Liang, Sheng, Wang, Hao, Zhang, Yongyue, Gu, Hongchao, Guo, Wei, Lian, Defu, Liu, Yong, Chen, Enhong |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
CoSteer: Collaborative Decoding-Time Personalization via Local Delta Steering
par: Lv, Hang, et autres
Publié: (2025)
par: Lv, Hang, et autres
Publié: (2025)
IE as Cache: Information Extraction Enhanced Agentic Reasoning
par: Lv, Hang, et autres
Publié: (2026)
par: Lv, Hang, et autres
Publié: (2026)
RAPID: Efficient Retrieval-Augmented Long Text Generation with Writing Planning and Information Discovery
par: Gu, Hongchao, et autres
Publié: (2025)
par: Gu, Hongchao, et autres
Publié: (2025)
Learning from Emptiness: De-biasing Listwise Rerankers with Content-Agnostic Probability Calibration
par: Lv, Hang, et autres
Publié: (2026)
par: Lv, Hang, et autres
Publié: (2026)
Adaptive Schema-aware Event Extraction with Retrieval-Augmented Generation
par: Liang, Sheng, et autres
Publié: (2025)
par: Liang, Sheng, et autres
Publié: (2025)
Efficient Machine Unlearning via Influence Approximation
par: Liu, Jiawei, et autres
Publié: (2025)
par: Liu, Jiawei, et autres
Publié: (2025)
Is Softmax Loss All You Need? A Principled Analysis of Softmax-family Loss
par: Pu, Yuanhao, et autres
Publié: (2026)
par: Pu, Yuanhao, et autres
Publié: (2026)
Beyond Surrogates: A Quantitative Analysis for Inter-Metric Relationships
par: Pu, Yuanhao, et autres
Publié: (2026)
par: Pu, Yuanhao, et autres
Publié: (2026)
SPARD: Self-Paced Curriculum for RL Alignment via Integrating Reward Dynamics and Data Utility
par: Zhi, Xuyang, et autres
Publié: (2026)
par: Zhi, Xuyang, et autres
Publié: (2026)
DLF: Enhancing Explicit-Implicit Interaction via Dynamic Low-Order-Aware Fusion for CTR Prediction
par: Wang, Kefan, et autres
Publié: (2025)
par: Wang, Kefan, et autres
Publié: (2025)
Efficient Personalized Reranking with Semi-Autoregressive Generation and Online Knowledge Distillation
par: Cheng, Kai, et autres
Publié: (2026)
par: Cheng, Kai, et autres
Publié: (2026)
END4Rec: Efficient Noise-Decoupling for Multi-Behavior Sequential Recommendation
par: Han, Yongqiang, et autres
Publié: (2024)
par: Han, Yongqiang, et autres
Publié: (2024)
Denoising Pre-Training and Customized Prompt Learning for Efficient Multi-Behavior Sequential Recommendation
par: Wang, Hao, et autres
Publié: (2024)
par: Wang, Hao, et autres
Publié: (2024)
Learning to Substitute Components for Compositional Generalization
par: Li, Zhaoyi, et autres
Publié: (2025)
par: Li, Zhaoyi, et autres
Publié: (2025)
Dataset Regeneration for Sequential Recommendation
par: Yin, Mingjia, et autres
Publié: (2024)
par: Yin, Mingjia, et autres
Publié: (2024)
FuXi-β: Towards a Lightweight and Fast Large-Scale Generative Recommendation Model
par: Ye, Yufei, et autres
Publié: (2025)
par: Ye, Yufei, et autres
Publié: (2025)
LLM Cache Bandit Revisited: Addressing Query Heterogeneity for Cost-Effective LLM Inference
par: Yang, Hantao, et autres
Publié: (2025)
par: Yang, Hantao, et autres
Publié: (2025)
Securing Recommender System via Cooperative Training
par: Wang, Qingyang, et autres
Publié: (2024)
par: Wang, Qingyang, et autres
Publié: (2024)
Generative Large Recommendation Models: Emerging Trends in LLMs for Recommendation
par: Wang, Hao, et autres
Publié: (2025)
par: Wang, Hao, et autres
Publié: (2025)
Killing Two Birds with One Stone: Unifying Retrieval and Ranking with a Single Generative Recommendation Model
par: Zhang, Luankang, et autres
Publié: (2025)
par: Zhang, Luankang, et autres
Publié: (2025)
Effective and Efficient Schema-aware Information Extraction Using On-Device Large Language Models
par: Wen, Zhihao, et autres
Publié: (2025)
par: Wen, Zhihao, et autres
Publié: (2025)
Query-Centric Graph Retrieval Augmented Generation
par: Wu, Yaxiong, et autres
Publié: (2025)
par: Wu, Yaxiong, et autres
Publié: (2025)
MLDocRAG: Multimodal Long-Context Document Retrieval Augmented Generation
par: Zhang, Yongyue, et autres
Publié: (2026)
par: Zhang, Yongyue, et autres
Publié: (2026)
Learning Deep Tree-based Retriever for Efficient Recommendation: Theory and Method
par: Liu, Ze, et autres
Publié: (2024)
par: Liu, Ze, et autres
Publié: (2024)
A Universal Framework for Compressing Embeddings in CTR Prediction
par: Wang, Kefan, et autres
Publié: (2025)
par: Wang, Kefan, et autres
Publié: (2025)
Multi-granularity Interest Retrieval and Refinement Network for Long-Term User Behavior Modeling in CTR Prediction
par: Xu, Xiang, et autres
Publié: (2024)
par: Xu, Xiang, et autres
Publié: (2024)
Learning Partially Aligned Item Representation for Cross-Domain Sequential Recommendation
par: Yin, Mingjia, et autres
Publié: (2024)
par: Yin, Mingjia, et autres
Publié: (2024)
SGMem: Sentence Graph Memory for Long-Term Conversational Agents
par: Wu, Yaxiong, et autres
Publié: (2025)
par: Wu, Yaxiong, et autres
Publié: (2025)
PiXTime: A Model for Federated Time Series Forecasting with Heterogeneous Data across Nodes
par: Zhou, Yiming, et autres
Publié: (2026)
par: Zhou, Yiming, et autres
Publié: (2026)
Breaking Determinism: Fuzzy Modeling of Sequential Recommendation Using Discrete State Space Diffusion Model
par: Xie, Wenjia, et autres
Publié: (2024)
par: Xie, Wenjia, et autres
Publié: (2024)
MDAP: A Multi-view Disentangled and Adaptive Preference Learning Framework for Cross-Domain Recommendation
par: Tong, Junxiong, et autres
Publié: (2024)
par: Tong, Junxiong, et autres
Publié: (2024)
From Feature Interaction to Feature Generation: A Generative Paradigm of CTR Prediction Models
par: Yin, Mingjia, et autres
Publié: (2025)
par: Yin, Mingjia, et autres
Publié: (2025)
Analytical and Empirical Study of Herding Effects in Recommendation Systems
par: Xie, Hong, et autres
Publié: (2024)
par: Xie, Hong, et autres
Publié: (2024)
Multi-agent Multi-armed Bandits with Stochastic Sharable Arm Capacities
par: Xie, Hong, et autres
Publié: (2024)
par: Xie, Hong, et autres
Publié: (2024)
Synergizing Systemic Inflammation and Multimodal Ultrasound: Methodological Insights Into Predicting Carotid Plaque Vulnerability
par: Hongchao Lu, et autres
Publié: (2026)
par: Hongchao Lu, et autres
Publié: (2026)
Model Specific Task Similarity for Vision Language Model Selection via Layer Conductance
par: Yang, Wei, et autres
Publié: (2026)
par: Yang, Wei, et autres
Publié: (2026)
Optimizing Sequential Recommendation Models with Scaling Laws and Approximate Entropy
par: Shen, Tingjia, et autres
Publié: (2024)
par: Shen, Tingjia, et autres
Publié: (2024)
Prompting is not Enough: Exploring Knowledge Integration and Controllable Generation
par: Shen, Tingjia, et autres
Publié: (2025)
par: Shen, Tingjia, et autres
Publié: (2025)
FuXi-Linear: Unleashing the Power of Linear Attention in Long-term Time-aware Sequential Recommendation
par: Ye, Yufei, et autres
Publié: (2026)
par: Ye, Yufei, et autres
Publié: (2026)
Entropy Law: The Story Behind Data Compression and LLM Performance
par: Yin, Mingjia, et autres
Publié: (2024)
par: Yin, Mingjia, et autres
Publié: (2024)
Documents similaires
-
CoSteer: Collaborative Decoding-Time Personalization via Local Delta Steering
par: Lv, Hang, et autres
Publié: (2025) -
IE as Cache: Information Extraction Enhanced Agentic Reasoning
par: Lv, Hang, et autres
Publié: (2026) -
RAPID: Efficient Retrieval-Augmented Long Text Generation with Writing Planning and Information Discovery
par: Gu, Hongchao, et autres
Publié: (2025) -
Learning from Emptiness: De-biasing Listwise Rerankers with Content-Agnostic Probability Calibration
par: Lv, Hang, et autres
Publié: (2026) -
Adaptive Schema-aware Event Extraction with Retrieval-Augmented Generation
par: Liang, Sheng, et autres
Publié: (2025)