Towards Cold-Start Drafting and Continual Refining: A Value-Driven Memory Approach with Application to NPU Kernel Synthesis
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Zheng, Yujie, Li, Zhuo, Zhang, Shengtao, Wang, Hanjing, Sheng, Junjie, Wang, Jiaqian, Yan, Junchi, Zhang, Weinan, Wen, Ying, Tang, Bo, Wen, Muning |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
MemRL: Self-Evolving Agents via Runtime Reinforcement Learning on Episodic Memory
von: Zhang, Shengtao, et al.
Veröffentlicht: (2026)
von: Zhang, Shengtao, et al.
Veröffentlicht: (2026)
MemQ: Integrating Q-Learning into Self-Evolving Memory Agents over Provenance DAGs
von: Liao, Junwei, et al.
Veröffentlicht: (2026)
von: Liao, Junwei, et al.
Veröffentlicht: (2026)
MARFT: Multi-Agent Reinforcement Fine-Tuning
von: Liao, Junwei, et al.
Veröffentlicht: (2025)
von: Liao, Junwei, et al.
Veröffentlicht: (2025)
Reinforcing Language Agents via Policy Optimization with Action Decomposition
von: Wen, Muning, et al.
Veröffentlicht: (2024)
von: Wen, Muning, et al.
Veröffentlicht: (2024)
Mentor‐Student Relationship and Graduate Students' Satisfaction With Mentors: A Moderated Mediation Model
von: Xingzi Chen, et al.
Veröffentlicht: (2025)
von: Xingzi Chen, et al.
Veröffentlicht: (2025)
Position: Agentic AI System Is a Foreseeable Pathway to AGI
von: Liao, Junwei, et al.
Veröffentlicht: (2026)
von: Liao, Junwei, et al.
Veröffentlicht: (2026)
Entropy-Regularized Token-Level Policy Optimization for Language Agent Reinforcement
von: Wen, Muning, et al.
Veröffentlicht: (2024)
von: Wen, Muning, et al.
Veröffentlicht: (2024)
P3: A Policy-Driven, Pace-Adaptive, and Diversity-Promoted Framework for data pruning in LLM Training
von: Yang, Yingxuan, et al.
Veröffentlicht: (2024)
von: Yang, Yingxuan, et al.
Veröffentlicht: (2024)
Autonomous Goal Detection and Cessation in Reinforcement Learning: A Case Study on Source Term Estimation
von: Shi, Yiwei, et al.
Veröffentlicht: (2024)
von: Shi, Yiwei, et al.
Veröffentlicht: (2024)
AscendCraft: Automatic Ascend NPU Kernel Generation via DSL-Guided Transcompilation
von: Wen, Zhongzhen, et al.
Veröffentlicht: (2026)
von: Wen, Zhongzhen, et al.
Veröffentlicht: (2026)
Alphazero-like Tree-Search can Guide Large Language Model Decoding and Training
von: Feng, Xidong, et al.
Veröffentlicht: (2023)
von: Feng, Xidong, et al.
Veröffentlicht: (2023)
AscendOptimizer: Episodic Agent for Ascend NPU Operator Optimization
von: Wu, Jiehao, et al.
Veröffentlicht: (2026)
von: Wu, Jiehao, et al.
Veröffentlicht: (2026)
$L_1$-norm Regularized Indefinite Kernel Logistic Regression
von: Wang, Shaoxin, et al.
Veröffentlicht: (2025)
von: Wang, Shaoxin, et al.
Veröffentlicht: (2025)
TRAD: Enhancing LLM Agents with Step-Wise Thought Retrieval and Aligned Decision
von: Zhou, Ruiwen, et al.
Veröffentlicht: (2024)
von: Zhou, Ruiwen, et al.
Veröffentlicht: (2024)
Understanding Agent Scaling in LLM-Based Multi-Agent Systems via Diversity
von: Yang, Yingxuan, et al.
Veröffentlicht: (2026)
von: Yang, Yingxuan, et al.
Veröffentlicht: (2026)
Person Re-Identification for Robot Person Following with Online Continual Learning
von: Ye, Hanjing, et al.
Veröffentlicht: (2023)
von: Ye, Hanjing, et al.
Veröffentlicht: (2023)
NPUEval: Optimizing NPU Kernels with LLMs and Open Source Compilers
von: Kalade, Sarunas, et al.
Veröffentlicht: (2025)
von: Kalade, Sarunas, et al.
Veröffentlicht: (2025)
Item-centric Exploration for Cold Start Problem
von: Wang, Dong, et al.
Veröffentlicht: (2025)
von: Wang, Dong, et al.
Veröffentlicht: (2025)
HammerBench: Fine-Grained Function-Calling Evaluation in Real Mobile Device Scenarios
von: Wang, Jun, et al.
Veröffentlicht: (2024)
von: Wang, Jun, et al.
Veröffentlicht: (2024)
MobileUse: A GUI Agent with Hierarchical Reflection for Autonomous Mobile Operation
von: Li, Ning, et al.
Veröffentlicht: (2025)
von: Li, Ning, et al.
Veröffentlicht: (2025)
Fast Second-Order Online Kernel Learning through Incremental Matrix Sketching and Decomposition
von: Wen, Dongxie, et al.
Veröffentlicht: (2024)
von: Wen, Dongxie, et al.
Veröffentlicht: (2024)
Diffusion-Inspired Cold Start with Sufficient Prior in Computerized Adaptive Testing
von: Ma, Haiping, et al.
Veröffentlicht: (2024)
von: Ma, Haiping, et al.
Veröffentlicht: (2024)
ReMA: Learning to Meta-think for LLMs with Multi-Agent Reinforcement Learning
von: Wan, Ziyu, et al.
Veröffentlicht: (2025)
von: Wan, Ziyu, et al.
Veröffentlicht: (2025)
Boundary-Aware NL2SQL: Integrating Reliability through Hybrid Reward and Data Synthesis
von: Tian, Songsong, et al.
Veröffentlicht: (2026)
von: Tian, Songsong, et al.
Veröffentlicht: (2026)
LLM Reasoning for Cold-Start Item Recommendation
von: Li, Shijun, et al.
Veröffentlicht: (2025)
von: Li, Shijun, et al.
Veröffentlicht: (2025)
Draft and Refine with Visual Experts
von: Jeong, Sungheon, et al.
Veröffentlicht: (2025)
von: Jeong, Sungheon, et al.
Veröffentlicht: (2025)
Shallow AutoEncoding Recommender with Cold Start Handling via Side Features
von: Cui, Edward DongBo, et al.
Veröffentlicht: (2025)
von: Cui, Edward DongBo, et al.
Veröffentlicht: (2025)
CDRNP: Cross-Domain Recommendation to Cold-Start Users via Neural Process
von: Li, Xiaodong, et al.
Veröffentlicht: (2024)
von: Li, Xiaodong, et al.
Veröffentlicht: (2024)
Task Aligned Meta-learning based Augmented Graph for Cold-Start Recommendation
von: Shi, Yuxiang, et al.
Veröffentlicht: (2022)
von: Shi, Yuxiang, et al.
Veröffentlicht: (2022)
EONSim: An NPU Simulator for On-Chip Memory and Embedding Vector Operations
von: Choi, Sangun, et al.
Veröffentlicht: (2025)
von: Choi, Sangun, et al.
Veröffentlicht: (2025)
Meta-Memory: Retrieving and Integrating Semantic-Spatial Memories for Robot Spatial Reasoning
von: Mao, Yufan, et al.
Veröffentlicht: (2025)
von: Mao, Yufan, et al.
Veröffentlicht: (2025)
DREAM-S: Speculative Decoding with Searchable Drafting and Target-Aware Refinement for Multimodal Generation
von: Liu, Zining, et al.
Veröffentlicht: (2026)
von: Liu, Zining, et al.
Veröffentlicht: (2026)
SE-Merging: A Self-Enhanced Approach for Dynamic Model Merging
von: Chen, Zijun, et al.
Veröffentlicht: (2025)
von: Chen, Zijun, et al.
Veröffentlicht: (2025)
Personalized Multi-Interest Modeling for Cross-Domain Recommendation to Cold-Start Users
von: Li, Xiaodong, et al.
Veröffentlicht: (2026)
von: Li, Xiaodong, et al.
Veröffentlicht: (2026)
DRiffusion: Draft-and-Refine Process Parallelizes Diffusion Models with Ease
von: Bai, Runsheng, et al.
Veröffentlicht: (2026)
von: Bai, Runsheng, et al.
Veröffentlicht: (2026)
When Federated Recommendation Meets Cold-Start Problem: Separating Item Attributes and User Interactions
von: Zhang, Chunxu, et al.
Veröffentlicht: (2023)
von: Zhang, Chunxu, et al.
Veröffentlicht: (2023)
Sharpness-Aware Cross-Domain Recommendation to Cold-Start Users
von: Zeng, Guohang, et al.
Veröffentlicht: (2024)
von: Zeng, Guohang, et al.
Veröffentlicht: (2024)
PMAT: Optimizing Action Generation Order in Multi-Agent Reinforcement Learning
von: Hu, Kun, et al.
Veröffentlicht: (2025)
von: Hu, Kun, et al.
Veröffentlicht: (2025)
Iterative Refinement of Flow Policies in Probability Space for Online Reinforcement Learning
von: Sun, Mingyang, et al.
Veröffentlicht: (2025)
von: Sun, Mingyang, et al.
Veröffentlicht: (2025)
Graph Neural Patching for Cold-Start Recommendations
von: Chen, Hao, et al.
Veröffentlicht: (2024)
von: Chen, Hao, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
MemRL: Self-Evolving Agents via Runtime Reinforcement Learning on Episodic Memory
von: Zhang, Shengtao, et al.
Veröffentlicht: (2026) -
MemQ: Integrating Q-Learning into Self-Evolving Memory Agents over Provenance DAGs
von: Liao, Junwei, et al.
Veröffentlicht: (2026) -
MARFT: Multi-Agent Reinforcement Fine-Tuning
von: Liao, Junwei, et al.
Veröffentlicht: (2025) -
Reinforcing Language Agents via Policy Optimization with Action Decomposition
von: Wen, Muning, et al.
Veröffentlicht: (2024) -
Mentor‐Student Relationship and Graduate Students' Satisfaction With Mentors: A Moderated Mediation Model
von: Xingzi Chen, et al.
Veröffentlicht: (2025)