MemDLM: Memory-Enhanced DLM Training
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Pei, Zehua, Zhen, Hui-Ling, Lin, Weizhe, Pan, Sinno Jialin, Wang, Yunhe, Yuan, Mingxuan, Yu, Bei |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
FocuSFT: Bilevel Optimization for Dilution-Aware Long-Context Fine-Tuning
von: Pei, Zehua, et al.
Veröffentlicht: (2026)
von: Pei, Zehua, et al.
Veröffentlicht: (2026)
Verilog-Evolve: Feedback-Driven and Skill-Evolving Verilog Generation
von: Pei, Zehua, et al.
Veröffentlicht: (2026)
von: Pei, Zehua, et al.
Veröffentlicht: (2026)
From Pruning to Grafting: Dynamic Knowledge Redistribution via Learnable Layer Fusion
von: Pei, Zehua, et al.
Veröffentlicht: (2024)
von: Pei, Zehua, et al.
Veröffentlicht: (2024)
SCOPE: Prompt Evolution for Enhancing Agent Effectiveness
von: Pei, Zehua, et al.
Veröffentlicht: (2025)
von: Pei, Zehua, et al.
Veröffentlicht: (2025)
Beyond Speedup -- Utilizing KV Cache for Sampling and Reasoning
von: Xing, Zeyu, et al.
Veröffentlicht: (2026)
von: Xing, Zeyu, et al.
Veröffentlicht: (2026)
C$^2$DLM: Causal Concept-Guided Diffusion Large Language Models
von: Han, Kairong, et al.
Veröffentlicht: (2025)
von: Han, Kairong, et al.
Veröffentlicht: (2025)
DiLA: Enhancing LLM Tool Learning with Differential Logic Layer
von: Zhang, Yu, et al.
Veröffentlicht: (2024)
von: Zhang, Yu, et al.
Veröffentlicht: (2024)
DLM-SWAI: Steering Diffusion Language Models Before They Unmask
von: An, Hyeseon, et al.
Veröffentlicht: (2026)
von: An, Hyeseon, et al.
Veröffentlicht: (2026)
DLM-Scope: Mechanistic Interpretability of Diffusion Language Models via Sparse Autoencoders
von: Wang, Xu, et al.
Veröffentlicht: (2026)
von: Wang, Xu, et al.
Veröffentlicht: (2026)
DLM-One: Diffusion Language Models for One-Step Sequence Generation
von: Chen, Tianqi, et al.
Veröffentlicht: (2025)
von: Chen, Tianqi, et al.
Veröffentlicht: (2025)
Efficient-DLM: From Autoregressive to Diffusion Language Models, and Beyond in Speed
von: Fu, Yonggan, et al.
Veröffentlicht: (2025)
von: Fu, Yonggan, et al.
Veröffentlicht: (2025)
BetterV: Controlled Verilog Generation with Discriminative Guidance
von: Pei, Zehua, et al.
Veröffentlicht: (2024)
von: Pei, Zehua, et al.
Veröffentlicht: (2024)
SwiftMem: Fast Agentic Memory via Query-aware Indexing
von: Tian, Anxin, et al.
Veröffentlicht: (2026)
von: Tian, Anxin, et al.
Veröffentlicht: (2026)
WeDLM: Reconciling Diffusion Language Models with Standard Causal Attention for Fast Inference
von: Liu, Aiwei, et al.
Veröffentlicht: (2025)
von: Liu, Aiwei, et al.
Veröffentlicht: (2025)
FlashDLM: Accelerating Diffusion Language Model Inference via Efficient KV Caching and Guided Diffusion
von: Hu, Zhanqiu, et al.
Veröffentlicht: (2025)
von: Hu, Zhanqiu, et al.
Veröffentlicht: (2025)
Behavioral Fingerprinting of Large Language Models
von: Pei, Zehua, et al.
Veröffentlicht: (2025)
von: Pei, Zehua, et al.
Veröffentlicht: (2025)
TabDLM: Free-Form Tabular Data Generation via Joint Numerical-Language Diffusion
von: Cai, Donghong, et al.
Veröffentlicht: (2026)
von: Cai, Donghong, et al.
Veröffentlicht: (2026)
Revisiting Judge Decoding from First Principles via Training-Free Distributional Divergence
von: Sun, Shengyin, et al.
Veröffentlicht: (2026)
von: Sun, Shengyin, et al.
Veröffentlicht: (2026)
Analytical FFN-to-MoE Restructuring via Activation Pattern Analysis
von: Pei, Zehua, et al.
Veröffentlicht: (2025)
von: Pei, Zehua, et al.
Veröffentlicht: (2025)
KVTuner: Sensitivity-Aware Layer-Wise Mixed-Precision KV Cache Quantization for Efficient and Nearly Lossless LLM Inference
von: Li, Xing, et al.
Veröffentlicht: (2025)
von: Li, Xing, et al.
Veröffentlicht: (2025)
PreMoE: Proactive Inference for Efficient Mixture-of-Experts
von: Pei, Zehua, et al.
Veröffentlicht: (2025)
von: Pei, Zehua, et al.
Veröffentlicht: (2025)
MetaDefense: Defending Finetuning-based Jailbreak Attack Before and During Generation
von: Jiang, Weisen, et al.
Veröffentlicht: (2025)
von: Jiang, Weisen, et al.
Veröffentlicht: (2025)
Does In-Context Learning Really Learn? Rethinking How Large Language Models Respond and Solve Tasks via In-Context Learning
von: Long, Quanyu, et al.
Veröffentlicht: (2024)
von: Long, Quanyu, et al.
Veröffentlicht: (2024)
Large Language Models Know What Makes Exemplary Contexts
von: Long, Quanyu, et al.
Veröffentlicht: (2024)
von: Long, Quanyu, et al.
Veröffentlicht: (2024)
TrimR: Verifier-based Training-Free Thinking Compression for Efficient Test-Time Scaling
von: Lin, Weizhe, et al.
Veröffentlicht: (2025)
von: Lin, Weizhe, et al.
Veröffentlicht: (2025)
Multilingual Jailbreak Challenges in Large Language Models
von: Deng, Yue, et al.
Veröffentlicht: (2023)
von: Deng, Yue, et al.
Veröffentlicht: (2023)
MetaMoE: Diversity-Aware Proxy Selection for Privacy-Preserving Mixture-of-Experts Unification
von: Jiang, Weisen, et al.
Veröffentlicht: (2026)
von: Jiang, Weisen, et al.
Veröffentlicht: (2026)
PASER: Post-Training Data Selection for Efficient Pruned Large Language Model Recovery
von: He, Bowei, et al.
Veröffentlicht: (2025)
von: He, Bowei, et al.
Veröffentlicht: (2025)
PSD: Pushing the Pareto Frontier of Diffusion LLMs via Parallel Speculative Decoding
von: Sun, Shengyin, et al.
Veröffentlicht: (2026)
von: Sun, Shengyin, et al.
Veröffentlicht: (2026)
Backdoor Attacks on Dense Retrieval via Public and Unintentional Triggers
von: Long, Quanyu, et al.
Veröffentlicht: (2024)
von: Long, Quanyu, et al.
Veröffentlicht: (2024)
ToolMem: Enhancing Multimodal Agents with Learnable Tool Capability Memory
von: Xiao, Yunzhong, et al.
Veröffentlicht: (2025)
von: Xiao, Yunzhong, et al.
Veröffentlicht: (2025)
MemEmo: Evaluating Emotion in Memory Systems of Agents
von: Liu, Peng, et al.
Veröffentlicht: (2026)
von: Liu, Peng, et al.
Veröffentlicht: (2026)
PixDLM: A Dual-Path Multimodal Language Model for UAV Reasoning Segmentation
von: Ke, Shuyan, et al.
Veröffentlicht: (2026)
von: Ke, Shuyan, et al.
Veröffentlicht: (2026)
Mem-W: Latent Memory-Native GUI Agents
von: Zhang, Guibin, et al.
Veröffentlicht: (2026)
von: Zhang, Guibin, et al.
Veröffentlicht: (2026)
Towards Efficient Agents: A Co-Design of Inference Architecture and System
von: Lin, Weizhe, et al.
Veröffentlicht: (2025)
von: Lin, Weizhe, et al.
Veröffentlicht: (2025)
MemOS: A Memory OS for AI System
von: Li, Zhiyu, et al.
Veröffentlicht: (2025)
von: Li, Zhiyu, et al.
Veröffentlicht: (2025)
C-MOP: Integrating Momentum and Boundary-Aware Clustering for Enhanced Prompt Evolution
von: Yan, Binwei, et al.
Veröffentlicht: (2026)
von: Yan, Binwei, et al.
Veröffentlicht: (2026)
Mem-Gallery: Benchmarking Multimodal Long-Term Conversational Memory for MLLM Agents
von: Bei, Yuanchen, et al.
Veröffentlicht: (2026)
von: Bei, Yuanchen, et al.
Veröffentlicht: (2026)
MemFactory: Unified Inference & Training Framework for Agent Memory
von: Guo, Ziliang, et al.
Veröffentlicht: (2026)
von: Guo, Ziliang, et al.
Veröffentlicht: (2026)
Reinforcing Compositional Retrieval: Retrieving Step-by-Step for Composing Informative Contexts
von: Long, Quanyu, et al.
Veröffentlicht: (2025)
von: Long, Quanyu, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
FocuSFT: Bilevel Optimization for Dilution-Aware Long-Context Fine-Tuning
von: Pei, Zehua, et al.
Veröffentlicht: (2026) -
Verilog-Evolve: Feedback-Driven and Skill-Evolving Verilog Generation
von: Pei, Zehua, et al.
Veröffentlicht: (2026) -
From Pruning to Grafting: Dynamic Knowledge Redistribution via Learnable Layer Fusion
von: Pei, Zehua, et al.
Veröffentlicht: (2024) -
SCOPE: Prompt Evolution for Enhancing Agent Effectiveness
von: Pei, Zehua, et al.
Veröffentlicht: (2025) -
Beyond Speedup -- Utilizing KV Cache for Sampling and Reasoning
von: Xing, Zeyu, et al.
Veröffentlicht: (2026)