Salvato in:
| Autori principali: | Liu, Yijun, Yu, Jinzheng, Xu, Yang, Li, Zhongyang, Zhu, Qingfu |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2503.13299 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Lookahead Q-Cache: Achieving More Consistent KV Cache Eviction via Pseudo Query
di: Wang, Yixuan, et al.
Pubblicazione: (2025)
di: Wang, Yixuan, et al.
Pubblicazione: (2025)
Judge Q: Trainable Queries for Optimized Information Retention in KV Cache Eviction
di: Liu, Yijun, et al.
Pubblicazione: (2025)
di: Liu, Yijun, et al.
Pubblicazione: (2025)
Improving Grammatical Error Correction via Contextual Data Augmentation
di: Wang, Yixuan, et al.
Pubblicazione: (2024)
di: Wang, Yixuan, et al.
Pubblicazione: (2024)
Memory, Consciousness and Large Language Model
di: Li, Jitang, et al.
Pubblicazione: (2024)
di: Li, Jitang, et al.
Pubblicazione: (2024)
Shortcut Learning in In-Context Learning: A Survey
di: Song, Rui, et al.
Pubblicazione: (2024)
di: Song, Rui, et al.
Pubblicazione: (2024)
A Survey on Evaluation of Large Language Models
di: Chang, Yupeng, et al.
Pubblicazione: (2023)
di: Chang, Yupeng, et al.
Pubblicazione: (2023)
A Static and Dynamic Attention Framework for Multi Turn Dialogue Generation
di: Zhang, Wei-Nan, et al.
Pubblicazione: (2024)
di: Zhang, Wei-Nan, et al.
Pubblicazione: (2024)
Evaluation of Retrieval-Augmented Generation: A Survey
di: Yu, Hao, et al.
Pubblicazione: (2024)
di: Yu, Hao, et al.
Pubblicazione: (2024)
$π$-Attention: Periodic Sparse Transformers for Efficient Long-Context Modeling
di: Liu, Dong, et al.
Pubblicazione: (2025)
di: Liu, Dong, et al.
Pubblicazione: (2025)
Dehallucinating Parallel Context Extension for Retrieval-Augmented Generation
di: Ma, Zexiong, et al.
Pubblicazione: (2024)
di: Ma, Zexiong, et al.
Pubblicazione: (2024)
Machine Unlearning in Generative AI: A Survey
di: Liu, Zheyuan, et al.
Pubblicazione: (2024)
di: Liu, Zheyuan, et al.
Pubblicazione: (2024)
Correlation-Aware Select and Merge Attention for Efficient Fine-Tuning and Context Length Extension
di: Wang, Ning, et al.
Pubblicazione: (2024)
di: Wang, Ning, et al.
Pubblicazione: (2024)
Automated Creativity Evaluation for Large Language Models: A Reference-Based Approach
di: Li, Ruizhe, et al.
Pubblicazione: (2025)
di: Li, Ruizhe, et al.
Pubblicazione: (2025)
Evolutionary Perspectives on the Evaluation of LLM-Based AI Agents: A Comprehensive Survey
di: Zhu, Jiachen, et al.
Pubblicazione: (2025)
di: Zhu, Jiachen, et al.
Pubblicazione: (2025)
System-2 Mathematical Reasoning via Enriched Instruction Tuning
di: Cai, Huanqia, et al.
Pubblicazione: (2024)
di: Cai, Huanqia, et al.
Pubblicazione: (2024)
On the Transformations across Reward Model, Parameter Update, and In-Context Prompt
di: Cai, Deng, et al.
Pubblicazione: (2024)
di: Cai, Deng, et al.
Pubblicazione: (2024)
Medical Dialogue: A Survey of Categories, Methods, Evaluation and Challenges
di: Shi, Xiaoming, et al.
Pubblicazione: (2024)
di: Shi, Xiaoming, et al.
Pubblicazione: (2024)
Enhancing Complex Causality Extraction via Improved Subtask Interaction and Knowledge Fusion
di: Gao, Jinglong, et al.
Pubblicazione: (2024)
di: Gao, Jinglong, et al.
Pubblicazione: (2024)
A Systematic Survey on Large Language Models for Algorithm Design
di: Liu, Fei, et al.
Pubblicazione: (2024)
di: Liu, Fei, et al.
Pubblicazione: (2024)
Unveiling Effective In-Context Configurations for Image Captioning: An External & Internal Analysis
di: Li, Li, et al.
Pubblicazione: (2025)
di: Li, Li, et al.
Pubblicazione: (2025)
Know More, Know Clearer: A Meta-Cognitive Framework for Knowledge Augmentation in Large Language Models
di: Chen, Hao, et al.
Pubblicazione: (2026)
di: Chen, Hao, et al.
Pubblicazione: (2026)
TQA-Bench: Evaluating LLMs for Multi-Table Question Answering with Scalable Context and Symbolic Extension
di: Qiu, Zipeng, et al.
Pubblicazione: (2024)
di: Qiu, Zipeng, et al.
Pubblicazione: (2024)
Enhancing LLM-Based Data Annotation with Error Decomposition
di: Xu, Zhen, et al.
Pubblicazione: (2026)
di: Xu, Zhen, et al.
Pubblicazione: (2026)
Counterfactual Probing for Hallucination Detection and Mitigation in Large Language Models
di: Feng, Yijun
Pubblicazione: (2025)
di: Feng, Yijun
Pubblicazione: (2025)
FreqKV: Key-Value Compression in Frequency Domain for Context Window Extension
di: Kai, Jushi, et al.
Pubblicazione: (2025)
di: Kai, Jushi, et al.
Pubblicazione: (2025)
Stacked from One: Multi-Scale Self-Injection for Context Window Extension
di: Han, Wei, et al.
Pubblicazione: (2026)
di: Han, Wei, et al.
Pubblicazione: (2026)
FastMem: Fast Memorization of Prompt Improves Context Awareness of Large Language Models
di: Zhu, Junyi, et al.
Pubblicazione: (2024)
di: Zhu, Junyi, et al.
Pubblicazione: (2024)
A Survey of Pun Generation: Datasets, Evaluations and Methodologies
di: Su, Yuchen, et al.
Pubblicazione: (2025)
di: Su, Yuchen, et al.
Pubblicazione: (2025)
Beyond Chain-of-Thought: A Survey of Chain-of-X Paradigms for LLMs
di: Xia, Yu, et al.
Pubblicazione: (2024)
di: Xia, Yu, et al.
Pubblicazione: (2024)
SurveyEval: Towards Comprehensive Evaluation of LLM-Generated Academic Surveys
di: Zhao, Jiahao, et al.
Pubblicazione: (2025)
di: Zhao, Jiahao, et al.
Pubblicazione: (2025)
A Survey on Large Language Models for Mathematical Reasoning
di: Wang, Peng-Yuan, et al.
Pubblicazione: (2025)
di: Wang, Peng-Yuan, et al.
Pubblicazione: (2025)
IndexMem: Learned KV-Cache Eviction with Latent Memory for Long-Context LLM Inference
di: Yang, Xintong, et al.
Pubblicazione: (2026)
di: Yang, Xintong, et al.
Pubblicazione: (2026)
To Retrieve or To Think? An Agentic Approach for Context Evolution
di: Chen, Rubing, et al.
Pubblicazione: (2026)
di: Chen, Rubing, et al.
Pubblicazione: (2026)
A Survey on the Honesty of Large Language Models
di: Li, Siheng, et al.
Pubblicazione: (2024)
di: Li, Siheng, et al.
Pubblicazione: (2024)
Understanding In-Context Learning Beyond Transformers: An Investigation of State Space and Hybrid Architectures
di: Wang, Shenran, et al.
Pubblicazione: (2025)
di: Wang, Shenran, et al.
Pubblicazione: (2025)
How Far Can In-Context Alignment Go? Exploring the State of In-Context Alignment
di: Huang, Heyan, et al.
Pubblicazione: (2024)
di: Huang, Heyan, et al.
Pubblicazione: (2024)
ARS: Automatic Routing Solver with Large Language Models
di: Li, Kai, et al.
Pubblicazione: (2025)
di: Li, Kai, et al.
Pubblicazione: (2025)
Survey on Knowledge Distillation for Large Language Models: Methods, Evaluation, and Application
di: Yang, Chuanpeng, et al.
Pubblicazione: (2024)
di: Yang, Chuanpeng, et al.
Pubblicazione: (2024)
A Survey on Model Compression for Large Language Models
di: Zhu, Xunyu, et al.
Pubblicazione: (2023)
di: Zhu, Xunyu, et al.
Pubblicazione: (2023)
Stealthy Jailbreak Attacks on Large Language Models via Benign Data Mirroring
di: Mu, Honglin, et al.
Pubblicazione: (2024)
di: Mu, Honglin, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Lookahead Q-Cache: Achieving More Consistent KV Cache Eviction via Pseudo Query
di: Wang, Yixuan, et al.
Pubblicazione: (2025) -
Judge Q: Trainable Queries for Optimized Information Retention in KV Cache Eviction
di: Liu, Yijun, et al.
Pubblicazione: (2025) -
Improving Grammatical Error Correction via Contextual Data Augmentation
di: Wang, Yixuan, et al.
Pubblicazione: (2024) -
Memory, Consciousness and Large Language Model
di: Li, Jitang, et al.
Pubblicazione: (2024) -
Shortcut Learning in In-Context Learning: A Survey
di: Song, Rui, et al.
Pubblicazione: (2024)