Salvato in:
| Autori principali: | Xie, Wenxuan, Wang, Yujia, Tan, Xin, Lu, Chaochao, Hu, Xia, Wang, Xuhong |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2602.10021 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Decoupling Reasoning and Knowledge Injection for In-Context Knowledge Editing
di: Wang, Changyue, et al.
Pubblicazione: (2025)
di: Wang, Changyue, et al.
Pubblicazione: (2025)
DSPC: Dual-Stage Progressive Compression Framework for Efficient Long-Context Reasoning
di: Gao, Yaxin, et al.
Pubblicazione: (2025)
di: Gao, Yaxin, et al.
Pubblicazione: (2025)
Probe and Skip: Self-Predictive Token Skipping for Efficient Long-Context LLM Inference
di: Wu, Zimeng, et al.
Pubblicazione: (2026)
di: Wu, Zimeng, et al.
Pubblicazione: (2026)
Dynamic Adversarial Reinforcement Learning for Robust Multimodal Large Language Models
di: Bao, Yicheng, et al.
Pubblicazione: (2026)
di: Bao, Yicheng, et al.
Pubblicazione: (2026)
Token Sparse Attention: Efficient Long-Context Inference with Interleaved Token Selection
di: Jo, Dongwon, et al.
Pubblicazione: (2026)
di: Jo, Dongwon, et al.
Pubblicazione: (2026)
VeriFact: Enhancing Long-Form Factuality Evaluation with Refined Fact Extraction and Reference Facts
di: Liu, Xin, et al.
Pubblicazione: (2025)
di: Liu, Xin, et al.
Pubblicazione: (2025)
Think-Reflect-Revise: A Policy-Guided Reflective Framework for Safety Alignment in Large Vision Language Models
di: Weng, Fenghua, et al.
Pubblicazione: (2025)
di: Weng, Fenghua, et al.
Pubblicazione: (2025)
Dual-Density Inference for Efficient Language Model Reasoning
di: Zhao, Zhengyi, et al.
Pubblicazione: (2025)
di: Zhao, Zhengyi, et al.
Pubblicazione: (2025)
From Implicit to Explicit: Token-Efficient Logical Supervision for Mathematical Reasoning in LLMs
di: Wang, Shaojie, et al.
Pubblicazione: (2026)
di: Wang, Shaojie, et al.
Pubblicazione: (2026)
TokenSelect: Efficient Long-Context Inference and Length Extrapolation for LLMs via Dynamic Token-Level KV Cache Selection
di: Wu, Wei, et al.
Pubblicazione: (2024)
di: Wu, Wei, et al.
Pubblicazione: (2024)
IP-Dialog: Evaluating Implicit Personalization in Dialogue Systems with Synthetic Data
di: Peng, Bo, et al.
Pubblicazione: (2025)
di: Peng, Bo, et al.
Pubblicazione: (2025)
D2O: Dynamic Discriminative Operations for Efficient Long-Context Inference of Large Language Models
di: Wan, Zhongwei, et al.
Pubblicazione: (2024)
di: Wan, Zhongwei, et al.
Pubblicazione: (2024)
LoPT: Lossless Parallel Tokenization Acceleration for Long Context Inference of Large Language Model
di: Shao, Wei, et al.
Pubblicazione: (2025)
di: Shao, Wei, et al.
Pubblicazione: (2025)
MEDA: Dynamic KV Cache Allocation for Efficient Multimodal Long-Context Inference
di: Wan, Zhongwei, et al.
Pubblicazione: (2025)
di: Wan, Zhongwei, et al.
Pubblicazione: (2025)
LazyLLM: Dynamic Token Pruning for Efficient Long Context LLM Inference
di: Fu, Qichen, et al.
Pubblicazione: (2024)
di: Fu, Qichen, et al.
Pubblicazione: (2024)
DiffAdapt: Difficulty-Adaptive Reasoning for Token-Efficient LLM Inference
di: Liu, Xiang, et al.
Pubblicazione: (2025)
di: Liu, Xiang, et al.
Pubblicazione: (2025)
DELTA: Dynamic Layer-Aware Token Attention for Efficient Long-Context Reasoning
di: Zarch, Hossein Entezari, et al.
Pubblicazione: (2025)
di: Zarch, Hossein Entezari, et al.
Pubblicazione: (2025)
Implicit Hierarchical GRPO: Decoupling Tool Invocation from Execution for Tool-Integrated Mathematical Reasoning
di: Wang, Li, et al.
Pubblicazione: (2026)
di: Wang, Li, et al.
Pubblicazione: (2026)
Exploiting Sparsity for Long Context Inference: Million Token Contexts on Commodity GPUs
di: Synk, Ryan, et al.
Pubblicazione: (2025)
di: Synk, Ryan, et al.
Pubblicazione: (2025)
SemToken: Semantic-Aware Tokenization for Efficient Long-Context Language Modeling
di: Liu, Dong, et al.
Pubblicazione: (2025)
di: Liu, Dong, et al.
Pubblicazione: (2025)
When Thoughts Meet Facts: Reusable Reasoning for Long-Context LMs
di: Jeong, Soyeong, et al.
Pubblicazione: (2025)
di: Jeong, Soyeong, et al.
Pubblicazione: (2025)
Training-free Context-adaptive Attention for Efficient Long Context Modeling
di: You, Zeng, et al.
Pubblicazione: (2025)
di: You, Zeng, et al.
Pubblicazione: (2025)
Efficient Long-Context LLM Inference via KV Cache Clustering
di: Hu, Jie, et al.
Pubblicazione: (2025)
di: Hu, Jie, et al.
Pubblicazione: (2025)
Efficient Prompt Compression with Evaluator Heads for Long-Context Transformer Inference
di: Fei, Weizhi, et al.
Pubblicazione: (2025)
di: Fei, Weizhi, et al.
Pubblicazione: (2025)
Latent-Condensed Transformer for Efficient Long Context Modeling
di: You, Zeng, et al.
Pubblicazione: (2026)
di: You, Zeng, et al.
Pubblicazione: (2026)
JEPA-Reasoner: Decoupling Latent Reasoning from Token Generation
di: Liu, Bingyang Kelvin, et al.
Pubblicazione: (2025)
di: Liu, Bingyang Kelvin, et al.
Pubblicazione: (2025)
Tokenization Falling Short: On Subword Robustness in Large Language Models
di: Chai, Yekun, et al.
Pubblicazione: (2024)
di: Chai, Yekun, et al.
Pubblicazione: (2024)
Membership Inference Attack against Long-Context Large Language Models
di: Wang, Zixiong, et al.
Pubblicazione: (2024)
di: Wang, Zixiong, et al.
Pubblicazione: (2024)
Decoupling Understanding from Reasoning via Problem Space Mapping for Small-Scale Model Reasoning
di: Wang, Li, et al.
Pubblicazione: (2025)
di: Wang, Li, et al.
Pubblicazione: (2025)
Enhancing Retrieval Systems with Inference-Time Logical Reasoning
di: Faltings, Felix, et al.
Pubblicazione: (2025)
di: Faltings, Felix, et al.
Pubblicazione: (2025)
LongRecipe: Recipe for Efficient Long Context Generalization in Large Language Models
di: Hu, Zhiyuan, et al.
Pubblicazione: (2024)
di: Hu, Zhiyuan, et al.
Pubblicazione: (2024)
Squid: Long Context as a New Modality for Energy-Efficient On-Device Language Models
di: Chen, Wei, et al.
Pubblicazione: (2024)
di: Chen, Wei, et al.
Pubblicazione: (2024)
R$^2$PO: Decoupling Training Trajectories from Inference Responses for LLM Reasoning
di: Wang, Jingchu, et al.
Pubblicazione: (2026)
di: Wang, Jingchu, et al.
Pubblicazione: (2026)
ATACompressor: Adaptive Task-Aware Compression for Efficient Long-Context Processing in LLMs
di: Li, Xuancheng, et al.
Pubblicazione: (2026)
di: Li, Xuancheng, et al.
Pubblicazione: (2026)
SlimInfer: Accelerating Long-Context LLM Inference via Dynamic Token Pruning
di: Long, Lingkun, et al.
Pubblicazione: (2025)
di: Long, Lingkun, et al.
Pubblicazione: (2025)
VTC-R1: Vision-Text Compression for Efficient Long-Context Reasoning
di: Wang, Yibo, et al.
Pubblicazione: (2026)
di: Wang, Yibo, et al.
Pubblicazione: (2026)
Less Languages, Less Tokens: An Efficient Unified Logic Cross-lingual Chain-of-Thought Reasoning Framework
di: Zhang, Chenyuan, et al.
Pubblicazione: (2026)
di: Zhang, Chenyuan, et al.
Pubblicazione: (2026)
HyLRA: Hybrid Layer Reuse Attention for Efficient Long-Context Inference
di: Ai, Xuan, et al.
Pubblicazione: (2026)
di: Ai, Xuan, et al.
Pubblicazione: (2026)
Think Through Uncertainty: Improving Long-Form Generation Factuality via Reasoning Calibration
di: Liu, Xin, et al.
Pubblicazione: (2026)
di: Liu, Xin, et al.
Pubblicazione: (2026)
Think Dense, Not Long: Dynamic Decoupled Conditional Advantage for Efficient Reasoning
di: Peng, Keqin, et al.
Pubblicazione: (2026)
di: Peng, Keqin, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Decoupling Reasoning and Knowledge Injection for In-Context Knowledge Editing
di: Wang, Changyue, et al.
Pubblicazione: (2025) -
DSPC: Dual-Stage Progressive Compression Framework for Efficient Long-Context Reasoning
di: Gao, Yaxin, et al.
Pubblicazione: (2025) -
Probe and Skip: Self-Predictive Token Skipping for Efficient Long-Context LLM Inference
di: Wu, Zimeng, et al.
Pubblicazione: (2026) -
Dynamic Adversarial Reinforcement Learning for Robust Multimodal Large Language Models
di: Bao, Yicheng, et al.
Pubblicazione: (2026) -
Token Sparse Attention: Efficient Long-Context Inference with Interleaved Token Selection
di: Jo, Dongwon, et al.
Pubblicazione: (2026)