Diver: Large Language Model Decoding with Span-Level Mutual Information Verification
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Lu, Jinliang, Wang, Chen, Zhang, Jiajun |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Hit the Sweet Spot! Span-Level Ensemble for Large Language Models
von: Xu, Yangyifan, et al.
Veröffentlicht: (2024)
von: Xu, Yangyifan, et al.
Veröffentlicht: (2024)
Merge, Ensemble, and Cooperate! A Survey on Collaborative Strategies in the Era of Large Language Models
von: Lu, Jinliang, et al.
Veröffentlicht: (2024)
von: Lu, Jinliang, et al.
Veröffentlicht: (2024)
Bridging the Gap between Different Vocabularies for LLM Ensemble
von: Xu, Yangyifan, et al.
Veröffentlicht: (2024)
von: Xu, Yangyifan, et al.
Veröffentlicht: (2024)
X-Instruction: Aligning Language Model in Low-resource Languages with Self-curated Cross-lingual Instructions
von: Li, Chong, et al.
Veröffentlicht: (2024)
von: Li, Chong, et al.
Veröffentlicht: (2024)
Adaptive Draft-Verification for Efficient Large Language Model Decoding
von: Liu, Xukun, et al.
Veröffentlicht: (2024)
von: Liu, Xukun, et al.
Veröffentlicht: (2024)
MI-PRUN: Optimize Large Language Model Pruning via Mutual Information
von: Zhang, Hao, et al.
Veröffentlicht: (2026)
von: Zhang, Hao, et al.
Veröffentlicht: (2026)
Rethinking Personalization in Large Language Models at the Token Level
von: Zhang, Chenheng, et al.
Veröffentlicht: (2026)
von: Zhang, Chenheng, et al.
Veröffentlicht: (2026)
MILL: Mutual Verification with Large Language Models for Zero-Shot Query Expansion
von: Jia, Pengyue, et al.
Veröffentlicht: (2023)
von: Jia, Pengyue, et al.
Veröffentlicht: (2023)
Strategies for Span Labeling with Large Language Models
von: Semin, Danil, et al.
Veröffentlicht: (2026)
von: Semin, Danil, et al.
Veröffentlicht: (2026)
A Unified Representation Underlying the Judgment of Large Language Models
von: Lu, Yi-Long, et al.
Veröffentlicht: (2025)
von: Lu, Yi-Long, et al.
Veröffentlicht: (2025)
Encoder-Decoder or Decoder-Only? Revisiting Encoder-Decoder Large Language Model
von: Zhang, Biao, et al.
Veröffentlicht: (2025)
von: Zhang, Biao, et al.
Veröffentlicht: (2025)
SRA: Span Representation Alignment for Large Language Model Distillation
von: Dao, Quoc Phong, et al.
Veröffentlicht: (2026)
von: Dao, Quoc Phong, et al.
Veröffentlicht: (2026)
Leveraging Conditional Mutual Information to Improve Large Language Model Fine-Tuning For Classification
von: Sivakaran, Thanushon, et al.
Veröffentlicht: (2025)
von: Sivakaran, Thanushon, et al.
Veröffentlicht: (2025)
Span Modeling for Idiomaticity and Figurative Language Detection with Span Contrastive Loss
von: Matheny, Blake, et al.
Veröffentlicht: (2026)
von: Matheny, Blake, et al.
Veröffentlicht: (2026)
ResT: Reshaping Token-Level Policy Gradients for Tool-Use Large Language Models
von: Lin, Zihan, et al.
Veröffentlicht: (2025)
von: Lin, Zihan, et al.
Veröffentlicht: (2025)
Grounding Language with Vision: A Conditional Mutual Information Calibrated Decoding Strategy for Reducing Hallucinations in LVLMs
von: Fang, Hao, et al.
Veröffentlicht: (2025)
von: Fang, Hao, et al.
Veröffentlicht: (2025)
Mitigating Hallucinations of Large Language Models in Medical Information Extraction via Contrastive Decoding
von: Xu, Derong, et al.
Veröffentlicht: (2024)
von: Xu, Derong, et al.
Veröffentlicht: (2024)
Self-Selected Attention Span for Accelerating Large Language Model Inference
von: Jin, Tian, et al.
Veröffentlicht: (2024)
von: Jin, Tian, et al.
Veröffentlicht: (2024)
Self Speculative Decoding for Diffusion Large Language Models
von: Gao, Yifeng, et al.
Veröffentlicht: (2025)
von: Gao, Yifeng, et al.
Veröffentlicht: (2025)
Advancing Process Verification for Large Language Models via Tree-Based Preference Learning
von: He, Mingqian, et al.
Veröffentlicht: (2024)
von: He, Mingqian, et al.
Veröffentlicht: (2024)
SPOT: Span-level Pause-of-Thought for Efficient and Interpretable Latent Reasoning in Large Language Models
von: Chu, Yunlong, et al.
Veröffentlicht: (2026)
von: Chu, Yunlong, et al.
Veröffentlicht: (2026)
DeepDiver: Adaptive Search Intensity Scaling via Open-Web Reinforcement Learning
von: Shi, Wenxuan, et al.
Veröffentlicht: (2025)
von: Shi, Wenxuan, et al.
Veröffentlicht: (2025)
Enhancing Knowledge Distillation of Large Language Models through Efficient Multi-Modal Distribution Alignment
von: Peng, Tianyu, et al.
Veröffentlicht: (2024)
von: Peng, Tianyu, et al.
Veröffentlicht: (2024)
DSVD: Dynamic Self-Verify Decoding for Faithful Generation in Large Language Models
von: Guo, YiQiu, et al.
Veröffentlicht: (2025)
von: Guo, YiQiu, et al.
Veröffentlicht: (2025)
CITER: Collaborative Inference for Efficient Large Language Model Decoding with Token-Level Routing
von: Zheng, Wenhao, et al.
Veröffentlicht: (2025)
von: Zheng, Wenhao, et al.
Veröffentlicht: (2025)
Neuron-Level Sequential Editing for Large Language Models
von: Jiang, Houcheng, et al.
Veröffentlicht: (2024)
von: Jiang, Houcheng, et al.
Veröffentlicht: (2024)
MIRL: Mutual Information-Guided Reinforcement Learning for Vision-Language Models
von: Zhang, Yin, et al.
Veröffentlicht: (2026)
von: Zhang, Yin, et al.
Veröffentlicht: (2026)
Draft & Verify: Lossless Large Language Model Acceleration via Self-Speculative Decoding
von: Zhang, Jun, et al.
Veröffentlicht: (2023)
von: Zhang, Jun, et al.
Veröffentlicht: (2023)
Exploring the Factual Consistency in Dialogue Comprehension of Large Language Models
von: She, Shuaijie, et al.
Veröffentlicht: (2023)
von: She, Shuaijie, et al.
Veröffentlicht: (2023)
Recurrent Drafter for Fast Speculative Decoding in Large Language Models
von: Cheng, Yunfei, et al.
Veröffentlicht: (2024)
von: Cheng, Yunfei, et al.
Veröffentlicht: (2024)
BLSP: Bootstrapping Language-Speech Pre-training via Behavior Alignment of Continuation Writing
von: Wang, Chen, et al.
Veröffentlicht: (2023)
von: Wang, Chen, et al.
Veröffentlicht: (2023)
Decoding Text Spans for Efficient and Accurate Named-Entity Recognition
von: Maracani, Andrea, et al.
Veröffentlicht: (2026)
von: Maracani, Andrea, et al.
Veröffentlicht: (2026)
Speculative Verification: Exploiting Information Gain to Refine Speculative Decoding
von: Kim, Sungkyun, et al.
Veröffentlicht: (2025)
von: Kim, Sungkyun, et al.
Veröffentlicht: (2025)
DPPA: Pruning Method for Large Language Model to Model Merging
von: Zhu, Yaochen, et al.
Veröffentlicht: (2024)
von: Zhu, Yaochen, et al.
Veröffentlicht: (2024)
League of LLMs: A Benchmark-Free Paradigm for Mutual Evaluation of Large Language Models
von: Guo, Qianhong, et al.
Veröffentlicht: (2025)
von: Guo, Qianhong, et al.
Veröffentlicht: (2025)
Accelerate Speculative Decoding with Sparse Computation in Verification
von: Wang, Jikai, et al.
Veröffentlicht: (2025)
von: Wang, Jikai, et al.
Veröffentlicht: (2025)
Exploring the Performance of Large Language Models on Subjective Span Identification Tasks
von: Dmonte, Alphaeus, et al.
Veröffentlicht: (2026)
von: Dmonte, Alphaeus, et al.
Veröffentlicht: (2026)
UncertaintyRAG: Span-Level Uncertainty Enhanced Long-Context Modeling for Retrieval-Augmented Generation
von: Li, Zixuan, et al.
Veröffentlicht: (2024)
von: Li, Zixuan, et al.
Veröffentlicht: (2024)
Multilingual Contrastive Decoding via Language-Agnostic Layers Skipping
von: Zhu, Wenhao, et al.
Veröffentlicht: (2024)
von: Zhu, Wenhao, et al.
Veröffentlicht: (2024)
Large Language Models Can Self-Correct with Key Condition Verification
von: Wu, Zhenyu, et al.
Veröffentlicht: (2024)
von: Wu, Zhenyu, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
Hit the Sweet Spot! Span-Level Ensemble for Large Language Models
von: Xu, Yangyifan, et al.
Veröffentlicht: (2024) -
Merge, Ensemble, and Cooperate! A Survey on Collaborative Strategies in the Era of Large Language Models
von: Lu, Jinliang, et al.
Veröffentlicht: (2024) -
Bridging the Gap between Different Vocabularies for LLM Ensemble
von: Xu, Yangyifan, et al.
Veröffentlicht: (2024) -
X-Instruction: Aligning Language Model in Low-resource Languages with Self-curated Cross-lingual Instructions
von: Li, Chong, et al.
Veröffentlicht: (2024) -
Adaptive Draft-Verification for Efficient Large Language Model Decoding
von: Liu, Xukun, et al.
Veröffentlicht: (2024)