A Survey on LLM Inference-Time Self-Improvement
Fuente:
arXiv
Guardado en:
| Autores principales: | Dong, Xiangjue, Teleki, Maria, Caverlee, James |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
CHOIR: Collaborative Harmonization fOr Inference Robustness
por: Dong, Xiangjue, et al.
Publicado: (2025)
por: Dong, Xiangjue, et al.
Publicado: (2025)
Masculine Defaults via Gendered Discourse in Podcasts and Large Language Models
por: Teleki, Maria, et al.
Publicado: (2025)
por: Teleki, Maria, et al.
Publicado: (2025)
$DA^3$: A Distribution-Aware Adversarial Attack against Language Models
por: Wang, Yibo, et al.
Publicado: (2023)
por: Wang, Yibo, et al.
Publicado: (2023)
Disclosure and Mitigation of Gender Bias in LLMs
por: Dong, Xiangjue, et al.
Publicado: (2024)
por: Dong, Xiangjue, et al.
Publicado: (2024)
Language Models as Semantic Augmenters for Sequential Recommenders
por: Valizadeh, Mahsa, et al.
Publicado: (2025)
por: Valizadeh, Mahsa, et al.
Publicado: (2025)
Conversational Speech Reveals Structural Robustness Failures in SpeechLLM Backbones
por: Teleki, Maria, et al.
Publicado: (2025)
por: Teleki, Maria, et al.
Publicado: (2025)
ReasoningRec: Bridging Personalized Recommendations and Human-Interpretable Explanations through LLM Reasoning
por: Bismay, Millennium, et al.
Publicado: (2024)
por: Bismay, Millennium, et al.
Publicado: (2024)
PromptHelper: A Prompt Recommender System for Encouraging Creativity in AI Chatbot Interactions
por: Kim, Jason, et al.
Publicado: (2026)
por: Kim, Jason, et al.
Publicado: (2026)
Z-Scores: A Metric for Linguistically Assessing Disfluency Removal
por: Teleki, Maria, et al.
Publicado: (2025)
por: Teleki, Maria, et al.
Publicado: (2025)
SocialPulse: An Open-Source Subreddit Sensemaking Toolkit
por: Birkelbach, Stephanie, et al.
Publicado: (2026)
por: Birkelbach, Stephanie, et al.
Publicado: (2026)
Beyond Single Ground Truth: Reference Monism as Epistemic Injustice in ASR Evaluation
por: Choi, Anna Seo Gyeong, et al.
Publicado: (2026)
por: Choi, Anna Seo Gyeong, et al.
Publicado: (2026)
The Neglected Tails in Vision-Language Models
por: Parashar, Shubham, et al.
Publicado: (2024)
por: Parashar, Shubham, et al.
Publicado: (2024)
DisastQA: A Comprehensive Benchmark for Evaluating Question Answering in Disaster Management
por: Chen, Zhitong, et al.
Publicado: (2026)
por: Chen, Zhitong, et al.
Publicado: (2026)
The Voice Behind the Words: Quantifying Intersectional Bias in SpeechLLMs
por: Satish, Shree Harsha Bokkahalli, et al.
Publicado: (2026)
por: Satish, Shree Harsha Bokkahalli, et al.
Publicado: (2026)
Self-Improvement in Multimodal Large Language Models: A Survey
por: Deng, Shijian, et al.
Publicado: (2025)
por: Deng, Shijian, et al.
Publicado: (2025)
LLM Inference Enhanced by External Knowledge: A Survey
por: Lin, Yu-Hsuan, et al.
Publicado: (2025)
por: Lin, Yu-Hsuan, et al.
Publicado: (2025)
LLM Inference Unveiled: Survey and Roofline Model Insights
por: Yuan, Zhihang, et al.
Publicado: (2024)
por: Yuan, Zhihang, et al.
Publicado: (2024)
A Probabilistic Inference Scaling Theory for LLM Self-Correction
por: Yang, Zhe, et al.
Publicado: (2025)
por: Yang, Zhe, et al.
Publicado: (2025)
Self-Trained Verification for Training- and Test-Time Self-Improvement
por: Wu, Chen Henry, et al.
Publicado: (2026)
por: Wu, Chen Henry, et al.
Publicado: (2026)
SWIFT: On-the-Fly Self-Speculative Decoding for LLM Inference Acceleration
por: Xia, Heming, et al.
Publicado: (2024)
por: Xia, Heming, et al.
Publicado: (2024)
DIVE: Diversified Iterative Self-Improvement
por: Qin, Yiwei, et al.
Publicado: (2025)
por: Qin, Yiwei, et al.
Publicado: (2025)
WebEvolver: Enhancing Web Agent Self-Improvement with Coevolving World Model
por: Fang, Tianqing, et al.
Publicado: (2025)
por: Fang, Tianqing, et al.
Publicado: (2025)
Semantic Voting: A Self-Evaluation-Free Approach for Efficient LLM Self-Improvement on Unverifiable Open-ended Tasks
por: Jiang, Chunyang, et al.
Publicado: (2025)
por: Jiang, Chunyang, et al.
Publicado: (2025)
AttnCache: Accelerating Self-Attention Inference for LLM Prefill via Attention Cache
por: Song, Dinghong, et al.
Publicado: (2025)
por: Song, Dinghong, et al.
Publicado: (2025)
Select-then-Solve: Paradigm Routing as Inference-Time Optimization for LLM Agents
por: Zhou, Heng, et al.
Publicado: (2026)
por: Zhou, Heng, et al.
Publicado: (2026)
TTSR: Test-Time Self-Reflection for Continual Reasoning Improvement
por: He, Haoyang, et al.
Publicado: (2026)
por: He, Haoyang, et al.
Publicado: (2026)
Toward Self-Improvement of LLMs via Imagination, Searching, and Criticizing
por: Tian, Ye, et al.
Publicado: (2024)
por: Tian, Ye, et al.
Publicado: (2024)
Taming the Titans: A Survey of Efficient LLM Inference Serving
por: Zhen, Ranran, et al.
Publicado: (2025)
por: Zhen, Ranran, et al.
Publicado: (2025)
Review of Inference-Time Scaling Strategies: Reasoning, Search and RAG
por: Wang, Zhichao, et al.
Publicado: (2025)
por: Wang, Zhichao, et al.
Publicado: (2025)
A Survey of Frontiers in LLM Reasoning: Inference Scaling, Learning to Reason, and Agentic Systems
por: Ke, Zixuan, et al.
Publicado: (2025)
por: Ke, Zixuan, et al.
Publicado: (2025)
On Cost-Effective LLM-as-a-Judge Improvement Techniques
por: Lail, Ryan, et al.
Publicado: (2026)
por: Lail, Ryan, et al.
Publicado: (2026)
Dynamic Model Routing and Cascading for Efficient LLM Inference: A Survey
por: Moslem, Yasmin, et al.
Publicado: (2026)
por: Moslem, Yasmin, et al.
Publicado: (2026)
Leveraging Domain Knowledge at Inference Time for LLM Translation: Retrieval versus Generation
por: Li, Bryan, et al.
Publicado: (2025)
por: Li, Bryan, et al.
Publicado: (2025)
Progress or Regress? Self-Improvement Reversal in Post-training
por: Wu, Ting, et al.
Publicado: (2024)
por: Wu, Ting, et al.
Publicado: (2024)
Enabling Language Models to Implicitly Learn Self-Improvement
por: Wang, Ziqi, et al.
Publicado: (2023)
por: Wang, Ziqi, et al.
Publicado: (2023)
Mitigating Tail Narrowing in LLM Self-Improvement via Socratic-Guided Sampling
por: Ding, Yiwen, et al.
Publicado: (2024)
por: Ding, Yiwen, et al.
Publicado: (2024)
From Seeing it to Experiencing it: Interactive Evaluation of Intersectional Voice Bias in Human-AI Speech Interaction
por: Satish, Shree Harsha Bokkahalli, et al.
Publicado: (2026)
por: Satish, Shree Harsha Bokkahalli, et al.
Publicado: (2026)
Unlocking Efficiency in Large Language Model Inference: A Comprehensive Survey of Speculative Decoding
por: Xia, Heming, et al.
Publicado: (2024)
por: Xia, Heming, et al.
Publicado: (2024)
Non-Linear Inference Time Intervention: Improving LLM Truthfulness
por: Hoscilowicz, Jakub, et al.
Publicado: (2024)
por: Hoscilowicz, Jakub, et al.
Publicado: (2024)
A Training-Free Regeneration Paradigm: Contrastive Reflection Memory Guided Self-Verification and Self-Improvement
por: Li, Yuran, et al.
Publicado: (2026)
por: Li, Yuran, et al.
Publicado: (2026)
Ejemplares similares
-
CHOIR: Collaborative Harmonization fOr Inference Robustness
por: Dong, Xiangjue, et al.
Publicado: (2025) -
Masculine Defaults via Gendered Discourse in Podcasts and Large Language Models
por: Teleki, Maria, et al.
Publicado: (2025) -
$DA^3$: A Distribution-Aware Adversarial Attack against Language Models
por: Wang, Yibo, et al.
Publicado: (2023) -
Disclosure and Mitigation of Gender Bias in LLMs
por: Dong, Xiangjue, et al.
Publicado: (2024) -
Language Models as Semantic Augmenters for Sequential Recommenders
por: Valizadeh, Mahsa, et al.
Publicado: (2025)