Importance Weighting Can Help Large Language Models Self-Improve
Fuente:
arXiv
Guardado en:
| Autores principales: | Jiang, Chunyang, Chan, Chi-min, Xue, Wei, Liu, Qifeng, Guo, Yike |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Graceful Forgetting in Generative Language Models
por: Jiang, Chunyang, et al.
Publicado: (2025)
por: Jiang, Chunyang, et al.
Publicado: (2025)
Semantic Voting: A Self-Evaluation-Free Approach for Efficient LLM Self-Improvement on Unverifiable Open-ended Tasks
por: Jiang, Chunyang, et al.
Publicado: (2025)
por: Jiang, Chunyang, et al.
Publicado: (2025)
Large Language Models Can Self-Improve in Long-context Reasoning
por: Li, Siheng, et al.
Publicado: (2024)
por: Li, Siheng, et al.
Publicado: (2024)
Can Small Language Models Help Large Language Models Reason Better?: LM-Guided Chain-of-Thought
por: Lee, Jooyoung, et al.
Publicado: (2024)
por: Lee, Jooyoung, et al.
Publicado: (2024)
Can Reasoning Help Large Language Models Capture Human Annotator Disagreement?
por: Ni, Jingwei, et al.
Publicado: (2025)
por: Ni, Jingwei, et al.
Publicado: (2025)
Toward Adaptive Large Language Models Structured Pruning via Hybrid-grained Weight Importance Assessment
por: Liu, Jun, et al.
Publicado: (2024)
por: Liu, Jun, et al.
Publicado: (2024)
Leveraging Importance Sampling to Detach Alignment Modules from Large Language Models
por: Liu, Yi, et al.
Publicado: (2025)
por: Liu, Yi, et al.
Publicado: (2025)
Large Language Models Can Self-Improve At Web Agent Tasks
por: Patel, Ajay, et al.
Publicado: (2024)
por: Patel, Ajay, et al.
Publicado: (2024)
Can Large Language Models Help Multimodal Language Analysis? MMLA: A Comprehensive Benchmark
por: Zhang, Hanlei, et al.
Publicado: (2025)
por: Zhang, Hanlei, et al.
Publicado: (2025)
ProgCo: Program Helps Self-Correction of Large Language Models
por: Song, Xiaoshuai, et al.
Publicado: (2025)
por: Song, Xiaoshuai, et al.
Publicado: (2025)
FastSAG: Towards Fast Non-Autoregressive Singing Accompaniment Generation
por: Chen, Jianyi, et al.
Publicado: (2024)
por: Chen, Jianyi, et al.
Publicado: (2024)
Advancing Large Language Model Attribution through Self-Improving
por: Huang, Lei, et al.
Publicado: (2024)
por: Huang, Lei, et al.
Publicado: (2024)
Beyond Accuracy: The Role of Calibration in Self-Improving Large Language Models
por: Huang, Liangjie, et al.
Publicado: (2025)
por: Huang, Liangjie, et al.
Publicado: (2025)
Efficient Attention Mechanisms for Large Language Models: A Survey
por: Sun, Yutao, et al.
Publicado: (2025)
por: Sun, Yutao, et al.
Publicado: (2025)
Self-HarmLLM: Can Large Language Model Harm Itself?
por: Kim, Heehwan, et al.
Publicado: (2025)
por: Kim, Heehwan, et al.
Publicado: (2025)
SafeMT: Multi-turn Safety for Multimodal Language Models
por: Zhu, Han, et al.
Publicado: (2025)
por: Zhu, Han, et al.
Publicado: (2025)
How Much Can RAG Help the Reasoning of LLM?
por: Liu, Jingyu, et al.
Publicado: (2024)
por: Liu, Jingyu, et al.
Publicado: (2024)
CRITIC: Large Language Models Can Self-Correct with Tool-Interactive Critiquing
por: Gou, Zhibin, et al.
Publicado: (2023)
por: Gou, Zhibin, et al.
Publicado: (2023)
HonestLLM: Toward an Honest and Helpful Large Language Model
por: Gao, Chujie, et al.
Publicado: (2024)
por: Gao, Chujie, et al.
Publicado: (2024)
The Super Weight in Large Language Models
por: Yu, Mengxia, et al.
Publicado: (2024)
por: Yu, Mengxia, et al.
Publicado: (2024)
Evaluating the Performance of Large Language Models on GAOKAO Benchmark
por: Zhang, Xiaotian, et al.
Publicado: (2023)
por: Zhang, Xiaotian, et al.
Publicado: (2023)
Benchmarking Multi-National Value Alignment for Large Language Models
por: Shi, Weijie, et al.
Publicado: (2025)
por: Shi, Weijie, et al.
Publicado: (2025)
Small Language Model Can Self-correct
por: Han, Haixia, et al.
Publicado: (2024)
por: Han, Haixia, et al.
Publicado: (2024)
DC-W2S: Dual-Consensus Weak-to-Strong Training for Reliable Process Reward Modeling in Biological Reasoning
por: Chan, Chi-Min, et al.
Publicado: (2026)
por: Chan, Chi-Min, et al.
Publicado: (2026)
Can Language Model Moderators Improve the Health of Online Discourse?
por: Cho, Hyundong, et al.
Publicado: (2023)
por: Cho, Hyundong, et al.
Publicado: (2023)
Can Large Language Models do Analytical Reasoning?
por: Hu, Yebowen, et al.
Publicado: (2024)
por: Hu, Yebowen, et al.
Publicado: (2024)
Self-Discover: Large Language Models Self-Compose Reasoning Structures
por: Zhou, Pei, et al.
Publicado: (2024)
por: Zhou, Pei, et al.
Publicado: (2024)
Does Using Counterfactual Help LLMs Explain Textual Importance in Classification?
por: Tan, Nelvin, et al.
Publicado: (2025)
por: Tan, Nelvin, et al.
Publicado: (2025)
Offline Training of Language Model Agents with Functions as Learnable Weights
por: Zhang, Shaokun, et al.
Publicado: (2024)
por: Zhang, Shaokun, et al.
Publicado: (2024)
Codec Does Matter: Exploring the Semantic Shortcoming of Codec for Audio Language Model
por: Ye, Zhen, et al.
Publicado: (2024)
por: Ye, Zhen, et al.
Publicado: (2024)
Translate-and-Revise: Boosting Large Language Models for Constrained Translation
por: Huang, Pengcheng, et al.
Publicado: (2024)
por: Huang, Pengcheng, et al.
Publicado: (2024)
Towards Safety and Helpfulness Balanced Responses via Controllable Large Language Models
por: Tuan, Yi-Lin, et al.
Publicado: (2024)
por: Tuan, Yi-Lin, et al.
Publicado: (2024)
Helping Large Language Models Protect Themselves: An Enhanced Filtering and Summarization System
por: Muhaimin, Sheikh Samit, et al.
Publicado: (2025)
por: Muhaimin, Sheikh Samit, et al.
Publicado: (2025)
Break the Chain: Large Language Models Can be Shortcut Reasoners
por: Ding, Mengru, et al.
Publicado: (2024)
por: Ding, Mengru, et al.
Publicado: (2024)
ALOPE: Adaptive Layer Optimization for Translation Quality Estimation using Large Language Models
por: Sindhujan, Archchana, et al.
Publicado: (2025)
por: Sindhujan, Archchana, et al.
Publicado: (2025)
Large Language Models Can Help Mitigate Barren Plateaus in Quantum Neural Networks
por: Zhuang, Jun, et al.
Publicado: (2025)
por: Zhuang, Jun, et al.
Publicado: (2025)
SLED: Self Logits Evolution Decoding for Improving Factuality in Large Language Models
por: Zhang, Jianyi, et al.
Publicado: (2024)
por: Zhang, Jianyi, et al.
Publicado: (2024)
From Implicit to Explicit: Enhancing Self-Recognition in Large Language Models
por: Zhou, Yinghan, et al.
Publicado: (2025)
por: Zhou, Yinghan, et al.
Publicado: (2025)
SeSE: Black-Box Uncertainty Quantification for Large Language Models Based on Structural Information Theory
por: Zhao, Xingtao, et al.
Publicado: (2025)
por: Zhao, Xingtao, et al.
Publicado: (2025)
SSL-SSAW: Self-Supervised Learning with Sigmoid Self-Attention Weighting for Question-Based Sign Language Translation
por: Liu, Zekang, et al.
Publicado: (2025)
por: Liu, Zekang, et al.
Publicado: (2025)
Ejemplares similares
-
Graceful Forgetting in Generative Language Models
por: Jiang, Chunyang, et al.
Publicado: (2025) -
Semantic Voting: A Self-Evaluation-Free Approach for Efficient LLM Self-Improvement on Unverifiable Open-ended Tasks
por: Jiang, Chunyang, et al.
Publicado: (2025) -
Large Language Models Can Self-Improve in Long-context Reasoning
por: Li, Siheng, et al.
Publicado: (2024) -
Can Small Language Models Help Large Language Models Reason Better?: LM-Guided Chain-of-Thought
por: Lee, Jooyoung, et al.
Publicado: (2024) -
Can Reasoning Help Large Language Models Capture Human Annotator Disagreement?
por: Ni, Jingwei, et al.
Publicado: (2025)