Importance Weighting Can Help Large Language Models Self-Improve
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Jiang, Chunyang, Chan, Chi-min, Xue, Wei, Liu, Qifeng, Guo, Yike |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Graceful Forgetting in Generative Language Models
par: Jiang, Chunyang, et autres
Publié: (2025)
par: Jiang, Chunyang, et autres
Publié: (2025)
Semantic Voting: A Self-Evaluation-Free Approach for Efficient LLM Self-Improvement on Unverifiable Open-ended Tasks
par: Jiang, Chunyang, et autres
Publié: (2025)
par: Jiang, Chunyang, et autres
Publié: (2025)
Large Language Models Can Self-Improve in Long-context Reasoning
par: Li, Siheng, et autres
Publié: (2024)
par: Li, Siheng, et autres
Publié: (2024)
Can Small Language Models Help Large Language Models Reason Better?: LM-Guided Chain-of-Thought
par: Lee, Jooyoung, et autres
Publié: (2024)
par: Lee, Jooyoung, et autres
Publié: (2024)
Can Reasoning Help Large Language Models Capture Human Annotator Disagreement?
par: Ni, Jingwei, et autres
Publié: (2025)
par: Ni, Jingwei, et autres
Publié: (2025)
Toward Adaptive Large Language Models Structured Pruning via Hybrid-grained Weight Importance Assessment
par: Liu, Jun, et autres
Publié: (2024)
par: Liu, Jun, et autres
Publié: (2024)
Leveraging Importance Sampling to Detach Alignment Modules from Large Language Models
par: Liu, Yi, et autres
Publié: (2025)
par: Liu, Yi, et autres
Publié: (2025)
Large Language Models Can Self-Improve At Web Agent Tasks
par: Patel, Ajay, et autres
Publié: (2024)
par: Patel, Ajay, et autres
Publié: (2024)
Can Large Language Models Help Multimodal Language Analysis? MMLA: A Comprehensive Benchmark
par: Zhang, Hanlei, et autres
Publié: (2025)
par: Zhang, Hanlei, et autres
Publié: (2025)
ProgCo: Program Helps Self-Correction of Large Language Models
par: Song, Xiaoshuai, et autres
Publié: (2025)
par: Song, Xiaoshuai, et autres
Publié: (2025)
FastSAG: Towards Fast Non-Autoregressive Singing Accompaniment Generation
par: Chen, Jianyi, et autres
Publié: (2024)
par: Chen, Jianyi, et autres
Publié: (2024)
Advancing Large Language Model Attribution through Self-Improving
par: Huang, Lei, et autres
Publié: (2024)
par: Huang, Lei, et autres
Publié: (2024)
Beyond Accuracy: The Role of Calibration in Self-Improving Large Language Models
par: Huang, Liangjie, et autres
Publié: (2025)
par: Huang, Liangjie, et autres
Publié: (2025)
Efficient Attention Mechanisms for Large Language Models: A Survey
par: Sun, Yutao, et autres
Publié: (2025)
par: Sun, Yutao, et autres
Publié: (2025)
Self-HarmLLM: Can Large Language Model Harm Itself?
par: Kim, Heehwan, et autres
Publié: (2025)
par: Kim, Heehwan, et autres
Publié: (2025)
SafeMT: Multi-turn Safety for Multimodal Language Models
par: Zhu, Han, et autres
Publié: (2025)
par: Zhu, Han, et autres
Publié: (2025)
How Much Can RAG Help the Reasoning of LLM?
par: Liu, Jingyu, et autres
Publié: (2024)
par: Liu, Jingyu, et autres
Publié: (2024)
CRITIC: Large Language Models Can Self-Correct with Tool-Interactive Critiquing
par: Gou, Zhibin, et autres
Publié: (2023)
par: Gou, Zhibin, et autres
Publié: (2023)
HonestLLM: Toward an Honest and Helpful Large Language Model
par: Gao, Chujie, et autres
Publié: (2024)
par: Gao, Chujie, et autres
Publié: (2024)
The Super Weight in Large Language Models
par: Yu, Mengxia, et autres
Publié: (2024)
par: Yu, Mengxia, et autres
Publié: (2024)
Evaluating the Performance of Large Language Models on GAOKAO Benchmark
par: Zhang, Xiaotian, et autres
Publié: (2023)
par: Zhang, Xiaotian, et autres
Publié: (2023)
Benchmarking Multi-National Value Alignment for Large Language Models
par: Shi, Weijie, et autres
Publié: (2025)
par: Shi, Weijie, et autres
Publié: (2025)
Small Language Model Can Self-correct
par: Han, Haixia, et autres
Publié: (2024)
par: Han, Haixia, et autres
Publié: (2024)
DC-W2S: Dual-Consensus Weak-to-Strong Training for Reliable Process Reward Modeling in Biological Reasoning
par: Chan, Chi-Min, et autres
Publié: (2026)
par: Chan, Chi-Min, et autres
Publié: (2026)
Can Language Model Moderators Improve the Health of Online Discourse?
par: Cho, Hyundong, et autres
Publié: (2023)
par: Cho, Hyundong, et autres
Publié: (2023)
Can Large Language Models do Analytical Reasoning?
par: Hu, Yebowen, et autres
Publié: (2024)
par: Hu, Yebowen, et autres
Publié: (2024)
Self-Discover: Large Language Models Self-Compose Reasoning Structures
par: Zhou, Pei, et autres
Publié: (2024)
par: Zhou, Pei, et autres
Publié: (2024)
Does Using Counterfactual Help LLMs Explain Textual Importance in Classification?
par: Tan, Nelvin, et autres
Publié: (2025)
par: Tan, Nelvin, et autres
Publié: (2025)
Offline Training of Language Model Agents with Functions as Learnable Weights
par: Zhang, Shaokun, et autres
Publié: (2024)
par: Zhang, Shaokun, et autres
Publié: (2024)
Codec Does Matter: Exploring the Semantic Shortcoming of Codec for Audio Language Model
par: Ye, Zhen, et autres
Publié: (2024)
par: Ye, Zhen, et autres
Publié: (2024)
Translate-and-Revise: Boosting Large Language Models for Constrained Translation
par: Huang, Pengcheng, et autres
Publié: (2024)
par: Huang, Pengcheng, et autres
Publié: (2024)
Towards Safety and Helpfulness Balanced Responses via Controllable Large Language Models
par: Tuan, Yi-Lin, et autres
Publié: (2024)
par: Tuan, Yi-Lin, et autres
Publié: (2024)
Helping Large Language Models Protect Themselves: An Enhanced Filtering and Summarization System
par: Muhaimin, Sheikh Samit, et autres
Publié: (2025)
par: Muhaimin, Sheikh Samit, et autres
Publié: (2025)
Break the Chain: Large Language Models Can be Shortcut Reasoners
par: Ding, Mengru, et autres
Publié: (2024)
par: Ding, Mengru, et autres
Publié: (2024)
ALOPE: Adaptive Layer Optimization for Translation Quality Estimation using Large Language Models
par: Sindhujan, Archchana, et autres
Publié: (2025)
par: Sindhujan, Archchana, et autres
Publié: (2025)
Large Language Models Can Help Mitigate Barren Plateaus in Quantum Neural Networks
par: Zhuang, Jun, et autres
Publié: (2025)
par: Zhuang, Jun, et autres
Publié: (2025)
SLED: Self Logits Evolution Decoding for Improving Factuality in Large Language Models
par: Zhang, Jianyi, et autres
Publié: (2024)
par: Zhang, Jianyi, et autres
Publié: (2024)
From Implicit to Explicit: Enhancing Self-Recognition in Large Language Models
par: Zhou, Yinghan, et autres
Publié: (2025)
par: Zhou, Yinghan, et autres
Publié: (2025)
SeSE: Black-Box Uncertainty Quantification for Large Language Models Based on Structural Information Theory
par: Zhao, Xingtao, et autres
Publié: (2025)
par: Zhao, Xingtao, et autres
Publié: (2025)
SSL-SSAW: Self-Supervised Learning with Sigmoid Self-Attention Weighting for Question-Based Sign Language Translation
par: Liu, Zekang, et autres
Publié: (2025)
par: Liu, Zekang, et autres
Publié: (2025)
Documents similaires
-
Graceful Forgetting in Generative Language Models
par: Jiang, Chunyang, et autres
Publié: (2025) -
Semantic Voting: A Self-Evaluation-Free Approach for Efficient LLM Self-Improvement on Unverifiable Open-ended Tasks
par: Jiang, Chunyang, et autres
Publié: (2025) -
Large Language Models Can Self-Improve in Long-context Reasoning
par: Li, Siheng, et autres
Publié: (2024) -
Can Small Language Models Help Large Language Models Reason Better?: LM-Guided Chain-of-Thought
par: Lee, Jooyoung, et autres
Publié: (2024) -
Can Reasoning Help Large Language Models Capture Human Annotator Disagreement?
par: Ni, Jingwei, et autres
Publié: (2025)