Self-Demos: Eliciting Out-of-Demonstration Generalizability in Large Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | He, Wei, Liu, Shichun, Zhao, Jun, Ding, Yiwen, Lu, Yi, Xi, Zhiheng, Gui, Tao, Zhang, Qi, Huang, Xuanjing |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Distill Visual Chart Reasoning Ability from LLMs to MLLMs
par: He, Wei, et autres
Publié: (2024)
par: He, Wei, et autres
Publié: (2024)
LongAgent: Scaling Language Models to 128k Context through Multi-Agent Collaboration
par: Zhao, Jun, et autres
Publié: (2024)
par: Zhao, Jun, et autres
Publié: (2024)
Self-Polish: Enhance Reasoning in Large Language Models via Problem Refinement
par: Xi, Zhiheng, et autres
Publié: (2023)
par: Xi, Zhiheng, et autres
Publié: (2023)
Mitigating Tail Narrowing in LLM Self-Improvement via Socratic-Guided Sampling
par: Ding, Yiwen, et autres
Publié: (2024)
par: Ding, Yiwen, et autres
Publié: (2024)
Unveiling Linguistic Regions in Large Language Models
par: Zhang, Zhihao, et autres
Publié: (2024)
par: Zhang, Zhihao, et autres
Publié: (2024)
RoCoIns: Enhancing Robustness of Large Language Models through Code-Style Instructions
par: Zhang, Yuansen, et autres
Publié: (2024)
par: Zhang, Yuansen, et autres
Publié: (2024)
Counteracting Matthew Effect in Self-Improvement of LVLMs through Head-Tail Re-balancing
par: Guo, Xin, et autres
Publié: (2025)
par: Guo, Xin, et autres
Publié: (2025)
Subspace Defense: Discarding Adversarial Perturbations by Learning a Subspace for Clean Signals
par: Zheng, Rui, et autres
Publié: (2024)
par: Zheng, Rui, et autres
Publié: (2024)
LongHeads: Multi-Head Attention is Secretly a Long Context Processor
par: Lu, Yi, et autres
Publié: (2024)
par: Lu, Yi, et autres
Publié: (2024)
Inverse-Q*: Token Level Reinforcement Learning for Aligning Large Language Models Without Preference Data
par: Xia, Han, et autres
Publié: (2024)
par: Xia, Han, et autres
Publié: (2024)
Training Large Language Models for Reasoning through Reverse Curriculum Reinforcement Learning
par: Xi, Zhiheng, et autres
Publié: (2024)
par: Xi, Zhiheng, et autres
Publié: (2024)
LLaMA Beyond English: An Empirical Study on Language Capability Transfer
par: Zhao, Jun, et autres
Publié: (2024)
par: Zhao, Jun, et autres
Publié: (2024)
Feedback-Driven Tool-Use Improvements in Large Language Models via Automated Build Environments
par: Ye, Junjie, et autres
Publié: (2025)
par: Ye, Junjie, et autres
Publié: (2025)
AgentGym: Evolving Large Language Model-based Agents across Diverse Environments
par: Xi, Zhiheng, et autres
Publié: (2024)
par: Xi, Zhiheng, et autres
Publié: (2024)
DFPO: Scaling Value Modeling via Distributional Flow towards Robust and Generalizable LLM Post-Training
par: Zhu, Dingwei, et autres
Publié: (2026)
par: Zhu, Dingwei, et autres
Publié: (2026)
Parrot: A Training Pipeline Enhances Both Program CoT and Natural Language CoT for Reasoning
par: Jin, Senjie, et autres
Publié: (2025)
par: Jin, Senjie, et autres
Publié: (2025)
Agentic Harness Engineering: Observability-Driven Automatic Evolution of Coding-Agent Harnesses
par: Lin, Jiahang, et autres
Publié: (2026)
par: Lin, Jiahang, et autres
Publié: (2026)
LoRAMoE: Alleviate World Knowledge Forgetting in Large Language Models via MoE-Style Plugin
par: Dou, Shihan, et autres
Publié: (2023)
par: Dou, Shihan, et autres
Publié: (2023)
DemoRank: Selecting Effective Demonstrations for Large Language Models in Ranking Task
par: Liu, Wenhan, et autres
Publié: (2024)
par: Liu, Wenhan, et autres
Publié: (2024)
TL-Training: A Task-Feature-Based Framework for Training Large Language Models in Tool Use
par: Ye, Junjie, et autres
Publié: (2024)
par: Ye, Junjie, et autres
Publié: (2024)
LLM-DA: Data Augmentation via Large Language Models for Few-Shot Named Entity Recognition
par: Ye, Junjie, et autres
Publié: (2024)
par: Ye, Junjie, et autres
Publié: (2024)
LLMEval-Fair: A Large-Scale Longitudinal Study on Robust and Fair Evaluation of Large Language Models
par: Zhang, Ming, et autres
Publié: (2025)
par: Zhang, Ming, et autres
Publié: (2025)
DemoShapley: Valuation of Demonstrations for In-Context Learning
par: Xie, Shan, et autres
Publié: (2024)
par: Xie, Shan, et autres
Publié: (2024)
Are Large Language Models Good Prompt Optimizers?
par: Ma, Ruotian, et autres
Publié: (2024)
par: Ma, Ruotian, et autres
Publié: (2024)
ToolHop: A Query-Driven Benchmark for Evaluating Large Language Models in Multi-Hop Tool Use
par: Ye, Junjie, et autres
Publié: (2025)
par: Ye, Junjie, et autres
Publié: (2025)
Better Process Supervision with Bi-directional Rewarding Signals
par: Chen, Wenxiang, et autres
Publié: (2025)
par: Chen, Wenxiang, et autres
Publié: (2025)
MM-Doc-R1: Training Agents for Long Document Visual Question Answering through Multi-turn Reinforcement Learning
par: Lin, Jiahang, et autres
Publié: (2026)
par: Lin, Jiahang, et autres
Publié: (2026)
Navigating the OverKill in Large Language Models
par: Shi, Chenyu, et autres
Publié: (2024)
par: Shi, Chenyu, et autres
Publié: (2024)
Exploring the Compositional Deficiency of Large Language Models in Mathematical Reasoning
par: Zhao, Jun, et autres
Publié: (2024)
par: Zhao, Jun, et autres
Publié: (2024)
Advancing Block Diffusion Language Models for Test-Time Scaling
par: Lu, Yi, et autres
Publié: (2026)
par: Lu, Yi, et autres
Publié: (2026)
Chain-of-Dictionary Prompting Elicits Translation in Large Language Models
par: Lu, Hongyuan, et autres
Publié: (2023)
par: Lu, Hongyuan, et autres
Publié: (2023)
R-Horizon: How Far Can Your Large Reasoning Model Really Go in Breadth and Depth?
par: Lu, Yi, et autres
Publié: (2025)
par: Lu, Yi, et autres
Publié: (2025)
Self-Consistency of the Internal Reward Models Improves Self-Rewarding Language Models
par: Zhou, Xin, et autres
Publié: (2025)
par: Zhou, Xin, et autres
Publié: (2025)
Scaling Laws for Fact Memorization of Large Language Models
par: Lu, Xingyu, et autres
Publié: (2024)
par: Lu, Xingyu, et autres
Publié: (2024)
LLMEval-Med: A Real-world Clinical Benchmark for Medical LLMs with Physician Validation
par: Zhang, Ming, et autres
Publié: (2025)
par: Zhang, Ming, et autres
Publié: (2025)
What's Wrong with Your Code Generated by Large Language Models? An Extensive Study
par: Dou, Shihan, et autres
Publié: (2024)
par: Dou, Shihan, et autres
Publié: (2024)
CodeChameleon: Personalized Encryption Framework for Jailbreaking Large Language Models
par: Lv, Huijie, et autres
Publié: (2024)
par: Lv, Huijie, et autres
Publié: (2024)
ToolSword: Unveiling Safety Issues of Large Language Models in Tool Learning Across Three Stages
par: Ye, Junjie, et autres
Publié: (2024)
par: Ye, Junjie, et autres
Publié: (2024)
BMMR: A Large-Scale Bilingual Multimodal Multi-Discipline Reasoning Dataset
par: Xi, Zhiheng, et autres
Publié: (2025)
par: Xi, Zhiheng, et autres
Publié: (2025)
Effective Length Extrapolation via Dimension-Wise Positional Embeddings Manipulation
par: Lu, Yi, et autres
Publié: (2025)
par: Lu, Yi, et autres
Publié: (2025)
Documents similaires
-
Distill Visual Chart Reasoning Ability from LLMs to MLLMs
par: He, Wei, et autres
Publié: (2024) -
LongAgent: Scaling Language Models to 128k Context through Multi-Agent Collaboration
par: Zhao, Jun, et autres
Publié: (2024) -
Self-Polish: Enhance Reasoning in Large Language Models via Problem Refinement
par: Xi, Zhiheng, et autres
Publié: (2023) -
Mitigating Tail Narrowing in LLM Self-Improvement via Socratic-Guided Sampling
par: Ding, Yiwen, et autres
Publié: (2024) -
Unveiling Linguistic Regions in Large Language Models
par: Zhang, Zhihao, et autres
Publié: (2024)