Information-Theoretic Distillation for Reference-less Summarization
Fuente:
arXiv
Salvato in:
| Autori principali: | Jung, Jaehun, Lu, Ximing, Jiang, Liwei, Brahman, Faeze, West, Peter, Koh, Pang Wei, Choi, Yejin |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Impossible Distillation: from Low-Quality Model to High-Quality Dataset & Model for Summarization and Paraphrasing
di: Jung, Jaehun, et al.
Pubblicazione: (2023)
di: Jung, Jaehun, et al.
Pubblicazione: (2023)
Trust or Escalate: LLM Judges with Provable Guarantees for Human Agreement
di: Jung, Jaehun, et al.
Pubblicazione: (2024)
di: Jung, Jaehun, et al.
Pubblicazione: (2024)
JAMDEC: Unsupervised Authorship Obfuscation using Constrained Decoding over Small Language Models
di: Fisher, Jillian, et al.
Pubblicazione: (2024)
di: Fisher, Jillian, et al.
Pubblicazione: (2024)
In Search of the Long-Tail: Systematic Generation of Long-Tail Inferential Knowledge via Logical Rule Guided Search
di: Li, Huihan, et al.
Pubblicazione: (2023)
di: Li, Huihan, et al.
Pubblicazione: (2023)
Socratic-MCTS: Test-Time Visual Reasoning by Asking the Right Questions
di: Acuna, David, et al.
Pubblicazione: (2025)
di: Acuna, David, et al.
Pubblicazione: (2025)
PrefDisco: Benchmarking Proactive Personalized Reasoning
di: Li, Shuyue Stella, et al.
Pubblicazione: (2025)
di: Li, Shuyue Stella, et al.
Pubblicazione: (2025)
Agent Lumos: Unified and Modular Training for Open-Source Language Agents
di: Yin, Da, et al.
Pubblicazione: (2023)
di: Yin, Da, et al.
Pubblicazione: (2023)
Verifying the Verifiers: Unveiling Pitfalls and Potentials in Fact Verifiers
di: Seo, Wooseok, et al.
Pubblicazione: (2025)
di: Seo, Wooseok, et al.
Pubblicazione: (2025)
ParaPO: Aligning Language Models to Reduce Verbatim Reproduction of Pre-training Data
di: Chen, Tong, et al.
Pubblicazione: (2025)
di: Chen, Tong, et al.
Pubblicazione: (2025)
Value Kaleidoscope: Engaging AI with Pluralistic Human Values, Rights, and Duties
di: Sorensen, Taylor, et al.
Pubblicazione: (2023)
di: Sorensen, Taylor, et al.
Pubblicazione: (2023)
MacGyver: Are Large Language Models Creative Problem Solvers?
di: Tian, Yufei, et al.
Pubblicazione: (2023)
di: Tian, Yufei, et al.
Pubblicazione: (2023)
WildBench: Benchmarking LLMs with Challenging Tasks from Real Users in the Wild
di: Lin, Bill Yuchen, et al.
Pubblicazione: (2024)
di: Lin, Bill Yuchen, et al.
Pubblicazione: (2024)
ProfBench: Multi-Domain Rubrics requiring Professional Knowledge to Answer and Judge
di: Wang, Zhilin, et al.
Pubblicazione: (2025)
di: Wang, Zhilin, et al.
Pubblicazione: (2025)
Prismatic Synthesis: Gradient-based Data Diversification Boosts Generalization in LLM Reasoning
di: Jung, Jaehun, et al.
Pubblicazione: (2025)
di: Jung, Jaehun, et al.
Pubblicazione: (2025)
DailyDilemmas: Revealing Value Preferences of LLMs with Quandaries of Daily Life
di: Chiu, Yu Ying, et al.
Pubblicazione: (2024)
di: Chiu, Yu Ying, et al.
Pubblicazione: (2024)
Creativity Support in the Age of Large Language Models: An Empirical Study Involving Emerging Writers
di: Chakrabarty, Tuhin, et al.
Pubblicazione: (2023)
di: Chakrabarty, Tuhin, et al.
Pubblicazione: (2023)
Long Grounded Thoughts: Synthesizing Visual Problems and Reasoning Chains at Scale
di: Acuna, David, et al.
Pubblicazione: (2025)
di: Acuna, David, et al.
Pubblicazione: (2025)
Reasoning Up the Instruction Ladder for Controllable Language Models
di: Zheng, Zishuo, et al.
Pubblicazione: (2025)
di: Zheng, Zishuo, et al.
Pubblicazione: (2025)
Retro-Search: Exploring Untaken Paths for Deeper and Efficient Reasoning
di: Lu, Ximing, et al.
Pubblicazione: (2025)
di: Lu, Ximing, et al.
Pubblicazione: (2025)
Privasis: Synthesizing the Largest "Public" Private Dataset from Scratch
di: Kim, Hyunwoo, et al.
Pubblicazione: (2026)
di: Kim, Hyunwoo, et al.
Pubblicazione: (2026)
Cold-Start Personalization via Training-Free Priors from Structured World Models
di: Bose, Avinandan, et al.
Pubblicazione: (2026)
di: Bose, Avinandan, et al.
Pubblicazione: (2026)
Phenomenal Yet Puzzling: Testing Inductive Reasoning Capabilities of Language Models with Hypothesis Refinement
di: Qiu, Linlu, et al.
Pubblicazione: (2023)
di: Qiu, Linlu, et al.
Pubblicazione: (2023)
CreativityPrism: A Holistic Evaluation Framework for Large Language Model Creativity
di: Hou, Zhaoyi Joey, et al.
Pubblicazione: (2025)
di: Hou, Zhaoyi Joey, et al.
Pubblicazione: (2025)
How to Train Your Fact Verifier: Knowledge Transfer with Multimodal Open Models
di: Lee, Jaeyoung, et al.
Pubblicazione: (2024)
di: Lee, Jaeyoung, et al.
Pubblicazione: (2024)
AI-LieDar: Examine the Trade-off Between Utility and Truthfulness in LLM Agents
di: Su, Zhe, et al.
Pubblicazione: (2024)
di: Su, Zhe, et al.
Pubblicazione: (2024)
PlaSma: Making Small Language Models Better Procedural Knowledge Models for (Counterfactual) Planning
di: Brahman, Faeze, et al.
Pubblicazione: (2023)
di: Brahman, Faeze, et al.
Pubblicazione: (2023)
WildTeaming at Scale: From In-the-Wild Jailbreaks to (Adversarially) Safer Language Models
di: Jiang, Liwei, et al.
Pubblicazione: (2024)
di: Jiang, Liwei, et al.
Pubblicazione: (2024)
DeepSearch: Overcome the Bottleneck of Reinforcement Learning with Verifiable Rewards via Monte Carlo Tree Search
di: Wu, Fang, et al.
Pubblicazione: (2025)
di: Wu, Fang, et al.
Pubblicazione: (2025)
Large-Scale Data Selection for Instruction Tuning
di: Ivison, Hamish, et al.
Pubblicazione: (2025)
di: Ivison, Hamish, et al.
Pubblicazione: (2025)
ProRL: Prolonged Reinforcement Learning Expands Reasoning Boundaries in Large Language Models
di: Liu, Mingjie, et al.
Pubblicazione: (2025)
di: Liu, Mingjie, et al.
Pubblicazione: (2025)
What Makes it Ok to Set a Fire? Iterative Self-distillation of Contexts and Rationales for Disambiguating Defeasible Social and Moral Situations
di: Rao, Kavel, et al.
Pubblicazione: (2023)
di: Rao, Kavel, et al.
Pubblicazione: (2023)
The Invisible Leash: Why RLVR May or May Not Escape Its Origin
di: Wu, Fang, et al.
Pubblicazione: (2025)
di: Wu, Fang, et al.
Pubblicazione: (2025)
S^2tory: Story Spine Distillation for Movie Script Summarization
di: Lu, Mingzhe, et al.
Pubblicazione: (2026)
di: Lu, Mingzhe, et al.
Pubblicazione: (2026)
Affective and Dynamic Beam Search for Story Generation
di: Huang, Tenghao, et al.
Pubblicazione: (2023)
di: Huang, Tenghao, et al.
Pubblicazione: (2023)
Opt-ICL at LeWiDi-2025: Maximizing In-Context Signal from Rater Examples via Meta-Learning
di: Sorensen, Taylor, et al.
Pubblicazione: (2025)
di: Sorensen, Taylor, et al.
Pubblicazione: (2025)
A Roadmap to Pluralistic Alignment
di: Sorensen, Taylor, et al.
Pubblicazione: (2024)
di: Sorensen, Taylor, et al.
Pubblicazione: (2024)
Spectrum Tuning: Post-Training for Distributional Coverage and In-Context Steerability
di: Sorensen, Taylor, et al.
Pubblicazione: (2025)
di: Sorensen, Taylor, et al.
Pubblicazione: (2025)
Multi-Attribute Constraint Satisfaction via Language Model Rewriting
di: Baheti, Ashutosh, et al.
Pubblicazione: (2024)
di: Baheti, Ashutosh, et al.
Pubblicazione: (2024)
The Art of Saying No: Contextual Noncompliance in Language Models
di: Brahman, Faeze, et al.
Pubblicazione: (2024)
di: Brahman, Faeze, et al.
Pubblicazione: (2024)
Mitigating Hallucination in Abstractive Summarization with Domain-Conditional Mutual Information
di: Chae, Kyubyung, et al.
Pubblicazione: (2024)
di: Chae, Kyubyung, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Impossible Distillation: from Low-Quality Model to High-Quality Dataset & Model for Summarization and Paraphrasing
di: Jung, Jaehun, et al.
Pubblicazione: (2023) -
Trust or Escalate: LLM Judges with Provable Guarantees for Human Agreement
di: Jung, Jaehun, et al.
Pubblicazione: (2024) -
JAMDEC: Unsupervised Authorship Obfuscation using Constrained Decoding over Small Language Models
di: Fisher, Jillian, et al.
Pubblicazione: (2024) -
In Search of the Long-Tail: Systematic Generation of Long-Tail Inferential Knowledge via Logical Rule Guided Search
di: Li, Huihan, et al.
Pubblicazione: (2023) -
Socratic-MCTS: Test-Time Visual Reasoning by Asking the Right Questions
di: Acuna, David, et al.
Pubblicazione: (2025)