Tuning Language Models by Proxy
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Liu, Alisa, Han, Xiaochuang, Wang, Yizhong, Tsvetkov, Yulia, Choi, Yejin, Smith, Noah A. |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
David helps Goliath: Inference-Time Collaboration Between Small Specialized and Large General Diffusion LMs
von: Han, Xiaochuang, et al.
Veröffentlicht: (2023)
von: Han, Xiaochuang, et al.
Veröffentlicht: (2023)
Can Language Models Solve Graph Problems in Natural Language?
von: Wang, Heng, et al.
Veröffentlicht: (2023)
von: Wang, Heng, et al.
Veröffentlicht: (2023)
Quantifying Language Models' Sensitivity to Spurious Features in Prompt Design or: How I learned to start worrying about prompt formatting
von: Sclar, Melanie, et al.
Veröffentlicht: (2023)
von: Sclar, Melanie, et al.
Veröffentlicht: (2023)
JPEG-LM: LLMs as Image Generators with Canonical Codec Representations
von: Han, Xiaochuang, et al.
Veröffentlicht: (2024)
von: Han, Xiaochuang, et al.
Veröffentlicht: (2024)
SuperBPE: Space Travel for Language Models
von: Liu, Alisa, et al.
Veröffentlicht: (2025)
von: Liu, Alisa, et al.
Veröffentlicht: (2025)
When One LLM Drools, Multi-LLM Collaboration Rules
von: Feng, Shangbin, et al.
Veröffentlicht: (2025)
von: Feng, Shangbin, et al.
Veröffentlicht: (2025)
P^3SUM: Preserving Author's Perspective in News Summarization with Diffusion Language Models
von: Liu, Yuhan, et al.
Veröffentlicht: (2023)
von: Liu, Yuhan, et al.
Veröffentlicht: (2023)
Broken Tokens? Your Language Model can Secretly Handle Non-Canonical Tokenizations
von: Zheng, Brian Siyuan, et al.
Veröffentlicht: (2025)
von: Zheng, Brian Siyuan, et al.
Veröffentlicht: (2025)
Are you going to finish that? A Practical Study of the Partial Token Problem
von: Xu, Hao, et al.
Veröffentlicht: (2026)
von: Xu, Hao, et al.
Veröffentlicht: (2026)
FACTS&EVIDENCE: An Interactive Tool for Transparent Fine-Grained Factual Verification of Machine-Generated Text
von: Boonsanong, Varich, et al.
Veröffentlicht: (2025)
von: Boonsanong, Varich, et al.
Veröffentlicht: (2025)
ComPO: Community Preferences for Language Model Personalization
von: Kumar, Sachin, et al.
Veröffentlicht: (2024)
von: Kumar, Sachin, et al.
Veröffentlicht: (2024)
Third-Party Language Model Performance Prediction from Instruction
von: Nadkarni, Rahul, et al.
Veröffentlicht: (2024)
von: Nadkarni, Rahul, et al.
Veröffentlicht: (2024)
Data Mixture Inference: What do BPE Tokenizers Reveal about their Training Data?
von: Hayase, Jonathan, et al.
Veröffentlicht: (2024)
von: Hayase, Jonathan, et al.
Veröffentlicht: (2024)
Fine-grained Hallucination Detection and Editing for Language Models
von: Mishra, Abhika, et al.
Veröffentlicht: (2024)
von: Mishra, Abhika, et al.
Veröffentlicht: (2024)
MADFormer: Mixed Autoregressive and Diffusion Transformers for Continuous Image Generation
von: Chen, Junhao, et al.
Veröffentlicht: (2025)
von: Chen, Junhao, et al.
Veröffentlicht: (2025)
Can LLM Graph Reasoning Generalize beyond Pattern Memorization?
von: Zhang, Yizhuo, et al.
Veröffentlicht: (2024)
von: Zhang, Yizhuo, et al.
Veröffentlicht: (2024)
MAGNET: Improving the Multilingual Fairness of Language Models with Adaptive Gradient-Based Tokenization
von: Ahia, Orevaoghene, et al.
Veröffentlicht: (2024)
von: Ahia, Orevaoghene, et al.
Veröffentlicht: (2024)
Can LLMs Keep a Secret? Testing Privacy Implications of Language Models via Contextual Integrity Theory
von: Mireshghallah, Niloofar, et al.
Veröffentlicht: (2023)
von: Mireshghallah, Niloofar, et al.
Veröffentlicht: (2023)
Finding Flawed Fictions: Evaluating Complex Reasoning in Language Models via Plot Hole Detection
von: Ahuja, Kabir, et al.
Veröffentlicht: (2025)
von: Ahuja, Kabir, et al.
Veröffentlicht: (2025)
Are Language Models Sensitive to Morally Irrelevant Distractors?
von: Shaw, Andrew, et al.
Veröffentlicht: (2026)
von: Shaw, Andrew, et al.
Veröffentlicht: (2026)
Artificial Hivemind: The Open-Ended Homogeneity of Language Models (and Beyond)
von: Jiang, Liwei, et al.
Veröffentlicht: (2025)
von: Jiang, Liwei, et al.
Veröffentlicht: (2025)
ScienceMeter: Tracking Scientific Knowledge Updates in Language Models
von: Wang, Yike, et al.
Veröffentlicht: (2025)
von: Wang, Yike, et al.
Veröffentlicht: (2025)
Set the Clock: Temporal Alignment of Pretrained Language Models
von: Zhao, Bowen, et al.
Veröffentlicht: (2024)
von: Zhao, Bowen, et al.
Veröffentlicht: (2024)
Modular Pluralism: Pluralistic Alignment via Multi-LLM Collaboration
von: Feng, Shangbin, et al.
Veröffentlicht: (2024)
von: Feng, Shangbin, et al.
Veröffentlicht: (2024)
Sampling from Your Language Model One Byte at a Time
von: Hayase, Jonathan, et al.
Veröffentlicht: (2025)
von: Hayase, Jonathan, et al.
Veröffentlicht: (2025)
Do Membership Inference Attacks Work on Large Language Models?
von: Duan, Michael, et al.
Veröffentlicht: (2024)
von: Duan, Michael, et al.
Veröffentlicht: (2024)
The Art of Saying No: Contextual Noncompliance in Language Models
von: Brahman, Faeze, et al.
Veröffentlicht: (2024)
von: Brahman, Faeze, et al.
Veröffentlicht: (2024)
Unpacking DPO and PPO: Disentangling Best Practices for Learning from Preference Feedback
von: Ivison, Hamish, et al.
Veröffentlicht: (2024)
von: Ivison, Hamish, et al.
Veröffentlicht: (2024)
BASS: Benchmarking Audio LMs for Musical Structure and Semantic Reasoning
von: Jang, Min, et al.
Veröffentlicht: (2026)
von: Jang, Min, et al.
Veröffentlicht: (2026)
Does Liking Yellow Imply Driving a School Bus? Semantic Leakage in Language Models
von: Gonen, Hila, et al.
Veröffentlicht: (2024)
von: Gonen, Hila, et al.
Veröffentlicht: (2024)
Infini-gram mini: Exact n-gram Search at the Internet Scale with FM-Index
von: Xu, Hao, et al.
Veröffentlicht: (2025)
von: Xu, Hao, et al.
Veröffentlicht: (2025)
SPARTA ALIGNMENT: Collectively Aligning Multiple Language Models through Combat
von: Jiang, Yuru, et al.
Veröffentlicht: (2025)
von: Jiang, Yuru, et al.
Veröffentlicht: (2025)
Alpaca against Vicuna: Using LLMs to Uncover Memorization of LLMs
von: Kassem, Aly M., et al.
Veröffentlicht: (2024)
von: Kassem, Aly M., et al.
Veröffentlicht: (2024)
Voices Unheard: NLP Resources and Models for Yorùbá Regional Dialects
von: Ahia, Orevaoghene, et al.
Veröffentlicht: (2024)
von: Ahia, Orevaoghene, et al.
Veröffentlicht: (2024)
Resolving Knowledge Conflicts in Large Language Models
von: Wang, Yike, et al.
Veröffentlicht: (2023)
von: Wang, Yike, et al.
Veröffentlicht: (2023)
The Single-Multi Evolution Loop for Self-Improving Model Collaboration Systems
von: Feng, Shangbin, et al.
Veröffentlicht: (2026)
von: Feng, Shangbin, et al.
Veröffentlicht: (2026)
Among Us: Measuring and Mitigating Malicious Contributions in Model Collaboration Systems
von: Yang, Ziyuan, et al.
Veröffentlicht: (2026)
von: Yang, Ziyuan, et al.
Veröffentlicht: (2026)
Explore Theory of Mind: Program-guided adversarial data generation for theory of mind reasoning
von: Sclar, Melanie, et al.
Veröffentlicht: (2024)
von: Sclar, Melanie, et al.
Veröffentlicht: (2024)
What Does the Bot Say? Opportunities and Risks of Large Language Models in Social Media Bot Detection
von: Feng, Shangbin, et al.
Veröffentlicht: (2024)
von: Feng, Shangbin, et al.
Veröffentlicht: (2024)
Learning Syntax Without Planting Trees: Understanding Hierarchical Generalization in Transformers
von: Ahuja, Kabir, et al.
Veröffentlicht: (2024)
von: Ahuja, Kabir, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
David helps Goliath: Inference-Time Collaboration Between Small Specialized and Large General Diffusion LMs
von: Han, Xiaochuang, et al.
Veröffentlicht: (2023) -
Can Language Models Solve Graph Problems in Natural Language?
von: Wang, Heng, et al.
Veröffentlicht: (2023) -
Quantifying Language Models' Sensitivity to Spurious Features in Prompt Design or: How I learned to start worrying about prompt formatting
von: Sclar, Melanie, et al.
Veröffentlicht: (2023) -
JPEG-LM: LLMs as Image Generators with Canonical Codec Representations
von: Han, Xiaochuang, et al.
Veröffentlicht: (2024) -
SuperBPE: Space Travel for Language Models
von: Liu, Alisa, et al.
Veröffentlicht: (2025)