Enregistré dans:
| Auteurs principaux: | Li, Michael Y., Fox, Emily B., Goodman, Noah D. |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2402.17879 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
CriticAL: Critic Automation with Language Models
par: Li, Michael Y., et autres
Publié: (2024)
par: Li, Michael Y., et autres
Publié: (2024)
Is Child-Directed Speech Effective Training Data for Language Models?
par: Feng, Steven Y., et autres
Publié: (2024)
par: Feng, Steven Y., et autres
Publié: (2024)
Large Language Model Reasoning Failures
par: Song, Peiyang, et autres
Publié: (2026)
par: Song, Peiyang, et autres
Publié: (2026)
Hypothesis Search: Inductive Reasoning with Language Models
par: Wang, Ruocheng, et autres
Publié: (2023)
par: Wang, Ruocheng, et autres
Publié: (2023)
Quiet-STaR: Language Models Can Teach Themselves to Think Before Speaking
par: Zelikman, Eric, et autres
Publié: (2024)
par: Zelikman, Eric, et autres
Publié: (2024)
Language and Experience: A Computational Model of Social Learning in Complex Tasks
par: Colas, Cédric, et autres
Publié: (2025)
par: Colas, Cédric, et autres
Publié: (2025)
Endless Terminals: Scaling RL Environments for Terminal Agents
par: Gandhi, Kanishk, et autres
Publié: (2026)
par: Gandhi, Kanishk, et autres
Publié: (2026)
Neural Garbage Collection: Learning to Forget while Learning to Reason
par: Li, Michael Y., et autres
Publié: (2026)
par: Li, Michael Y., et autres
Publié: (2026)
Automating Governing Knowledge Commons and Contextual Integrity (GKC-CI) Privacy Policy Annotations with Large Language Models
par: Chanenson, Jake, et autres
Publié: (2023)
par: Chanenson, Jake, et autres
Publié: (2023)
pyvene: A Library for Understanding and Improving PyTorch Models via Interventions
par: Wu, Zhengxuan, et autres
Publié: (2024)
par: Wu, Zhengxuan, et autres
Publié: (2024)
Cognitive Behaviors that Enable Self-Improving Reasoners, or, Four Habits of Highly Effective STaRs
par: Gandhi, Kanishk, et autres
Publié: (2025)
par: Gandhi, Kanishk, et autres
Publié: (2025)
Stream of Search (SoS): Learning to Search in Language
par: Gandhi, Kanishk, et autres
Publié: (2024)
par: Gandhi, Kanishk, et autres
Publié: (2024)
Sample, Don't Search: Rethinking Test-Time Alignment for Language Models
par: Faria, Gonçalo, et autres
Publié: (2025)
par: Faria, Gonçalo, et autres
Publié: (2025)
BoxingGym: Benchmarking Progress in Automated Experimental Design and Model Discovery
par: Gandhi, Kanishk, et autres
Publié: (2025)
par: Gandhi, Kanishk, et autres
Publié: (2025)
Auto-Intent: Automated Intent Discovery and Self-Exploration for Large Language Model Web Agents
par: Kim, Jaekyeom, et autres
Publié: (2024)
par: Kim, Jaekyeom, et autres
Publié: (2024)
The Dual-Stream Transformer: Channelized Architecture for Interpretable Language Modeling
par: Kerce, J. Clayton, et autres
Publié: (2026)
par: Kerce, J. Clayton, et autres
Publié: (2026)
BALAR : A Bayesian Agentic Loop for Active Reasoning
par: Echarghaoui, Aymen, et autres
Publié: (2026)
par: Echarghaoui, Aymen, et autres
Publié: (2026)
Large Language Model-driven Meta-structure Discovery in Heterogeneous Information Network
par: Chen, Lin, et autres
Publié: (2024)
par: Chen, Lin, et autres
Publié: (2024)
Automated Capability Discovery via Foundation Model Self-Exploration
par: Lu, Cong, et autres
Publié: (2025)
par: Lu, Cong, et autres
Publié: (2025)
What Makes a Maze Look Like a Maze?
par: Hsu, Joy, et autres
Publié: (2024)
par: Hsu, Joy, et autres
Publié: (2024)
Advancing Event Forecasting through Massive Training of Large Language Models: Challenges, Solutions, and Broader Impacts
par: Lee, Sang-Woo, et autres
Publié: (2025)
par: Lee, Sang-Woo, et autres
Publié: (2025)
Evaluating Copyright Takedown Methods for Language Models
par: Wei, Boyi, et autres
Publié: (2024)
par: Wei, Boyi, et autres
Publié: (2024)
Merge to Learn: Efficiently Adding Skills to Language Models with Model Merging
par: Morrison, Jacob, et autres
Publié: (2024)
par: Morrison, Jacob, et autres
Publié: (2024)
Bayesian scaling laws for in-context learning
par: Arora, Aryaman, et autres
Publié: (2024)
par: Arora, Aryaman, et autres
Publié: (2024)
SuperBPE: Space Travel for Language Models
par: Liu, Alisa, et autres
Publié: (2025)
par: Liu, Alisa, et autres
Publié: (2025)
Improve Mathematical Reasoning in Language Models by Automated Process Supervision
par: Luo, Liangchen, et autres
Publié: (2024)
par: Luo, Liangchen, et autres
Publié: (2024)
Sequences of Logits Reveal the Low Rank Structure of Language Models
par: Golowich, Noah, et autres
Publié: (2025)
par: Golowich, Noah, et autres
Publié: (2025)
DiscoveryBench: Towards Data-Driven Discovery with Large Language Models
par: Majumder, Bodhisattwa Prasad, et autres
Publié: (2024)
par: Majumder, Bodhisattwa Prasad, et autres
Publié: (2024)
Automating Evaluation of Diffusion Model Unlearning with (Vision-) Language Model World Knowledge
par: Yeats, Eric, et autres
Publié: (2025)
par: Yeats, Eric, et autres
Publié: (2025)
In-Context Symbolic Regression: Leveraging Large Language Models for Function Discovery
par: Merler, Matteo, et autres
Publié: (2024)
par: Merler, Matteo, et autres
Publié: (2024)
Knowledge Boundary Discovery for Large Language Models
par: Wang, Ziquan, et autres
Publié: (2026)
par: Wang, Ziquan, et autres
Publié: (2026)
CLEVRER-Humans: Describing Physical and Causal Events the Human Way
par: Mao, Jiayuan, et autres
Publié: (2023)
par: Mao, Jiayuan, et autres
Publié: (2023)
Efficient Post-Training Pruning of Large Language Models with Statistical Correction
par: Yu, Peiqi, et autres
Publié: (2026)
par: Yu, Peiqi, et autres
Publié: (2026)
ELMES: An Automated Framework for Evaluating Large Language Models in Educational Scenarios
par: Wei, Shou'ang, et autres
Publié: (2025)
par: Wei, Shou'ang, et autres
Publié: (2025)
Sampling from Your Language Model One Byte at a Time
par: Hayase, Jonathan, et autres
Publié: (2025)
par: Hayase, Jonathan, et autres
Publié: (2025)
Skill Set Optimization: Reinforcing Language Model Behavior via Transferable Skills
par: Nottingham, Kolby, et autres
Publié: (2024)
par: Nottingham, Kolby, et autres
Publié: (2024)
Efficient Automated Circuit Discovery in Transformers using Contextual Decomposition
par: Hsu, Aliyah R., et autres
Publié: (2024)
par: Hsu, Aliyah R., et autres
Publié: (2024)
Towards Statistical Factuality Guarantee for Large Vision-Language Models
par: Li, Zhuohang, et autres
Publié: (2025)
par: Li, Zhuohang, et autres
Publié: (2025)
'Simulacrum of Stories': Examining Large Language Models as Qualitative Research Participants
par: Kapania, Shivani, et autres
Publié: (2024)
par: Kapania, Shivani, et autres
Publié: (2024)
Hallucination Detection and Mitigation with Diffusion in Multi-Variate Time-Series Foundation Models
par: Wichitwechkarn, Vijja, et autres
Publié: (2025)
par: Wichitwechkarn, Vijja, et autres
Publié: (2025)
Documents similaires
-
CriticAL: Critic Automation with Language Models
par: Li, Michael Y., et autres
Publié: (2024) -
Is Child-Directed Speech Effective Training Data for Language Models?
par: Feng, Steven Y., et autres
Publié: (2024) -
Large Language Model Reasoning Failures
par: Song, Peiyang, et autres
Publié: (2026) -
Hypothesis Search: Inductive Reasoning with Language Models
par: Wang, Ruocheng, et autres
Publié: (2023) -
Quiet-STaR: Language Models Can Teach Themselves to Think Before Speaking
par: Zelikman, Eric, et autres
Publié: (2024)