Reverse-Engineering the Reader
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Kiegeland, Samuel, Wilcox, Ethan Gotlieb, Amini, Afra, Reich, David Robert, Cotterell, Ryan |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Direct Preference Optimization with an Offset
par: Amini, Afra, et autres
Publié: (2024)
par: Amini, Afra, et autres
Publié: (2024)
Better Estimation of the Kullback--Leibler Divergence Between Language Models
par: Amini, Afra, et autres
Publié: (2025)
par: Amini, Afra, et autres
Publié: (2025)
Variational Best-of-N Alignment
par: Amini, Afra, et autres
Publié: (2024)
par: Amini, Afra, et autres
Publié: (2024)
Syntactic Control of Language Models by Posterior Inference
par: Xefteri, Vicky, et autres
Publié: (2025)
par: Xefteri, Vicky, et autres
Publié: (2025)
On the Role of Context in Reading Time Prediction
par: Opedal, Andreas, et autres
Publié: (2024)
par: Opedal, Andreas, et autres
Publié: (2024)
Structured Voronoi Sampling
par: Amini, Afra, et autres
Publié: (2023)
par: Amini, Afra, et autres
Publié: (2023)
Ensembling Language Models with Sequential Monte Carlo
par: Chan, Robin Shing Moon, et autres
Publié: (2026)
par: Chan, Robin Shing Moon, et autres
Publié: (2026)
Function Words as Statistical Cues for Language Learning
par: Yang, Xiulin, et autres
Publié: (2026)
par: Yang, Xiulin, et autres
Publié: (2026)
Transformers Can Represent $n$-gram Language Models
par: Svete, Anej, et autres
Publié: (2024)
par: Svete, Anej, et autres
Publié: (2024)
Gumbel Counterfactual Generation From Language Models
par: Ravfogel, Shauli, et autres
Publié: (2024)
par: Ravfogel, Shauli, et autres
Publié: (2024)
A Unified Assessment of the Poverty of the Stimulus Argument for Neural Language Models
par: Yang, Xiulin, et autres
Publié: (2026)
par: Yang, Xiulin, et autres
Publié: (2026)
Pointwise Mutual Information as a Performance Gauge for Retrieval-Augmented Generation
par: Liu, Tianyu, et autres
Publié: (2024)
par: Liu, Tianyu, et autres
Publié: (2024)
Learning to Reason Efficiently with A* Post-Training
par: Opedal, Andreas, et autres
Publié: (2026)
par: Opedal, Andreas, et autres
Publié: (2026)
The Foundations of Tokenization: Statistical and Computational Concerns
par: Gastaldi, Juan Luis, et autres
Publié: (2024)
par: Gastaldi, Juan Luis, et autres
Publié: (2024)
Revisiting Padded Transformer Expressivity: Which Architectural Choices Matter and Which Don't
par: Svete, Anej, et autres
Publié: (2026)
par: Svete, Anej, et autres
Publié: (2026)
Is Active Persona Inference Necessary for Aligning Small Models to Personal Preferences?
par: Tang, Zilu, et autres
Publié: (2025)
par: Tang, Zilu, et autres
Publié: (2025)
RE-Adapt: Reverse Engineered Adaptation of Large Language Models
par: Fleshman, William, et autres
Publié: (2024)
par: Fleshman, William, et autres
Publié: (2024)
What Can String Probability Tell Us About Grammaticality?
par: Hu, Jennifer, et autres
Publié: (2025)
par: Hu, Jennifer, et autres
Publié: (2025)
Principled Gradient-based Markov Chain Monte Carlo for Text Generation
par: Du, Li, et autres
Publié: (2023)
par: Du, Li, et autres
Publié: (2023)
Do Language Models Exhibit the Same Cognitive Biases in Problem Solving as Human Learners?
par: Opedal, Andreas, et autres
Publié: (2024)
par: Opedal, Andreas, et autres
Publié: (2024)
Online Rubrics Elicitation from Pairwise Comparisons
par: Rezaei, MohammadHossein, et autres
Publié: (2025)
par: Rezaei, MohammadHossein, et autres
Publié: (2025)
Are Large Language Models Reliable AI Scientists? Assessing Reverse-Engineering of Black-Box Systems
par: Geng, Jiayi, et autres
Publié: (2025)
par: Geng, Jiayi, et autres
Publié: (2025)
Assessing Large Language Models on Climate Information
par: Bulian, Jannis, et autres
Publié: (2023)
par: Bulian, Jannis, et autres
Publié: (2023)
Introducing HALC: A general pipeline for finding optimal prompting strategies for automated coding with LLMs in the computational social sciences
par: Reich, Andreas, et autres
Publié: (2025)
par: Reich, Andreas, et autres
Publié: (2025)
Benchmarking the Capabilities of Large Language Models in Transportation System Engineering: Accuracy, Consistency, and Reasoning Behaviors
par: Syed, Usman, et autres
Publié: (2024)
par: Syed, Usman, et autres
Publié: (2024)
Language Models can Self-Improve at State-Value Estimation for Better Search
par: Mendes, Ethan, et autres
Publié: (2025)
par: Mendes, Ethan, et autres
Publié: (2025)
On the Proper Treatment of Units in Surprisal Theory
par: Kiegeland, Samuel, et autres
Publié: (2026)
par: Kiegeland, Samuel, et autres
Publié: (2026)
The Harmonic Structure of Information Contours
par: Tsipidi, Eleftheria, et autres
Publié: (2025)
par: Tsipidi, Eleftheria, et autres
Publié: (2025)
An Analysis and Mitigation of the Reversal Curse
par: Lv, Ang, et autres
Publié: (2023)
par: Lv, Ang, et autres
Publié: (2023)
Depth Registers Unlock W4A4 on SwiGLU: A Reader/Generator Decomposition
par: Liu, Ziyang
Publié: (2026)
par: Liu, Ziyang
Publié: (2026)
Are Language Models Efficient Reasoners? A Perspective from Logic Programming
par: Opedal, Andreas, et autres
Publié: (2025)
par: Opedal, Andreas, et autres
Publié: (2025)
Fast Controlled Generation from Language Models with Adaptive Weighted Rejection Sampling
par: Lipkin, Benjamin, et autres
Publié: (2025)
par: Lipkin, Benjamin, et autres
Publié: (2025)
Testing the Predictions of Surprisal Theory in 11 Languages
par: Wilcox, Ethan Gotlieb, et autres
Publié: (2023)
par: Wilcox, Ethan Gotlieb, et autres
Publié: (2023)
Toeplitz MLP Mixers are Low Complexity, Information-Rich Sequence Models
par: Badger, Benjamin L., et autres
Publié: (2026)
par: Badger, Benjamin L., et autres
Publié: (2026)
RE-AdaptIR: Improving Information Retrieval through Reverse Engineered Adaptation
par: Fleshman, William, et autres
Publié: (2024)
par: Fleshman, William, et autres
Publié: (2024)
MixCE: Training Autoregressive Language Models by Mixing Forward and Reverse Cross-Entropies
par: Zhang, Shiyue, et autres
Publié: (2023)
par: Zhang, Shiyue, et autres
Publié: (2023)
Reverse Thinking Makes LLMs Stronger Reasoners
par: Chen, Justin Chih-Yao, et autres
Publié: (2024)
par: Chen, Justin Chih-Yao, et autres
Publié: (2024)
Debate Helps Weak Judges Reward Stronger Models
par: Elasky, Ethan, et autres
Publié: (2026)
par: Elasky, Ethan, et autres
Publié: (2026)
LongForm: Effective Instruction Tuning with Reverse Instructions
par: Köksal, Abdullatif, et autres
Publié: (2023)
par: Köksal, Abdullatif, et autres
Publié: (2023)
Towards Explainability in Legal Outcome Prediction Models
par: Valvoda, Josef, et autres
Publié: (2024)
par: Valvoda, Josef, et autres
Publié: (2024)
Documents similaires
-
Direct Preference Optimization with an Offset
par: Amini, Afra, et autres
Publié: (2024) -
Better Estimation of the Kullback--Leibler Divergence Between Language Models
par: Amini, Afra, et autres
Publié: (2025) -
Variational Best-of-N Alignment
par: Amini, Afra, et autres
Publié: (2024) -
Syntactic Control of Language Models by Posterior Inference
par: Xefteri, Vicky, et autres
Publié: (2025) -
On the Role of Context in Reading Time Prediction
par: Opedal, Andreas, et autres
Publié: (2024)