Markovian Transformers for Informative Language Modeling
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Viteri, Scott, Lamparth, Max, Chatain, Peter, Barrett, Clark |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Analyzing And Editing Inner Mechanisms Of Backdoored Language Models
von: Lamparth, Max, et al.
Veröffentlicht: (2023)
von: Lamparth, Max, et al.
Veröffentlicht: (2023)
Risks from Language Models for Automated Mental Healthcare: Ethics and Structure for Implementation
von: Grabb, Declan, et al.
Veröffentlicht: (2024)
von: Grabb, Declan, et al.
Veröffentlicht: (2024)
Measuring Free-Form Decision-Making Inconsistency of Language Models in Military Crisis Simulations
von: Shrivastava, Aryan, et al.
Veröffentlicht: (2024)
von: Shrivastava, Aryan, et al.
Veröffentlicht: (2024)
Uncovering Latent Chain of Thought Vectors in Language Models
von: Zhang, Jason, et al.
Veröffentlicht: (2024)
von: Zhang, Jason, et al.
Veröffentlicht: (2024)
One Bias After Another: Mechanistic Reward Shaping and Persistent Biases in Language Reward Models
von: Fein, Daniel, et al.
Veröffentlicht: (2026)
von: Fein, Daniel, et al.
Veröffentlicht: (2026)
Human vs. Machine: Behavioral Differences Between Expert Humans and Language Models in Wargame Simulations
von: Lamparth, Max, et al.
Veröffentlicht: (2024)
von: Lamparth, Max, et al.
Veröffentlicht: (2024)
Escalation Risks from Language Models in Military and Diplomatic Decision-Making
von: Rivera, Juan-Pablo, et al.
Veröffentlicht: (2024)
von: Rivera, Juan-Pablo, et al.
Veröffentlicht: (2024)
Lemur: Integrating Large Language Models in Automated Program Verification
von: Wu, Haoze, et al.
Veröffentlicht: (2023)
von: Wu, Haoze, et al.
Veröffentlicht: (2023)
Language Modeling by Language Models
von: Cheng, Junyan, et al.
Veröffentlicht: (2025)
von: Cheng, Junyan, et al.
Veröffentlicht: (2025)
The termination of Nielsen transformations applied to word equations with length constraints
von: Przybocki, Benjamin, et al.
Veröffentlicht: (2025)
von: Przybocki, Benjamin, et al.
Veröffentlicht: (2025)
Moving Beyond Medical Exams: A Clinician-Annotated Fairness Dataset of Real-World Tasks and Ambiguity in Mental Healthcare
von: Lamparth, Max, et al.
Veröffentlicht: (2025)
von: Lamparth, Max, et al.
Veröffentlicht: (2025)
Faithful Autoformalization via Roundtrip Verification and Repair
von: Amrollahi, Daneshvar, et al.
Veröffentlicht: (2026)
von: Amrollahi, Daneshvar, et al.
Veröffentlicht: (2026)
TransformerRanker: A Tool for Efficiently Finding the Best-Suited Language Models for Downstream Classification Tasks
von: Garbas, Lukas, et al.
Veröffentlicht: (2024)
von: Garbas, Lukas, et al.
Veröffentlicht: (2024)
Markovian Generation Chains in Large Language Models
von: Geng, Mingmeng, et al.
Veröffentlicht: (2026)
von: Geng, Mingmeng, et al.
Veröffentlicht: (2026)
Word Meanings in Transformer Language Models
von: Grindrod, Jumbly, et al.
Veröffentlicht: (2025)
von: Grindrod, Jumbly, et al.
Veröffentlicht: (2025)
Non-Markovian Discrete Diffusion with Causal Language Models
von: Zhang, Yangtian, et al.
Veröffentlicht: (2025)
von: Zhang, Yangtian, et al.
Veröffentlicht: (2025)
Automatic Pruning of Fine-tuning Datasets for Transformer-based Language Models
von: Tayaranian, Mohammadreza, et al.
Veröffentlicht: (2024)
von: Tayaranian, Mohammadreza, et al.
Veröffentlicht: (2024)
Analysing Differences in Persuasive Language in LLM-Generated Text: Uncovering Stereotypical Gender Patterns
von: Pauli, Amalie Brogaard, et al.
Veröffentlicht: (2026)
von: Pauli, Amalie Brogaard, et al.
Veröffentlicht: (2026)
Taking Complete Finite Prefixes To High Level, Symbolically
von: Würdemann, Nick, et al.
Veröffentlicht: (2023)
von: Würdemann, Nick, et al.
Veröffentlicht: (2023)
Searching for Structure: Investigating Emergent Communication with Large Language Models
von: Kouwenhoven, Tom, et al.
Veröffentlicht: (2024)
von: Kouwenhoven, Tom, et al.
Veröffentlicht: (2024)
Can Language Models Serve as Text-Based World Simulators?
von: Wang, Ruoyao, et al.
Veröffentlicht: (2024)
von: Wang, Ruoyao, et al.
Veröffentlicht: (2024)
Automated Generation of High-Quality Medical Simulation Scenarios Through Integration of Semi-Structured Data and Large Language Models
von: Sumpter, Scott
Veröffentlicht: (2024)
von: Sumpter, Scott
Veröffentlicht: (2024)
Traces of Social Competence in Large Language Models
von: Kouwenhoven, Tom, et al.
Veröffentlicht: (2026)
von: Kouwenhoven, Tom, et al.
Veröffentlicht: (2026)
ARWKV: Pretrain is not what we need, an RNN-Attention-Based Language Model Born from Transformer
von: Yueyu, Lin, et al.
Veröffentlicht: (2025)
von: Yueyu, Lin, et al.
Veröffentlicht: (2025)
Shaping Shared Languages: Human and Large Language Models' Inductive Biases in Emergent Communication
von: Kouwenhoven, Tom, et al.
Veröffentlicht: (2025)
von: Kouwenhoven, Tom, et al.
Veröffentlicht: (2025)
TyDi QA-WANA: A Benchmark for Information-Seeking Question Answering in Languages of West Asia and North Africa
von: Riley, Parker, et al.
Veröffentlicht: (2025)
von: Riley, Parker, et al.
Veröffentlicht: (2025)
BEAR: A Unified Framework for Evaluating Relational Knowledge in Causal and Masked Language Models
von: Wiland, Jacek, et al.
Veröffentlicht: (2024)
von: Wiland, Jacek, et al.
Veröffentlicht: (2024)
Semformer: Transformer Language Models with Semantic Planning
von: Yin, Yongjing, et al.
Veröffentlicht: (2024)
von: Yin, Yongjing, et al.
Veröffentlicht: (2024)
Linearity of Relation Decoding in Transformer Language Models
von: Hernandez, Evan, et al.
Veröffentlicht: (2023)
von: Hernandez, Evan, et al.
Veröffentlicht: (2023)
Weak Supervision Dynamic KL-Weighted Diffusion Models Guided by Large Language Models
von: Perry, Julian, et al.
Veröffentlicht: (2025)
von: Perry, Julian, et al.
Veröffentlicht: (2025)
Vocabulary Expansion of Large Language Models via Kullback-Leibler-Based Self-Distillation
von: Linder, Max Rehman
Veröffentlicht: (2025)
von: Linder, Max Rehman
Veröffentlicht: (2025)
Linear Recency Bias During Training Improves Transformers' Fit to Reading Times
von: Clark, Christian, et al.
Veröffentlicht: (2024)
von: Clark, Christian, et al.
Veröffentlicht: (2024)
Will Large Language Models Transform Clinical Prediction?
von: Yildiz, Yusuf, et al.
Veröffentlicht: (2025)
von: Yildiz, Yusuf, et al.
Veröffentlicht: (2025)
Exploratory Semantic Reliability Analysis of Wind Turbine Maintenance Logs using Large Language Models
von: Malyi, Max, et al.
Veröffentlicht: (2025)
von: Malyi, Max, et al.
Veröffentlicht: (2025)
Tree-Planted Transformers: Unidirectional Transformer Language Models with Implicit Syntactic Supervision
von: Yoshida, Ryo, et al.
Veröffentlicht: (2024)
von: Yoshida, Ryo, et al.
Veröffentlicht: (2024)
LinkTransformer: A Unified Package for Record Linkage with Transformer Language Models
von: Arora, Abhishek, et al.
Veröffentlicht: (2023)
von: Arora, Abhishek, et al.
Veröffentlicht: (2023)
Fishing for Magikarp: Automatically Detecting Under-trained Tokens in Large Language Models
von: Land, Sander, et al.
Veröffentlicht: (2024)
von: Land, Sander, et al.
Veröffentlicht: (2024)
Probing the Category of Verbal Aspect in Transformer Language Models
von: Katinskaia, Anisia, et al.
Veröffentlicht: (2024)
von: Katinskaia, Anisia, et al.
Veröffentlicht: (2024)
Sneaking Syntax into Transformer Language Models with Tree Regularization
von: Nandi, Ananjan, et al.
Veröffentlicht: (2024)
von: Nandi, Ananjan, et al.
Veröffentlicht: (2024)
Can Transformers Learn $n$-gram Language Models?
von: Svete, Anej, et al.
Veröffentlicht: (2024)
von: Svete, Anej, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
Analyzing And Editing Inner Mechanisms Of Backdoored Language Models
von: Lamparth, Max, et al.
Veröffentlicht: (2023) -
Risks from Language Models for Automated Mental Healthcare: Ethics and Structure for Implementation
von: Grabb, Declan, et al.
Veröffentlicht: (2024) -
Measuring Free-Form Decision-Making Inconsistency of Language Models in Military Crisis Simulations
von: Shrivastava, Aryan, et al.
Veröffentlicht: (2024) -
Uncovering Latent Chain of Thought Vectors in Language Models
von: Zhang, Jason, et al.
Veröffentlicht: (2024) -
One Bias After Another: Mechanistic Reward Shaping and Persistent Biases in Language Reward Models
von: Fein, Daniel, et al.
Veröffentlicht: (2026)