Leviathan: Decoupling Input and Output Representations in Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Batley, Reza T., Saha, Sourav |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
KHRONOS: a Kernel-Based Neural Architecture for Rapid, Resource-Efficient Scientific Computation
di: Batley, Reza T., et al.
Pubblicazione: (2025)
di: Batley, Reza T., et al.
Pubblicazione: (2025)
Agile Reinforcement Learning through Separable Neural Architecture
di: Mostakim, Rajib, et al.
Pubblicazione: (2026)
di: Mostakim, Rajib, et al.
Pubblicazione: (2026)
Explainable Hierarchical Deep Learning Neural Networks (Ex-HiDeNN)
di: Batley, Reza T., et al.
Pubblicazione: (2025)
di: Batley, Reza T., et al.
Pubblicazione: (2025)
Separable neural architectures as a primitive for unified predictive and generative intelligence
di: Batley, Reza T., et al.
Pubblicazione: (2026)
di: Batley, Reza T., et al.
Pubblicazione: (2026)
SLOT: Structuring the Output of Large Language Models
di: Wang, Darren Yow-Bang, et al.
Pubblicazione: (2025)
di: Wang, Darren Yow-Bang, et al.
Pubblicazione: (2025)
An Evaluation on Large Language Model Outputs: Discourse and Memorization
di: de Wynter, Adrian, et al.
Pubblicazione: (2023)
di: de Wynter, Adrian, et al.
Pubblicazione: (2023)
Single-pass Detection of Jailbreaking Input in Large Language Models
di: Candogan, Leyla Naz, et al.
Pubblicazione: (2025)
di: Candogan, Leyla Naz, et al.
Pubblicazione: (2025)
Reducing the Probability of Undesirable Outputs in Language Models Using Probabilistic Inference
di: Zhao, Stephen, et al.
Pubblicazione: (2025)
di: Zhao, Stephen, et al.
Pubblicazione: (2025)
Graph-based Uncertainty Metrics for Long-form Language Model Outputs
di: Jiang, Mingjian, et al.
Pubblicazione: (2024)
di: Jiang, Mingjian, et al.
Pubblicazione: (2024)
Group-Aware Reinforcement Learning for Output Diversity in Large Language Models
di: Anschel, Oron, et al.
Pubblicazione: (2025)
di: Anschel, Oron, et al.
Pubblicazione: (2025)
Model-diff: A Tool for Comparative Study of Language Models in the Input Space
di: Liu, Weitang, et al.
Pubblicazione: (2024)
di: Liu, Weitang, et al.
Pubblicazione: (2024)
Proxy-RLHF: Decoupling Generation and Alignment in Large Language Model with Proxy
di: Zhu, Yu, et al.
Pubblicazione: (2024)
di: Zhu, Yu, et al.
Pubblicazione: (2024)
Baby Scale: Investigating Models Trained on Individual Children's Language Input
di: Feng, Steven Y., et al.
Pubblicazione: (2026)
di: Feng, Steven Y., et al.
Pubblicazione: (2026)
When Correct Isn't Usable: Improving Structured Output Reliability in Small Language Models
di: Galeone, Cosimo, et al.
Pubblicazione: (2026)
di: Galeone, Cosimo, et al.
Pubblicazione: (2026)
Talking Nonsense: Probing Large Language Models' Understanding of Adversarial Gibberish Inputs
di: Cherepanova, Valeriia, et al.
Pubblicazione: (2024)
di: Cherepanova, Valeriia, et al.
Pubblicazione: (2024)
Large Language Models are Skeptics: False Negative Problem of Input-conflicting Hallucination
di: Song, Jongyoon, et al.
Pubblicazione: (2024)
di: Song, Jongyoon, et al.
Pubblicazione: (2024)
Fact-Checking the Output of Large Language Models via Token-Level Uncertainty Quantification
di: Fadeeva, Ekaterina, et al.
Pubblicazione: (2024)
di: Fadeeva, Ekaterina, et al.
Pubblicazione: (2024)
Memory-Efficient Looped Transformer: Decoupling Compute from Memory in Looped Language Models
di: Vendrell, Victor Conchello, et al.
Pubblicazione: (2026)
di: Vendrell, Victor Conchello, et al.
Pubblicazione: (2026)
Fine-Grained Uncertainty Quantification for Long-Form Language Model Outputs: A Comparative Study
di: Bouchard, Dylan, et al.
Pubblicazione: (2026)
di: Bouchard, Dylan, et al.
Pubblicazione: (2026)
A Voter-Based Stochastic Rejection-Method Framework for Asymptotically Safe Language Model Outputs
di: Watts, Jake R., et al.
Pubblicazione: (2024)
di: Watts, Jake R., et al.
Pubblicazione: (2024)
A Unified Generative-Predictive Framework for Deterministic Inverse Design
di: Batley, Reza T., et al.
Pubblicazione: (2025)
di: Batley, Reza T., et al.
Pubblicazione: (2025)
The Method of Infinite Descent
di: Batley, Reza T., et al.
Pubblicazione: (2025)
di: Batley, Reza T., et al.
Pubblicazione: (2025)
ReFT: Representation Finetuning for Language Models
di: Wu, Zhengxuan, et al.
Pubblicazione: (2024)
di: Wu, Zhengxuan, et al.
Pubblicazione: (2024)
Phase Transitions in the Output Distribution of Large Language Models
di: Arnold, Julian, et al.
Pubblicazione: (2024)
di: Arnold, Julian, et al.
Pubblicazione: (2024)
AXOLOTL: Fairness through Assisted Self-Debiasing of Large Language Model Outputs
di: Ebrahimi, Sana, et al.
Pubblicazione: (2024)
di: Ebrahimi, Sana, et al.
Pubblicazione: (2024)
Clustering-driven Memory Compression for On-device Large Language Models
di: Bohdal, Ondrej, et al.
Pubblicazione: (2026)
di: Bohdal, Ondrej, et al.
Pubblicazione: (2026)
Can Safety Emerge from Weak Supervision? A Systematic Analysis of Small Language Models
di: Saha, Punyajoy, et al.
Pubblicazione: (2026)
di: Saha, Punyajoy, et al.
Pubblicazione: (2026)
Value-Aware Numerical Representations for Transformer Language Models
di: Dutulescu, Andreea, et al.
Pubblicazione: (2026)
di: Dutulescu, Andreea, et al.
Pubblicazione: (2026)
Layer by Layer: Uncovering Hidden Representations in Language Models
di: Skean, Oscar, et al.
Pubblicazione: (2025)
di: Skean, Oscar, et al.
Pubblicazione: (2025)
The Linear Representation Hypothesis and the Geometry of Large Language Models
di: Park, Kiho, et al.
Pubblicazione: (2023)
di: Park, Kiho, et al.
Pubblicazione: (2023)
The Confidence Manifold: Geometric Structure of Correctness Representations in Language Models
di: Cho, Seonglae, et al.
Pubblicazione: (2026)
di: Cho, Seonglae, et al.
Pubblicazione: (2026)
Representational Curvature Modulates Behavioral Uncertainty in Large Language Models
di: King, Jack, et al.
Pubblicazione: (2026)
di: King, Jack, et al.
Pubblicazione: (2026)
Improving Large Language Model Safety with Contrastive Representation Learning
di: Simko, Samuel, et al.
Pubblicazione: (2025)
di: Simko, Samuel, et al.
Pubblicazione: (2025)
Can Large Language Models Understand Intermediate Representations in Compilers?
di: Jiang, Hailong, et al.
Pubblicazione: (2025)
di: Jiang, Hailong, et al.
Pubblicazione: (2025)
Analyzing the Role of Semantic Representations in the Era of Large Language Models
di: Jin, Zhijing, et al.
Pubblicazione: (2024)
di: Jin, Zhijing, et al.
Pubblicazione: (2024)
Superscopes: Amplifying Internal Feature Representations for Language Model Interpretation
di: Jacobi, Jonathan, et al.
Pubblicazione: (2025)
di: Jacobi, Jonathan, et al.
Pubblicazione: (2025)
Factual Self-Awareness in Language Models: Representation, Robustness, and Scaling
di: Tamoyan, Hovhannes, et al.
Pubblicazione: (2025)
di: Tamoyan, Hovhannes, et al.
Pubblicazione: (2025)
EmbedLLM: Learning Compact Representations of Large Language Models
di: Zhuang, Richard, et al.
Pubblicazione: (2024)
di: Zhuang, Richard, et al.
Pubblicazione: (2024)
Branch-Solve-Merge Improves Large Language Model Evaluation and Generation
di: Saha, Swarnadeep, et al.
Pubblicazione: (2023)
di: Saha, Swarnadeep, et al.
Pubblicazione: (2023)
SafetyNet: Detecting Harmful Outputs in LLMs by Modeling and Monitoring Deceptive Behaviors
di: Chaudhary, Maheep, et al.
Pubblicazione: (2025)
di: Chaudhary, Maheep, et al.
Pubblicazione: (2025)
Documenti analoghi
-
KHRONOS: a Kernel-Based Neural Architecture for Rapid, Resource-Efficient Scientific Computation
di: Batley, Reza T., et al.
Pubblicazione: (2025) -
Agile Reinforcement Learning through Separable Neural Architecture
di: Mostakim, Rajib, et al.
Pubblicazione: (2026) -
Explainable Hierarchical Deep Learning Neural Networks (Ex-HiDeNN)
di: Batley, Reza T., et al.
Pubblicazione: (2025) -
Separable neural architectures as a primitive for unified predictive and generative intelligence
di: Batley, Reza T., et al.
Pubblicazione: (2026) -
SLOT: Structuring the Output of Large Language Models
di: Wang, Darren Yow-Bang, et al.
Pubblicazione: (2025)