Enregistré dans:
| Auteurs principaux: | Stranges, Nicholas, Yang, Yimin |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2603.04429 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
The Outputs of Large Language Models are Meaningless
par: Hattiangadi, Anandi, et autres
Publié: (2025)
par: Hattiangadi, Anandi, et autres
Publié: (2025)
Anthropomimetic Uncertainty: What Verbalized Uncertainty in Language Models is Missing
par: Ulmer, Dennis, et autres
Publié: (2025)
par: Ulmer, Dennis, et autres
Publié: (2025)
Missed Connections: Lateral Thinking Puzzles for Large Language Models
par: Todd, Graham, et autres
Publié: (2024)
par: Todd, Graham, et autres
Publié: (2024)
Output Scouting: Auditing Large Language Models for Catastrophic Responses
par: Bell, Andrew, et autres
Publié: (2024)
par: Bell, Andrew, et autres
Publié: (2024)
SLOT: Structuring the Output of Large Language Models
par: Wang, Darren Yow-Bang, et autres
Publié: (2025)
par: Wang, Darren Yow-Bang, et autres
Publié: (2025)
Large Visual-Language Models Are Also Good Classifiers: A Study of In-Context Multimodal Fake News Detection
par: Jiang, Ye, et autres
Publié: (2024)
par: Jiang, Ye, et autres
Publié: (2024)
What Single-Prompt Accuracy Misses: A Multi-Variant Reliability Audit of Language Models
par: Karmakar, Ranit, et autres
Publié: (2026)
par: Karmakar, Ranit, et autres
Publié: (2026)
The Structured Output Benchmark: A Multi-Source Benchmark for Evaluating Structured Output Quality in Large Language Models
par: Singh, Abhinav Kumar, et autres
Publié: (2026)
par: Singh, Abhinav Kumar, et autres
Publié: (2026)
Instruction Tuning Vs. In-Context Learning: Revisiting Large Language Models in Few-Shot Computational Social Science
par: Wang, Taihang, et autres
Publié: (2024)
par: Wang, Taihang, et autres
Publié: (2024)
UloRL:An Ultra-Long Output Reinforcement Learning Approach for Advancing Large Language Models' Reasoning Abilities
par: Du, Dong, et autres
Publié: (2025)
par: Du, Dong, et autres
Publié: (2025)
Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model
par: Tian, Yuanhe, et autres
Publié: (2025)
par: Tian, Yuanhe, et autres
Publié: (2025)
An Evaluation on Large Language Model Outputs: Discourse and Memorization
par: de Wynter, Adrian, et autres
Publié: (2023)
par: de Wynter, Adrian, et autres
Publié: (2023)
Can AI Master Construction Management (CM)? Benchmarking State-of-the-Art Large Language Models on CM Certification Exams
par: Xiong, Ruoxin, et autres
Publié: (2025)
par: Xiong, Ruoxin, et autres
Publié: (2025)
Mechanistic Interpretability of Emotion Inference in Large Language Models
par: Tak, Ala N., et autres
Publié: (2025)
par: Tak, Ala N., et autres
Publié: (2025)
Using Large Language Models for the Interpretation of Building Regulations
par: Fuchs, Stefan, et autres
Publié: (2024)
par: Fuchs, Stefan, et autres
Publié: (2024)
What is the best model? Application-driven Evaluation for Large Language Models
par: Lian, Shiguo, et autres
Publié: (2024)
par: Lian, Shiguo, et autres
Publié: (2024)
Binary Autoencoder for Mechanistic Interpretability of Large Language Models
par: Cho, Hakaze, et autres
Publié: (2025)
par: Cho, Hakaze, et autres
Publié: (2025)
Brain in a Vat: On Missing Pieces Towards Artificial General Intelligence in Large Language Models
par: Ma, Yuxi, et autres
Publié: (2023)
par: Ma, Yuxi, et autres
Publié: (2023)
Do Large Language Models Know What They Are Capable Of?
par: Barkan, Casey O., et autres
Publié: (2025)
par: Barkan, Casey O., et autres
Publié: (2025)
Convergence of Outputs When Two Large Language Models Interact in a Multi-Agentic Setup
par: Maiti, Aniruddha, et autres
Publié: (2025)
par: Maiti, Aniruddha, et autres
Publié: (2025)
Mind the Gap: Conformative Decoding to Improve Output Diversity of Instruction-Tuned Large Language Models
par: Peeperkorn, Max, et autres
Publié: (2025)
par: Peeperkorn, Max, et autres
Publié: (2025)
StruEdit: Structured Outputs Enable the Fast and Accurate Knowledge Editing for Large Language Models
par: Bi, Baolong, et autres
Publié: (2024)
par: Bi, Baolong, et autres
Publié: (2024)
Comparing Human and Large Language Model Interpretation of Implicit Information
par: De Santis, Antonio, et autres
Publié: (2026)
par: De Santis, Antonio, et autres
Publié: (2026)
Reasoning on Graphs: Faithful and Interpretable Large Language Model Reasoning
par: Luo, Linhao, et autres
Publié: (2023)
par: Luo, Linhao, et autres
Publié: (2023)
Interpretable Differential Diagnosis with Dual-Inference Large Language Models
par: Zhou, Shuang, et autres
Publié: (2024)
par: Zhou, Shuang, et autres
Publié: (2024)
Group-Aware Reinforcement Learning for Output Diversity in Large Language Models
par: Anschel, Oron, et autres
Publié: (2025)
par: Anschel, Oron, et autres
Publié: (2025)
Fine-Grained Interpretation of Political Opinions in Large Language Models
par: Hu, Jingyu, et autres
Publié: (2025)
par: Hu, Jingyu, et autres
Publié: (2025)
CrashSage: A Large Language Model-Centered Framework for Contextual and Interpretable Traffic Crash Analysis
par: Zhen, Hao, et autres
Publié: (2025)
par: Zhen, Hao, et autres
Publié: (2025)
DynamicRAG: Leveraging Outputs of Large Language Model as Feedback for Dynamic Reranking in Retrieval-Augmented Generation
par: Sun, Jiashuo, et autres
Publié: (2025)
par: Sun, Jiashuo, et autres
Publié: (2025)
Safe Inputs but Unsafe Output: Benchmarking Cross-modality Safety Alignment of Large Vision-Language Model
par: Wang, Siyin, et autres
Publié: (2024)
par: Wang, Siyin, et autres
Publié: (2024)
Phase Transitions in the Output Distribution of Large Language Models
par: Arnold, Julian, et autres
Publié: (2024)
par: Arnold, Julian, et autres
Publié: (2024)
Team QUST at SemEval-2025 Task 10: Evaluating Large Language Models in Multiclass Multi-label Classification of News Entity Framing
par: Liu, Jiyan, et autres
Publié: (2025)
par: Liu, Jiyan, et autres
Publié: (2025)
LLMD: A Large Language Model for Interpreting Longitudinal Medical Records
par: Porter, Robert, et autres
Publié: (2024)
par: Porter, Robert, et autres
Publié: (2024)
Rethinking Interpretability in the Era of Large Language Models
par: Singh, Chandan, et autres
Publié: (2024)
par: Singh, Chandan, et autres
Publié: (2024)
Large Language Model in Financial Regulatory Interpretation
par: Cao, Zhiyu, et autres
Publié: (2024)
par: Cao, Zhiyu, et autres
Publié: (2024)
"Sorry, I Didn't Catch That": How Speech Models Miss What Matters Most
par: Zhou, Kaitlyn, et autres
Publié: (2026)
par: Zhou, Kaitlyn, et autres
Publié: (2026)
AdapTime: Enabling Adaptive Temporal Reasoning in Large Language Models
par: Deng, Yimin, et autres
Publié: (2026)
par: Deng, Yimin, et autres
Publié: (2026)
Round-Trip Translation Reveals What Frontier Multilingual Benchmarks Miss
par: Skorobogat, Ronald, et autres
Publié: (2026)
par: Skorobogat, Ronald, et autres
Publié: (2026)
Regulating Large Language Models: A Roundtable Report
par: Nicholas, Gabriel, et autres
Publié: (2024)
par: Nicholas, Gabriel, et autres
Publié: (2024)
What are Models Thinking about? Understanding Large Language Model Hallucinations "Psychology" through Model Inner State Analysis
par: Wang, Peiran, et autres
Publié: (2025)
par: Wang, Peiran, et autres
Publié: (2025)
Documents similaires
-
The Outputs of Large Language Models are Meaningless
par: Hattiangadi, Anandi, et autres
Publié: (2025) -
Anthropomimetic Uncertainty: What Verbalized Uncertainty in Language Models is Missing
par: Ulmer, Dennis, et autres
Publié: (2025) -
Missed Connections: Lateral Thinking Puzzles for Large Language Models
par: Todd, Graham, et autres
Publié: (2024) -
Output Scouting: Auditing Large Language Models for Catastrophic Responses
par: Bell, Andrew, et autres
Publié: (2024) -
SLOT: Structuring the Output of Large Language Models
par: Wang, Darren Yow-Bang, et autres
Publié: (2025)