The Model Agreed, But Didn't Learn: Diagnosing Surface Compliance in Large Language Models
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Gu, Xiaojie, Huang, Ziying, Hong, Weicong, Xie, Jian, Lou, Renze, Zhang, Kai |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Too Long, Didn't Model: Decomposing LLM Long-Context Understanding With Novels
von: Hamilton, Sil, et al.
Veröffentlicht: (2025)
von: Hamilton, Sil, et al.
Veröffentlicht: (2025)
UltraEdit: Training-, Subject-, and Memory-Free Lifelong Editing in Language Models
von: Gu, Xiaojie, et al.
Veröffentlicht: (2025)
von: Gu, Xiaojie, et al.
Veröffentlicht: (2025)
Adaptive Chameleon or Stubborn Sloth: Revealing the Behavior of Large Language Models in Knowledge Conflicts
von: Xie, Jian, et al.
Veröffentlicht: (2023)
von: Xie, Jian, et al.
Veröffentlicht: (2023)
"Sorry, I Didn't Catch That": How Speech Models Miss What Matters Most
von: Zhou, Kaitlyn, et al.
Veröffentlicht: (2026)
von: Zhou, Kaitlyn, et al.
Veröffentlicht: (2026)
The Effect of Sampling Temperature on Problem Solving in Large Language Models
von: Renze, Matthew, et al.
Veröffentlicht: (2024)
von: Renze, Matthew, et al.
Veröffentlicht: (2024)
The Benefits of a Concise Chain of Thought on Problem-Solving in Large Language Models
von: Renze, Matthew, et al.
Veröffentlicht: (2024)
von: Renze, Matthew, et al.
Veröffentlicht: (2024)
Hierarchical Orthogonal Residual Spread for Precise Massive Editing in Large Language Models
von: Gu, Xiaojie, et al.
Veröffentlicht: (2026)
von: Gu, Xiaojie, et al.
Veröffentlicht: (2026)
LLMSurgeon: Diagnosing Data Mixture of Large Language Models
von: Luo, Yaxin, et al.
Veröffentlicht: (2026)
von: Luo, Yaxin, et al.
Veröffentlicht: (2026)
Diagnosing Robotics Systems Issues with Large Language Models
von: Herrmann, Jordis Emilia, et al.
Veröffentlicht: (2024)
von: Herrmann, Jordis Emilia, et al.
Veröffentlicht: (2024)
Towards Automated Regulatory Compliance Verification in Financial Auditing with Large Language Models
von: Berger, Armin, et al.
Veröffentlicht: (2025)
von: Berger, Armin, et al.
Veröffentlicht: (2025)
You Didn't Have to Say It like That: Subliminal Learning from Faithful Paraphrases
von: Gisler, Isaia, et al.
Veröffentlicht: (2026)
von: Gisler, Isaia, et al.
Veröffentlicht: (2026)
Diagnosing Retrieval Bias Under Multiple In-Context Knowledge Updates in Large Language Models
von: Qiao, Boyu, et al.
Veröffentlicht: (2026)
von: Qiao, Boyu, et al.
Veröffentlicht: (2026)
Automated ICD Classification of Psychiatric Diagnoses: From Classical NLP to Large Language Models
von: Ortega, Fernando, et al.
Veröffentlicht: (2026)
von: Ortega, Fernando, et al.
Veröffentlicht: (2026)
AR$^2$: Adversarial Reinforcement Learning for Abstract Reasoning in Large Language Models
von: Yeh, Cheng-Kai, et al.
Veröffentlicht: (2025)
von: Yeh, Cheng-Kai, et al.
Veröffentlicht: (2025)
SUV: Scalable Large Language Model Copyright Compliance with Regularized Selective Unlearning
von: Xu, Tianyang, et al.
Veröffentlicht: (2025)
von: Xu, Tianyang, et al.
Veröffentlicht: (2025)
A Survey of Quantized Graph Representation Learning: Connecting Graph Structures with Large Language Models
von: Lin, Qika, et al.
Veröffentlicht: (2025)
von: Lin, Qika, et al.
Veröffentlicht: (2025)
Omanic: Towards Step-wise Evaluation of Multi-hop Reasoning in Large Language Models
von: Gu, Xiaojie, et al.
Veröffentlicht: (2026)
von: Gu, Xiaojie, et al.
Veröffentlicht: (2026)
The Role of Diversity in In-Context Learning for Large Language Models
von: Xiao, Wenyang, et al.
Veröffentlicht: (2025)
von: Xiao, Wenyang, et al.
Veröffentlicht: (2025)
MUFFIN: Curating Multi-Faceted Instructions for Improving Instruction-Following
von: Lou, Renze, et al.
Veröffentlicht: (2023)
von: Lou, Renze, et al.
Veröffentlicht: (2023)
Diagnosing Shoulder Disorders Using Multimodal Large Language Models and Consumer-Grade Cameras
von: Hong, Jindong, et al.
Veröffentlicht: (2025)
von: Hong, Jindong, et al.
Veröffentlicht: (2025)
Accelerated Preference Optimization for Large Language Model Alignment
von: He, Jiafan, et al.
Veröffentlicht: (2024)
von: He, Jiafan, et al.
Veröffentlicht: (2024)
On Prompt-Driven Safeguarding for Large Language Models
von: Zheng, Chujie, et al.
Veröffentlicht: (2024)
von: Zheng, Chujie, et al.
Veröffentlicht: (2024)
Cite Pretrain: Retrieval-Free Knowledge Attribution for Large Language Models
von: Huang, Yukun, et al.
Veröffentlicht: (2025)
von: Huang, Yukun, et al.
Veröffentlicht: (2025)
Large Language Model Pruning
von: Huang, Hanjuan, et al.
Veröffentlicht: (2024)
von: Huang, Hanjuan, et al.
Veröffentlicht: (2024)
APTQ: Attention-aware Post-Training Mixed-Precision Quantization for Large Language Models
von: Guan, Ziyi, et al.
Veröffentlicht: (2024)
von: Guan, Ziyi, et al.
Veröffentlicht: (2024)
Learning When to Think While Listening in Large Audio-Language Models
von: Song, Zhiyuan, et al.
Veröffentlicht: (2026)
von: Song, Zhiyuan, et al.
Veröffentlicht: (2026)
Method-Based Reasoning for Large Language Models: Extraction, Reuse, and Continuous Improvement
von: Su, Hong
Veröffentlicht: (2025)
von: Su, Hong
Veröffentlicht: (2025)
Solving Inequality Proofs with Large Language Models
von: Lu, Pan, et al.
Veröffentlicht: (2025)
von: Lu, Pan, et al.
Veröffentlicht: (2025)
The Deepfakes We Missed: We Built Detectors for a Threat That Didn't Arrive
von: Raza, Shaina
Veröffentlicht: (2026)
von: Raza, Shaina
Veröffentlicht: (2026)
Do Large Language Models Truly Grasp Mathematics? An Empirical Exploration From Cognitive Psychology
von: Xie, Wei, et al.
Veröffentlicht: (2024)
von: Xie, Wei, et al.
Veröffentlicht: (2024)
Differentially Private Zeroth-Order Methods for Scalable Large Language Model Finetuning
von: Liu, Z, et al.
Veröffentlicht: (2024)
von: Liu, Z, et al.
Veröffentlicht: (2024)
An Evaluation on Large Language Model Outputs: Discourse and Memorization
von: de Wynter, Adrian, et al.
Veröffentlicht: (2023)
von: de Wynter, Adrian, et al.
Veröffentlicht: (2023)
Textual Aesthetics in Large Language Models
von: Jiang, Lingjie, et al.
Veröffentlicht: (2024)
von: Jiang, Lingjie, et al.
Veröffentlicht: (2024)
LLMC: Benchmarking Large Language Model Quantization with a Versatile Compression Toolkit
von: Gong, Ruihao, et al.
Veröffentlicht: (2024)
von: Gong, Ruihao, et al.
Veröffentlicht: (2024)
StyleBench: Evaluating thinking styles in Large Language Models
von: Guo, Junyu, et al.
Veröffentlicht: (2025)
von: Guo, Junyu, et al.
Veröffentlicht: (2025)
Revisiting Entropy in Reinforcement Learning for Large Reasoning Models
von: Jin, Renren, et al.
Veröffentlicht: (2025)
von: Jin, Renren, et al.
Veröffentlicht: (2025)
Continuity and Ordinality Matter: Constraining Time Series Tokens for Effective Time Series Analysis with Large Language Models
von: Li, Musheng, et al.
Veröffentlicht: (2026)
von: Li, Musheng, et al.
Veröffentlicht: (2026)
Learning Mathematical Rules with Large Language Models
von: Gorceix, Antoine, et al.
Veröffentlicht: (2024)
von: Gorceix, Antoine, et al.
Veröffentlicht: (2024)
Integration of Large Language Models and Federated Learning
von: Chen, Chaochao, et al.
Veröffentlicht: (2023)
von: Chen, Chaochao, et al.
Veröffentlicht: (2023)
Active Preference Learning for Large Language Models
von: Muldrew, William, et al.
Veröffentlicht: (2024)
von: Muldrew, William, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
Too Long, Didn't Model: Decomposing LLM Long-Context Understanding With Novels
von: Hamilton, Sil, et al.
Veröffentlicht: (2025) -
UltraEdit: Training-, Subject-, and Memory-Free Lifelong Editing in Language Models
von: Gu, Xiaojie, et al.
Veröffentlicht: (2025) -
Adaptive Chameleon or Stubborn Sloth: Revealing the Behavior of Large Language Models in Knowledge Conflicts
von: Xie, Jian, et al.
Veröffentlicht: (2023) -
"Sorry, I Didn't Catch That": How Speech Models Miss What Matters Most
von: Zhou, Kaitlyn, et al.
Veröffentlicht: (2026) -
The Effect of Sampling Temperature on Problem Solving in Large Language Models
von: Renze, Matthew, et al.
Veröffentlicht: (2024)