MISR: Measuring Instrumental Self-Reasoning in Frontier Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Fronsdal, Kai, Lindner, David |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Language Models are Hidden Reasoners: Unlocking Latent Reasoning Capabilities via Self-Rewarding
par: Chen, Haolin, et autres
Publié: (2024)
par: Chen, Haolin, et autres
Publié: (2024)
Evaluating the Efficacy of Hybrid Deep Learning Models in Distinguishing AI-Generated Text
par: Oketunji, Abiodun Finbarrs
Publié: (2023)
par: Oketunji, Abiodun Finbarrs
Publié: (2023)
Entropy-Based Measurement of Value Drift and Alignment Work in Large Language Models
par: Fadli, Samih
Publié: (2025)
par: Fadli, Samih
Publié: (2025)
Self-Consistency from Only Two Samples: CoT-PoT Ensembling for Efficient LLM Reasoning
par: Saparkhan, Raman, et autres
Publié: (2026)
par: Saparkhan, Raman, et autres
Publié: (2026)
Large Language Model (LLM) Bias Index -- LLMBI
par: Oketunji, Abiodun Finbarrs, et autres
Publié: (2023)
par: Oketunji, Abiodun Finbarrs, et autres
Publié: (2023)
Self-Supervised Position Debiasing for Large Language Models
par: Liu, Zhongkun, et autres
Publié: (2024)
par: Liu, Zhongkun, et autres
Publié: (2024)
RAVR: Reference-Answer-guided Variational Reasoning for Large Language Models
par: Lin, Tianqianjin, et autres
Publié: (2025)
par: Lin, Tianqianjin, et autres
Publié: (2025)
Metaphors are a Source of Cross-Domain Misalignment of Large Reasoning Models
par: Hu, Zhibo, et autres
Publié: (2026)
par: Hu, Zhibo, et autres
Publié: (2026)
Mathador-LM: A Dynamic Benchmark for Mathematical Reasoning on Large Language Models
par: Kurtic, Eldar, et autres
Publié: (2024)
par: Kurtic, Eldar, et autres
Publié: (2024)
External Hippocampus: Topological Cognitive Maps for Guiding Large Language Model Reasoning
par: Yan, Jian
Publié: (2025)
par: Yan, Jian
Publié: (2025)
Generalizing Numerical Reasoning in Table Data through Operation Sketches and Self-Supervised Learning
par: Cho, Hanjun, et autres
Publié: (2026)
par: Cho, Hanjun, et autres
Publié: (2026)
Danoliteracy of Generative Large Language Models
par: Holm, Søren Vejlgaard, et autres
Publié: (2024)
par: Holm, Søren Vejlgaard, et autres
Publié: (2024)
SocraSynth: Multi-LLM Reasoning with Conditional Statistics
par: Chang, Edward Y.
Publié: (2024)
par: Chang, Edward Y.
Publié: (2024)
ConciseRL: Conciseness-Guided Reinforcement Learning for Efficient Reasoning Models
par: Dumitru, Razvan-Gabriel, et autres
Publié: (2025)
par: Dumitru, Razvan-Gabriel, et autres
Publié: (2025)
Cognitive Load Limits in Large Language Models: Benchmarking Multi-Hop Reasoning
par: Adapala, Sai Teja Reddy
Publié: (2025)
par: Adapala, Sai Teja Reddy
Publié: (2025)
Positional Failures in Long-Context LLMs: A Blind Spot in Reasoning Benchmarks
par: Zhang, Chuyifei, et autres
Publié: (2026)
par: Zhang, Chuyifei, et autres
Publié: (2026)
AtManRL: Towards Faithful Reasoning via Differentiable Attention Saliency
par: Höth, Max Henning, et autres
Publié: (2026)
par: Höth, Max Henning, et autres
Publié: (2026)
Slim-SC: Thought Pruning for Efficient Scaling with Self-Consistency
par: Hong, Colin, et autres
Publié: (2025)
par: Hong, Colin, et autres
Publié: (2025)
Path-Lock Expert: Separating Reasoning Mode in Hybrid Thinking via Architecture-Level Separation
par: Wang, Shouren, et autres
Publié: (2026)
par: Wang, Shouren, et autres
Publié: (2026)
Beyond Hallucinations: A Composite Score for Measuring Reliability in Open-Source Large Language Models
par: Salla, Rohit Kumar, et autres
Publié: (2025)
par: Salla, Rohit Kumar, et autres
Publié: (2025)
Does LLM Alignment Really Need Diversity? An Empirical Study of Adapting RLVR Methods for Moral Reasoning
par: Zhang, Zhaowei, et autres
Publié: (2026)
par: Zhang, Zhaowei, et autres
Publié: (2026)
ACCORD: Closing the Commonsense Measurability Gap
par: Roewer-Després, François, et autres
Publié: (2024)
par: Roewer-Després, François, et autres
Publié: (2024)
Contextual Integrity in LLMs via Reasoning and Reinforcement Learning
par: Lan, Guangchen, et autres
Publié: (2025)
par: Lan, Guangchen, et autres
Publié: (2025)
Robust Explanations for User Trust in Enterprise NLP Systems
par: Zhang, Guilin, et autres
Publié: (2026)
par: Zhang, Guilin, et autres
Publié: (2026)
Beyond Pass@k: Breadth-Depth Metrics for Reasoning Boundaries
par: Dragoi, Marius, et autres
Publié: (2025)
par: Dragoi, Marius, et autres
Publié: (2025)
Counterfactual Likelihood Tests for Indirect Influence in Private Reasoning Channels
par: Lorup, Alexander Boesgaard
Publié: (2026)
par: Lorup, Alexander Boesgaard
Publié: (2026)
Harnessing Negative Signals: Reinforcement Distillation from Teacher Data for LLM Reasoning
par: Xu, Shuyao, et autres
Publié: (2025)
par: Xu, Shuyao, et autres
Publié: (2025)
The Deterministic Horizon: When Extended Reasoning Fails and Tool Delegation Becomes Necessary
par: Guo, Dongxin, et autres
Publié: (2026)
par: Guo, Dongxin, et autres
Publié: (2026)
On Measuring Faithfulness or Self-consistency of Natural Language Explanations
par: Parcalabescu, Letitia, et autres
Publié: (2023)
par: Parcalabescu, Letitia, et autres
Publié: (2023)
R2R: Efficiently Navigating Divergent Reasoning Paths with Small-Large Model Token Routing
par: Fu, Tianyu, et autres
Publié: (2025)
par: Fu, Tianyu, et autres
Publié: (2025)
AMALIA Technical Report: A Fully Open Source Large Language Model for European Portuguese
par: Simplício, Afonso, et autres
Publié: (2026)
par: Simplício, Afonso, et autres
Publié: (2026)
Random-Set Large Language Models
par: Mubashar, Muhammad, et autres
Publié: (2025)
par: Mubashar, Muhammad, et autres
Publié: (2025)
Improving Language Models with Intentional Analysis
par: Yin, Yuwei, et autres
Publié: (2025)
par: Yin, Yuwei, et autres
Publié: (2025)
Distilling Knowledge from Large Language Models: A Concept Bottleneck Model for Hate and Counter Speech Recognition
par: Labadie-Tamayo, Roberto, et autres
Publié: (2025)
par: Labadie-Tamayo, Roberto, et autres
Publié: (2025)
NRR-Core: Non-Resolution Reasoning as a Computational Framework for Contextual Identity and Ambiguity Preservation
par: Saito, Kei
Publié: (2025)
par: Saito, Kei
Publié: (2025)
Uncovering Biases with Reflective Large Language Models
par: Chang, Edward Y.
Publié: (2024)
par: Chang, Edward Y.
Publié: (2024)
SWI: Speaking with Intent in Large Language Models
par: Yin, Yuwei, et autres
Publié: (2025)
par: Yin, Yuwei, et autres
Publié: (2025)
Neural Multimodal Topic Modeling: A Comprehensive Evaluation
par: González-Pizarro, Felipe, et autres
Publié: (2024)
par: González-Pizarro, Felipe, et autres
Publié: (2024)
Uncovering Latent Human Wellbeing in Language Model Embeddings
par: Freire, Pedro, et autres
Publié: (2024)
par: Freire, Pedro, et autres
Publié: (2024)
Benchmarking Cognitive Biases in Large Language Models as Evaluators
par: Koo, Ryan, et autres
Publié: (2023)
par: Koo, Ryan, et autres
Publié: (2023)
Documents similaires
-
Language Models are Hidden Reasoners: Unlocking Latent Reasoning Capabilities via Self-Rewarding
par: Chen, Haolin, et autres
Publié: (2024) -
Evaluating the Efficacy of Hybrid Deep Learning Models in Distinguishing AI-Generated Text
par: Oketunji, Abiodun Finbarrs
Publié: (2023) -
Entropy-Based Measurement of Value Drift and Alignment Work in Large Language Models
par: Fadli, Samih
Publié: (2025) -
Self-Consistency from Only Two Samples: CoT-PoT Ensembling for Efficient LLM Reasoning
par: Saparkhan, Raman, et autres
Publié: (2026) -
Large Language Model (LLM) Bias Index -- LLMBI
par: Oketunji, Abiodun Finbarrs, et autres
Publié: (2023)