Enregistré dans:
| Auteurs principaux: | Carrino, Gabriele, Sassella, Andrea, Brunello, Nicolo, Toschi, Federico, Carman, Mark James |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2603.18756 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
From Instructions to Assistance: a Dataset Aligning Instruction Manuals with Assembly Videos for Evaluating Multimodal LLMs
par: Toschi, Federico, et autres
Publié: (2026)
par: Toschi, Federico, et autres
Publié: (2026)
Benchmarking EngGPT2-16B-A3B against Comparable Italian and International Open-source LLMs
par: Sassella, Andrea, et autres
Publié: (2026)
par: Sassella, Andrea, et autres
Publié: (2026)
InTraVisTo: Inside Transformer Visualisation Tool
par: Brunello, Nicolò, et autres
Publié: (2025)
par: Brunello, Nicolò, et autres
Publié: (2025)
Tag-LLM: Repurposing General-Purpose LLMs for Specialized Domains
par: Shen, Junhong, et autres
Publié: (2024)
par: Shen, Junhong, et autres
Publié: (2024)
LLMs cannot find reasoning errors, but can correct them given the error location
par: Tyen, Gladys, et autres
Publié: (2023)
par: Tyen, Gladys, et autres
Publié: (2023)
QuestBench: Can LLMs ask the right question to acquire information in reasoning tasks?
par: Li, Belinda Z., et autres
Publié: (2025)
par: Li, Belinda Z., et autres
Publié: (2025)
QMOS: Enhancing LLMs for Telecommunication with Question Masked loss and Option Shuffling
par: Guda, Blessed, et autres
Publié: (2024)
par: Guda, Blessed, et autres
Publié: (2024)
Language models show human-like content effects on reasoning tasks
par: Dasgupta, Ishita, et autres
Publié: (2022)
par: Dasgupta, Ishita, et autres
Publié: (2022)
Interpretable Early Failure Detection via Machine Learning and Trace Checking-based Monitoring
par: Brunello, Andrea, et autres
Publié: (2025)
par: Brunello, Andrea, et autres
Publié: (2025)
When can transformers reason with abstract symbols?
par: Boix-Adsera, Enric, et autres
Publié: (2023)
par: Boix-Adsera, Enric, et autres
Publié: (2023)
Artificial Expert Intelligence through PAC-reasoning
par: Shalev-Shwartz, Shai, et autres
Publié: (2024)
par: Shalev-Shwartz, Shai, et autres
Publié: (2024)
Language hooks: a modular framework for augmenting LLM reasoning that decouples tool usage from the model and its prompt
par: de Mijolla, Damien, et autres
Publié: (2024)
par: de Mijolla, Damien, et autres
Publié: (2024)
Is continuous CoT better suited for multi-lingual reasoning?
par: Bashir, Ali Hamza, et autres
Publié: (2026)
par: Bashir, Ali Hamza, et autres
Publié: (2026)
Sudoku-Bench: Evaluating creative reasoning with Sudoku variants
par: Seely, Jeffrey, et autres
Publié: (2025)
par: Seely, Jeffrey, et autres
Publié: (2025)
ContextGPT: Infusing LLMs Knowledge into Neuro-Symbolic Activity Recognition Models
par: Arrotta, Luca, et autres
Publié: (2024)
par: Arrotta, Luca, et autres
Publié: (2024)
Neural networks for abstraction and reasoning: Towards broad generalization in machines
par: Bober-Irizar, Mikel, et autres
Publié: (2024)
par: Bober-Irizar, Mikel, et autres
Publié: (2024)
Your thoughts tell who you are: Characterize the reasoning patterns of LRMs
par: Chen, Yida, et autres
Publié: (2025)
par: Chen, Yida, et autres
Publié: (2025)
To CoT or not to CoT? Chain-of-thought helps mainly on math and symbolic reasoning
par: Sprague, Zayne, et autres
Publié: (2024)
par: Sprague, Zayne, et autres
Publié: (2024)
How do LLMs Compute Verbal Confidence
par: Kumaran, Dharshan, et autres
Publié: (2026)
par: Kumaran, Dharshan, et autres
Publié: (2026)
Critique of Impure Reason: Unveiling the reasoning behaviour of medical Large Language Models
par: Sim, Shamus, et autres
Publié: (2024)
par: Sim, Shamus, et autres
Publié: (2024)
Encode, Think, Decode: Scaling test-time reasoning with recursive latent thoughts
par: Koishekenov, Yeskendir, et autres
Publié: (2025)
par: Koishekenov, Yeskendir, et autres
Publié: (2025)
Counterfactual reasoning: an analysis of in-context emergence
par: Miller, Moritz, et autres
Publié: (2025)
par: Miller, Moritz, et autres
Publié: (2025)
Multi-step retrieval and reasoning improves radiology question answering with large language models
par: Wind, Sebastian, et autres
Publié: (2025)
par: Wind, Sebastian, et autres
Publié: (2025)
Explore Theory of Mind: Program-guided adversarial data generation for theory of mind reasoning
par: Sclar, Melanie, et autres
Publié: (2024)
par: Sclar, Melanie, et autres
Publié: (2024)
Learning and Enforcing Context-Sensitive Control for LLMs
par: Albinhassan, Mohammad, et autres
Publié: (2026)
par: Albinhassan, Mohammad, et autres
Publié: (2026)
Easy Problems That LLMs Get Wrong
par: Williams, Sean, et autres
Publié: (2024)
par: Williams, Sean, et autres
Publié: (2024)
Hypertokens: Holographic Associative Memory in Tokenized LLMs
par: Augeri, Christopher James
Publié: (2025)
par: Augeri, Christopher James
Publié: (2025)
Catching rationalization in the act: detecting motivated reasoning before and after CoT via activation probing
par: Mirtaheri, Parsa, et autres
Publié: (2026)
par: Mirtaheri, Parsa, et autres
Publié: (2026)
A Shared Geometry of Difficulty in Multilingual Language Models
par: Civelli, Stefano, et autres
Publié: (2026)
par: Civelli, Stefano, et autres
Publié: (2026)
BoostStep: Boosting mathematical capability of Large Language Models via improved single-step reasoning
par: Zhang, Beichen, et autres
Publié: (2025)
par: Zhang, Beichen, et autres
Publié: (2025)
L1RA: Dynamic Rank Assignment in LoRA Fine-Tuning
par: Singh, Raul, et autres
Publié: (2025)
par: Singh, Raul, et autres
Publié: (2025)
Frictive Policy Optimization for LLMs: Epistemic Intervention, Risk-Sensitive Control, and Reflective Alignment
par: Pustejovsky, James, et autres
Publié: (2026)
par: Pustejovsky, James, et autres
Publié: (2026)
Draft-Conditioned Constrained Decoding for Structured Generation in LLMs
par: Reddy, Avinash, et autres
Publié: (2026)
par: Reddy, Avinash, et autres
Publié: (2026)
MarginSel : Max-Margin Demonstration Selection for LLMs
par: Ambati, Rajeev Bhatt, et autres
Publié: (2025)
par: Ambati, Rajeev Bhatt, et autres
Publié: (2025)
Can formal argumentative reasoning enhance LLMs performances?
par: Castagna, Federico, et autres
Publié: (2024)
par: Castagna, Federico, et autres
Publié: (2024)
Adapting Language Models via Token Translation
par: Feng, Zhili, et autres
Publié: (2024)
par: Feng, Zhili, et autres
Publié: (2024)
Zero-shot data citation function classification using transformer-based large language models (LLMs)
par: Byers, Neil, et autres
Publié: (2025)
par: Byers, Neil, et autres
Publié: (2025)
How to Train Data-Efficient LLMs
par: Sachdeva, Noveen, et autres
Publié: (2024)
par: Sachdeva, Noveen, et autres
Publié: (2024)
LLMs Have Rhythm: Fingerprinting Large Language Models Using Inter-Token Times and Network Traffic Analysis
par: Alhazbi, Saeif, et autres
Publié: (2025)
par: Alhazbi, Saeif, et autres
Publié: (2025)
Beyond Confidence: Rethinking Self-Assessments for Performance Prediction in LLMs
par: Bhattacharyya, Sree, et autres
Publié: (2026)
par: Bhattacharyya, Sree, et autres
Publié: (2026)
Documents similaires
-
From Instructions to Assistance: a Dataset Aligning Instruction Manuals with Assembly Videos for Evaluating Multimodal LLMs
par: Toschi, Federico, et autres
Publié: (2026) -
Benchmarking EngGPT2-16B-A3B against Comparable Italian and International Open-source LLMs
par: Sassella, Andrea, et autres
Publié: (2026) -
InTraVisTo: Inside Transformer Visualisation Tool
par: Brunello, Nicolò, et autres
Publié: (2025) -
Tag-LLM: Repurposing General-Purpose LLMs for Specialized Domains
par: Shen, Junhong, et autres
Publié: (2024) -
LLMs cannot find reasoning errors, but can correct them given the error location
par: Tyen, Gladys, et autres
Publié: (2023)