Enregistré dans:
| Auteurs principaux: | Parashar, Jayant, Bhandarkar, Suchendra M. |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2606.00532 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
KisMATH: Do LLMs Have Knowledge of Implicit Structures in Mathematical Reasoning?
par: Saha, Soumadeep, et autres
Publié: (2025)
par: Saha, Soumadeep, et autres
Publié: (2025)
PhysNote: Self-Knowledge Notes for Evolvable Physical Reasoning in Vision-Language Model
par: Zhang, Sinin, et autres
Publié: (2026)
par: Zhang, Sinin, et autres
Publié: (2026)
InfinityMATH: A Scalable Instruction Tuning Dataset in Programmatic Mathematical Reasoning
par: Zhang, Bo-Wen, et autres
Publié: (2024)
par: Zhang, Bo-Wen, et autres
Publié: (2024)
Evaluating Relational Reasoning in LLMs with REL
par: Fesser, Lukas, et autres
Publié: (2026)
par: Fesser, Lukas, et autres
Publié: (2026)
HIP Network: Historical Information Passing Network for Extrapolation Reasoning on Temporal Knowledge Graph
par: He, Yongquan, et autres
Publié: (2024)
par: He, Yongquan, et autres
Publié: (2024)
Active Context Compression: Autonomous Memory Management in LLM Agents
par: Verma, Nikhil
Publié: (2026)
par: Verma, Nikhil
Publié: (2026)
SCULPT: Constraint-Guided Pruned MCTS that Carves Efficient Paths for Mathematical Reasoning
par: Fang, Qitong, et autres
Publié: (2026)
par: Fang, Qitong, et autres
Publié: (2026)
Temporal Knowledge Question Answering via Abstract Reasoning Induction
par: Chen, Ziyang, et autres
Publié: (2023)
par: Chen, Ziyang, et autres
Publié: (2023)
RomanLens: The Role Of Latent Romanization In Multilinguality In LLMs
par: Saji, Alan, et autres
Publié: (2025)
par: Saji, Alan, et autres
Publié: (2025)
Text-Based Approaches to Item Difficulty Modeling in Large-Scale Assessments: A Systematic Review
par: Peters, Sydney, et autres
Publié: (2025)
par: Peters, Sydney, et autres
Publié: (2025)
SagaLLM: Context Management, Validation, and Transaction Guarantees for Multi-Agent LLM Planning
par: Chang, Edward Y., et autres
Publié: (2025)
par: Chang, Edward Y., et autres
Publié: (2025)
Pareto-Optimized Open-Source LLMs for Healthcare via Context Retrieval
par: Bayarri-Planas, Jordi, et autres
Publié: (2024)
par: Bayarri-Planas, Jordi, et autres
Publié: (2024)
Thinking Machines: Mathematical Reasoning in the Age of LLMs
par: Asperti, Andrea, et autres
Publié: (2025)
par: Asperti, Andrea, et autres
Publié: (2025)
RAudit: A Blind Auditing Protocol for Large Language Model Reasoning
par: Chang, Edward Y., et autres
Publié: (2026)
par: Chang, Edward Y., et autres
Publié: (2026)
From Extraction to Synthesis: Entangled Heuristics for Agent-Augmented Strategic Reasoning
par: Ghisellini, Renato, et autres
Publié: (2025)
par: Ghisellini, Renato, et autres
Publié: (2025)
RADD: Retrieval-Augmented Discrete Diffusion for Multi-Modal Knowledge Graph Completion
par: Niu, Guanglin, et autres
Publié: (2026)
par: Niu, Guanglin, et autres
Publié: (2026)
Enhancing Mental Health Counseling Support in Bangladesh using Culturally-Grounded Knowledge
par: Hasan, Md Arid, et autres
Publié: (2026)
par: Hasan, Md Arid, et autres
Publié: (2026)
A Survey of Task-Oriented Knowledge Graph Reasoning: Status, Applications, and Prospects
par: Niu, Guanglin, et autres
Publié: (2025)
par: Niu, Guanglin, et autres
Publié: (2025)
MapAgent: A Hierarchical Agent for Geospatial Reasoning with Dynamic Map Tool Integration
par: Hasan, Md Hasebul, et autres
Publié: (2025)
par: Hasan, Md Hasebul, et autres
Publié: (2025)
A Fuzzy Logic Prompting Framework for Large Language Models in Adaptive and Uncertain Tasks
par: Figueiredo, Vanessa
Publié: (2025)
par: Figueiredo, Vanessa
Publié: (2025)
The Unified Cognitive Consciousness Theory for Language Models: Anchoring Semantics, Thresholds of Activation, and Emergent Reasoning
par: Chang, Edward Y., et autres
Publié: (2025)
par: Chang, Edward Y., et autres
Publié: (2025)
Planning vs Reasoning: Ablations to Test Capabilities of LoRA layers
par: Redkar, Neel
Publié: (2024)
par: Redkar, Neel
Publié: (2024)
Automatic Prompt Optimization for Knowledge Graph Construction: Insights from an Empirical Study
par: Mihindukulasooriya, Nandana, et autres
Publié: (2025)
par: Mihindukulasooriya, Nandana, et autres
Publié: (2025)
Adaptive Interviewing for Persona Simulation in LLMs: Evidence-Grounded Reasoning Improves Decision Alignment
par: Su, Ruoxi, et autres
Publié: (2026)
par: Su, Ruoxi, et autres
Publié: (2026)
An Investigation of Neuron Activation as a Unified Lens to Explain Chain-of-Thought Eliciting Arithmetic Reasoning of LLMs
par: Rai, Daking, et autres
Publié: (2024)
par: Rai, Daking, et autres
Publié: (2024)
AI Predicts AGI: Leveraging AGI Forecasting and Peer Review to Explore LLMs' Complex Reasoning Capabilities
par: Davide, Fabrizio, et autres
Publié: (2024)
par: Davide, Fabrizio, et autres
Publié: (2024)
ChatGPT4PCG 2 Competition: Prompt Engineering for Science Birds Level Generation
par: Taveekitworachai, Pittawat, et autres
Publié: (2024)
par: Taveekitworachai, Pittawat, et autres
Publié: (2024)
CausalT5K: Diagnosing and Informing Refusal for Trustworthy Causal Reasoning of Skepticism, Sycophancy, Detection-Correction, and Rung Collapse
par: Geng, Longling, et autres
Publié: (2026)
par: Geng, Longling, et autres
Publié: (2026)
BitCal-TTS: Bit-Calibrated Test-Time Scaling for Quantized Reasoning Models
par: Patarlapalli, Sai Babu, et autres
Publié: (2026)
par: Patarlapalli, Sai Babu, et autres
Publié: (2026)
Reasoning-Based AI for Startup Evaluation (R.A.I.S.E.): A Memory-Augmented, Multi-Step Decision Framework
par: Preuveneers, Jack, et autres
Publié: (2025)
par: Preuveneers, Jack, et autres
Publié: (2025)
Mathador-LM: A Dynamic Benchmark for Mathematical Reasoning on Large Language Models
par: Kurtic, Eldar, et autres
Publié: (2024)
par: Kurtic, Eldar, et autres
Publié: (2024)
UA-Legal-Bench: A Benchmark for Evaluating Large Language Models on Ukrainian Legal Reasoning
par: Ovcharov, Volodymyr
Publié: (2026)
par: Ovcharov, Volodymyr
Publié: (2026)
A Benchmark for Audio Reasoning Capabilities of Multimodal Large Language Models
par: Christop, Iwona, et autres
Publié: (2026)
par: Christop, Iwona, et autres
Publié: (2026)
Red Teaming for Large Language Models At Scale: Tackling Hallucinations on Mathematics Tasks
par: Buszydlik, Aleksander, et autres
Publié: (2023)
par: Buszydlik, Aleksander, et autres
Publié: (2023)
Context Is What You Need: The Maximum Effective Context Window for Real World Limits of LLMs
par: Paulsen, Norman
Publié: (2025)
par: Paulsen, Norman
Publié: (2025)
Evaluating the Efficacy of Hybrid Deep Learning Models in Distinguishing AI-Generated Text
par: Oketunji, Abiodun Finbarrs
Publié: (2023)
par: Oketunji, Abiodun Finbarrs
Publié: (2023)
LLM-Based SQL Generation: Prompting, Self-Refinement, and Adaptive Weighted Majority Voting
par: Yang, Yu-Jie, et autres
Publié: (2026)
par: Yang, Yu-Jie, et autres
Publié: (2026)
From Guessing to Asking: An Approach to Resolving the Persona Knowledge Gap in LLMs during Multi-Turn Conversations
par: Baskar, Sarvesh, et autres
Publié: (2025)
par: Baskar, Sarvesh, et autres
Publié: (2025)
Beyond Greenfield: The D3 Framework for AI-Driven Productivity in Brownfield Engineering
par: Sharma, Krishna Kumaar
Publié: (2025)
par: Sharma, Krishna Kumaar
Publié: (2025)
Can LLMs Do Rocket Science? Exploring the Limits of Complex Reasoning with GTOC 12
par: del Campo, Iñaki, et autres
Publié: (2026)
par: del Campo, Iñaki, et autres
Publié: (2026)
Documents similaires
-
KisMATH: Do LLMs Have Knowledge of Implicit Structures in Mathematical Reasoning?
par: Saha, Soumadeep, et autres
Publié: (2025) -
PhysNote: Self-Knowledge Notes for Evolvable Physical Reasoning in Vision-Language Model
par: Zhang, Sinin, et autres
Publié: (2026) -
InfinityMATH: A Scalable Instruction Tuning Dataset in Programmatic Mathematical Reasoning
par: Zhang, Bo-Wen, et autres
Publié: (2024) -
Evaluating Relational Reasoning in LLMs with REL
par: Fesser, Lukas, et autres
Publié: (2026) -
HIP Network: Historical Information Passing Network for Extrapolation Reasoning on Temporal Knowledge Graph
par: He, Yongquan, et autres
Publié: (2024)