Evaluating the Systematic Reasoning Abilities of Large Language Models through Graph Coloring
Fuente:
arXiv
Salvato in:
| Autori principali: | Heyman, Alex, Zylberberg, Joel |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Reasoning Large Language Model Errors Arise from Hallucinating Critical Problem Features
di: Heyman, Alex, et al.
Pubblicazione: (2025)
di: Heyman, Alex, et al.
Pubblicazione: (2025)
Entropy-Based Measurement of Value Drift and Alignment Work in Large Language Models
di: Fadli, Samih
Pubblicazione: (2025)
di: Fadli, Samih
Pubblicazione: (2025)
Merge-Bench: Resolve Merge Conflicts with Large Language Models
di: Schesch, Benedikt, et al.
Pubblicazione: (2026)
di: Schesch, Benedikt, et al.
Pubblicazione: (2026)
The Geometry of Thought: How Scale Restructures Reasoning In Large Language Models
di: Anderson, Samuel Cyrenius
Pubblicazione: (2026)
di: Anderson, Samuel Cyrenius
Pubblicazione: (2026)
Transformer Scalability Crisis: The First Comprehensive Empirical Analysis of Performance Walls in Modern Language Models
di: Moghadasi, Mahdi Naser, et al.
Pubblicazione: (2026)
di: Moghadasi, Mahdi Naser, et al.
Pubblicazione: (2026)
Learned Relay Representations for Forward-Thinking Discrete Diffusion Models
di: Rozonoyer, Benjamin, et al.
Pubblicazione: (2026)
di: Rozonoyer, Benjamin, et al.
Pubblicazione: (2026)
Super Apriel: One Checkpoint, Many Speeds
di: Labs, SLAM, et al.
Pubblicazione: (2026)
di: Labs, SLAM, et al.
Pubblicazione: (2026)
Variance Is Not Importance: Structural Analysis of Transformer Compressibility Across Model Scales
di: Salfati, Samuel
Pubblicazione: (2026)
di: Salfati, Samuel
Pubblicazione: (2026)
Memory Bank Compression for Continual Adaptation of Large Language Models
di: Katraouras, Thomas, et al.
Pubblicazione: (2026)
di: Katraouras, Thomas, et al.
Pubblicazione: (2026)
PoTS: Proof-of-Training-Steps for Backdoor Detection in Large Language Models
di: Seddik, Issam, et al.
Pubblicazione: (2025)
di: Seddik, Issam, et al.
Pubblicazione: (2025)
The Anti-Ouroboros Effect: Emergent Resilience in Large Language Models from Recursive Selective Feedback
di: Adapala, Sai Teja Reddy
Pubblicazione: (2025)
di: Adapala, Sai Teja Reddy
Pubblicazione: (2025)
ACE: Exploring Activation Cosine Similarity and Variance for Accurate and Calibration-Efficient LLM Pruning
di: Mi, Zhendong, et al.
Pubblicazione: (2025)
di: Mi, Zhendong, et al.
Pubblicazione: (2025)
Scalable GPU-Accelerated Euler Characteristic Curves: Optimization and Differentiable Learning for PyTorch
di: Saxena, Udit
Pubblicazione: (2025)
di: Saxena, Udit
Pubblicazione: (2025)
Synergy over Discrepancy: A Partition-Based Approach to Multi-Domain LLM Fine-Tuning
di: Ye, Hua, et al.
Pubblicazione: (2025)
di: Ye, Hua, et al.
Pubblicazione: (2025)
KerZOO: Kernel Function Informed Zeroth-Order Optimization for Accurate and Accelerated LLM Fine-Tuning
di: Mi, Zhendong, et al.
Pubblicazione: (2025)
di: Mi, Zhendong, et al.
Pubblicazione: (2025)
Revisiting LRP: Positional Attribution as the Missing Ingredient for Transformer Explainability
di: Bakish, Yarden, et al.
Pubblicazione: (2025)
di: Bakish, Yarden, et al.
Pubblicazione: (2025)
QuAnTS: Question Answering on Time Series
di: Divo, Felix, et al.
Pubblicazione: (2025)
di: Divo, Felix, et al.
Pubblicazione: (2025)
Latent Instruction Representation Alignment: defending against jailbreaks, backdoors and undesired knowledge in LLMs
di: Easley, Eric, et al.
Pubblicazione: (2026)
di: Easley, Eric, et al.
Pubblicazione: (2026)
Descriptive Collision in Sparse Autoencoder Auto-Interpretability: When One Explanation Describes Many Features
di: McCann, Jordan F.
Pubblicazione: (2026)
di: McCann, Jordan F.
Pubblicazione: (2026)
Why LoRA Resists Label Noise: A Theoretical Framework for Noise-Robust Parameter-Efficient Fine-Tuning
di: Steele, Brady
Pubblicazione: (2026)
di: Steele, Brady
Pubblicazione: (2026)
TensorLens: End-to-End Transformer Analysis via High-Order Attention Tensors
di: Atad, Ido Andrew, et al.
Pubblicazione: (2026)
di: Atad, Ido Andrew, et al.
Pubblicazione: (2026)
Scaling Trends for Multi-Hop Contextual Reasoning in Mid-Scale Language Models
di: Steele, Brady, et al.
Pubblicazione: (2026)
di: Steele, Brady, et al.
Pubblicazione: (2026)
On Semantic Loss Fine-Tuning Approach for Preventing Model Collapse in Causal Reasoning
di: Deshmukh, Pratik, et al.
Pubblicazione: (2026)
di: Deshmukh, Pratik, et al.
Pubblicazione: (2026)
Language Models Are Implicitly Continuous
di: Marro, Samuele, et al.
Pubblicazione: (2025)
di: Marro, Samuele, et al.
Pubblicazione: (2025)
Latent Cache Flow: Model-to-Model Communication Without Text
di: Rossi, Maximillian, et al.
Pubblicazione: (2026)
di: Rossi, Maximillian, et al.
Pubblicazione: (2026)
Cognitive Load Limits in Large Language Models: Benchmarking Multi-Hop Reasoning
di: Adapala, Sai Teja Reddy
Pubblicazione: (2025)
di: Adapala, Sai Teja Reddy
Pubblicazione: (2025)
Combining Language and Topic Models for Hierarchical Text Classification
di: Toit, Jaco du, et al.
Pubblicazione: (2025)
di: Toit, Jaco du, et al.
Pubblicazione: (2025)
Advancing Transformer Architecture in Long-Context Large Language Models: A Comprehensive Survey
di: Huang, Yunpeng, et al.
Pubblicazione: (2023)
di: Huang, Yunpeng, et al.
Pubblicazione: (2023)
Rethinking Addressing in Language Models via Contexualized Equivariant Positional Encoding
di: Zhu, Jiajun, et al.
Pubblicazione: (2025)
di: Zhu, Jiajun, et al.
Pubblicazione: (2025)
Recurrent Memory-Augmented Transformers with Chunked Attention for Long-Context Language Modeling
di: Kashyap, Ankit
Pubblicazione: (2025)
di: Kashyap, Ankit
Pubblicazione: (2025)
Kronecker Embeddings: Byte-Level Structured Token Representations for Parameter-Efficient Language Models
di: Shravan, Rohan
Pubblicazione: (2026)
di: Shravan, Rohan
Pubblicazione: (2026)
How Language Models Process Out-of-Distribution Inputs: A Two-Pathway Framework
di: Saghir, Hamidreza
Pubblicazione: (2026)
di: Saghir, Hamidreza
Pubblicazione: (2026)
Overclocking LLM Reasoning: Monitoring and Controlling Thinking Path Lengths in LLMs
di: Eisenstadt, Roy, et al.
Pubblicazione: (2025)
di: Eisenstadt, Roy, et al.
Pubblicazione: (2025)
TIME: Temporally Intelligent Meta-reasoning Engine for Context-Triggered Explicit Reasoning
di: Das, Susmit
Pubblicazione: (2026)
di: Das, Susmit
Pubblicazione: (2026)
CircuitProbe: Predicting Reasoning Circuits in Transformers via Stability Zone Detection
di: Panuganti, Rajkiran
Pubblicazione: (2026)
di: Panuganti, Rajkiran
Pubblicazione: (2026)
Neural Activation Patterns Across Language Model Architectures: A Comprehensive Analysis of Cognitive Task Performance
di: Naser-Moghadasi, Mahdi, et al.
Pubblicazione: (2026)
di: Naser-Moghadasi, Mahdi, et al.
Pubblicazione: (2026)
Future Token Prediction -- Causal Language Modelling with Per-Token Semantic State Vector for Multi-Token Prediction
di: Walker, Nicholas
Pubblicazione: (2024)
di: Walker, Nicholas
Pubblicazione: (2024)
How Does Unfaithful Reasoning Emerge from Autoregressive Training? A Study of Synthetic Experiments
di: Wang, Fuxin, et al.
Pubblicazione: (2026)
di: Wang, Fuxin, et al.
Pubblicazione: (2026)
From Syntax to Semantics: Unveiling the Emergence of Chirality in SMILES Translation Models
di: Li, Zehao, et al.
Pubblicazione: (2026)
di: Li, Zehao, et al.
Pubblicazione: (2026)
Your Pretrained Model Tells the Difficulty Itself: A Self-Adaptive Curriculum Learning Paradigm for Natural Language Understanding
di: Feng, Qi, et al.
Pubblicazione: (2025)
di: Feng, Qi, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Reasoning Large Language Model Errors Arise from Hallucinating Critical Problem Features
di: Heyman, Alex, et al.
Pubblicazione: (2025) -
Entropy-Based Measurement of Value Drift and Alignment Work in Large Language Models
di: Fadli, Samih
Pubblicazione: (2025) -
Merge-Bench: Resolve Merge Conflicts with Large Language Models
di: Schesch, Benedikt, et al.
Pubblicazione: (2026) -
The Geometry of Thought: How Scale Restructures Reasoning In Large Language Models
di: Anderson, Samuel Cyrenius
Pubblicazione: (2026) -
Transformer Scalability Crisis: The First Comprehensive Empirical Analysis of Performance Walls in Modern Language Models
di: Moghadasi, Mahdi Naser, et al.
Pubblicazione: (2026)