Continuity and Isolation Lead to Doubts or Dilemmas in Large Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Pasten, Hector, Urrutia, Felipe, Jimenez, Hector, Calderon, Cristian B., Rojas, Cristóbal, Kozachinskiy, Alexander |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Decoupling Positional and Symbolic Attention Behavior in Transformers
par: Urrutia, Felipe, et autres
Publié: (2025)
par: Urrutia, Felipe, et autres
Publié: (2025)
Strassen Attention, Split VC Dimension and Compositionality in Transformers
par: Kozachinskiy, Alexander, et autres
Publié: (2025)
par: Kozachinskiy, Alexander, et autres
Publié: (2025)
Lower bounds on transformers with infinite precision
par: Kozachinskiy, Alexander
Publié: (2024)
par: Kozachinskiy, Alexander
Publié: (2024)
Positional versus Symbolic Attention Heads: Learning Dynamics, RoPE Geometry, and Length Generalization
par: Urrutia, Felipe, et autres
Publié: (2026)
par: Urrutia, Felipe, et autres
Publié: (2026)
Message Passing on the Edge: Towards Scalable and Expressive GNNs
par: Barceló, Pablo, et autres
Publié: (2025)
par: Barceló, Pablo, et autres
Publié: (2025)
A completely uniform transformer for parity
par: Kozachinskiy, Alexander, et autres
Publié: (2025)
par: Kozachinskiy, Alexander, et autres
Publié: (2025)
Simple online learning with consistent oracle
par: Kozachinskiy, Alexander, et autres
Publié: (2023)
par: Kozachinskiy, Alexander, et autres
Publié: (2023)
Ehrenfeucht-Haussler Rank and Chain of Thought
par: Barceló, Pablo, et autres
Publié: (2025)
par: Barceló, Pablo, et autres
Publié: (2025)
Parity, Sensitivity, and Transformers
par: Kozachinskiy, Alexander, et autres
Publié: (2026)
par: Kozachinskiy, Alexander, et autres
Publié: (2026)
On the Limits of Self-Improving in Large Language Models: The Singularity Is Not Near Without Symbolic Model Synthesis
par: Zenil, Hector
Publié: (2026)
par: Zenil, Hector
Publié: (2026)
On Token's Dilemma: Dynamic MoE with Drift-Aware Token Assignment for Continual Learning of Large Vision Language Models
par: Zhao, Chongyang, et autres
Publié: (2026)
par: Zhao, Chongyang, et autres
Publié: (2026)
Risk-Sensitive RL for Alleviating Exploration Dilemmas in Large Language Models
par: Jiang, Yuhua, et autres
Publié: (2025)
par: Jiang, Yuhua, et autres
Publié: (2025)
Optimal bounds for dissatisfaction in perpetual voting
par: Kozachinskiy, Alexander, et autres
Publié: (2024)
par: Kozachinskiy, Alexander, et autres
Publié: (2024)
On dimensionality of feature vectors in MPNNs
par: Bravo, César, et autres
Publié: (2024)
par: Bravo, César, et autres
Publié: (2024)
Explaining k-Nearest Neighbors: Abductive and Counterfactual Explanations
par: Barceló, Pablo, et autres
Publié: (2025)
par: Barceló, Pablo, et autres
Publié: (2025)
Shared Doubt: Zero-shot Cross-Lingual Confidence Estimation for Language Models
par: Kyriakou, Athina, et autres
Publié: (2026)
par: Kyriakou, Athina, et autres
Publié: (2026)
Language Generation: Complexity Barriers and Implications for Learning
par: Arenas, Marcelo, et autres
Publié: (2025)
par: Arenas, Marcelo, et autres
Publié: (2025)
Meta-Cognitive Reinforcement Learning with Self-Doubt and Recovery
par: Zhang, Zhipeng, et autres
Publié: (2026)
par: Zhang, Zhipeng, et autres
Publié: (2026)
Concisely Explaining the Doubt: Minimum-Size Abductive Explanations for Linear Models with a Reject Option
par: Fernandes, Gleilson Pedro, et autres
Publié: (2026)
par: Fernandes, Gleilson Pedro, et autres
Publié: (2026)
Echoes of Socratic Doubt: Embracing Uncertainty in Calibrated Evidential Reinforcement Learning
par: Stutts, Alex Christopher, et autres
Publié: (2024)
par: Stutts, Alex Christopher, et autres
Publié: (2024)
The Constitutional Controller: Doubt-Calibrated Steering of Compliant Agents
par: Kohaut, Simon, et autres
Publié: (2025)
par: Kohaut, Simon, et autres
Publié: (2025)
STABLE: Gated Continual Learning for Large Language Models
par: Hoy, William, et autres
Publié: (2025)
par: Hoy, William, et autres
Publié: (2025)
Routing-Based Continual Learning for Multimodal Large Language Models
par: Mohta, Jay, et autres
Publié: (2025)
par: Mohta, Jay, et autres
Publié: (2025)
The Data Addition Dilemma
par: Shen, Judy Hanwen, et autres
Publié: (2024)
par: Shen, Judy Hanwen, et autres
Publié: (2024)
JumpLoRA: Sparse Adapters for Continual Learning in Large Language Models
par: Dragomir, Alexandra, et autres
Publié: (2026)
par: Dragomir, Alexandra, et autres
Publié: (2026)
Why Keep Your Doubts to Yourself? Trading Visual Uncertainties in Multi-Agent Bandit Systems
par: Zhang, Jusheng, et autres
Publié: (2026)
par: Zhang, Jusheng, et autres
Publié: (2026)
CAMEL: Continuous Action Masking Enabled by Large Language Models for Reinforcement Learning
par: Zhao, Yanxiao, et autres
Publié: (2025)
par: Zhao, Yanxiao, et autres
Publié: (2025)
When Continue Learning Meets Multimodal Large Language Model: A Survey
par: Huo, Yukang, et autres
Publié: (2025)
par: Huo, Yukang, et autres
Publié: (2025)
The Chicken and Egg Dilemma: Co-optimizing Data and Model Configurations for LLMs
par: Chen, Zhiliang, et autres
Publié: (2026)
par: Chen, Zhiliang, et autres
Publié: (2026)
Learning Generalized Policies for Fully Observable Non-Deterministic Planning Domains
par: Hofmann, Till, et autres
Publié: (2024)
par: Hofmann, Till, et autres
Publié: (2024)
Are Large-Language Models Graph Algorithmic Reasoners?
par: Taylor, Alexander K, et autres
Publié: (2024)
par: Taylor, Alexander K, et autres
Publié: (2024)
Functional Component Ablation Reveals Specialization Patterns in Hybrid Language Model Architectures
par: Borobia, Hector, et autres
Publié: (2026)
par: Borobia, Hector, et autres
Publié: (2026)
When Less is More: 8-bit Quantization Improves Continual Learning in Large Language Models
par: Zhang, Michael S., et autres
Publié: (2025)
par: Zhang, Michael S., et autres
Publié: (2025)
Robust Uncertainty Quantification for Self-Evolving Large Language Models via Continual Domain Pretraining
par: Zhou, Xiaofan, et autres
Publié: (2025)
par: Zhou, Xiaofan, et autres
Publié: (2025)
Multi-Level Safety Continual Projection for Fine-Tuned Large Language Models without Retraining
par: Han, Bing, et autres
Publié: (2025)
par: Han, Bing, et autres
Publié: (2025)
COPAL: Continual Pruning in Large Language Generative Models
par: Malla, Srikanth, et autres
Publié: (2024)
par: Malla, Srikanth, et autres
Publié: (2024)
SmoothLLM: Defending Large Language Models Against Jailbreaking Attacks
par: Robey, Alexander, et autres
Publié: (2023)
par: Robey, Alexander, et autres
Publié: (2023)
Jailbreaking Black Box Large Language Models in Twenty Queries
par: Chao, Patrick, et autres
Publié: (2023)
par: Chao, Patrick, et autres
Publié: (2023)
Learning Dynamics in Continual Pre-Training for Large Language Models
par: Wang, Xingjin, et autres
Publié: (2025)
par: Wang, Xingjin, et autres
Publié: (2025)
Continual Learning of Large Language Models: A Comprehensive Survey
par: Shi, Haizhou, et autres
Publié: (2024)
par: Shi, Haizhou, et autres
Publié: (2024)
Documents similaires
-
Decoupling Positional and Symbolic Attention Behavior in Transformers
par: Urrutia, Felipe, et autres
Publié: (2025) -
Strassen Attention, Split VC Dimension and Compositionality in Transformers
par: Kozachinskiy, Alexander, et autres
Publié: (2025) -
Lower bounds on transformers with infinite precision
par: Kozachinskiy, Alexander
Publié: (2024) -
Positional versus Symbolic Attention Heads: Learning Dynamics, RoPE Geometry, and Length Generalization
par: Urrutia, Felipe, et autres
Publié: (2026) -
Message Passing on the Edge: Towards Scalable and Expressive GNNs
par: Barceló, Pablo, et autres
Publié: (2025)