Hecto: Modular Sparse Experts for Adaptive and Interpretable Reasoning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Pandey, Sanskar, Chopra, Ruhaan, Bhat, Saad Murtaza, Abhyudaya, Ark |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Beacon: Single-Turn Diagnosis and Mitigation of Latent Sycophancy in Large Language Models
par: Pandey, Sanskar, et autres
Publié: (2025)
par: Pandey, Sanskar, et autres
Publié: (2025)
A Mechanistic Investigation of Supervised Fine Tuning
par: Chopra, Ruhaan
Publié: (2026)
par: Chopra, Ruhaan
Publié: (2026)
Unlocking Generalization for Robotics via Modularity and Scale
par: Dalal, Murtaza
Publié: (2025)
par: Dalal, Murtaza
Publié: (2025)
Retro-Expert: Collaborative Reasoning for Interpretable Retrosynthesis
par: Li, Xinyi, et autres
Publié: (2025)
par: Li, Xinyi, et autres
Publié: (2025)
Forward versus Backward: Comparing Reasoning Objectives in Direct Preference Optimization
par: Nikzad, Murtaza, et autres
Publié: (2026)
par: Nikzad, Murtaza, et autres
Publié: (2026)
Logical Lease Litigation: Prolog and LLMs for Rental Law Compliance in New York
par: Sehgal, Sanskar, et autres
Publié: (2025)
par: Sehgal, Sanskar, et autres
Publié: (2025)
Chronocept: Instilling a Sense of Time in Machines
par: Goel, Krish, et autres
Publié: (2025)
par: Goel, Krish, et autres
Publié: (2025)
Think Just Enough: Sequence-Level Entropy as a Confidence Signal for LLM Reasoning
par: Sharma, Aman, et autres
Publié: (2025)
par: Sharma, Aman, et autres
Publié: (2025)
Expert-Guided Prompting and Retrieval-Augmented Generation for Emergency Medical Service Question Answering
par: Ge, Xueren, et autres
Publié: (2025)
par: Ge, Xueren, et autres
Publié: (2025)
Building Interpretable Models for Moral Decision-Making
par: Goel, Mayank, et autres
Publié: (2026)
par: Goel, Mayank, et autres
Publié: (2026)
PhyPlan: Compositional and Adaptive Physical Task Reasoning with Physics-Informed Skill Networks for Robot Manipulators
par: Vagadia, Harshil, et autres
Publié: (2024)
par: Vagadia, Harshil, et autres
Publié: (2024)
Mixture of Modular Experts: Distilling Knowledge from a Multilingual Teacher into Specialized Modular Language Models
par: Al-Maamari, Mohammed, et autres
Publié: (2024)
par: Al-Maamari, Mohammed, et autres
Publié: (2024)
Towards Interpretable and Inference-Optimal COT Reasoning with Sparse Autoencoder-Guided Generation
par: Zhao, Daniel, et autres
Publié: (2025)
par: Zhao, Daniel, et autres
Publié: (2025)
Evaluating Consistency and Reasoning Capabilities of Large Language Models
par: Saxena, Yash, et autres
Publié: (2024)
par: Saxena, Yash, et autres
Publié: (2024)
EsoLang-Bench: Evaluating Genuine Reasoning in Large Language Models via Esoteric Programming Languages
par: Sharma, Aman, et autres
Publié: (2026)
par: Sharma, Aman, et autres
Publié: (2026)
Adaptive Graph of Thoughts: Test-Time Adaptive Reasoning Unifying Chain, Tree, and Graph Structures
par: Pandey, Tushar, et autres
Publié: (2025)
par: Pandey, Tushar, et autres
Publié: (2025)
Compositional Neuro-Symbolic Reasoning
par: Das, Anugyan, et autres
Publié: (2026)
par: Das, Anugyan, et autres
Publié: (2026)
Modeling Expert Interactions in Sparse Mixture of Experts via Graph Structures
par: Nguyen-Nhat, Minh-Khoi, et autres
Publié: (2025)
par: Nguyen-Nhat, Minh-Khoi, et autres
Publié: (2025)
Exploring Expert Specialization through Unsupervised Training in Sparse Mixture of Experts
par: Nikolic, Strahinja, et autres
Publié: (2025)
par: Nikolic, Strahinja, et autres
Publié: (2025)
Adaptive Accountability in Networked MAS: Tracing and Mitigating Emergent Norms at Scale
par: Alqithami, Saad
Publié: (2025)
par: Alqithami, Saad
Publié: (2025)
Training Neural Networks for Modularity aids Interpretability
par: Golechha, Satvik, et autres
Publié: (2024)
par: Golechha, Satvik, et autres
Publié: (2024)
Large Population Models
par: Chopra, Ayush
Publié: (2025)
par: Chopra, Ayush
Publié: (2025)
How does Chain of Thought Think? Mechanistic Interpretability of Chain-of-Thought Reasoning with Sparse Autoencoding
par: Chen, Xi, et autres
Publié: (2025)
par: Chen, Xi, et autres
Publié: (2025)
SELFDOUBT: Uncertainty Quantification for Reasoning LLMs via the Hedge-to-Verify Ratio
par: Pandey, Satwik, et autres
Publié: (2026)
par: Pandey, Satwik, et autres
Publié: (2026)
Geometry of Human Perceptual Domains Emerges Transiently in LLM Representations
par: Singh, Simardeep, et autres
Publié: (2026)
par: Singh, Simardeep, et autres
Publié: (2026)
See, Symbolize, Act: Grounding VLMs with Spatial Representations for Better Gameplay
par: Baghel, Ashish, et autres
Publié: (2026)
par: Baghel, Ashish, et autres
Publié: (2026)
RANGER: Sparsely-Gated Mixture-of-Experts with Adaptive Retrieval Re-ranking for Pathology Report Generation
par: Chen, Yixin, et autres
Publié: (2026)
par: Chen, Yixin, et autres
Publié: (2026)
Qwen2.5-32B: Leveraging Self-Consistent Tool-Integrated Reasoning for Bengali Mathematical Olympiad Problem Solving
par: Tahmid, Saad, et autres
Publié: (2024)
par: Tahmid, Saad, et autres
Publié: (2024)
Scalable Multi-Domain Adaptation of Language Models using Modular Experts
par: Schafhalter, Peter, et autres
Publié: (2024)
par: Schafhalter, Peter, et autres
Publié: (2024)
Contrastive Sparse Autoencoders for Interpreting Planning of Chess-Playing Agents
par: Poupart, Yoann
Publié: (2024)
par: Poupart, Yoann
Publié: (2024)
Causal Reasoning in Pieces: Modular In-Context Learning for Causal Discovery
par: Kadziolka, Kacper, et autres
Publié: (2025)
par: Kadziolka, Kacper, et autres
Publié: (2025)
Dense Backpropagation Improves Training for Sparse Mixture-of-Experts
par: Panda, Ashwinee, et autres
Publié: (2025)
par: Panda, Ashwinee, et autres
Publié: (2025)
Learning Like Humans: Advancing LLM Reasoning Capabilities via Adaptive Difficulty Curriculum Learning and Expert-Guided Self-Reformulation
par: Zhang, Enci, et autres
Publié: (2025)
par: Zhang, Enci, et autres
Publié: (2025)
PASS: Probabilistic Agentic Supernet Sampling for Interpretable and Adaptive Chest X-Ray Reasoning
par: Feng, Yushi, et autres
Publié: (2025)
par: Feng, Yushi, et autres
Publié: (2025)
Accelerating Mixture-of-Expert Inference with Adaptive Expert Split Mechanism
par: Yan, Jiaming, et autres
Publié: (2025)
par: Yan, Jiaming, et autres
Publié: (2025)
AdaptStress: Online Adaptive Learning for Interpretable and Personalized Stress Prediction Using Multivariate and Sparse Physiological Signals
par: Wang, Xueyi, et autres
Publié: (2026)
par: Wang, Xueyi, et autres
Publié: (2026)
Don't Blink: Evidence Collapse during Multimodal Reasoning
par: Raghu, Suresh, et autres
Publié: (2026)
par: Raghu, Suresh, et autres
Publié: (2026)
AdaMoE: Token-Adaptive Routing with Null Experts for Mixture-of-Experts Language Models
par: Zeng, Zihao, et autres
Publié: (2024)
par: Zeng, Zihao, et autres
Publié: (2024)
Knowledge-Guided Adaptive Mixture of Experts for Precipitation Prediction
par: Jiang, Chen, et autres
Publié: (2025)
par: Jiang, Chen, et autres
Publié: (2025)
Sparse Models, Sparse Safety: Unsafe Routes in Mixture-of-Experts LLMs
par: Jiang, Yukun, et autres
Publié: (2026)
par: Jiang, Yukun, et autres
Publié: (2026)
Documents similaires
-
Beacon: Single-Turn Diagnosis and Mitigation of Latent Sycophancy in Large Language Models
par: Pandey, Sanskar, et autres
Publié: (2025) -
A Mechanistic Investigation of Supervised Fine Tuning
par: Chopra, Ruhaan
Publié: (2026) -
Unlocking Generalization for Robotics via Modularity and Scale
par: Dalal, Murtaza
Publié: (2025) -
Retro-Expert: Collaborative Reasoning for Interpretable Retrosynthesis
par: Li, Xinyi, et autres
Publié: (2025) -
Forward versus Backward: Comparing Reasoning Objectives in Direct Preference Optimization
par: Nikzad, Murtaza, et autres
Publié: (2026)