Big Reasoning with Small Models: Instruction Retrieval at Inference Time
Fuente:
arXiv
Guardado en:
| Autores principales: | Alkiek, Kenan, Jurgens, David, Vydiswaran, Vinod |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Neurobiber: Fast and Interpretable Stylistic Feature Extraction
por: Alkiek, Kenan, et al.
Publicado: (2025)
por: Alkiek, Kenan, et al.
Publicado: (2025)
Speculative Thinking: Enhancing Small-Model Reasoning with Large Model Guidance at Inference Time
por: Yang, Wang, et al.
Publicado: (2025)
por: Yang, Wang, et al.
Publicado: (2025)
One Model, Many Morals: Uncovering Cross-Linguistic Misalignments in Computational Moral Reasoning
por: Farid, Sualeha, et al.
Publicado: (2025)
por: Farid, Sualeha, et al.
Publicado: (2025)
Small Vocabularies, Big Gains: Pretraining and Tokenization in Time Series Models
por: Roger, Alexis, et al.
Publicado: (2025)
por: Roger, Alexis, et al.
Publicado: (2025)
A Short Survey on Small Reasoning Models: Training, Inference, Applications and Research Directions
por: Wang, Chengyu, et al.
Publicado: (2025)
por: Wang, Chengyu, et al.
Publicado: (2025)
Small Models, Big Results: Achieving Superior Intent Extraction through Decomposition
por: Cohen, Danielle, et al.
Publicado: (2025)
por: Cohen, Danielle, et al.
Publicado: (2025)
Bridging the Reasoning Gap in Vietnamese with Small Language Models via Test-Time Scaling
por: Trung, Bui The, et al.
Publicado: (2026)
por: Trung, Bui The, et al.
Publicado: (2026)
Do LLMs Understand Social Knowledge? Evaluating the Sociability of Large Language Models with SocKET Benchmark
por: Choi, Minje, et al.
Publicado: (2023)
por: Choi, Minje, et al.
Publicado: (2023)
Exploiting Instruction-Following Retrievers for Malicious Information Retrieval
por: BehnamGhader, Parishad, et al.
Publicado: (2025)
por: BehnamGhader, Parishad, et al.
Publicado: (2025)
Small Drafts, Big Verdict: Information-Intensive Visual Reasoning via Speculation
por: Liu, Yuhan, et al.
Publicado: (2025)
por: Liu, Yuhan, et al.
Publicado: (2025)
Reasoning Up the Instruction Ladder for Controllable Language Models
por: Zheng, Zishuo, et al.
Publicado: (2025)
por: Zheng, Zishuo, et al.
Publicado: (2025)
Scaling Reasoning, Losing Control: Evaluating Instruction Following in Large Reasoning Models
por: Fu, Tingchen, et al.
Publicado: (2025)
por: Fu, Tingchen, et al.
Publicado: (2025)
Small Edits, Big Consequences: Telling Good from Bad Robustness in Large Language Models
por: Ismailov, Altynbek, et al.
Publicado: (2025)
por: Ismailov, Altynbek, et al.
Publicado: (2025)
Reasoning or Retrieval? A Study of Answer Attribution on Large Reasoning Models
por: Wang, Yuhui, et al.
Publicado: (2025)
por: Wang, Yuhui, et al.
Publicado: (2025)
LightReasoner: Can Small Language Models Teach Large Language Models Reasoning?
por: Wang, Jingyuan, et al.
Publicado: (2025)
por: Wang, Jingyuan, et al.
Publicado: (2025)
Distilling LLM Agent into Small Models with Retrieval and Code Tools
por: Kang, Minki, et al.
Publicado: (2025)
por: Kang, Minki, et al.
Publicado: (2025)
InfiR : Crafting Effective Small Language Models and Multimodal Small Language Models in Reasoning
por: Xie, Congkai, et al.
Publicado: (2025)
por: Xie, Congkai, et al.
Publicado: (2025)
PhysicsEval: Inference-Time Techniques to Improve the Reasoning Proficiency of Large Language Models on Physics Problems
por: Siddique, Oshayer, et al.
Publicado: (2025)
por: Siddique, Oshayer, et al.
Publicado: (2025)
Efficient Long CoT Reasoning in Small Language Models
por: Wang, Zhaoyang, et al.
Publicado: (2025)
por: Wang, Zhaoyang, et al.
Publicado: (2025)
Distilling Mathematical Reasoning Capabilities into Small Language Models
por: Zhu, Xunyu, et al.
Publicado: (2024)
por: Zhu, Xunyu, et al.
Publicado: (2024)
Modeling Public Perceptions of Science in Media
por: Pei, Jiaxin, et al.
Publicado: (2025)
por: Pei, Jiaxin, et al.
Publicado: (2025)
Retrieval is Not Enough: Enhancing RAG Reasoning through Test-Time Critique and Optimization
por: Wei, Jiaqi, et al.
Publicado: (2025)
por: Wei, Jiaqi, et al.
Publicado: (2025)
Improving Retrieval Augmented Language Model with Self-Reasoning
por: Xia, Yuan, et al.
Publicado: (2024)
por: Xia, Yuan, et al.
Publicado: (2024)
ReasoningGuard: Safeguarding Large Reasoning Models with Inference-time Safety Aha Moments
por: Wang, Yuquan, et al.
Publicado: (2025)
por: Wang, Yuquan, et al.
Publicado: (2025)
Neuro-RIT: Neuron-Guided Instruction Tuning for Robust Retrieval-Augmented Language Model
por: Kim, Jaemin, et al.
Publicado: (2026)
por: Kim, Jaemin, et al.
Publicado: (2026)
RA-DIT: Retrieval-Augmented Dual Instruction Tuning
por: Lin, Xi Victoria, et al.
Publicado: (2023)
por: Lin, Xi Victoria, et al.
Publicado: (2023)
CCQA: Generating Question from Solution Can Improve Inference-Time Reasoning in SLMs
por: Kim, Jin Young, et al.
Publicado: (2025)
por: Kim, Jin Young, et al.
Publicado: (2025)
Decoupling Understanding from Reasoning via Problem Space Mapping for Small-Scale Model Reasoning
por: Wang, Li, et al.
Publicado: (2025)
por: Wang, Li, et al.
Publicado: (2025)
Refine Thought: A Test-Time Inference Method for Embedding Model Reasoning
por: Wang, Guangzhi, et al.
Publicado: (2025)
por: Wang, Guangzhi, et al.
Publicado: (2025)
CounterRefine: Answer-Conditioned Counterevidence Retrieval for Inference-Time Knowledge Repair in Factual Question Answering
por: Huang, Tianyi, et al.
Publicado: (2026)
por: Huang, Tianyi, et al.
Publicado: (2026)
Cluster-R1: Large Reasoning Models Are Instruction-following Clustering Agents
por: Qing, Peijun, et al.
Publicado: (2026)
por: Qing, Peijun, et al.
Publicado: (2026)
Think Before You Retrieve: Learning Test-Time Adaptive Search with Small Language Models
por: Vijay, Supriti, et al.
Publicado: (2025)
por: Vijay, Supriti, et al.
Publicado: (2025)
Abductive Inference in Retrieval-Augmented Language Models: Generating and Validating Missing Premises
por: Lin, Shiyin
Publicado: (2025)
por: Lin, Shiyin
Publicado: (2025)
JudgeBoard: Benchmarking and Enhancing Small Language Models for Reasoning Evaluation
por: Bi, Zhenyu, et al.
Publicado: (2025)
por: Bi, Zhenyu, et al.
Publicado: (2025)
HintMR: Eliciting Stronger Mathematical Reasoning in Small Language Models
por: Hossain, Jawad, et al.
Publicado: (2026)
por: Hossain, Jawad, et al.
Publicado: (2026)
HIRAG: Hierarchical-Thought Instruction-Tuning Retrieval-Augmented Generation
por: Jiao, YiHan, et al.
Publicado: (2025)
por: Jiao, YiHan, et al.
Publicado: (2025)
Small Updates, Big Doubts: Does Parameter-Efficient Fine-tuning Enhance Hallucination Detection ?
por: Hu, Xu, et al.
Publicado: (2026)
por: Hu, Xu, et al.
Publicado: (2026)
Reasoning in Action: MCTS-Driven Knowledge Retrieval for Large Language Models
por: Liu, Shuqi, et al.
Publicado: (2025)
por: Liu, Shuqi, et al.
Publicado: (2025)
Position: Towards Bidirectional Human-AI Alignment
por: Shen, Hua, et al.
Publicado: (2024)
por: Shen, Hua, et al.
Publicado: (2024)
Audit-of-Understanding: Posterior-Constrained Inference for Mathematical Reasoning in Language Models
por: Abdaljalil, Samir, et al.
Publicado: (2025)
por: Abdaljalil, Samir, et al.
Publicado: (2025)
Ejemplares similares
-
Neurobiber: Fast and Interpretable Stylistic Feature Extraction
por: Alkiek, Kenan, et al.
Publicado: (2025) -
Speculative Thinking: Enhancing Small-Model Reasoning with Large Model Guidance at Inference Time
por: Yang, Wang, et al.
Publicado: (2025) -
One Model, Many Morals: Uncovering Cross-Linguistic Misalignments in Computational Moral Reasoning
por: Farid, Sualeha, et al.
Publicado: (2025) -
Small Vocabularies, Big Gains: Pretraining and Tokenization in Time Series Models
por: Roger, Alexis, et al.
Publicado: (2025) -
A Short Survey on Small Reasoning Models: Training, Inference, Applications and Research Directions
por: Wang, Chengyu, et al.
Publicado: (2025)