Influence Functions for Efficient Data Selection in Reasoning
Fuente:
arXiv
Guardado en:
| Autores principales: | Humane, Prateek, Cudrano, Paolo, Kaplan, Daniel Z., Matteucci, Matteo, Chakraborty, Supriyo, Rish, Irina |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Random Initialization Can't Catch Up: The Advantage of Language Model Transfer for Time Series Forecasting
por: Riachi, Roland, et al.
Publicado: (2025)
por: Riachi, Roland, et al.
Publicado: (2025)
Critique-Guided Distillation for Robust Reasoning via Refinement
por: Kapusuzoglu, Berkcan, et al.
Publicado: (2025)
por: Kapusuzoglu, Berkcan, et al.
Publicado: (2025)
LLM Pretraining Shapes a Generalizable Manifold: Insights into Cross-Modal Transfer to Time Series
por: Roger, Alexis, et al.
Publicado: (2026)
por: Roger, Alexis, et al.
Publicado: (2026)
SPEAR-MM: Selective Parameter Evaluation and Restoration via Model Merging for Efficient Financial LLM Adaptation
por: Kapusuzoglu, Berkcan, et al.
Publicado: (2025)
por: Kapusuzoglu, Berkcan, et al.
Publicado: (2025)
Seq-VCR: Preventing Collapse in Intermediate Transformer Representations for Enhanced Reasoning
por: Arefin, Md Rifat, et al.
Publicado: (2024)
por: Arefin, Md Rifat, et al.
Publicado: (2024)
The Empirical Impact of Forgetting and Transfer in Continual Visual Odometry
por: Cudrano, Paolo, et al.
Publicado: (2024)
por: Cudrano, Paolo, et al.
Publicado: (2024)
Efficient Data Selection at Scale via Influence Distillation
por: Nikdan, Mahdi, et al.
Publicado: (2025)
por: Nikdan, Mahdi, et al.
Publicado: (2025)
Can Shape-Infused Joint Embeddings Improve Image-Conditioned 3D Diffusion?
por: Sbrolli, Cristian, et al.
Publicado: (2024)
por: Sbrolli, Cristian, et al.
Publicado: (2024)
MATES: Model-Aware Data Selection for Efficient Pretraining with Data Influence Models
por: Yu, Zichun, et al.
Publicado: (2024)
por: Yu, Zichun, et al.
Publicado: (2024)
One-Pass to Reason: Token Duplication and Block-Sparse Mask for Efficient Fine-Tuning on Multi-Turn Reasoning
por: Goru, Ritesh, et al.
Publicado: (2025)
por: Goru, Ritesh, et al.
Publicado: (2025)
Small Vocabularies, Big Gains: Pretraining and Tokenization in Time Series Models
por: Roger, Alexis, et al.
Publicado: (2025)
por: Roger, Alexis, et al.
Publicado: (2025)
Leveraging Parameter Space Symmetries for Reasoning Skill Transfer in LLMs
por: Horoi, Stefan, et al.
Publicado: (2025)
por: Horoi, Stefan, et al.
Publicado: (2025)
Routing with Generated Data: Annotation-Free LLM Skill Estimation and Expert Selection
por: Niu, Tianyi, et al.
Publicado: (2026)
por: Niu, Tianyi, et al.
Publicado: (2026)
LLM Surgery: Efficient Knowledge Unlearning and Editing in Large Language Models
por: Veldanda, Akshaj Kumar, et al.
Publicado: (2024)
por: Veldanda, Akshaj Kumar, et al.
Publicado: (2024)
Uncertainty-Aware Answer Selection for Improved Reasoning in Multi-LLM Systems
por: Agrawal, Aakriti, et al.
Publicado: (2025)
por: Agrawal, Aakriti, et al.
Publicado: (2025)
Stabilizing Efficient Reasoning with Step-Level Advantage Selection
por: Wang, Han, et al.
Publicado: (2026)
por: Wang, Han, et al.
Publicado: (2026)
Data Shapley in One Training Run
por: Wang, Jiachen T., et al.
Publicado: (2024)
por: Wang, Jiachen T., et al.
Publicado: (2024)
Group-Level Data Selection for Efficient Pretraining
por: Yu, Zichun, et al.
Publicado: (2025)
por: Yu, Zichun, et al.
Publicado: (2025)
Efficient Uncertainty Estimation for LLM-based Entity Linking in Tabular Data
por: Bono, Carlo, et al.
Publicado: (2025)
por: Bono, Carlo, et al.
Publicado: (2025)
Dynamic Thinking-Token Selection for Efficient Reasoning in Large Reasoning Models
por: Guo, Zhenyuan, et al.
Publicado: (2026)
por: Guo, Zhenyuan, et al.
Publicado: (2026)
Efficient RLVR Training via Weighted Mutual Information Data Selection
por: Zhou, Xinyu, et al.
Publicado: (2026)
por: Zhou, Xinyu, et al.
Publicado: (2026)
Simple and Scalable Strategies to Continually Pre-train Large Language Models
por: Ibrahim, Adam, et al.
Publicado: (2024)
por: Ibrahim, Adam, et al.
Publicado: (2024)
ReGUIDE: Data Efficient GUI Grounding via Spatial Reasoning and Search
por: Lee, Hyunseok, et al.
Publicado: (2025)
por: Lee, Hyunseok, et al.
Publicado: (2025)
ICONS: Influence Consensus for Vision-Language Data Selection
por: Wu, Xindi, et al.
Publicado: (2024)
por: Wu, Xindi, et al.
Publicado: (2024)
UFO-RL: Uncertainty-Focused Optimization for Efficient Reinforcement Learning Data Selection
por: Zhao, Yang, et al.
Publicado: (2025)
por: Zhao, Yang, et al.
Publicado: (2025)
Revisiting Replay and Gradient Alignment for Continual Pre-Training of Large Language Models
por: Abbes, Istabrak, et al.
Publicado: (2025)
por: Abbes, Istabrak, et al.
Publicado: (2025)
Effectively Controlling Reasoning Models through Thinking Intervention
por: Wu, Tong, et al.
Publicado: (2025)
por: Wu, Tong, et al.
Publicado: (2025)
Efficient Reasoning on the Edge
por: Bondarenko, Yelysei, et al.
Publicado: (2026)
por: Bondarenko, Yelysei, et al.
Publicado: (2026)
TabSHAP
por: Chaudhary, Aryan, et al.
Publicado: (2026)
por: Chaudhary, Aryan, et al.
Publicado: (2026)
ComPEFT: Compression for Communicating Parameter Efficient Updates via Sparsification and Quantization
por: Yadav, Prateek, et al.
Publicado: (2023)
por: Yadav, Prateek, et al.
Publicado: (2023)
Towards Adversarially Robust Vision-Language Models: Insights from Design Choices and Prompt Formatting Techniques
por: Bhagwatkar, Rishika, et al.
Publicado: (2024)
por: Bhagwatkar, Rishika, et al.
Publicado: (2024)
When Actions Teach You to Think: Reasoning-Action Synergy via Reinforcement Learning in Conversational Agents
por: Rawat, Mrinal, et al.
Publicado: (2025)
por: Rawat, Mrinal, et al.
Publicado: (2025)
What is Your Data Worth to GPT? LLM-Scale Data Valuation with Influence Functions
por: Choe, Sang Keun, et al.
Publicado: (2024)
por: Choe, Sang Keun, et al.
Publicado: (2024)
On Training Data Influence of GPT Models
por: Chai, Yekun, et al.
Publicado: (2024)
por: Chai, Yekun, et al.
Publicado: (2024)
Large Language Model Data Generation for Enhanced Intent Recognition in German Speech
por: Rosin, Theresa Pekarek, et al.
Publicado: (2025)
por: Rosin, Theresa Pekarek, et al.
Publicado: (2025)
Training Language Models to Reason Efficiently
por: Arora, Daman, et al.
Publicado: (2025)
por: Arora, Daman, et al.
Publicado: (2025)
Efficiently Scaling LLM Reasoning with Certaindex
por: Fu, Yichao, et al.
Publicado: (2024)
por: Fu, Yichao, et al.
Publicado: (2024)
Deep Generative Sampling in the Dual Divergence Space: A Data-efficient & Interpretative Approach for Generative AI
por: Garg, Sahil, et al.
Publicado: (2024)
por: Garg, Sahil, et al.
Publicado: (2024)
AutoTool: Dynamic Tool Selection and Integration for Agentic Reasoning
por: Zou, Jiaru, et al.
Publicado: (2025)
por: Zou, Jiaru, et al.
Publicado: (2025)
Federated Knowledge Recycling: Privacy-Preserving Synthetic Data Sharing
por: Lomurno, Eugenio, et al.
Publicado: (2024)
por: Lomurno, Eugenio, et al.
Publicado: (2024)
Ejemplares similares
-
Random Initialization Can't Catch Up: The Advantage of Language Model Transfer for Time Series Forecasting
por: Riachi, Roland, et al.
Publicado: (2025) -
Critique-Guided Distillation for Robust Reasoning via Refinement
por: Kapusuzoglu, Berkcan, et al.
Publicado: (2025) -
LLM Pretraining Shapes a Generalizable Manifold: Insights into Cross-Modal Transfer to Time Series
por: Roger, Alexis, et al.
Publicado: (2026) -
SPEAR-MM: Selective Parameter Evaluation and Restoration via Model Merging for Efficient Financial LLM Adaptation
por: Kapusuzoglu, Berkcan, et al.
Publicado: (2025) -
Seq-VCR: Preventing Collapse in Intermediate Transformer Representations for Enhanced Reasoning
por: Arefin, Md Rifat, et al.
Publicado: (2024)