BARD: budget-aware reasoning distillation
Fuente:
arXiv
Salvato in:
| Autori principali: | Niu, Lujie, Shen, Lei, Jiang, Yi, Yuan, Caixia, Wang, Xiaojie, Su, Wenbo, zheng, Bo |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Collab-Overcooked: Benchmarking and Evaluating Large Language Models as Collaborative Agents
di: Sun, Haochen, et al.
Pubblicazione: (2025)
di: Sun, Haochen, et al.
Pubblicazione: (2025)
Enhancing Complex Instruction Following for Large Language Models with Mixture-of-Contexts Fine-tuning
di: Lu, Yuheng, et al.
Pubblicazione: (2025)
di: Lu, Yuheng, et al.
Pubblicazione: (2025)
Controlled Low-Rank Adaptation with Subspace Regularization for Continued Training on Large Language Models
di: Lu, Yuheng, et al.
Pubblicazione: (2024)
di: Lu, Yuheng, et al.
Pubblicazione: (2024)
Fine-Tuning is Subgraph Search: A New Lens on Learning Dynamics
di: Li, Yueyan, et al.
Pubblicazione: (2025)
di: Li, Yueyan, et al.
Pubblicazione: (2025)
QAgent: A modular Search Agent with Interactive Query Understanding
di: Jiang, Yi, et al.
Pubblicazione: (2025)
di: Jiang, Yi, et al.
Pubblicazione: (2025)
BARD10: A New Benchmark Reveals Significance of Bangla Stop-Words in Authorship Attribution
di: Moosa, Abdullah Muhammad, et al.
Pubblicazione: (2025)
di: Moosa, Abdullah Muhammad, et al.
Pubblicazione: (2025)
Distributional reasoning in LLMs: Parallel reasoning processes in multi-hop reasoning
di: Shalev, Yuval, et al.
Pubblicazione: (2024)
di: Shalev, Yuval, et al.
Pubblicazione: (2024)
Unified attacks to large language model watermarks: spoofing and scrubbing in unauthorized knowledge distillation
di: Yi, Xin, et al.
Pubblicazione: (2025)
di: Yi, Xin, et al.
Pubblicazione: (2025)
Transferable text data distillation by trajectory matching
di: Yao, Rong, et al.
Pubblicazione: (2025)
di: Yao, Rong, et al.
Pubblicazione: (2025)
CoT-Self-Instruct: Building high-quality synthetic prompts for reasoning and non-reasoning tasks
di: Yu, Ping, et al.
Pubblicazione: (2025)
di: Yu, Ping, et al.
Pubblicazione: (2025)
NAN: A Training-Free Solution to Coefficient Estimation in Model Merging
di: Si, Chongjie, et al.
Pubblicazione: (2025)
di: Si, Chongjie, et al.
Pubblicazione: (2025)
COMI: Coarse-to-fine Context Compression via Marginal Information Gain
di: Tang, Jiwei, et al.
Pubblicazione: (2026)
di: Tang, Jiwei, et al.
Pubblicazione: (2026)
ECKGBench: Benchmarking Large Language Models in E-commerce Leveraging Knowledge Graph
di: Liu, Langming, et al.
Pubblicazione: (2025)
di: Liu, Langming, et al.
Pubblicazione: (2025)
ROSA-Tuning: Enhancing Long-Context Modeling via Suffix Matching
di: Zheng, Yunao, et al.
Pubblicazione: (2026)
di: Zheng, Yunao, et al.
Pubblicazione: (2026)
Lngram: N-gram Conditional Memory in Latent Space
di: Zheng, Yunao, et al.
Pubblicazione: (2026)
di: Zheng, Yunao, et al.
Pubblicazione: (2026)
Geometry-Aware Localized Watermarking for Copyright Protection in Embedding-as-a-Service
di: Chen, Zhimin, et al.
Pubblicazione: (2026)
di: Chen, Zhimin, et al.
Pubblicazione: (2026)
Adaptive Tool Generation with Models as Tools and Reinforcement Learning
di: Wang, Chenpeng, et al.
Pubblicazione: (2025)
di: Wang, Chenpeng, et al.
Pubblicazione: (2025)
Reasoning is about giving reasons
di: Shah, Krunal, et al.
Pubblicazione: (2025)
di: Shah, Krunal, et al.
Pubblicazione: (2025)
Where Matters More Than What: Decoding-aligned KV Cache Compression via Position-aware Pseudo Queries
di: Tian, Zhenxu, et al.
Pubblicazione: (2026)
di: Tian, Zhenxu, et al.
Pubblicazione: (2026)
How to inject knowledge efficiently? Knowledge Infusion Scaling Law for Pre-training Large Language Models
di: Lv, Kangtao, et al.
Pubblicazione: (2025)
di: Lv, Kangtao, et al.
Pubblicazione: (2025)
A Survey on Multi-modal Machine Translation: Tasks, Methods and Challenges
di: Shen, Huangjun, et al.
Pubblicazione: (2024)
di: Shen, Huangjun, et al.
Pubblicazione: (2024)
WebResearcher: Unleashing unbounded reasoning capability in Long-Horizon Agents
di: Qiao, Zile, et al.
Pubblicazione: (2025)
di: Qiao, Zile, et al.
Pubblicazione: (2025)
A Method for Building Large Language Models with Predefined KV Cache Capacity
di: Yi, Zhonghua, et al.
Pubblicazione: (2024)
di: Yi, Zhonghua, et al.
Pubblicazione: (2024)
SafeInt: Shielding Large Language Models from Jailbreak Attacks via Safety-Aware Representation Intervention
di: Wu, Jiaqi, et al.
Pubblicazione: (2025)
di: Wu, Jiaqi, et al.
Pubblicazione: (2025)
Data Distribution Matters: A Data-Centric Perspective on Context Compression for Large Language Model
di: Lv, Kangtao, et al.
Pubblicazione: (2026)
di: Lv, Kangtao, et al.
Pubblicazione: (2026)
Tokenization, Fusion and Decoupling: Bridging the Granularity Mismatch Between Large Language Models and Knowledge Graphs
di: Su, Siyue, et al.
Pubblicazione: (2026)
di: Su, Siyue, et al.
Pubblicazione: (2026)
Read Anywhere Pointed: Layout-aware GUI Screen Reading with Tree-of-Lens Grounding
di: Fan, Yue, et al.
Pubblicazione: (2024)
di: Fan, Yue, et al.
Pubblicazione: (2024)
PretrainRL: Alleviating Factuality Hallucination of Large Language Models at the Beginning
di: Liu, Langming, et al.
Pubblicazione: (2026)
di: Liu, Langming, et al.
Pubblicazione: (2026)
Schema-R1: A reasoning training approach for schema linking in Text-to-SQL Task
di: Wen, Wuzhenghong, et al.
Pubblicazione: (2025)
di: Wen, Wuzhenghong, et al.
Pubblicazione: (2025)
RTLocating: Intent-aware RTL Localization for Hardware Design Iteration
di: Xing, Changwen, et al.
Pubblicazione: (2026)
di: Xing, Changwen, et al.
Pubblicazione: (2026)
Integrating clinical reasoning into large language model-based diagnosis through etiology-aware attention steering
di: Li, Peixian, et al.
Pubblicazione: (2025)
di: Li, Peixian, et al.
Pubblicazione: (2025)
AVG-LLaVA: An Efficient Large Multimodal Model with Adaptive Visual Granularity
di: Lan, Zhibin, et al.
Pubblicazione: (2024)
di: Lan, Zhibin, et al.
Pubblicazione: (2024)
What Makes it Ok to Set a Fire? Iterative Self-distillation of Contexts and Rationales for Disambiguating Defeasible Social and Moral Situations
di: Rao, Kavel, et al.
Pubblicazione: (2023)
di: Rao, Kavel, et al.
Pubblicazione: (2023)
CARE: Cognitive-reasoning Augmented Reinforcement for Emotional Support Conversation
di: Zhu, Jie, et al.
Pubblicazione: (2025)
di: Zhu, Jie, et al.
Pubblicazione: (2025)
LaiDA: Linguistics-aware In-context Learning with Data Augmentation for Metaphor Components Identification
di: Liu, Hongde, et al.
Pubblicazione: (2024)
di: Liu, Hongde, et al.
Pubblicazione: (2024)
Linguini: A benchmark for language-agnostic linguistic reasoning
di: Sánchez, Eduardo, et al.
Pubblicazione: (2024)
di: Sánchez, Eduardo, et al.
Pubblicazione: (2024)
Towards Trustworthy Report Generation: A Deep Research Agent with Progressive Confidence Estimation and Calibration
di: Yuan, Yi, et al.
Pubblicazione: (2026)
di: Yuan, Yi, et al.
Pubblicazione: (2026)
Density-aware Soft Context Compression with Semi-Dynamic Compression Ratio
di: Yu, Yijiong, et al.
Pubblicazione: (2026)
di: Yu, Yijiong, et al.
Pubblicazione: (2026)
KEDRec-LM: A Knowledge-distilled Explainable Drug Recommendation Large Language Model
di: Zhang, Kai, et al.
Pubblicazione: (2025)
di: Zhang, Kai, et al.
Pubblicazione: (2025)
VSP: Assessing the dual challenges of perception and reasoning in spatial planning tasks for VLMs
di: Wu, Qiucheng, et al.
Pubblicazione: (2024)
di: Wu, Qiucheng, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Collab-Overcooked: Benchmarking and Evaluating Large Language Models as Collaborative Agents
di: Sun, Haochen, et al.
Pubblicazione: (2025) -
Enhancing Complex Instruction Following for Large Language Models with Mixture-of-Contexts Fine-tuning
di: Lu, Yuheng, et al.
Pubblicazione: (2025) -
Controlled Low-Rank Adaptation with Subspace Regularization for Continued Training on Large Language Models
di: Lu, Yuheng, et al.
Pubblicazione: (2024) -
Fine-Tuning is Subgraph Search: A New Lens on Learning Dynamics
di: Li, Yueyan, et al.
Pubblicazione: (2025) -
QAgent: A modular Search Agent with Interactive Query Understanding
di: Jiang, Yi, et al.
Pubblicazione: (2025)