EquivPruner: Boosting Efficiency and Quality in LLM-Based Search via Action Pruning
Fuente:
arXiv
Salvato in:
| Autori principali: | Liu, Jiawei, Chen, Qisi, Zhang, Jianshu, Liu, Quan, Lian, Defu |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Boosting Long-Context Management via Query-Guided Activation Refilling
di: Qian, Hongjin, et al.
Pubblicazione: (2024)
di: Qian, Hongjin, et al.
Pubblicazione: (2024)
Adapt-Pruner: Adaptive Structural Pruning for Efficient Small Language Model Training
di: Pan, Rui, et al.
Pubblicazione: (2025)
di: Pan, Rui, et al.
Pubblicazione: (2025)
GradPruner: Gradient-Guided Layer Pruning Enabling Efficient Fine-Tuning and Inference for LLMs
di: Huang, Wei, et al.
Pubblicazione: (2026)
di: Huang, Wei, et al.
Pubblicazione: (2026)
MemoRAG: Boosting Long Context Processing with Global Memory-Enhanced Retrieval Augmentation
di: Qian, Hongjin, et al.
Pubblicazione: (2024)
di: Qian, Hongjin, et al.
Pubblicazione: (2024)
MoE-Pruner: Pruning Mixture-of-Experts Large Language Model using the Hints from Its Router
di: Xie, Yanyue, et al.
Pubblicazione: (2024)
di: Xie, Yanyue, et al.
Pubblicazione: (2024)
Fewer is More: Boosting LLM Reasoning with Reinforced Context Pruning
di: Huang, Xijie, et al.
Pubblicazione: (2023)
di: Huang, Xijie, et al.
Pubblicazione: (2023)
Satori: Reinforcement Learning with Chain-of-Action-Thought Enhances LLM Reasoning via Autoregressive Search
di: Shen, Maohao, et al.
Pubblicazione: (2025)
di: Shen, Maohao, et al.
Pubblicazione: (2025)
UniMEL: A Unified Framework for Multimodal Entity Linking with Large Language Models
di: Qi, Liu, et al.
Pubblicazione: (2024)
di: Qi, Liu, et al.
Pubblicazione: (2024)
Optima: Optimizing Effectiveness and Efficiency for LLM-Based Multi-Agent System
di: Chen, Weize, et al.
Pubblicazione: (2024)
di: Chen, Weize, et al.
Pubblicazione: (2024)
THOR: Tool-Integrated Hierarchical Optimization via RL for Mathematical Reasoning
di: Chang, Qikai, et al.
Pubblicazione: (2025)
di: Chang, Qikai, et al.
Pubblicazione: (2025)
Enhancing the Geometric Problem-Solving Ability of Multimodal LLMs via Symbolic-Neural Integration
di: Pan, Yicheng, et al.
Pubblicazione: (2025)
di: Pan, Yicheng, et al.
Pubblicazione: (2025)
Re-Search for The Truth: Multi-round Retrieval-augmented Large Language Models are Strong Fake News Detectors
di: Li, Guanghua, et al.
Pubblicazione: (2024)
di: Li, Guanghua, et al.
Pubblicazione: (2024)
Understanding the planning of LLM agents: A survey
di: Huang, Xu, et al.
Pubblicazione: (2024)
di: Huang, Xu, et al.
Pubblicazione: (2024)
EvoP: Robust LLM Inference via Evolutionary Pruning
di: Wu, Shangyu, et al.
Pubblicazione: (2025)
di: Wu, Shangyu, et al.
Pubblicazione: (2025)
Pruning via Merging: Compressing LLMs via Manifold Alignment Based Layer Merging
di: Liu, Deyuan, et al.
Pubblicazione: (2024)
di: Liu, Deyuan, et al.
Pubblicazione: (2024)
CoSteer: Collaborative Decoding-Time Personalization via Local Delta Steering
di: Lv, Hang, et al.
Pubblicazione: (2025)
di: Lv, Hang, et al.
Pubblicazione: (2025)
M3-Embedding: Multi-Linguality, Multi-Functionality, Multi-Granularity Text Embeddings Through Self-Knowledge Distillation
di: Chen, Jianlv, et al.
Pubblicazione: (2024)
di: Chen, Jianlv, et al.
Pubblicazione: (2024)
Understanding Privacy Risks of Embeddings Induced by Large Language Models
di: Zhu, Zhihao, et al.
Pubblicazione: (2024)
di: Zhu, Zhihao, et al.
Pubblicazione: (2024)
CARFT: Boosting LLM Reasoning via Contrastive Learning with Annotated Chain-of-Thought-based Reinforced Fine-Tuning
di: Zhu, Wenqiao, et al.
Pubblicazione: (2025)
di: Zhu, Wenqiao, et al.
Pubblicazione: (2025)
Mitigate Negative Transfer with Similarity Heuristic Lifelong Prompt Tuning
di: Wu, Chenyuan, et al.
Pubblicazione: (2024)
di: Wu, Chenyuan, et al.
Pubblicazione: (2024)
Improving Data Efficiency via Curating LLM-Driven Rating Systems
di: Pang, Jinlong, et al.
Pubblicazione: (2024)
di: Pang, Jinlong, et al.
Pubblicazione: (2024)
SafeSearch: Automated Red-Teaming of LLM-Based Search Agents
di: Dong, Jianshuo, et al.
Pubblicazione: (2025)
di: Dong, Jianshuo, et al.
Pubblicazione: (2025)
Retro*: Optimizing LLMs for Reasoning-Intensive Document Retrieval
di: Lan, Junwei, et al.
Pubblicazione: (2025)
di: Lan, Junwei, et al.
Pubblicazione: (2025)
RAPID: Efficient Retrieval-Augmented Long Text Generation with Writing Planning and Information Discovery
di: Gu, Hongchao, et al.
Pubblicazione: (2025)
di: Gu, Hongchao, et al.
Pubblicazione: (2025)
BlockPruner: Fine-grained Pruning for Large Language Models
di: Zhong, Longguang, et al.
Pubblicazione: (2024)
di: Zhong, Longguang, et al.
Pubblicazione: (2024)
An Enhanced Prompt-Based LLM Reasoning Scheme via Knowledge Graph-Integrated Collaboration
di: Li, Yihao, et al.
Pubblicazione: (2024)
di: Li, Yihao, et al.
Pubblicazione: (2024)
C-Pack: Packed Resources For General Chinese Embeddings
di: Xiao, Shitao, et al.
Pubblicazione: (2023)
di: Xiao, Shitao, et al.
Pubblicazione: (2023)
Boosting LLM via Learning from Data Iteratively and Selectively
di: Jia, Qi, et al.
Pubblicazione: (2024)
di: Jia, Qi, et al.
Pubblicazione: (2024)
Text Quality-Based Pruning for Efficient Training of Language Models
di: Sharma, Vasu, et al.
Pubblicazione: (2024)
di: Sharma, Vasu, et al.
Pubblicazione: (2024)
Rethinking Layer Redundancy: Calibration Matters More Than Search in LLM Depth Pruning
di: Kim, Minkyu, et al.
Pubblicazione: (2026)
di: Kim, Minkyu, et al.
Pubblicazione: (2026)
Advancing and Benchmarking Personalized Tool Invocation for LLMs
di: Huang, Xu, et al.
Pubblicazione: (2025)
di: Huang, Xu, et al.
Pubblicazione: (2025)
ToolACE-DEV: Self-Improving Tool Learning via Decomposition and EVolution
di: Huang, Xu, et al.
Pubblicazione: (2025)
di: Huang, Xu, et al.
Pubblicazione: (2025)
DocMamba: Efficient Document Pre-training with State Space Model
di: Hu, Pengfei, et al.
Pubblicazione: (2024)
di: Hu, Pengfei, et al.
Pubblicazione: (2024)
LLM-Agnostic Semantic Representation Attack
di: Lian, Jiawei, et al.
Pubblicazione: (2026)
di: Lian, Jiawei, et al.
Pubblicazione: (2026)
HawkBench: Investigating Resilience of RAG Methods on Stratified Information-Seeking Tasks
di: Qian, Hongjin, et al.
Pubblicazione: (2025)
di: Qian, Hongjin, et al.
Pubblicazione: (2025)
CommonIT: Commonality-Aware Instruction Tuning for Large Language Models via Data Partitions
di: Rao, Jun, et al.
Pubblicazione: (2024)
di: Rao, Jun, et al.
Pubblicazione: (2024)
MaskPrune: Mask-based LLM Pruning for Layer-wise Uniform Structures
di: Qin, Jiayu, et al.
Pubblicazione: (2025)
di: Qin, Jiayu, et al.
Pubblicazione: (2025)
Sparsity Induction for Accurate Post-Training Pruning of Large Language Models
di: Jiang, Minhao, et al.
Pubblicazione: (2026)
di: Jiang, Minhao, et al.
Pubblicazione: (2026)
Executable Code Actions Elicit Better LLM Agents
di: Wang, Xingyao, et al.
Pubblicazione: (2024)
di: Wang, Xingyao, et al.
Pubblicazione: (2024)
On the Limitations of Language Targeted Pruning: Investigating the Calibration Language Impact in Multilingual LLM Pruning
di: Kurz, Simon, et al.
Pubblicazione: (2024)
di: Kurz, Simon, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Boosting Long-Context Management via Query-Guided Activation Refilling
di: Qian, Hongjin, et al.
Pubblicazione: (2024) -
Adapt-Pruner: Adaptive Structural Pruning for Efficient Small Language Model Training
di: Pan, Rui, et al.
Pubblicazione: (2025) -
GradPruner: Gradient-Guided Layer Pruning Enabling Efficient Fine-Tuning and Inference for LLMs
di: Huang, Wei, et al.
Pubblicazione: (2026) -
MemoRAG: Boosting Long Context Processing with Global Memory-Enhanced Retrieval Augmentation
di: Qian, Hongjin, et al.
Pubblicazione: (2024) -
MoE-Pruner: Pruning Mixture-of-Experts Large Language Model using the Hints from Its Router
di: Xie, Yanyue, et al.
Pubblicazione: (2024)