PYRA: Parallel Yielding Re-Activation for Training-Inference Efficient Task Adaptation
Fuente:
arXiv
Guardado en:
| Autores principales: | Xiong, Yizhe, Chen, Hui, Hao, Tianxiang, Lin, Zijia, Han, Jungong, Zhang, Yuesong, Wang, Guoxin, Bao, Yongjun, Ding, Guiguang |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Neutralizing Token Aggregation via Information Augmentation for Efficient Test-Time Adaptation
por: Xiong, Yizhe, et al.
Publicado: (2025)
por: Xiong, Yizhe, et al.
Publicado: (2025)
Learn from the Learnt: Source-Free Active Domain Adaptation via Contrastive Sampling and Visual Persistence
por: Lyu, Mengyao, et al.
Publicado: (2024)
por: Lyu, Mengyao, et al.
Publicado: (2024)
UniAttn: Reducing Inference Costs via Softmax Unification for Post-Training LLMs
por: Xiong, Yizhe, et al.
Publicado: (2025)
por: Xiong, Yizhe, et al.
Publicado: (2025)
[CLS] Token Tells Everything Needed for Training-free Efficient MLLMs
por: Wang, Ao, et al.
Publicado: (2024)
por: Wang, Ao, et al.
Publicado: (2024)
CAIT: Triple-Win Compression towards High Accuracy, Fast Inference, and Favorable Transferability For ViTs
por: Wang, Ao, et al.
Publicado: (2023)
por: Wang, Ao, et al.
Publicado: (2023)
RepViT-SAM: Towards Real-Time Segmenting Anything
por: Wang, Ao, et al.
Publicado: (2023)
por: Wang, Ao, et al.
Publicado: (2023)
LSNet: See Large, Focus Small
por: Wang, Ao, et al.
Publicado: (2025)
por: Wang, Ao, et al.
Publicado: (2025)
RepViT: Revisiting Mobile CNN From ViT Perspective
por: Wang, Ao, et al.
Publicado: (2023)
por: Wang, Ao, et al.
Publicado: (2023)
Advancing Reliable Test-Time Adaptation of Vision-Language Models under Visual Variations
por: Liang, Yiwen, et al.
Publicado: (2025)
por: Liang, Yiwen, et al.
Publicado: (2025)
Towards Efficient Vision-Language Tuning: More Information Density, More Generalizability
por: Hao, Tianxiang, et al.
Publicado: (2023)
por: Hao, Tianxiang, et al.
Publicado: (2023)
YOLOE: Real-Time Seeing Anything
por: Wang, Ao, et al.
Publicado: (2025)
por: Wang, Ao, et al.
Publicado: (2025)
Finedeep: Mitigating Sparse Activation in Dense LLMs via Multi-Layer Fine-Grained Experts
por: Pan, Leiyu, et al.
Publicado: (2025)
por: Pan, Leiyu, et al.
Publicado: (2025)
Scaffold-BPE: Enhancing Byte Pair Encoding for Large Language Models with Simple and Effective Scaffold Token Removal
por: Lian, Haoran, et al.
Publicado: (2024)
por: Lian, Haoran, et al.
Publicado: (2024)
YOLOv10: Real-Time End-to-End Object Detection
por: Wang, Ao, et al.
Publicado: (2024)
por: Wang, Ao, et al.
Publicado: (2024)
Fast Quiet-STaR: Thinking Without Thought Tokens
por: Huang, Wei, et al.
Publicado: (2025)
por: Huang, Wei, et al.
Publicado: (2025)
Temporal Scaling Law for Large Language Models
por: Xiong, Yizhe, et al.
Publicado: (2024)
por: Xiong, Yizhe, et al.
Publicado: (2024)
DSMoE: Matrix-Partitioned Experts with Dynamic Routing for Computation-Efficient Dense LLMs
por: Lv, Minxuan, et al.
Publicado: (2025)
por: Lv, Minxuan, et al.
Publicado: (2025)
PrefixKV: Adaptive Prefix KV Cache is What Vision Instruction-Following Models Need for Efficient Generation
por: Wang, Ao, et al.
Publicado: (2024)
por: Wang, Ao, et al.
Publicado: (2024)
Context Enhancement with Reconstruction as Sequence for Unified Unsupervised Anomaly Detection
por: Yang, Hui-Yue, et al.
Publicado: (2024)
por: Yang, Hui-Yue, et al.
Publicado: (2024)
LBPE: Long-token-first Tokenization to Improve Large Language Models
por: Lian, Haoran, et al.
Publicado: (2024)
por: Lian, Haoran, et al.
Publicado: (2024)
TempMe: Video Temporal Token Merging for Efficient Text-Video Retrieval
por: Shen, Leqi, et al.
Publicado: (2024)
por: Shen, Leqi, et al.
Publicado: (2024)
YOLO-UniOW: Efficient Universal Open-World Object Detection
por: Liu, Lihao, et al.
Publicado: (2024)
por: Liu, Lihao, et al.
Publicado: (2024)
Tracking and Segmenting Anything in Any Modality
por: Zhang, Tianlu, et al.
Publicado: (2025)
por: Zhang, Tianlu, et al.
Publicado: (2025)
Quantized Prompt for Efficient Generalization of Vision-Language Models
por: Hao, Tianxiang, et al.
Publicado: (2024)
por: Hao, Tianxiang, et al.
Publicado: (2024)
DiscoVLA: Discrepancy Reduction in Vision, Language, and Alignment for Parameter-Efficient Video-Text Retrieval
por: Shen, Leqi, et al.
Publicado: (2025)
por: Shen, Leqi, et al.
Publicado: (2025)
CartesianMoE: Boosting Knowledge Sharing among Experts via Cartesian Product Routing in Mixture-of-Experts
por: Su, Zhenpeng, et al.
Publicado: (2024)
por: Su, Zhenpeng, et al.
Publicado: (2024)
Promptable Anomaly Segmentation with SAM Through Self-Perception Tuning
por: Yang, Hui-Yue, et al.
Publicado: (2024)
por: Yang, Hui-Yue, et al.
Publicado: (2024)
AdaTP: Attention-Debiased Token Pruning for Video Large Language Models
por: Sun, Fengyuan, et al.
Publicado: (2025)
por: Sun, Fengyuan, et al.
Publicado: (2025)
MaskMoE: Boosting Token-Level Learning via Routing Mask in Mixture-of-Experts
por: Su, Zhenpeng, et al.
Publicado: (2024)
por: Su, Zhenpeng, et al.
Publicado: (2024)
Breaking the Stage Barrier: A Novel Single-Stage Approach to Long Context Extension for Large Language Models
por: Lian, Haoran, et al.
Publicado: (2024)
por: Lian, Haoran, et al.
Publicado: (2024)
LLMI3D: MLLM-based 3D Perception from a Single 2D Image
por: Yang, Fan, et al.
Publicado: (2024)
por: Yang, Fan, et al.
Publicado: (2024)
PruneHal: Reducing Hallucinations in Multi-modal Large Language Models through Adaptive KV Cache Pruning
por: Sun, Fengyuan, et al.
Publicado: (2025)
por: Sun, Fengyuan, et al.
Publicado: (2025)
Cream of the Crop: Harvesting Rich, Scalable and Transferable Multi-Modal Data for Instruction Fine-Tuning
por: Lyu, Mengyao, et al.
Publicado: (2025)
por: Lyu, Mengyao, et al.
Publicado: (2025)
More is Better: Deep Domain Adaptation with Multiple Sources
por: Zhao, Sicheng, et al.
Publicado: (2024)
por: Zhao, Sicheng, et al.
Publicado: (2024)
One-Dimensional Adapter to Rule Them All: Concepts, Diffusion Models and Erasing Applications
por: Lyu, Mengyao, et al.
Publicado: (2023)
por: Lyu, Mengyao, et al.
Publicado: (2023)
MiLe Loss: a New Entropy-Weighed Loss for Mitigating the Bias of Learning Difficulties in Large Language Models
por: Su, Zhenpeng, et al.
Publicado: (2023)
por: Su, Zhenpeng, et al.
Publicado: (2023)
A Parallel Alternative for Energy-Efficient Neural Network Training and Inferencing
por: Seal, Sudip K., et al.
Publicado: (2025)
por: Seal, Sudip K., et al.
Publicado: (2025)
Re-Prompting SAM 3 via Object Retrieval: 3rd of the 5th PVUW MOSE Track
por: Gao, Mingqi, et al.
Publicado: (2026)
por: Gao, Mingqi, et al.
Publicado: (2026)
Efficient Learned Image Compression without Entropy Coding
por: Cao, Hao, et al.
Publicado: (2026)
por: Cao, Hao, et al.
Publicado: (2026)
HAP: Hybrid Adaptive Parallelism for Efficient Mixture-of-Experts Inference
por: Lin, Haoran, et al.
Publicado: (2025)
por: Lin, Haoran, et al.
Publicado: (2025)
Ejemplares similares
-
Neutralizing Token Aggregation via Information Augmentation for Efficient Test-Time Adaptation
por: Xiong, Yizhe, et al.
Publicado: (2025) -
Learn from the Learnt: Source-Free Active Domain Adaptation via Contrastive Sampling and Visual Persistence
por: Lyu, Mengyao, et al.
Publicado: (2024) -
UniAttn: Reducing Inference Costs via Softmax Unification for Post-Training LLMs
por: Xiong, Yizhe, et al.
Publicado: (2025) -
[CLS] Token Tells Everything Needed for Training-free Efficient MLLMs
por: Wang, Ao, et al.
Publicado: (2024) -
CAIT: Triple-Win Compression towards High Accuracy, Fast Inference, and Favorable Transferability For ViTs
por: Wang, Ao, et al.
Publicado: (2023)