Expressive and Generalizable Low-rank Adaptation for Large Models via Slow Cascaded Learning
Fuente:
arXiv
Guardado en:
| Autores principales: | Li, Siwei, Yang, Yifan, Shen, Yifei, Wei, Fangyun, Lu, Zongqing, Qiu, Lili, Yang, Yuqing |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Generalizable Entity Grounding via Assistance of Large Language Model
por: Qi, Lu, et al.
Publicado: (2024)
por: Qi, Lu, et al.
Publicado: (2024)
ReasonGen-R1: CoT for Autoregressive Image generation models through SFT and RL
por: Zhang, Yu, et al.
Publicado: (2025)
por: Zhang, Yu, et al.
Publicado: (2025)
Dynamic Context-oriented Decomposition for Task-aware Low-rank Adaptation with Less Forgetting and Faster Convergence
por: Yang, Yibo, et al.
Publicado: (2025)
por: Yang, Yibo, et al.
Publicado: (2025)
UniCode: Learning a Unified Codebook for Multimodal Large Language Models
por: Zheng, Sipeng, et al.
Publicado: (2024)
por: Zheng, Sipeng, et al.
Publicado: (2024)
AVGen-Bench: A Task-Driven Benchmark for Multi-Granular Evaluation of Text-to-Audio-Video Generation
por: Zhou, Ziwei, et al.
Publicado: (2026)
por: Zhou, Ziwei, et al.
Publicado: (2026)
A Hong Kong Sign Language Corpus Collected from Sign-interpreted TV News
por: Niu, Zhe, et al.
Publicado: (2024)
por: Niu, Zhe, et al.
Publicado: (2024)
CoLA: Cross-Modal Low-rank Adaptation for Multimodal Downstream Tasks
por: Suharitdamrong, Wish, et al.
Publicado: (2026)
por: Suharitdamrong, Wish, et al.
Publicado: (2026)
DeLoRA: Decoupling Angles and Strength in Low-rank Adaptation
por: Bini, Massimo, et al.
Publicado: (2025)
por: Bini, Massimo, et al.
Publicado: (2025)
LLM2CLIP: Powerful Language Model Unlocks Richer Cross-Modality Representation
por: Huang, Weiquan, et al.
Publicado: (2024)
por: Huang, Weiquan, et al.
Publicado: (2024)
Large Multi-modal Models Can Interpret Features in Large Multi-modal Models
por: Zhang, Kaichen, et al.
Publicado: (2024)
por: Zhang, Kaichen, et al.
Publicado: (2024)
FLAT-LLM: Fine-grained Low-rank Activation Space Transformation for Large Language Model Compression
por: Tian, Jiayi, et al.
Publicado: (2025)
por: Tian, Jiayi, et al.
Publicado: (2025)
Context Cascade Compression: Exploring the Upper Limits of Text Compression
por: Liu, Fanfan, et al.
Publicado: (2025)
por: Liu, Fanfan, et al.
Publicado: (2025)
Enhancing Fine-Grained Image Classifications via Cascaded Vision Language Models
por: Wei, Canshi
Publicado: (2024)
por: Wei, Canshi
Publicado: (2024)
GSCo: Towards Generalizable AI in Medicine via Generalist-Specialist Collaboration
por: He, Sunan, et al.
Publicado: (2024)
por: He, Sunan, et al.
Publicado: (2024)
Rethinking Generative Large Language Model Evaluation for Semantic Comprehension
por: Wei, Fangyun, et al.
Publicado: (2024)
por: Wei, Fangyun, et al.
Publicado: (2024)
DoRA: Weight-Decomposed Low-Rank Adaptation
por: Liu, Shih-Yang, et al.
Publicado: (2024)
por: Liu, Shih-Yang, et al.
Publicado: (2024)
MM-WebAgent: A Hierarchical Multimodal Web Agent for Webpage Generation
por: Li, Yan, et al.
Publicado: (2026)
por: Li, Yan, et al.
Publicado: (2026)
Beyond Text: Frozen Large Language Models in Visual Signal Comprehension
por: Zhu, Lei, et al.
Publicado: (2024)
por: Zhu, Lei, et al.
Publicado: (2024)
AnyTool: Self-Reflective, Hierarchical Agents for Large-Scale API Calls
por: Du, Yu, et al.
Publicado: (2024)
por: Du, Yu, et al.
Publicado: (2024)
EAGLE-3: Scaling up Inference Acceleration of Large Language Models via Training-Time Test
por: Li, Yuhui, et al.
Publicado: (2025)
por: Li, Yuhui, et al.
Publicado: (2025)
VLM-R1: A Stable and Generalizable R1-style Large Vision-Language Model
por: Shen, Haozhan, et al.
Publicado: (2025)
por: Shen, Haozhan, et al.
Publicado: (2025)
Trajectory Prediction Meets Large Language Models: A Survey
por: Xu, Yi, et al.
Publicado: (2025)
por: Xu, Yi, et al.
Publicado: (2025)
VideoVLA: Video Generators Can Be Generalizable Robot Manipulators
por: Shen, Yichao, et al.
Publicado: (2025)
por: Shen, Yichao, et al.
Publicado: (2025)
Think Twice, Click Once: Enhancing GUI Grounding via Fast and Slow Systems
por: Tang, Fei, et al.
Publicado: (2025)
por: Tang, Fei, et al.
Publicado: (2025)
MedCLIPSeg: Probabilistic Vision-Language Adaptation for Data-Efficient and Generalizable Medical Image Segmentation
por: Koleilat, Taha, et al.
Publicado: (2026)
por: Koleilat, Taha, et al.
Publicado: (2026)
Orthogonal Low-rank Adaptation in Lie Groups for Continual Learning of Large Language Models
por: Cao, Kefan, et al.
Publicado: (2025)
por: Cao, Kefan, et al.
Publicado: (2025)
SlowFast-VGen: Slow-Fast Learning for Action-Driven Long Video Generation
por: Hong, Yining, et al.
Publicado: (2024)
por: Hong, Yining, et al.
Publicado: (2024)
ChartInsights: Evaluating Multimodal Large Language Models for Low-Level Chart Question Answering
por: Wu, Yifan, et al.
Publicado: (2024)
por: Wu, Yifan, et al.
Publicado: (2024)
Accelerating Prefilling via Decoding-time Contribution Sparsity
por: He, Zhiyuan, et al.
Publicado: (2025)
por: He, Zhiyuan, et al.
Publicado: (2025)
SPORTU: A Comprehensive Sports Understanding Benchmark for Multimodal Large Language Models
por: Xia, Haotian, et al.
Publicado: (2024)
por: Xia, Haotian, et al.
Publicado: (2024)
VLMInferSlow: Evaluating the Efficiency Robustness of Large Vision-Language Models as a Service
por: Wang, Xiasi, et al.
Publicado: (2025)
por: Wang, Xiasi, et al.
Publicado: (2025)
Generalizable Prompt Learning of CLIP: A Brief Overview
por: Cui, Fangming, et al.
Publicado: (2025)
por: Cui, Fangming, et al.
Publicado: (2025)
Gemini in Reasoning: Unveiling Commonsense in Multimodal Large Language Models
por: Wang, Yuqing, et al.
Publicado: (2023)
por: Wang, Yuqing, et al.
Publicado: (2023)
Growing a Multi-head Twig via Distillation and Reinforcement Learning to Accelerate Large Vision-Language Models
por: Shao, Zhenwei, et al.
Publicado: (2025)
por: Shao, Zhenwei, et al.
Publicado: (2025)
Render-of-Thought: Rendering Textual Chain-of-Thought as Images for Visual Latent Reasoning
por: Wang, Yifan, et al.
Publicado: (2026)
por: Wang, Yifan, et al.
Publicado: (2026)
The Expressive Power of Low-Rank Adaptation
por: Zeng, Yuchen, et al.
Publicado: (2023)
por: Zeng, Yuchen, et al.
Publicado: (2023)
Bridging The Gap between Low-rank and Orthogonal Adaptation via Householder Reflection Adaptation
por: Yuan, Shen, et al.
Publicado: (2024)
por: Yuan, Shen, et al.
Publicado: (2024)
Unleashing Spatial Reasoning in Multimodal Large Language Models via Textual Representation Guided Reasoning
por: Hua, Jiacheng, et al.
Publicado: (2026)
por: Hua, Jiacheng, et al.
Publicado: (2026)
Libra-VLA: Achieving Learning Equilibrium via Asynchronous Coarse-to-Fine Dual-System
por: Wei, Yifei, et al.
Publicado: (2026)
por: Wei, Yifei, et al.
Publicado: (2026)
Position Engineering: Boosting Large Language Models through Positional Information Manipulation
por: He, Zhiyuan, et al.
Publicado: (2024)
por: He, Zhiyuan, et al.
Publicado: (2024)
Ejemplares similares
-
Generalizable Entity Grounding via Assistance of Large Language Model
por: Qi, Lu, et al.
Publicado: (2024) -
ReasonGen-R1: CoT for Autoregressive Image generation models through SFT and RL
por: Zhang, Yu, et al.
Publicado: (2025) -
Dynamic Context-oriented Decomposition for Task-aware Low-rank Adaptation with Less Forgetting and Faster Convergence
por: Yang, Yibo, et al.
Publicado: (2025) -
UniCode: Learning a Unified Codebook for Multimodal Large Language Models
por: Zheng, Sipeng, et al.
Publicado: (2024) -
AVGen-Bench: A Task-Driven Benchmark for Multi-Granular Evaluation of Text-to-Audio-Video Generation
por: Zhou, Ziwei, et al.
Publicado: (2026)