Orthogonal Finetuning Made Scalable
Fuente:
arXiv
Salvato in:
| Autori principali: | Qiu, Zeju, Liu, Weiyang, Weller, Adrian, Schölkopf, Bernhard |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Controlling Text-to-Image Diffusion by Orthogonal Finetuning
di: Qiu, Zeju, et al.
Pubblicazione: (2023)
di: Qiu, Zeju, et al.
Pubblicazione: (2023)
Parameter-Efficient Orthogonal Finetuning via Butterfly Factorization
di: Liu, Weiyang, et al.
Pubblicazione: (2023)
di: Liu, Weiyang, et al.
Pubblicazione: (2023)
Can Large Language Models Understand Symbolic Graphics Programs?
di: Qiu, Zeju, et al.
Pubblicazione: (2024)
di: Qiu, Zeju, et al.
Pubblicazione: (2024)
POET-X: Memory-efficient LLM Training by Scaling Orthogonal Transformation
di: Qiu, Zeju, et al.
Pubblicazione: (2026)
di: Qiu, Zeju, et al.
Pubblicazione: (2026)
Reparameterized LLM Training via Orthogonal Equivalence Transformation
di: Qiu, Zeju, et al.
Pubblicazione: (2025)
di: Qiu, Zeju, et al.
Pubblicazione: (2025)
Verbalized Machine Learning: Revisiting Machine Learning with Language Models
di: Xiao, Tim Z., et al.
Pubblicazione: (2024)
di: Xiao, Tim Z., et al.
Pubblicazione: (2024)
Agentic Design of Compositional Machines
di: Zhang, Wenqian, et al.
Pubblicazione: (2025)
di: Zhang, Wenqian, et al.
Pubblicazione: (2025)
MoLEx: Mixture of Layer Experts for Finetuning with Sparse Upcycling
di: Teo, Rachel S. Y., et al.
Pubblicazione: (2025)
di: Teo, Rachel S. Y., et al.
Pubblicazione: (2025)
VLSM-Adapter: Finetuning Vision-Language Segmentation Efficiently with Lightweight Blocks
di: Dhakal, Manish, et al.
Pubblicazione: (2024)
di: Dhakal, Manish, et al.
Pubblicazione: (2024)
LLM-CXR: Instruction-Finetuned LLM for CXR Image Understanding and Generation
di: Lee, Suhyeon, et al.
Pubblicazione: (2023)
di: Lee, Suhyeon, et al.
Pubblicazione: (2023)
Hyperbolic Busemann Neural Networks
di: Chen, Ziheng, et al.
Pubblicazione: (2026)
di: Chen, Ziheng, et al.
Pubblicazione: (2026)
How LoRA Remembers? A Parametric Memory Law for LLM Finetuning
di: Xu, Ziwen, et al.
Pubblicazione: (2026)
di: Xu, Ziwen, et al.
Pubblicazione: (2026)
PEFT-Arena: Understanding Parameter-Efficient Finetuning from a Stability-Plasticity Perspective
di: Huang, Yangyi, et al.
Pubblicazione: (2026)
di: Huang, Yangyi, et al.
Pubblicazione: (2026)
MoPE: Mixture of Prompt Experts for Parameter-Efficient and Scalable Multimodal Fusion
di: Jiang, Ruixiang, et al.
Pubblicazione: (2024)
di: Jiang, Ruixiang, et al.
Pubblicazione: (2024)
Energy-Based Transformers are Scalable Learners and Thinkers
di: Gladstone, Alexi, et al.
Pubblicazione: (2025)
di: Gladstone, Alexi, et al.
Pubblicazione: (2025)
Scalable Video-to-Dataset Generation for Cross-Platform Mobile Agents
di: Jang, Yunseok, et al.
Pubblicazione: (2025)
di: Jang, Yunseok, et al.
Pubblicazione: (2025)
Identifying Intervenable and Interpretable Features via Orthogonality Regularization
di: Miller, Moritz, et al.
Pubblicazione: (2026)
di: Miller, Moritz, et al.
Pubblicazione: (2026)
Leveraging Large Language Models for Scalable Vector Graphics-Driven Image Understanding
di: Cai, Mu, et al.
Pubblicazione: (2023)
di: Cai, Mu, et al.
Pubblicazione: (2023)
VERA: Explainable Video Anomaly Detection via Verbalized Learning of Vision-Language Models
di: Ye, Muchao, et al.
Pubblicazione: (2024)
di: Ye, Muchao, et al.
Pubblicazione: (2024)
Group and Shuffle: Efficient Structured Orthogonal Parametrization
di: Gorbunov, Mikhail, et al.
Pubblicazione: (2024)
di: Gorbunov, Mikhail, et al.
Pubblicazione: (2024)
Cream of the Crop: Harvesting Rich, Scalable and Transferable Multi-Modal Data for Instruction Fine-Tuning
di: Lyu, Mengyao, et al.
Pubblicazione: (2025)
di: Lyu, Mengyao, et al.
Pubblicazione: (2025)
TRACER: Persistent Regularization for Robust Multimodal Finetuning
di: Asadollahzadeh, Hesam, et al.
Pubblicazione: (2026)
di: Asadollahzadeh, Hesam, et al.
Pubblicazione: (2026)
Decoding Diffusion: A Scalable Framework for Unsupervised Analysis of Latent Space Biases and Representations Using Natural Language Prompts
di: Zeng, E. Zhixuan, et al.
Pubblicazione: (2024)
di: Zeng, E. Zhixuan, et al.
Pubblicazione: (2024)
Unified Vision-Language Modeling via Concept Space Alignment
di: Qiu, Yifu, et al.
Pubblicazione: (2026)
di: Qiu, Yifu, et al.
Pubblicazione: (2026)
Exploring the Effect of Reinforcement Learning on Video Understanding: Insights from SEED-Bench-R1
di: Chen, Yi, et al.
Pubblicazione: (2025)
di: Chen, Yi, et al.
Pubblicazione: (2025)
From Pixels to Components: Eigenvector Masking for Visual Representation Learning
di: Bizeul, Alice, et al.
Pubblicazione: (2025)
di: Bizeul, Alice, et al.
Pubblicazione: (2025)
TouchUp-G: Improving Feature Representation through Graph-Centric Finetuning
di: Zhu, Jing, et al.
Pubblicazione: (2023)
di: Zhu, Jing, et al.
Pubblicazione: (2023)
PQPP: A Joint Benchmark for Text-to-Image Prompt and Query Performance Prediction
di: Poesina, Eduard, et al.
Pubblicazione: (2024)
di: Poesina, Eduard, et al.
Pubblicazione: (2024)
Self-Supervised Disentanglement by Leveraging Structure in Data Augmentations
di: Eastwood, Cian, et al.
Pubblicazione: (2023)
di: Eastwood, Cian, et al.
Pubblicazione: (2023)
Few-Shot Recognition via Stage-Wise Retrieval-Augmented Finetuning
di: Liu, Tian, et al.
Pubblicazione: (2024)
di: Liu, Tian, et al.
Pubblicazione: (2024)
BitStack: Any-Size Compression of Large Language Models in Variable Memory Environments
di: Wang, Xinghao, et al.
Pubblicazione: (2024)
di: Wang, Xinghao, et al.
Pubblicazione: (2024)
GraphDreamer: Compositional 3D Scene Synthesis from Scene Graphs
di: Gao, Gege, et al.
Pubblicazione: (2023)
di: Gao, Gege, et al.
Pubblicazione: (2023)
Metis-SPECS: Decoupling Multimodal Learning via Self-distilled Preference-based Cold Start
di: Chen, Kun, et al.
Pubblicazione: (2025)
di: Chen, Kun, et al.
Pubblicazione: (2025)
Bias Is a Subspace, Not a Coordinate: A Geometric Rethinking of Post-hoc Debiasing in Vision-Language Models
di: Zhao, Dachuan, et al.
Pubblicazione: (2025)
di: Zhao, Dachuan, et al.
Pubblicazione: (2025)
From EduVisBench to EduVisAgent: A Benchmark and Multi-Agent Framework for Reasoning-Driven Pedagogical Visualization
di: Ji, Haonian, et al.
Pubblicazione: (2025)
di: Ji, Haonian, et al.
Pubblicazione: (2025)
A Survey of Reasoning with Foundation Models
di: Sun, Jiankai, et al.
Pubblicazione: (2023)
di: Sun, Jiankai, et al.
Pubblicazione: (2023)
AnyGPT: Unified Multimodal LLM with Discrete Sequence Modeling
di: Zhan, Jun, et al.
Pubblicazione: (2024)
di: Zhan, Jun, et al.
Pubblicazione: (2024)
deepTerra -- AI Land Classification Made Easy
di: Wilkinson, Andrew Keith
Pubblicazione: (2025)
di: Wilkinson, Andrew Keith
Pubblicazione: (2025)
RetinalGPT: A Retinal Clinical Preference Conversational Assistant Powered by Large Vision-Language Models
di: Zhu, Wenhui, et al.
Pubblicazione: (2025)
di: Zhu, Wenhui, et al.
Pubblicazione: (2025)
MathVerse: Does Your Multi-modal LLM Truly See the Diagrams in Visual Math Problems?
di: Zhang, Renrui, et al.
Pubblicazione: (2024)
di: Zhang, Renrui, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Controlling Text-to-Image Diffusion by Orthogonal Finetuning
di: Qiu, Zeju, et al.
Pubblicazione: (2023) -
Parameter-Efficient Orthogonal Finetuning via Butterfly Factorization
di: Liu, Weiyang, et al.
Pubblicazione: (2023) -
Can Large Language Models Understand Symbolic Graphics Programs?
di: Qiu, Zeju, et al.
Pubblicazione: (2024) -
POET-X: Memory-efficient LLM Training by Scaling Orthogonal Transformation
di: Qiu, Zeju, et al.
Pubblicazione: (2026) -
Reparameterized LLM Training via Orthogonal Equivalence Transformation
di: Qiu, Zeju, et al.
Pubblicazione: (2025)