ScaLearn: Simple and Highly Parameter-Efficient Task Transfer by Learning to Scale
Fuente:
arXiv
Salvato in:
| Autori principali: | Frohmann, Markus, Holtermann, Carolin, Masoudian, Shahed, Lauscher, Anne, Rekabsaz, Navid |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
What the Weight?! A Unified Framework for Zero-Shot Knowledge Composition
di: Holtermann, Carolin, et al.
Pubblicazione: (2024)
di: Holtermann, Carolin, et al.
Pubblicazione: (2024)
Unlabeled Debiasing in Downstream Tasks via Class-wise Low Variance Regularization
di: Masoudian, Shahed, et al.
Pubblicazione: (2024)
di: Masoudian, Shahed, et al.
Pubblicazione: (2024)
Effective Controllable Bias Mitigation for Classification and Retrieval using Gate Adapters
di: Masoudian, Shahed, et al.
Pubblicazione: (2024)
di: Masoudian, Shahed, et al.
Pubblicazione: (2024)
SoS: Analysis of Surface over Semantics in Multilingual Text-To-Image Generation
di: Holtermann, Carolin, et al.
Pubblicazione: (2026)
di: Holtermann, Carolin, et al.
Pubblicazione: (2026)
TempViz: On the Evaluation of Temporal Knowledge in Text-to-Image Models
di: Holtermann, Carolin, et al.
Pubblicazione: (2026)
di: Holtermann, Carolin, et al.
Pubblicazione: (2026)
Evaluating the Elementary Multilingual Capabilities of Large Language Models with MultiQ
di: Holtermann, Carolin, et al.
Pubblicazione: (2024)
di: Holtermann, Carolin, et al.
Pubblicazione: (2024)
Investigating Gender Bias in LLM-Generated Stories via Psychological Stereotypes
di: Masoudian, Shahed, et al.
Pubblicazione: (2025)
di: Masoudian, Shahed, et al.
Pubblicazione: (2025)
Segment Any Text: A Universal Approach for Robust, Efficient and Adaptable Sentence Segmentation
di: Frohmann, Markus, et al.
Pubblicazione: (2024)
di: Frohmann, Markus, et al.
Pubblicazione: (2024)
Around the World in 24 Hours: Probing LLM Knowledge of Time and Place
di: Holtermann, Carolin, et al.
Pubblicazione: (2025)
di: Holtermann, Carolin, et al.
Pubblicazione: (2025)
Synthetic Lyrics Detection Across Languages and Genres
di: Labrak, Yanis, et al.
Pubblicazione: (2024)
di: Labrak, Yanis, et al.
Pubblicazione: (2024)
Large Language Models for Human-Machine Collaborative Particle Accelerator Tuning through Natural Language
di: Kaiser, Jan, et al.
Pubblicazione: (2024)
di: Kaiser, Jan, et al.
Pubblicazione: (2024)
GIMMICK -- Globally Inclusive Multimodal Multitask Cultural Knowledge Benchmarking
di: Schneider, Florian, et al.
Pubblicazione: (2025)
di: Schneider, Florian, et al.
Pubblicazione: (2025)
MoSLD: An Extremely Parameter-Efficient Mixture-of-Shared LoRAs for Multi-Task Learning
di: Zhao, Lulu, et al.
Pubblicazione: (2024)
di: Zhao, Lulu, et al.
Pubblicazione: (2024)
Parameter Efficient Reinforcement Learning from Human Feedback
di: Sidahmed, Hakim, et al.
Pubblicazione: (2024)
di: Sidahmed, Hakim, et al.
Pubblicazione: (2024)
Increasing Model Capacity for Free: A Simple Strategy for Parameter Efficient Fine-tuning
di: Song, Haobo, et al.
Pubblicazione: (2024)
di: Song, Haobo, et al.
Pubblicazione: (2024)
It's Not That Simple. An Analysis of Simple Test-Time Scaling
di: Wu, Guojun
Pubblicazione: (2025)
di: Wu, Guojun
Pubblicazione: (2025)
SimpleVLA-RL: Scaling VLA Training via Reinforcement Learning
di: Li, Haozhan, et al.
Pubblicazione: (2025)
di: Li, Haozhan, et al.
Pubblicazione: (2025)
Always Learning, Always Mixing: Efficient and Simple Data Mixing All The Time
di: Hu, Michael Y., et al.
Pubblicazione: (2026)
di: Hu, Michael Y., et al.
Pubblicazione: (2026)
Large Scale Transfer Learning for Tabular Data via Language Modeling
di: Gardner, Josh, et al.
Pubblicazione: (2024)
di: Gardner, Josh, et al.
Pubblicazione: (2024)
Learning Rate Scaling across LoRA Ranks and Transfer to Full Finetuning
di: Chen, Nan, et al.
Pubblicazione: (2026)
di: Chen, Nan, et al.
Pubblicazione: (2026)
Frontier LLMs Still Struggle with Simple Reasoning Tasks
di: Malek, Alan, et al.
Pubblicazione: (2025)
di: Malek, Alan, et al.
Pubblicazione: (2025)
Language Control Diffusion: Efficiently Scaling through Space, Time, and Tasks
di: Zhang, Edwin, et al.
Pubblicazione: (2022)
di: Zhang, Edwin, et al.
Pubblicazione: (2022)
Batched Contextual Reinforcement: A Task-Scaling Law for Efficient Reasoning
di: Yang, Bangji, et al.
Pubblicazione: (2026)
di: Yang, Bangji, et al.
Pubblicazione: (2026)
Unified Multi-Task Learning & Model Fusion for Efficient Language Model Guardrailing
di: Neill, James O', et al.
Pubblicazione: (2025)
di: Neill, James O', et al.
Pubblicazione: (2025)
SEMFED: Semantic-Aware Resource-Efficient Federated Learning for Heterogeneous NLP Tasks
di: Hussain, Sajid, et al.
Pubblicazione: (2025)
di: Hussain, Sajid, et al.
Pubblicazione: (2025)
OrchMoE: Efficient Multi-Adapter Learning with Task-Skill Synergy
di: Wang, Haowen, et al.
Pubblicazione: (2024)
di: Wang, Haowen, et al.
Pubblicazione: (2024)
AI-Generated Song Detection via Lyrics Transcripts
di: Frohmann, Markus, et al.
Pubblicazione: (2025)
di: Frohmann, Markus, et al.
Pubblicazione: (2025)
Decoding Multilingual Moral Preferences: Unveiling LLM's Biases Through the Moral Machine Experiment
di: Vida, Karina, et al.
Pubblicazione: (2024)
di: Vida, Karina, et al.
Pubblicazione: (2024)
Multi-Task Reinforcement Learning Enables Parameter Scaling
di: McLean, Reginald, et al.
Pubblicazione: (2025)
di: McLean, Reginald, et al.
Pubblicazione: (2025)
Sensitivity, Performance, Robustness: Deconstructing the Effect of Sociodemographic Prompting
di: Beck, Tilman, et al.
Pubblicazione: (2023)
di: Beck, Tilman, et al.
Pubblicazione: (2023)
The Curious Case of Factual (Mis)Alignment between LLMs' Short- and Long-Form Answers
di: Islam, Saad Obaid ul, et al.
Pubblicazione: (2025)
di: Islam, Saad Obaid ul, et al.
Pubblicazione: (2025)
How Much Do LLMs Hallucinate across Languages? On Realistic Multilingual Estimation of LLM Hallucination
di: Islam, Saad Obaid ul, et al.
Pubblicazione: (2025)
di: Islam, Saad Obaid ul, et al.
Pubblicazione: (2025)
Donors and Recipients: On Asymmetric Transfer Across Tasks and Languages with Parameter-Efficient Fine-Tuning
di: Dymkiewicz, Kajetan, et al.
Pubblicazione: (2025)
di: Dymkiewicz, Kajetan, et al.
Pubblicazione: (2025)
Ability Transfer and Recovery via Modularized Parameters Localization
di: Jin, Songyao, et al.
Pubblicazione: (2026)
di: Jin, Songyao, et al.
Pubblicazione: (2026)
MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning
di: Feng, Zhaopeng, et al.
Pubblicazione: (2025)
di: Feng, Zhaopeng, et al.
Pubblicazione: (2025)
Efficient Systematic Reviews: Literature Filtering with Transformers & Transfer Learning
di: Hawkins, John, et al.
Pubblicazione: (2024)
di: Hawkins, John, et al.
Pubblicazione: (2024)
SSR-Zero: Simple Self-Rewarding Reinforcement Learning for Machine Translation
di: Yang, Wenjie, et al.
Pubblicazione: (2025)
di: Yang, Wenjie, et al.
Pubblicazione: (2025)
Double Entendre: Robust Audio-Based AI-Generated Lyrics Detection via Multi-View Fusion
di: Frohmann, Markus, et al.
Pubblicazione: (2025)
di: Frohmann, Markus, et al.
Pubblicazione: (2025)
Leveraging Parameter Space Symmetries for Reasoning Skill Transfer in LLMs
di: Horoi, Stefan, et al.
Pubblicazione: (2025)
di: Horoi, Stefan, et al.
Pubblicazione: (2025)
Facet-Level Tracing of Evidence Uncertainty and Hallucination in RAG
di: Elchafei, Passant, et al.
Pubblicazione: (2026)
di: Elchafei, Passant, et al.
Pubblicazione: (2026)
Documenti analoghi
-
What the Weight?! A Unified Framework for Zero-Shot Knowledge Composition
di: Holtermann, Carolin, et al.
Pubblicazione: (2024) -
Unlabeled Debiasing in Downstream Tasks via Class-wise Low Variance Regularization
di: Masoudian, Shahed, et al.
Pubblicazione: (2024) -
Effective Controllable Bias Mitigation for Classification and Retrieval using Gate Adapters
di: Masoudian, Shahed, et al.
Pubblicazione: (2024) -
SoS: Analysis of Surface over Semantics in Multilingual Text-To-Image Generation
di: Holtermann, Carolin, et al.
Pubblicazione: (2026) -
TempViz: On the Evaluation of Temporal Knowledge in Text-to-Image Models
di: Holtermann, Carolin, et al.
Pubblicazione: (2026)