FUSE-ing Language Models: Zero-Shot Adapter Discovery for Prompt Optimization Across Tokenizers
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Williams, Joshua Nathaniel, Kolter, J. Zico |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Prompt Recovery for Image Generation Models: A Comparative Study of Discrete Optimizers
par: Williams, Joshua Nathaniel, et autres
Publié: (2024)
par: Williams, Joshua Nathaniel, et autres
Publié: (2024)
Massive Activations in Large Language Models
par: Sun, Mingjie, et autres
Publié: (2024)
par: Sun, Mingjie, et autres
Publié: (2024)
Forcing Diffuse Distributions out of Language Models
par: Zhang, Yiming, et autres
Publié: (2024)
par: Zhang, Yiming, et autres
Publié: (2024)
Predicting the Performance of Black-box LLMs through Follow-up Queries
par: Sam, Dylan, et autres
Publié: (2025)
par: Sam, Dylan, et autres
Publié: (2025)
FUSE: Ensembling Verifiers with Zero Labeled Data
par: Lee, Joonhyuk, et autres
Publié: (2026)
par: Lee, Joonhyuk, et autres
Publié: (2026)
A Simple and Effective Pruning Approach for Large Language Models
par: Sun, Mingjie, et autres
Publié: (2023)
par: Sun, Mingjie, et autres
Publié: (2023)
Automated Black-box Prompt Engineering for Personalized Text-to-Image Generation
par: He, Yutong, et autres
Publié: (2024)
par: He, Yutong, et autres
Publié: (2024)
Context-Parametric Inversion: Why Instruction Finetuning Can Worsen Context Reliance
par: Goyal, Sachin, et autres
Publié: (2024)
par: Goyal, Sachin, et autres
Publié: (2024)
Mimetic Initialization Helps State Space Models Learn to Recall
par: Trockman, Asher, et autres
Publié: (2024)
par: Trockman, Asher, et autres
Publié: (2024)
Looking beyond the next token
par: Thankaraj, Abitha, et autres
Publié: (2025)
par: Thankaraj, Abitha, et autres
Publié: (2025)
Rethinking Distance Metrics for Counterfactual Explainability
par: Williams, Joshua Nathaniel, et autres
Publié: (2024)
par: Williams, Joshua Nathaniel, et autres
Publié: (2024)
TOFU: A Task of Fictitious Unlearning for LLMs
par: Maini, Pratyush, et autres
Publié: (2024)
par: Maini, Pratyush, et autres
Publié: (2024)
Rethinking LLM Memorization through the Lens of Adversarial Compression
par: Schwarzschild, Avi, et autres
Publié: (2024)
par: Schwarzschild, Avi, et autres
Publié: (2024)
Base Models Look Human To AI Detectors
par: Xu, Yixuan Even, et autres
Publié: (2026)
par: Xu, Yixuan Even, et autres
Publié: (2026)
Not All Rollouts are Useful: Down-Sampling Rollouts in LLM Reinforcement Learning
par: Xu, Yixuan Even, et autres
Publié: (2025)
par: Xu, Yixuan Even, et autres
Publié: (2025)
Leveraging Zero-Shot Prompting for Efficient Language Model Distillation
par: Vöge, Lukas, et autres
Publié: (2024)
par: Vöge, Lukas, et autres
Publié: (2024)
Prompt-Based Bias Calibration for Better Zero/Few-Shot Learning of Language Models
par: He, Kang, et autres
Publié: (2024)
par: He, Kang, et autres
Publié: (2024)
Existing Large Language Model Unlearning Evaluations Are Inconclusive
par: Feng, Zhili, et autres
Publié: (2025)
par: Feng, Zhili, et autres
Publié: (2025)
T-MARS: Improving Visual Representations by Circumventing Text Feature Learning
par: Maini, Pratyush, et autres
Publié: (2023)
par: Maini, Pratyush, et autres
Publié: (2023)
Optimizing GPT for Video Understanding: Zero-Shot Performance and Prompt Engineering
par: Beliaev, Mark, et autres
Publié: (2025)
par: Beliaev, Mark, et autres
Publié: (2025)
AcceleratedLiNGAM: Learning Causal DAGs at the speed of GPUs
par: Akinwande, Victor, et autres
Publié: (2024)
par: Akinwande, Victor, et autres
Publié: (2024)
From Token to Token Pair: Efficient Prompt Compression for Large Language Models in Clinical Prediction
par: Zhu, Mingcheng, et autres
Publié: (2026)
par: Zhu, Mingcheng, et autres
Publié: (2026)
Zero-Shot Morphological Discovery in Low-Resource Bantu Languages via Cross-Lingual Transfer and Unsupervised Clustering
par: Mutisya, Hillary, et autres
Publié: (2026)
par: Mutisya, Hillary, et autres
Publié: (2026)
Zero-Shot Decision Tree Construction via Large Language Models
par: Carrasco, Lucas, et autres
Publié: (2025)
par: Carrasco, Lucas, et autres
Publié: (2025)
Mimetic Initialization of MLPs
par: Trockman, Asher, et autres
Publié: (2026)
par: Trockman, Asher, et autres
Publié: (2026)
Block Circulant Adapter for Large Language Models
par: Ding, Xinyu, et autres
Publié: (2025)
par: Ding, Xinyu, et autres
Publié: (2025)
One-Step Diffusion Distillation via Deep Equilibrium Models
par: Geng, Zhengyang, et autres
Publié: (2023)
par: Geng, Zhengyang, et autres
Publié: (2023)
Prompting Large Language Models for Zero-Shot Clinical Prediction with Structured Longitudinal Electronic Health Record Data
par: Zhu, Yinghao, et autres
Publié: (2024)
par: Zhu, Yinghao, et autres
Publié: (2024)
Hadamard Adapter: An Extreme Parameter-Efficient Adapter Tuning Method for Pre-trained Language Models
par: Chen, Yuyan, et autres
Publié: (2024)
par: Chen, Yuyan, et autres
Publié: (2024)
Training a Generally Curious Agent
par: Tajwar, Fahim, et autres
Publié: (2025)
par: Tajwar, Fahim, et autres
Publié: (2025)
COMPACT: Common-token Optimized Model Pruning Across Channels and Tokens
par: Kwek, Eugene, et autres
Publié: (2025)
par: Kwek, Eugene, et autres
Publié: (2025)
Benchmarking Large Language Model Uncertainty for Prompt Optimization
par: Guo, Pei-Fu, et autres
Publié: (2024)
par: Guo, Pei-Fu, et autres
Publié: (2024)
C-ing Clearly: Enhanced Binary Code Explanations using C code
par: Poncu, Teodor, et autres
Publié: (2025)
par: Poncu, Teodor, et autres
Publié: (2025)
Towards Reliable Latent Knowledge Estimation in LLMs: Zero-Prompt Many-Shot Based Factual Knowledge Extraction
par: Wu, Qinyuan, et autres
Publié: (2024)
par: Wu, Qinyuan, et autres
Publié: (2024)
Antidistillation Fingerprinting
par: Xu, Yixuan Even, et autres
Publié: (2026)
par: Xu, Yixuan Even, et autres
Publié: (2026)
Correcting Suppressed Log-Probabilities in Language Models with Post-Transformer Adapters
par: Sanchez, Bryan
Publié: (2026)
par: Sanchez, Bryan
Publié: (2026)
AF Adapter: Continual Pretraining for Building Chinese Biomedical Language Model
par: Yan, Yongyu, et autres
Publié: (2022)
par: Yan, Yongyu, et autres
Publié: (2022)
LogicDiff: Logic-Guided Denoising Improves Zero-Shot Reasoning in Masked Diffusion Language Models
par: Aman, Shaik
Publié: (2026)
par: Aman, Shaik
Publié: (2026)
Inference Optimal VLMs Need Fewer Visual Tokens and More Parameters
par: Li, Kevin Y., et autres
Publié: (2024)
par: Li, Kevin Y., et autres
Publié: (2024)
Agent Instructs Large Language Models to be General Zero-Shot Reasoners
par: Crispino, Nicholas, et autres
Publié: (2023)
par: Crispino, Nicholas, et autres
Publié: (2023)
Documents similaires
-
Prompt Recovery for Image Generation Models: A Comparative Study of Discrete Optimizers
par: Williams, Joshua Nathaniel, et autres
Publié: (2024) -
Massive Activations in Large Language Models
par: Sun, Mingjie, et autres
Publié: (2024) -
Forcing Diffuse Distributions out of Language Models
par: Zhang, Yiming, et autres
Publié: (2024) -
Predicting the Performance of Black-box LLMs through Follow-up Queries
par: Sam, Dylan, et autres
Publié: (2025) -
FUSE: Ensembling Verifiers with Zero Labeled Data
par: Lee, Joonhyuk, et autres
Publié: (2026)