Guardado en:
| Autores principales: | Tseng, Albert, Sun, Zhaofeng, De Sa, Christopher |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2505.22988 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
L$^3$: Large Lookup Layers
por: Tseng, Albert, et al.
Publicado: (2026)
por: Tseng, Albert, et al.
Publicado: (2026)
QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks
por: Tseng, Albert, et al.
Publicado: (2024)
por: Tseng, Albert, et al.
Publicado: (2024)
FAAR: Format-Aware Adaptive Rounding for NVFP4
por: Li, Hanglin, et al.
Publicado: (2026)
por: Li, Hanglin, et al.
Publicado: (2026)
Rounding-Guided Backdoor Injection in Deep Learning Model Quantization
por: Chen, Xiangxiang, et al.
Publicado: (2025)
por: Chen, Xiangxiang, et al.
Publicado: (2025)
Deep Reinforcement Learning with Task-Adaptive Retrieval via Hypernetwork
por: Jin, Yonggang, et al.
Publicado: (2023)
por: Jin, Yonggang, et al.
Publicado: (2023)
ModuLoRA: Finetuning 2-Bit LLMs on Consumer GPUs by Integrating with Modular Quantizers
por: Yin, Junjie, et al.
Publicado: (2023)
por: Yin, Junjie, et al.
Publicado: (2023)
FlexRound: Learnable Rounding based on Element-wise Division for Post-Training Quantization
por: Lee, Jung Hyun, et al.
Publicado: (2023)
por: Lee, Jung Hyun, et al.
Publicado: (2023)
QTIP: Quantization with Trellises and Incoherence Processing
por: Tseng, Albert, et al.
Publicado: (2024)
por: Tseng, Albert, et al.
Publicado: (2024)
From Bits to Rounds: Parallel Decoding with Exploration for Diffusion Language Models
por: Fu, Hengyu, et al.
Publicado: (2025)
por: Fu, Hengyu, et al.
Publicado: (2025)
Cluster-Aware Multi-Round Update for Wireless Federated Learning in Heterogeneous Environments
por: Sun, Pengcheng, et al.
Publicado: (2025)
por: Sun, Pengcheng, et al.
Publicado: (2025)
Preserving Plasticity in Continual Learning with Adaptive Linearity Injection
por: Rohani, Seyed Roozbeh Razavi, et al.
Publicado: (2025)
por: Rohani, Seyed Roozbeh Razavi, et al.
Publicado: (2025)
Single-Round Scalable Analytic Federated Learning
por: Bacellar, Alan T. L., et al.
Publicado: (2025)
por: Bacellar, Alan T. L., et al.
Publicado: (2025)
Preserve-Then-Quantize: Balancing Rank Budgets for Quantization Error Reconstruction in LLMs
por: Cho, Yoonjun, et al.
Publicado: (2026)
por: Cho, Yoonjun, et al.
Publicado: (2026)
Preserving Diversity in Supervised Fine-Tuning of Large Language Models
por: Li, Ziniu, et al.
Publicado: (2024)
por: Li, Ziniu, et al.
Publicado: (2024)
STAT: Shrinking Transformers After Training
por: Flynn, Megan, et al.
Publicado: (2024)
por: Flynn, Megan, et al.
Publicado: (2024)
Compute-Optimal LLMs Provably Generalize Better With Scale
por: Finzi, Marc, et al.
Publicado: (2025)
por: Finzi, Marc, et al.
Publicado: (2025)
CoreQ: Learning-Free Mismatch Correction and Successive Rounding for Quantization
por: Cha, Seohyeon, et al.
Publicado: (2026)
por: Cha, Seohyeon, et al.
Publicado: (2026)
Policy Gradient with Adaptive Entropy Annealing for Continual Fine-Tuning
por: Zhang, Yaqian, et al.
Publicado: (2026)
por: Zhang, Yaqian, et al.
Publicado: (2026)
Adaptive Non-local Observable on Quantum Neural Networks
por: Lin, Hsin-Yi, et al.
Publicado: (2025)
por: Lin, Hsin-Yi, et al.
Publicado: (2025)
Quantum Reinforcement Learning by Adaptive Non-local Observables
por: Lin, Hsin-Yi, et al.
Publicado: (2025)
por: Lin, Hsin-Yi, et al.
Publicado: (2025)
Quantum Super-resolution by Adaptive Non-local Observables
por: Lin, Hsin-Yi, et al.
Publicado: (2026)
por: Lin, Hsin-Yi, et al.
Publicado: (2026)
Silent Neuron Theory and Plasticity Preservation for Deep Reinforcement Learning in Adaptive Video Streaming
por: He, Zhiqiang, et al.
Publicado: (2025)
por: He, Zhiqiang, et al.
Publicado: (2025)
Adaptive Clipping for Privacy-Preserving Few-Shot Learning: Enhancing Generalization with Limited Data
por: Ranaweera, Kanishka, et al.
Publicado: (2025)
por: Ranaweera, Kanishka, et al.
Publicado: (2025)
Diagonal Adaptive Non-local Observables on Quantum Neural Networks
por: Tseng, Huan-Hsin, et al.
Publicado: (2026)
por: Tseng, Huan-Hsin, et al.
Publicado: (2026)
Adaptive Learning of Design Strategies over Non-Hierarchical Multi-Fidelity Models via Policy Alignment
por: Agrawal, Akash, et al.
Publicado: (2024)
por: Agrawal, Akash, et al.
Publicado: (2024)
PAC Privacy Preserving Diffusion Models
por: Xu, Qipan, et al.
Publicado: (2023)
por: Xu, Qipan, et al.
Publicado: (2023)
HyperMoE: Towards Better Mixture of Experts via Transferring Among Experts
por: Zhao, Hao, et al.
Publicado: (2024)
por: Zhao, Hao, et al.
Publicado: (2024)
Beyond 2:4: exploring V:N:M sparsity for efficient transformer inference on GPUs
por: Zhao, Kang, et al.
Publicado: (2024)
por: Zhao, Kang, et al.
Publicado: (2024)
SG-XDEAT: Sparsity-Guided Cross-Dimensional and Cross-Encoding Attention with Target-Aware Conditioning in Tabular Learning
por: Cheng, Chih-Chuan, et al.
Publicado: (2025)
por: Cheng, Chih-Chuan, et al.
Publicado: (2025)
One Permutation Is All You Need: Fast, Reliable Variable Importance and Model Stress-Testing
por: Dorador, Albert
Publicado: (2025)
por: Dorador, Albert
Publicado: (2025)
Towards Understanding Multi-Round Large Language Model Reasoning: Approximability, Learnability and Generalizability
por: Xu, Chenhui, et al.
Publicado: (2025)
por: Xu, Chenhui, et al.
Publicado: (2025)
RTMol: Rethinking Molecule-text Alignment in a Round-trip View
por: Chen, Letian, et al.
Publicado: (2025)
por: Chen, Letian, et al.
Publicado: (2025)
CoAst: Validation-Free Contribution Assessment for Federated Learning based on Cross-Round Valuation
por: Wu, Hao, et al.
Publicado: (2024)
por: Wu, Hao, et al.
Publicado: (2024)
RCCDA: Adaptive Model Updates in the Presence of Concept Drift under a Constrained Resource Budget
por: Piaseczny, Adam, et al.
Publicado: (2025)
por: Piaseczny, Adam, et al.
Publicado: (2025)
Mamba: Linear-Time Sequence Modeling with Selective State Spaces
por: Gu, Albert, et al.
Publicado: (2023)
por: Gu, Albert, et al.
Publicado: (2023)
Adaptive Selection of LoRA Components in Privacy-Preserving Federated Learning
por: Kim, Myoungjun, et al.
Publicado: (2026)
por: Kim, Myoungjun, et al.
Publicado: (2026)
Privacy-Preserving Dynamic Assortment Selection
por: Cho, Young Hyun, et al.
Publicado: (2024)
por: Cho, Young Hyun, et al.
Publicado: (2024)
Adaptive Multi-Fidelity Reinforcement Learning for Variance Reduction in Engineering Design Optimization
por: Agrawal, Akash, et al.
Publicado: (2025)
por: Agrawal, Akash, et al.
Publicado: (2025)
Leveraging the Context through Multi-Round Interactions for Jailbreaking Attacks
por: Cheng, Yixin, et al.
Publicado: (2024)
por: Cheng, Yixin, et al.
Publicado: (2024)
TAP: Two-Stage Adaptive Personalization of Multi-Task and Multi-Modal Foundation Models in Federated Learning
por: Lee, Seohyun, et al.
Publicado: (2025)
por: Lee, Seohyun, et al.
Publicado: (2025)
Ejemplares similares
-
L$^3$: Large Lookup Layers
por: Tseng, Albert, et al.
Publicado: (2026) -
QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks
por: Tseng, Albert, et al.
Publicado: (2024) -
FAAR: Format-Aware Adaptive Rounding for NVFP4
por: Li, Hanglin, et al.
Publicado: (2026) -
Rounding-Guided Backdoor Injection in Deep Learning Model Quantization
por: Chen, Xiangxiang, et al.
Publicado: (2025) -
Deep Reinforcement Learning with Task-Adaptive Retrieval via Hypernetwork
por: Jin, Yonggang, et al.
Publicado: (2023)