Scalable Optimization in the Modular Norm
Fuente:
arXiv
Saved in:
| Main Authors: | Large, Tim, Liu, Yang, Huh, Minyoung, Bahng, Hyojin, Isola, Phillip, Bernstein, Jeremy |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Cycle Consistency as Reward: Learning Image-Text Alignment without Human Preferences
by: Bahng, Hyojin, et al.
Published: (2025)
by: Bahng, Hyojin, et al.
Published: (2025)
Training Neural Networks from Scratch with Parallel Low-Rank Adapters
by: Huh, Minyoung, et al.
Published: (2024)
by: Huh, Minyoung, et al.
Published: (2024)
The Platonic Representation Hypothesis
by: Huh, Minyoung, et al.
Published: (2024)
by: Huh, Minyoung, et al.
Published: (2024)
Old Optimizer, New Norm: An Anthology
by: Bernstein, Jeremy, et al.
Published: (2024)
by: Bernstein, Jeremy, et al.
Published: (2024)
Training Transformers with Enforced Lipschitz Constants
by: Newhouse, Laker, et al.
Published: (2025)
by: Newhouse, Laker, et al.
Published: (2025)
Modular Duality in Deep Learning
by: Bernstein, Jeremy, et al.
Published: (2024)
by: Bernstein, Jeremy, et al.
Published: (2024)
Improved Representation of Asymmetrical Distances with Interval Quasimetric Embeddings
by: Wang, Tongzhou, et al.
Published: (2022)
by: Wang, Tongzhou, et al.
Published: (2022)
Neural Thickets: Diverse Task Experts Are Dense Around Pretrained Weights
by: Gan, Yulu, et al.
Published: (2026)
by: Gan, Yulu, et al.
Published: (2026)
Fairness Aware Reward Optimization
by: Choi, Ching Lam, et al.
Published: (2026)
by: Choi, Ching Lam, et al.
Published: (2026)
The Truth Lies Somewhere in the Middle (of the Generated Tokens)
by: Wang, Sophie L., et al.
Published: (2026)
by: Wang, Sophie L., et al.
Published: (2026)
A Stochastic Approach to Bi-Level Optimization for Hyperparameter Optimization and Meta Learning
by: Kim, Minyoung, et al.
Published: (2024)
by: Kim, Minyoung, et al.
Published: (2024)
Canonicalizing Multimodal Contrastive Representation Learning
by: Gupta, Sharut, et al.
Published: (2026)
by: Gupta, Sharut, et al.
Published: (2026)
A Unified Framework for Diffusion Bridge Problems: Flow Matching and Schrödinger Matching into One
by: Kim, Minyoung
Published: (2025)
by: Kim, Minyoung
Published: (2025)
Warm-Start Flow Matching for Guaranteed Fast Text/Image Generation
by: Kim, Minyoung
Published: (2026)
by: Kim, Minyoung
Published: (2026)
Large-scale Score-based Variational Posterior Inference for Bayesian Deep Neural Networks
by: Kim, Minyoung
Published: (2026)
by: Kim, Minyoung
Published: (2026)
Words That Make Language Models Perceive
by: Wang, Sophie L., et al.
Published: (2025)
by: Wang, Sophie L., et al.
Published: (2025)
A Spectral Condition for Feature Learning
by: Yang, Greg, et al.
Published: (2023)
by: Yang, Greg, et al.
Published: (2023)
GeoNorm: Unify Pre-Norm and Post-Norm with Geodesic Optimization
by: Zheng, Chuanyang, et al.
Published: (2026)
by: Zheng, Chuanyang, et al.
Published: (2026)
Adaptive Length Image Tokenization via Recurrent Allocation
by: Duggal, Shivam, et al.
Published: (2024)
by: Duggal, Shivam, et al.
Published: (2024)
Personalized Representation from Personalized Generation
by: Sundaram, Shobhita, et al.
Published: (2024)
by: Sundaram, Shobhita, et al.
Published: (2024)
Better Together: Leveraging Unpaired Multimodal Data for Stronger Unimodal Models
by: Gupta, Sharut, et al.
Published: (2025)
by: Gupta, Sharut, et al.
Published: (2025)
A PDE-Informed Latent Diffusion Model for 2-m Temperature Downscaling
by: Rosu, Paul, et al.
Published: (2025)
by: Rosu, Paul, et al.
Published: (2025)
Muon Optimizes Under Spectral Norm Constraints
by: Chen, Lizhang, et al.
Published: (2025)
by: Chen, Lizhang, et al.
Published: (2025)
Modular MeanFlow: Towards Stable and Scalable One-Step Generative Modeling
by: You, Haochen, et al.
Published: (2025)
by: You, Haochen, et al.
Published: (2025)
Muown: Row-Norm Control for Muon Optimization
by: Lion, Kai, et al.
Published: (2026)
by: Lion, Kai, et al.
Published: (2026)
Single-pass Adaptive Image Tokenization for Minimum Program Search
by: Duggal, Shivam, et al.
Published: (2025)
by: Duggal, Shivam, et al.
Published: (2025)
From BOP to BOSS and Beyond: Time Series Classification with Dictionary Based Classifiers
by: Large, James, et al.
Published: (2018)
by: Large, James, et al.
Published: (2018)
Riemannian Optimization in Modular Systems
by: Pehle, Christian, et al.
Published: (2026)
by: Pehle, Christian, et al.
Published: (2026)
HO-FMN: Hyperparameter Optimization for Fast Minimum-Norm Attacks
by: Mura, Raffaele, et al.
Published: (2024)
by: Mura, Raffaele, et al.
Published: (2024)
Incorporating Surrogate Gradient Norm to Improve Offline Optimization Techniques
by: Dao, Manh Cuong, et al.
Published: (2025)
by: Dao, Manh Cuong, et al.
Published: (2025)
The Ky Fan Norms and Beyond: Dual Norms and Combinations for Matrix Optimization
by: Kravatskiy, Alexey, et al.
Published: (2025)
by: Kravatskiy, Alexey, et al.
Published: (2025)
SketchOGD: Memory-Efficient Continual Learning
by: Min, Youngjae, et al.
Published: (2023)
by: Min, Youngjae, et al.
Published: (2023)
ReasonCACHE: Teaching LLMs To Reason Without Weight Updates
by: Gupta, Sharut, et al.
Published: (2026)
by: Gupta, Sharut, et al.
Published: (2026)
TQ-DiT: Efficient Time-Aware Quantization for Diffusion Transformers
by: Hwang, Younghye, et al.
Published: (2025)
by: Hwang, Younghye, et al.
Published: (2025)
FedHB: Hierarchical Bayesian Federated Learning
by: Kim, Minyoung, et al.
Published: (2023)
by: Kim, Minyoung, et al.
Published: (2023)
SortedNet: A Scalable and Generalized Framework for Training Modular Deep Neural Networks
by: Valipour, Mojtaba, et al.
Published: (2023)
by: Valipour, Mojtaba, et al.
Published: (2023)
DreamSim: Learning New Dimensions of Human Visual Similarity using Synthetic Data
by: Fu, Stephanie, et al.
Published: (2023)
by: Fu, Stephanie, et al.
Published: (2023)
Small Gradient Norm Regret for Online Convex Optimization
by: Gao, Wenzhi, et al.
Published: (2026)
by: Gao, Wenzhi, et al.
Published: (2026)
RMNP: Row-Momentum Normalized Preconditioning for Scalable Matrix-Based Optimization
by: Deng, Shenyang, et al.
Published: (2026)
by: Deng, Shenyang, et al.
Published: (2026)
Distilled Feature Fields Enable Few-Shot Language-Guided Manipulation
by: Shen, William, et al.
Published: (2023)
by: Shen, William, et al.
Published: (2023)
Similar Items
-
Cycle Consistency as Reward: Learning Image-Text Alignment without Human Preferences
by: Bahng, Hyojin, et al.
Published: (2025) -
Training Neural Networks from Scratch with Parallel Low-Rank Adapters
by: Huh, Minyoung, et al.
Published: (2024) -
The Platonic Representation Hypothesis
by: Huh, Minyoung, et al.
Published: (2024) -
Old Optimizer, New Norm: An Anthology
by: Bernstein, Jeremy, et al.
Published: (2024) -
Training Transformers with Enforced Lipschitz Constants
by: Newhouse, Laker, et al.
Published: (2025)