Enregistré dans:
| Auteurs principaux: | Liu, Liming, Zhang, Zixuan, Du, Simon, Zhao, Tuo |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2503.02809 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
BackPlay: Head-Only Look-Back Self-Correction for Diffusion Language Models
par: Liu, Liming, et autres
Publié: (2026)
par: Liu, Liming, et autres
Publié: (2026)
COSMOS: A Hybrid Adaptive Optimizer for Memory-Efficient Training of LLMs
par: Liu, Liming, et autres
Publié: (2025)
par: Liu, Liming, et autres
Publié: (2025)
On the Interplay Between Stepsize Tuning and Progressive Sharpening
par: Roulet, Vincent, et autres
Publié: (2023)
par: Roulet, Vincent, et autres
Publié: (2023)
Diffusion Model for Manifold Data: Score Decomposition, Curvature, and Statistical Complexity
par: Zhang, Zixuan, et autres
Publié: (2026)
par: Zhang, Zixuan, et autres
Publié: (2026)
NorMuon: Making Muon more efficient and scalable
par: Li, Zichong, et autres
Publié: (2025)
par: Li, Zichong, et autres
Publié: (2025)
Understanding Sharpness Dynamics in NN Training with a Minimalist Example: The Effects of Dataset Difficulty, Depth, Stochasticity, and More
par: Yoo, Geonhui, et autres
Publié: (2025)
par: Yoo, Geonhui, et autres
Publié: (2025)
Minimalist Softmax Attention Provably Learns Constrained Boolean Functions
par: Hu, Jerry Yao-Chieh, et autres
Publié: (2025)
par: Hu, Jerry Yao-Chieh, et autres
Publié: (2025)
Differential Smoothing Mitigates Sharpening and Improves LLM Reasoning
par: Gai, Jingchu, et autres
Publié: (2025)
par: Gai, Jingchu, et autres
Publié: (2025)
Provably Unlearnable Data Examples
par: Wang, Derui, et autres
Publié: (2024)
par: Wang, Derui, et autres
Publié: (2024)
Robust Reinforcement Learning from Corrupted Human Feedback
par: Bukharin, Alexander, et autres
Publié: (2024)
par: Bukharin, Alexander, et autres
Publié: (2024)
Nonparametric Classification on Low Dimensional Manifolds using Overparameterized Convolutional Residual Networks
par: Zhang, Zixuan, et autres
Publié: (2023)
par: Zhang, Zixuan, et autres
Publié: (2023)
Self-Consistency via Marginal Sharpening
par: Arzhantsev, Aleksei, et autres
Publié: (2026)
par: Arzhantsev, Aleksei, et autres
Publié: (2026)
Understanding Pan-Sharpening via Generalized Inverse
par: Liu, Shiqi, et autres
Publié: (2023)
par: Liu, Shiqi, et autres
Publié: (2023)
A Minimalist Prompt for Zero-Shot Policy Learning
par: Song, Meng, et autres
Publié: (2024)
par: Song, Meng, et autres
Publié: (2024)
Rewarding the Unlikely: Lifting GRPO Beyond Distribution Sharpening
par: He, Andre, et autres
Publié: (2025)
par: He, Andre, et autres
Publié: (2025)
Self-Improvement in Language Models: The Sharpening Mechanism
par: Huang, Audrey, et autres
Publié: (2024)
par: Huang, Audrey, et autres
Publié: (2024)
Minimalist Concept Erasure in Generative Models
par: Zhang, Yang, et autres
Publié: (2025)
par: Zhang, Yang, et autres
Publié: (2025)
Beyond Distribution Sharpening: The Importance of Task Rewards
par: Mittal, Sarthak, et autres
Publié: (2026)
par: Mittal, Sarthak, et autres
Publié: (2026)
Sharpened Lazy Incremental Quasi-Newton Method
par: Lahoti, Aakash, et autres
Publié: (2023)
par: Lahoti, Aakash, et autres
Publié: (2023)
MINTS: Minimalist Thompson Sampling
par: Wang, Kaizheng
Publié: (2026)
par: Wang, Kaizheng
Publié: (2026)
Soft-Label Caching and Sharpening for Communication-Efficient Federated Distillation
par: Azuma, Kitsuya, et autres
Publié: (2025)
par: Azuma, Kitsuya, et autres
Publié: (2025)
Graph Transductive Sharpening: Leveraging Unlabeled Predictions in Node Classification
par: Zaz, Brown, et autres
Publié: (2026)
par: Zaz, Brown, et autres
Publié: (2026)
Minimalist Visual Inertial Odometry
par: Pasti, Francesco, et autres
Publié: (2026)
par: Pasti, Francesco, et autres
Publié: (2026)
SlimMoE: Structured Compression of Large MoE Models via Expert Slimming and Distillation
par: Li, Zichong, et autres
Publié: (2025)
par: Li, Zichong, et autres
Publié: (2025)
A Minimalist Bayesian Framework for Stochastic Optimization
par: Wang, Kaizheng
Publié: (2025)
par: Wang, Kaizheng
Publié: (2025)
Laplacian Score Sharpening for Mitigating Hallucination in Diffusion Models
par: C, Barath Chandran., et autres
Publié: (2025)
par: C, Barath Chandran., et autres
Publié: (2025)
Edge of Stochastic Stability: Revisiting the Edge of Stability for SGD
par: Andreyev, Arseniy, et autres
Publié: (2024)
par: Andreyev, Arseniy, et autres
Publié: (2024)
The Origin of Edge of Stability
par: Litman, Elon
Publié: (2026)
par: Litman, Elon
Publié: (2026)
Persistent Classification: A New Approach to Stability of Data and Adversarial Examples
par: Bell, Brian, et autres
Publié: (2024)
par: Bell, Brian, et autres
Publié: (2024)
Laplacian Canonization: A Minimalist Approach to Sign and Basis Invariant Spectral Embedding
par: Ma, Jiangyan, et autres
Publié: (2023)
par: Ma, Jiangyan, et autres
Publié: (2023)
Sharpen Your Flow: Sharpness-Aware Sampling for Flow Matching
par: Gupta, Aditi, et autres
Publié: (2026)
par: Gupta, Aditi, et autres
Publié: (2026)
RAZOR: Sharpening Knowledge by Cutting Bias with Unsupervised Text Rewriting
par: Yang, Shuo, et autres
Publié: (2024)
par: Yang, Shuo, et autres
Publié: (2024)
SEEN: Sharpening Explanations for Graph Neural Networks using Explanations from Neighborhoods
par: Cho, Hyeoncheol, et autres
Publié: (2021)
par: Cho, Hyeoncheol, et autres
Publié: (2021)
A Minimalist Method for Fine-tuning Text-to-Image Diffusion Models
par: Miao, Yanting, et autres
Publié: (2025)
par: Miao, Yanting, et autres
Publié: (2025)
SimPER: A Minimalist Approach to Preference Alignment without Hyperparameters
par: Xiao, Teng, et autres
Publié: (2025)
par: Xiao, Teng, et autres
Publié: (2025)
Gaussian Match-and-Copy: A Minimalist Benchmark for Studying Transformer Induction
par: Gonon, Antoine, et autres
Publié: (2026)
par: Gonon, Antoine, et autres
Publié: (2026)
When Sharpening Becomes Collapse: Sampling Bias and Semantic Coupling in RL with Verifiable Rewards
par: Fan, Mingyuan, et autres
Publié: (2026)
par: Fan, Mingyuan, et autres
Publié: (2026)
B3C: A Minimalist Approach to Offline Multi-Agent Reinforcement Learning
par: Kim, Woojun, et autres
Publié: (2025)
par: Kim, Woojun, et autres
Publié: (2025)
A Minimalist Approach to LLM Reasoning: from Rejection Sampling to Reinforce
par: Xiong, Wei, et autres
Publié: (2025)
par: Xiong, Wei, et autres
Publié: (2025)
Efficient Edge LLMs Deployment via HessianAware Quantization and CPU GPU Collaborative
par: Zhang, Tuo, et autres
Publié: (2025)
par: Zhang, Tuo, et autres
Publié: (2025)
Documents similaires
-
BackPlay: Head-Only Look-Back Self-Correction for Diffusion Language Models
par: Liu, Liming, et autres
Publié: (2026) -
COSMOS: A Hybrid Adaptive Optimizer for Memory-Efficient Training of LLMs
par: Liu, Liming, et autres
Publié: (2025) -
On the Interplay Between Stepsize Tuning and Progressive Sharpening
par: Roulet, Vincent, et autres
Publié: (2023) -
Diffusion Model for Manifold Data: Score Decomposition, Curvature, and Statistical Complexity
par: Zhang, Zixuan, et autres
Publié: (2026) -
NorMuon: Making Muon more efficient and scalable
par: Li, Zichong, et autres
Publié: (2025)