Break a Lag: Triple Exponential Moving Average for Enhanced Optimization
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Peleg, Roi, Smadar, Yair, Lazebnik, Teddy, Hoogi, Assaf |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Recurrent Neural Networks for Still Images
par: Dmitri, et autres
Publié: (2024)
par: Dmitri, et autres
Publié: (2024)
GS-EMA: Integrating Gradient Surgery Exponential Moving Average with Boundary-Aware Contrastive Learning for Enhanced Domain Generalization in Aneurysm Segmentation
par: Lin, Fengming, et autres
Publié: (2024)
par: Lin, Fengming, et autres
Publié: (2024)
Advancing Compositional Awareness in CLIP with Efficient Fine-Tuning
par: Peleg, Amit, et autres
Publié: (2025)
par: Peleg, Amit, et autres
Publié: (2025)
PTEENet: Post-Trained Early-Exit Neural Networks Augmentation for Inference Cost Optimization
par: Lahiany, Assaf, et autres
Publié: (2025)
par: Lahiany, Assaf, et autres
Publié: (2025)
The Unified Balance Theory of Second-Moment Exponential Scaling Optimizers in Visual Tasks
par: Zhang, Gongyue, et autres
Publié: (2024)
par: Zhang, Gongyue, et autres
Publié: (2024)
ToFe: Lagged Token Freezing and Reusing for Efficient Vision Transformer Inference
par: Zhang, Haoyue, et autres
Publié: (2025)
par: Zhang, Haoyue, et autres
Publié: (2025)
XVertNet: Unsupervised Contrast Enhancement of Vertebral Structures with Dynamic Self-Tuning Guidance and Multi-Stage Analysis
par: Eidlin, Ella, et autres
Publié: (2023)
par: Eidlin, Ella, et autres
Publié: (2023)
Filter Like You Test: Data-Driven Data Filtering for CLIP Pretraining
par: Shechter, Mikey, et autres
Publié: (2025)
par: Shechter, Mikey, et autres
Publié: (2025)
Intriguing Properties of Modern GANs
par: Friedman, Roy, et autres
Publié: (2024)
par: Friedman, Roy, et autres
Publié: (2024)
Pseudo-Invertible Neural Networks
par: Ehrlich, Yamit, et autres
Publié: (2026)
par: Ehrlich, Yamit, et autres
Publié: (2026)
EMAG: Self-Rectifying Diffusion Sampling with Exponential Moving Average Guidance
par: Yadav, Ankit, et autres
Publié: (2025)
par: Yadav, Ankit, et autres
Publié: (2025)
LagKV: Lag-Relative Information of the KV Cache Tells Which Tokens Are Important
par: Liang, Manlai, et autres
Publié: (2025)
par: Liang, Manlai, et autres
Publié: (2025)
Time-to-Move: Training-Free Motion Controlled Video Generation via Dual-Clock Denoising
par: Singer, Assaf, et autres
Publié: (2025)
par: Singer, Assaf, et autres
Publié: (2025)
Is the Modality Gap a Bug or a Feature? A Robustness Perspective
par: Chowers, Rhea, et autres
Publié: (2026)
par: Chowers, Rhea, et autres
Publié: (2026)
Breaking the Limits of Open-Weight CLIP: An Optimization Framework for Self-supervised Fine-tuning of CLIP
par: Mehta, Anant, et autres
Publié: (2026)
par: Mehta, Anant, et autres
Publié: (2026)
PopulAtion Parameter Averaging (PAPA)
par: Jolicoeur-Martineau, Alexia, et autres
Publié: (2023)
par: Jolicoeur-Martineau, Alexia, et autres
Publié: (2023)
Rethinking Weight-Averaged Model-merging
par: Wang, Hu, et autres
Publié: (2024)
par: Wang, Hu, et autres
Publié: (2024)
Layer Pruning with Consensus: A Triple-Win Solution
par: Mugnaini, Leandro Giusti, et autres
Publié: (2024)
par: Mugnaini, Leandro Giusti, et autres
Publié: (2024)
RoHan: Robust Hand Detection in Operation Room
par: Papo, Roi, et autres
Publié: (2025)
par: Papo, Roi, et autres
Publié: (2025)
Unsupervised Fault Detection using SAM with a Moving Window Approach
par: Maged, Ahmed, et autres
Publié: (2024)
par: Maged, Ahmed, et autres
Publié: (2024)
Not Every Image is Worth a Thousand Words: Quantifying Originality in Stable Diffusion
par: Haviv, Adi, et autres
Publié: (2024)
par: Haviv, Adi, et autres
Publié: (2024)
Constructive Distortion: Improving MLLMs with Attention-Guided Image Warping
par: Dalal, Dwip, et autres
Publié: (2025)
par: Dalal, Dwip, et autres
Publié: (2025)
Value bounds and Convergence Analysis for Averages of LRP attributions
par: Binder, Alexander, et autres
Publié: (2025)
par: Binder, Alexander, et autres
Publié: (2025)
NavFormer: IGRF Forecasting in Moving Coordinate Frames
par: Hwang, Yoontae, et autres
Publié: (2026)
par: Hwang, Yoontae, et autres
Publié: (2026)
ZipLoRA: Any Subject in Any Style by Effectively Merging LoRAs
par: Shah, Viraj, et autres
Publié: (2023)
par: Shah, Viraj, et autres
Publié: (2023)
Improving Diffusion Posterior Samplers with Lagged Temporal Corrections for Image Restoration
par: Evangelista, Davide, et autres
Publié: (2026)
par: Evangelista, Davide, et autres
Publié: (2026)
Maximizing the Position Embedding for Vision Transformers with Global Average Pooling
par: Lee, Wonjun, et autres
Publié: (2025)
par: Lee, Wonjun, et autres
Publié: (2025)
TripleSumm: Adaptive Triple-Modality Fusion for Video Summarization
par: Kim, Sumin, et autres
Publié: (2026)
par: Kim, Sumin, et autres
Publié: (2026)
Text2Model: Text-based Model Induction for Zero-shot Image Classification
par: Amosy, Ohad, et autres
Publié: (2022)
par: Amosy, Ohad, et autres
Publié: (2022)
Unveiling Deepfakes: A Frequency-Aware Triple Branch Network for Deepfake Detection
par: Shen, Qihao, et autres
Publié: (2026)
par: Shen, Qihao, et autres
Publié: (2026)
Weight Averaging for Out-of-Distribution Generalization and Few-Shot Domain Adaptation
par: Xu, Shijian
Publié: (2025)
par: Xu, Shijian
Publié: (2025)
Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference
par: Gafni, Tomer, et autres
Publié: (2025)
par: Gafni, Tomer, et autres
Publié: (2025)
RL-RC-DoT: A Block-level RL agent for Task-Aware Video Compression
par: Gadot, Uri, et autres
Publié: (2025)
par: Gadot, Uri, et autres
Publié: (2025)
Average Calibration Error: A Differentiable Loss for Improved Reliability in Image Segmentation
par: Barfoot, Theodore, et autres
Publié: (2024)
par: Barfoot, Theodore, et autres
Publié: (2024)
Landmark Stereo Dataset for Landmark Recognition and Moving Node Localization in a Non-GPS Battlefield Environment
par: Sapkota, Ganesh, et autres
Publié: (2024)
par: Sapkota, Ganesh, et autres
Publié: (2024)
Self-Supervised Moving Object Segmentation of Sparse and Noisy Radar Point Clouds
par: Schwarzer, Leon, et autres
Publié: (2025)
par: Schwarzer, Leon, et autres
Publié: (2025)
Better than Average: Spatially-Aware Aggregation of Segmentation Uncertainty Improves Downstream Performance
par: Guarino, Vanessa Emanuela, et autres
Publié: (2026)
par: Guarino, Vanessa Emanuela, et autres
Publié: (2026)
SEE-DPO: Self Entropy Enhanced Direct Preference Optimization
par: Shekhar, Shivanshu, et autres
Publié: (2024)
par: Shekhar, Shivanshu, et autres
Publié: (2024)
Breaking the Illusion: Real-world Challenges for Adversarial Patches in Object Detection
par: Shack, Jakob, et autres
Publié: (2024)
par: Shack, Jakob, et autres
Publié: (2024)
MovePose: A High-performance Human Pose Estimation Algorithm on Mobile and Edge Devices
par: Yu, Dongyang, et autres
Publié: (2023)
par: Yu, Dongyang, et autres
Publié: (2023)
Documents similaires
-
Recurrent Neural Networks for Still Images
par: Dmitri, et autres
Publié: (2024) -
GS-EMA: Integrating Gradient Surgery Exponential Moving Average with Boundary-Aware Contrastive Learning for Enhanced Domain Generalization in Aneurysm Segmentation
par: Lin, Fengming, et autres
Publié: (2024) -
Advancing Compositional Awareness in CLIP with Efficient Fine-Tuning
par: Peleg, Amit, et autres
Publié: (2025) -
PTEENet: Post-Trained Early-Exit Neural Networks Augmentation for Inference Cost Optimization
par: Lahiany, Assaf, et autres
Publié: (2025) -
The Unified Balance Theory of Second-Moment Exponential Scaling Optimizers in Visual Tasks
par: Zhang, Gongyue, et autres
Publié: (2024)