An Adaptive Method Stabilizing Activations for Enhanced Generalization
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Seung, Hyunseok, Lee, Jaewoo, Ko, Hyunsuk |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
MAC: An Efficient Gradient Preconditioning using Mean Activation Approximated Curvature
par: Seung, Hyunseok, et autres
Publié: (2025)
par: Seung, Hyunseok, et autres
Publié: (2025)
NysAct: A Scalable Preconditioned Gradient Descent using Nystrom Approximation
par: Seung, Hyunseok, et autres
Publié: (2025)
par: Seung, Hyunseok, et autres
Publié: (2025)
Low-Rank Curvature for Zeroth-Order Optimization in LLM Fine-Tuning
par: Seung, Hyunseok, et autres
Publié: (2025)
par: Seung, Hyunseok, et autres
Publié: (2025)
Concept-skill Transferability-based Data Selection for Large Vision-Language Models
par: Lee, Jaewoo, et autres
Publié: (2024)
par: Lee, Jaewoo, et autres
Publié: (2024)
Nonlinearity Enhanced Adaptive Activation Functions
par: Yevick, David
Publié: (2024)
par: Yevick, David
Publié: (2024)
Adaptive Parametric Activation: Unifying and Generalising Activation Functions Across Tasks
par: Alexandridis, Konstantinos Panagiotis, et autres
Publié: (2024)
par: Alexandridis, Konstantinos Panagiotis, et autres
Publié: (2024)
ArcGate: Adaptive Arctangent Gated Activation
par: Bhattacharya, Avik, et autres
Publié: (2026)
par: Bhattacharya, Avik, et autres
Publié: (2026)
STELLA: Continual Audio-Video Pre-training with Spatio-Temporal Localized Alignment
par: Lee, Jaewoo, et autres
Publié: (2023)
par: Lee, Jaewoo, et autres
Publié: (2023)
Can LLMs Deceive CLIP? Benchmarking Adversarial Compositionality of Pre-trained Multimodal Representation via Text Updates
par: Ahn, Jaewoo, et autres
Publié: (2025)
par: Ahn, Jaewoo, et autres
Publié: (2025)
Exploiting Autoencoder's Weakness to Generate Pseudo Anomalies
par: Astrid, Marcella, et autres
Publié: (2024)
par: Astrid, Marcella, et autres
Publié: (2024)
Benchmarking Federated Learning for Semantic Datasets: Federated Scene Graph Generation
par: Ha, SeungBum, et autres
Publié: (2024)
par: Ha, SeungBum, et autres
Publié: (2024)
Activation Matching for Explanation Generation
par: Suhail, Pirzada, et autres
Publié: (2025)
par: Suhail, Pirzada, et autres
Publié: (2025)
Fractional Concepts in Neural Networks: Enhancing Activation Functions
par: Alijani, Zahra, et autres
Publié: (2023)
par: Alijani, Zahra, et autres
Publié: (2023)
DQA: An Efficient Method for Deep Quantization of Deep Neural Network Activations
par: Hu, Wenhao, et autres
Publié: (2024)
par: Hu, Wenhao, et autres
Publié: (2024)
Subjective and Objective Quality Evaluation of Super-Resolution Enhanced Broadcast Images on a Novel SR-IQA Dataset
par: Kim, Yongrok, et autres
Publié: (2024)
par: Kim, Yongrok, et autres
Publié: (2024)
An Open-Source Software Toolkit & Benchmark Suite for the Evaluation and Adaptation of Multimodal Action Models
par: Guruprasad, Pranav, et autres
Publié: (2025)
par: Guruprasad, Pranav, et autres
Publié: (2025)
SURGEON: Memory-Adaptive Fully Test-Time Adaptation via Dynamic Activation Sparsity
par: Ma, Ke, et autres
Publié: (2025)
par: Ma, Ke, et autres
Publié: (2025)
GeoAvatar: Adaptive Geometrical Gaussian Splatting for 3D Head Avatar
par: Moon, SeungJun, et autres
Publié: (2025)
par: Moon, SeungJun, et autres
Publié: (2025)
DefectFill: Realistic Defect Generation with Inpainting Diffusion Model for Visual Inspection
par: Song, Jaewoo, et autres
Publié: (2025)
par: Song, Jaewoo, et autres
Publié: (2025)
Enhancing Diffusion-Based Quantitatively Controllable Image Generation via Matrix-Form EDM and Adaptive Vicinal Training
par: Ding, Xin, et autres
Publié: (2026)
par: Ding, Xin, et autres
Publié: (2026)
General Transform: A Unified Framework for Adaptive Transform to Enhance Representations
par: Budiutama, Gekko, et autres
Publié: (2025)
par: Budiutama, Gekko, et autres
Publié: (2025)
Teaching Metric Distance to Discrete Autoregressive Language Models
par: Chung, Jiwan, et autres
Publié: (2025)
par: Chung, Jiwan, et autres
Publié: (2025)
AdaRank: Adaptive Rank Pruning for Enhanced Model Merging
par: Lee, Chanhyuk, et autres
Publié: (2025)
par: Lee, Chanhyuk, et autres
Publié: (2025)
Activation Quantization of Vision Encoders Needs Prefixing Registers
par: Kim, Seunghyeon, et autres
Publié: (2025)
par: Kim, Seunghyeon, et autres
Publié: (2025)
KLO-Net: A Dynamic K-NN Attention U-Net with CSP Encoder for Efficient Prostate Gland Segmentation from MRI
par: Tian, Anning, et autres
Publié: (2025)
par: Tian, Anning, et autres
Publié: (2025)
Enhancing Diffusion Model Stability for Image Restoration via Gradient Management
par: Wu, Hongjie, et autres
Publié: (2025)
par: Wu, Hongjie, et autres
Publié: (2025)
Enhancing Federated Quadruplet Learning: Stochastic Client Selection and Embedding Stability Analysis
par: Goksu, Ozgu, et autres
Publié: (2026)
par: Goksu, Ozgu, et autres
Publié: (2026)
MetaMix: Meta-state Precision Searcher for Mixed-precision Activation Quantization
par: Kim, Han-Byul, et autres
Publié: (2023)
par: Kim, Han-Byul, et autres
Publié: (2023)
RepAct: The Re-parameterizable Adaptive Activation Function
par: Wu, Xian, et autres
Publié: (2024)
par: Wu, Xian, et autres
Publié: (2024)
Enhancing Post-Training Quantization via Future Activation Awareness
par: Lv, Zheqi, et autres
Publié: (2026)
par: Lv, Zheqi, et autres
Publié: (2026)
Optimizing Few-Step Generation with Adaptive Matching Distillation
par: Bai, Lichen, et autres
Publié: (2026)
par: Bai, Lichen, et autres
Publié: (2026)
RCR-AF: Enhancing Model Generalization via Rademacher Complexity Reduction Activation Function
par: Yu, Yunrui, et autres
Publié: (2025)
par: Yu, Yunrui, et autres
Publié: (2025)
Divide-and-Conquer for Enhancing Unlabeled Learning, Stability, and Plasticity in Semi-supervised Continual Learning
par: Duan, Yue, et autres
Publié: (2025)
par: Duan, Yue, et autres
Publié: (2025)
Adaptive Teaching with Shared Classifier for Knowledge Distillation
par: Jang, Jaeyeon, et autres
Publié: (2024)
par: Jang, Jaeyeon, et autres
Publié: (2024)
Stable-Drift: A Patient-Aware Latent Drift Replay Method for Stabilizing Representations in Continual Learning
par: Theofilou, Paraskevi-Antonia, et autres
Publié: (2025)
par: Theofilou, Paraskevi-Antonia, et autres
Publié: (2025)
Adaptive Sample-Level Framework Motivated by Distributionally Robust Optimization with Variance-Based Radius Assignment for Enhanced Neural Network Generalization Under Distribution Shift
par: Sravon, Aheer, et autres
Publié: (2025)
par: Sravon, Aheer, et autres
Publié: (2025)
Spectrum Translation for Refinement of Image Generation (STIG) Based on Contrastive Learning and Spectral Filter Profile
par: Lee, Seokjun, et autres
Publié: (2024)
par: Lee, Seokjun, et autres
Publié: (2024)
Sparsely Activated Networks
par: Bizopoulos, Paschalis, et autres
Publié: (2019)
par: Bizopoulos, Paschalis, et autres
Publié: (2019)
DiffInject: Revisiting Debias via Synthetic Data Generation using Diffusion-based Style Injection
par: Ko, Donggeun, et autres
Publié: (2024)
par: Ko, Donggeun, et autres
Publié: (2024)
Anomaly Score: Evaluating Generative Models and Individual Generated Images based on Complexity and Vulnerability
par: Hwang, Jaehui, et autres
Publié: (2023)
par: Hwang, Jaehui, et autres
Publié: (2023)
Documents similaires
-
MAC: An Efficient Gradient Preconditioning using Mean Activation Approximated Curvature
par: Seung, Hyunseok, et autres
Publié: (2025) -
NysAct: A Scalable Preconditioned Gradient Descent using Nystrom Approximation
par: Seung, Hyunseok, et autres
Publié: (2025) -
Low-Rank Curvature for Zeroth-Order Optimization in LLM Fine-Tuning
par: Seung, Hyunseok, et autres
Publié: (2025) -
Concept-skill Transferability-based Data Selection for Large Vision-Language Models
par: Lee, Jaewoo, et autres
Publié: (2024) -
Nonlinearity Enhanced Adaptive Activation Functions
par: Yevick, David
Publié: (2024)