Investigating the Histogram Loss in Regression
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Imani, Ehsan, Luedemann, Kai, Scholnick-Hughes, Sam, Elelimy, Esraa, White, Martha |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Real-Time Recurrent Learning using Trace Units in Reinforcement Learning
par: Elelimy, Esraa, et autres
Publié: (2024)
par: Elelimy, Esraa, et autres
Publié: (2024)
Rethinking the Foundations for Continual Reinforcement Learning
par: Elelimy, Esraa, et autres
Publié: (2025)
par: Elelimy, Esraa, et autres
Publié: (2025)
Deep Reinforcement Learning with Gradient Eligibility Traces
par: Elelimy, Esraa, et autres
Publié: (2025)
par: Elelimy, Esraa, et autres
Publié: (2025)
AGaLiTe: Approximate Gated Linear Transformers for Online Reinforcement Learning
par: Pramanik, Subhojeet, et autres
Publié: (2023)
par: Pramanik, Subhojeet, et autres
Publié: (2023)
Forager: a lightweight testbed for continual learning with partial observability in RL
par: Tang, Steven, et autres
Publié: (2026)
par: Tang, Steven, et autres
Publié: (2026)
Mitigating Value Hallucination in Dyna Planning via Multistep Predecessor Models
par: Aminmansour, Farzane, et autres
Publié: (2020)
par: Aminmansour, Farzane, et autres
Publié: (2020)
Investigating the Interplay of Prioritized Replay and Generalization
par: Panahi, Parham Mohammad, et autres
Publié: (2024)
par: Panahi, Parham Mohammad, et autres
Publié: (2024)
Extended Histogram-based Outlier Score (EHBOS)
par: Islam, Tanvir
Publié: (2025)
par: Islam, Tanvir
Publié: (2025)
Fine-Tuning without Performance Degradation
par: Wang, Han, et autres
Publié: (2025)
par: Wang, Han, et autres
Publié: (2025)
A Generalized Projected Bellman Error for Off-policy Value Estimation in Reinforcement Learning
par: Patterson, Andrew, et autres
Publié: (2021)
par: Patterson, Andrew, et autres
Publié: (2021)
Gradient Aligned Regression via Pairwise Losses
par: Zhu, Dixian, et autres
Publié: (2024)
par: Zhu, Dixian, et autres
Publié: (2024)
Automatic Grid Updates for Kolmogorov-Arnold Networks using Layer Histograms
par: Moody, Jamison, et autres
Publié: (2025)
par: Moody, Jamison, et autres
Publié: (2025)
Empirical Design in Reinforcement Learning
par: Patterson, Andrew, et autres
Publié: (2023)
par: Patterson, Andrew, et autres
Publié: (2023)
Beyond the Mean: Distribution-Aware Loss Functions for Bimodal Regression
par: Mohammadi-Seif, Abolfazl, et autres
Publié: (2026)
par: Mohammadi-Seif, Abolfazl, et autres
Publié: (2026)
Histogram Approaches for Imbalanced Data Streams Regression
par: Aminian, Ehsan, et autres
Publié: (2025)
par: Aminian, Ehsan, et autres
Publié: (2025)
Value Bonuses using Ensemble Errors for Exploration in Reinforcement Learning
par: Wahab, Abdul, et autres
Publié: (2026)
par: Wahab, Abdul, et autres
Publié: (2026)
Revisiting Mixture Policies in Entropy-Regularized Actor-Critic
par: He, Jiamin, et autres
Publié: (2026)
par: He, Jiamin, et autres
Publié: (2026)
Uncertainty Regularized Evidential Regression
par: Ye, Kai, et autres
Publié: (2024)
par: Ye, Kai, et autres
Publié: (2024)
Geometry of Drifting MDPs with Path-Integral Stability Certificates
par: Zhang, Zuyuan, et autres
Publié: (2026)
par: Zhang, Zuyuan, et autres
Publié: (2026)
Dist Loss: Enhancing Regression in Few-Shot Region through Distribution Distance Constraint
par: Nie, Guangkun, et autres
Publié: (2024)
par: Nie, Guangkun, et autres
Publié: (2024)
Privacy-Preserving Federated Learning with Differentially Private Hyperdimensional Computing
par: Piran, Fardin Jalil, et autres
Publié: (2024)
par: Piran, Fardin Jalil, et autres
Publié: (2024)
Demystifying the Recency Heuristic in Temporal-Difference Learning
par: Daley, Brett, et autres
Publié: (2024)
par: Daley, Brett, et autres
Publié: (2024)
Deep Double Q-learning
par: Nagarajan, Prabhat, et autres
Publié: (2025)
par: Nagarajan, Prabhat, et autres
Publié: (2025)
Distributions as Actions: A Unified Framework for Diverse Action Spaces
par: He, Jiamin, et autres
Publié: (2025)
par: He, Jiamin, et autres
Publié: (2025)
Fine-Tuning Adaptive Stochastic Optimizers: Determining the Optimal Hyperparameter $ε$ via Gradient Magnitude Histogram Analysis
par: Silva, Gustavo, et autres
Publié: (2023)
par: Silva, Gustavo, et autres
Publié: (2023)
A New View on Planning in Online Reinforcement Learning
par: Roice, Kevin, et autres
Publié: (2024)
par: Roice, Kevin, et autres
Publié: (2024)
Efficient Benchmarking Is Just Feature Selection and Multiple Regression
par: Bowyer, Sam, et autres
Publié: (2026)
par: Bowyer, Sam, et autres
Publié: (2026)
Generalized Munchausen Reinforcement Learning using Tsallis KL Divergence
par: Zhu, Lingwei, et autres
Publié: (2023)
par: Zhu, Lingwei, et autres
Publié: (2023)
When is Offline Policy Selection Sample Efficient for Reinforcement Learning?
par: Liu, Vincent, et autres
Publié: (2023)
par: Liu, Vincent, et autres
Publié: (2023)
Towards Theoretical Understanding of Transformer Test-Time Computing: Investigation on In-Context Linear Regression
par: Chen, Xingwu, et autres
Publié: (2025)
par: Chen, Xingwu, et autres
Publié: (2025)
Analyzing Generalization in Pre-Trained Symbolic Regression
par: Voigt, Henrik, et autres
Publié: (2025)
par: Voigt, Henrik, et autres
Publié: (2025)
Learning from Integral Losses in Physics Informed Neural Networks
par: Saleh, Ehsan, et autres
Publié: (2023)
par: Saleh, Ehsan, et autres
Publié: (2023)
Metric-Gradient Projection for Stable Multi-Agent Policy Learning
par: Zhang, Zuyuan, et autres
Publié: (2026)
par: Zhang, Zuyuan, et autres
Publié: (2026)
ReSAE: Residualized Sparse Autoencoders for Multi-Layer Transformer Interventions
par: Poduval, Prathyush, et autres
Publié: (2026)
par: Poduval, Prathyush, et autres
Publié: (2026)
Manifold-Constrained Energy-Based Transition Models for Offline Reinforcement Learning
par: Fang, Zeyu, et autres
Publié: (2026)
par: Fang, Zeyu, et autres
Publié: (2026)
An Analysis of Action-Value Temporal-Difference Methods That Learn State Values
par: Daley, Brett, et autres
Publié: (2025)
par: Daley, Brett, et autres
Publié: (2025)
Symmetric Behavior Regularized Policy Optimization
par: Zhu, Lingwei, et autres
Publié: (2025)
par: Zhu, Lingwei, et autres
Publié: (2025)
Goal-Space Planning with Subgoal Models
par: Lo, Chunlok, et autres
Publié: (2022)
par: Lo, Chunlok, et autres
Publié: (2022)
Gradient Iterated Temporal-Difference Learning
par: Vincent, Théo, et autres
Publié: (2026)
par: Vincent, Théo, et autres
Publié: (2026)
DeltaLLM: Compress LLMs with Low-Rank Deltas between Shared Weights
par: Mikaelyan, Liana, et autres
Publié: (2025)
par: Mikaelyan, Liana, et autres
Publié: (2025)
Documents similaires
-
Real-Time Recurrent Learning using Trace Units in Reinforcement Learning
par: Elelimy, Esraa, et autres
Publié: (2024) -
Rethinking the Foundations for Continual Reinforcement Learning
par: Elelimy, Esraa, et autres
Publié: (2025) -
Deep Reinforcement Learning with Gradient Eligibility Traces
par: Elelimy, Esraa, et autres
Publié: (2025) -
AGaLiTe: Approximate Gated Linear Transformers for Online Reinforcement Learning
par: Pramanik, Subhojeet, et autres
Publié: (2023) -
Forager: a lightweight testbed for continual learning with partial observability in RL
par: Tang, Steven, et autres
Publié: (2026)