Gradient Aligned Regression via Pairwise Losses
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhu, Dixian, Yang, Tianbao, Jerby, Livnat |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Non-Smooth Weakly-Convex Finite-sum Coupled Compositional Optimization
di: Hu, Quanqi, et al.
Pubblicazione: (2023)
di: Hu, Quanqi, et al.
Pubblicazione: (2023)
Post Hoc Regression Refinement via Pairwise Rankings
di: Wijaya, Kevin Tirta, et al.
Pubblicazione: (2025)
di: Wijaya, Kevin Tirta, et al.
Pubblicazione: (2025)
When Losses Align: Gradient-Based Composite Loss Weighting for Efficient Pretraining
di: Karpukhin, Ivan, et al.
Pubblicazione: (2026)
di: Karpukhin, Ivan, et al.
Pubblicazione: (2026)
Harness as an Asset: Enforcing Determinism via the Convergent AI Agent Framework (CAAF)
di: Zhang, Tianbao
Pubblicazione: (2026)
di: Zhang, Tianbao
Pubblicazione: (2026)
Efficient Epistemic Uncertainty Estimation in Regression Ensemble Models Using Pairwise-Distance Estimators
di: Berry, Lucas, et al.
Pubblicazione: (2023)
di: Berry, Lucas, et al.
Pubblicazione: (2023)
Vertical Symbolic Regression via Deep Policy Gradient
di: Jiang, Nan, et al.
Pubblicazione: (2024)
di: Jiang, Nan, et al.
Pubblicazione: (2024)
PSL: Rethinking and Improving Softmax Loss from Pairwise Perspective for Recommendation
di: Yang, Weiqin, et al.
Pubblicazione: (2024)
di: Yang, Weiqin, et al.
Pubblicazione: (2024)
DRPO: Efficient Reasoning via Decoupled Reward Policy Optimization
di: Li, Gang, et al.
Pubblicazione: (2025)
di: Li, Gang, et al.
Pubblicazione: (2025)
Investigating the Histogram Loss in Regression
di: Imani, Ehsan, et al.
Pubblicazione: (2024)
di: Imani, Ehsan, et al.
Pubblicazione: (2024)
GradAlign: Gradient-Aligned Data Selection for LLM Reinforcement Learning
di: Yang, Ningyuan, et al.
Pubblicazione: (2026)
di: Yang, Ningyuan, et al.
Pubblicazione: (2026)
Aligning with Human Judgement: The Role of Pairwise Preference in Large Language Model Evaluators
di: Liu, Yinhong, et al.
Pubblicazione: (2024)
di: Liu, Yinhong, et al.
Pubblicazione: (2024)
Geometrically Aligned Transfer Encoder for Inductive Transfer in Regression Tasks
di: Ko, Sung Moon, et al.
Pubblicazione: (2023)
di: Ko, Sung Moon, et al.
Pubblicazione: (2023)
Pairwise Difference Learning for Classification
di: Belaid, Mohamed Karim, et al.
Pubblicazione: (2024)
di: Belaid, Mohamed Karim, et al.
Pubblicazione: (2024)
Multi-Output Distributional Fairness via Post-Processing
di: Li, Gang, et al.
Pubblicazione: (2024)
di: Li, Gang, et al.
Pubblicazione: (2024)
Myna: Masking-Based Contrastive Learning of Musical Representations
di: Yonay, Ori, et al.
Pubblicazione: (2025)
di: Yonay, Ori, et al.
Pubblicazione: (2025)
Annealed Co-Generation: Disentangling Variables via Progressive Pairwise Modeling
di: Zhang, Hantao, et al.
Pubblicazione: (2026)
di: Zhang, Hantao, et al.
Pubblicazione: (2026)
LearnAlign: Data Selection for LLM Reinforcement Learning with Improved Gradient Alignment
di: Li, Shipeng, et al.
Pubblicazione: (2025)
di: Li, Shipeng, et al.
Pubblicazione: (2025)
Approximated Orthogonal Projection Unit: Stabilizing Regression Network Training Using Natural Gradient
di: Wang, Shaoqi, et al.
Pubblicazione: (2024)
di: Wang, Shaoqi, et al.
Pubblicazione: (2024)
Beyond the Mean: Distribution-Aware Loss Functions for Bimodal Regression
di: Mohammadi-Seif, Abolfazl, et al.
Pubblicazione: (2026)
di: Mohammadi-Seif, Abolfazl, et al.
Pubblicazione: (2026)
Dynamic Model Selection for Trajectory Prediction via Pairwise Ranking and Meta-Features
di: Bowen, Lu
Pubblicazione: (2025)
di: Bowen, Lu
Pubblicazione: (2025)
Less is More: Multimodal Region Representation via Pairwise Inter-view Learning
di: Namgung, Min, et al.
Pubblicazione: (2025)
di: Namgung, Min, et al.
Pubblicazione: (2025)
Pairwise Calibrated Rewards for Pluralistic Alignment
di: Halpern, Daniel, et al.
Pubblicazione: (2025)
di: Halpern, Daniel, et al.
Pubblicazione: (2025)
Shift of Pairwise Similarities for Data Clustering
di: Chehreghani, Morteza Haghir
Pubblicazione: (2021)
di: Chehreghani, Morteza Haghir
Pubblicazione: (2021)
GradTree: Learning Axis-Aligned Decision Trees with Gradient Descent
di: Marton, Sascha, et al.
Pubblicazione: (2023)
di: Marton, Sascha, et al.
Pubblicazione: (2023)
Post-processing for Fair Regression via Explainable SVD
di: Zuo, Zhiqun, et al.
Pubblicazione: (2025)
di: Zuo, Zhiqun, et al.
Pubblicazione: (2025)
Federated Smoothing Proximal Gradient for Quantile Regression with Non-Convex Penalties
di: Mirzaeifard, Reza, et al.
Pubblicazione: (2024)
di: Mirzaeifard, Reza, et al.
Pubblicazione: (2024)
DisCO: Reinforcing Large Reasoning Models with Discriminative Constrained Optimization
di: Li, Gang, et al.
Pubblicazione: (2025)
di: Li, Gang, et al.
Pubblicazione: (2025)
Complexity-Aware Deep Symbolic Regression with Robust Risk-Seeking Policy Gradients
di: Bastiani, Zachary, et al.
Pubblicazione: (2024)
di: Bastiani, Zachary, et al.
Pubblicazione: (2024)
Dist Loss: Enhancing Regression in Few-Shot Region through Distribution Distance Constraint
di: Nie, Guangkun, et al.
Pubblicazione: (2024)
di: Nie, Guangkun, et al.
Pubblicazione: (2024)
Reinforcement Learning with Pairwise Preferences in Long-Term Decision Problems
di: Carr, Jonathan Colaço, et al.
Pubblicazione: (2026)
di: Carr, Jonathan Colaço, et al.
Pubblicazione: (2026)
Local Pairwise Distance Matching for Backpropagation-Free Reinforcement Learning
di: Tanneberg, Daniel
Pubblicazione: (2025)
di: Tanneberg, Daniel
Pubblicazione: (2025)
From Abstract to Actionable: Pairwise Shapley Values for Explainable AI
di: Xu, Jiaxin, et al.
Pubblicazione: (2025)
di: Xu, Jiaxin, et al.
Pubblicazione: (2025)
Fast and Featureless Node Representation Learning with Partial Pairwise Supervision
di: Chakraborty, Sujan, et al.
Pubblicazione: (2026)
di: Chakraborty, Sujan, et al.
Pubblicazione: (2026)
PaTaRM: Bridging Pairwise and Pointwise Signals via Preference-Aware Task-Adaptive Reward Modeling
di: Jian, Ai, et al.
Pubblicazione: (2025)
di: Jian, Ai, et al.
Pubblicazione: (2025)
Verifier-Free RL for LLMs via Intrinsic Gradient-Norm Reward
di: Wen, Xuexiang, et al.
Pubblicazione: (2026)
di: Wen, Xuexiang, et al.
Pubblicazione: (2026)
A3S: A General Active Clustering Method with Pairwise Constraints
di: Deng, Xun, et al.
Pubblicazione: (2024)
di: Deng, Xun, et al.
Pubblicazione: (2024)
Quantifying Multimodal Capabilities: Formal Generalization Guarantees in Pairwise Metric Learning
di: Zhou, Richeng, et al.
Pubblicazione: (2026)
di: Zhou, Richeng, et al.
Pubblicazione: (2026)
On the Representation of Pairwise Causal Background Knowledge and Its Applications in Causal Inference
di: Fang, Zhuangyan, et al.
Pubblicazione: (2022)
di: Fang, Zhuangyan, et al.
Pubblicazione: (2022)
From Noisy Traces to Stable Gradients: Bias-Variance Optimized Preference Optimization for Aligning Large Reasoning Models
di: Zhu, Mingkang, et al.
Pubblicazione: (2025)
di: Zhu, Mingkang, et al.
Pubblicazione: (2025)
AlignedCoT: Prompting Large Language Models via Native-Speaking Demonstrations
di: Yang, Zhicheng, et al.
Pubblicazione: (2023)
di: Yang, Zhicheng, et al.
Pubblicazione: (2023)
Documenti analoghi
-
Non-Smooth Weakly-Convex Finite-sum Coupled Compositional Optimization
di: Hu, Quanqi, et al.
Pubblicazione: (2023) -
Post Hoc Regression Refinement via Pairwise Rankings
di: Wijaya, Kevin Tirta, et al.
Pubblicazione: (2025) -
When Losses Align: Gradient-Based Composite Loss Weighting for Efficient Pretraining
di: Karpukhin, Ivan, et al.
Pubblicazione: (2026) -
Harness as an Asset: Enforcing Determinism via the Convergent AI Agent Framework (CAAF)
di: Zhang, Tianbao
Pubblicazione: (2026) -
Efficient Epistemic Uncertainty Estimation in Regression Ensemble Models Using Pairwise-Distance Estimators
di: Berry, Lucas, et al.
Pubblicazione: (2023)