Enregistré dans:
| Auteurs principaux: | Zheng, Hongye, Wang, Bingxing, Xiao, Minheng, Qin, Honglin, Wu, Zhizhong, Tan, Lianghao |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2408.11839 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Reducing Bias in Deep Learning Optimization: The RSGDM Approach
par: Qin, Honglin, et autres
Publié: (2024)
par: Qin, Honglin, et autres
Publié: (2024)
Root Cause Attribution of Delivery Risks via Causal Discovery with Reinforcement Learning
par: Xiao, Minheng
Publié: (2024)
par: Xiao, Minheng
Publié: (2024)
Multiple Greedy Quasi-Newton Methods for Saddle Point Problems
par: Xiao, Minheng, et autres
Publié: (2024)
par: Xiao, Minheng, et autres
Publié: (2024)
Stock Type Prediction Model Based on Hierarchical Graph Neural Network
par: Yao, Jianhua, et autres
Publié: (2024)
par: Yao, Jianhua, et autres
Publié: (2024)
Policy Gradient Methods for Risk-Sensitive Distributional Reinforcement Learning with Provable Convergence
par: Xiao, Minheng, et autres
Publié: (2024)
par: Xiao, Minheng, et autres
Publié: (2024)
Robust Weight Initialization for Tanh Neural Networks with Fixed Point Analysis
par: Lee, Hyunwoo, et autres
Publié: (2024)
par: Lee, Hyunwoo, et autres
Publié: (2024)
SNAP: Stopping Catastrophic Forgetting in Hebbian Learning with Sigmoidal Neuronal Adaptive Plasticity
par: Xu, Tianyi, et autres
Publié: (2024)
par: Xu, Tianyi, et autres
Publié: (2024)
Top K Enhanced Reinforcement Learning Attacks on Heterogeneous Graph Node Classification
par: Gao, Honglin, et autres
Publié: (2024)
par: Gao, Honglin, et autres
Publié: (2024)
Dynamic Hypergraph-Enhanced Prediction of Sequential Medical Visits
par: Yang, Wangying, et autres
Publié: (2024)
par: Yang, Wangying, et autres
Publié: (2024)
FedGRec: Dynamic Spatio-Temporal Federated Graph Learning for Secure and Efficient Cross-Border Recommendations
par: Tan, Zhizhong, et autres
Publié: (2025)
par: Tan, Zhizhong, et autres
Publié: (2025)
Learning Cross-Atlas Consistent Brain Disorder Representations via Disentangled Multi-Atlas Functional Connectivity Learning
par: Chen, Minheng, et autres
Publié: (2026)
par: Chen, Minheng, et autres
Publié: (2026)
Global Minimizers of Sigmoid Contrastive Loss
par: Bangachev, Kiril, et autres
Publié: (2025)
par: Bangachev, Kiril, et autres
Publié: (2025)
AnyGraph: Graph Foundation Model in the Wild
par: Xia, Lianghao, et autres
Publié: (2024)
par: Xia, Lianghao, et autres
Publié: (2024)
An Efficient Recommendation Model Based on Knowledge Graph Attention-Assisted Network (KGATAX)
par: Wu, Zhizhong
Publié: (2024)
par: Wu, Zhizhong
Publié: (2024)
Thinking Preference Optimization
par: Yang, Wang, et autres
Publié: (2025)
par: Yang, Wang, et autres
Publié: (2025)
Achieving the Tightest Relaxation of Sigmoids for Formal Verification
par: Chevalier, Samuel, et autres
Publié: (2024)
par: Chevalier, Samuel, et autres
Publié: (2024)
Frictional Q-Learning
par: Kim, Hyunwoo, et autres
Publié: (2025)
par: Kim, Hyunwoo, et autres
Publié: (2025)
Reinforcement Learning Fine-Tuning Enhances Activation Intensity and Diversity in the Internal Circuitry of LLMs
par: Zhang, Honglin, et autres
Publié: (2025)
par: Zhang, Honglin, et autres
Publié: (2025)
Contrastive Learning for Multi Label ECG Classification with Jaccard Score Based Sigmoid Loss
par: Takahashi, Junichiro, et autres
Publié: (2026)
par: Takahashi, Junichiro, et autres
Publié: (2026)
Automated Design of Linear Bounding Functions for Sigmoidal Nonlinearities in Neural Networks
par: König, Matthias, et autres
Publié: (2024)
par: König, Matthias, et autres
Publié: (2024)
Adaptive Image Registration: A Hybrid Approach Integrating Deep Learning and Optimization Functions for Enhanced Precision
par: De Araujo, Gabriel, et autres
Publié: (2023)
par: De Araujo, Gabriel, et autres
Publié: (2023)
Research on Autonomous Robots Navigation based on Reinforcement Learning
par: Wang, Zixiang, et autres
Publié: (2024)
par: Wang, Zixiang, et autres
Publié: (2024)
Deep Reinforcement Learning with Task-Adaptive Retrieval via Hypernetwork
par: Jin, Yonggang, et autres
Publié: (2023)
par: Jin, Yonggang, et autres
Publié: (2023)
Multiobjective Hydropower Reservoir Operation Optimization with Transformer-Based Deep Reinforcement Learning
par: Wu, Rixin, et autres
Publié: (2023)
par: Wu, Rixin, et autres
Publié: (2023)
GraphEdit: Large Language Models for Graph Structure Learning
par: Guo, Zirui, et autres
Publié: (2024)
par: Guo, Zirui, et autres
Publié: (2024)
Beyond Gaussian Initializations: Signal Preserving Weight Initialization for Odd-Sigmoid Activations
par: Lee, Hyunwoo, et autres
Publié: (2025)
par: Lee, Hyunwoo, et autres
Publié: (2025)
A Triple-Inertial Accelerated Alternating Optimization Method for Deep Learning Training
par: Yan, Chengcheng, et autres
Publié: (2025)
par: Yan, Chengcheng, et autres
Publié: (2025)
EasyST: A Simple Framework for Spatio-Temporal Prediction
par: Tang, Jiabin, et autres
Publié: (2024)
par: Tang, Jiabin, et autres
Publié: (2024)
Scaling Sim-to-Real Reinforcement Learning for Robot VLAs with Generative 3D Worlds
par: Choi, Andrew, et autres
Publié: (2026)
par: Choi, Andrew, et autres
Publié: (2026)
HeteroBA: A Structure-Manipulating Backdoor Attack on Heterogeneous Graphs
par: Gao, Honglin, et autres
Publié: (2025)
par: Gao, Honglin, et autres
Publié: (2025)
AceGRPO: Adaptive Curriculum Enhanced Group Relative Policy Optimization for Autonomous Machine Learning Engineering
par: Cai, Yuzhu, et autres
Publié: (2026)
par: Cai, Yuzhu, et autres
Publié: (2026)
Step-wise Adaptive Integration of Supervised Fine-tuning and Reinforcement Learning for Task-Specific LLMs
par: Chen, Jack, et autres
Publié: (2025)
par: Chen, Jack, et autres
Publié: (2025)
Pre-training for Recommendation Unlearning
par: Chen, Guoxuan, et autres
Publié: (2025)
par: Chen, Guoxuan, et autres
Publié: (2025)
LightGNN: Simple Graph Neural Network for Recommendation
par: Chen, Guoxuan, et autres
Publié: (2025)
par: Chen, Guoxuan, et autres
Publié: (2025)
BAPO: Stabilizing Off-Policy Reinforcement Learning for LLMs via Balanced Policy Optimization with Adaptive Clipping
par: Xi, Zhiheng, et autres
Publié: (2025)
par: Xi, Zhiheng, et autres
Publié: (2025)
Causal Information Prioritization for Efficient Reinforcement Learning
par: Cao, Hongye, et autres
Publié: (2025)
par: Cao, Hongye, et autres
Publié: (2025)
AFLoRA: Adaptive Freezing of Low Rank Adaptation in Parameter Efficient Fine-Tuning of Large Models
par: Liu, Zeyu, et autres
Publié: (2024)
par: Liu, Zeyu, et autres
Publié: (2024)
BET: Explaining Deep Reinforcement Learning through The Error-Prone Decisions
par: Liu, Xiao, et autres
Publié: (2024)
par: Liu, Xiao, et autres
Publié: (2024)
Early Warning of Intraoperative Adverse Events via Transformer-Driven Multi-Label Learning
par: Wang, Xueyao, et autres
Publié: (2026)
par: Wang, Xueyao, et autres
Publié: (2026)
Meta-Learning Adaptive Loss Functions
par: Raymond, Christian, et autres
Publié: (2023)
par: Raymond, Christian, et autres
Publié: (2023)
Documents similaires
-
Reducing Bias in Deep Learning Optimization: The RSGDM Approach
par: Qin, Honglin, et autres
Publié: (2024) -
Root Cause Attribution of Delivery Risks via Causal Discovery with Reinforcement Learning
par: Xiao, Minheng
Publié: (2024) -
Multiple Greedy Quasi-Newton Methods for Saddle Point Problems
par: Xiao, Minheng, et autres
Publié: (2024) -
Stock Type Prediction Model Based on Hierarchical Graph Neural Network
par: Yao, Jianhua, et autres
Publié: (2024) -
Policy Gradient Methods for Risk-Sensitive Distributional Reinforcement Learning with Provable Convergence
par: Xiao, Minheng, et autres
Publié: (2024)