Enregistré dans:
| Auteurs principaux: | Li, Hao, Zhou, Xiao-Hu, Li, Shu-Hai, Gui, Mei-Jiang, Xie, Xiao-Liang, Liu, Shi-Qi, Wang, Shuang-Yi, Feng, Zhen-Qiu, Hou, Zeng-Guang |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2310.17245 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
MICRO: Model-Based Offline Reinforcement Learning with a Conservative Bellman Operator
par: Liu, Xiao-Yin, et autres
Publié: (2023)
par: Liu, Xiao-Yin, et autres
Publié: (2023)
MOSformer: Momentum encoder-based inter-slice fusion transformer for medical image segmentation
par: Huang, De-Xing, et autres
Publié: (2024)
par: Huang, De-Xing, et autres
Publié: (2024)
SPIRONet: Spatial-Frequency Learning and Topological Channel Interaction Network for Vessel Segmentation
par: Huang, De-Xing, et autres
Publié: (2024)
par: Huang, De-Xing, et autres
Publié: (2024)
CAS-GAN for Contrast-free Angiography Synthesis
par: Huang, De-Xing, et autres
Publié: (2024)
par: Huang, De-Xing, et autres
Publié: (2024)
DOMAIN: MilDly COnservative Model-BAsed OfflINe Reinforcement Learning
par: Liu, Xiao-Yin, et autres
Publié: (2023)
par: Liu, Xiao-Yin, et autres
Publié: (2023)
LEASE: Offline Preference-based Reinforcement Learning with High Sample Efficiency
par: Liu, Xiao-Yin, et autres
Publié: (2024)
par: Liu, Xiao-Yin, et autres
Publié: (2024)
VLA Model Post-Training via Action-Chunked PPO and Self Behavior Cloning
par: Wang, Si-Cheng, et autres
Publié: (2025)
par: Wang, Si-Cheng, et autres
Publié: (2025)
VasoMIM: Vascular Anatomy-Aware Masked Image Modeling for Vessel Segmentation
par: Huang, De-Xing, et autres
Publié: (2025)
par: Huang, De-Xing, et autres
Publié: (2025)
Online Adaptation via Dual-Stage Alignment and Self-Supervision for Fast-Calibration Brain-Computer Interfaces
par: Duan, Sheng-Bin, et autres
Publié: (2025)
par: Duan, Sheng-Bin, et autres
Publié: (2025)
Activity and control of methanol metabolism in the seawaters across the estuary–coast–shelf continuum
par: Guang‐Chao Zhuang, et autres
Publié: (2025)
par: Guang‐Chao Zhuang, et autres
Publié: (2025)
Learning Novel Skills from Language-Generated Demonstrations
par: Jin, Ao-Qun, et autres
Publié: (2024)
par: Jin, Ao-Qun, et autres
Publié: (2024)
VLA Model-Expert Collaboration for Bi-directional Manipulation Learning
par: Xiang, Tian-Yu, et autres
Publié: (2025)
par: Xiang, Tian-Yu, et autres
Publié: (2025)
Task-Oriented Learning for Automatic EEG Denoising
par: Xiang, Tian-Yu, et autres
Publié: (2025)
par: Xiang, Tian-Yu, et autres
Publié: (2025)
REASON: Probability map-guided dual-branch fusion framework for gastric content assessment
par: Xiao, Nu-Fnag, et autres
Publié: (2025)
par: Xiao, Nu-Fnag, et autres
Publié: (2025)
COSBO: Conservative Offline Simulation-Based Policy Optimization
par: Kargar, Eshagh, et autres
Publié: (2024)
par: Kargar, Eshagh, et autres
Publié: (2024)
CROP: Expert-Aligned Image Cropping via Compositional Reasoning and Optimizing Preference
par: Dong, Zhitong, et autres
Publié: (2026)
par: Dong, Zhitong, et autres
Publié: (2026)
Parallels Between VLA Model Post-Training and Human Motor Learning: Progress, Challenges, and Trends
par: Xiang, Tian-Yu, et autres
Publié: (2025)
par: Xiang, Tian-Yu, et autres
Publié: (2025)
Behavior-Regularized Diffusion Policy Optimization for Offline Reinforcement Learning
par: Gao, Chen-Xiao, et autres
Publié: (2025)
par: Gao, Chen-Xiao, et autres
Publié: (2025)
TRIM26‐Mediated CBX6 Ubiquitination Triggers NETosis to Drive Bladder Cancer Tumor Growth via the CNPY2/NF‐κB Signaling Pathway
par: XiaoJuan Xie, et autres
Publié: (2026)
par: XiaoJuan Xie, et autres
Publié: (2026)
Conservative Offline Robot Policy Learning via Posterior-Transition Reweighting
par: Zhang, Wanpeng, et autres
Publié: (2026)
par: Zhang, Wanpeng, et autres
Publié: (2026)
Trajectory-Oriented Policy Optimization with Sparse Rewards
par: Wang, Guojian, et autres
Publié: (2024)
par: Wang, Guojian, et autres
Publié: (2024)
Deciphering viscosity‐driven mechanisms governing chaotic flow dynamics and mixing efficiency in micromixers
par: Shi‐Xiao Wei, et autres
Publié: (2026)
par: Shi‐Xiao Wei, et autres
Publié: (2026)
A Weight-aware-based Multi-source Unsupervised Domain Adaptation Method for Human Motion Intention Recognition
par: Liu, Xiao-Yin, et autres
Publié: (2024)
par: Liu, Xiao-Yin, et autres
Publié: (2024)
Enhancing Generative Auto-bidding with Offline Reward Evaluation and Policy Search
par: Mou, Zhiyu, et autres
Publié: (2025)
par: Mou, Zhiyu, et autres
Publié: (2025)
Arena as Offline Reward: Efficient Fine-Grained Preference Optimization for Diffusion Models
par: Li, Zhikai, et autres
Publié: (2026)
par: Li, Zhikai, et autres
Publié: (2026)
Preferred-Action-Optimized Diffusion Policies for Offline Reinforcement Learning
par: Zhang, Tianle, et autres
Publié: (2024)
par: Zhang, Tianle, et autres
Publié: (2024)
Landscape Analysis of Simultaneous Blind Deconvolution and Phase Retrieval via Structured Low-Rank Tensor Recovery
par: Liang, Xiao, et autres
Publié: (2025)
par: Liang, Xiao, et autres
Publié: (2025)
A Muon-Accelerated Algorithm for Low Separation Rank Tensor Generalized Linear Models
par: Liang, Xiao, et autres
Publié: (2026)
par: Liang, Xiao, et autres
Publié: (2026)
CAS-IQA: Teaching Vision-Language Models for Synthetic Angiography Quality Assessment
par: Wang, Bo, et autres
Publié: (2025)
par: Wang, Bo, et autres
Publié: (2025)
Robust Offline Reinforcement learning with Heavy-Tailed Rewards
par: Zhu, Jin, et autres
Publié: (2023)
par: Zhu, Jin, et autres
Publié: (2023)
Session-Level Dynamic Ad Load Optimization using Offline Robust Reinforcement Learning
par: Liu, Tao, et autres
Publié: (2025)
par: Liu, Tao, et autres
Publié: (2025)
Optimistic Model Rollouts for Pessimistic Offline Policy Optimization
par: Zhai, Yuanzhao, et autres
Publié: (2024)
par: Zhai, Yuanzhao, et autres
Publié: (2024)
ROLeR: Effective Reward Shaping in Offline Reinforcement Learning for Recommender Systems
par: Zhang, Yi, et autres
Publié: (2024)
par: Zhang, Yi, et autres
Publié: (2024)
Offline Policy Optimization with Posterior Sampling
par: Lin, Hongqiang, et autres
Publié: (2026)
par: Lin, Hongqiang, et autres
Publié: (2026)
Methane concentration and oxidation rate in the Yangtze River Estuary (July 2021) and East China Sea (April 2021)
par: Mao, Shi-Hai, et autres
Publié: (2022)
par: Mao, Shi-Hai, et autres
Publié: (2022)
Methane production in the Yangtze River Estuary and East China Sea in 2019/2020
par: Mao, Shi-Hai, et autres
Publié: (2022)
par: Mao, Shi-Hai, et autres
Publié: (2022)
Investigation on global and local RTD , mixing, and heat transfer of a high‐throughput passive chaotic microreactor
par: Shi‐Xiao Wei, et autres
Publié: (2025)
par: Shi‐Xiao Wei, et autres
Publié: (2025)
Dual RNA-Seq Unveils Candidate Key Virulence Genes of at the Early Stage of Infection in Hybrid Grouper (♀ × ♂ ).
par: Zeng, Yan-Hua, et autres
Publié: (2024)
par: Zeng, Yan-Hua, et autres
Publié: (2024)
Cooper: Co-Optimizing Policy and Reward Models in Reinforcement Learning for Large Language Models
par: Hong, Haitao, et autres
Publié: (2025)
par: Hong, Haitao, et autres
Publié: (2025)
Sedum qingyuanense (Crassulaceae), a new species from Qingyuan, Guangdong, China
par: Yi, Xiao-Wei, et autres
Publié: (2025)
par: Yi, Xiao-Wei, et autres
Publié: (2025)
Documents similaires
-
MICRO: Model-Based Offline Reinforcement Learning with a Conservative Bellman Operator
par: Liu, Xiao-Yin, et autres
Publié: (2023) -
MOSformer: Momentum encoder-based inter-slice fusion transformer for medical image segmentation
par: Huang, De-Xing, et autres
Publié: (2024) -
SPIRONet: Spatial-Frequency Learning and Topological Channel Interaction Network for Vessel Segmentation
par: Huang, De-Xing, et autres
Publié: (2024) -
CAS-GAN for Contrast-free Angiography Synthesis
par: Huang, De-Xing, et autres
Publié: (2024) -
DOMAIN: MilDly COnservative Model-BAsed OfflINe Reinforcement Learning
par: Liu, Xiao-Yin, et autres
Publié: (2023)