$\mathrm{E^{2}CFD}$: Towards Effective and Efficient Cost Function Design for Safe Reinforcement Learning via Large Language Model
Fuente:
arXiv
Guardado en:
| Autores principales: | Wang, Zepeng, Ma, Chao, Zhou, Linjiang, Wu, Libing, Yang, Lei, Shi, Xiaochuan, Peng, Guojun |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
AdaptGrad: Adaptive Sampling to Reduce Noise
por: Zhou, Linjiang, et al.
Publicado: (2024)
por: Zhou, Linjiang, et al.
Publicado: (2024)
Axiomatization of Gradient Smoothing in Neural Networks
por: Zhou, Linjiang, et al.
Publicado: (2024)
por: Zhou, Linjiang, et al.
Publicado: (2024)
MDSAM:Memory-Driven Sparse Attention Matrix for LVLMs Hallucination Mitigation
por: Lu, Shuaiye, et al.
Publicado: (2025)
por: Lu, Shuaiye, et al.
Publicado: (2025)
KGLens: Towards Efficient and Effective Knowledge Probing of Large Language Models with Knowledge Graphs
por: Zheng, Shangshang, et al.
Publicado: (2023)
por: Zheng, Shangshang, et al.
Publicado: (2023)
SEG-Parking: Towards Safe, Efficient, and Generalizable Autonomous Parking via End-to-End Offline Reinforcement Learning
por: Yang, Zewei, et al.
Publicado: (2025)
por: Yang, Zewei, et al.
Publicado: (2025)
On Simplifying Large-Scale Spatial Vectors: Fast, Memory-Efficient, and Cost-Predictable k-means
por: Ji, Yushuai, et al.
Publicado: (2024)
por: Ji, Yushuai, et al.
Publicado: (2024)
Counterfactually Safe Reinforcement Learning
por: Li, Jingyi, et al.
Publicado: (2026)
por: Li, Jingyi, et al.
Publicado: (2026)
Evaluating the Effectiveness of Cost-Efficient Large Language Models in Benchmark Biomedical Tasks
por: Jahan, Israt, et al.
Publicado: (2025)
por: Jahan, Israt, et al.
Publicado: (2025)
AIBrix: Towards Scalable, Cost-Effective Large Language Model Inference Infrastructure
por: The AIBrix Team, et al.
Publicado: (2025)
por: The AIBrix Team, et al.
Publicado: (2025)
ICU: Conquering Language Barriers in Vision-and-Language Modeling by Dividing the Tasks into Image Captioning and Language Understanding
por: Wu, Guojun
Publicado: (2023)
por: Wu, Guojun
Publicado: (2023)
A Large Language Model-Enhanced Q-learning for Capacitated Vehicle Routing Problem with Time Windows
por: Cao, Linjiang, et al.
Publicado: (2025)
por: Cao, Linjiang, et al.
Publicado: (2025)
SafeLawBench: Towards Safe Alignment of Large Language Models
por: Cao, Chuxue, et al.
Publicado: (2025)
por: Cao, Chuxue, et al.
Publicado: (2025)
General Humanoid Whole-Body Control via Pretraining and Fast Adaptation
por: Wang, Zepeng, et al.
Publicado: (2026)
por: Wang, Zepeng, et al.
Publicado: (2026)
Towards Efficient and Effective Alignment of Large Language Models
por: Jiang, Yuxin
Publicado: (2025)
por: Jiang, Yuxin
Publicado: (2025)
Multi-round jailbreak attack on large language models
por: Zhou, Yihua, et al.
Publicado: (2024)
por: Zhou, Yihua, et al.
Publicado: (2024)
Defining Cost Function of Steganography with Large Language Models
por: Wu, Hanzhou, et al.
Publicado: (2025)
por: Wu, Hanzhou, et al.
Publicado: (2025)
Improving Visual Storytelling with Multimodal Large Language Models
por: Lin, Xiaochuan, et al.
Publicado: (2024)
por: Lin, Xiaochuan, et al.
Publicado: (2024)
Designing Control Barrier Function via Probabilistic Enumeration for Safe Reinforcement Learning Navigation
por: Marzari, Luca, et al.
Publicado: (2025)
por: Marzari, Luca, et al.
Publicado: (2025)
P-ICL: Point In-Context Learning for Named Entity Recognition with Large Language Models
por: Jiang, Guochao, et al.
Publicado: (2024)
por: Jiang, Guochao, et al.
Publicado: (2024)
Towards Safe Reinforcement Learning via Constraining Conditional Value-at-Risk
por: Ying, Chengyang, et al.
Publicado: (2022)
por: Ying, Chengyang, et al.
Publicado: (2022)
FR-TTS: Test-Time Scaling for NTP-based Image Generation with Effective Filling-based Reward Signal
por: Xu, Hang, et al.
Publicado: (2025)
por: Xu, Hang, et al.
Publicado: (2025)
Towards Effective Long Video Understanding of Multimodal Large Language Models via One-shot Clip Retrieval
por: Chen, Tao, et al.
Publicado: (2025)
por: Chen, Tao, et al.
Publicado: (2025)
Single-Sample Black-Box Membership Inference Attack against Vision-Language Models via Cross-modal Semantic Alignment
por: Li, Jiaqing, et al.
Publicado: (2026)
por: Li, Jiaqing, et al.
Publicado: (2026)
Dual-Quadruped Collaborative Transportation in Narrow Environments via Safe Reinforcement Learning
por: Lei, Zhezhi, et al.
Publicado: (2026)
por: Lei, Zhezhi, et al.
Publicado: (2026)
Towards Effective and Efficient Continual Pre-training of Large Language Models
por: Chen, Jie, et al.
Publicado: (2024)
por: Chen, Jie, et al.
Publicado: (2024)
Towards Efficient and Effective Unlearning of Large Language Models for Recommendation
por: Wang, Hangyu, et al.
Publicado: (2024)
por: Wang, Hangyu, et al.
Publicado: (2024)
Beyond the Next Token: Towards Prompt-Robust Zero-Shot Classification via Efficient Multi-Token Prediction
por: Qian, Junlang, et al.
Publicado: (2025)
por: Qian, Junlang, et al.
Publicado: (2025)
Trustworthy Alignment of Retrieval-Augmented Large Language Models via Reinforcement Learning
por: Zhang, Zongmeng, et al.
Publicado: (2024)
por: Zhang, Zongmeng, et al.
Publicado: (2024)
SOLVE: Synergy of Language-Vision and End-to-End Networks for Autonomous Driving
por: Chen, Xuesong, et al.
Publicado: (2025)
por: Chen, Xuesong, et al.
Publicado: (2025)
Towards Coarse-to-Fine Evaluation of Inference Efficiency for Large Language Models
por: Chen, Yushuo, et al.
Publicado: (2024)
por: Chen, Yushuo, et al.
Publicado: (2024)
A Status Quo Investigation of Large Language Models towards Cost-Effective CFD Automation with OpenFOAMGPT: ChatGPT vs. Qwen vs. Deepseek
por: Wang, Wenkang, et al.
Publicado: (2025)
por: Wang, Wenkang, et al.
Publicado: (2025)
Enhancing User Intent for Recommendation Systems via Large Language Models
por: Xu, Xiaochuan, et al.
Publicado: (2025)
por: Xu, Xiaochuan, et al.
Publicado: (2025)
EARL: Efficient Agentic Reinforcement Learning Systems for Large Language Models
por: Tan, Zheyue, et al.
Publicado: (2025)
por: Tan, Zheyue, et al.
Publicado: (2025)
Provably Efficient Reinforcement Learning for Adversarial Restless Multi-Armed Bandits with Unknown Transitions and Bandit Feedback
por: Xiong, Guojun, et al.
Publicado: (2024)
por: Xiong, Guojun, et al.
Publicado: (2024)
A Simple Cost‐Effective Method to Fabricate Single Nanochannels by Embedding Electrospun Polyethylene Oxide Nanofibers
por: Lei Zhou, et al.
Publicado: (2024)
por: Lei Zhou, et al.
Publicado: (2024)
Cost-Effectiveness Analysis and Design of Cost-Efficient Cell-Free Massive MIMO Systems
por: Jiang, Wei, et al.
Publicado: (2024)
por: Jiang, Wei, et al.
Publicado: (2024)
ThriftLLM: On Cost-Effective Selection of Large Language Models for Classification Queries
por: Huang, Keke, et al.
Publicado: (2025)
por: Huang, Keke, et al.
Publicado: (2025)
GenSafe: A Generalizable Safety Enhancer for Safe Reinforcement Learning Algorithms Based on Reduced Order Markov Decision Process Model
por: Zhou, Zhehua, et al.
Publicado: (2024)
por: Zhou, Zhehua, et al.
Publicado: (2024)
Highly Efficient Test-Time Scaling for T2I Diffusion Models with Text Embedding Perturbation
por: Xu, Hang, et al.
Publicado: (2025)
por: Xu, Hang, et al.
Publicado: (2025)
An Automated Reinforcement Learning Reward Design Framework with Large Language Model for Cooperative Platoon Coordination
por: Wei, Dixiao, et al.
Publicado: (2025)
por: Wei, Dixiao, et al.
Publicado: (2025)
Ejemplares similares
-
AdaptGrad: Adaptive Sampling to Reduce Noise
por: Zhou, Linjiang, et al.
Publicado: (2024) -
Axiomatization of Gradient Smoothing in Neural Networks
por: Zhou, Linjiang, et al.
Publicado: (2024) -
MDSAM:Memory-Driven Sparse Attention Matrix for LVLMs Hallucination Mitigation
por: Lu, Shuaiye, et al.
Publicado: (2025) -
KGLens: Towards Efficient and Effective Knowledge Probing of Large Language Models with Knowledge Graphs
por: Zheng, Shangshang, et al.
Publicado: (2023) -
SEG-Parking: Towards Safe, Efficient, and Generalizable Autonomous Parking via End-to-End Offline Reinforcement Learning
por: Yang, Zewei, et al.
Publicado: (2025)