Robust Reward Modeling for Large Language Models via Causal Decomposition
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Lu, Yunsheng, Yang, Zijiang, Pan, Licheng, Chu, Zhixuan |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Factual Dialogue Summarization via Learning from Large Language Models
par: Zhu, Rongxin, et autres
Publié: (2024)
par: Zhu, Rongxin, et autres
Publié: (2024)
Do Large Language Models Speak All Languages Equally? A Comparative Study in Low-Resource Settings
par: Hasan, Md. Arid, et autres
Publié: (2024)
par: Hasan, Md. Arid, et autres
Publié: (2024)
PaperVoyager : Building Interactive Web with Visual Language Models
par: Dai, Dasen, et autres
Publié: (2026)
par: Dai, Dasen, et autres
Publié: (2026)
Evaluating the efficacy of LLM Safety Solutions : The Palit Benchmark Dataset
par: Palit, Sayon, et autres
Publié: (2025)
par: Palit, Sayon, et autres
Publié: (2025)
Large Language Models for Propaganda Span Annotation
par: Hasanain, Maram, et autres
Publié: (2023)
par: Hasanain, Maram, et autres
Publié: (2023)
Corpus Considerations for Annotator Modeling and Scaling
par: Sarumi, Olufunke O., et autres
Publié: (2024)
par: Sarumi, Olufunke O., et autres
Publié: (2024)
Vision-Language Reasoning for Geolocalization: A Reinforcement Learning Approach
par: Wu, Biao, et autres
Publié: (2026)
par: Wu, Biao, et autres
Publié: (2026)
Infinity Parser: Layout Aware Reinforcement Learning for Scanned Document Parsing
par: Wang, Baode, et autres
Publié: (2025)
par: Wang, Baode, et autres
Publié: (2025)
Development and Preliminary Evaluation of a Domain-Specific Large Language Model for Tuberculosis Care in South Africa
par: Khosa, Thokozile, et autres
Publié: (2026)
par: Khosa, Thokozile, et autres
Publié: (2026)
The Hidden Attention of Mamba Models
par: Ali, Ameen, et autres
Publié: (2024)
par: Ali, Ameen, et autres
Publié: (2024)
Mobile Phone Sensor-based Nigerian Driving Dataset to Detect Alcohol-influenced Behaviours
par: Thompson, Iniakpokeikiye Peter, et autres
Publié: (2025)
par: Thompson, Iniakpokeikiye Peter, et autres
Publié: (2025)
From Pixels to Privacy: Temporally Consistent Video Anonymization via Token Pruning for Privacy Preserving Action Recognition
par: Aslam, Nazia, et autres
Publié: (2026)
par: Aslam, Nazia, et autres
Publié: (2026)
PromptSAM+: Malware Detection based on Prompt Segment Anything Model
par: Wei, Xingyuan, et autres
Publié: (2024)
par: Wei, Xingyuan, et autres
Publié: (2024)
Story2Proposal: A Scaffold for Structured Scientific Paper Writing
par: Qian, Zhuoyang, et autres
Publié: (2026)
par: Qian, Zhuoyang, et autres
Publié: (2026)
UIPress: Bringing Optical Token Compression to UI-to-Code Generation
par: Dai, Dasen, et autres
Publié: (2026)
par: Dai, Dasen, et autres
Publié: (2026)
From Classification to Ranking: Enhancing LLM Reasoning Capabilities for MBTI Personality Detection
par: Cao, Yuan, et autres
Publié: (2026)
par: Cao, Yuan, et autres
Publié: (2026)
I-WebGenBench : Evaluating Interactivity in LLM-Generated Scientific Web Applications
par: Dai, Dasen, et autres
Publié: (2026)
par: Dai, Dasen, et autres
Publié: (2026)
The acquisition of English irregular inflections by Yemeni L1 Arabic learners: A Universal Grammar approach
par: Alsawsh, Muneef Y., et autres
Publié: (2026)
par: Alsawsh, Muneef Y., et autres
Publié: (2026)
Generative linguistics contribution to artificial intelligence: Where this contribution lies?
par: Shormani, Mohammed Q.
Publié: (2024)
par: Shormani, Mohammed Q.
Publié: (2024)
A generalised editor calculus (Short Paper)
par: Bennetzen, Benjamin, et autres
Publié: (2025)
par: Bennetzen, Benjamin, et autres
Publié: (2025)
The Syntax of qulk-clauses in Yemeni Ibbi Arabic: A Minimalist Approach
par: Albadani, Zubaida Mohammed, et autres
Publié: (2025)
par: Albadani, Zubaida Mohammed, et autres
Publié: (2025)
An End-to-End System for Culturally-Attuned Driving Feedback using a Dual-Component NLG Engine
par: Thompson, Iniakpokeikiye Peter, et autres
Publié: (2025)
par: Thompson, Iniakpokeikiye Peter, et autres
Publié: (2025)
Circularity and Symmetries of $p$ and $p^{2}$-polygons
par: Haag, Rolf
Publié: (2025)
par: Haag, Rolf
Publié: (2025)
Leveraging Test Driven Development with Large Language Models for Reliable and Verifiable Spreadsheet Code Generation: A Research Framework
par: Thorne, Simon, et autres
Publié: (2025)
par: Thorne, Simon, et autres
Publié: (2025)
LAraBench: Benchmarking Arabic AI with Large Language Models
par: Abdelali, Ahmed, et autres
Publié: (2023)
par: Abdelali, Ahmed, et autres
Publié: (2023)
Software Implementation of Digital Filtering via Tustin's Bilinear Transform
par: Herron, Connor W.
Publié: (2024)
par: Herron, Connor W.
Publié: (2024)
R-Genie: Reasoning-Guided Generative Image Editing
par: Zhang, Dong, et autres
Publié: (2025)
par: Zhang, Dong, et autres
Publié: (2025)
Random Heterogeneous Neurochaos Learning Architecture for Data Classification
par: S, Remya Ajai A, et autres
Publié: (2024)
par: S, Remya Ajai A, et autres
Publié: (2024)
Current LLMs still cannot 'talk much' about grammar modules: Evidence from syntax
par: Shormani, Mohammed Q., et autres
Publié: (2026)
par: Shormani, Mohammed Q., et autres
Publié: (2026)
Revisiting the syntax of imperatives in Yemeni Arabic: An Agree across phases approach
par: Shormani, Mohammed Q.
Publié: (2026)
par: Shormani, Mohammed Q.
Publié: (2026)
Automotive-ENV: Benchmarking Multimodal Agents in Vehicle Interface Systems
par: Yan, Junfeng, et autres
Publié: (2025)
par: Yan, Junfeng, et autres
Publié: (2025)
Multilingual and Multimodal LLMs in the Wild: Building for Low-Resource Languages
par: Alam, Firoj, et autres
Publié: (2026)
par: Alam, Firoj, et autres
Publié: (2026)
A Multiple-Fill-in-the-Blank Exam Approach for Enhancing Zero-Resource Hallucination Detection in Large Language Models
par: Munakata, Satoshi, et autres
Publié: (2024)
par: Munakata, Satoshi, et autres
Publié: (2024)
DOSE: Data Selection for Multi-Modal LLMs via Off-the-Shelf Models
par: Wu, Biao, et autres
Publié: (2026)
par: Wu, Biao, et autres
Publié: (2026)
Large Language Model Interface for Home Energy Management Systems
par: Michelon, François, et autres
Publié: (2025)
par: Michelon, François, et autres
Publié: (2025)
Policy-Grounded Safety Evaluation of 20 Large Language Models
par: Contreras, Juan Manuel
Publié: (2025)
par: Contreras, Juan Manuel
Publié: (2025)
LayerRoute: Input-Conditioned Adaptive Layer Skipping via LoRA Fine-Tuning for Agentic Language Models
par: Sikdar, Prateek Kumar
Publié: (2026)
par: Sikdar, Prateek Kumar
Publié: (2026)
RepoAgent: An LLM-Powered Open-Source Framework for Repository-level Code Documentation Generation
par: Luo, Qinyu, et autres
Publié: (2024)
par: Luo, Qinyu, et autres
Publié: (2024)
A multilingual dataset for offensive language and hate speech detection for hausa, yoruba and igbo languages
par: Aliyu, Saminu Mohammad, et autres
Publié: (2024)
par: Aliyu, Saminu Mohammad, et autres
Publié: (2024)
Only Whats Necessary: Pareto Optimal Data Minimization for Privacy Preserving Video Anomaly Detection
par: Aslam, Nazia, et autres
Publié: (2026)
par: Aslam, Nazia, et autres
Publié: (2026)
Documents similaires
-
Factual Dialogue Summarization via Learning from Large Language Models
par: Zhu, Rongxin, et autres
Publié: (2024) -
Do Large Language Models Speak All Languages Equally? A Comparative Study in Low-Resource Settings
par: Hasan, Md. Arid, et autres
Publié: (2024) -
PaperVoyager : Building Interactive Web with Visual Language Models
par: Dai, Dasen, et autres
Publié: (2026) -
Evaluating the efficacy of LLM Safety Solutions : The Palit Benchmark Dataset
par: Palit, Sayon, et autres
Publié: (2025) -
Large Language Models for Propaganda Span Annotation
par: Hasanain, Maram, et autres
Publié: (2023)