BLM-Guard: Explainable Multimodal Ad Moderation with Chain-of-Thought and Policy-Aligned Rewards
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yang, Yiran, Liu, Zhaowei, Yuan, Yuan, Song, Yukun, Ma, Xiong, Song, Yinghao, Zeng, Xiangji, Sun, Lu, Wang, Yulu, Zhou, Hai, Cui, Shuai, Gong, Zhaohan, Zhang, Jiefei |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
PRPO: Aligning Process Reward with Outcome Reward in Policy Optimization
par: Ding, Ruiyi, et autres
Publié: (2026)
par: Ding, Ruiyi, et autres
Publié: (2026)
ExplainableGuard: Interpretable Adversarial Defense for Large Language Models Using Chain-of-Thought Reasoning
par: Guan, Shaowei, et autres
Publié: (2025)
par: Guan, Shaowei, et autres
Publié: (2025)
Upfront Chain-of-Thought: A Cooperative Framework for Chain-of-Thought Compression
par: Li, Chengzhengxu, et autres
Publié: (2025)
par: Li, Chengzhengxu, et autres
Publié: (2025)
Thinking with Sound: Audio Chain-of-Thought Enables Multimodal Reasoning in Large Audio-Language Models
par: Xiong, Zhen, et autres
Publié: (2025)
par: Xiong, Zhen, et autres
Publié: (2025)
Tool-MCoT: Tool Augmented Multimodal Chain-of-Thought for Content Safety Moderation
par: Zhang, Shutong, et autres
Publié: (2026)
par: Zhang, Shutong, et autres
Publié: (2026)
Explainable Action Form Assessment by Exploiting Multimodal Chain-of-Thoughts Reasoning
par: Qi, Mengshi, et autres
Publié: (2025)
par: Qi, Mengshi, et autres
Publié: (2025)
Multimodal Chain-of-Thought Reasoning in Language Models
par: Zhang, Zhuosheng, et autres
Publié: (2023)
par: Zhang, Zhuosheng, et autres
Publié: (2023)
ETR: Entropy Trend Reward for Efficient Chain-of-Thought Reasoning
par: Xiong, Xuan, et autres
Publié: (2026)
par: Xiong, Xuan, et autres
Publié: (2026)
Grounded Chain-of-Thought for Multimodal Large Language Models
par: Wu, Qiong, et autres
Publié: (2025)
par: Wu, Qiong, et autres
Publié: (2025)
Unified Multimodal Chain-of-Thought Reward Model through Reinforcement Fine-Tuning
par: Wang, Yibin, et autres
Publié: (2025)
par: Wang, Yibin, et autres
Publié: (2025)
Rethinking Token-Level Policy Optimization for Multimodal Chain-of-Thought
par: Li, Yunheng, et autres
Publié: (2026)
par: Li, Yunheng, et autres
Publié: (2026)
Towards Trustworthy Multimodal Moderation via Policy-Aligned Reasoning and Hierarchical Labeling
par: Li, Anqi, et autres
Publié: (2025)
par: Li, Anqi, et autres
Publié: (2025)
To Reason or Not to: Selective Chain-of-Thought in Medical Question Answering
par: Zhan, Zaifu, et autres
Publié: (2026)
par: Zhan, Zaifu, et autres
Publié: (2026)
Is Chain-of-Thought Really Not Explainability? Chain-of-Thought Can Be Faithful without Hint Verbalization
par: Zaman, Kerem, et autres
Publié: (2025)
par: Zaman, Kerem, et autres
Publié: (2025)
From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought
par: Tan, Wentao, et autres
Publié: (2025)
par: Tan, Wentao, et autres
Publié: (2025)
Corvid: Improving Multimodal Large Language Models Towards Chain-of-Thought Reasoning
par: Jiang, Jingjing, et autres
Publié: (2025)
par: Jiang, Jingjing, et autres
Publié: (2025)
X-Guard: Multilingual Guard Agent for Content Moderation
par: Upadhayay, Bibek, et autres
Publié: (2025)
par: Upadhayay, Bibek, et autres
Publié: (2025)
Explainable Chain-of-Thought Reasoning: An Empirical Analysis on State-Aware Reasoning Dynamics
par: Yu, Sheldon, et autres
Publié: (2025)
par: Yu, Sheldon, et autres
Publié: (2025)
RefReward-SR: LR-Conditioned Reward Modeling for Preference-Aligned Super-Resolution
par: Song, Yushuai, et autres
Publié: (2026)
par: Song, Yushuai, et autres
Publié: (2026)
Demystifying Multilingual Chain-of-Thought in Process Reward Modeling
par: Wang, Weixuan, et autres
Publié: (2025)
par: Wang, Weixuan, et autres
Publié: (2025)
SA-IQA: Redefining Image Quality Assessment for Spatial Aesthetics with Multi-Dimensional Rewards
par: Gao, Yuan, et autres
Publié: (2025)
par: Gao, Yuan, et autres
Publié: (2025)
CMI-RewardBench: Evaluating Music Reward Models with Compositional Multimodal Instruction
par: Ma, Yinghao, et autres
Publié: (2026)
par: Ma, Yinghao, et autres
Publié: (2026)
Joint Reward Modeling: Internalizing Chain-of-Thought for Efficient Visual Reward Models
par: Yang, Yankai, et autres
Publié: (2026)
par: Yang, Yankai, et autres
Publié: (2026)
ConsisGuard: Aligning Safety Deliberation with Policy Enforcement in LLM Guardrails
par: Wang, Yan, et autres
Publié: (2026)
par: Wang, Yan, et autres
Publié: (2026)
Beyond Chain-of-Thought, Effective Graph-of-Thought Reasoning in Language Models
par: Yao, Yao, et autres
Publié: (2023)
par: Yao, Yao, et autres
Publié: (2023)
Rethinking Chain-of-Thought Reasoning for Videos
par: Zhong, Yiwu, et autres
Publié: (2025)
par: Zhong, Yiwu, et autres
Publié: (2025)
EMPA: Evaluating Persona-Aligned Empathy as a Process
par: Zhang, Shiya, et autres
Publié: (2026)
par: Zhang, Shiya, et autres
Publié: (2026)
GeoChain: Multimodal Chain-of-Thought for Geographic Reasoning
par: Yerramilli, Sahiti, et autres
Publié: (2025)
par: Yerramilli, Sahiti, et autres
Publié: (2025)
Reward Collapse in Aligning Large Language Models
par: Song, Ziang, et autres
Publié: (2023)
par: Song, Ziang, et autres
Publié: (2023)
Imminent Geologic and Hydrologic Hazards on Fort Ord BLM Land
par: Smith, Douglas
Publié: (2008)
par: Smith, Douglas
Publié: (2008)
PAM: Training Policy-Aligned Moderation Filters at Scale
par: Fatehkia, Masoomali, et autres
Publié: (2025)
par: Fatehkia, Masoomali, et autres
Publié: (2025)
BingoGuard: LLM Content Moderation Tools with Risk Levels
par: Yin, Fan, et autres
Publié: (2025)
par: Yin, Fan, et autres
Publié: (2025)
Teaching Models to Verbalize Reward Hacking in Chain-of-Thought Reasoning
par: Turpin, Miles, et autres
Publié: (2025)
par: Turpin, Miles, et autres
Publié: (2025)
Missing Value Chain in Generative AI Governance China as an example
par: Pi, Yulu
Publié: (2024)
par: Pi, Yulu
Publié: (2024)
BLM$_1$: A Boundless Large Model for Cross-Space, Cross-Task, and Cross-Embodiment Learning
par: Tan, Wentao, et autres
Publié: (2025)
par: Tan, Wentao, et autres
Publié: (2025)
GuardAlign: Test-time Safety Alignment in Multimodal Large Language Models
par: Zhu, Xingyu, et autres
Publié: (2026)
par: Zhu, Xingyu, et autres
Publié: (2026)
DIO: Refining Mutual Information and Causal Chain to Enhance Machine Abstract Reasoning Ability
par: Song, Ruizhuo, et autres
Publié: (2025)
par: Song, Ruizhuo, et autres
Publié: (2025)
Skywork R1V: Pioneering Multimodal Reasoning with Chain-of-Thought
par: Peng, Yi, et autres
Publié: (2025)
par: Peng, Yi, et autres
Publié: (2025)
CoCoT: Contrastive Chain-of-Thought Prompting for Large Multimodal Models with Multiple Image Inputs
par: Zhang, Daoan, et autres
Publié: (2024)
par: Zhang, Daoan, et autres
Publié: (2024)
Fast ECoT: Efficient Embodied Chain-of-Thought via Thoughts Reuse
par: Duan, Zhekai, et autres
Publié: (2025)
par: Duan, Zhekai, et autres
Publié: (2025)
Documents similaires
-
PRPO: Aligning Process Reward with Outcome Reward in Policy Optimization
par: Ding, Ruiyi, et autres
Publié: (2026) -
ExplainableGuard: Interpretable Adversarial Defense for Large Language Models Using Chain-of-Thought Reasoning
par: Guan, Shaowei, et autres
Publié: (2025) -
Upfront Chain-of-Thought: A Cooperative Framework for Chain-of-Thought Compression
par: Li, Chengzhengxu, et autres
Publié: (2025) -
Thinking with Sound: Audio Chain-of-Thought Enables Multimodal Reasoning in Large Audio-Language Models
par: Xiong, Zhen, et autres
Publié: (2025) -
Tool-MCoT: Tool Augmented Multimodal Chain-of-Thought for Content Safety Moderation
par: Zhang, Shutong, et autres
Publié: (2026)