Towards Trustworthy Multimodal Moderation via Policy-Aligned Reasoning and Hierarchical Labeling
Fuente:
arXiv
Guardado en:
| Autores principales: | Li, Anqi, Jin, Wenwei, Tong, Jintao, Qin, Pengda, Li, Weijia, Lu, Guo |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
FlowCut: Rethinking Redundancy via Information Flow for Efficient Vision-Language Models
por: Tong, Jintao, et al.
Publicado: (2025)
por: Tong, Jintao, et al.
Publicado: (2025)
The Re-Label Method For Data-Centric Machine Learning
por: Guo, Tong
Publicado: (2023)
por: Guo, Tong
Publicado: (2023)
Dual-Uncertainty Guided Policy Learning for Multimodal Reasoning
por: Liu, Rui, et al.
Publicado: (2025)
por: Liu, Rui, et al.
Publicado: (2025)
SceneAlign: Aligning Multimodal Reasoning to Scene Graphs in Complex Visual Scenes
por: Wang, Chuhan, et al.
Publicado: (2026)
por: Wang, Chuhan, et al.
Publicado: (2026)
Scaling Reasoning Efficiently via Relaxed On-Policy Distillation
por: Ko, Jongwoo, et al.
Publicado: (2026)
por: Ko, Jongwoo, et al.
Publicado: (2026)
Beyond Labels: Aligning Large Language Models with Human-like Reasoning
por: Kabir, Muhammad Rafsan, et al.
Publicado: (2024)
por: Kabir, Muhammad Rafsan, et al.
Publicado: (2024)
TT-XAI: Trustworthy Clinical Text Explanations via Keyword Distillation and LLM Reasoning
por: Miok, Kristian, et al.
Publicado: (2025)
por: Miok, Kristian, et al.
Publicado: (2025)
Toward Automated Regulatory Decision-Making: Trustworthy Medical Device Risk Classification with Multimodal Transformers and Self-Training
por: Han, Yu, et al.
Publicado: (2025)
por: Han, Yu, et al.
Publicado: (2025)
LABO: Towards Learning Optimal Label Regularization via Bi-level Optimization
por: Lu, Peng, et al.
Publicado: (2023)
por: Lu, Peng, et al.
Publicado: (2023)
Towards Reasoning-Preserving Unlearning in Multimodal Large Language Models
por: Li, Hongji, et al.
Publicado: (2025)
por: Li, Hongji, et al.
Publicado: (2025)
HTPO: Towards Exploration-Exploitation Balanced Policy Optimization via Hierarchical Token-level Objective Control
por: Yao, Xincheng, et al.
Publicado: (2026)
por: Yao, Xincheng, et al.
Publicado: (2026)
Dental-TriageBench: Benchmarking Multimodal Reasoning for Hierarchical Dental Triage
por: He, Ziyi, et al.
Publicado: (2026)
por: He, Ziyi, et al.
Publicado: (2026)
IAPO: Information-Aware Policy Optimization for Token-Efficient Reasoning
por: He, Yinhan, et al.
Publicado: (2026)
por: He, Yinhan, et al.
Publicado: (2026)
TrustAgent: Towards Safe and Trustworthy LLM-based Agents
por: Hua, Wenyue, et al.
Publicado: (2024)
por: Hua, Wenyue, et al.
Publicado: (2024)
From Consistency to Complementarity: Aligned and Disentangled Multi-modal Learning for Time Series Understanding and Reasoning
por: Ni, Hang, et al.
Publicado: (2026)
por: Ni, Hang, et al.
Publicado: (2026)
FGTR: Fine-Grained Multi-Table Retrieval via Hierarchical LLM Reasoning
por: Sun, Chaojie, et al.
Publicado: (2026)
por: Sun, Chaojie, et al.
Publicado: (2026)
Towards Chapter-to-Chapter Context-Aware Literary Translation via Large Language Models
por: Jin, Linghao, et al.
Publicado: (2024)
por: Jin, Linghao, et al.
Publicado: (2024)
Towards AI-$45^{\circ}$ Law: A Roadmap to Trustworthy AGI
por: Yang, Chao, et al.
Publicado: (2024)
por: Yang, Chao, et al.
Publicado: (2024)
ParaPO: Aligning Language Models to Reduce Verbatim Reproduction of Pre-training Data
por: Chen, Tong, et al.
Publicado: (2025)
por: Chen, Tong, et al.
Publicado: (2025)
Seek in the Dark: Reasoning via Test-Time Instance-Level Policy Gradient in Latent Space
por: Li, Hengli, et al.
Publicado: (2025)
por: Li, Hengli, et al.
Publicado: (2025)
ALaRM: Align Language Models via Hierarchical Rewards Modeling
por: Lai, Yuhang, et al.
Publicado: (2024)
por: Lai, Yuhang, et al.
Publicado: (2024)
RIG: Synergizing Reasoning and Imagination in End-to-End Generalist Policy
por: Zhao, Zhonghan, et al.
Publicado: (2025)
por: Zhao, Zhonghan, et al.
Publicado: (2025)
CALF: Aligning LLMs for Time Series Forecasting via Cross-modal Fine-Tuning
por: Liu, Peiyuan, et al.
Publicado: (2024)
por: Liu, Peiyuan, et al.
Publicado: (2024)
VSPO: Vector-Steered Policy Optimization for Behavioral Control
por: Zhang, Xuechen, et al.
Publicado: (2026)
por: Zhang, Xuechen, et al.
Publicado: (2026)
AlignDistil: Token-Level Language Model Alignment as Adaptive Policy Distillation
por: Zhang, Songming, et al.
Publicado: (2025)
por: Zhang, Songming, et al.
Publicado: (2025)
Entropy-Aligned Decoding of LMs for Better Writing and Reasoning
por: Ahmed, Kareem, et al.
Publicado: (2026)
por: Ahmed, Kareem, et al.
Publicado: (2026)
From Sparse Decisions to Dense Reasoning: A Multi-attribute Trajectory Paradigm for Multimodal Moderation
por: Gu, Tianle, et al.
Publicado: (2026)
por: Gu, Tianle, et al.
Publicado: (2026)
Fleming-R1: Toward Expert-Level Medical Reasoning via Reinforcement Learning
por: Liu, Chi, et al.
Publicado: (2025)
por: Liu, Chi, et al.
Publicado: (2025)
AlignSAE: Concept-Aligned Sparse Autoencoders
por: Yang, Minglai, et al.
Publicado: (2025)
por: Yang, Minglai, et al.
Publicado: (2025)
SHAPE: Stage-aware Hierarchical Advantage via Potential Estimation for LLM Reasoning
por: Ai, Zhengyang, et al.
Publicado: (2026)
por: Ai, Zhengyang, et al.
Publicado: (2026)
Process Supervision of Confidence Margin for Calibrated LLM Reasoning
por: Wang, Liaoyaqi, et al.
Publicado: (2026)
por: Wang, Liaoyaqi, et al.
Publicado: (2026)
Agent-Omni: Test-Time Multimodal Reasoning via Model Coordination for Understanding Anything
por: Lin, Huawei, et al.
Publicado: (2025)
por: Lin, Huawei, et al.
Publicado: (2025)
Distribution-Aligned Sequence Distillation for Superior Long-CoT Reasoning
por: Yan, Shaotian, et al.
Publicado: (2026)
por: Yan, Shaotian, et al.
Publicado: (2026)
ReasonFlux: Hierarchical LLM Reasoning via Scaling Thought Templates
por: Yang, Ling, et al.
Publicado: (2025)
por: Yang, Ling, et al.
Publicado: (2025)
MultiTrust: A Comprehensive Benchmark Towards Trustworthy Multimodal Large Language Models
por: Zhang, Yichi, et al.
Publicado: (2024)
por: Zhang, Yichi, et al.
Publicado: (2024)
X-Reasoner: Towards Generalizable Reasoning Across Modalities and Domains
por: Liu, Qianchu, et al.
Publicado: (2025)
por: Liu, Qianchu, et al.
Publicado: (2025)
MolReasoner: Toward Effective and Interpretable Reasoning for Molecular LLMs
por: Zhao, Guojiang, et al.
Publicado: (2025)
por: Zhao, Guojiang, et al.
Publicado: (2025)
Unlocking Multimodal Mathematical Reasoning via Process Reward Model
por: Luo, Ruilin, et al.
Publicado: (2025)
por: Luo, Ruilin, et al.
Publicado: (2025)
Reasoning-preserved Efficient Distillation of Large Language Models via Activation-aware Initialization
por: He, Junlin, et al.
Publicado: (2026)
por: He, Junlin, et al.
Publicado: (2026)
ChemDFM-X: Towards Large Multimodal Model for Chemistry
por: Zhao, Zihan, et al.
Publicado: (2024)
por: Zhao, Zihan, et al.
Publicado: (2024)
Ejemplares similares
-
FlowCut: Rethinking Redundancy via Information Flow for Efficient Vision-Language Models
por: Tong, Jintao, et al.
Publicado: (2025) -
The Re-Label Method For Data-Centric Machine Learning
por: Guo, Tong
Publicado: (2023) -
Dual-Uncertainty Guided Policy Learning for Multimodal Reasoning
por: Liu, Rui, et al.
Publicado: (2025) -
SceneAlign: Aligning Multimodal Reasoning to Scene Graphs in Complex Visual Scenes
por: Wang, Chuhan, et al.
Publicado: (2026) -
Scaling Reasoning Efficiently via Relaxed On-Policy Distillation
por: Ko, Jongwoo, et al.
Publicado: (2026)