Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Hu, Wenbin, Li, Haoran, Jing, Huihao, Hu, Qi, Zeng, Ziqian, Han, Sirui, Xu, Heli, Chu, Tianshu, Hu, Peizhao, Song, Yangqiu |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
PrivaCI-Bench: Evaluating Privacy with Contextual Integrity and Legal Compliance
par: Li, Haoran, et autres
Publié: (2025)
par: Li, Haoran, et autres
Publié: (2025)
MCIP: Protecting MCP Safety via Model Contextual Integrity Protocol
par: Jing, Huihao, et autres
Publié: (2025)
par: Jing, Huihao, et autres
Publié: (2025)
Safety Compliance: Rethinking LLM Safety Reasoning through the Lens of Compliance
par: Hu, Wenbin, et autres
Publié: (2025)
par: Hu, Wenbin, et autres
Publié: (2025)
ContextLens: Modeling Imperfect Privacy and Safety Context for Legal Compliance
par: Li, Haoran, et autres
Publié: (2026)
par: Li, Haoran, et autres
Publié: (2026)
GSPR: Aligning LLM Safeguards as Generalizable Safety Policy Reasoners
par: Li, Haoran, et autres
Publié: (2025)
par: Li, Haoran, et autres
Publié: (2025)
OmniCompliance-100K: A Multi-Domain, Rule-Grounded, Real-World Safety Compliance Dataset
par: Hu, Wenbin, et autres
Publié: (2026)
par: Hu, Wenbin, et autres
Publié: (2026)
Privacy Checklist: Privacy Violation Detection Grounding on Contextual Integrity Theory
par: Li, Haoran, et autres
Publié: (2024)
par: Li, Haoran, et autres
Publié: (2024)
Node Level Graph Autoencoder: Unified Pretraining for Textual Graph Learning
par: Hu, Wenbin, et autres
Publié: (2024)
par: Hu, Wenbin, et autres
Publié: (2024)
MASLegalBench: Benchmarking Multi-Agent Systems in Deductive Legal Reasoning
par: Jing, Huihao, et autres
Publié: (2025)
par: Jing, Huihao, et autres
Publié: (2025)
PerfCodeBench: Benchmarking LLMs for System-Level High-Performance Code Optimization
par: Jing, Huihao, et autres
Publié: (2026)
par: Jing, Huihao, et autres
Publié: (2026)
Privacy-Preserved Neural Graph Databases
par: Hu, Qi, et autres
Publié: (2023)
par: Hu, Qi, et autres
Publié: (2023)
Do Reasoning Models Enhance Embedding Models?
par: Chan, Wun Yu, et autres
Publié: (2026)
par: Chan, Wun Yu, et autres
Publié: (2026)
GrandGuard: Taxonomy, Benchmark, and Safeguards for Elderly-Chatbot Interaction Safety
par: Fan, Changxuan, et autres
Publié: (2026)
par: Fan, Changxuan, et autres
Publié: (2026)
DINO-R1: Incentivizing Reasoning Capability in Vision Foundation Models
par: Pan, Chenbin, et autres
Publié: (2025)
par: Pan, Chenbin, et autres
Publié: (2025)
Contextual Bilevel Reinforcement Learning for Incentive Alignment
par: Thoma, Vinzenz, et autres
Publié: (2024)
par: Thoma, Vinzenz, et autres
Publié: (2024)
GoldCoin: Grounding Large Language Models in Privacy Laws via Contextual Integrity Theory
par: Fan, Wei, et autres
Publié: (2024)
par: Fan, Wei, et autres
Publié: (2024)
VideoRFT: Incentivizing Video Reasoning Capability in MLLMs via Reinforced Fine-Tuning
par: Wang, Qi, et autres
Publié: (2025)
par: Wang, Qi, et autres
Publié: (2025)
Diversity-Incentivized Exploration for Versatile Reasoning
par: Hu, Zican, et autres
Publié: (2025)
par: Hu, Zican, et autres
Publié: (2025)
R-Log: Incentivizing Log Analysis Capability in LLMs via Reasoning-based Reinforcement Learning
par: Liu, Yilun, et autres
Publié: (2025)
par: Liu, Yilun, et autres
Publié: (2025)
Vision-R1: Incentivizing Reasoning Capability in Multimodal Large Language Models
par: Huang, Wenxuan, et autres
Publié: (2025)
par: Huang, Wenxuan, et autres
Publié: (2025)
Graph-Augmented Reasoning: Evolving Step-by-Step Knowledge Graph Retrieval for LLM Reasoning
par: Wu, Wenjie, et autres
Publié: (2025)
par: Wu, Wenjie, et autres
Publié: (2025)
DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning
par: DeepSeek-AI, et autres
Publié: (2025)
par: DeepSeek-AI, et autres
Publié: (2025)
rSIM: Incentivizing Reasoning Capabilities of LLMs via Reinforced Strategy Injection
par: Chen, Sijia, et autres
Publié: (2025)
par: Chen, Sijia, et autres
Publié: (2025)
R-4B: Incentivizing General-Purpose Auto-Thinking Capability in MLLMs via Bi-Mode Annealing and Reinforce Learning
par: Yang, Qi, et autres
Publié: (2025)
par: Yang, Qi, et autres
Publié: (2025)
Saliency-R1: Incentivizing Unified Saliency Reasoning Capability in MLLM with Confidence-Guided Reinforcement Learning
par: Li, Long, et autres
Publié: (2025)
par: Li, Long, et autres
Publié: (2025)
Explicit Context Reasoning with Supervision for Visual Tracking
par: Zeng, Fansheng, et autres
Publié: (2025)
par: Zeng, Fansheng, et autres
Publié: (2025)
MARS: Benchmarking the Metaphysical Reasoning Abilities of Language Models with a Multi-task Evaluation Dataset
par: Wang, Weiqi, et autres
Publié: (2024)
par: Wang, Weiqi, et autres
Publié: (2024)
Incentivizing Consistent, Effective and Scalable Reasoning Capability in Audio LLMs via Reasoning Process Rewards
par: Fan, Jiajun, et autres
Publié: (2025)
par: Fan, Jiajun, et autres
Publié: (2025)
ARise: Towards Knowledge-Augmented Reasoning via Risk-Adaptive Search
par: Zhang, Yize, et autres
Publié: (2025)
par: Zhang, Yize, et autres
Publié: (2025)
Capabilities of GPT-5 on Multimodal Medical Reasoning
par: Wang, Shansong, et autres
Publié: (2025)
par: Wang, Shansong, et autres
Publié: (2025)
R1-T1: Fully Incentivizing Translation Capability in LLMs via Reasoning Learning
par: He, Minggui, et autres
Publié: (2025)
par: He, Minggui, et autres
Publié: (2025)
PrivLM-Bench: A Multi-level Privacy Evaluation Benchmark for Language Models
par: Li, Haoran, et autres
Publié: (2023)
par: Li, Haoran, et autres
Publié: (2023)
RCP-Merging: Merging Long Chain-of-Thought Models with Domain-Specific Models by Considering Reasoning Capability as Prior
par: Yang, Junyao, et autres
Publié: (2025)
par: Yang, Junyao, et autres
Publié: (2025)
Privacy Reasoning in Ambiguous Contexts
par: Yi, Ren, et autres
Publié: (2025)
par: Yi, Ren, et autres
Publié: (2025)
Rectify Evaluation Preference: Improving LLMs' Critique on Math Reasoning via Perplexity-aware Reinforcement Learning
par: Tian, Changyuan, et autres
Publié: (2025)
par: Tian, Changyuan, et autres
Publié: (2025)
Automated Driving with Evolution Capability: A Reinforcement Learning Method with Monotonic Performance Enhancement
par: Hu, Jia, et autres
Publié: (2024)
par: Hu, Jia, et autres
Publié: (2024)
Pixel Reasoner: Incentivizing Pixel-Space Reasoning with Curiosity-Driven Reinforcement Learning
par: Wang, Haozhe, et autres
Publié: (2025)
par: Wang, Haozhe, et autres
Publié: (2025)
AudAgent: Automated Auditing of Privacy Policy Compliance in AI Agents
par: Zheng, Ye, et autres
Publié: (2025)
par: Zheng, Ye, et autres
Publié: (2025)
CLR-Fact: Evaluating the Complex Logical Reasoning Capability of Large Language Models over Factual Knowledge
par: Zheng, Tianshi, et autres
Publié: (2024)
par: Zheng, Tianshi, et autres
Publié: (2024)
MixKVQ: Query-Aware Mixed-Precision KV Cache Quantization for Long-Context Reasoning
par: Zhang, Tao, et autres
Publié: (2025)
par: Zhang, Tao, et autres
Publié: (2025)
Documents similaires
-
PrivaCI-Bench: Evaluating Privacy with Contextual Integrity and Legal Compliance
par: Li, Haoran, et autres
Publié: (2025) -
MCIP: Protecting MCP Safety via Model Contextual Integrity Protocol
par: Jing, Huihao, et autres
Publié: (2025) -
Safety Compliance: Rethinking LLM Safety Reasoning through the Lens of Compliance
par: Hu, Wenbin, et autres
Publié: (2025) -
ContextLens: Modeling Imperfect Privacy and Safety Context for Legal Compliance
par: Li, Haoran, et autres
Publié: (2026) -
GSPR: Aligning LLM Safeguards as Generalizable Safety Policy Reasoners
par: Li, Haoran, et autres
Publié: (2025)