IntentionReasoner: Facilitating Adaptive LLM Safeguards through Intent Reasoning and Selective Query Refinement
Fuente:
arXiv
Salvato in:
| Autori principali: | Shen, Yuanzhe, Huang, Zisu, Guo, Zhengkang, Liu, Yide, Chen, Guanxu, Yin, Ruicheng, Zheng, Xiaoqing, Huang, Xuanjing |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
SATER: A Self-Aware and Token-Efficient Approach to Routing and Cascading
di: Shen, Yuanzhe, et al.
Pubblicazione: (2025)
di: Shen, Yuanzhe, et al.
Pubblicazione: (2025)
Enhancing the Capability and Robustness of Large Language Models through Reinforcement Learning-Driven Query Refinement
di: Wang, Xiaohua, et al.
Pubblicazione: (2024)
di: Wang, Xiaohua, et al.
Pubblicazione: (2024)
CSSG: Measuring Code Similarity with Semantic Graphs
di: Lu, Yiyang, et al.
Pubblicazione: (2026)
di: Lu, Yiyang, et al.
Pubblicazione: (2026)
TripTailor: A Real-World Benchmark for Personalized Travel Planning
di: Shen, Yuanzhe, et al.
Pubblicazione: (2025)
di: Shen, Yuanzhe, et al.
Pubblicazione: (2025)
Controllable Memory Usage: Balancing Anchoring and Innovation in Long-Term Human-Agent Interaction
di: Tian, Muzhao, et al.
Pubblicazione: (2026)
di: Tian, Muzhao, et al.
Pubblicazione: (2026)
Improving Continual Pre-training Through Seamless Data Packing
di: Yin, Ruicheng, et al.
Pubblicazione: (2025)
di: Yin, Ruicheng, et al.
Pubblicazione: (2025)
BatCoder: Self-Supervised Bidirectional Code-Documentation Learning via Back-Translation
di: Xu, Jingwen, et al.
Pubblicazione: (2026)
di: Xu, Jingwen, et al.
Pubblicazione: (2026)
RECAST: Expanding the Boundaries of LLMs' Complex Instruction Following with Multi-Constraint Data
di: Guo, Zhengkang, et al.
Pubblicazione: (2025)
di: Guo, Zhengkang, et al.
Pubblicazione: (2025)
Improving RL Exploration for LLM Reasoning through Retrospective Replay
di: Dou, Shihan, et al.
Pubblicazione: (2025)
di: Dou, Shihan, et al.
Pubblicazione: (2025)
Explainable Synthetic Image Detection through Diffusion Timestep Ensembling
di: Wu, Yixin, et al.
Pubblicazione: (2025)
di: Wu, Yixin, et al.
Pubblicazione: (2025)
Progressive Mastery: Customized Curriculum Learning with Guided Prompting for Mathematical Reasoning
di: Wu, Muling, et al.
Pubblicazione: (2025)
di: Wu, Muling, et al.
Pubblicazione: (2025)
AgentEscapeBench: Evaluating Out-of-Domain Tool-Grounded Reasoning in LLM Agents
di: Guo, Zhengkang, et al.
Pubblicazione: (2026)
di: Guo, Zhengkang, et al.
Pubblicazione: (2026)
GuardReasoner: Towards Reasoning-based LLM Safeguards
di: Liu, Yue, et al.
Pubblicazione: (2025)
di: Liu, Yue, et al.
Pubblicazione: (2025)
ARISE: An Adaptive Resolution-Aware Metric for Test-Time Scaling Evaluation in Large Reasoning Models
di: Yin, Zhangyue, et al.
Pubblicazione: (2025)
di: Yin, Zhangyue, et al.
Pubblicazione: (2025)
Self-Polish: Enhance Reasoning in Large Language Models via Problem Refinement
di: Xi, Zhiheng, et al.
Pubblicazione: (2023)
di: Xi, Zhiheng, et al.
Pubblicazione: (2023)
Enhancing Model Privacy in Federated Learning with Random Masking and Quantization
di: Xu, Zhibo, et al.
Pubblicazione: (2025)
di: Xu, Zhibo, et al.
Pubblicazione: (2025)
Route to Reason: Adaptive Routing for LLM and Reasoning Strategy Selection
di: Pan, Zhihong, et al.
Pubblicazione: (2025)
di: Pan, Zhihong, et al.
Pubblicazione: (2025)
Learning Query-Specific Rubrics from Human Preferences for DeepResearch Report Generation
di: Lv, Changze, et al.
Pubblicazione: (2026)
di: Lv, Changze, et al.
Pubblicazione: (2026)
Reward Hacking in the Era of Large Models: Mechanisms, Emergent Misalignment, Challenges
di: Wang, Xiaohua, et al.
Pubblicazione: (2026)
di: Wang, Xiaohua, et al.
Pubblicazione: (2026)
Rethinking Agentic RAG: Toward LLM-Driven Logical Retrieval Beyond Embeddings
di: Zeng, Yuqi, et al.
Pubblicazione: (2026)
di: Zeng, Yuqi, et al.
Pubblicazione: (2026)
GSPR: Aligning LLM Safeguards as Generalizable Safety Policy Reasoners
di: Li, Haoran, et al.
Pubblicazione: (2025)
di: Li, Haoran, et al.
Pubblicazione: (2025)
Search and Refine During Think: Facilitating Knowledge Refinement for Improved Retrieval-Augmented Reasoning
di: Shi, Yaorui, et al.
Pubblicazione: (2025)
di: Shi, Yaorui, et al.
Pubblicazione: (2025)
Benchmark^2: Systematic Evaluation of LLM Benchmarks
di: Qian, Qi, et al.
Pubblicazione: (2026)
di: Qian, Qi, et al.
Pubblicazione: (2026)
OmniVideo-R1: Reinforcing Audio-visual Reasoning with Query Intention and Modality Attention
di: Chen, Zhangquan, et al.
Pubblicazione: (2026)
di: Chen, Zhangquan, et al.
Pubblicazione: (2026)
Understanding Inter-Session Intentions via Complex Logical Reasoning
di: Bai, Jiaxin, et al.
Pubblicazione: (2023)
di: Bai, Jiaxin, et al.
Pubblicazione: (2023)
DesignerlyLoop: Forming Design Intent through Curated Reasoning for Human-LLM Alignment
di: Wang, Anqi, et al.
Pubblicazione: (2025)
di: Wang, Anqi, et al.
Pubblicazione: (2025)
Unveiling the Truth and Facilitating Change: Towards Agent-based Large-scale Social Movement Simulation
di: Mou, Xinyi, et al.
Pubblicazione: (2024)
di: Mou, Xinyi, et al.
Pubblicazione: (2024)
Controllable Traffic Simulation through LLM-Guided Hierarchical Reasoning and Refinement
di: Liu, Zhiyuan, et al.
Pubblicazione: (2024)
di: Liu, Zhiyuan, et al.
Pubblicazione: (2024)
Decoding Continuous Character-based Language from Non-invasive Brain Recordings
di: Zhang, Cenyuan, et al.
Pubblicazione: (2024)
di: Zhang, Cenyuan, et al.
Pubblicazione: (2024)
GuardReasoner-VL: Safeguarding VLMs via Reinforced Reasoning
di: Liu, Yue, et al.
Pubblicazione: (2025)
di: Liu, Yue, et al.
Pubblicazione: (2025)
Rethinking Entropy Regularization in Large Reasoning Models
di: Jiang, Yuxian, et al.
Pubblicazione: (2025)
di: Jiang, Yuxian, et al.
Pubblicazione: (2025)
Quantifying Cross-Query Contradictions in Multi-Query LLM Reasoning
di: Salla, Rohit Kumar, et al.
Pubblicazione: (2026)
di: Salla, Rohit Kumar, et al.
Pubblicazione: (2026)
RelayLLM: Efficient Reasoning via Collaborative Decoding
di: Huang, Chengsong, et al.
Pubblicazione: (2026)
di: Huang, Chengsong, et al.
Pubblicazione: (2026)
Multi-hop Reasoning via Early Knowledge Alignment
di: Wang, Yuxin, et al.
Pubblicazione: (2025)
di: Wang, Yuxin, et al.
Pubblicazione: (2025)
LLM-Guided Semantic Relational Reasoning for Multimodal Intent Recognition
di: Zhou, Qianrui, et al.
Pubblicazione: (2025)
di: Zhou, Qianrui, et al.
Pubblicazione: (2025)
Query-Enhanced Adaptive Semantic Path Reasoning for Inductive Knowledge Graph Completion
di: Sun, Kai, et al.
Pubblicazione: (2024)
di: Sun, Kai, et al.
Pubblicazione: (2024)
GuardAgent: Safeguard LLM Agents by a Guard Agent via Knowledge-Enabled Reasoning
di: Xiang, Zhen, et al.
Pubblicazione: (2024)
di: Xiang, Zhen, et al.
Pubblicazione: (2024)
Intent Classification on Low-Resource Languages with Query Similarity Search
di: Bhalla, Arjun, et al.
Pubblicazione: (2025)
di: Bhalla, Arjun, et al.
Pubblicazione: (2025)
Adaptive Selection of Symbolic Languages for Improving LLM Logical Reasoning
di: Wang, Xiangyu, et al.
Pubblicazione: (2025)
di: Wang, Xiangyu, et al.
Pubblicazione: (2025)
Ares: Adaptive Reasoning Effort Selection for Efficient LLM Agents
di: Yang, Jingbo, et al.
Pubblicazione: (2026)
di: Yang, Jingbo, et al.
Pubblicazione: (2026)
Documenti analoghi
-
SATER: A Self-Aware and Token-Efficient Approach to Routing and Cascading
di: Shen, Yuanzhe, et al.
Pubblicazione: (2025) -
Enhancing the Capability and Robustness of Large Language Models through Reinforcement Learning-Driven Query Refinement
di: Wang, Xiaohua, et al.
Pubblicazione: (2024) -
CSSG: Measuring Code Similarity with Semantic Graphs
di: Lu, Yiyang, et al.
Pubblicazione: (2026) -
TripTailor: A Real-World Benchmark for Personalized Travel Planning
di: Shen, Yuanzhe, et al.
Pubblicazione: (2025) -
Controllable Memory Usage: Balancing Anchoring and Innovation in Long-Term Human-Agent Interaction
di: Tian, Muzhao, et al.
Pubblicazione: (2026)