IntentionReasoner: Facilitating Adaptive LLM Safeguards through Intent Reasoning and Selective Query Refinement
Fuente:
arXiv
Guardado en:
| Autores principales: | Shen, Yuanzhe, Huang, Zisu, Guo, Zhengkang, Liu, Yide, Chen, Guanxu, Yin, Ruicheng, Zheng, Xiaoqing, Huang, Xuanjing |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
SATER: A Self-Aware and Token-Efficient Approach to Routing and Cascading
por: Shen, Yuanzhe, et al.
Publicado: (2025)
por: Shen, Yuanzhe, et al.
Publicado: (2025)
Enhancing the Capability and Robustness of Large Language Models through Reinforcement Learning-Driven Query Refinement
por: Wang, Xiaohua, et al.
Publicado: (2024)
por: Wang, Xiaohua, et al.
Publicado: (2024)
CSSG: Measuring Code Similarity with Semantic Graphs
por: Lu, Yiyang, et al.
Publicado: (2026)
por: Lu, Yiyang, et al.
Publicado: (2026)
TripTailor: A Real-World Benchmark for Personalized Travel Planning
por: Shen, Yuanzhe, et al.
Publicado: (2025)
por: Shen, Yuanzhe, et al.
Publicado: (2025)
Controllable Memory Usage: Balancing Anchoring and Innovation in Long-Term Human-Agent Interaction
por: Tian, Muzhao, et al.
Publicado: (2026)
por: Tian, Muzhao, et al.
Publicado: (2026)
Improving Continual Pre-training Through Seamless Data Packing
por: Yin, Ruicheng, et al.
Publicado: (2025)
por: Yin, Ruicheng, et al.
Publicado: (2025)
BatCoder: Self-Supervised Bidirectional Code-Documentation Learning via Back-Translation
por: Xu, Jingwen, et al.
Publicado: (2026)
por: Xu, Jingwen, et al.
Publicado: (2026)
RECAST: Expanding the Boundaries of LLMs' Complex Instruction Following with Multi-Constraint Data
por: Guo, Zhengkang, et al.
Publicado: (2025)
por: Guo, Zhengkang, et al.
Publicado: (2025)
Improving RL Exploration for LLM Reasoning through Retrospective Replay
por: Dou, Shihan, et al.
Publicado: (2025)
por: Dou, Shihan, et al.
Publicado: (2025)
Explainable Synthetic Image Detection through Diffusion Timestep Ensembling
por: Wu, Yixin, et al.
Publicado: (2025)
por: Wu, Yixin, et al.
Publicado: (2025)
Progressive Mastery: Customized Curriculum Learning with Guided Prompting for Mathematical Reasoning
por: Wu, Muling, et al.
Publicado: (2025)
por: Wu, Muling, et al.
Publicado: (2025)
AgentEscapeBench: Evaluating Out-of-Domain Tool-Grounded Reasoning in LLM Agents
por: Guo, Zhengkang, et al.
Publicado: (2026)
por: Guo, Zhengkang, et al.
Publicado: (2026)
GuardReasoner: Towards Reasoning-based LLM Safeguards
por: Liu, Yue, et al.
Publicado: (2025)
por: Liu, Yue, et al.
Publicado: (2025)
ARISE: An Adaptive Resolution-Aware Metric for Test-Time Scaling Evaluation in Large Reasoning Models
por: Yin, Zhangyue, et al.
Publicado: (2025)
por: Yin, Zhangyue, et al.
Publicado: (2025)
Self-Polish: Enhance Reasoning in Large Language Models via Problem Refinement
por: Xi, Zhiheng, et al.
Publicado: (2023)
por: Xi, Zhiheng, et al.
Publicado: (2023)
Enhancing Model Privacy in Federated Learning with Random Masking and Quantization
por: Xu, Zhibo, et al.
Publicado: (2025)
por: Xu, Zhibo, et al.
Publicado: (2025)
Route to Reason: Adaptive Routing for LLM and Reasoning Strategy Selection
por: Pan, Zhihong, et al.
Publicado: (2025)
por: Pan, Zhihong, et al.
Publicado: (2025)
Learning Query-Specific Rubrics from Human Preferences for DeepResearch Report Generation
por: Lv, Changze, et al.
Publicado: (2026)
por: Lv, Changze, et al.
Publicado: (2026)
Reward Hacking in the Era of Large Models: Mechanisms, Emergent Misalignment, Challenges
por: Wang, Xiaohua, et al.
Publicado: (2026)
por: Wang, Xiaohua, et al.
Publicado: (2026)
Rethinking Agentic RAG: Toward LLM-Driven Logical Retrieval Beyond Embeddings
por: Zeng, Yuqi, et al.
Publicado: (2026)
por: Zeng, Yuqi, et al.
Publicado: (2026)
GSPR: Aligning LLM Safeguards as Generalizable Safety Policy Reasoners
por: Li, Haoran, et al.
Publicado: (2025)
por: Li, Haoran, et al.
Publicado: (2025)
Search and Refine During Think: Facilitating Knowledge Refinement for Improved Retrieval-Augmented Reasoning
por: Shi, Yaorui, et al.
Publicado: (2025)
por: Shi, Yaorui, et al.
Publicado: (2025)
Benchmark^2: Systematic Evaluation of LLM Benchmarks
por: Qian, Qi, et al.
Publicado: (2026)
por: Qian, Qi, et al.
Publicado: (2026)
OmniVideo-R1: Reinforcing Audio-visual Reasoning with Query Intention and Modality Attention
por: Chen, Zhangquan, et al.
Publicado: (2026)
por: Chen, Zhangquan, et al.
Publicado: (2026)
Understanding Inter-Session Intentions via Complex Logical Reasoning
por: Bai, Jiaxin, et al.
Publicado: (2023)
por: Bai, Jiaxin, et al.
Publicado: (2023)
DesignerlyLoop: Forming Design Intent through Curated Reasoning for Human-LLM Alignment
por: Wang, Anqi, et al.
Publicado: (2025)
por: Wang, Anqi, et al.
Publicado: (2025)
Unveiling the Truth and Facilitating Change: Towards Agent-based Large-scale Social Movement Simulation
por: Mou, Xinyi, et al.
Publicado: (2024)
por: Mou, Xinyi, et al.
Publicado: (2024)
Controllable Traffic Simulation through LLM-Guided Hierarchical Reasoning and Refinement
por: Liu, Zhiyuan, et al.
Publicado: (2024)
por: Liu, Zhiyuan, et al.
Publicado: (2024)
Decoding Continuous Character-based Language from Non-invasive Brain Recordings
por: Zhang, Cenyuan, et al.
Publicado: (2024)
por: Zhang, Cenyuan, et al.
Publicado: (2024)
GuardReasoner-VL: Safeguarding VLMs via Reinforced Reasoning
por: Liu, Yue, et al.
Publicado: (2025)
por: Liu, Yue, et al.
Publicado: (2025)
Rethinking Entropy Regularization in Large Reasoning Models
por: Jiang, Yuxian, et al.
Publicado: (2025)
por: Jiang, Yuxian, et al.
Publicado: (2025)
Quantifying Cross-Query Contradictions in Multi-Query LLM Reasoning
por: Salla, Rohit Kumar, et al.
Publicado: (2026)
por: Salla, Rohit Kumar, et al.
Publicado: (2026)
RelayLLM: Efficient Reasoning via Collaborative Decoding
por: Huang, Chengsong, et al.
Publicado: (2026)
por: Huang, Chengsong, et al.
Publicado: (2026)
Multi-hop Reasoning via Early Knowledge Alignment
por: Wang, Yuxin, et al.
Publicado: (2025)
por: Wang, Yuxin, et al.
Publicado: (2025)
LLM-Guided Semantic Relational Reasoning for Multimodal Intent Recognition
por: Zhou, Qianrui, et al.
Publicado: (2025)
por: Zhou, Qianrui, et al.
Publicado: (2025)
Query-Enhanced Adaptive Semantic Path Reasoning for Inductive Knowledge Graph Completion
por: Sun, Kai, et al.
Publicado: (2024)
por: Sun, Kai, et al.
Publicado: (2024)
GuardAgent: Safeguard LLM Agents by a Guard Agent via Knowledge-Enabled Reasoning
por: Xiang, Zhen, et al.
Publicado: (2024)
por: Xiang, Zhen, et al.
Publicado: (2024)
Intent Classification on Low-Resource Languages with Query Similarity Search
por: Bhalla, Arjun, et al.
Publicado: (2025)
por: Bhalla, Arjun, et al.
Publicado: (2025)
Adaptive Selection of Symbolic Languages for Improving LLM Logical Reasoning
por: Wang, Xiangyu, et al.
Publicado: (2025)
por: Wang, Xiangyu, et al.
Publicado: (2025)
Ares: Adaptive Reasoning Effort Selection for Efficient LLM Agents
por: Yang, Jingbo, et al.
Publicado: (2026)
por: Yang, Jingbo, et al.
Publicado: (2026)
Ejemplares similares
-
SATER: A Self-Aware and Token-Efficient Approach to Routing and Cascading
por: Shen, Yuanzhe, et al.
Publicado: (2025) -
Enhancing the Capability and Robustness of Large Language Models through Reinforcement Learning-Driven Query Refinement
por: Wang, Xiaohua, et al.
Publicado: (2024) -
CSSG: Measuring Code Similarity with Semantic Graphs
por: Lu, Yiyang, et al.
Publicado: (2026) -
TripTailor: A Real-World Benchmark for Personalized Travel Planning
por: Shen, Yuanzhe, et al.
Publicado: (2025) -
Controllable Memory Usage: Balancing Anchoring and Innovation in Long-Term Human-Agent Interaction
por: Tian, Muzhao, et al.
Publicado: (2026)