RRTL: Red Teaming Reasoning Large Language Models in Tool Learning
Fuente:
arXiv
Guardado en:
| Autores principales: | Liu, Yifei, Cui, Yu, Zhang, Haibin |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Red Teaming Large Language Models for Healthcare
por: Balazadeh, Vahid, et al.
Publicado: (2025)
por: Balazadeh, Vahid, et al.
Publicado: (2025)
Resource Consumption Red-Teaming for Large Vision-Language Models
por: Gao, Haoran, et al.
Publicado: (2025)
por: Gao, Haoran, et al.
Publicado: (2025)
RedBench: A Universal Dataset for Comprehensive Red Teaming of Large Language Models
por: Dang, Quy-Anh, et al.
Publicado: (2026)
por: Dang, Quy-Anh, et al.
Publicado: (2026)
RedTopic: Toward Topic-Diverse Red Teaming of Large Language Models
por: Ding, Jiale, et al.
Publicado: (2025)
por: Ding, Jiale, et al.
Publicado: (2025)
Stop Fixating on Prompts: Reasoning Hijacking and Constraint Tightening for Red-Teaming LLM Agents
por: Mao, Yanxu, et al.
Publicado: (2026)
por: Mao, Yanxu, et al.
Publicado: (2026)
Learning-Based Automated Adversarial Red-Teaming for Robustness Evaluation of Large Language Models
por: Wei, Zhang, et al.
Publicado: (2025)
por: Wei, Zhang, et al.
Publicado: (2025)
Red Teaming Visual Language Models
por: Li, Mukai, et al.
Publicado: (2024)
por: Li, Mukai, et al.
Publicado: (2024)
Red-Teaming for Inducing Societal Bias in Large Language Models
por: Luo, Chu Fei, et al.
Publicado: (2024)
por: Luo, Chu Fei, et al.
Publicado: (2024)
Gradient-Based Language Model Red Teaming
por: Wichers, Nevan, et al.
Publicado: (2024)
por: Wichers, Nevan, et al.
Publicado: (2024)
RedAgent: Red Teaming Large Language Models with Context-aware Autonomous Language Agent
por: Xu, Huiyu, et al.
Publicado: (2024)
por: Xu, Huiyu, et al.
Publicado: (2024)
GenBreak: Red Teaming Text-to-Image Generators Using Large Language Models
por: Wang, Zilong, et al.
Publicado: (2025)
por: Wang, Zilong, et al.
Publicado: (2025)
TOOLCAD: Exploring Tool-Using Large Language Models in Text-to-CAD Generation with Reinforcement Learning
por: Gong, Yifei, et al.
Publicado: (2026)
por: Gong, Yifei, et al.
Publicado: (2026)
TRIDENT: Enhancing Large Language Model Safety with Tri-Dimensional Diversified Red-Teaming Data Synthesis
por: Wu, Xiaorui, et al.
Publicado: (2025)
por: Wu, Xiaorui, et al.
Publicado: (2025)
Teaching Thinking Models to Reason with Tools: A Full-Pipeline Recipe for Tool-Integrated Reasoning
por: Cheng, Qianjia, et al.
Publicado: (2026)
por: Cheng, Qianjia, et al.
Publicado: (2026)
TroubleLLM: Align to Red Team Expert
por: Xu, Zhuoer, et al.
Publicado: (2024)
por: Xu, Zhuoer, et al.
Publicado: (2024)
Enhancing Tool Learning in Large Language Models with Hierarchical Error Checklists
por: Cui, Yue, et al.
Publicado: (2025)
por: Cui, Yue, et al.
Publicado: (2025)
Building Safe GenAI Applications: An End-to-End Overview of Red Teaming for Large Language Models
por: Purpura, Alberto, et al.
Publicado: (2025)
por: Purpura, Alberto, et al.
Publicado: (2025)
When Prompt Optimization Becomes Jailbreaking: Adaptive Red-Teaming of Large Language Models
por: Shamsi, Zafir, et al.
Publicado: (2026)
por: Shamsi, Zafir, et al.
Publicado: (2026)
Red Teaming Language Models for Processing Contradictory Dialogues
por: Wen, Xiaofei, et al.
Publicado: (2024)
por: Wen, Xiaofei, et al.
Publicado: (2024)
Auto-RT: Automatic Jailbreak Strategy Exploration for Red-Teaming Large Language Models
por: Liu, Yanjiang, et al.
Publicado: (2025)
por: Liu, Yanjiang, et al.
Publicado: (2025)
Jailbreak-Zero: A Path to Pareto Optimal Red Teaming for Large Language Models
por: Hu, Kai, et al.
Publicado: (2025)
por: Hu, Kai, et al.
Publicado: (2025)
CREATOR: Tool Creation for Disentangling Abstract and Concrete Reasoning of Large Language Models
por: Qian, Cheng, et al.
Publicado: (2023)
por: Qian, Cheng, et al.
Publicado: (2023)
Operationalizing a Threat Model for Red-Teaming Large Language Models (LLMs)
por: Verma, Apurv, et al.
Publicado: (2024)
por: Verma, Apurv, et al.
Publicado: (2024)
BiasGuard: A Reasoning-enhanced Bias Detection Tool For Large Language Models
por: Fan, Zhiting, et al.
Publicado: (2025)
por: Fan, Zhiting, et al.
Publicado: (2025)
Buffer of Thoughts: Thought-Augmented Reasoning with Large Language Models
por: Yang, Ling, et al.
Publicado: (2024)
por: Yang, Ling, et al.
Publicado: (2024)
Re-Initialization Token Learning for Tool-Augmented Large Language Models
por: Li, Chenghao, et al.
Publicado: (2025)
por: Li, Chenghao, et al.
Publicado: (2025)
StableToolBench: Towards Stable Large-Scale Benchmarking on Tool Learning of Large Language Models
por: Guo, Zhicheng, et al.
Publicado: (2024)
por: Guo, Zhicheng, et al.
Publicado: (2024)
Chain-of-Knowledge: Integrating Knowledge Reasoning into Large Language Models by Learning from Knowledge Graphs
por: Zhang, Yifei, et al.
Publicado: (2024)
por: Zhang, Yifei, et al.
Publicado: (2024)
MUR: Momentum Uncertainty guided Reasoning for Large Language Models
por: Yan, Hang, et al.
Publicado: (2025)
por: Yan, Hang, et al.
Publicado: (2025)
MATHSENSEI: A Tool-Augmented Large Language Model for Mathematical Reasoning
por: Das, Debrup, et al.
Publicado: (2024)
por: Das, Debrup, et al.
Publicado: (2024)
TInR: Exploring Tool-Internalized Reasoning in Large Language Models
por: Xu, Qiancheng, et al.
Publicado: (2026)
por: Xu, Qiancheng, et al.
Publicado: (2026)
Red Teaming Multimodal Language Models: Evaluating Harm Across Prompt Modalities and Models
por: Van Doren, Madison, et al.
Publicado: (2025)
por: Van Doren, Madison, et al.
Publicado: (2025)
Red Teaming for Large Language Models At Scale: Tackling Hallucinations on Mathematics Tasks
por: Buszydlik, Aleksander, et al.
Publicado: (2023)
por: Buszydlik, Aleksander, et al.
Publicado: (2023)
Unleashing Spatial Reasoning in Multimodal Large Language Models via Textual Representation Guided Reasoning
por: Hua, Jiacheng, et al.
Publicado: (2026)
por: Hua, Jiacheng, et al.
Publicado: (2026)
MUSE: MCTS-Driven Red Teaming Framework for Enhanced Multi-Turn Dialogue Safety in Large Language Models
por: Yan, Siyu, et al.
Publicado: (2025)
por: Yan, Siyu, et al.
Publicado: (2025)
EmoLLM: Appraisal-Grounded Cognitive-Emotional Co-Reasoning in Large Language Models
por: Zhang, Yifei, et al.
Publicado: (2026)
por: Zhang, Yifei, et al.
Publicado: (2026)
Learning Evolving Tools for Large Language Models
por: Chen, Guoxin, et al.
Publicado: (2024)
por: Chen, Guoxin, et al.
Publicado: (2024)
Nemotron-Research-Tool-N1: Exploring Tool-Using Language Models with Reinforced Reasoning
por: Zhang, Shaokun, et al.
Publicado: (2025)
por: Zhang, Shaokun, et al.
Publicado: (2025)
STAR: SocioTechnical Approach to Red Teaming Language Models
por: Weidinger, Laura, et al.
Publicado: (2024)
por: Weidinger, Laura, et al.
Publicado: (2024)
NEAT: Neuron-Based Early Exit for Large Reasoning Models
por: Liu, Kang, et al.
Publicado: (2026)
por: Liu, Kang, et al.
Publicado: (2026)
Ejemplares similares
-
Red Teaming Large Language Models for Healthcare
por: Balazadeh, Vahid, et al.
Publicado: (2025) -
Resource Consumption Red-Teaming for Large Vision-Language Models
por: Gao, Haoran, et al.
Publicado: (2025) -
RedBench: A Universal Dataset for Comprehensive Red Teaming of Large Language Models
por: Dang, Quy-Anh, et al.
Publicado: (2026) -
RedTopic: Toward Topic-Diverse Red Teaming of Large Language Models
por: Ding, Jiale, et al.
Publicado: (2025) -
Stop Fixating on Prompts: Reasoning Hijacking and Constraint Tightening for Red-Teaming LLM Agents
por: Mao, Yanxu, et al.
Publicado: (2026)