Taxonomy of Comprehensive Safety for Clinical Agents
Fuente:
arXiv
Guardado en:
| Autores principales: | Seo, Jean, Lee, Hyunkyung, Kim, Gibaeg, Han, Wooseok, Yoo, Jaehyo, Lim, Seungseop, Shin, Kihun, Yang, Eunho |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Format Inertia: A Failure Mechanism of LLMs in Medical Pre-Consultation
por: Lim, Seungseop, et al.
Publicado: (2025)
por: Lim, Seungseop, et al.
Publicado: (2025)
Evaluating the Pre-Consultation Ability of LLMs using Diagnostic Guidelines
por: Seo, Jean, et al.
Publicado: (2026)
por: Seo, Jean, et al.
Publicado: (2026)
H-DDx: A Hierarchical Evaluation Framework for Differential Diagnosis
por: Lim, Seungseop, et al.
Publicado: (2025)
por: Lim, Seungseop, et al.
Publicado: (2025)
Face-StyleSpeech: Enhancing Zero-shot Speech Synthesis from Face Images with Improved Face-to-Speech Mapping
por: Kang, Minki, et al.
Publicado: (2023)
por: Kang, Minki, et al.
Publicado: (2023)
Optimal path for Biomedical Text Summarization Using Pointer GPT
por: Han, Hyunkyung, et al.
Publicado: (2024)
por: Han, Hyunkyung, et al.
Publicado: (2024)
SAFE-SQL: Self-Augmented In-Context Learning with Fine-grained Example Selection for Text-to-SQL
por: Lee, Jimin, et al.
Publicado: (2025)
por: Lee, Jimin, et al.
Publicado: (2025)
Divide and Translate: Compositional First-Order Logic Translation and Verification for Complex Logical Reasoning
por: Ryu, Hyun, et al.
Publicado: (2024)
por: Ryu, Hyun, et al.
Publicado: (2024)
DAHL: Domain-specific Automated Hallucination Evaluation of Long-Form Text through a Benchmark Dataset in Biomedicine
por: Seo, Jean, et al.
Publicado: (2024)
por: Seo, Jean, et al.
Publicado: (2024)
A Multi-Agent Framework for Feature-Constrained Difficulty Control in Reading Comprehension Item Generation
por: Hwang, Seonjeong, et al.
Publicado: (2026)
por: Hwang, Seonjeong, et al.
Publicado: (2026)
Token-Supervised Value Models for Enhancing Mathematical Problem-Solving Capabilities of Large Language Models
por: Lee, Jung Hyun, et al.
Publicado: (2024)
por: Lee, Jung Hyun, et al.
Publicado: (2024)
BiCon-Gate: Consistency-Gated De-colloquialisation for Dialogue Fact-Checking
por: Park, Hyunkyung, et al.
Publicado: (2026)
por: Park, Hyunkyung, et al.
Publicado: (2026)
MoFE: Mixture of Frozen Experts Architecture
por: Seo, Jean, et al.
Publicado: (2025)
por: Seo, Jean, et al.
Publicado: (2025)
Verified Misguidance: Measuring Structural Citation Failures in Search-Augmented LLMs
por: Seo, Yongsik, et al.
Publicado: (2026)
por: Seo, Yongsik, et al.
Publicado: (2026)
CURaTE: Continual Unlearning in Real Time with Ensured Preservation of LLM Knowledge
por: Bae, Seyun, et al.
Publicado: (2026)
por: Bae, Seyun, et al.
Publicado: (2026)
Taxonomy and Analysis of Sensitive User Queries in Generative AI Search
por: Jo, Hwiyeol, et al.
Publicado: (2024)
por: Jo, Hwiyeol, et al.
Publicado: (2024)
Code-Switching Red-Teaming: LLM Evaluation for Safety and Multilingual Understanding
por: Yoo, Haneul, et al.
Publicado: (2024)
por: Yoo, Haneul, et al.
Publicado: (2024)
How does a Language-Specific Tokenizer affect LLMs?
por: Seo, Jean, et al.
Publicado: (2025)
por: Seo, Jean, et al.
Publicado: (2025)
Every Expert Matters: Towards Effective Knowledge Distillation for Mixture-of-Experts Language Models
por: Kim, Gyeongman, et al.
Publicado: (2025)
por: Kim, Gyeongman, et al.
Publicado: (2025)
PromptKD: Distilling Student-Friendly Knowledge for Generative Language Models via Prompt Tuning
por: Kim, Gyeongman, et al.
Publicado: (2024)
por: Kim, Gyeongman, et al.
Publicado: (2024)
Verifying the Verifiers: Unveiling Pitfalls and Potentials in Fact Verifiers
por: Seo, Wooseok, et al.
Publicado: (2025)
por: Seo, Wooseok, et al.
Publicado: (2025)
SPeCtrum: A Grounded Framework for Multidimensional Identity Representation in LLM-Based Agent
por: Lee, Keyeun, et al.
Publicado: (2025)
por: Lee, Keyeun, et al.
Publicado: (2025)
No Reader Left Behind: Multi-Agent Summaries Everyone Can Understand
por: Jung, Jimin, et al.
Publicado: (2026)
por: Jung, Jimin, et al.
Publicado: (2026)
Question-to-Knowledge (Q2K): Multi-Agent Generation of Inspectable Facts for Product Mapping
por: Seo, Wonduk, et al.
Publicado: (2025)
por: Seo, Wonduk, et al.
Publicado: (2025)
MedOrchestra: A Hybrid Cloud-Local LLM Approach for Clinical Data Interpretation
por: Lee, Sihyeon, et al.
Publicado: (2025)
por: Lee, Sihyeon, et al.
Publicado: (2025)
FunctionChat-Bench: Comprehensive Evaluation of Language Models' Generative Capabilities in Korean Tool-use Dialogs
por: Lee, Shinbok, et al.
Publicado: (2024)
por: Lee, Shinbok, et al.
Publicado: (2024)
X-LLaVA: Optimizing Bilingual Large Vision-Language Alignment
por: Shin, Dongjae, et al.
Publicado: (2024)
por: Shin, Dongjae, et al.
Publicado: (2024)
When to Ensemble: Identifying Token-Level Points for Stable and Fast LLM Ensembling
por: Yun, Heecheol, et al.
Publicado: (2025)
por: Yun, Heecheol, et al.
Publicado: (2025)
CARBD-Ko: A Contextually Annotated Review Benchmark Dataset for Aspect-Level Sentiment Classification in Korean
por: Jang, Dongjun, et al.
Publicado: (2024)
por: Jang, Dongjun, et al.
Publicado: (2024)
Safety at Scale: A Comprehensive Survey of Large Model and Agent Safety
por: Ma, Xingjun, et al.
Publicado: (2025)
por: Ma, Xingjun, et al.
Publicado: (2025)
SWITCH: Studying with Teacher for Knowledge Distillation of Large Language Models
por: Koo, Jahyun, et al.
Publicado: (2024)
por: Koo, Jahyun, et al.
Publicado: (2024)
ADVICE: Answer-Dependent Verbalized Confidence Estimation
por: Seo, Ki Jung, et al.
Publicado: (2025)
por: Seo, Ki Jung, et al.
Publicado: (2025)
Agent-SafetyBench: Evaluating the Safety of LLM Agents
por: Zhang, Zhexin, et al.
Publicado: (2024)
por: Zhang, Zhexin, et al.
Publicado: (2024)
Speculative Verification: Exploiting Information Gain to Refine Speculative Decoding
por: Kim, Sungkyun, et al.
Publicado: (2025)
por: Kim, Sungkyun, et al.
Publicado: (2025)
ixi-GEN: Efficient Industrial sLLMs through Domain Adaptive Continual Pretraining
por: Kim, Seonwu, et al.
Publicado: (2025)
por: Kim, Seonwu, et al.
Publicado: (2025)
HAD: HAllucination Detection Language Models Based on a Comprehensive Hallucination Taxonomy
por: Xu, Fan, et al.
Publicado: (2025)
por: Xu, Fan, et al.
Publicado: (2025)
BenchPreS: A Benchmark for Context-Aware Personalized Preference Selectivity of Persistent-Memory LLMs
por: Yoon, Sangyeon, et al.
Publicado: (2026)
por: Yoon, Sangyeon, et al.
Publicado: (2026)
How Does Vision-Language Adaptation Impact the Safety of Vision Language Models?
por: Lee, Seongyun, et al.
Publicado: (2024)
por: Lee, Seongyun, et al.
Publicado: (2024)
One-Topic-Doesn't-Fit-All: Transcreating Reading Comprehension Test for Personalized Learning
por: Han, Jieun, et al.
Publicado: (2025)
por: Han, Jieun, et al.
Publicado: (2025)
Margin Matching Preference Optimization: Enhanced Model Alignment with Granular Feedback
por: Kim, Kyuyoung, et al.
Publicado: (2024)
por: Kim, Kyuyoung, et al.
Publicado: (2024)
MPIB: A Benchmark for Medical Prompt Injection Attacks and Clinical Safety in LLMs
por: Lee, Junhyeok, et al.
Publicado: (2026)
por: Lee, Junhyeok, et al.
Publicado: (2026)
Ejemplares similares
-
Format Inertia: A Failure Mechanism of LLMs in Medical Pre-Consultation
por: Lim, Seungseop, et al.
Publicado: (2025) -
Evaluating the Pre-Consultation Ability of LLMs using Diagnostic Guidelines
por: Seo, Jean, et al.
Publicado: (2026) -
H-DDx: A Hierarchical Evaluation Framework for Differential Diagnosis
por: Lim, Seungseop, et al.
Publicado: (2025) -
Face-StyleSpeech: Enhancing Zero-shot Speech Synthesis from Face Images with Improved Face-to-Speech Mapping
por: Kang, Minki, et al.
Publicado: (2023) -
Optimal path for Biomedical Text Summarization Using Pointer GPT
por: Han, Hyunkyung, et al.
Publicado: (2024)