LifeTox: Unveiling Implicit Toxicity in Life Advice
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Kim, Minbeom, Koo, Jahyun, Lee, Hwanhee, Park, Joonsuk, Lee, Hwaran, Jung, Kyomin |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
AdvisorQA: Towards Helpful and Harmless Advice-seeking Question Answering with Collective Intelligence
par: Kim, Minbeom, et autres
Publié: (2024)
par: Kim, Minbeom, et autres
Publié: (2024)
Drift: Decoding-time Personalized Alignments with Implicit User Preferences
par: Kim, Minbeom, et autres
Publié: (2025)
par: Kim, Minbeom, et autres
Publié: (2025)
Program Synthesis via Test-Time Transduction
par: Lee, Kang-il, et autres
Publié: (2025)
par: Lee, Kang-il, et autres
Publié: (2025)
Guaranteed Generation from Large Language Models
par: Kim, Minbeom, et autres
Publié: (2024)
par: Kim, Minbeom, et autres
Publié: (2024)
A Character-Centric Creative Story Generation via Imagination
par: Park, Kyeongman, et autres
Publié: (2024)
par: Park, Kyeongman, et autres
Publié: (2024)
Are LLM-Judges Robust to Expressions of Uncertainty? Investigating the effect of Epistemic Markers on LLM-based Evaluation
par: Lee, Dongryeol, et autres
Publié: (2024)
par: Lee, Dongryeol, et autres
Publié: (2024)
Black-Box Hallucination Detection via Consistency Under the Uncertain Expression
par: Joo, Seongho, et autres
Publié: (2025)
par: Joo, Seongho, et autres
Publié: (2025)
Return of EM: Entity-driven Answer Set Expansion for QA Evaluation
par: Lee, Dongryeol, et autres
Publié: (2024)
par: Lee, Dongryeol, et autres
Publié: (2024)
SWITCH: Studying with Teacher for Knowledge Distillation of Large Language Models
par: Koo, Jahyun, et autres
Publié: (2024)
par: Koo, Jahyun, et autres
Publié: (2024)
Mitigating Hallucinations in Large Vision-Language Models via Summary-Guided Decoding
par: Min, Kyungmin, et autres
Publié: (2024)
par: Min, Kyungmin, et autres
Publié: (2024)
Can LLMs Recognize Toxicity? A Structured Investigation Framework and Toxicity Metric
par: Koh, Hyukhun, et autres
Publié: (2024)
par: Koh, Hyukhun, et autres
Publié: (2024)
LLMs can be easily Confused by Instructional Distractions
par: Hwang, Yerin, et autres
Publié: (2025)
par: Hwang, Yerin, et autres
Publié: (2025)
Selective Demonstration Retrieval for Improved Implicit Hate Speech Detection
par: Kim, Yumin, et autres
Publié: (2025)
par: Kim, Yumin, et autres
Publié: (2025)
VLind-Bench: Measuring Language Priors in Large Vision-Language Models
par: Lee, Kang-il, et autres
Publié: (2024)
par: Lee, Kang-il, et autres
Publié: (2024)
ReflAct: World-Grounded Decision Making in LLM Agents via Goal-State Reflection
par: Kim, Jeonghye, et autres
Publié: (2025)
par: Kim, Jeonghye, et autres
Publié: (2025)
Tox-BART: Leveraging Toxicity Attributes for Explanation Generation of Implicit Hate Speech
par: Yadav, Neemesh, et autres
Publié: (2024)
par: Yadav, Neemesh, et autres
Publié: (2024)
OPAL: Outlier-Preserved Microscaling Quantization Accelerator for Generative Large Language Models
par: Koo, Jahyun, et autres
Publié: (2024)
par: Koo, Jahyun, et autres
Publié: (2024)
Conversational Query Reformulation with the Guidance of Retrieved Documents
par: Park, Jeonghyun, et autres
Publié: (2024)
par: Park, Jeonghyun, et autres
Publié: (2024)
Investigating Language Preference of Multilingual RAG Systems
par: Park, Jeonghyun, et autres
Publié: (2025)
par: Park, Jeonghyun, et autres
Publié: (2025)
Alignment Data Map for Efficient Preference Data Selection and Diagnosis
par: Lee, Seohyeong, et autres
Publié: (2025)
par: Lee, Seohyeong, et autres
Publié: (2025)
Fine-grained Gender Control in Machine Translation with Large Language Models
par: Lee, Minwoo, et autres
Publié: (2024)
par: Lee, Minwoo, et autres
Publié: (2024)
Chronological Passage Assembling in RAG framework for Temporal Question Answering
par: Kim, Byeongjeong, et autres
Publié: (2025)
par: Kim, Byeongjeong, et autres
Publié: (2025)
Enhancing Multilingual RAG Systems with Debiased Language Preference-Guided Query Fusion
par: Park, Jeonghyun, et autres
Publié: (2026)
par: Park, Jeonghyun, et autres
Publié: (2026)
Low-Resource Cross-Lingual Summarization through Few-Shot Learning with Large Language Models
par: Park, Gyutae, et autres
Publié: (2024)
par: Park, Gyutae, et autres
Publié: (2024)
ToDi: Token-wise Distillation via Fine-Grained Divergence Control
par: Jung, Seongryong, et autres
Publié: (2025)
par: Jung, Seongryong, et autres
Publié: (2025)
Beyond One Path: Evaluating and Enhancing Divergent Thinking in Interactive LLM Agents
par: Park, Jihyeong, et autres
Publié: (2026)
par: Park, Jihyeong, et autres
Publié: (2026)
Exploring Persona Sentiment Sensitivity in Personalized Dialogue Generation
par: Jun, Yonghyun, et autres
Publié: (2025)
par: Jun, Yonghyun, et autres
Publié: (2025)
Dynamic Order Template Prediction for Generative Aspect-Based Sentiment Analysis
par: Jun, Yonghyun, et autres
Publié: (2024)
par: Jun, Yonghyun, et autres
Publié: (2024)
Which Retain Set Matters for LLM Unlearning? A Case Study on Entity Unlearning
par: Chang, Hwan, et autres
Publié: (2025)
par: Chang, Hwan, et autres
Publié: (2025)
Confidence-Guided Stepwise Model Routing for Cost-Efficient Reasoning
par: Lee, Sangmook, et autres
Publié: (2025)
par: Lee, Sangmook, et autres
Publié: (2025)
Can You Trick the Grader? Adversarial Persuasion of LLM Judges
par: Hwang, Yerin, et autres
Publié: (2025)
par: Hwang, Yerin, et autres
Publié: (2025)
ReflectCAP: Detailed Image Captioning with Reflective Memory
par: Min, Kyungmin, et autres
Publié: (2026)
par: Min, Kyungmin, et autres
Publié: (2026)
Persona Switch: Mixing Distinct Perspectives in Decoding Time
par: Kim, Junseok, et autres
Publié: (2026)
par: Kim, Junseok, et autres
Publié: (2026)
Persona is a Double-edged Sword: Mitigating the Negative Impact of Role-playing Prompts in Zero-shot Reasoning Tasks
par: Kim, Junseok, et autres
Publié: (2024)
par: Kim, Junseok, et autres
Publié: (2024)
LongStory: Coherent, Complete and Length Controlled Long story Generation
par: Park, Kyeongman, et autres
Publié: (2023)
par: Park, Kyeongman, et autres
Publié: (2023)
Avoidance Decoding for Diverse Multi-Branch Story Generation
par: Park, Kyeongman, et autres
Publié: (2025)
par: Park, Kyeongman, et autres
Publié: (2025)
A Universal Avoidance Method for Diverse Multi-branch Generation
par: Park, Kyeongman, et autres
Publié: (2026)
par: Park, Kyeongman, et autres
Publié: (2026)
MAQA: Evaluating Uncertainty Quantification in LLMs Regarding Data Uncertainty
par: Yang, Yongjin, et autres
Publié: (2024)
par: Yang, Yongjin, et autres
Publié: (2024)
Code-Switching Red-Teaming: LLM Evaluation for Safety and Multilingual Understanding
par: Yoo, Haneul, et autres
Publié: (2024)
par: Yoo, Haneul, et autres
Publié: (2024)
ToxSearch: Evolving Prompts for Toxicity Search in Large Language Models
par: Shelar, Onkar, et autres
Publié: (2025)
par: Shelar, Onkar, et autres
Publié: (2025)
Documents similaires
-
AdvisorQA: Towards Helpful and Harmless Advice-seeking Question Answering with Collective Intelligence
par: Kim, Minbeom, et autres
Publié: (2024) -
Drift: Decoding-time Personalized Alignments with Implicit User Preferences
par: Kim, Minbeom, et autres
Publié: (2025) -
Program Synthesis via Test-Time Transduction
par: Lee, Kang-il, et autres
Publié: (2025) -
Guaranteed Generation from Large Language Models
par: Kim, Minbeom, et autres
Publié: (2024) -
A Character-Centric Creative Story Generation via Imagination
par: Park, Kyeongman, et autres
Publié: (2024)