When in Doubt, Consult: Expert Debate for Sexism Detection via Confidence-Based Routing
Fuente:
arXiv
Salvato in:
| Autori principali: | Alajmi, Anwar, Pergola, Gabriele |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Explaining Matters: Leveraging Definitions and Semantic Expansion for Sexism Detection
di: Khan, Sahrish, et al.
Pubblicazione: (2025)
di: Khan, Sahrish, et al.
Pubblicazione: (2025)
Dataset Creation and Baseline Models for Sexism Detection in Hausa
di: Muhammad, Fatima Adam, et al.
Pubblicazione: (2025)
di: Muhammad, Fatima Adam, et al.
Pubblicazione: (2025)
Rewarding Doubt: A Reinforcement Learning Approach to Calibrated Confidence Expression of Large Language Models
di: Bani-Harouni, David, et al.
Pubblicazione: (2025)
di: Bani-Harouni, David, et al.
Pubblicazione: (2025)
Shared Doubt: Zero-shot Cross-Lingual Confidence Estimation for Language Models
di: Kyriakou, Athina, et al.
Pubblicazione: (2026)
di: Kyriakou, Athina, et al.
Pubblicazione: (2026)
Beyond Binary Classification: Detecting Fine-Grained Sexism in Social Media Videos
di: De Grazia, Laura, et al.
Pubblicazione: (2026)
di: De Grazia, Laura, et al.
Pubblicazione: (2026)
An Expert is Worth One Token: Synergizing Multiple Expert LLMs as Generalist via Expert Token Routing
di: Chai, Ziwei, et al.
Pubblicazione: (2024)
di: Chai, Ziwei, et al.
Pubblicazione: (2024)
Cascading Large Language Models for Salient Event Graph Generation
di: Tan, Xingwei, et al.
Pubblicazione: (2024)
di: Tan, Xingwei, et al.
Pubblicazione: (2024)
ExDDI: Explaining Drug-Drug Interaction Predictions with Natural Language
di: Sun, Zhaoyue, et al.
Pubblicazione: (2024)
di: Sun, Zhaoyue, et al.
Pubblicazione: (2024)
MuSeD: A Multimodal Spanish Dataset for Sexism Detection in Social Media Videos
di: De Grazia, Laura, et al.
Pubblicazione: (2025)
di: De Grazia, Laura, et al.
Pubblicazione: (2025)
Express Your Doubts -- Probabilistic World Modeling Should not be Based on Token logprobs
di: Wagner, Eitan, et al.
Pubblicazione: (2025)
di: Wagner, Eitan, et al.
Pubblicazione: (2025)
Small Updates, Big Doubts: Does Parameter-Efficient Fine-tuning Enhance Hallucination Detection ?
di: Hu, Xu, et al.
Pubblicazione: (2026)
di: Hu, Xu, et al.
Pubblicazione: (2026)
Mapping Clinical Doubt: Locating Linguistic Uncertainty in LLMs
di: Sridhar, Srivarshinee, et al.
Pubblicazione: (2025)
di: Sridhar, Srivarshinee, et al.
Pubblicazione: (2025)
Routing by Analogy: kNN-Augmented Expert Assignment for Mixture-of-Experts
di: Lyu, Boxuan, et al.
Pubblicazione: (2026)
di: Lyu, Boxuan, et al.
Pubblicazione: (2026)
When Quantization Affects Confidence of Large Language Models?
di: Proskurina, Irina, et al.
Pubblicazione: (2024)
di: Proskurina, Irina, et al.
Pubblicazione: (2024)
Learning to Route LLMs with Confidence Tokens
di: Chuang, Yu-Neng, et al.
Pubblicazione: (2024)
di: Chuang, Yu-Neng, et al.
Pubblicazione: (2024)
When to Trust Context: Self-Reflective Debates for Context Reliability
di: Zhou, Zeqi, et al.
Pubblicazione: (2025)
di: Zhou, Zeqi, et al.
Pubblicazione: (2025)
Skill-Based Mixture-of-Experts: Adaptive Routing for Heterogeneous Reasoning via Inferred Skills
di: Chen, Justin Chih-Yao, et al.
Pubblicazione: (2025)
di: Chen, Justin Chih-Yao, et al.
Pubblicazione: (2025)
Debate-to-Detect: Reformulating Misinformation Detection as a Real-World Debate with Large Language Models
di: Han, Chen, et al.
Pubblicazione: (2025)
di: Han, Chen, et al.
Pubblicazione: (2025)
When Weak LLMs Speak with Confidence, Preference Alignment Gets Stronger
di: Afzali, Amirabbas, et al.
Pubblicazione: (2026)
di: Afzali, Amirabbas, et al.
Pubblicazione: (2026)
Multilingual Routing in Mixture-of-Experts
di: Bandarkar, Lucas, et al.
Pubblicazione: (2025)
di: Bandarkar, Lucas, et al.
Pubblicazione: (2025)
Routing-Free Mixture-of-Experts
di: Liu, Yilun, et al.
Pubblicazione: (2026)
di: Liu, Yilun, et al.
Pubblicazione: (2026)
Cognitive Decision Routing in Large Language Models: When to Think Fast, When to Think Slow
di: Du, Y., et al.
Pubblicazione: (2025)
di: Du, Y., et al.
Pubblicazione: (2025)
COTCAgent: Preventive Consultation via Probabilistic Chain-of-Thought Completion
di: Deng, Zihan, et al.
Pubblicazione: (2026)
di: Deng, Zihan, et al.
Pubblicazione: (2026)
Confident or Seek Stronger: Exploring Uncertainty-Based On-device LLM Routing From Benchmarking to Generalization
di: Chuang, Yu-Neng, et al.
Pubblicazione: (2025)
di: Chuang, Yu-Neng, et al.
Pubblicazione: (2025)
LD-MoLE: Learnable Dynamic Routing for Mixture of LoRA Experts
di: Zhuang, Yuan, et al.
Pubblicazione: (2025)
di: Zhuang, Yuan, et al.
Pubblicazione: (2025)
Cosine-Similarity Routing with Semantic Anchors for Interpretable Mixture-of-Experts Language Models
di: Ternovtsii, Ivan, et al.
Pubblicazione: (2025)
di: Ternovtsii, Ivan, et al.
Pubblicazione: (2025)
Routing-Aligned Fine-Tuning for Multilingual Downstream Tasks in Mixture-of-Experts Models
di: Deng, Guanzhi, et al.
Pubblicazione: (2026)
di: Deng, Guanzhi, et al.
Pubblicazione: (2026)
Knowledge Graph Error Detection with Contrastive Confidence Adaption
di: Liu, Xiangyu, et al.
Pubblicazione: (2023)
di: Liu, Xiangyu, et al.
Pubblicazione: (2023)
Expert Threshold Routing for Autoregressive Language Modeling with Dynamic Computation Allocation and Load Balancing
di: Sun, Hanchi, et al.
Pubblicazione: (2026)
di: Sun, Hanchi, et al.
Pubblicazione: (2026)
Probing Semantic Routing in Large Mixture-of-Expert Models
di: Olson, Matthew Lyle, et al.
Pubblicazione: (2025)
di: Olson, Matthew Lyle, et al.
Pubblicazione: (2025)
Beyond Spurious Signals: Debiasing Multimodal Large Language Models via Counterfactual Inference and Adaptive Expert Routing
di: Wu, Zichen, et al.
Pubblicazione: (2025)
di: Wu, Zichen, et al.
Pubblicazione: (2025)
The First Token Knows: Single-Decode Confidence for Hallucination Detection
di: Gabriel, Mina
Pubblicazione: (2026)
di: Gabriel, Mina
Pubblicazione: (2026)
Consultant Decoding: Yet Another Synergistic Mechanism
di: Ding, Chuanghao, et al.
Pubblicazione: (2025)
di: Ding, Chuanghao, et al.
Pubblicazione: (2025)
Confidence-Aware Routing for Large Language Model Reliability Enhancement: A Multi-Signal Approach to Pre-Generation Hallucination Mitigation
di: M, Nandakishor
Pubblicazione: (2025)
di: M, Nandakishor
Pubblicazione: (2025)
A Role-specific Guided Large Language Model for Ophthalmic Consultation Based on Stylistic Differentiation
di: Fu, Laiyi, et al.
Pubblicazione: (2024)
di: Fu, Laiyi, et al.
Pubblicazione: (2024)
FHSTP@EXIST 2025 Benchmark: Sexism Detection with Transparent Speech Concept Bottleneck Models
di: Labadie-Tamayo, Roberto, et al.
Pubblicazione: (2025)
di: Labadie-Tamayo, Roberto, et al.
Pubblicazione: (2025)
Confidence Estimation for LLM-Based Dialogue State Tracking
di: Sun, Yi-Jyun, et al.
Pubblicazione: (2024)
di: Sun, Yi-Jyun, et al.
Pubblicazione: (2024)
When Two LLMs Debate, Both Think They'll Win
di: Prasad, Pradyumna Shyama, et al.
Pubblicazione: (2025)
di: Prasad, Pradyumna Shyama, et al.
Pubblicazione: (2025)
Leave It to the Experts: Detecting Knowledge Distillation via MoE Expert Signatures
di: Li, Pingzhi, et al.
Pubblicazione: (2025)
di: Li, Pingzhi, et al.
Pubblicazione: (2025)
DDO: Dual-Decision Optimization for LLM-Based Medical Consultation via Multi-Agent Collaboration
di: Jia, Zhihao, et al.
Pubblicazione: (2025)
di: Jia, Zhihao, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Explaining Matters: Leveraging Definitions and Semantic Expansion for Sexism Detection
di: Khan, Sahrish, et al.
Pubblicazione: (2025) -
Dataset Creation and Baseline Models for Sexism Detection in Hausa
di: Muhammad, Fatima Adam, et al.
Pubblicazione: (2025) -
Rewarding Doubt: A Reinforcement Learning Approach to Calibrated Confidence Expression of Large Language Models
di: Bani-Harouni, David, et al.
Pubblicazione: (2025) -
Shared Doubt: Zero-shot Cross-Lingual Confidence Estimation for Language Models
di: Kyriakou, Athina, et al.
Pubblicazione: (2026) -
Beyond Binary Classification: Detecting Fine-Grained Sexism in Social Media Videos
di: De Grazia, Laura, et al.
Pubblicazione: (2026)