Right Prediction, Wrong Reasoning: Uncovering LLM Misalignment in RA Disease Diagnosis
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Maharana, Umakanta, Verma, Sarthak, Agarwal, Avarna, Mruthyunjaya, Prakashini, Mahapatra, Dwarikanath, Ahmed, Sakir, Mandal, Murari |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Short‐Term Effectiveness of Sulfasalazine and Tofacitinib in NSAID ‐Refractory Reactive Arthritis: An Observational Study
par: Prakashini Mruthyunjaya, et autres
Publié: (2025)
par: Prakashini Mruthyunjaya, et autres
Publié: (2025)
Investigating Pedagogical Teacher and Student LLM Agents: Genetic Adaptation Meets Retrieval Augmented Generation Across Learning Style
par: Sanyal, Debdeep, et autres
Publié: (2025)
par: Sanyal, Debdeep, et autres
Publié: (2025)
Update on Takayasu arteritis: Year in review 2024
par: Prakashini Mruthyunjaya, et autres
Publié: (2024)
par: Prakashini Mruthyunjaya, et autres
Publié: (2024)
OrgAccess: A Benchmark for Role Based Access Control in Organization Scale LLMs
par: Sanyal, Debdeep, et autres
Publié: (2025)
par: Sanyal, Debdeep, et autres
Publié: (2025)
Agents Are All You Need for LLM Unlearning
par: Sanyal, Debdeep, et autres
Publié: (2025)
par: Sanyal, Debdeep, et autres
Publié: (2025)
The Realignment Problem: When Right becomes Wrong in LLMs
par: Sharma, Aakash Sen, et autres
Publié: (2025)
par: Sharma, Aakash Sen, et autres
Publié: (2025)
UnStar: Unlearning with Self-Taught Anti-Sample Reasoning for LLMs
par: Sinha, Yash, et autres
Publié: (2024)
par: Sinha, Yash, et autres
Publié: (2024)
LLM-as-a-Judge for Time Series Explanations
par: Sivalingam, Preetham, et autres
Publié: (2026)
par: Sivalingam, Preetham, et autres
Publié: (2026)
Stride-Net: Fairness-Aware Disentangled Representation Learning for Chest X-Ray Diagnosis
par: Rashid, Darakshan, et autres
Publié: (2026)
par: Rashid, Darakshan, et autres
Publié: (2026)
LLM driven Text-to-Table Generation through Sub-Tasks Guidance and Iterative Refinement
par: C, Rajmohan, et autres
Publié: (2025)
par: C, Rajmohan, et autres
Publié: (2025)
Right Looks, Wrong Reasons: Compositional Fidelity in Text-to-Image Generation
par: Vatsa, Mayank, et autres
Publié: (2025)
par: Vatsa, Mayank, et autres
Publié: (2025)
Time-RA: Towards Time Series Reasoning for Anomaly Diagnosis with LLM Feedback
par: Yang, Yiyuan, et autres
Publié: (2025)
par: Yang, Yiyuan, et autres
Publié: (2025)
One Model, Many Morals: Uncovering Cross-Linguistic Misalignments in Computational Moral Reasoning
par: Farid, Sualeha, et autres
Publié: (2025)
par: Farid, Sualeha, et autres
Publié: (2025)
Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models
par: Sinha, Yash, et autres
Publié: (2025)
par: Sinha, Yash, et autres
Publié: (2025)
DiMPLe -- Disentangled Multi-Modal Prompt Learning: Enhancing Out-Of-Distribution Alignment with Invariant and Spurious Feature Separation
par: Rahman, Umaima, et autres
Publié: (2025)
par: Rahman, Umaima, et autres
Publié: (2025)
Wrong Code, Right Structure: Learning Netlist Representations from Imperfect LLM-Generated RTL
par: Cai, Siyang, et autres
Publié: (2026)
par: Cai, Siyang, et autres
Publié: (2026)
Residual Connections and the Causal Shift: Uncovering a Structural Misalignment in Transformers
par: Lys, Jonathan, et autres
Publié: (2026)
par: Lys, Jonathan, et autres
Publié: (2026)
Perplexity Cannot Always Tell Right from Wrong
par: Veličković, Petar, et autres
Publié: (2026)
par: Veličković, Petar, et autres
Publié: (2026)
How to Trick Your AI TA: A Systematic Study of Academic Jailbreaking in LLM Code Evaluation
par: Sahoo, Devanshu, et autres
Publié: (2025)
par: Sahoo, Devanshu, et autres
Publié: (2025)
Forgetting is Competition: Rethinking Unlearning as Representation Interference in Diffusion Models
par: Ranjan, Ashutosh, et autres
Publié: (2026)
par: Ranjan, Ashutosh, et autres
Publié: (2026)
Thinking Fast, Thinking Wrong: Intuitiveness Modulates LLM Counterfactual Reasoning in Policy Evaluation
par: He, Yanjie
Publié: (2026)
par: He, Yanjie
Publié: (2026)
FedRot-LoRA: Mitigating Rotational Misalignment in Federated LoRA
par: Zhang, Haoran, et autres
Publié: (2026)
par: Zhang, Haoran, et autres
Publié: (2026)
Right Answer, Wrong Score: Uncovering the Inconsistencies of LLM Evaluation in Multiple-Choice Question Answering
par: Molfese, Francesco Maria, et autres
Publié: (2025)
par: Molfese, Francesco Maria, et autres
Publié: (2025)
Triple-Stream Deep Feature Selection with Metaheuristic Optimization and Machine Learning for Multi-Stage Hypertensive Retinopathy Diagnosis
par: Suyun, Suleyman Burcin, et autres
Publié: (2025)
par: Suyun, Suleyman Burcin, et autres
Publié: (2025)
Unlocking Futures: A Natural Language Driven Career Prediction System for Computer Science and Software Engineering Students
par: Faruque, Sakir Hossain, et autres
Publié: (2024)
par: Faruque, Sakir Hossain, et autres
Publié: (2024)
Uncovering Hidden Correctness in LLM Causal Reasoning via Symbolic Verification
par: He, Paul, et autres
Publié: (2026)
par: He, Paul, et autres
Publié: (2026)
ProofNet++: A Neuro-Symbolic System for Formal Proof Verification with Self-Correction
par: Ambati, Murari
Publié: (2025)
par: Ambati, Murari
Publié: (2025)
Analyzing LLM Reasoning to Uncover Mental Health Stigma
par: Sankar, Sreehari, et autres
Publié: (2026)
par: Sankar, Sreehari, et autres
Publié: (2026)
When Right Meets Wrong: Bilateral Context Conditioning with Reward-Confidence Correction for GRPO
par: Li, Yu, et autres
Publié: (2026)
par: Li, Yu, et autres
Publié: (2026)
The Confidence Paradox: Can LLM Know When It's Wrong
par: Tripathi, Sahil, et autres
Publié: (2025)
par: Tripathi, Sahil, et autres
Publié: (2025)
HiCoLoRA: Addressing Context-Prompt Misalignment via Hierarchical Collaborative LoRA for Zero-Shot DST
par: Zhang, Shuyu, et autres
Publié: (2025)
par: Zhang, Shuyu, et autres
Publié: (2025)
An Enhanced YOLOv8 Model for Real-Time and Accurate Pothole Detection and Measurement
par: Yurdakul, Mustafa, et autres
Publié: (2025)
par: Yurdakul, Mustafa, et autres
Publié: (2025)
MRI-Based Brain Tumor Detection through an Explainable EfficientNetV2 and MLP-Mixer-Attention Architecture
par: Yurdakul, Mustafa, et autres
Publié: (2025)
par: Yurdakul, Mustafa, et autres
Publié: (2025)
CoAtNeXt:An Attention-Enhanced ConvNeXtV2-Transformer Hybrid Model for Gastric Tissue Classification
par: Yurdakul, Mustafa, et autres
Publié: (2025)
par: Yurdakul, Mustafa, et autres
Publié: (2025)
Answering the Wrong Question: Reasoning Trace Inversion for Abstention in LLMs
par: Gourabathina, Abinitha, et autres
Publié: (2026)
par: Gourabathina, Abinitha, et autres
Publié: (2026)
PopuLoRA: Co-Evolving LLM Populations for Reasoning Self-Play
par: Castanyer, Roger Creus, et autres
Publié: (2026)
par: Castanyer, Roger Creus, et autres
Publié: (2026)
Correct Chains, Wrong Answers: Dissociating Reasoning from Output in LLM Logic
par: Rao, Abinav, et autres
Publié: (2026)
par: Rao, Abinav, et autres
Publié: (2026)
Align to Misalign: Automatic LLM Jailbreak with Meta-Optimized LLM Judges
par: Koo, Hamin, et autres
Publié: (2025)
par: Koo, Hamin, et autres
Publié: (2025)
What Work is AI Actually Doing? Uncovering the Drivers of Generative AI Adoption
par: Agarwal, Peeyush, et autres
Publié: (2025)
par: Agarwal, Peeyush, et autres
Publié: (2025)
I Am Big, You Are Little; I Am Right, You Are Wrong
par: Kelly, David A., et autres
Publié: (2025)
par: Kelly, David A., et autres
Publié: (2025)
Documents similaires
-
Short‐Term Effectiveness of Sulfasalazine and Tofacitinib in NSAID ‐Refractory Reactive Arthritis: An Observational Study
par: Prakashini Mruthyunjaya, et autres
Publié: (2025) -
Investigating Pedagogical Teacher and Student LLM Agents: Genetic Adaptation Meets Retrieval Augmented Generation Across Learning Style
par: Sanyal, Debdeep, et autres
Publié: (2025) -
Update on Takayasu arteritis: Year in review 2024
par: Prakashini Mruthyunjaya, et autres
Publié: (2024) -
OrgAccess: A Benchmark for Role Based Access Control in Organization Scale LLMs
par: Sanyal, Debdeep, et autres
Publié: (2025) -
Agents Are All You Need for LLM Unlearning
par: Sanyal, Debdeep, et autres
Publié: (2025)