Modeling and Predicting Multi-Turn Answer Instability in Large Language Models
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | He, Jiahang, Ramachandran, Rishi, Ramachandran, Neel, Katakam, Aryan, Zhu, Kevin, Dev, Sunishchal, Panda, Ashwinee, Shrivastava, Aryan |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Linearly Decoding Refused Knowledge in Aligned Language Models
von: Shrivastava, Aryan, et al.
Veröffentlicht: (2025)
von: Shrivastava, Aryan, et al.
Veröffentlicht: (2025)
DICE: A Framework for Dimensional and Contextual Evaluation of Language Models
von: Shrivastava, Aryan, et al.
Veröffentlicht: (2025)
von: Shrivastava, Aryan, et al.
Veröffentlicht: (2025)
Refusal Tokens: A Simple Way to Calibrate Refusals in Large Language Models
von: Jain, Neel, et al.
Veröffentlicht: (2024)
von: Jain, Neel, et al.
Veröffentlicht: (2024)
Measuring Free-Form Decision-Making Inconsistency of Language Models in Military Crisis Simulations
von: Shrivastava, Aryan, et al.
Veröffentlicht: (2024)
von: Shrivastava, Aryan, et al.
Veröffentlicht: (2024)
Advancing Reasoning in Large Language Models: Promising Methods and Approaches
von: Patil, Avinash, et al.
Veröffentlicht: (2025)
von: Patil, Avinash, et al.
Veröffentlicht: (2025)
Resource-Aware Arabic LLM Creation: Model Adaptation, Integration, and Multi-Domain Testing
von: Aryan, Prakash
Veröffentlicht: (2024)
von: Aryan, Prakash
Veröffentlicht: (2024)
SALT: Steering Activations towards Leakage-free Thinking in Chain of Thought
von: Batra, Shourya, et al.
Veröffentlicht: (2025)
von: Batra, Shourya, et al.
Veröffentlicht: (2025)
Structure First, Reason Next: Enhancing a Large Language Model using Knowledge Graph for Numerical Reasoning in Financial Documents
von: Mishra, Aryan, et al.
Veröffentlicht: (2026)
von: Mishra, Aryan, et al.
Veröffentlicht: (2026)
Causal Reflection with Language Models
von: Aryan, Abi, et al.
Veröffentlicht: (2025)
von: Aryan, Abi, et al.
Veröffentlicht: (2025)
A Comparative Study of Translation Bias and Accuracy in Multilingual Large Language Models for Cross-Language Claim Verification
von: Singhal, Aryan, et al.
Veröffentlicht: (2024)
von: Singhal, Aryan, et al.
Veröffentlicht: (2024)
Adapting Biomedical Abstracts into Plain language using Large Language Models
von: Gangavarapu, Haritha, et al.
Veröffentlicht: (2025)
von: Gangavarapu, Haritha, et al.
Veröffentlicht: (2025)
AbsenceBench: Language Models Can't Tell What's Missing
von: Fu, Harvey Yiyun, et al.
Veröffentlicht: (2025)
von: Fu, Harvey Yiyun, et al.
Veröffentlicht: (2025)
Emergent Misalignment via In-Context Learning: Narrow in-context examples can produce broadly misaligned LLMs
von: Afonin, Nikita, et al.
Veröffentlicht: (2025)
von: Afonin, Nikita, et al.
Veröffentlicht: (2025)
English Please: Evaluating Machine Translation with Large Language Models for Multilingual Bug Reports
von: Patil, Avinash, et al.
Veröffentlicht: (2025)
von: Patil, Avinash, et al.
Veröffentlicht: (2025)
Private Fine-tuning of Large Language Models with Zeroth-order Optimization
von: Tang, Xinyu, et al.
Veröffentlicht: (2024)
von: Tang, Xinyu, et al.
Veröffentlicht: (2024)
Large Language Models aren't all that you need
von: Holla, Kiran Voderhobli, et al.
Veröffentlicht: (2024)
von: Holla, Kiran Voderhobli, et al.
Veröffentlicht: (2024)
Signal or Noise? Evaluating Large Language Models in Resume Screening Across Contextual Variations and Human Expert Benchmarks
von: Varshney, Aryan, et al.
Veröffentlicht: (2025)
von: Varshney, Aryan, et al.
Veröffentlicht: (2025)
AI Based Font Pair Suggestion Modelling For Graphic Design
von: Singh, Aryan, et al.
Veröffentlicht: (2025)
von: Singh, Aryan, et al.
Veröffentlicht: (2025)
Know Thyself? On the Incapability and Implications of AI Self-Recognition
von: Bai, Xiaoyan, et al.
Veröffentlicht: (2025)
von: Bai, Xiaoyan, et al.
Veröffentlicht: (2025)
Multi-Token Prediction via Self-Distillation
von: Kirchenbauer, John, et al.
Veröffentlicht: (2026)
von: Kirchenbauer, John, et al.
Veröffentlicht: (2026)
Same Evidence, Different Answers: Canonical-Context On-Policy Distillation for Multi-Turn Language Models
von: Lin, Zizhuo, et al.
Veröffentlicht: (2026)
von: Lin, Zizhuo, et al.
Veröffentlicht: (2026)
Grounded Concreteness: Human-Like Concreteness Sensitivity in Vision-Language Models
von: Roy, Aryan, et al.
Veröffentlicht: (2026)
von: Roy, Aryan, et al.
Veröffentlicht: (2026)
Investigating Spatial Attention Bias in Vision-Language Models
von: Chaudhary, Aryan, et al.
Veröffentlicht: (2025)
von: Chaudhary, Aryan, et al.
Veröffentlicht: (2025)
Visualizing and Benchmarking LLM Factual Hallucination Tendencies via Internal State Analysis and Clustering
von: Mao, Nathan, et al.
Veröffentlicht: (2026)
von: Mao, Nathan, et al.
Veröffentlicht: (2026)
TurnBench-MS: A Benchmark for Evaluating Multi-Turn, Multi-Step Reasoning in Large Language Models
von: Zhang, Yiran, et al.
Veröffentlicht: (2025)
von: Zhang, Yiran, et al.
Veröffentlicht: (2025)
Is Training Data Quality or Quantity More Impactful to Small Language Model Performance?
von: Sajith, Aryan, et al.
Veröffentlicht: (2024)
von: Sajith, Aryan, et al.
Veröffentlicht: (2024)
Alignment-Constrained Dynamic Pruning for LLMs: Identifying and Preserving Alignment-Critical Circuits
von: Patel, Dev, et al.
Veröffentlicht: (2025)
von: Patel, Dev, et al.
Veröffentlicht: (2025)
LLMs as Debate Partners: Utilizing Genetic Algorithms and Adversarial Search for Adaptive Arguments
von: Aryan, Prakash
Veröffentlicht: (2024)
von: Aryan, Prakash
Veröffentlicht: (2024)
Illuminate: A novel approach for depression detection with explainable analysis and proactive therapy using prompt engineering
von: Agrawal, Aryan
Veröffentlicht: (2024)
von: Agrawal, Aryan
Veröffentlicht: (2024)
TRUTH DECAY: Quantifying Multi-Turn Sycophancy in Language Models
von: Liu, Joshua, et al.
Veröffentlicht: (2025)
von: Liu, Joshua, et al.
Veröffentlicht: (2025)
COMPASS: Context-Modulated PID Attention Steering System for Hallucination Mitigation
von: Sahay, Kenji, et al.
Veröffentlicht: (2025)
von: Sahay, Kenji, et al.
Veröffentlicht: (2025)
DebateBench: A Challenging Long Context Reasoning Benchmark For Large Language Models
von: Tiwari, Utkarsh, et al.
Veröffentlicht: (2025)
von: Tiwari, Utkarsh, et al.
Veröffentlicht: (2025)
The Text Uncanny Valley: Non-Monotonic Performance Degradation in LLM Information Retrieval
von: Tong, Zekai, et al.
Veröffentlicht: (2026)
von: Tong, Zekai, et al.
Veröffentlicht: (2026)
LoRI: Reducing Cross-Task Interference in Multi-Task Low-Rank Adaptation
von: Zhang, Juzheng, et al.
Veröffentlicht: (2025)
von: Zhang, Juzheng, et al.
Veröffentlicht: (2025)
Amortized Latent Steering: Low-Cost Alternative to Test-Time Optimization
von: Egbuna, Nathan, et al.
Veröffentlicht: (2025)
von: Egbuna, Nathan, et al.
Veröffentlicht: (2025)
The Chameleon Nature of LLMs: Quantifying Multi-Turn Stance Instability in Search-Enabled Language Models
von: Ratnakar, Shivam, et al.
Veröffentlicht: (2025)
von: Ratnakar, Shivam, et al.
Veröffentlicht: (2025)
Mem0: Building Production-Ready AI Agents with Scalable Long-Term Memory
von: Chhikara, Prateek, et al.
Veröffentlicht: (2025)
von: Chhikara, Prateek, et al.
Veröffentlicht: (2025)
Teach LLMs to Phish: Stealing Private Information from Language Models
von: Panda, Ashwinee, et al.
Veröffentlicht: (2024)
von: Panda, Ashwinee, et al.
Veröffentlicht: (2024)
Question: How do Large Language Models perform on the Question Answering tasks? Answer:
von: Fischer, Kevin, et al.
Veröffentlicht: (2024)
von: Fischer, Kevin, et al.
Veröffentlicht: (2024)
Align to Structure: Aligning Large Language Models with Structural Information
von: Kim, Zae Myung, et al.
Veröffentlicht: (2025)
von: Kim, Zae Myung, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Linearly Decoding Refused Knowledge in Aligned Language Models
von: Shrivastava, Aryan, et al.
Veröffentlicht: (2025) -
DICE: A Framework for Dimensional and Contextual Evaluation of Language Models
von: Shrivastava, Aryan, et al.
Veröffentlicht: (2025) -
Refusal Tokens: A Simple Way to Calibrate Refusals in Large Language Models
von: Jain, Neel, et al.
Veröffentlicht: (2024) -
Measuring Free-Form Decision-Making Inconsistency of Language Models in Military Crisis Simulations
von: Shrivastava, Aryan, et al.
Veröffentlicht: (2024) -
Advancing Reasoning in Large Language Models: Promising Methods and Approaches
von: Patil, Avinash, et al.
Veröffentlicht: (2025)