Delusions of Large Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Xu, Hongshen, yang, Zixv, Zhu, Zichen, Lan, Kunyao, Wang, Zihan, Wu, Mengyue, Ji, Ziwei, Chen, Lu, Fung, Pascale, Yu, Kai |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Enhancing LLM Reliability via Explicit Knowledge Boundary Modeling
di: Zheng, Hang, et al.
Pubblicazione: (2025)
di: Zheng, Hang, et al.
Pubblicazione: (2025)
Towards Reliable and Empathetic Depression-Diagnosis-Oriented Chats
di: Lan, Kunyao, et al.
Pubblicazione: (2024)
di: Lan, Kunyao, et al.
Pubblicazione: (2024)
Alignment for Efficient Tool Calling of Large Language Models
di: Xu, Hongshen, et al.
Pubblicazione: (2025)
di: Xu, Hongshen, et al.
Pubblicazione: (2025)
AdaEAGLE: Optimizing Speculative Decoding via Explicit Modeling of Adaptive Draft Structures
di: Zhang, Situo, et al.
Pubblicazione: (2024)
di: Zhang, Situo, et al.
Pubblicazione: (2024)
Depression Diagnosis Dialogue Simulation: Self-improving Psychiatrist with Tertiary Memory
di: Lan, Kunyao, et al.
Pubblicazione: (2024)
di: Lan, Kunyao, et al.
Pubblicazione: (2024)
High-Dimension Human Value Representation in Large Language Models
di: Cahyawijaya, Samuel, et al.
Pubblicazione: (2024)
di: Cahyawijaya, Samuel, et al.
Pubblicazione: (2024)
From Medical Records to Diagnostic Dialogues: A Clinical-Grounded Approach and Dataset for Psychiatric Comorbidity
di: Wan, Tianxi, et al.
Pubblicazione: (2025)
di: Wan, Tianxi, et al.
Pubblicazione: (2025)
Multilingual Brain Surgeon: Large Language Models Can be Compressed Leaving No Language Behind
di: Zeng, Hongchuan, et al.
Pubblicazione: (2024)
di: Zeng, Hongchuan, et al.
Pubblicazione: (2024)
Measuring Political Bias in Large Language Models: What Is Said and How It Is Said
di: Bang, Yejin, et al.
Pubblicazione: (2024)
di: Bang, Yejin, et al.
Pubblicazione: (2024)
A Diverse and Effective Retrieval-Based Debt Collection System with Expert Knowledge
di: Luo, Jiaming, et al.
Pubblicazione: (2025)
di: Luo, Jiaming, et al.
Pubblicazione: (2025)
Hierarchical Multimodal Pre-training for Visually Rich Webpage Understanding
di: Xu, Hongshen, et al.
Pubblicazione: (2024)
di: Xu, Hongshen, et al.
Pubblicazione: (2024)
MobA: Multifaceted Memory-Enhanced Adaptive Planning for Efficient Mobile Task Automation
di: Zhu, Zichen, et al.
Pubblicazione: (2024)
di: Zhu, Zichen, et al.
Pubblicazione: (2024)
ANAH: Analytical Annotation of Hallucinations in Large Language Models
di: Ji, Ziwei, et al.
Pubblicazione: (2024)
di: Ji, Ziwei, et al.
Pubblicazione: (2024)
Evolving Subnetwork Training for Large Language Models
di: Li, Hanqi, et al.
Pubblicazione: (2024)
di: Li, Hanqi, et al.
Pubblicazione: (2024)
LLMs Are Few-Shot In-Context Low-Resource Language Learners
di: Cahyawijaya, Samuel, et al.
Pubblicazione: (2024)
di: Cahyawijaya, Samuel, et al.
Pubblicazione: (2024)
Synthetic or Authentic? Building Mental Patient Simulators from Longitudinal Evidence
di: Li, Baihan, et al.
Pubblicazione: (2026)
di: Li, Baihan, et al.
Pubblicazione: (2026)
Reducing Tool Hallucination via Reliability Alignment
di: Xu, Hongshen, et al.
Pubblicazione: (2024)
di: Xu, Hongshen, et al.
Pubblicazione: (2024)
ANAH-v2: Scaling Analytical Hallucination Annotation of Large Language Models
di: Gu, Yuzhe, et al.
Pubblicazione: (2024)
di: Gu, Yuzhe, et al.
Pubblicazione: (2024)
Probing the "Psyche'' of Large Reasoning Models: Understanding Through a Human Lens
di: Chen, Yuxiang, et al.
Pubblicazione: (2025)
di: Chen, Yuxiang, et al.
Pubblicazione: (2025)
SciDFM: A Large Language Model with Mixture-of-Experts for Science
di: Sun, Liangtai, et al.
Pubblicazione: (2024)
di: Sun, Liangtai, et al.
Pubblicazione: (2024)
Rejection Improves Reliability: Training LLMs to Refuse Unknown Questions Using RL from Knowledge Feedback
di: Xu, Hongshen, et al.
Pubblicazione: (2024)
di: Xu, Hongshen, et al.
Pubblicazione: (2024)
A Cognitive Evaluation Benchmark of Image Reasoning and Description for Large Vision-Language Models
di: Song, Xiujie, et al.
Pubblicazione: (2024)
di: Song, Xiujie, et al.
Pubblicazione: (2024)
Sparsity-Accelerated Training for Large Language Models
di: Ma, Da, et al.
Pubblicazione: (2024)
di: Ma, Da, et al.
Pubblicazione: (2024)
Negative Object Presence Evaluation (NOPE) to Measure Object Hallucination in Vision-Language Models
di: Lovenia, Holy, et al.
Pubblicazione: (2023)
di: Lovenia, Holy, et al.
Pubblicazione: (2023)
HalluLens: LLM Hallucination Benchmark
di: Bang, Yejin, et al.
Pubblicazione: (2025)
di: Bang, Yejin, et al.
Pubblicazione: (2025)
CriticEval: Evaluating Large Language Model as Critic
di: Lan, Tian, et al.
Pubblicazione: (2024)
di: Lan, Tian, et al.
Pubblicazione: (2024)
Beyond Spurious Signals: Debiasing Multimodal Large Language Models via Counterfactual Inference and Adaptive Expert Routing
di: Wu, Zichen, et al.
Pubblicazione: (2025)
di: Wu, Zichen, et al.
Pubblicazione: (2025)
META-GUI: Towards Multi-modal Conversational Agents on Mobile GUI
di: Sun, Liangtai, et al.
Pubblicazione: (2022)
di: Sun, Liangtai, et al.
Pubblicazione: (2022)
ProgRM: Build Better GUI Agents with Progress Rewards
di: Zhang, Danyang, et al.
Pubblicazione: (2025)
di: Zhang, Danyang, et al.
Pubblicazione: (2025)
Fine-Grained Interpretation of Political Opinions in Large Language Models
di: Hu, Jingyu, et al.
Pubblicazione: (2025)
di: Hu, Jingyu, et al.
Pubblicazione: (2025)
A BiRGAT Model for Multi-intent Spoken Language Understanding with Hierarchical Semantic Frames
di: Xu, Hongshen, et al.
Pubblicazione: (2024)
di: Xu, Hongshen, et al.
Pubblicazione: (2024)
Hallucination is Inevitable: An Innate Limitation of Large Language Models
di: Xu, Ziwei, et al.
Pubblicazione: (2024)
di: Xu, Ziwei, et al.
Pubblicazione: (2024)
Coding Triangle: How Does Large Language Model Understand Code?
di: Zhang, Taolin, et al.
Pubblicazione: (2025)
di: Zhang, Taolin, et al.
Pubblicazione: (2025)
CLaw: Benchmarking Chinese Legal Knowledge in Large Language Models - A Fine-grained Corpus and Reasoning Analysis
di: Xu, Xinzhe, et al.
Pubblicazione: (2025)
di: Xu, Xinzhe, et al.
Pubblicazione: (2025)
RECAP: Resistance Capture in Text-based Mental Health Counseling with Large Language Models
di: Li, Anqi, et al.
Pubblicazione: (2026)
di: Li, Anqi, et al.
Pubblicazione: (2026)
EyeGPT: Ophthalmic Assistant with Large Language Models
di: Chen, Xiaolan, et al.
Pubblicazione: (2024)
di: Chen, Xiaolan, et al.
Pubblicazione: (2024)
A Survey of Process Reward Models: From Outcome Signals to Process Supervisions for Large Language Models
di: Zheng, Congmin, et al.
Pubblicazione: (2025)
di: Zheng, Congmin, et al.
Pubblicazione: (2025)
Embedding Domain Knowledge for Large Language Models via Reinforcement Learning from Augmented Generation
di: Nie, Chaojun, et al.
Pubblicazione: (2025)
di: Nie, Chaojun, et al.
Pubblicazione: (2025)
TWICE: An LLM Agent Framework for Simulating Personalized User Tweeting Behavior with Long-term Temporal Features
di: Jin, Bingrui, et al.
Pubblicazione: (2025)
di: Jin, Bingrui, et al.
Pubblicazione: (2025)
High-Dimensional Interlingual Representations of Large Language Models
di: Wilie, Bryan, et al.
Pubblicazione: (2025)
di: Wilie, Bryan, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Enhancing LLM Reliability via Explicit Knowledge Boundary Modeling
di: Zheng, Hang, et al.
Pubblicazione: (2025) -
Towards Reliable and Empathetic Depression-Diagnosis-Oriented Chats
di: Lan, Kunyao, et al.
Pubblicazione: (2024) -
Alignment for Efficient Tool Calling of Large Language Models
di: Xu, Hongshen, et al.
Pubblicazione: (2025) -
AdaEAGLE: Optimizing Speculative Decoding via Explicit Modeling of Adaptive Draft Structures
di: Zhang, Situo, et al.
Pubblicazione: (2024) -
Depression Diagnosis Dialogue Simulation: Self-improving Psychiatrist with Tertiary Memory
di: Lan, Kunyao, et al.
Pubblicazione: (2024)