Are Reasoning Models More Prone to Hallucination?
Fuente:
arXiv
Guardado en:
| Autores principales: | Yao, Zijun, Liu, Yantao, Chen, Yanxu, Chen, Jianhui, Fang, Junfeng, Hou, Lei, Li, Juanzi, Chua, Tat-Seng |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
StockBench: Can LLM Agents Trade Stocks Profitably In Real-world Markets?
por: Chen, Yanxu, et al.
Publicado: (2025)
por: Chen, Yanxu, et al.
Publicado: (2025)
Towards Understanding Safety Alignment: A Mechanistic Perspective from Safety Neurons
por: Chen, Jianhui, et al.
Publicado: (2024)
por: Chen, Jianhui, et al.
Publicado: (2024)
T1: Advancing Language Model Reasoning through Reinforcement Learning and Inference Scaling
por: Hou, Zhenyu, et al.
Publicado: (2025)
por: Hou, Zhenyu, et al.
Publicado: (2025)
Guiding LLM Post-training Data Engineering with Model Internals from Sparse Autoencoders
por: Jing, Yi, et al.
Publicado: (2026)
por: Jing, Yi, et al.
Publicado: (2026)
RM-Bench: Benchmarking Reward Models of Language Models with Subtlety and Style
por: Liu, Yantao, et al.
Publicado: (2024)
por: Liu, Yantao, et al.
Publicado: (2024)
Evaluating Generative Language Models in Information Extraction as Subjective Question Correction
por: Fan, Yuchen, et al.
Publicado: (2024)
por: Fan, Yuchen, et al.
Publicado: (2024)
AdaptThink: Reasoning Models Can Learn When to Think
por: Zhang, Jiajie, et al.
Publicado: (2025)
por: Zhang, Jiajie, et al.
Publicado: (2025)
Don't Just Say "I don't know"! Self-aligning Large Language Models for Responding to Unknown Questions with Explanations
por: Deng, Yang, et al.
Publicado: (2024)
por: Deng, Yang, et al.
Publicado: (2024)
Untangle the KNOT: Interweaving Conflicting Knowledge and Reasoning Skills in Large Language Models
por: Liu, Yantao, et al.
Publicado: (2024)
por: Liu, Yantao, et al.
Publicado: (2024)
PairJudge RM: Perform Best-of-N Sampling with Knockout Tournament
por: Liu, Yantao, et al.
Publicado: (2025)
por: Liu, Yantao, et al.
Publicado: (2025)
Aligning Teacher with Student Preferences for Tailored Training Data Generation
por: Liu, Yantao, et al.
Publicado: (2024)
por: Liu, Yantao, et al.
Publicado: (2024)
Steering LVLMs via Sparse Autoencoder for Hallucination Mitigation
por: Hua, Zhenglin, et al.
Publicado: (2025)
por: Hua, Zhenglin, et al.
Publicado: (2025)
Boundary-Guided Policy Optimization for Memory-efficient RL of Diffusion Large Language Models
por: Lin, Nianyi, et al.
Publicado: (2025)
por: Lin, Nianyi, et al.
Publicado: (2025)
Active Zero: Self-Evolving Vision-Language Models through Active Environment Exploration
por: He, Jinghan, et al.
Publicado: (2026)
por: He, Jinghan, et al.
Publicado: (2026)
SafeMLRM: Demystifying Safety in Multi-modal Large Reasoning Models
por: Fang, Junfeng, et al.
Publicado: (2025)
por: Fang, Junfeng, et al.
Publicado: (2025)
Learning to Generate Explainable Stock Predictions using Self-Reflective Large Language Models
por: Koa, Kelvin J. L., et al.
Publicado: (2024)
por: Koa, Kelvin J. L., et al.
Publicado: (2024)
Self-Improvement Towards Pareto Optimality: Mitigating Preference Conflicts in Multi-Objective Alignment
por: Li, Moxin, et al.
Publicado: (2025)
por: Li, Moxin, et al.
Publicado: (2025)
The Missing Half: Unveiling Training-time Implicit Safety Risks Beyond Deployment
por: Zhang, Zhexin, et al.
Publicado: (2026)
por: Zhang, Zhexin, et al.
Publicado: (2026)
We Should Identify and Mitigate Third-Party Safety Risks in MCP-Powered Agent Systems
por: Fang, Junfeng, et al.
Publicado: (2025)
por: Fang, Junfeng, et al.
Publicado: (2025)
Temporal Relational Reasoning of Large Language Models for Detecting Stock Portfolio Crashes
por: Koa, Kelvin J. L., et al.
Publicado: (2024)
por: Koa, Kelvin J. L., et al.
Publicado: (2024)
NExT-GPT: Any-to-Any Multimodal LLM
por: Wu, Shengqiong, et al.
Publicado: (2023)
por: Wu, Shengqiong, et al.
Publicado: (2023)
DreamDPO: Aligning Text-to-3D Generation with Human Preferences via Direct Preference Optimization
por: Zhou, Zhenglin, et al.
Publicado: (2025)
por: Zhou, Zhenglin, et al.
Publicado: (2025)
CARL: Criticality-Aware Agentic Reinforcement Learning
por: Shen, Leyang, et al.
Publicado: (2025)
por: Shen, Leyang, et al.
Publicado: (2025)
LongReward: Improving Long-context Large Language Models with AI Feedback
por: Zhang, Jiajie, et al.
Publicado: (2024)
por: Zhang, Jiajie, et al.
Publicado: (2024)
SILMM: Self-Improving Large Multimodal Models for Compositional Text-to-Image Generation
por: Qu, Leigang, et al.
Publicado: (2024)
por: Qu, Leigang, et al.
Publicado: (2024)
AtomR: Atomic Operator-Empowered Large Language Models for Heterogeneous Knowledge Reasoning
por: Xin, Amy, et al.
Publicado: (2024)
por: Xin, Amy, et al.
Publicado: (2024)
DRAFT: Task Decoupled Latent Reasoning for Agent Safety
por: Wang, Lin, et al.
Publicado: (2026)
por: Wang, Lin, et al.
Publicado: (2026)
Thinking-Free Policy Initialization Makes Distilled Reasoning Models More Effective and Efficient Reasoners
por: Xu, Xin, et al.
Publicado: (2025)
por: Xu, Xin, et al.
Publicado: (2025)
A Survey on Hallucination in Large Vision-Language Models
por: Liu, Hanchao, et al.
Publicado: (2024)
por: Liu, Hanchao, et al.
Publicado: (2024)
DICE: Detecting In-distribution Contamination in LLM's Fine-tuning Phase for Math Reasoning
por: Tu, Shangqing, et al.
Publicado: (2024)
por: Tu, Shangqing, et al.
Publicado: (2024)
LongAlign: A Recipe for Long Context Alignment of Large Language Models
por: Bai, Yushi, et al.
Publicado: (2024)
por: Bai, Yushi, et al.
Publicado: (2024)
Mixture Compressor for Mixture-of-Experts LLMs Gains More
por: Huang, Wei, et al.
Publicado: (2024)
por: Huang, Wei, et al.
Publicado: (2024)
More Edits, More Stable: Understanding the Lifelong Normalization in Sequential Model Editing
por: Ma, Xin, et al.
Publicado: (2026)
por: Ma, Xin, et al.
Publicado: (2026)
Tracing Facts or just Copies? A critical investigation of the Competitions of Mechanisms in Large Language Models
por: Campregher, Dante, et al.
Publicado: (2025)
por: Campregher, Dante, et al.
Publicado: (2025)
TIGeR: Unifying Text-to-Image Generation and Retrieval with Large Multimodal Models
por: Qu, Leigang, et al.
Publicado: (2024)
por: Qu, Leigang, et al.
Publicado: (2024)
Explainable LLM Unlearning Through Reasoning
por: Liao, Junfeng, et al.
Publicado: (2026)
por: Liao, Junfeng, et al.
Publicado: (2026)
Reasoning in Trees: Improving Retrieval-Augmented Generation for Multi-Hop Question Answering
por: Shi, Yuling, et al.
Publicado: (2026)
por: Shi, Yuling, et al.
Publicado: (2026)
A Cause-Effect Look at Alleviating Hallucination of Knowledge-grounded Dialogue Generation
por: Yu, Jifan, et al.
Publicado: (2024)
por: Yu, Jifan, et al.
Publicado: (2024)
Learning to Reason for Hallucination Span Detection
por: Su, Hsuan, et al.
Publicado: (2025)
por: Su, Hsuan, et al.
Publicado: (2025)
RLPR: Extrapolating RLVR to General Domains without Verifiers
por: Yu, Tianyu, et al.
Publicado: (2025)
por: Yu, Tianyu, et al.
Publicado: (2025)
Ejemplares similares
-
StockBench: Can LLM Agents Trade Stocks Profitably In Real-world Markets?
por: Chen, Yanxu, et al.
Publicado: (2025) -
Towards Understanding Safety Alignment: A Mechanistic Perspective from Safety Neurons
por: Chen, Jianhui, et al.
Publicado: (2024) -
T1: Advancing Language Model Reasoning through Reinforcement Learning and Inference Scaling
por: Hou, Zhenyu, et al.
Publicado: (2025) -
Guiding LLM Post-training Data Engineering with Model Internals from Sparse Autoencoders
por: Jing, Yi, et al.
Publicado: (2026) -
RM-Bench: Benchmarking Reward Models of Language Models with Subtlety and Style
por: Liu, Yantao, et al.
Publicado: (2024)