Lyapunov Probes for Hallucination Detection in Large Foundation Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Luan, Bozhi, Li, Gen, Qin, Yalan, Guo, Jifeng, Zhou, Yun, Wu, Faguo, Zheng, Hongwei, Wu, Wenjun, Fan, Zhaoxin |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Z-Erase: Enabling Concept Erasure in Single-Stream Diffusion Transformers
par: Jiang, Nanxiang, et autres
Publié: (2026)
par: Jiang, Nanxiang, et autres
Publié: (2026)
HalluSAE: Detecting Hallucinations in Large Language Models via Sparse Auto-Encoders
par: Chen, Boshui, et autres
Publié: (2026)
par: Chen, Boshui, et autres
Publié: (2026)
Mosaic: Multimodal Jailbreak against Closed-Source VLMs via Multi-View Ensemble Optimization
par: Lan, Yuqin, et autres
Publié: (2026)
par: Lan, Yuqin, et autres
Publié: (2026)
Multi-Cue Adaptive Visual Token Pruning for Large Vision-Language Models
par: Luan, Bozhi, et autres
Publié: (2025)
par: Luan, Bozhi, et autres
Publié: (2025)
EraseAnything++: Enabling Concept Erasure in Rectified Flow Transformers Leveraging Multi-Object Optimization
par: Fan, Zhaoxin, et autres
Publié: (2026)
par: Fan, Zhaoxin, et autres
Publié: (2026)
Erased, But Not Forgotten: Erased Rectified Flow Transformers Still Remain Unsafe Under Concept Attack
par: Jiang, Nanxiang, et autres
Publié: (2025)
par: Jiang, Nanxiang, et autres
Publié: (2025)
VIB-Probe: Detecting and Mitigating Hallucinations in Vision-Language Models via Variational Information Bottleneck
par: Zhang, Feiran, et autres
Publié: (2026)
par: Zhang, Feiran, et autres
Publié: (2026)
TinyLLaVA-Video: Towards Smaller LMMs for Video Understanding with Group Resampler
par: Zhang, Xingjian, et autres
Publié: (2025)
par: Zhang, Xingjian, et autres
Publié: (2025)
Dynamic Multimodal Activation Steering for Hallucination Mitigation in Large Vision-Language Models
par: Yin, Jianghao, et autres
Publié: (2026)
par: Yin, Jianghao, et autres
Publié: (2026)
BookNet: Book Image Rectification via Cross-Page Attention Network
par: Liu, Shaokai, et autres
Publié: (2026)
par: Liu, Shaokai, et autres
Publié: (2026)
TextCoT: Zoom In for Enhanced Multimodal Text-Rich Image Understanding
par: Luan, Bozhi, et autres
Publié: (2024)
par: Luan, Bozhi, et autres
Publié: (2024)
Detecting and Evaluating Medical Hallucinations in Large Vision Language Models
par: Chen, Jiawei, et autres
Publié: (2024)
par: Chen, Jiawei, et autres
Publié: (2024)
3D-LSPTM: An Automatic Framework with 3D-Large-Scale Pretrained Model for Laryngeal Cancer Detection Using Laryngoscopic Videos
par: Qiu, Meiyu, et autres
Publié: (2024)
par: Qiu, Meiyu, et autres
Publié: (2024)
TinyAlign: Boosting Lightweight Vision-Language Models by Mitigating Modal Alignment Bottlenecks
par: Hu, Yuanze, et autres
Publié: (2025)
par: Hu, Yuanze, et autres
Publié: (2025)
What Color Is It? A Text-Interference Multimodal Hallucination Benchmark
par: Zhao, Jinkun, et autres
Publié: (2025)
par: Zhao, Jinkun, et autres
Publié: (2025)
Relaxing Anchor-Frame Dominance for Mitigating Hallucinations in Video Large Language Models
par: Liu, Zijian, et autres
Publié: (2026)
par: Liu, Zijian, et autres
Publié: (2026)
Evaluating and Analyzing Relationship Hallucinations in Large Vision-Language Models
par: Wu, Mingrui, et autres
Publié: (2024)
par: Wu, Mingrui, et autres
Publié: (2024)
HiProbe-VAD: Video Anomaly Detection via Hidden States Probing in Tuning-Free Multimodal LLMs
par: Cai, Zhaolin, et autres
Publié: (2025)
par: Cai, Zhaolin, et autres
Publié: (2025)
VL-Uncertainty: Detecting Hallucination in Large Vision-Language Model via Uncertainty Estimation
par: Zhang, Ruiyang, et autres
Publié: (2024)
par: Zhang, Ruiyang, et autres
Publié: (2024)
SMFormer: Empowering Self-supervised Stereo Matching via Foundation Models and Data Augmentation
par: Wang, Yun, et autres
Publié: (2026)
par: Wang, Yun, et autres
Publié: (2026)
HF-VTON: High-Fidelity Virtual Try-On via Consistent Geometric and Semantic Alignment
par: Meng, Ming, et autres
Publié: (2025)
par: Meng, Ming, et autres
Publié: (2025)
Hallucination of Multimodal Large Language Models: A Survey
par: Bai, Zechen, et autres
Publié: (2024)
par: Bai, Zechen, et autres
Publié: (2024)
Sora Detector: A Unified Hallucination Detection for Large Text-to-Video Models
par: Chu, Zhixuan, et autres
Publié: (2024)
par: Chu, Zhixuan, et autres
Publié: (2024)
H-POPE: Hierarchical Polling-based Probing Evaluation of Hallucinations in Large Vision-Language Models
par: Pham, Nhi, et autres
Publié: (2024)
par: Pham, Nhi, et autres
Publié: (2024)
VGG-Tex: A Vivid Geometry-Guided Facial Texture Estimation Model for High Fidelity Monocular 3D Face Reconstruction
par: Wu, Haoyu, et autres
Publié: (2024)
par: Wu, Haoyu, et autres
Publié: (2024)
Boosting Salient Object Detection with Knowledge Distillated from Large Foundation Models
par: He, Miaoyang, et autres
Publié: (2025)
par: He, Miaoyang, et autres
Publié: (2025)
HaloProbe: Bayesian Detection and Mitigation of Object Hallucinations in Vision-Language Models
par: Zohrabi, Reihaneh, et autres
Publié: (2026)
par: Zohrabi, Reihaneh, et autres
Publié: (2026)
Lyapunov Stable Graph Neural Flow
par: Chu, Haoyu, et autres
Publié: (2026)
par: Chu, Haoyu, et autres
Publié: (2026)
From Hallucinations to Jailbreaks: Rethinking the Vulnerability of Large Foundation Models
par: Jin, Haibo, et autres
Publié: (2025)
par: Jin, Haibo, et autres
Publié: (2025)
RULER-Bench: Probing Rule-based Reasoning Abilities of Next-level Video Generation Models for Vision Foundation Intelligence
par: He, Xuming, et autres
Publié: (2025)
par: He, Xuming, et autres
Publié: (2025)
Detecting and Preventing Hallucinations in Large Vision Language Models
par: Gunjal, Anisha, et autres
Publié: (2023)
par: Gunjal, Anisha, et autres
Publié: (2023)
Verb Mirage: Unveiling and Assessing Verb Concept Hallucinations in Multimodal Large Language Models
par: Wang, Zehao, et autres
Publié: (2024)
par: Wang, Zehao, et autres
Publié: (2024)
Spot the Fake: Large Multimodal Model-Based Synthetic Image Detection with Artifact Explanation
par: Wen, Siwei, et autres
Publié: (2025)
par: Wen, Siwei, et autres
Publié: (2025)
Hallucination Elimination and Semantic Enhancement Framework for Vision-Language Models in Traffic Scenarios
par: Fan, Jiaqi, et autres
Publié: (2024)
par: Fan, Jiaqi, et autres
Publié: (2024)
MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models
par: Zhao, Qiyan, et autres
Publié: (2025)
par: Zhao, Qiyan, et autres
Publié: (2025)
Language-Guided Token Compression with Reinforcement Learning in Large Vision-Language Models
par: Cao, Sihan, et autres
Publié: (2026)
par: Cao, Sihan, et autres
Publié: (2026)
Counting Hallucinations in Diffusion Models
par: Fu, Shuai, et autres
Publié: (2025)
par: Fu, Shuai, et autres
Publié: (2025)
AsynFusion: Towards Asynchronous Latent Consistency Models for Decoupled Whole-Body Audio-Driven Avatars
par: Zhang, Tianbao, et autres
Publié: (2025)
par: Zhang, Tianbao, et autres
Publié: (2025)
Audio-Visual Intelligence in Large Foundation Models
par: Qin, You, et autres
Publié: (2026)
par: Qin, You, et autres
Publié: (2026)
RCP: Representation Consistency Pruner for Mitigating Distribution Shift in Large Vision-Language Models
par: Zhang, Jianwei, et autres
Publié: (2026)
par: Zhang, Jianwei, et autres
Publié: (2026)
Documents similaires
-
Z-Erase: Enabling Concept Erasure in Single-Stream Diffusion Transformers
par: Jiang, Nanxiang, et autres
Publié: (2026) -
HalluSAE: Detecting Hallucinations in Large Language Models via Sparse Auto-Encoders
par: Chen, Boshui, et autres
Publié: (2026) -
Mosaic: Multimodal Jailbreak against Closed-Source VLMs via Multi-View Ensemble Optimization
par: Lan, Yuqin, et autres
Publié: (2026) -
Multi-Cue Adaptive Visual Token Pruning for Large Vision-Language Models
par: Luan, Bozhi, et autres
Publié: (2025) -
EraseAnything++: Enabling Concept Erasure in Rectified Flow Transformers Leveraging Multi-Object Optimization
par: Fan, Zhaoxin, et autres
Publié: (2026)