EDVD-LLaMA: Explainable Deepfake Video Detection via Multimodal Large Language Model Reasoning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Sun, Haoran, Cai, Chen, Zhuang, Huiping, Lee, Kong Aik, Chau, Lap-Pui, Wang, Yi |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
LLaMA Pro: Progressive LLaMA with Block Expansion
par: Wu, Chengyue, et autres
Publié: (2024)
par: Wu, Chengyue, et autres
Publié: (2024)
Emotion-LLaMA: Multimodal Emotion Recognition and Reasoning with Instruction Tuning
par: Cheng, Zebang, et autres
Publié: (2024)
par: Cheng, Zebang, et autres
Publié: (2024)
LLaMA-XR: A Novel Framework for Radiology Report Generation using LLaMA and QLoRA Fine Tuning
par: Jahangir, Md. Zihad Bin, et autres
Publié: (2025)
par: Jahangir, Md. Zihad Bin, et autres
Publié: (2025)
ECHO-LLaMA: Efficient Caching for High-Performance LLaMA Training
par: Dialameh, Maryam, et autres
Publié: (2025)
par: Dialameh, Maryam, et autres
Publié: (2025)
Amharic LLaMA and LLaVA: Multimodal LLMs for Low Resource Languages
par: Andersland, Michael
Publié: (2024)
par: Andersland, Michael
Publié: (2024)
Smart-LLaMA-DPO: Reinforced Large Language Model for Explainable Smart Contract Vulnerability Detection
par: Yu, Lei, et autres
Publié: (2025)
par: Yu, Lei, et autres
Publié: (2025)
LLaMA-Reg: Using LLaMA 2 for Unsupervised Medical Image Registration
par: Ma, Mingrui, et autres
Publié: (2024)
par: Ma, Mingrui, et autres
Publié: (2024)
Multimodal Medical Disease Classification with LLaMA II
par: Gapp, Christian, et autres
Publié: (2024)
par: Gapp, Christian, et autres
Publié: (2024)
BanglaLlama: LLaMA for Bangla Language
par: Zehady, Abdullah Khan, et autres
Publié: (2024)
par: Zehady, Abdullah Khan, et autres
Publié: (2024)
EVA02-AT: Egocentric Video-Language Understanding with Spatial-Temporal Rotary Positional Embeddings and Symmetric Optimization
par: Wang, Xiaoqi, et autres
Publié: (2025)
par: Wang, Xiaoqi, et autres
Publié: (2025)
LLaMA-MoE: Building Mixture-of-Experts from LLaMA with Continual Pre-training
par: Zhu, Tong, et autres
Publié: (2024)
par: Zhu, Tong, et autres
Publié: (2024)
LLaMA-MoE v2: Exploring Sparsity of LLaMA from Perspective of Mixture-of-Experts with Post-Training
par: Qu, Xiaoye, et autres
Publié: (2024)
par: Qu, Xiaoye, et autres
Publié: (2024)
Vista-LLaMA: Reducing Hallucination in Video Language Models via Equal Distance to Visual Tokens
par: Ma, Fan, et autres
Publié: (2023)
par: Ma, Fan, et autres
Publié: (2023)
Mol-LLaMA: Towards General Understanding of Molecules in Large Molecular Language Model
par: Kim, Dongki, et autres
Publié: (2025)
par: Kim, Dongki, et autres
Publié: (2025)
Me LLaMA: Foundation Large Language Models for Medical Applications
par: Xie, Qianqian, et autres
Publié: (2024)
par: Xie, Qianqian, et autres
Publié: (2024)
LLaMA-Omni: Seamless Speech Interaction with Large Language Models
par: Fang, Qingkai, et autres
Publié: (2024)
par: Fang, Qingkai, et autres
Publié: (2024)
Tailored-LLaMA: Optimizing Few-Shot Learning in Pruned LLaMA Models with Task-Specific Prompts
par: Aftab, Danyal, et autres
Publié: (2024)
par: Aftab, Danyal, et autres
Publié: (2024)
LogLLaMA: Transformer-based log anomaly detection with LLaMA
par: Yang, Zhuoyi, et autres
Publié: (2025)
par: Yang, Zhuoyi, et autres
Publié: (2025)
VisionLLaMA: A Unified LLaMA Backbone for Vision Tasks
par: Chu, Xiangxiang, et autres
Publié: (2024)
par: Chu, Xiangxiang, et autres
Publié: (2024)
MuMu-LLaMA: Multi-modal Music Understanding and Generation via Large Language Models
par: Liu, Shansong, et autres
Publié: (2024)
par: Liu, Shansong, et autres
Publié: (2024)
Evaluating LLaMA 3.2 for Software Vulnerability Detection
par: Gonçalves, José, et autres
Publié: (2025)
par: Gonçalves, José, et autres
Publié: (2025)
LLaMA-NAS: Efficient Neural Architecture Search for Large Language Models
par: Sarah, Anthony, et autres
Publié: (2024)
par: Sarah, Anthony, et autres
Publié: (2024)
VoCo-LLaMA: Towards Vision Compression with Large Language Models
par: Ye, Xubing, et autres
Publié: (2024)
par: Ye, Xubing, et autres
Publié: (2024)
Adapting LLaMA Decoder to Vision Transformer
par: Wang, Jiahao, et autres
Publié: (2024)
par: Wang, Jiahao, et autres
Publié: (2024)
Egocentric Human-Object Interaction Detection: A New Benchmark and Method
par: Deng, Kunyuan, et autres
Publié: (2025)
par: Deng, Kunyuan, et autres
Publié: (2025)
Shortened LLaMA: Depth Pruning for Large Language Models with Comparison of Retraining Methods
par: Kim, Bo-Kyeong, et autres
Publié: (2024)
par: Kim, Bo-Kyeong, et autres
Publié: (2024)
Dia-LLaMA: Towards Large Language Model-driven CT Report Generation
par: Chen, Zhixuan, et autres
Publié: (2024)
par: Chen, Zhixuan, et autres
Publié: (2024)
MIDI-LLaMA: An Instruction-Following Multimodal LLM for Symbolic Music Understanding
par: Yang, Meng, et autres
Publié: (2026)
par: Yang, Meng, et autres
Publié: (2026)
LLaMAs Have Feelings Too: Unveiling Sentiment and Emotion Representations in LLaMA Models Through Probing
par: Di Palma, Dario, et autres
Publié: (2025)
par: Di Palma, Dario, et autres
Publié: (2025)
LLaMA Beyond English: An Empirical Study on Language Capability Transfer
par: Zhao, Jun, et autres
Publié: (2024)
par: Zhao, Jun, et autres
Publié: (2024)
How Vocabulary Sharing Facilitates Multilingualism in LLaMA?
par: Yuan, Fei, et autres
Publié: (2023)
par: Yuan, Fei, et autres
Publié: (2023)
Sheared LLaMA: Accelerating Language Model Pre-training via Structured Pruning
par: Xia, Mengzhou, et autres
Publié: (2023)
par: Xia, Mengzhou, et autres
Publié: (2023)
Sorted LLaMA: Unlocking the Potential of Intermediate Layers of Large Language Models for Dynamic Inference
par: Kavehzadeh, Parsa, et autres
Publié: (2023)
par: Kavehzadeh, Parsa, et autres
Publié: (2023)
Llamazip: Leveraging LLaMA for Lossless Text Compression and Training Dataset Detection
par: Dréano, Sören, et autres
Publié: (2025)
par: Dréano, Sören, et autres
Publié: (2025)
GVSynergy-Det: Synergistic Gaussian-Voxel Representations for Multi-View 3D Object Detection
par: Zhang, Yi, et autres
Publié: (2025)
par: Zhang, Yi, et autres
Publié: (2025)
LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models
par: Wang, Zhengyi, et autres
Publié: (2024)
par: Wang, Zhengyi, et autres
Publié: (2024)
3DGeoDet: General-purpose Geometry-aware Image-based 3D Object Detection
par: Zhang, Yi, et autres
Publié: (2025)
par: Zhang, Yi, et autres
Publié: (2025)
Efficient and Effective Text Encoding for Chinese LLaMA and Alpaca
par: Cui, Yiming, et autres
Publié: (2023)
par: Cui, Yiming, et autres
Publié: (2023)
Dynamic Activation Pitfalls in LLaMA Models: An Empirical Study
par: Ma, Chi, et autres
Publié: (2024)
par: Ma, Chi, et autres
Publié: (2024)
Faster Speech-LLaMA Inference with Multi-token Prediction
par: Raj, Desh, et autres
Publié: (2024)
par: Raj, Desh, et autres
Publié: (2024)
Documents similaires
-
LLaMA Pro: Progressive LLaMA with Block Expansion
par: Wu, Chengyue, et autres
Publié: (2024) -
Emotion-LLaMA: Multimodal Emotion Recognition and Reasoning with Instruction Tuning
par: Cheng, Zebang, et autres
Publié: (2024) -
LLaMA-XR: A Novel Framework for Radiology Report Generation using LLaMA and QLoRA Fine Tuning
par: Jahangir, Md. Zihad Bin, et autres
Publié: (2025) -
ECHO-LLaMA: Efficient Caching for High-Performance LLaMA Training
par: Dialameh, Maryam, et autres
Publié: (2025) -
Amharic LLaMA and LLaVA: Multimodal LLMs for Low Resource Languages
par: Andersland, Michael
Publié: (2024)