GIM: A Million-scale Benchmark for Generative Image Manipulation Detection and Localization
Fuente:
arXiv
Guardado en:
| Autores principales: | Chen, Yirui, Huang, Xudong, Zhang, Quan, Li, Wei, Zhu, Mingjian, Yan, Qiangyu, Li, Simiao, Chen, Hanting, Hu, Hailin, Yang, Jie, Liu, Wei, Hu, Jie |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
GenVidBench: A 6-Million Benchmark for AI-Generated Video Detection
por: Ni, Zhenliang, et al.
Publicado: (2025)
por: Ni, Zhenliang, et al.
Publicado: (2025)
DSPO: Direct Semantic Preference Optimization for Real-World Image Super-Resolution
por: Cai, Miaomiao, et al.
Publicado: (2025)
por: Cai, Miaomiao, et al.
Publicado: (2025)
EAM: Enhancing Anything with Diffusion Transformers for Blind Super-Resolution
por: Xie, Haizhen, et al.
Publicado: (2025)
por: Xie, Haizhen, et al.
Publicado: (2025)
Omni-Dimensional Frequency Learner for General Time Series Analysis
por: Chen, Xianing, et al.
Publicado: (2024)
por: Chen, Xianing, et al.
Publicado: (2024)
Knowledge Distillation with Multi-granularity Mixture of Priors for Image Super-Resolution
por: Li, Simiao, et al.
Publicado: (2024)
por: Li, Simiao, et al.
Publicado: (2024)
Multi-Granularity Semantic Revision for Large Language Model Distillation
por: Liu, Xiaoyu, et al.
Publicado: (2024)
por: Liu, Xiaoyu, et al.
Publicado: (2024)
Data Upcycling Knowledge Distillation for Image Super-Resolution
por: Zhang, Yun, et al.
Publicado: (2023)
por: Zhang, Yun, et al.
Publicado: (2023)
C-MOP: Integrating Momentum and Boundary-Aware Clustering for Enhanced Prompt Evolution
por: Yan, Binwei, et al.
Publicado: (2026)
por: Yan, Binwei, et al.
Publicado: (2026)
GIM: Learning Generalizable Image Matcher From Internet Videos
por: Shen, Xuelun, et al.
Publicado: (2024)
por: Shen, Xuelun, et al.
Publicado: (2024)
Autoregressive Image Generation with Vision Full-view Prompt
por: Cai, Miaomiao, et al.
Publicado: (2025)
por: Cai, Miaomiao, et al.
Publicado: (2025)
From Sequential to Spatial: Reordering Autoregression for Efficient Visual Generation
por: Wang, Siyang, et al.
Publicado: (2025)
por: Wang, Siyang, et al.
Publicado: (2025)
Collaboration of Teachers for Semi-supervised Object Detection
por: Chen, Liyu, et al.
Publicado: (2024)
por: Chen, Liyu, et al.
Publicado: (2024)
NeXT-IMDL: Build Benchmark for NeXT-Generation Image Manipulation Detection & Localization
por: Li, Yifei, et al.
Publicado: (2025)
por: Li, Yifei, et al.
Publicado: (2025)
IPT-V2: Efficient Image Processing Transformer using Hierarchical Attentions
por: Tu, Zhijun, et al.
Publicado: (2024)
por: Tu, Zhijun, et al.
Publicado: (2024)
Distilling Semantic Priors from SAM to Efficient Image Restoration Models
por: Zhang, Quan, et al.
Publicado: (2024)
por: Zhang, Quan, et al.
Publicado: (2024)
EvalGIM: A Library for Evaluating Generative Image Models
por: Hall, Melissa, et al.
Publicado: (2024)
por: Hall, Melissa, et al.
Publicado: (2024)
DeMamba: AI-Generated Video Detection on Million-Scale GenVideo Benchmark
por: Chen, Haoxing, et al.
Publicado: (2024)
por: Chen, Haoxing, et al.
Publicado: (2024)
LIPT: Latency-aware Image Processing Transformer
por: Qiao, Junbo, et al.
Publicado: (2024)
por: Qiao, Junbo, et al.
Publicado: (2024)
Allo{SR}$^2$: Rectifying One-Step Super-Resolution to Stay Real via Allomorphic Generative Flows
por: Wang, Zihan, et al.
Publicado: (2026)
por: Wang, Zihan, et al.
Publicado: (2026)
Large Language Models for Fault Localization: An Empirical Study
por: Xiao, YingJian, et al.
Publicado: (2025)
por: Xiao, YingJian, et al.
Publicado: (2025)
COCO-Inpaint: A Benchmark for Detecting and Localizing Inpainting-Based Image Manipulations
por: Yan, Haozhen, et al.
Publicado: (2025)
por: Yan, Haozhen, et al.
Publicado: (2025)
RealSR-R1: Reinforcement Learning for Real-World Image Super-Resolution with Vision-Language Chain-of-Thought
por: Qiao, Junbo, et al.
Publicado: (2025)
por: Qiao, Junbo, et al.
Publicado: (2025)
Dynamic Contrastive Knowledge Distillation for Efficient Image Restoration
por: Zhou, Yunshuai, et al.
Publicado: (2024)
por: Zhou, Yunshuai, et al.
Publicado: (2024)
G3Flow: Generative 3D Semantic Flow for Pose-aware and Generalizable Object Manipulation
por: Chen, Tianxing, et al.
Publicado: (2024)
por: Chen, Tianxing, et al.
Publicado: (2024)
Dynamic Frequency-Adaptive Knowledge Distillation for Speech Enhancement
por: Yuan, Xihao, et al.
Publicado: (2025)
por: Yuan, Xihao, et al.
Publicado: (2025)
OmniEval: A Benchmark for Evaluating Omni-modal Models with Visual, Auditory, and Textual Inputs
por: Zhang, Yiman, et al.
Publicado: (2025)
por: Zhang, Yiman, et al.
Publicado: (2025)
OmniHuman: A Large-scale Dataset and Benchmark for Human-Centric Video Generation
por: Zhu, Lei, et al.
Publicado: (2026)
por: Zhu, Lei, et al.
Publicado: (2026)
SaD: A Scenario-Aware Discriminator for Speech Enhancement
por: Yuan, Xihao, et al.
Publicado: (2025)
por: Yuan, Xihao, et al.
Publicado: (2025)
FIND: A Simple yet Effective Baseline for Diffusion-Generated Image Detection
por: Li, Jie, et al.
Publicado: (2026)
por: Li, Jie, et al.
Publicado: (2026)
ShapeGen: Robotic Data Generation for Category-Level Manipulation
por: Wang, Yirui, et al.
Publicado: (2026)
por: Wang, Yirui, et al.
Publicado: (2026)
RDDM: Practicing RAW Domain Diffusion Model for Real-world Image Restoration
por: Chen, Yan, et al.
Publicado: (2025)
por: Chen, Yan, et al.
Publicado: (2025)
Global Cross-Modal Geo-Localization: A Million-Scale Dataset and a Physical Consistency Learning Framework
por: Hu, Yutong, et al.
Publicado: (2026)
por: Hu, Yutong, et al.
Publicado: (2026)
AI-Face: A Million-Scale Demographically Annotated AI-Generated Face Dataset and Fairness Benchmark
por: Lin, Li, et al.
Publicado: (2024)
por: Lin, Li, et al.
Publicado: (2024)
Saliency-driven Dynamic Token Pruning for Large Language Models
por: Tao, Yao, et al.
Publicado: (2025)
por: Tao, Yao, et al.
Publicado: (2025)
Forge-and-Quench: Enhancing Image Generation for Higher Fidelity in Unified Multimodal Models
por: Zeng, Yanbing, et al.
Publicado: (2026)
por: Zeng, Yanbing, et al.
Publicado: (2026)
OS-DiffVSR: Towards One-step Latent Diffusion Model for High-detailed Real-world Video Super-Resolution
por: Li, Hanting, et al.
Publicado: (2025)
por: Li, Hanting, et al.
Publicado: (2025)
FASTC: A Fast Attentional Framework for Semantic Traversability Classification Using Point Cloud
por: Chen, Yirui, et al.
Publicado: (2024)
por: Chen, Yirui, et al.
Publicado: (2024)
Dome-DETR: DETR with Density-Oriented Feature-Query Manipulation for Efficient Tiny Object Detection
por: Hu, Zhangchi, et al.
Publicado: (2025)
por: Hu, Zhangchi, et al.
Publicado: (2025)
MagicMirror: A Large-Scale Dataset and Benchmark for Fine-Grained Artifacts Assessment in Text-to-Image Generation
por: Wang, Jia, et al.
Publicado: (2025)
por: Wang, Jia, et al.
Publicado: (2025)
U-DiTs: Downsample Tokens in U-Shaped Diffusion Transformers
por: Tian, Yuchuan, et al.
Publicado: (2024)
por: Tian, Yuchuan, et al.
Publicado: (2024)
Ejemplares similares
-
GenVidBench: A 6-Million Benchmark for AI-Generated Video Detection
por: Ni, Zhenliang, et al.
Publicado: (2025) -
DSPO: Direct Semantic Preference Optimization for Real-World Image Super-Resolution
por: Cai, Miaomiao, et al.
Publicado: (2025) -
EAM: Enhancing Anything with Diffusion Transformers for Blind Super-Resolution
por: Xie, Haizhen, et al.
Publicado: (2025) -
Omni-Dimensional Frequency Learner for General Time Series Analysis
por: Chen, Xianing, et al.
Publicado: (2024) -
Knowledge Distillation with Multi-granularity Mixture of Priors for Image Super-Resolution
por: Li, Simiao, et al.
Publicado: (2024)