DEAL-300K: Diffusion-based Editing Area Localization with a 300K-Scale Dataset and Frequency-Prompted Baseline
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhang, Rui, Wang, Hongxia, Liu, Hangqing, Zhou, Yang, Zeng, Qiang |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
CigTime: Corrective Instruction Generation Through Inverse Motion Editing
par: Fang, Qihang, et autres
Publié: (2024)
par: Fang, Qihang, et autres
Publié: (2024)
Gaze into the Heart: A Multi-View Video Dataset for rPPG and Health Biomarkers Estimation
par: Egorov, Konstantin, et autres
Publié: (2025)
par: Egorov, Konstantin, et autres
Publié: (2025)
Efficient Vision-based Vehicle Speed Estimation
par: Macko, Andrej, et autres
Publié: (2025)
par: Macko, Andrej, et autres
Publié: (2025)
FACEMUG: A Multimodal Generative and Fusion Framework for Local Facial Editing
par: Lu, Wanglong, et autres
Publié: (2024)
par: Lu, Wanglong, et autres
Publié: (2024)
Visual Style Prompt Learning Using Diffusion Models for Blind Face Restoration
par: Lu, Wanglong, et autres
Publié: (2024)
par: Lu, Wanglong, et autres
Publié: (2024)
Detailed Evaluation of Modern Machine Learning Approaches for Optic Plastics Sorting
par: Maheshkar, Vaishali, et autres
Publié: (2025)
par: Maheshkar, Vaishali, et autres
Publié: (2025)
PolyGlotFake: A Novel Multilingual and Multimodal DeepFake Dataset
par: Hou, Yang, et autres
Publié: (2024)
par: Hou, Yang, et autres
Publié: (2024)
Relightable and Dynamic Gaussian Avatar Reconstruction from Monocular Video
par: Choi, Seonghwa, et autres
Publié: (2025)
par: Choi, Seonghwa, et autres
Publié: (2025)
Stylized Face Sketch Extraction via Generative Prior with Limited Data
par: Yun, Kwan, et autres
Publié: (2024)
par: Yun, Kwan, et autres
Publié: (2024)
SymFace: Additional Facial Symmetry Loss for Deep Face Recognition
par: Prakash, Pritesh, et autres
Publié: (2024)
par: Prakash, Pritesh, et autres
Publié: (2024)
LeGO: Leveraging a Surface Deformation Network for Animatable Stylized Face Generation with One Example
par: Yoon, Soyeon, et autres
Publié: (2024)
par: Yoon, Soyeon, et autres
Publié: (2024)
EditP23: 3D Editing via Propagation of Image Prompts to Multi-View
par: Bar-On, Roi, et autres
Publié: (2025)
par: Bar-On, Roi, et autres
Publié: (2025)
N-DriverMotion: Driver motion learning and prediction using an event-based camera and directly trained spiking neural networks on Loihi 2
par: Chung, Hyo Jong, et autres
Publié: (2024)
par: Chung, Hyo Jong, et autres
Publié: (2024)
Few-Class Arena: A Benchmark for Efficient Selection of Vision Models and Dataset Difficulty Measurement
par: Cao, Bryan Bo, et autres
Publié: (2024)
par: Cao, Bryan Bo, et autres
Publié: (2024)
Event-ECC: Asynchronous Tracking of Events with Continuous Optimization
par: Zafeiri, Maria, et autres
Publié: (2024)
par: Zafeiri, Maria, et autres
Publié: (2024)
HieraEdgeNet: A Multi-Scale Edge-Enhanced Framework for Automated Pollen Recognition
par: Long, Yuchong, et autres
Publié: (2025)
par: Long, Yuchong, et autres
Publié: (2025)
The Impact of Image Resolution on Face Detection: A Comparative Analysis of MTCNN, YOLOv XI and YOLOv XII models
par: Ömercikoğlu, Ahmet Can, et autres
Publié: (2025)
par: Ömercikoğlu, Ahmet Can, et autres
Publié: (2025)
SelectiveKD: A semi-supervised framework for cancer detection in DBT through Knowledge Distillation and Pseudo-labeling
par: Dillard, Laurent, et autres
Publié: (2024)
par: Dillard, Laurent, et autres
Publié: (2024)
Distilling foundation models for robust and efficient models in digital pathology
par: Filiot, Alexandre, et autres
Publié: (2025)
par: Filiot, Alexandre, et autres
Publié: (2025)
Harnessing Deep Learning and Satellite Imagery for Post-Buyout Land Cover Mapping
par: Otal, Hakan T., et autres
Publié: (2024)
par: Otal, Hakan T., et autres
Publié: (2024)
Fixed-Threshold Evaluation of a Hybrid CNN-ViT for AI-Generated Image Detection Across Photos and Art
par: Khan, Md Ashik, et autres
Publié: (2025)
par: Khan, Md Ashik, et autres
Publié: (2025)
TextDoctor: Unified Document Image Inpainting via Patch Pyramid Diffusion Models
par: Lu, Wanglong, et autres
Publié: (2025)
par: Lu, Wanglong, et autres
Publié: (2025)
FastFit: Accelerating Multi-Reference Virtual Try-On via Cacheable Diffusion Models
par: Chong, Zheng, et autres
Publié: (2025)
par: Chong, Zheng, et autres
Publié: (2025)
DeepFusionNet: Autoencoder-Based Low-Light Image Enhancement and Super-Resolution
par: Çalışkan, Halil Hüseyin, et autres
Publié: (2025)
par: Çalışkan, Halil Hüseyin, et autres
Publié: (2025)
Tri-Plane Mamba: Efficiently Adapting Segment Anything Model for 3D Medical Images
par: Wang, Hualiang, et autres
Publié: (2024)
par: Wang, Hualiang, et autres
Publié: (2024)
StatsMerging: Statistics-Guided Model Merging via Task-Specific Teacher Distillation
par: Merugu, Ranjith, et autres
Publié: (2025)
par: Merugu, Ranjith, et autres
Publié: (2025)
Motion-Based Sign Language Video Summarization using Curvature and Torsion
par: Sartinas, Evangelos G., et autres
Publié: (2023)
par: Sartinas, Evangelos G., et autres
Publié: (2023)
Eleven Primitives and Three Gates: The Universal Structure of Computational Imaging
par: Yang, Chengshuai, et autres
Publié: (2026)
par: Yang, Chengshuai, et autres
Publié: (2026)
Rethinking VLMs for Image Forgery Detection and Localization
par: Guo, Shaofeng, et autres
Publié: (2026)
par: Guo, Shaofeng, et autres
Publié: (2026)
ForensicFormer: Hierarchical Multi-Scale Reasoning for Cross-Domain Image Forgery Detection
par: Samson, Hema Hariharan
Publié: (2026)
par: Samson, Hema Hariharan
Publié: (2026)
BG-YOLO: A Bidirectional-Guided Method for Underwater Object Detection
par: Zhang, Jian, et autres
Publié: (2024)
par: Zhang, Jian, et autres
Publié: (2024)
CatVTON: Concatenation Is All You Need for Virtual Try-On with Diffusion Models
par: Chong, Zheng, et autres
Publié: (2024)
par: Chong, Zheng, et autres
Publié: (2024)
SPEAK: Speech-Driven Pose and Emotion-Adjustable Talking Head Generation
par: Cai, Changpeng, et autres
Publié: (2024)
par: Cai, Changpeng, et autres
Publié: (2024)
CatV2TON: Taming Diffusion Transformers for Vision-Based Virtual Try-On with Temporal Concatenation
par: Chong, Zheng, et autres
Publié: (2025)
par: Chong, Zheng, et autres
Publié: (2025)
S3Simulator: A benchmarking Side Scan Sonar Simulator dataset for Underwater Image Analysis
par: S, Kamal Basha, et autres
Publié: (2024)
par: S, Kamal Basha, et autres
Publié: (2024)
Mapping Tomato Cropping Systems in California Using AlphaEarth Geospatial Embeddings and Deep Learning Analysis
par: Narimani, Mohammadreza, et autres
Publié: (2026)
par: Narimani, Mohammadreza, et autres
Publié: (2026)
Satellite-Net: Automatic Extraction of Land Cover Indicators from Satellite Imagery by Deep Learning
par: Bernasconi, Eleonora, et autres
Publié: (2019)
par: Bernasconi, Eleonora, et autres
Publié: (2019)
Balanced conic rectified flow
par: Kim, Shin Seong, et autres
Publié: (2025)
par: Kim, Shin Seong, et autres
Publié: (2025)
CADE 2.5 - ZeResFDG: Frequency-Decoupled, Rescaled and Zero-Projected Guidance for SD/SDXL Latent Diffusion Models
par: Rychkovskiy, Denis
Publié: (2025)
par: Rychkovskiy, Denis
Publié: (2025)
Identity Deepfake Threats to Biometric Authentication Systems: Public and Expert Perspectives
par: He, Shijing, et autres
Publié: (2025)
par: He, Shijing, et autres
Publié: (2025)
Documents similaires
-
CigTime: Corrective Instruction Generation Through Inverse Motion Editing
par: Fang, Qihang, et autres
Publié: (2024) -
Gaze into the Heart: A Multi-View Video Dataset for rPPG and Health Biomarkers Estimation
par: Egorov, Konstantin, et autres
Publié: (2025) -
Efficient Vision-based Vehicle Speed Estimation
par: Macko, Andrej, et autres
Publié: (2025) -
FACEMUG: A Multimodal Generative and Fusion Framework for Local Facial Editing
par: Lu, Wanglong, et autres
Publié: (2024) -
Visual Style Prompt Learning Using Diffusion Models for Blind Face Restoration
par: Lu, Wanglong, et autres
Publié: (2024)