FlexiEdit: Frequency-Aware Latent Refinement for Enhanced Non-Rigid Editing
Fuente:
arXiv
Guardado en:
| Autores principales: | Koo, Gwanhyeong, Yoon, Sunjae, Hong, Ji Woo, Yoo, Chang D. |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
DNI: Dilutional Noise Initialization for Diffusion Video Editing
por: Yoon, Sunjae, et al.
Publicado: (2024)
por: Yoon, Sunjae, et al.
Publicado: (2024)
FRAG: Frequency Adapting Group for Diffusion Video Editing
por: Yoon, Sunjae, et al.
Publicado: (2024)
por: Yoon, Sunjae, et al.
Publicado: (2024)
Wavelet-Guided Acceleration of Text Inversion in Diffusion-Based Image Editing
por: Koo, Gwanhyeong, et al.
Publicado: (2024)
por: Koo, Gwanhyeong, et al.
Publicado: (2024)
FlowDrag: 3D-aware Drag-based Image Editing with Mesh-guided Deformation Vector Flow Fields
por: Koo, Gwanhyeong, et al.
Publicado: (2025)
por: Koo, Gwanhyeong, et al.
Publicado: (2025)
SCANet: Scene Complexity Aware Network for Weakly-Supervised Video Moment Retrieval
por: Yoon, Sunjae, et al.
Publicado: (2023)
por: Yoon, Sunjae, et al.
Publicado: (2023)
Occlusion-robust Stylization for Drawing-based 3D Animation
por: Yoon, Sunjae, et al.
Publicado: (2025)
por: Yoon, Sunjae, et al.
Publicado: (2025)
TPC: Test-time Procrustes Calibration for Diffusion-based Human Image Animation
por: Yoon, Sunjae, et al.
Publicado: (2024)
por: Yoon, Sunjae, et al.
Publicado: (2024)
ITA-MDT: Image-Timestep-Adaptive Masked Diffusion Transformer Framework for Image-Based Virtual Try-On
por: Hong, Ji Woo, et al.
Publicado: (2025)
por: Hong, Ji Woo, et al.
Publicado: (2025)
High-Fidelity Text-to-Image Generation from Pre-Trained Vision-Language Models via Distribution-Conditioned Diffusion Decoding
por: Hong, Ji Woo, et al.
Publicado: (2026)
por: Hong, Ji Woo, et al.
Publicado: (2026)
Selective Query-guided Debiasing for Video Corpus Moment Retrieval
por: Yoon, Sunjae, et al.
Publicado: (2022)
por: Yoon, Sunjae, et al.
Publicado: (2022)
AVI-Edit: Audio-sync Video Instance Editing with Granularity-Aware Mask Refiner
por: Zheng, Haojie, et al.
Publicado: (2025)
por: Zheng, Haojie, et al.
Publicado: (2025)
Neural Pose Representation Learning for Generating and Transferring Non-Rigid Object Poses
por: Yoo, Seungwoo, et al.
Publicado: (2024)
por: Yoo, Seungwoo, et al.
Publicado: (2024)
TARO: Timestep-Adaptive Representation Alignment with Onset-Aware Conditioning for Synchronized Video-to-Audio Synthesis
por: Ton, Tri, et al.
Publicado: (2025)
por: Ton, Tri, et al.
Publicado: (2025)
EditRefiner: A Human-Aligned Agentic Framework for Image Editing Refinement
por: Xu, Zitong, et al.
Publicado: (2026)
por: Xu, Zitong, et al.
Publicado: (2026)
Beyond Rigid: Benchmarking Non-Rigid Video Editing
por: Qu, Bingzheng, et al.
Publicado: (2026)
por: Qu, Bingzheng, et al.
Publicado: (2026)
DesignEdit: Multi-Layered Latent Decomposition and Fusion for Unified & Accurate Image Editing
por: Jia, Yueru, et al.
Publicado: (2024)
por: Jia, Yueru, et al.
Publicado: (2024)
ResetEdit: Precise Text-guided Editing of Generated Image via Resettable Starting Latent
por: Wang, Hanyi, et al.
Publicado: (2026)
por: Wang, Hanyi, et al.
Publicado: (2026)
Rethinking Where to Edit: Task-Aware Localization for Instruction-Based Image Editing
por: He, Jingxuan, et al.
Publicado: (2026)
por: He, Jingxuan, et al.
Publicado: (2026)
GranAlign: Granularity-Aware Alignment Framework for Zero-Shot Video Moment Retrieval
por: Jeon, Mingyu, et al.
Publicado: (2026)
por: Jeon, Mingyu, et al.
Publicado: (2026)
Learning Complex Non-Rigid Image Edits from Multimodal Conditioning
por: Warner, Nikolai, et al.
Publicado: (2024)
por: Warner, Nikolai, et al.
Publicado: (2024)
LatentEdit: Adaptive Latent Control for Consistent Semantic Editing
por: Liu, Siyi, et al.
Publicado: (2025)
por: Liu, Siyi, et al.
Publicado: (2025)
FDS: Frequency-Aware Denoising Score for Text-Guided Latent Diffusion Image Editing
por: Ren, Yufan, et al.
Publicado: (2025)
por: Ren, Yufan, et al.
Publicado: (2025)
Unified Diffusion-Based Rigid and Non-Rigid Editing with Text and Image Guidance
por: Wang, Jiacheng, et al.
Publicado: (2024)
por: Wang, Jiacheng, et al.
Publicado: (2024)
FlexiDreamer: Single Image-to-3D Generation with FlexiCubes
por: Zhao, Ruowen, et al.
Publicado: (2024)
por: Zhao, Ruowen, et al.
Publicado: (2024)
A Hidden Semantic Bottleneck in Conditional Embeddings of Diffusion Transformers
por: Pham, Trung X., et al.
Publicado: (2026)
por: Pham, Trung X., et al.
Publicado: (2026)
CARE-Edit: Condition-Aware Routing of Experts for Contextual Image Editing
por: Wang, Yucheng, et al.
Publicado: (2026)
por: Wang, Yucheng, et al.
Publicado: (2026)
ByteMorph: Benchmarking Instruction-Guided Image Editing with Non-Rigid Motions
por: Chang, Di, et al.
Publicado: (2025)
por: Chang, Di, et al.
Publicado: (2025)
FreqEdit: Preserving High-Frequency Features for Robust Multi-Turn Image Editing
por: Liao, Yucheng, et al.
Publicado: (2025)
por: Liao, Yucheng, et al.
Publicado: (2025)
ReasonEdit: Towards Reasoning-Enhanced Image Editing Models
por: Yin, Fukun, et al.
Publicado: (2025)
por: Yin, Fukun, et al.
Publicado: (2025)
Edit-Compass & EditReward-Compass: A Unified Benchmark for Image Editing and Reward Modeling
por: Bai, Xuehai, et al.
Publicado: (2026)
por: Bai, Xuehai, et al.
Publicado: (2026)
HierEdit: Region-Aware Hierarchical Diffusion for Efficient High-Resolution Editing
por: Zhang, Yuyao, et al.
Publicado: (2026)
por: Zhang, Yuyao, et al.
Publicado: (2026)
ExpertEdit: Learning Skill-Aware Motion Editing from Expert Videos
por: Somayazulu, Arjun, et al.
Publicado: (2026)
por: Somayazulu, Arjun, et al.
Publicado: (2026)
VidEdit: Zero-Shot and Spatially Aware Text-Driven Video Editing
por: Couairon, Paul, et al.
Publicado: (2023)
por: Couairon, Paul, et al.
Publicado: (2023)
SALAD: Part-Level Latent Diffusion for 3D Shape Generation and Manipulation
por: Koo, Juil, et al.
Publicado: (2023)
por: Koo, Juil, et al.
Publicado: (2023)
FlexiMo: A Flexible Remote Sensing Foundation Model
por: Li, Xuyang, et al.
Publicado: (2025)
por: Li, Xuyang, et al.
Publicado: (2025)
ScribbleEdit: Synthetic Data for Image Editing with Scribbles and Text
por: Ji, Anya, et al.
Publicado: (2026)
por: Ji, Anya, et al.
Publicado: (2026)
EditDuet: A Multi-Agent System for Video Non-Linear Editing
por: Sandoval-Castaneda, Marcelo, et al.
Publicado: (2025)
por: Sandoval-Castaneda, Marcelo, et al.
Publicado: (2025)
GalaxyEdit: Large-Scale Image Editing Dataset with Enhanced Diffusion Adapter
por: Bala, Aniruddha, et al.
Publicado: (2024)
por: Bala, Aniruddha, et al.
Publicado: (2024)
FIA-Edit: Frequency-Interactive Attention for Efficient and High-Fidelity Inversion-Free Text-Guided Image Editing
por: Yang, Kaixiang, et al.
Publicado: (2025)
por: Yang, Kaixiang, et al.
Publicado: (2025)
UltraEdit: Instruction-based Fine-Grained Image Editing at Scale
por: Zhao, Haozhe, et al.
Publicado: (2024)
por: Zhao, Haozhe, et al.
Publicado: (2024)
Ejemplares similares
-
DNI: Dilutional Noise Initialization for Diffusion Video Editing
por: Yoon, Sunjae, et al.
Publicado: (2024) -
FRAG: Frequency Adapting Group for Diffusion Video Editing
por: Yoon, Sunjae, et al.
Publicado: (2024) -
Wavelet-Guided Acceleration of Text Inversion in Diffusion-Based Image Editing
por: Koo, Gwanhyeong, et al.
Publicado: (2024) -
FlowDrag: 3D-aware Drag-based Image Editing with Mesh-guided Deformation Vector Flow Fields
por: Koo, Gwanhyeong, et al.
Publicado: (2025) -
SCANet: Scene Complexity Aware Network for Weakly-Supervised Video Moment Retrieval
por: Yoon, Sunjae, et al.
Publicado: (2023)