FiVE: A Fine-grained Video Editing Benchmark for Evaluating Emerging Diffusion and Rectified Flow Models
Fuente:
arXiv
Saved in:
| Main Authors: | Li, Minghan, Xie, Chenxi, Wu, Yichen, Zhang, Lei, Wang, Mengyu |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
DNAEdit: Direct Noise Alignment for Text-Guided Rectified Flow Editing
by: Xie, Chenxi, et al.
Published: (2025)
by: Xie, Chenxi, et al.
Published: (2025)
Delta Rectified Flow Sampling for Text-to-Image Editing
by: Beaudouin, Gaspard, et al.
Published: (2025)
by: Beaudouin, Gaspard, et al.
Published: (2025)
MaSS13K: A Matting-level Semantic Segmentation Benchmark
by: Xie, Chenxi, et al.
Published: (2025)
by: Xie, Chenxi, et al.
Published: (2025)
SplitFlow: Flow Decomposition for Inversion-Free Text-to-Image Editing
by: Yoon, Sung-Hoon, et al.
Published: (2025)
by: Yoon, Sung-Hoon, et al.
Published: (2025)
FiVA: Fine-grained Visual Attribute Dataset for Text-to-Image Diffusion Models
by: Wu, Tong, et al.
Published: (2024)
by: Wu, Tong, et al.
Published: (2024)
DreamVE: Unified Instruction-based Image and Video Editing
by: Xia, Bin, et al.
Published: (2025)
by: Xia, Bin, et al.
Published: (2025)
Taming Rectified Flow for Inversion and Editing
by: Wang, Jiangshan, et al.
Published: (2024)
by: Wang, Jiangshan, et al.
Published: (2024)
FlowDirector: Training-Free Flow Steering for Precise Text-to-Video Editing
by: Li, Guangzhao, et al.
Published: (2025)
by: Li, Guangzhao, et al.
Published: (2025)
Adams Bashforth Moulton Solver for Inversion and Editing in Rectified Flow
by: Ma, Yongjia, et al.
Published: (2025)
by: Ma, Yongjia, et al.
Published: (2025)
OpenVE-3M: A Large-Scale High-Quality Dataset for Instruction-Guided Video Editing
by: He, Haoyang, et al.
Published: (2025)
by: He, Haoyang, et al.
Published: (2025)
VE-Bench: Subjective-Aligned Benchmark Suite for Text-Driven Video Editing Quality Assessment
by: Sun, Shangkun, et al.
Published: (2024)
by: Sun, Shangkun, et al.
Published: (2024)
FREE-Edit: Using Editing-aware Injection in Rectified Flow Models for Zero-shot Image-Driven Video Editing
by: Li, Maomao, et al.
Published: (2026)
by: Li, Maomao, et al.
Published: (2026)
FineMotion: A Dataset and Benchmark with both Spatial and Temporal Annotation for Fine-grained Motion Generation and Editing
by: Wu, Bizhu, et al.
Published: (2025)
by: Wu, Bizhu, et al.
Published: (2025)
Rectified Diffusion: Straightness Is Not Your Need in Rectified Flow
by: Wang, Fu-Yun, et al.
Published: (2024)
by: Wang, Fu-Yun, et al.
Published: (2024)
InsViE-1M: Effective Instruction-based Video Editing with Elaborate Dataset Construction
by: Wu, Yuhui, et al.
Published: (2025)
by: Wu, Yuhui, et al.
Published: (2025)
LaTo: Landmark-tokenized Diffusion Transformer for Fine-grained Human Face Editing
by: Zhang, Zhenghao, et al.
Published: (2025)
by: Zhang, Zhenghao, et al.
Published: (2025)
FireFlow: Fast Inversion of Rectified Flow for Image Semantic Editing
by: Deng, Yingying, et al.
Published: (2024)
by: Deng, Yingying, et al.
Published: (2024)
DiVE-k: Differential Visual Reasoning for Fine-grained Image Recognition
by: Kumar, Raja, et al.
Published: (2025)
by: Kumar, Raja, et al.
Published: (2025)
EditBoard: Towards a Comprehensive Evaluation Benchmark for Text-Based Video Editing Models
by: Chen, Yupeng, et al.
Published: (2024)
by: Chen, Yupeng, et al.
Published: (2024)
FluxSpace: Disentangled Semantic Editing in Rectified Flow Transformers
by: Dalva, Yusuf, et al.
Published: (2024)
by: Dalva, Yusuf, et al.
Published: (2024)
Streaming Video Diffusion: Online Video Editing with Diffusion Models
by: Chen, Feng, et al.
Published: (2024)
by: Chen, Feng, et al.
Published: (2024)
FluencyVE: Marrying Temporal-Aware Mamba with Bypass Attention for Video Editing
by: Cai, Mingshu, et al.
Published: (2025)
by: Cai, Mingshu, et al.
Published: (2025)
SteerFlow: Steering Rectified Flows for Faithful Inversion-Based Image Editing
by: Dao, Thinh, et al.
Published: (2026)
by: Dao, Thinh, et al.
Published: (2026)
FlowBypass: Rectified Flow Trajectory Bypass for Training-Free Image Editing
by: Han, Menglin, et al.
Published: (2026)
by: Han, Menglin, et al.
Published: (2026)
VCapsBench: A Large-scale Fine-grained Benchmark for Video Caption Quality Evaluation
by: Zhang, Shi-Xue, et al.
Published: (2025)
by: Zhang, Shi-Xue, et al.
Published: (2025)
Latent Space Disentanglement in Diffusion Transformers Enables Zero-shot Fine-grained Semantic Editing
by: Shuai, Zitao, et al.
Published: (2024)
by: Shuai, Zitao, et al.
Published: (2024)
Entropy Rectifying Guidance for Diffusion and Flow Models
by: Ifriqi, Tariq Berrada, et al.
Published: (2025)
by: Ifriqi, Tariq Berrada, et al.
Published: (2025)
SlimFlow: Training Smaller One-Step Diffusion Models with Rectified Flow
by: Zhu, Yuanzhi, et al.
Published: (2024)
by: Zhu, Yuanzhi, et al.
Published: (2024)
InstantEdit: Text-Guided Few-Step Image Editing with Piecewise Rectified Flow
by: Gong, Yiming, et al.
Published: (2025)
by: Gong, Yiming, et al.
Published: (2025)
DAPE: Dual-Stage Parameter-Efficient Fine-Tuning for Consistent Video Editing with Diffusion Models
by: Xia, Junhao, et al.
Published: (2025)
by: Xia, Junhao, et al.
Published: (2025)
RFDM: Residual Flow Diffusion Model for Efficient Causal Video Editing
by: Salehi, Mohammadreza, et al.
Published: (2026)
by: Salehi, Mohammadreza, et al.
Published: (2026)
FiT: Flexible Vision Transformer for Diffusion Model
by: Lu, Zeyu, et al.
Published: (2024)
by: Lu, Zeyu, et al.
Published: (2024)
FREAK: A Fine-grained Hallucination Evaluation Benchmark for Advanced MLLMs
by: Yin, Zhihan, et al.
Published: (2026)
by: Yin, Zhihan, et al.
Published: (2026)
SHALE: A Scalable Benchmark for Fine-grained Hallucination Evaluation in LVLMs
by: Yan, Bei, et al.
Published: (2025)
by: Yan, Bei, et al.
Published: (2025)
CoCoEdit: Content-Consistent Image Editing via Region Regularized Reinforcement Learning
by: Wu, Yuhui, et al.
Published: (2026)
by: Wu, Yuhui, et al.
Published: (2026)
EFDiT: Efficient Fine-grained Image Generation Using Diffusion Transformer Models
by: Wang, Kun, et al.
Published: (2025)
by: Wang, Kun, et al.
Published: (2025)
Blended Latent Diffusion under Attention Control for Real-World Video Editing
by: Liu, Deyin, et al.
Published: (2024)
by: Liu, Deyin, et al.
Published: (2024)
LORE: Latent Optimization for Precise Semantic Control in Rectified Flow-based Image Editing
by: Ouyang, Liangyang, et al.
Published: (2025)
by: Ouyang, Liangyang, et al.
Published: (2025)
Optimal Transport for Rectified Flow Image Editing: Unifying Inversion-Based and Direct Methods
by: Lupascu, Marian, et al.
Published: (2025)
by: Lupascu, Marian, et al.
Published: (2025)
Rectified-CFG++ for Flow Based Models
by: Saini, Shreshth, et al.
Published: (2025)
by: Saini, Shreshth, et al.
Published: (2025)
Similar Items
-
DNAEdit: Direct Noise Alignment for Text-Guided Rectified Flow Editing
by: Xie, Chenxi, et al.
Published: (2025) -
Delta Rectified Flow Sampling for Text-to-Image Editing
by: Beaudouin, Gaspard, et al.
Published: (2025) -
MaSS13K: A Matting-level Semantic Segmentation Benchmark
by: Xie, Chenxi, et al.
Published: (2025) -
SplitFlow: Flow Decomposition for Inversion-Free Text-to-Image Editing
by: Yoon, Sung-Hoon, et al.
Published: (2025) -
FiVA: Fine-grained Visual Attribute Dataset for Text-to-Image Diffusion Models
by: Wu, Tong, et al.
Published: (2024)