DragAnything: Motion Control for Anything using Entity Representation
Fuente:
arXiv
Guardado en:
| Autores principales: | Wu, Weijia, Li, Zhuang, Gu, Yuchao, Zhao, Rui, He, Yefei, Zhang, David Junhao, Shou, Mike Zheng, Li, Yan, Gao, Tingting, Zhang, Di |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Paragraph-to-Image Generation with Information-Enriched Diffusion Model
por: Wu, Weijia, et al.
Publicado: (2023)
por: Wu, Weijia, et al.
Publicado: (2023)
Long-Context Autoregressive Video Modeling with Next-Frame Prediction
por: Gu, Yuchao, et al.
Publicado: (2025)
por: Gu, Yuchao, et al.
Publicado: (2025)
Motion Anything: Any to Motion Generation
por: Zhang, Zeyu, et al.
Publicado: (2025)
por: Zhang, Zeyu, et al.
Publicado: (2025)
Streaming Drag-Oriented Interactive Video Manipulation: Drag Anything, Anytime!
por: Zhou, Junbao, et al.
Publicado: (2025)
por: Zhou, Junbao, et al.
Publicado: (2025)
MakeAnything: Harnessing Diffusion Transformers for Multi-Domain Procedural Sequence Generation
por: Song, Yiren, et al.
Publicado: (2025)
por: Song, Yiren, et al.
Publicado: (2025)
FramePrompt: In-context Controllable Animation with Zero Structural Changes
por: Fang, Guian, et al.
Publicado: (2025)
por: Fang, Guian, et al.
Publicado: (2025)
FastDrag: Manipulate Anything in One Step
por: Zhao, Xuanjia, et al.
Publicado: (2024)
por: Zhao, Xuanjia, et al.
Publicado: (2024)
Object Placement for Anything
por: Gao, Bingjie, et al.
Publicado: (2025)
por: Gao, Bingjie, et al.
Publicado: (2025)
Matching Anything by Segmenting Anything
por: Li, Siyuan, et al.
Publicado: (2024)
por: Li, Siyuan, et al.
Publicado: (2024)
Perceive Anything: Recognize, Explain, Caption, and Segment Anything in Images and Videos
por: Lin, Weifeng, et al.
Publicado: (2025)
por: Lin, Weifeng, et al.
Publicado: (2025)
Count Anything
por: Lei, Mengqi, et al.
Publicado: (2026)
por: Lei, Mengqi, et al.
Publicado: (2026)
DoraCycle: Domain-Oriented Adaptation of Unified Generative Model in Multimodal Cycles
por: Zhao, Rui, et al.
Publicado: (2025)
por: Zhao, Rui, et al.
Publicado: (2025)
Causal Prompt Calibration Guided Segment Anything Model for Open-Vocabulary Multi-Entity Segmentation
por: Wang, Jingyao, et al.
Publicado: (2025)
por: Wang, Jingyao, et al.
Publicado: (2025)
Unifying Segment Anything in Microscopy with Vision-Language Knowledge
por: Li, Manyu, et al.
Publicado: (2025)
por: Li, Manyu, et al.
Publicado: (2025)
SynergyAmodal: Deocclude Anything with Text Control
por: Li, Xinyang, et al.
Publicado: (2025)
por: Li, Xinyang, et al.
Publicado: (2025)
Place Anything into Any Video
por: Liu, Ziling, et al.
Publicado: (2024)
por: Liu, Ziling, et al.
Publicado: (2024)
MoCapAnything V2: End-to-End Motion Capture for Arbitrary Skeletons
por: Gong, Kehong, et al.
Publicado: (2026)
por: Gong, Kehong, et al.
Publicado: (2026)
Segment and Caption Anything
por: Huang, Xiaoke, et al.
Publicado: (2023)
por: Huang, Xiaoke, et al.
Publicado: (2023)
AnimateAnything: Consistent and Controllable Animation for Video Generation
por: Lei, Guojun, et al.
Publicado: (2024)
por: Lei, Guojun, et al.
Publicado: (2024)
Get In Video: Add Anything You Want to the Video
por: Zhuang, Shaobin, et al.
Publicado: (2025)
por: Zhuang, Shaobin, et al.
Publicado: (2025)
Register Anything: Estimating "Corresponding Prompts" for Segment Anything Model
por: Huang, Shiqi, et al.
Publicado: (2025)
por: Huang, Shiqi, et al.
Publicado: (2025)
SAQ-SAM: Semantically-Aligned Quantization for Segment Anything Model
por: Zhang, Jing, et al.
Publicado: (2025)
por: Zhang, Jing, et al.
Publicado: (2025)
Edit Transfer: Learning Image Editing via Vision In-Context Relations
por: Chen, Lan, et al.
Publicado: (2025)
por: Chen, Lan, et al.
Publicado: (2025)
Segment Anything in Medical Images
por: Ma, Jun, et al.
Publicado: (2023)
por: Ma, Jun, et al.
Publicado: (2023)
Task Me Anything
por: Zhang, Jieyu, et al.
Publicado: (2024)
por: Zhang, Jieyu, et al.
Publicado: (2024)
Show-1: Marrying Pixel and Latent Diffusion Models for Text-to-Video Generation
por: Zhang, David Junhao, et al.
Publicado: (2023)
por: Zhang, David Junhao, et al.
Publicado: (2023)
MoCapAnything: Unified 3D Motion Capture for Arbitrary Skeletons from Monocular Videos
por: Gong, Kehong, et al.
Publicado: (2025)
por: Gong, Kehong, et al.
Publicado: (2025)
AnyFlow: Any-Step Video Diffusion Model with On-Policy Flow Map Distillation
por: Gu, Yuchao, et al.
Publicado: (2026)
por: Gu, Yuchao, et al.
Publicado: (2026)
DragEntity: Trajectory Guided Video Generation using Entity and Positional Relationships
por: Wan, Zhang, et al.
Publicado: (2024)
por: Wan, Zhang, et al.
Publicado: (2024)
Segment Anything for Videos: A Systematic Survey
por: Zhang, Chunhui, et al.
Publicado: (2024)
por: Zhang, Chunhui, et al.
Publicado: (2024)
Lightening Anything in Medical Images
por: Fei, Ben, et al.
Publicado: (2024)
por: Fei, Ben, et al.
Publicado: (2024)
Biomedical SAM 2: Segment Anything in Biomedical Images and Videos
por: Yan, Zhiling, et al.
Publicado: (2024)
por: Yan, Zhiling, et al.
Publicado: (2024)
SAMRefiner: Taming Segment Anything Model for Universal Mask Refinement
por: Lin, Yuqi, et al.
Publicado: (2025)
por: Lin, Yuqi, et al.
Publicado: (2025)
Multimodal OCR: Parse Anything from Documents
por: Zheng, Handong, et al.
Publicado: (2026)
por: Zheng, Handong, et al.
Publicado: (2026)
Separate Anything You Describe
por: Liu, Xubo, et al.
Publicado: (2023)
por: Liu, Xubo, et al.
Publicado: (2023)
Hearing Anything Anywhere
por: Wang, Mason, et al.
Publicado: (2024)
por: Wang, Mason, et al.
Publicado: (2024)
MetricAnything: Scaling Metric Depth Pretraining with Noisy Heterogeneous Sources
por: Ma, Baorui, et al.
Publicado: (2026)
por: Ma, Baorui, et al.
Publicado: (2026)
Detect Anything 3D in the Wild
por: Zhang, Hanxue, et al.
Publicado: (2025)
por: Zhang, Hanxue, et al.
Publicado: (2025)
DA$^{2}$: Depth Anything in Any Direction
por: Li, Haodong, et al.
Publicado: (2025)
por: Li, Haodong, et al.
Publicado: (2025)
Flatten Anything: Unsupervised Neural Surface Parameterization
por: Zhang, Qijian, et al.
Publicado: (2024)
por: Zhang, Qijian, et al.
Publicado: (2024)
Ejemplares similares
-
Paragraph-to-Image Generation with Information-Enriched Diffusion Model
por: Wu, Weijia, et al.
Publicado: (2023) -
Long-Context Autoregressive Video Modeling with Next-Frame Prediction
por: Gu, Yuchao, et al.
Publicado: (2025) -
Motion Anything: Any to Motion Generation
por: Zhang, Zeyu, et al.
Publicado: (2025) -
Streaming Drag-Oriented Interactive Video Manipulation: Drag Anything, Anytime!
por: Zhou, Junbao, et al.
Publicado: (2025) -
MakeAnything: Harnessing Diffusion Transformers for Multi-Domain Procedural Sequence Generation
por: Song, Yiren, et al.
Publicado: (2025)