M3DDM+: An improved video outpainting by a modified masking strategy
Fuente:
arXiv
Salvato in:
| Autori principali: | Murakawa, Takuya, Fukuzawa, Takumi, Ding, Ning, Tamaki, Toru |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Fine-grained length controllable video captioning with ordinal embeddings
di: Nitta, Tomoya, et al.
Pubblicazione: (2024)
di: Nitta, Tomoya, et al.
Pubblicazione: (2024)
Can masking background and object reduce static bias for zero-shot action recognition?
di: Fukuzawa, Takumi, et al.
Pubblicazione: (2025)
di: Fukuzawa, Takumi, et al.
Pubblicazione: (2025)
Reflective Dialogue between Teacher and Solver Agents for Video Question Answering
di: Murakawa, Takuya, et al.
Pubblicazione: (2026)
di: Murakawa, Takuya, et al.
Pubblicazione: (2026)
MoExDA: Domain Adaptation for Edge-based Action Recognition
di: Sugimoto, Takuya, et al.
Pubblicazione: (2025)
di: Sugimoto, Takuya, et al.
Pubblicazione: (2025)
Shift and matching queries for video semantic segmentation
di: Mizuno, Tsubasa, et al.
Pubblicazione: (2024)
di: Mizuno, Tsubasa, et al.
Pubblicazione: (2024)
Multi-model learning by sequential reading of untrimmed videos for action recognition
di: Kamiya, Kodai, et al.
Pubblicazione: (2024)
di: Kamiya, Kodai, et al.
Pubblicazione: (2024)
BFMD: A Full-Match Badminton Dense Dataset for Dense Shot Captioning
di: Ding, Ning, et al.
Pubblicazione: (2026)
di: Ding, Ning, et al.
Pubblicazione: (2026)
Shot2Tactic-Caption: Multi-Scale Captioning of Badminton Videos for Tactical Understanding
di: Ding, Ning, et al.
Pubblicazione: (2025)
di: Ding, Ning, et al.
Pubblicazione: (2025)
Disentangling Static and Dynamic Information for Reducing Static Bias in Action Recognition
di: Kobayashi, Masato, et al.
Pubblicazione: (2025)
di: Kobayashi, Masato, et al.
Pubblicazione: (2025)
Online pre-training with long-form videos
di: Kato, Itsuki, et al.
Pubblicazione: (2024)
di: Kato, Itsuki, et al.
Pubblicazione: (2024)
Separating Shared and Domain-Specific LoRAs for Multi-Domain Learning
di: Takama, Yusaku, et al.
Pubblicazione: (2025)
di: Takama, Yusaku, et al.
Pubblicazione: (2025)
Query matching for spatio-temporal action detection with query-based object detector
di: Hori, Shimon, et al.
Pubblicazione: (2024)
di: Hori, Shimon, et al.
Pubblicazione: (2024)
Action tube generation by person query matching for spatio-temporal action detection
di: Omi, Kazuki, et al.
Pubblicazione: (2025)
di: Omi, Kazuki, et al.
Pubblicazione: (2025)
3DFlowRenderer: One-shot Face Re-enactment via Dense 3D Facial Flow Estimation
di: Nijhawan, Siddharth, et al.
Pubblicazione: (2024)
di: Nijhawan, Siddharth, et al.
Pubblicazione: (2024)
DDM: A Metric for Comparing 3D Shapes Using Directional Distance Fields
di: Ren, Siyu, et al.
Pubblicazione: (2024)
di: Ren, Siyu, et al.
Pubblicazione: (2024)
SemiDDM-Weather: A Semi-supervised Learning Framework for All-in-one Adverse Weather Removal
di: Long, Fang, et al.
Pubblicazione: (2024)
di: Long, Fang, et al.
Pubblicazione: (2024)
Attention-Guided Lidar Segmentation and Odometry Using Image-to-Point Cloud Saliency Transfer
di: Ding, Guanqun, et al.
Pubblicazione: (2023)
di: Ding, Guanqun, et al.
Pubblicazione: (2023)
Symmetric masking strategy enhances the performance of Masked Image Modeling
di: Nguyen, Khanh-Binh, et al.
Pubblicazione: (2024)
di: Nguyen, Khanh-Binh, et al.
Pubblicazione: (2024)
Space evaluation based on pitch control using drone video in Ultimate
di: Iwashita, Shunsuke, et al.
Pubblicazione: (2024)
di: Iwashita, Shunsuke, et al.
Pubblicazione: (2024)
Action-conditioned video data improves predictability
di: Sarkar, Meenakshi, et al.
Pubblicazione: (2024)
di: Sarkar, Meenakshi, et al.
Pubblicazione: (2024)
DepthFake: a depth-based strategy for detecting Deepfake videos
di: Maiano, Luca, et al.
Pubblicazione: (2022)
di: Maiano, Luca, et al.
Pubblicazione: (2022)
Stochastic positional embeddings improve masked image modeling
di: Bar, Amir, et al.
Pubblicazione: (2023)
di: Bar, Amir, et al.
Pubblicazione: (2023)
Learning to mask: Towards generalized face forgery detection
di: Fei, Jianwei, et al.
Pubblicazione: (2022)
di: Fei, Jianwei, et al.
Pubblicazione: (2022)
Anatomically-guided masked autoencoder pre-training for aneurysm detection
di: Ceballos-Arroyo, Alberto Mario, et al.
Pubblicazione: (2025)
di: Ceballos-Arroyo, Alberto Mario, et al.
Pubblicazione: (2025)
A multifractal-based masked auto-encoder: an application to medical images
di: Florindo, Joao Batista, et al.
Pubblicazione: (2026)
di: Florindo, Joao Batista, et al.
Pubblicazione: (2026)
Audio-visual training for improved grounding in video-text LLMs
di: Sagare, Shivprasad, et al.
Pubblicazione: (2024)
di: Sagare, Shivprasad, et al.
Pubblicazione: (2024)
FIPGNet:Pyramid grafting network with feature interaction strategies
di: Ding, Ziyi, et al.
Pubblicazione: (2024)
di: Ding, Ziyi, et al.
Pubblicazione: (2024)
Fast Self-Supervised depth and mask aware Association for Multi-Object Tracking
di: Khanchi, Milad, et al.
Pubblicazione: (2025)
di: Khanchi, Milad, et al.
Pubblicazione: (2025)
Toward Motion Robustness: A masked attention regularization framework in remote photoplethysmography
di: Zhao, Pengfei, et al.
Pubblicazione: (2024)
di: Zhao, Pengfei, et al.
Pubblicazione: (2024)
AnatoMask: Enhancing Medical Image Segmentation with Reconstruction-guided Self-masking
di: Li, Yuheng, et al.
Pubblicazione: (2024)
di: Li, Yuheng, et al.
Pubblicazione: (2024)
Bind-Your-Avatar: Multi-Talking-Character Video Generation with Dynamic 3D-mask-based Embedding Router
di: Huang, Yubo, et al.
Pubblicazione: (2025)
di: Huang, Yubo, et al.
Pubblicazione: (2025)
A dataset of medication images with instance segmentation masks for preventing adverse drug events
di: Chu, W. I., et al.
Pubblicazione: (2026)
di: Chu, W. I., et al.
Pubblicazione: (2026)
A method for tissue-mask supported whole-body image registration in the UK Biobank
di: Utkueri, Yasemin, et al.
Pubblicazione: (2025)
di: Utkueri, Yasemin, et al.
Pubblicazione: (2025)
Geometric Mean Improves Loss For Few-Shot Learning
di: Wu, Tong, et al.
Pubblicazione: (2025)
di: Wu, Tong, et al.
Pubblicazione: (2025)
Contrastive learning-based video quality assessment-jointed video vision transformer for video recognition
di: Sun, Jian, et al.
Pubblicazione: (2026)
di: Sun, Jian, et al.
Pubblicazione: (2026)
PiClick: Picking the desired mask from multiple candidates in click-based interactive segmentation
di: Yan, Cilin, et al.
Pubblicazione: (2023)
di: Yan, Cilin, et al.
Pubblicazione: (2023)
Contrastive masked auto-encoders based self-supervised hashing for 2D image and 3D point cloud cross-modal retrieval
di: Wei, Rukai, et al.
Pubblicazione: (2024)
di: Wei, Rukai, et al.
Pubblicazione: (2024)
VidGen-1M: A Large-Scale Dataset for Text-to-video Generation
di: Tan, Zhiyu, et al.
Pubblicazione: (2024)
di: Tan, Zhiyu, et al.
Pubblicazione: (2024)
Online 3D reconstruction and dense tracking in endoscopic videos
di: Hayoz, Michel, et al.
Pubblicazione: (2024)
di: Hayoz, Michel, et al.
Pubblicazione: (2024)
Co-distilled attention guided masked image modeling with noisy teacher for self-supervised learning on medical images
di: Jiang, Jue, et al.
Pubblicazione: (2026)
di: Jiang, Jue, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Fine-grained length controllable video captioning with ordinal embeddings
di: Nitta, Tomoya, et al.
Pubblicazione: (2024) -
Can masking background and object reduce static bias for zero-shot action recognition?
di: Fukuzawa, Takumi, et al.
Pubblicazione: (2025) -
Reflective Dialogue between Teacher and Solver Agents for Video Question Answering
di: Murakawa, Takuya, et al.
Pubblicazione: (2026) -
MoExDA: Domain Adaptation for Edge-based Action Recognition
di: Sugimoto, Takuya, et al.
Pubblicazione: (2025) -
Shift and matching queries for video semantic segmentation
di: Mizuno, Tsubasa, et al.
Pubblicazione: (2024)