MxT: Mamba x Transformer for Image Inpainting
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Chen, Shuang, Atapour-Abarghouei, Amir, Zhang, Haozheng, Shum, Hubert P. H. |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
SEM-Net: Efficient Pixel Modelling for image inpainting with Spatially Enhanced SSM
par: Chen, Shuang, et autres
Publié: (2024)
par: Chen, Shuang, et autres
Publié: (2024)
HINT: High-quality INPainting Transformer with Mask-Aware Encoding and Enhanced Attention
par: Chen, Shuang, et autres
Publié: (2024)
par: Chen, Shuang, et autres
Publié: (2024)
CaFlow: Enhancing Long-Term Action Quality Assessment with Causal Counterfactual Flow
par: Han, Ruisheng, et autres
Publié: (2025)
par: Han, Ruisheng, et autres
Publié: (2025)
FineCausal: A Causal-Based Framework for Interpretable Fine-Grained Action Quality Assessment
par: Han, Ruisheng, et autres
Publié: (2025)
par: Han, Ruisheng, et autres
Publié: (2025)
BcQLM: Efficient Vision-Language Understanding with Distilled Q-Gated Cross-Modal Fusion
par: Xiang, Sike, et autres
Publié: (2025)
par: Xiang, Sike, et autres
Publié: (2025)
Exploring the Potentials of Spiking Neural Networks for Image Deraining
par: Chen, Shuang, et autres
Publié: (2025)
par: Chen, Shuang, et autres
Publié: (2025)
ART: Adaptive Relational Transformer for Pedestrian Trajectory Prediction with Temporal-Aware Relations
par: Li, Ruochen, et autres
Publié: (2026)
par: Li, Ruochen, et autres
Publié: (2026)
KD360-VoxelBEV: LiDAR and 360-degree Camera Cross Modality Knowledge Distillation for Bird's-Eye-View Segmentation
par: E, Wenke, et autres
Publié: (2025)
par: E, Wenke, et autres
Publié: (2025)
DEEP-SEA: Deep-Learning Enhancement for Environmental Perception in Submerged Aquatics
par: Chen, Shuang, et autres
Publié: (2025)
par: Chen, Shuang, et autres
Publié: (2025)
UIESNN: A Scale-Aware Spiking Network for Underwater Image Enhancement
par: Chen, Shuang, et autres
Publié: (2026)
par: Chen, Shuang, et autres
Publié: (2026)
Motion-Adaptive Multi-Scale Temporal Modelling with Skeleton-Constrained Spatial Graphs for Efficient 3D Human Pose Estimation
par: Li, Ruochen, et autres
Publié: (2026)
par: Li, Ruochen, et autres
Publié: (2026)
Depth-Aware Endoscopic Video Inpainting
par: Zhang, Francis Xiatian, et autres
Publié: (2024)
par: Zhang, Francis Xiatian, et autres
Publié: (2024)
Deep Learning-Enhanced Visual Monitoring in Hazardous Underwater Environments with a Swarm of Micro-Robots
par: Chen, Shuang, et autres
Publié: (2025)
par: Chen, Shuang, et autres
Publié: (2025)
Leveraging Imperfect Medical Data: A Manifold-Consistent Spatio-Temporal Network for Sensor-based Human Activity Recognition
par: Fan, Jiangtao, et autres
Publié: (2026)
par: Fan, Jiangtao, et autres
Publié: (2026)
Disentangling Racial Phenotypes: Fine-Grained Control of Race-related Facial Phenotype Characteristics
par: Yucer, Seyma, et autres
Publié: (2024)
par: Yucer, Seyma, et autres
Publié: (2024)
Checkup2Action: A Multimodal Clinical Check-up Report Dataset for Patient-Oriented Action Card Generation
par: Xiang, Sike, et autres
Publié: (2026)
par: Xiang, Sike, et autres
Publié: (2026)
TFDM: Time-Variant Frequency-Based Point Cloud Diffusion with Mamba
par: Liu, Jiaxu, et autres
Publié: (2025)
par: Liu, Jiaxu, et autres
Publié: (2025)
TOMD: A Trail-based Off-road Multimodal Dataset for Traversable Pathway Segmentation under Challenging Illumination Conditions
par: Sun, Yixin, et autres
Publié: (2025)
par: Sun, Yixin, et autres
Publié: (2025)
EEG-Driven Intention Decoding: Offline Deep Learning Benchmarking on a Robotic Rover
par: Alosaimi, Ghadah, et autres
Publié: (2026)
par: Alosaimi, Ghadah, et autres
Publié: (2026)
Artificial Intelligence for Geometry-Based Feature Extraction, Analysis and Synthesis in Artistic Images: A Survey
par: Vijendran, Mridula, et autres
Publié: (2024)
par: Vijendran, Mridula, et autres
Publié: (2024)
Geometric Features Enhanced Human-Object Interaction Detection
par: Zhu, Manli, et autres
Publié: (2024)
par: Zhu, Manli, et autres
Publié: (2024)
Insights from the Use of Previously Unseen Neural Architecture Search Datasets
par: Geada, Rob, et autres
Publié: (2024)
par: Geada, Rob, et autres
Publié: (2024)
Mind2Drive: Predicting Driver Intentions from EEG in Real-world On-Road Driving
par: Alosaimi, Ghadah, et autres
Publié: (2026)
par: Alosaimi, Ghadah, et autres
Publié: (2026)
Dur360BEV: A Real-world 360-degree Single Camera Dataset and Benchmark for Bird-Eye View Mapping in Autonomous Driving
par: E, Wenke, et autres
Publié: (2025)
par: E, Wenke, et autres
Publié: (2025)
One-Index Vector Quantization Based Adversarial Attack on Image Classification
par: Fan, Haiju, et autres
Publié: (2024)
par: Fan, Haiju, et autres
Publié: (2024)
Frequency-Domain Fusion Transformer for Image Inpainting
par: He, Sijin, et autres
Publié: (2025)
par: He, Sijin, et autres
Publié: (2025)
Two-Stage Human Verification using HandCAPTCHA and Anti-Spoofed Finger Biometrics with Feature Selection
par: Bera, Asish, et autres
Publié: (2024)
par: Bera, Asish, et autres
Publié: (2024)
Enhancing Surgical Performance in Cardiothoracic Surgery with Innovations from Computer Vision and Artificial Intelligence: A Narrative Review
par: Constable, Merryn D., et autres
Publié: (2024)
par: Constable, Merryn D., et autres
Publié: (2024)
InstaInpaint: Instant 3D-Scene Inpainting with Masked Large Reconstruction Model
par: You, Junqi, et autres
Publié: (2025)
par: You, Junqi, et autres
Publié: (2025)
Investigating Permutation-Invariant Discrete Representation Learning for Spatially Aligned Images
par: Stirling, Jamie S. J., et autres
Publié: (2026)
par: Stirling, Jamie S. J., et autres
Publié: (2026)
Aggregated Contextual Transformations for High-Resolution Image Inpainting
par: Zeng, Yanhong, et autres
Publié: (2021)
par: Zeng, Yanhong, et autres
Publié: (2021)
Motion In-Betweening for Densely Interacting Characters
par: Zhang, Xiaotang, et autres
Publié: (2025)
par: Zhang, Xiaotang, et autres
Publié: (2025)
From Inpainting to Layer Decomposition: Repurposing Generative Inpainting Models for Image Layer Decomposition
par: Chen, Jingxi, et autres
Publié: (2025)
par: Chen, Jingxi, et autres
Publié: (2025)
MaskMamba: A Hybrid Mamba-Transformer Model for Masked Image Generation
par: Chen, Wenchao, et autres
Publié: (2024)
par: Chen, Wenchao, et autres
Publié: (2024)
Controllable Image Generation with Composed Parallel Token Prediction
par: Stirling, Jamie, et autres
Publié: (2024)
par: Stirling, Jamie, et autres
Publié: (2024)
TraIL-Det: Transformation-Invariant Local Feature Networks for 3D LiDAR Object Detection with Unsupervised Pre-Training
par: Li, Li, et autres
Publié: (2024)
par: Li, Li, et autres
Publié: (2024)
Repeat and Concatenate: 2D to 3D Image Translation with 3D to 3D Generative Modeling
par: Corona-Figueroa, Abril, et autres
Publié: (2024)
par: Corona-Figueroa, Abril, et autres
Publié: (2024)
Two-Person Interaction Augmentation with Skeleton Priors
par: Li, Baiyi, et autres
Publié: (2024)
par: Li, Baiyi, et autres
Publié: (2024)
Geometric Image Editing via Effects-Sensitive In-Context Inpainting with Diffusion Transformers
par: Zhang, Shuo, et autres
Publié: (2026)
par: Zhang, Shuo, et autres
Publié: (2026)
Adaptive Graph Learning from Spatial Information for Surgical Workflow Anticipation
par: Zhang, Francis Xiatian, et autres
Publié: (2024)
par: Zhang, Francis Xiatian, et autres
Publié: (2024)
Documents similaires
-
SEM-Net: Efficient Pixel Modelling for image inpainting with Spatially Enhanced SSM
par: Chen, Shuang, et autres
Publié: (2024) -
HINT: High-quality INPainting Transformer with Mask-Aware Encoding and Enhanced Attention
par: Chen, Shuang, et autres
Publié: (2024) -
CaFlow: Enhancing Long-Term Action Quality Assessment with Causal Counterfactual Flow
par: Han, Ruisheng, et autres
Publié: (2025) -
FineCausal: A Causal-Based Framework for Interpretable Fine-Grained Action Quality Assessment
par: Han, Ruisheng, et autres
Publié: (2025) -
BcQLM: Efficient Vision-Language Understanding with Distilled Q-Gated Cross-Modal Fusion
par: Xiang, Sike, et autres
Publié: (2025)