LBMamba: Locally Bi-directional Mamba
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhang, Jingwei, Han, Xi, Qin, Hong, Hosseini, Mahdi S., Samaras, Dimitris |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
2DMamba: Efficient State Space Model for Image Representation with Applications on Giga-Pixel Whole Slide Image Classification
di: Zhang, Jingwei, et al.
Pubblicazione: (2024)
di: Zhang, Jingwei, et al.
Pubblicazione: (2024)
MonoLoss: A Training Objective for Interpretable Monosemantic Representations
di: Nasiri-Sarvi, Ali, et al.
Pubblicazione: (2026)
di: Nasiri-Sarvi, Ali, et al.
Pubblicazione: (2026)
Self-supervised co-salient object detection via feature correspondence at multiple scales
di: Chakraborty, Souradeep, et al.
Pubblicazione: (2024)
di: Chakraborty, Souradeep, et al.
Pubblicazione: (2024)
Vision Mamba for Classification of Breast Ultrasound Images
di: Nasiri-Sarvi, Ali, et al.
Pubblicazione: (2024)
di: Nasiri-Sarvi, Ali, et al.
Pubblicazione: (2024)
Diffusion-Refined VQA Annotations for Semi-Supervised Gaze Following
di: Miao, Qiaomu, et al.
Pubblicazione: (2024)
di: Miao, Qiaomu, et al.
Pubblicazione: (2024)
TopoDiffusionNet: A Topology-aware Diffusion Model
di: Gupta, Saumya, et al.
Pubblicazione: (2024)
di: Gupta, Saumya, et al.
Pubblicazione: (2024)
Weighting Pseudo-Labels via High-Activation Feature Index Similarity and Object Detection for Semi-Supervised Segmentation
di: Howlader, Prantik, et al.
Pubblicazione: (2024)
di: Howlader, Prantik, et al.
Pubblicazione: (2024)
Assessing Sample Quality via the Latent Space of Generative Models
di: Xu, Jingyi, et al.
Pubblicazione: (2024)
di: Xu, Jingyi, et al.
Pubblicazione: (2024)
Look Hear: Gaze Prediction for Speech-directed Human Attention
di: Mondal, Sounak, et al.
Pubblicazione: (2024)
di: Mondal, Sounak, et al.
Pubblicazione: (2024)
MI-NeRF: Learning a Single Face NeRF from Multiple Identities
di: Chatziagapi, Aggelina, et al.
Pubblicazione: (2024)
di: Chatziagapi, Aggelina, et al.
Pubblicazione: (2024)
MIGS: Multi-Identity Gaussian Splatting via Tensor Decomposition
di: Chatziagapi, Aggelina, et al.
Pubblicazione: (2024)
di: Chatziagapi, Aggelina, et al.
Pubblicazione: (2024)
Learning 3D Reconstruction with Priors in Test Time
di: Zhou, Lei, et al.
Pubblicazione: (2026)
di: Zhou, Lei, et al.
Pubblicazione: (2026)
Beyond Pixels: Semi-Supervised Semantic Segmentation with a Multi-scale Patch-based Multi-Label Classifier
di: Howlader, Prantik, et al.
Pubblicazione: (2024)
di: Howlader, Prantik, et al.
Pubblicazione: (2024)
Importance-Based Token Merging for Efficient Image and Video Generation
di: Wu, Haoyu, et al.
Pubblicazione: (2024)
di: Wu, Haoyu, et al.
Pubblicazione: (2024)
JEAN: Joint Expression and Audio-guided NeRF-based Talking Face Generation
di: Chakkera, Sai Tanmay Reddy, et al.
Pubblicazione: (2024)
di: Chakkera, Sai Tanmay Reddy, et al.
Pubblicazione: (2024)
Fast constrained sampling in pre-trained diffusion models
di: Graikos, Alexandros, et al.
Pubblicazione: (2024)
di: Graikos, Alexandros, et al.
Pubblicazione: (2024)
What about gravity in video generation? Post-Training Newton's Laws with Verifiable Rewards
di: Le, Minh-Quan, et al.
Pubblicazione: (2025)
di: Le, Minh-Quan, et al.
Pubblicazione: (2025)
Talking Head Generation via AU-Guided Landmark Prediction
di: Chang, Shao-Yu, et al.
Pubblicazione: (2025)
di: Chang, Shao-Yu, et al.
Pubblicazione: (2025)
PathSegDiff: Pathology Segmentation using Diffusion model representations
di: Danisetty, Sachin Kumar, et al.
Pubblicazione: (2025)
di: Danisetty, Sachin Kumar, et al.
Pubblicazione: (2025)
Rig3DGS: Creating Controllable Portraits from Casual Monocular Videos
di: Rivero, Alfredo, et al.
Pubblicazione: (2024)
di: Rivero, Alfredo, et al.
Pubblicazione: (2024)
Segment Any Crack: Deep Semantic Segmentation Adaptation for Crack Detection
di: Rostami, Ghodsiyeh, et al.
Pubblicazione: (2025)
di: Rostami, Ghodsiyeh, et al.
Pubblicazione: (2025)
One Attention, One Scale: Phase-Aligned Rotary Positional Embeddings for Mixed-Resolution Diffusion Transformer
di: Wu, Haoyu, et al.
Pubblicazione: (2025)
di: Wu, Haoyu, et al.
Pubblicazione: (2025)
Embedding Physical Reasoning into Diffusion-Based Shadow Generation
di: Hu, Shilin, et al.
Pubblicazione: (2025)
di: Hu, Shilin, et al.
Pubblicazione: (2025)
Cast and Attached Shadow Detection via Iterative Light and Geometry Reasoning
di: Hu, Shilin, et al.
Pubblicazione: (2025)
di: Hu, Shilin, et al.
Pubblicazione: (2025)
SI-MIL: Taming Deep MIL for Self-Interpretability in Gigapixel Histopathology
di: Kapse, Saarthak, et al.
Pubblicazione: (2023)
di: Kapse, Saarthak, et al.
Pubblicazione: (2023)
GriDiT: Factorized Grid-Based Diffusion for Efficient Long Image Sequence Generation
di: Tomar, Snehal Singh, et al.
Pubblicazione: (2025)
di: Tomar, Snehal Singh, et al.
Pubblicazione: (2025)
Shadow Removal Refinement via Material-Consistent Shadow Edges
di: Hu, Shilin, et al.
Pubblicazione: (2024)
di: Hu, Shilin, et al.
Pubblicazione: (2024)
BiSegMamba: Efficient Bidirectional Tri-Oriented Mamba for 3D Medical Image Segmentation
di: Zada, Bakht, et al.
Pubblicazione: (2026)
di: Zada, Bakht, et al.
Pubblicazione: (2026)
Vim4Path: Self-Supervised Vision Mamba for Histopathology Images
di: Nasiri-Sarvi, Ali, et al.
Pubblicazione: (2024)
di: Nasiri-Sarvi, Ali, et al.
Pubblicazione: (2024)
Learning Relighting and Intrinsic Decomposition in Neural Radiance Fields
di: Yang, Yixiong, et al.
Pubblicazione: (2024)
di: Yang, Yixiong, et al.
Pubblicazione: (2024)
MLI-NeRF: Multi-Light Intrinsic-Aware Neural Radiance Fields
di: Yang, Yixiong, et al.
Pubblicazione: (2024)
di: Yang, Yixiong, et al.
Pubblicazione: (2024)
Poppy: Polarization-based Plug-and-Play Guidance for Enhancing Monocular Normal Estimation
di: Kim, Irene, et al.
Pubblicazione: (2026)
di: Kim, Irene, et al.
Pubblicazione: (2026)
TalkinNeRF: Animatable Neural Fields for Full-Body Talking Humans
di: Chatziagapi, Aggelina, et al.
Pubblicazione: (2024)
di: Chatziagapi, Aggelina, et al.
Pubblicazione: (2024)
MaIR: A Locality- and Continuity-Preserving Mamba for Image Restoration
di: Li, Boyun, et al.
Pubblicazione: (2024)
di: Li, Boyun, et al.
Pubblicazione: (2024)
Q-MambaIR: Accurate Quantized Mamba for Efficient Image Restoration
di: Chen, Yujie, et al.
Pubblicazione: (2025)
di: Chen, Yujie, et al.
Pubblicazione: (2025)
Improving Contrastive Learning for Referring Expression Counting
di: Triaridis, Kostas, et al.
Pubblicazione: (2025)
di: Triaridis, Kostas, et al.
Pubblicazione: (2025)
CORA: Consistency-Guided Semi-Supervised Framework for Reasoning Segmentation
di: Howlader, Prantik, et al.
Pubblicazione: (2025)
di: Howlader, Prantik, et al.
Pubblicazione: (2025)
AV-Flow: Transforming Text to Audio-Visual Human-like Interactions
di: Chatziagapi, Aggelina, et al.
Pubblicazione: (2025)
di: Chatziagapi, Aggelina, et al.
Pubblicazione: (2025)
PISCES: Annotation-free Text-to-Video Post-Training via Optimal Transport-Aligned Rewards
di: Le, Minh-Quan, et al.
Pubblicazione: (2026)
di: Le, Minh-Quan, et al.
Pubblicazione: (2026)
$\infty$-Brush: Controllable Large Image Synthesis with Diffusion Models in Infinite Dimensions
di: Le, Minh-Quan, et al.
Pubblicazione: (2024)
di: Le, Minh-Quan, et al.
Pubblicazione: (2024)
Documenti analoghi
-
2DMamba: Efficient State Space Model for Image Representation with Applications on Giga-Pixel Whole Slide Image Classification
di: Zhang, Jingwei, et al.
Pubblicazione: (2024) -
MonoLoss: A Training Objective for Interpretable Monosemantic Representations
di: Nasiri-Sarvi, Ali, et al.
Pubblicazione: (2026) -
Self-supervised co-salient object detection via feature correspondence at multiple scales
di: Chakraborty, Souradeep, et al.
Pubblicazione: (2024) -
Vision Mamba for Classification of Breast Ultrasound Images
di: Nasiri-Sarvi, Ali, et al.
Pubblicazione: (2024) -
Diffusion-Refined VQA Annotations for Semi-Supervised Gaze Following
di: Miao, Qiaomu, et al.
Pubblicazione: (2024)