From Pixels to Gigapixels: Bridging Local Inductive Bias and Long-Range Dependencies with Pixel-Mamba
Fuente:
arXiv
Guardado en:
| Autores principales: | Qiu, Zhongwei, Chao, Hanqing, Lin, Tiancheng, Chang, Wanxing, Yang, Zijiang, Jiao, Wenpei, Shen, Yixuan, Zhang, Yunshuo, Yang, Yelin, Liu, Wenbin, Jiang, Hui, Bian, Yun, Yan, Ke, Jin, Dakai, Lu, Le |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
From Histopathology Images to Cell Clouds: Learning Slide Representations with Hierarchical Cell Transformer
por: Yang, Zijiang, et al.
Publicado: (2024)
por: Yang, Zijiang, et al.
Publicado: (2024)
MUSE: Multi-Scale Dense Self-Distillation for Nucleus Detection and Classification
por: Yang, Zijiang, et al.
Publicado: (2025)
por: Yang, Zijiang, et al.
Publicado: (2025)
End-to-end Multi-source Visual Prompt Tuning for Survival Analysis in Whole Slide Images
por: Qiu, Zhongwei, et al.
Publicado: (2024)
por: Qiu, Zhongwei, et al.
Publicado: (2024)
DMIS: Dynamic Mesh-based Importance Sampling for Training Physics-Informed Neural Networks
por: Yang, Zijiang, et al.
Publicado: (2022)
por: Yang, Zijiang, et al.
Publicado: (2022)
PixelLM: Pixel Reasoning with Large Multimodal Model
por: Ren, Zhongwei, et al.
Publicado: (2023)
por: Ren, Zhongwei, et al.
Publicado: (2023)
MM-NeRF: Multimodal-Guided 3D Multi-Style Transfer of Neural Radiance Field
por: Yang, Zijiang, et al.
Publicado: (2023)
por: Yang, Zijiang, et al.
Publicado: (2023)
PixelWeb: The First Web GUI Dataset with Pixel-Wise Labels
por: Yang, Qi, et al.
Publicado: (2025)
por: Yang, Qi, et al.
Publicado: (2025)
Bridging the Semantic-Numerical Gap: A Numerical Reasoning Method of Cross-modal Knowledge Graph for Material Property Prediction
por: Song, Guangxuan, et al.
Publicado: (2023)
por: Song, Guangxuan, et al.
Publicado: (2023)
Semi-Mamba-UNet: Pixel-Level Contrastive and Pixel-Level Cross-Supervised Visual Mamba-based UNet for Semi-Supervised Medical Image Segmentation
por: Ma, Chao, et al.
Publicado: (2024)
por: Ma, Chao, et al.
Publicado: (2024)
PixelThink: Towards Efficient Chain-of-Pixel Reasoning
por: Wang, Song, et al.
Publicado: (2025)
por: Wang, Song, et al.
Publicado: (2025)
Not All Pixels Are Equal: Pixel-wise Meta-Learning for Medical Segmentation with Noisy Labels
por: Mu, Chenyu, et al.
Publicado: (2025)
por: Mu, Chenyu, et al.
Publicado: (2025)
YOLOMG: Vision-based Drone-to-Drone Detection with Appearance and Pixel-Level Motion Fusion
por: Guo, Hanqing, et al.
Publicado: (2025)
por: Guo, Hanqing, et al.
Publicado: (2025)
MambaMIL+: Modeling Long-Term Contextual Patterns for Gigapixel Whole Slide Image
por: Zeng, Qian, et al.
Publicado: (2025)
por: Zeng, Qian, et al.
Publicado: (2025)
PixelMan: Consistent Object Editing with Diffusion Models via Pixel Manipulation and Generation
por: Jiang, Liyao, et al.
Publicado: (2024)
por: Jiang, Liyao, et al.
Publicado: (2024)
Enhance the after-discharge mortality rate prediction via learning from the medical notes
por: Yang, Zijiang
Publicado: (2026)
por: Yang, Zijiang
Publicado: (2026)
Long-only cryptocurrency portfolio management by ranking the assets: a neural network approach
por: Yang, Zijiang
Publicado: (2025)
por: Yang, Zijiang
Publicado: (2025)
Improving the Natural Language Inference robustness to hard dataset by data augmentation and preprocessing
por: Yang, Zijiang
Publicado: (2024)
por: Yang, Zijiang
Publicado: (2024)
Enhance the machine learning algorithm performance in phishing detection with keyword features
por: Yang, Zijiang
Publicado: (2025)
por: Yang, Zijiang
Publicado: (2025)
Dynamic Range of SiPMs with High Pixel Densities
por: Zhao, Zhiyu, et al.
Publicado: (2024)
por: Zhao, Zhiyu, et al.
Publicado: (2024)
Structured Diffusion Bridges: Inductive Bias for Denoising Diffusion Bridges
por: Kosman, Eitan, et al.
Publicado: (2026)
por: Kosman, Eitan, et al.
Publicado: (2026)
UniPixel: Unified Object Referring and Segmentation for Pixel-Level Visual Reasoning
por: Liu, Ye, et al.
Publicado: (2025)
por: Liu, Ye, et al.
Publicado: (2025)
PixelVLA: Advancing Pixel-level Understanding in Vision-Language-Action Model
por: Liang, Wenqi, et al.
Publicado: (2025)
por: Liang, Wenqi, et al.
Publicado: (2025)
IPixMatch: Boost Semi-supervised Semantic Segmentation with Inter-Pixel Relation
por: Wu, Kebin, et al.
Publicado: (2024)
por: Wu, Kebin, et al.
Publicado: (2024)
Vision-Language Models for Automated 3D PET/CT Report Generation
por: Jiao, Wenpei, et al.
Publicado: (2025)
por: Jiao, Wenpei, et al.
Publicado: (2025)
Pixel super-resolved lensless on-chip sensor with scattering multiplexing
por: Chang, Xuyang, et al.
Publicado: (2021)
por: Chang, Xuyang, et al.
Publicado: (2021)
Pixel-SAIL: Single Transformer For Pixel-Grounded Understanding
por: Zhang, Tao, et al.
Publicado: (2025)
por: Zhang, Tao, et al.
Publicado: (2025)
PixelGen: Improving Pixel Diffusion with Perceptual Supervision
por: Ma, Zehong, et al.
Publicado: (2026)
por: Ma, Zehong, et al.
Publicado: (2026)
PixelFlow: Pixel-Space Generative Models with Flow
por: Chen, Shoufa, et al.
Publicado: (2025)
por: Chen, Shoufa, et al.
Publicado: (2025)
PixelDiT: Pixel Diffusion Transformers for Image Generation
por: Yu, Yongsheng, et al.
Publicado: (2025)
por: Yu, Yongsheng, et al.
Publicado: (2025)
Pixel-Bit
Publicado: (2021)
Publicado: (2021)
Cases • Pixels
por: Baudry, Julien
Publicado: (2019)
por: Baudry, Julien
Publicado: (2019)
Further Characterization of the JadePix-3 CMOS Pixel Sensor for the CEPC Vertex Detector: in Dependence of Substrate Reverse Bias
por: Hu, Jiahao, et al.
Publicado: (2025)
por: Hu, Jiahao, et al.
Publicado: (2025)
The Pixel Charging-up effect in Gas Micro-Pixel Detectors
por: Yi, Difan, et al.
Publicado: (2024)
por: Yi, Difan, et al.
Publicado: (2024)
PixelArena: A benchmark for Pixel-Precision Visual Intelligence
por: Liang, Feng, et al.
Publicado: (2025)
por: Liang, Feng, et al.
Publicado: (2025)
In Pursuit of Pixel Supervision for Visual Pre-training
por: Yang, Lihe, et al.
Publicado: (2025)
por: Yang, Lihe, et al.
Publicado: (2025)
Quantum Pixel Time: Emergent Temporality from Discrete Spatial Units
por: Yun, SangHoon
Publicado: (2025)
por: Yun, SangHoon
Publicado: (2025)
PixelConfig: Longitudinal Measurement and Reverse-Engineering of Meta Pixel Configurations
por: Ghani, Abdullah, et al.
Publicado: (2026)
por: Ghani, Abdullah, et al.
Publicado: (2026)
Goal2Pixel: Grounding Goals to Pixels for Vision-Language Navigation
por: Bao, Muyi, et al.
Publicado: (2026)
por: Bao, Muyi, et al.
Publicado: (2026)
GeoPixel: Pixel Grounding Large Multimodal Model in Remote Sensing
por: Shabbir, Akashah, et al.
Publicado: (2025)
por: Shabbir, Akashah, et al.
Publicado: (2025)
PixelShuffler: A Simple Image Translation Through Pixel Rearrangement
por: Zamzam, Omar
Publicado: (2024)
por: Zamzam, Omar
Publicado: (2024)
Ejemplares similares
-
From Histopathology Images to Cell Clouds: Learning Slide Representations with Hierarchical Cell Transformer
por: Yang, Zijiang, et al.
Publicado: (2024) -
MUSE: Multi-Scale Dense Self-Distillation for Nucleus Detection and Classification
por: Yang, Zijiang, et al.
Publicado: (2025) -
End-to-end Multi-source Visual Prompt Tuning for Survival Analysis in Whole Slide Images
por: Qiu, Zhongwei, et al.
Publicado: (2024) -
DMIS: Dynamic Mesh-based Importance Sampling for Training Physics-Informed Neural Networks
por: Yang, Zijiang, et al.
Publicado: (2022) -
PixelLM: Pixel Reasoning with Large Multimodal Model
por: Ren, Zhongwei, et al.
Publicado: (2023)