Autoregressive Sequence Modeling for 3D Medical Image Representation
Fuente:
arXiv
Guardado en:
| Autores principales: | Wang, Siwen, Wang, Churan, Gao, Fei, Su, Lixian, Zhang, Fandong, Wang, Yizhou, Yu, Yizhou |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Cross-Dimensional Medical Self-Supervised Representation Learning Based on a Pseudo-3D Transformation
por: Gao, Fei, et al.
Publicado: (2024)
por: Gao, Fei, et al.
Publicado: (2024)
Enhanced MRI Representation via Cross-series Masking
por: Wang, Churan, et al.
Publicado: (2024)
por: Wang, Churan, et al.
Publicado: (2024)
LDRNet: Large Deformation Registration Model for Chest CT Registration
por: Wang, Cheng, et al.
Publicado: (2026)
por: Wang, Cheng, et al.
Publicado: (2026)
Clinically-Grounded Counterfactual Reasoning for Medical Video Diagnosis
por: Gao, Jianzhe, et al.
Publicado: (2026)
por: Gao, Jianzhe, et al.
Publicado: (2026)
Clinical Inspired MRI Lesion Segmentation
por: Yan, Lijun, et al.
Publicado: (2025)
por: Yan, Lijun, et al.
Publicado: (2025)
SAT-HMR: Real-Time Multi-Person 3D Mesh Estimation via Scale-Adaptive Tokens
por: Su, Chi, et al.
Publicado: (2024)
por: Su, Chi, et al.
Publicado: (2024)
Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis
por: Zheng, Peng, et al.
Publicado: (2025)
por: Zheng, Peng, et al.
Publicado: (2025)
Hierarchical Instruction-aware Embodied Visual Tracking
por: Wu, Kui, et al.
Publicado: (2025)
por: Wu, Kui, et al.
Publicado: (2025)
Less Could Be Better: Parameter-efficient Fine-tuning Advances Medical Vision Foundation Models
por: Lian, Chenyu, et al.
Publicado: (2024)
por: Lian, Chenyu, et al.
Publicado: (2024)
3D Human Mesh Estimation from Virtual Markers
por: Ma, Xiaoxuan, et al.
Publicado: (2023)
por: Ma, Xiaoxuan, et al.
Publicado: (2023)
VLM Can Be a Good Assistant: Enhancing Embodied Visual Tracking with Self-Improving Vision-Language Models
por: Wu, Kui, et al.
Publicado: (2025)
por: Wu, Kui, et al.
Publicado: (2025)
D2C: Unlocking the Potential of Continuous Autoregressive Image Generation with Discrete Tokens
por: Wang, Panpan, et al.
Publicado: (2025)
por: Wang, Panpan, et al.
Publicado: (2025)
Towards Zero-shot 3D Anomaly Localization
por: Wang, Yizhou, et al.
Publicado: (2024)
por: Wang, Yizhou, et al.
Publicado: (2024)
Decomposing Subject-Driven Image Generation via Intermediate Structural Prediction
por: Guo, Hanzhong, et al.
Publicado: (2026)
por: Guo, Hanzhong, et al.
Publicado: (2026)
SuperNeRF-GAN: A Universal 3D-Consistent Super-Resolution Framework for Efficient and Enhanced 3D-Aware Image Synthesis
por: Zheng, Peng, et al.
Publicado: (2025)
por: Zheng, Peng, et al.
Publicado: (2025)
D-CoDe: Scaling Image-Pretrained VLMs to Video via Dynamic Compression and Question Decomposition
por: Huang, Yiyang, et al.
Publicado: (2025)
por: Huang, Yiyang, et al.
Publicado: (2025)
UnrealZoo: Enriching Photo-realistic Virtual Worlds for Embodied AI
por: Zhong, Fangwei, et al.
Publicado: (2024)
por: Zhong, Fangwei, et al.
Publicado: (2024)
Trajectory Mamba: Efficient Attention-Mamba Forecasting Model Based on Selective SSM
por: Huang, Yizhou, et al.
Publicado: (2025)
por: Huang, Yizhou, et al.
Publicado: (2025)
DeformCL: Learning Deformable Centerline Representation for Vessel Extraction in 3D Medical Image
por: Zhao, Ziwei, et al.
Publicado: (2025)
por: Zhao, Ziwei, et al.
Publicado: (2025)
Towards Training-free Anomaly Detection with Vision and Language Foundation Models
por: Zhang, Jinjin, et al.
Publicado: (2025)
por: Zhang, Jinjin, et al.
Publicado: (2025)
GeneMAN: Generalizable Single-Image 3D Human Reconstruction from Multi-Source Human Data
por: Wang, Wentao, et al.
Publicado: (2024)
por: Wang, Wentao, et al.
Publicado: (2024)
Parameters as Experts: Adapting Vision Models with Dynamic Parameter Routing
por: Lou, Meng, et al.
Publicado: (2026)
por: Lou, Meng, et al.
Publicado: (2026)
OverLoCK: An Overview-first-Look-Closely-next ConvNet with Context-Mixing Dynamic Kernels
por: Lou, Meng, et al.
Publicado: (2025)
por: Lou, Meng, et al.
Publicado: (2025)
MorphSeek: Fine-grained Latent Representation-Level Policy Optimization for Deformable Image Registration
por: Zhang, Runxun, et al.
Publicado: (2025)
por: Zhang, Runxun, et al.
Publicado: (2025)
OpenDance: Multimodal Controllable 3D Dance Generation with Large-scale Internet Data
por: Zhang, Jinlu, et al.
Publicado: (2025)
por: Zhang, Jinlu, et al.
Publicado: (2025)
Reasoning-Driven Anomaly Detection and Localization with Image-Level Supervision
por: Jin, Yizhou, et al.
Publicado: (2026)
por: Jin, Yizhou, et al.
Publicado: (2026)
SegMAN: Omni-scale Context Modeling with State Space Models and Local Attention for Semantic Segmentation
por: Fu, Yunxiang, et al.
Publicado: (2024)
por: Fu, Yunxiang, et al.
Publicado: (2024)
Confusing Pair Correction Based on Category Prototype for Domain Adaptation under Noisy Environments
por: Zhi, Churan, et al.
Publicado: (2024)
por: Zhi, Churan, et al.
Publicado: (2024)
Continuous Visual Autoregressive Generation via Score Maximization
por: Shao, Chenze, et al.
Publicado: (2025)
por: Shao, Chenze, et al.
Publicado: (2025)
RichControl: Structure- and Appearance-Rich Training-Free Spatial Control for Text-to-Image Generation
por: Pang, Lexi, et al.
Publicado: (2025)
por: Pang, Lexi, et al.
Publicado: (2025)
Model Optimization for Multi-Camera 3D Detection and Tracking
por: Anderson, Ethan, et al.
Publicado: (2026)
por: Anderson, Ethan, et al.
Publicado: (2026)
OVER-NAV: Elevating Iterative Vision-and-Language Navigation with Open-Vocabulary Detection and StructurEd Representation
por: Zhao, Ganlong, et al.
Publicado: (2024)
por: Zhao, Ganlong, et al.
Publicado: (2024)
A2Mamba: Attention-augmented State Space Models for Visual Recognition
por: Lou, Meng, et al.
Publicado: (2025)
por: Lou, Meng, et al.
Publicado: (2025)
CRISP: Rank-Guided Iterative Squeezing for Robust Medical Image Segmentation under Domain Shift
por: Fang, Yizhou, et al.
Publicado: (2026)
por: Fang, Yizhou, et al.
Publicado: (2026)
The Texture-Shape Dilemma: Boundary-Safe Synthetic Generation for 3D Medical Transformers
por: Tang, Jiaqi, et al.
Publicado: (2026)
por: Tang, Jiaqi, et al.
Publicado: (2026)
LaMamba-Diff: Linear-Time High-Fidelity Diffusion Models Based on Local Attention and Mamba
por: Fu, Yunxiang, et al.
Publicado: (2024)
por: Fu, Yunxiang, et al.
Publicado: (2024)
BARL: Bilateral Alignment in Representation and Label Spaces for Semi-Supervised Volumetric Medical Image Segmentation
por: Gao, Shujian, et al.
Publicado: (2025)
por: Gao, Shujian, et al.
Publicado: (2025)
Learning Generalizable 3D Medical Image Representations from Mask-Guided Self-Supervision
por: Gao, Yunhe, et al.
Publicado: (2026)
por: Gao, Yunhe, et al.
Publicado: (2026)
Forging a Dynamic Memory: Retrieval-Guided Continual Learning for Generalist Medical Foundation Models
por: Chen, Zizhi, et al.
Publicado: (2025)
por: Chen, Zizhi, et al.
Publicado: (2025)
FoSS: Modeling Long Range Dependencies and Multimodal Uncertainty in Trajectory Prediction via Fourier State Space Integration
por: Huang, Yizhou, et al.
Publicado: (2026)
por: Huang, Yizhou, et al.
Publicado: (2026)
Ejemplares similares
-
Cross-Dimensional Medical Self-Supervised Representation Learning Based on a Pseudo-3D Transformation
por: Gao, Fei, et al.
Publicado: (2024) -
Enhanced MRI Representation via Cross-series Masking
por: Wang, Churan, et al.
Publicado: (2024) -
LDRNet: Large Deformation Registration Model for Chest CT Registration
por: Wang, Cheng, et al.
Publicado: (2026) -
Clinically-Grounded Counterfactual Reasoning for Medical Video Diagnosis
por: Gao, Jianzhe, et al.
Publicado: (2026) -
Clinical Inspired MRI Lesion Segmentation
por: Yan, Lijun, et al.
Publicado: (2025)