Mind-Omni: A Unified Multi-Task Framework for Brain-Vision-Language Modeling via Discrete Diffusion
Fuente:
arXiv
Saved in:
| Main Authors: | Lu, Yizhuo, Du, Changde, Shi, Qingyu, Chen, Hang, Peng, Jie, Jiang, Liuyun, Zhao, Shuangchen, He, Huiguang |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Versatile Framework with Semantic and Structural guidance for Image Reconstruction from Brain Activity
by: Lu, Yizhuo, et al.
Published: (2026)
by: Lu, Yizhuo, et al.
Published: (2026)
Animate Your Thoughts: Decoupled Reconstruction of Dynamic Natural Vision from Slow Brain Activity
by: Lu, Yizhuo, et al.
Published: (2024)
by: Lu, Yizhuo, et al.
Published: (2024)
NeuralOOD: Improving Out-of-Distribution Generalization Performance with Brain-machine Fusion Learning Framework
by: Zhao, Shuangchen, et al.
Published: (2024)
by: Zhao, Shuangchen, et al.
Published: (2024)
Multi-label Class Incremental Emotion Decoding with Augmented Emotional Semantics Learning
by: Fu, Kaicheng, et al.
Published: (2024)
by: Fu, Kaicheng, et al.
Published: (2024)
CLIP-MUSED: CLIP-Guided Multi-Subject Visual Neural Information Semantic Decoding
by: Zhou, Qiongyi, et al.
Published: (2024)
by: Zhou, Qiongyi, et al.
Published: (2024)
Identifying the Hierarchical Emotional Areas in the Human Brain Through Information Fusion
by: Huang, Zhongyu, et al.
Published: (2024)
by: Huang, Zhongyu, et al.
Published: (2024)
Bridging the behavior-neural gap: A multimodal AI reveals the brain's geometry of emotion more accurately than human self-reports
by: Du, Changde, et al.
Published: (2025)
by: Du, Changde, et al.
Published: (2025)
Reverse the auditory processing pathway: Coarse-to-fine audio reconstruction from fMRI
by: Liu, Che, et al.
Published: (2024)
by: Liu, Che, et al.
Published: (2024)
NeuroMamba: Multi-Perspective Feature Interaction with Visual Mamba for Neuron Segmentation
by: Jiang, Liuyun, et al.
Published: (2026)
by: Jiang, Liuyun, et al.
Published: (2026)
BP-GPT: Auditory Neural Decoding Using fMRI-prompted LLM
by: Chen, Xiaoyu, et al.
Published: (2025)
by: Chen, Xiaoyu, et al.
Published: (2025)
Open-vocabulary Auditory Neural Decoding Using fMRI-prompted LLM
by: Chen, Xiaoyu, et al.
Published: (2024)
by: Chen, Xiaoyu, et al.
Published: (2024)
PGCN: Pyramidal Graph Convolutional Network for EEG Emotion Recognition
by: Jin, Ming, et al.
Published: (2023)
by: Jin, Ming, et al.
Published: (2023)
Diffusion Model-Based Data Augmentation for Enhanced Neuron Segmentation
by: Jiang, Liuyun, et al.
Published: (2026)
by: Jiang, Liuyun, et al.
Published: (2026)
Omni-Diffusion: Unified Multimodal Understanding and Generation with Masked Discrete Diffusion
by: Li, Lijiang, et al.
Published: (2026)
by: Li, Lijiang, et al.
Published: (2026)
UniMind: Unleashing the Power of LLMs for Unified Multi-Task Brain Decoding
by: Lu, Weiheng, et al.
Published: (2025)
by: Lu, Weiheng, et al.
Published: (2025)
Exploring EEG and Eye Movement Fusion for Multi-Class Target RSVP-BCI
by: Li, Xujin, et al.
Published: (2025)
by: Li, Xujin, et al.
Published: (2025)
OmniTrace: A Unified Framework for Generation-Time Attribution in Omni-Modal LLMs
by: Yan, Qianqi, et al.
Published: (2026)
by: Yan, Qianqi, et al.
Published: (2026)
Discrete Diffusion VLA: Bringing Discrete Diffusion to Action Decoding in Vision-Language-Action Policies
by: Liang, Zhixuan, et al.
Published: (2025)
by: Liang, Zhixuan, et al.
Published: (2025)
OmniColor: A Unified Framework for Multi-modal Lineart Colorization
by: Zhang, Xulu, et al.
Published: (2026)
by: Zhang, Xulu, et al.
Published: (2026)
The factors controlling marine low clouds Across Multiple Timescales
by: Du, Shuangchen, et al.
Published: (2025)
by: Du, Shuangchen, et al.
Published: (2025)
OmniFashion: Towards Generalist Fashion Intelligence via Multi-Task Vision-Language Learning
by: Yang, Zhengwei, et al.
Published: (2026)
by: Yang, Zhengwei, et al.
Published: (2026)
MindOmni: Unleashing Reasoning Generation in Vision Language Models with RGPO
by: Xiao, Yicheng, et al.
Published: (2025)
by: Xiao, Yicheng, et al.
Published: (2025)
OmniEarth: A Benchmark for Evaluating Vision-Language Models in Geospatial Tasks
by: Fu, Ronghao, et al.
Published: (2026)
by: Fu, Ronghao, et al.
Published: (2026)
Efficient Estimation of Sum-Parameters for Multi-Component Complex Exponential Signals with Theoretical Cramer-Rao Bound Analysis
by: Zhang, Huiguang
Published: (2025)
by: Zhang, Huiguang
Published: (2025)
Lumina-OmniLV: A Unified Multimodal Framework for General Low-Level Vision
by: Pu, Yuandong, et al.
Published: (2025)
by: Pu, Yuandong, et al.
Published: (2025)
OmniBrainBench: A Comprehensive Multimodal Benchmark for Brain Imaging Analysis Across Multi-stage Clinical Tasks
by: Peng, Zhihao, et al.
Published: (2025)
by: Peng, Zhihao, et al.
Published: (2025)
Cramér-Rao Bound Analysis and Near-Optimal Performance of the Synchronous Nyquist-Folding Generalized Eigenvalue Method (SNGEM) for Sub-Nyquist Multi-Tone Parameter Estimation
by: Zhang, Huiguang
Published: (2025)
by: Zhang, Huiguang
Published: (2025)
Dynin-Omni: Omnimodal Unified Large Diffusion Language Model
by: Kim, Jaeik, et al.
Published: (2026)
by: Kim, Jaeik, et al.
Published: (2026)
OmniMRI: A Unified Vision--Language Foundation Model for Generalist MRI Interpretation
by: He, Xingxin, et al.
Published: (2025)
by: He, Xingxin, et al.
Published: (2025)
One Brain, Omni Modalities: Towards Unified Non-Invasive Brain Decoding with Large Language Models
by: Tang, Changli, et al.
Published: (2026)
by: Tang, Changli, et al.
Published: (2026)
Towards Unified Multi-Modal Personalization: Large Vision-Language Models for Generative Recommendation and Beyond
by: Wei, Tianxin, et al.
Published: (2024)
by: Wei, Tianxin, et al.
Published: (2024)
BrainOmni: A Brain Foundation Model for Unified EEG and MEG Signals
by: Xiao, Qinfan, et al.
Published: (2025)
by: Xiao, Qinfan, et al.
Published: (2025)
Muddit: Liberating Generation Beyond Text-to-Image with a Unified Discrete Diffusion Model
by: Shi, Qingyu, et al.
Published: (2025)
by: Shi, Qingyu, et al.
Published: (2025)
FlashOmni: A Unified Sparse Attention Engine for Diffusion Transformers
by: Qiao, Liang, et al.
Published: (2025)
by: Qiao, Liang, et al.
Published: (2025)
Human-like object concept representations emerge naturally in multimodal large language models
by: Du, Changde, et al.
Published: (2024)
by: Du, Changde, et al.
Published: (2024)
Unified Diffusion VLA: Vision-Language-Action Model via Joint Discrete Denoising Diffusion Process
by: Chen, Jiayi, et al.
Published: (2025)
by: Chen, Jiayi, et al.
Published: (2025)
OmniLiDAR: A Unified Diffusion Framework for Multi-Domain 3D LiDAR Generation
by: Liu, Youquan, et al.
Published: (2026)
by: Liu, Youquan, et al.
Published: (2026)
Discrete Diffusion for Reflective Vision-Language-Action Models in Autonomous Driving
by: Li, Pengxiang, et al.
Published: (2025)
by: Li, Pengxiang, et al.
Published: (2025)
Uni-MuMER: Unified Multi-Task Fine-Tuning of Vision-Language Model for Handwritten Mathematical Expression Recognition
by: Li, Yu, et al.
Published: (2025)
by: Li, Yu, et al.
Published: (2025)
Adaptive Machine Learning-Driven Multi-Fidelity Stratified Sampling for Failure Analysis of Nonlinear Stochastic Systems
by: Xu, Liuyun, et al.
Published: (2025)
by: Xu, Liuyun, et al.
Published: (2025)
Similar Items
-
Versatile Framework with Semantic and Structural guidance for Image Reconstruction from Brain Activity
by: Lu, Yizhuo, et al.
Published: (2026) -
Animate Your Thoughts: Decoupled Reconstruction of Dynamic Natural Vision from Slow Brain Activity
by: Lu, Yizhuo, et al.
Published: (2024) -
NeuralOOD: Improving Out-of-Distribution Generalization Performance with Brain-machine Fusion Learning Framework
by: Zhao, Shuangchen, et al.
Published: (2024) -
Multi-label Class Incremental Emotion Decoding with Augmented Emotional Semantics Learning
by: Fu, Kaicheng, et al.
Published: (2024) -
CLIP-MUSED: CLIP-Guided Multi-Subject Visual Neural Information Semantic Decoding
by: Zhou, Qiongyi, et al.
Published: (2024)