Visualizing the Invisible: Generative Visual Grounding Empowers Universal EEG Understanding in MLLMs
Fuente:
arXiv
Salvato in:
| Autori principali: | Pan, Jun-Yu, Wang, Yansen, Zhang, Enze, Lu, Bao-Liang, Zheng, Wei-Long, Li, Dongsheng |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
A Large-scale Medical Visual Task Adaptation Benchmark
di: Mo, Shentong, et al.
Pubblicazione: (2024)
di: Mo, Shentong, et al.
Pubblicazione: (2024)
LSPT: Long-term Spatial Prompt Tuning for Visual Representation Learning
di: Mo, Shentong, et al.
Pubblicazione: (2024)
di: Mo, Shentong, et al.
Pubblicazione: (2024)
OmniVideoBench: Towards Audio-Visual Understanding Evaluation for Omni MLLMs
di: Li, Caorui, et al.
Pubblicazione: (2025)
di: Li, Caorui, et al.
Pubblicazione: (2025)
How Do Medical MLLMs Fail? A Study on Visual Grounding in Medical Images
di: Liu, Guimeng, et al.
Pubblicazione: (2026)
di: Liu, Guimeng, et al.
Pubblicazione: (2026)
INVIGORATE: Interactive Visual Grounding and Grasping in Clutter
di: Zhang, Hanbo, et al.
Pubblicazione: (2021)
di: Zhang, Hanbo, et al.
Pubblicazione: (2021)
Diffusion-CAM: Faithful Visual Explanations for dMLLMs
di: Zuo, Haomin, et al.
Pubblicazione: (2026)
di: Zuo, Haomin, et al.
Pubblicazione: (2026)
State-Action Inpainting Diffuser for Continuous Control with Delay
di: Han, Dongqi, et al.
Pubblicazione: (2026)
di: Han, Dongqi, et al.
Pubblicazione: (2026)
NeuroLM: A Universal Multi-task Foundation Model for Bridging the Gap between Language and EEG Signals
di: Jiang, Wei-Bang, et al.
Pubblicazione: (2024)
di: Jiang, Wei-Bang, et al.
Pubblicazione: (2024)
RAR: Retrieving And Ranking Augmented MLLMs for Visual Recognition
di: Liu, Ziyu, et al.
Pubblicazione: (2024)
di: Liu, Ziyu, et al.
Pubblicazione: (2024)
Generating by Understanding: Neural Visual Generation with Logical Symbol Groundings
di: Peng, Yifei, et al.
Pubblicazione: (2023)
di: Peng, Yifei, et al.
Pubblicazione: (2023)
CharTool: Tool-Integrated Visual Reasoning for Chart Understanding
di: Zhang, Situo, et al.
Pubblicazione: (2026)
di: Zhang, Situo, et al.
Pubblicazione: (2026)
DocSeeker: Structured Visual Reasoning with Evidence Grounding for Long Document Understanding
di: Yan, Hao, et al.
Pubblicazione: (2026)
di: Yan, Hao, et al.
Pubblicazione: (2026)
CrystaL: Spontaneous Emergence of Visual Latents in MLLMs
di: Zhang, Yang, et al.
Pubblicazione: (2026)
di: Zhang, Yang, et al.
Pubblicazione: (2026)
Towards Understanding Visual Grounding in Visual Language Models
di: Pantazopoulos, Georgios, et al.
Pubblicazione: (2025)
di: Pantazopoulos, Georgios, et al.
Pubblicazione: (2025)
EEGFormer: Towards Transferable and Interpretable Large-Scale EEG Foundation Model
di: Chen, Yuqi, et al.
Pubblicazione: (2024)
di: Chen, Yuqi, et al.
Pubblicazione: (2024)
Tape: A Cellular Automata Benchmark for Evaluating Rule-Shift Generalization in Reinforcement Learning
di: Pan, Enze
Pubblicazione: (2026)
di: Pan, Enze
Pubblicazione: (2026)
MLLMs-Augmented Visual-Language Representation Learning
di: Liu, Yanqing, et al.
Pubblicazione: (2023)
di: Liu, Yanqing, et al.
Pubblicazione: (2023)
VideoScaffold: Elastic-Scale Visual Hierarchies for Streaming Video Understanding in MLLMs
di: Zheng, Naishan, et al.
Pubblicazione: (2025)
di: Zheng, Naishan, et al.
Pubblicazione: (2025)
Mitigating Visual Hallucinations via Semantic Curriculum Preference Optimization in MLLMs
di: Li, Yuanshuai, et al.
Pubblicazione: (2025)
di: Li, Yuanshuai, et al.
Pubblicazione: (2025)
Towards Unified Surgical Scene Understanding:Bridging Reasoning and Grounding via MLLMs
di: Huang, Jincai, et al.
Pubblicazione: (2026)
di: Huang, Jincai, et al.
Pubblicazione: (2026)
S$^2$-MLLM: Boosting Spatial Reasoning Capability of MLLMs for 3D Visual Grounding with Structural Guidance
di: Xu, Beining, et al.
Pubblicazione: (2025)
di: Xu, Beining, et al.
Pubblicazione: (2025)
Boosting Private Domain Understanding of Efficient MLLMs: A Tuning-free, Adaptive, Universal Prompt Optimization Framework
di: Liu, Jiang, et al.
Pubblicazione: (2024)
di: Liu, Jiang, et al.
Pubblicazione: (2024)
PEACE: Empowering Geologic Map Holistic Understanding with MLLMs
di: Huang, Yangyu, et al.
Pubblicazione: (2025)
di: Huang, Yangyu, et al.
Pubblicazione: (2025)
Visual Position Prompt for MLLM based Visual Grounding
di: Tang, Wei, et al.
Pubblicazione: (2025)
di: Tang, Wei, et al.
Pubblicazione: (2025)
IBISAgent: Reinforcing Pixel-Level Visual Reasoning in MLLMs for Universal Biomedical Object Referring and Segmentation
di: Jiang, Yankai, et al.
Pubblicazione: (2026)
di: Jiang, Yankai, et al.
Pubblicazione: (2026)
Visual Grounding for Object-Level Generalization in Reinforcement Learning
di: Jiang, Haobin, et al.
Pubblicazione: (2024)
di: Jiang, Haobin, et al.
Pubblicazione: (2024)
ScanReason: Empowering 3D Visual Grounding with Reasoning Capabilities
di: Zhu, Chenming, et al.
Pubblicazione: (2024)
di: Zhu, Chenming, et al.
Pubblicazione: (2024)
EVE: Verifiable Self-Evolution of MLLMs via Executable Visual Transformations
di: Heng, Yongrui, et al.
Pubblicazione: (2026)
di: Heng, Yongrui, et al.
Pubblicazione: (2026)
MoDA: Modulation Adapter for Fine-Grained Visual Grounding in Instructional MLLMs
di: Barrios, Wayner, et al.
Pubblicazione: (2025)
di: Barrios, Wayner, et al.
Pubblicazione: (2025)
Autoregressive Visual Decoding from EEG Signals
di: Dai, Sicheng, et al.
Pubblicazione: (2026)
di: Dai, Sicheng, et al.
Pubblicazione: (2026)
TimeSuite: Improving MLLMs for Long Video Understanding via Grounded Tuning
di: Zeng, Xiangyu, et al.
Pubblicazione: (2024)
di: Zeng, Xiangyu, et al.
Pubblicazione: (2024)
M2-Reasoning: Empowering MLLMs with Unified General and Spatial Reasoning
di: AI, Inclusion, et al.
Pubblicazione: (2025)
di: AI, Inclusion, et al.
Pubblicazione: (2025)
Adaptive Masking Enhances Visual Grounding
di: Jia, Sen, et al.
Pubblicazione: (2024)
di: Jia, Sen, et al.
Pubblicazione: (2024)
VEGAS: Towards Visually Explainable and Grounded Artificial Social Intelligence
di: Li, Hao, et al.
Pubblicazione: (2025)
di: Li, Hao, et al.
Pubblicazione: (2025)
FairReason: Balancing Reasoning and Social Bias in MLLMs
di: Pan, Zhenyu, et al.
Pubblicazione: (2025)
di: Pan, Zhenyu, et al.
Pubblicazione: (2025)
Do MLLMs Really Understand Space? A Mathematical Reasoning Evaluation
di: Lu, Shuo, et al.
Pubblicazione: (2026)
di: Lu, Shuo, et al.
Pubblicazione: (2026)
GeoEyes: On-Demand Visual Focusing for Evidence-Grounded Understanding of Ultra-High-Resolution Remote Sensing Imagery
di: Wang, Fengxiang, et al.
Pubblicazione: (2026)
di: Wang, Fengxiang, et al.
Pubblicazione: (2026)
AdaCodec: A Predictive Visual Code for Video MLLMs
di: Hou, Haowen, et al.
Pubblicazione: (2026)
di: Hou, Haowen, et al.
Pubblicazione: (2026)
ChartPoint: Guiding MLLMs with Grounding Reflection for Chart Reasoning
di: Xu, Zhengzhuo, et al.
Pubblicazione: (2025)
di: Xu, Zhengzhuo, et al.
Pubblicazione: (2025)
VGR: Visual Grounded Reasoning
di: Wang, Jiacong, et al.
Pubblicazione: (2025)
di: Wang, Jiacong, et al.
Pubblicazione: (2025)
Documenti analoghi
-
A Large-scale Medical Visual Task Adaptation Benchmark
di: Mo, Shentong, et al.
Pubblicazione: (2024) -
LSPT: Long-term Spatial Prompt Tuning for Visual Representation Learning
di: Mo, Shentong, et al.
Pubblicazione: (2024) -
OmniVideoBench: Towards Audio-Visual Understanding Evaluation for Omni MLLMs
di: Li, Caorui, et al.
Pubblicazione: (2025) -
How Do Medical MLLMs Fail? A Study on Visual Grounding in Medical Images
di: Liu, Guimeng, et al.
Pubblicazione: (2026) -
INVIGORATE: Interactive Visual Grounding and Grasping in Clutter
di: Zhang, Hanbo, et al.
Pubblicazione: (2021)