SonoSelect: Efficient Ultrasound Perception via Active Probe Exploration
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhang, Yixin, Hou, Yunzhong, Li, Longqi, Qin, Zhenyue, Liu, Yang, Yao, Yue |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
HandCraft: Anatomically Correct Restoration of Malformed Hands in Diffusion Generated Images
par: Qin, Zhenyue, et autres
Publié: (2024)
par: Qin, Zhenyue, et autres
Publié: (2024)
Learning Camera Movement Control from Real-World Drone Videos
par: Hou, Yunzhong, et autres
Publié: (2024)
par: Hou, Yunzhong, et autres
Publié: (2024)
Decision-Driven Semantic Object Exploration for Legged Robots via Confidence-Calibrated Perception and Topological Subgoal Selection
par: Zhao, Guoyang, et autres
Publié: (2025)
par: Zhao, Guoyang, et autres
Publié: (2025)
Authentic Emotion Mapping: Benchmarking Facial Expressions in Real News
par: Zhang, Qixuan, et autres
Publié: (2024)
par: Zhang, Qixuan, et autres
Publié: (2024)
ActFormer: Scalable Collaborative Perception via Active Queries
par: Huang, Suozhi, et autres
Publié: (2024)
par: Huang, Suozhi, et autres
Publié: (2024)
MP5: A Multi-modal Open-ended Embodied System in Minecraft via Active Perception
par: Qin, Yiran, et autres
Publié: (2023)
par: Qin, Yiran, et autres
Publié: (2023)
HeatV2X: Scalable Heterogeneous Collaborative Perception via Efficient Alignment and Interaction
par: Zhao, Yueran, et autres
Publié: (2025)
par: Zhao, Yueran, et autres
Publié: (2025)
Active Visual Perception: Opportunities and Challenges
par: Li, Yian, et autres
Publié: (2025)
par: Li, Yian, et autres
Publié: (2025)
Mind the Rarities: Can Rare Skin Diseases Be Reliably Diagnosed via Diagnostic Reasoning?
par: Liu, Yang, et autres
Publié: (2026)
par: Liu, Yang, et autres
Publié: (2026)
Visual Prompting in LLMs for Enhancing Emotion Recognition
par: Zhang, Qixuan, et autres
Publié: (2024)
par: Zhang, Qixuan, et autres
Publié: (2024)
ADAptation: Reconstruction-based Unsupervised Active Learning for Breast Ultrasound Diagnosis
par: Duan, Yaofei, et autres
Publié: (2025)
par: Duan, Yaofei, et autres
Publié: (2025)
Towards High-Fidelity CAD Generation via LLM-Driven Program Generation and Text-Based B-Rep Primitive Grounding
par: Li, Jiahao, et autres
Publié: (2026)
par: Li, Jiahao, et autres
Publié: (2026)
Evaluating Time Awareness and Cross-modal Active Perception of Large Models via 4D Escape Room Task
par: Dong, Yurui, et autres
Publié: (2026)
par: Dong, Yurui, et autres
Publié: (2026)
Perceive, Verify and Understand Long Video: Multi-Granular Perception and Active Verification via Interactive Agents
par: Li, Jiahua, et autres
Publié: (2025)
par: Li, Jiahua, et autres
Publié: (2025)
JAQ: Joint Efficient Architecture Design and Low-Bit Quantization with Hardware-Software Co-Exploration
par: Wang, Mingzi, et autres
Publié: (2025)
par: Wang, Mingzi, et autres
Publié: (2025)
SCSA: Exploring the Synergistic Effects Between Spatial and Channel Attention
par: Si, Yunzhong, et autres
Publié: (2024)
par: Si, Yunzhong, et autres
Publié: (2024)
ReCAD: Reinforcement Learning Enhanced Parametric CAD Model Generation with Vision-Language Models
par: Li, Jiahao, et autres
Publié: (2025)
par: Li, Jiahao, et autres
Publié: (2025)
UMind-VL: A Generalist Ultrasound Vision-Language Model for Unified Grounded Perception and Comprehensive Interpretation
par: Chen, Dengbo, et autres
Publié: (2025)
par: Chen, Dengbo, et autres
Publié: (2025)
Pursuing Minimal Sufficiency in Spatial Reasoning
par: Guo, Yejie, et autres
Publié: (2025)
par: Guo, Yejie, et autres
Publié: (2025)
Look-Closer-Then-Diagnose: Confidence-Aware Ultrasound VQA via Active Zooming
par: Zhou, Yue, et autres
Publié: (2026)
par: Zhou, Yue, et autres
Publié: (2026)
ActiView: Evaluating Active Perception Ability for Multimodal Large Language Models
par: Wang, Ziyue, et autres
Publié: (2024)
par: Wang, Ziyue, et autres
Publié: (2024)
Plane Geometry Problem Solving with Multi-modal Reasoning: A Survey
par: Cho, Seunghyuk, et autres
Publié: (2025)
par: Cho, Seunghyuk, et autres
Publié: (2025)
GeoDANO: Geometric VLM with Domain Agnostic Vision Encoder
par: Cho, Seunghyuk, et autres
Publié: (2025)
par: Cho, Seunghyuk, et autres
Publié: (2025)
FailureAtlas:Mapping the Failure Landscape of T2I Models via Active Exploration
par: Chen, Muxi, et autres
Publié: (2025)
par: Chen, Muxi, et autres
Publié: (2025)
ComGS: Efficient 3D Object-Scene Composition via Surface Octahedral Probes
par: Gao, Jian, et autres
Publié: (2025)
par: Gao, Jian, et autres
Publié: (2025)
Spatial-VLN: Zero-Shot Vision-and-Language Navigation With Explicit Spatial Perception and Exploration
par: Yue, Lu, et autres
Publié: (2026)
par: Yue, Lu, et autres
Publié: (2026)
Effective Training Data Synthesis for Improving MLLM Chart Understanding
par: Yang, Yuwei, et autres
Publié: (2025)
par: Yang, Yuwei, et autres
Publié: (2025)
ESAM++: Efficient Online 3D Perception on the Edge
par: Liu, Qin, et autres
Publié: (2026)
par: Liu, Qin, et autres
Publié: (2026)
Learn 3D VQA Better with Active Selection and Reannotation
par: Zhou, Shengli, et autres
Publié: (2025)
par: Zhou, Shengli, et autres
Publié: (2025)
Move to Understand a 3D Scene: Bridging Visual Grounding and Exploration for Efficient and Versatile Embodied Navigation
par: Zhu, Ziyu, et autres
Publié: (2025)
par: Zhu, Ziyu, et autres
Publié: (2025)
Active-O3: Empowering Multimodal Large Language Models with Active Perception via GRPO
par: Zhu, Muzhi, et autres
Publié: (2025)
par: Zhu, Muzhi, et autres
Publié: (2025)
PolarMAE: Efficient Fetal Ultrasound Pre-training via Semantic Screening and Polar-Guided Masking
par: Lv, Meng, et autres
Publié: (2026)
par: Lv, Meng, et autres
Publié: (2026)
ESA: Annotation-Efficient Active Learning for Semantic Segmentation
par: Ge, Jinchao, et autres
Publié: (2024)
par: Ge, Jinchao, et autres
Publié: (2024)
Seek-CAD: A Self-refined Generative Modeling for 3D Parametric CAD Using Local Inference via DeepSeek
par: Li, Xueyang, et autres
Publié: (2025)
par: Li, Xueyang, et autres
Publié: (2025)
Scaling Laws for Deepfake Detection
par: Wang, Wenhao, et autres
Publié: (2025)
par: Wang, Wenhao, et autres
Publié: (2025)
TASL-Net: Tri-Attention Selective Learning Network for Intelligent Diagnosis of Bimodal Ultrasound Video
par: Zhao, Chengqian, et autres
Publié: (2024)
par: Zhao, Chengqian, et autres
Publié: (2024)
Annotation-Efficient Polyp Segmentation via Active Learning
par: Huang, Duojun, et autres
Publié: (2024)
par: Huang, Duojun, et autres
Publié: (2024)
GeoExplorer: Active Geo-localization with Curiosity-Driven Exploration
par: Mi, Li, et autres
Publié: (2025)
par: Mi, Li, et autres
Publié: (2025)
ZoomEarth: Active Perception for Ultra-High-Resolution Geospatial Vision-Language Tasks
par: Liu, Ruixun, et autres
Publié: (2025)
par: Liu, Ruixun, et autres
Publié: (2025)
GeoVista: Visually Grounded Active Perception for Ultra-High-Resolution Remote Sensing Understanding
par: Zhu, Jiashun, et autres
Publié: (2026)
par: Zhu, Jiashun, et autres
Publié: (2026)
Documents similaires
-
HandCraft: Anatomically Correct Restoration of Malformed Hands in Diffusion Generated Images
par: Qin, Zhenyue, et autres
Publié: (2024) -
Learning Camera Movement Control from Real-World Drone Videos
par: Hou, Yunzhong, et autres
Publié: (2024) -
Decision-Driven Semantic Object Exploration for Legged Robots via Confidence-Calibrated Perception and Topological Subgoal Selection
par: Zhao, Guoyang, et autres
Publié: (2025) -
Authentic Emotion Mapping: Benchmarking Facial Expressions in Real News
par: Zhang, Qixuan, et autres
Publié: (2024) -
ActFormer: Scalable Collaborative Perception via Active Queries
par: Huang, Suozhi, et autres
Publié: (2024)