Towards Two-Stream Foveation-based Active Vision Learning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ibrayev, Timur, Mukherjee, Amitangshu, Aketi, Sai Aparna, Roy, Kaushik |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
On Inherent Adversarial Robustness of Active Vision Systems
par: Mukherjee, Amitangshu, et autres
Publié: (2024)
par: Mukherjee, Amitangshu, et autres
Publié: (2024)
Semantic-Syntactic Discrepancy in Images (SSDI): Learning Meaning and Order of Features from Natural Images
par: Tao, Chun, et autres
Publié: (2024)
par: Tao, Chun, et autres
Publié: (2024)
Foveated Instance Segmentation
par: Zeng, Hongyi, et autres
Publié: (2025)
par: Zeng, Hongyi, et autres
Publié: (2025)
FovealNet: Advancing AI-Driven Gaze Tracking Solutions for Optimized Foveated Rendering System Performance in Virtual Reality
par: Liu, Wenxuan, et autres
Publié: (2024)
par: Liu, Wenxuan, et autres
Publié: (2024)
Caption-Driven Explorations: Aligning Image and Text Embeddings through Human-Inspired Foveated Vision
par: Zanca, Dario, et autres
Publié: (2024)
par: Zanca, Dario, et autres
Publié: (2024)
Look, Focus, Act: Efficient and Robust Robot Learning via Human Gaze and Foveated Vision Transformers
par: Chuang, Ian, et autres
Publié: (2025)
par: Chuang, Ian, et autres
Publié: (2025)
Two-Stream Interactive Joint Learning of Scene Parsing and Geometric Vision Tasks
par: Tang, Guanfeng, et autres
Publié: (2026)
par: Tang, Guanfeng, et autres
Publié: (2026)
Panoptic Diffusion Models: co-generation of images and segmentation maps
par: Long, Yinghan, et autres
Publié: (2024)
par: Long, Yinghan, et autres
Publié: (2024)
REMAP: Regularized Matching and Partial Alignment of Video Embeddings
par: Chandra, Soumyadeep, et autres
Publié: (2025)
par: Chandra, Soumyadeep, et autres
Publié: (2025)
Bias-Aware Machine Unlearning: Towards Fairer Vision Models via Controllable Forgetting
par: Aylapuram, Sai Siddhartha Chary, et autres
Publié: (2025)
par: Aylapuram, Sai Siddhartha Chary, et autres
Publié: (2025)
Robust Noisy Label Learning via Two-Stream Sample Distillation
par: Bai, Sihan, et autres
Publié: (2024)
par: Bai, Sihan, et autres
Publié: (2024)
ActiveVLN: Towards Active Exploration via Multi-Turn RL in Vision-and-Language Navigation
par: Zhang, Zekai, et autres
Publié: (2025)
par: Zhang, Zekai, et autres
Publié: (2025)
Towards Resolving Optimization Conflicts Between Image- and Text-Based Person Re-Identification
par: Kvanchiani, Karina, et autres
Publié: (2026)
par: Kvanchiani, Karina, et autres
Publié: (2026)
Why We Look Where We Look: Emergent Human-like Fixations of a Foveated Visual Language Model Maximizing Scene Understanding
par: Murlidaran, Shravan, et autres
Publié: (2026)
par: Murlidaran, Shravan, et autres
Publié: (2026)
Towards Low-Latency Event Stream-based Visual Object Tracking: A Slow-Fast Approach
par: Wang, Shiao, et autres
Publié: (2025)
par: Wang, Shiao, et autres
Publié: (2025)
CapRecover: A Cross-Modality Feature Inversion Attack Framework on Vision Language Models
par: Xiu, Kedong, et autres
Publié: (2025)
par: Xiu, Kedong, et autres
Publié: (2025)
physfusion: A Transformer-based Dual-Stream Radar and Vision Fusion Framework for Open Water Surface Object Detection
par: Wan, Yuting, et autres
Publié: (2026)
par: Wan, Yuting, et autres
Publié: (2026)
RAU: Reference-based Anatomical Understanding with Vision Language Models
par: Li, Yiwei, et autres
Publié: (2025)
par: Li, Yiwei, et autres
Publié: (2025)
Evaluating Open-Source Vision Language Models for Facial Emotion Recognition against Traditional Deep Learning Models
par: Mulukutla, Vamsi Krishna, et autres
Publié: (2025)
par: Mulukutla, Vamsi Krishna, et autres
Publié: (2025)
Landsat30-AU: A Vision-Language Dataset for Australian Landsat Imagery
par: Ma, Sai, et autres
Publié: (2025)
par: Ma, Sai, et autres
Publié: (2025)
HydroVision: Predicting Optically Active Parameters in Surface Water Using Computer Vision
par: Deshmukh, Shubham Laxmikant, et autres
Publié: (2025)
par: Deshmukh, Shubham Laxmikant, et autres
Publié: (2025)
Towards Difficulty-Agnostic Efficient Transfer Learning for Vision-Language Models
par: Yang, Yongjin, et autres
Publié: (2023)
par: Yang, Yongjin, et autres
Publié: (2023)
Dropout Prompt Learning: Towards Robust and Adaptive Vision-Language Models
par: Chen, Biao, et autres
Publié: (2025)
par: Chen, Biao, et autres
Publié: (2025)
StreamGaze: Gaze-Guided Temporal Reasoning and Proactive Understanding in Streaming Videos
par: Lee, Daeun, et autres
Publié: (2025)
par: Lee, Daeun, et autres
Publié: (2025)
Avoid Wasted Annotation Costs in Open-set Active Learning with Pre-trained Vision-Language Model
par: Heo, Jaehyuk, et autres
Publié: (2024)
par: Heo, Jaehyuk, et autres
Publié: (2024)
Think Before You Act: A Two-Stage Framework for Mitigating Gender Bias Towards Vision-Language Tasks
par: Zhang, Yunqi, et autres
Publié: (2024)
par: Zhang, Yunqi, et autres
Publié: (2024)
CornViT: A Multi-Stage Convolutional Vision Transformer Framework for Hierarchical Corn Kernel Analysis
par: Erukude, Sai Teja, et autres
Publié: (2025)
par: Erukude, Sai Teja, et autres
Publié: (2025)
Cognition-Inspired Dual-Stream Semantic Enhancement for Vision-Based Dynamic Emotion Modeling
par: Wang, Huanzhen, et autres
Publié: (2026)
par: Wang, Huanzhen, et autres
Publié: (2026)
VERSE: Virtual-Gradient Aware Streaming Lifelong Learning with Anytime Inference
par: Banerjee, Soumya, et autres
Publié: (2023)
par: Banerjee, Soumya, et autres
Publié: (2023)
Towards Cross-modal Backward-compatible Representation Learning for Vision-Language Models
par: Jang, Young Kyun, et autres
Publié: (2024)
par: Jang, Young Kyun, et autres
Publié: (2024)
Deep Unlearning: Fast and Efficient Gradient-free Approach to Class Forgetting
par: Kodge, Sangamesh, et autres
Publié: (2023)
par: Kodge, Sangamesh, et autres
Publié: (2023)
Learning from One Continuous Video Stream
par: Carreira, João, et autres
Publié: (2023)
par: Carreira, João, et autres
Publié: (2023)
StrLoRA: Towards Streaming Continual Visual Instruction Tuning for MLLMs
par: Che, Chang, et autres
Publié: (2026)
par: Che, Chang, et autres
Publié: (2026)
Perception Before Reasoning: Two-Stage Reinforcement Learning for Visual Reasoning in Vision-Language Models
par: Chen, Yan, et autres
Publié: (2025)
par: Chen, Yan, et autres
Publié: (2025)
Breaking the Barrier: Selective Uncertainty-based Active Learning for Medical Image Segmentation
par: Ma, Siteng, et autres
Publié: (2024)
par: Ma, Siteng, et autres
Publié: (2024)
Towards Cognitive Defect Analysis in Active Infrared Thermography with Vision-Text Cues
par: Salah, Mohammed, et autres
Publié: (2026)
par: Salah, Mohammed, et autres
Publié: (2026)
EvRepSL: Event-Stream Representation via Self-Supervised Learning for Event-Based Vision
par: Qu, Qiang, et autres
Publié: (2024)
par: Qu, Qiang, et autres
Publié: (2024)
Reward Design for Physical Reasoning in Vision-Language Models
par: Lilienthal, Derek, et autres
Publié: (2026)
par: Lilienthal, Derek, et autres
Publié: (2026)
Dynamics-Aware Gaussian Splatting Streaming Towards Fast On-the-Fly 4D Reconstruction
par: Liu, Zhening, et autres
Publié: (2024)
par: Liu, Zhening, et autres
Publié: (2024)
Tuned Compositional Feature Replays for Efficient Stream Learning
par: Talbot, Morgan B., et autres
Publié: (2021)
par: Talbot, Morgan B., et autres
Publié: (2021)
Documents similaires
-
On Inherent Adversarial Robustness of Active Vision Systems
par: Mukherjee, Amitangshu, et autres
Publié: (2024) -
Semantic-Syntactic Discrepancy in Images (SSDI): Learning Meaning and Order of Features from Natural Images
par: Tao, Chun, et autres
Publié: (2024) -
Foveated Instance Segmentation
par: Zeng, Hongyi, et autres
Publié: (2025) -
FovealNet: Advancing AI-Driven Gaze Tracking Solutions for Optimized Foveated Rendering System Performance in Virtual Reality
par: Liu, Wenxuan, et autres
Publié: (2024) -
Caption-Driven Explorations: Aligning Image and Text Embeddings through Human-Inspired Foveated Vision
par: Zanca, Dario, et autres
Publié: (2024)