Task-Driven Fixation Network: An Efficient Architecture with Fixation Selection
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wang, Shuguang, Wang, Yuanjing |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Advancing TDFN: Precise Fixation Point Generation Using Reconstruction Differences
par: Wang, Shuguang, et autres
Publié: (2025)
par: Wang, Shuguang, et autres
Publié: (2025)
Learning Gaussian Representation for Eye Fixation Prediction
par: Song, Peipei, et autres
Publié: (2024)
par: Song, Peipei, et autres
Publié: (2024)
FastOCR: Dynamic Visual Fixation via KV Cache Pruning for Efficient Document Parsing
par: Tang, Zihan, et autres
Publié: (2026)
par: Tang, Zihan, et autres
Publié: (2026)
Attention-based Pin Site Image Classification in Orthopaedic Patients with External Fixators
par: Wang, Yubo, et autres
Publié: (2026)
par: Wang, Yubo, et autres
Publié: (2026)
Visual Fixation-Based Retinal Prosthetic Simulation
par: Wu, Yuli, et autres
Publié: (2024)
par: Wu, Yuli, et autres
Publié: (2024)
Through Their Eyes: Fixation-aligned Tuning for Personalized User Emulation
par: Huang, Lingfeng, et autres
Publié: (2026)
par: Huang, Lingfeng, et autres
Publié: (2026)
Deep Learning-Based Fixation Type Prediction for Quality Assurance in Digital Pathology
par: Thaeter, Oskar, et autres
Publié: (2026)
par: Thaeter, Oskar, et autres
Publié: (2026)
SaFiRe: Saccade-Fixation Reiteration with Mamba for Referring Image Segmentation
par: Mao, Zhenjie, et autres
Publié: (2025)
par: Mao, Zhenjie, et autres
Publié: (2025)
Fixation-based Self-calibration for Eye Tracking in VR Headsets
par: Uramune, Ryusei, et autres
Publié: (2023)
par: Uramune, Ryusei, et autres
Publié: (2023)
Raising the Ceiling: Better Empirical Fixation Densities for Saliency Benchmarking
par: Agrawal, Susmit, et autres
Publié: (2026)
par: Agrawal, Susmit, et autres
Publié: (2026)
Beyond Perception Errors: Semantic Fixation in Large Vision-Language Models
par: Alam, Md Tanvirul
Publié: (2026)
par: Alam, Md Tanvirul
Publié: (2026)
Fusing Foveal Fixations Using Linear Retinal Transformations and Bayesian Experimental Design
par: Williams, Christopher K. I.
Publié: (2025)
par: Williams, Christopher K. I.
Publié: (2025)
Distinguishing Target and Non-Target Fixations with EEG and Eye Tracking in Realistic Visual Scenes
par: Sharma, Mansi, et autres
Publié: (2025)
par: Sharma, Mansi, et autres
Publié: (2025)
Emergence of Fixational and Saccadic Movements in a Multi-Level Recurrent Attention Model for Vision
par: Pan, Pengcheng, et autres
Publié: (2025)
par: Pan, Pengcheng, et autres
Publié: (2025)
FixationFormer: Direct Utilization of Expert Gaze Trajectories for Chest X-Ray Classification
par: Beckmann, Daniel, et autres
Publié: (2026)
par: Beckmann, Daniel, et autres
Publié: (2026)
UniCAD: Efficient and Extendable Architecture for Multi-Task Computer-Aided Diagnosis System
par: Zhu, Yitao, et autres
Publié: (2025)
par: Zhu, Yitao, et autres
Publié: (2025)
Towards Consistent and Efficient Dataset Distillation via Diffusion-Driven Selection
par: Zhong, Xinhao, et autres
Publié: (2024)
par: Zhong, Xinhao, et autres
Publié: (2024)
Look & Mark: Leveraging Radiologist Eye Fixations and Bounding boxes in Multimodal Large Language Models for Chest X-ray Report Generation
par: Kim, Yunsoo, et autres
Publié: (2025)
par: Kim, Yunsoo, et autres
Publié: (2025)
evMLP: An Efficient Event-Driven MLP Architecture for Vision
par: Zheng, Zhentan
Publié: (2025)
par: Zheng, Zhentan
Publié: (2025)
Debiasing Central Fixation Confounds Reveals a Peripheral "Sweet Spot" for Human-like Scanpaths in Hard-Attention Vision
par: Pan, Pengcheng, et autres
Publié: (2026)
par: Pan, Pengcheng, et autres
Publié: (2026)
TR-PTS: Task-Relevant Parameter and Token Selection for Efficient Tuning
par: Luo, Siqi, et autres
Publié: (2025)
par: Luo, Siqi, et autres
Publié: (2025)
Why We Look Where We Look: Emergent Human-like Fixations of a Foveated Visual Language Model Maximizing Scene Understanding
par: Murlidaran, Shravan, et autres
Publié: (2026)
par: Murlidaran, Shravan, et autres
Publié: (2026)
Cross-Task Benchmarking of CNN Architectures
par: Sherawat, Kamal, et autres
Publié: (2026)
par: Sherawat, Kamal, et autres
Publié: (2026)
Modality Exchange Network for Retinogeniculate Visual Pathway Segmentation
par: Han, Hua, et autres
Publié: (2024)
par: Han, Hua, et autres
Publié: (2024)
Edge-Efficient Two-Stream Multimodal Architecture for Non-Intrusive Bathroom Fall Detection
par: Wang, Haitian, et autres
Publié: (2026)
par: Wang, Haitian, et autres
Publié: (2026)
Human Insights Driven Latent Space for Different Driving Perspectives: A Unified Encoder for Efficient Multi-Task Inference
par: Nguyen, Huy-Dung, et autres
Publié: (2024)
par: Nguyen, Huy-Dung, et autres
Publié: (2024)
Domain and Task-Focused Example Selection for Data-Efficient Contrastive Medical Image Segmentation
par: Ward, Tyler, et autres
Publié: (2025)
par: Ward, Tyler, et autres
Publié: (2025)
Target Aware Network Architecture Search and Compression for Efficient Knowledge Transfer
par: Basha, S. H. Shabbeer, et autres
Publié: (2022)
par: Basha, S. H. Shabbeer, et autres
Publié: (2022)
Adaptive Dynamic Dehazing via Instruction-Driven and Task-Feedback Closed-Loop Optimization for Diverse Downstream Task Adaptation
par: Zhang, Yafei, et autres
Publié: (2026)
par: Zhang, Yafei, et autres
Publié: (2026)
DROP: Decouple Re-Identification and Human Parsing with Task-specific Features for Occluded Person Re-identification
par: Dou, Shuguang, et autres
Publié: (2024)
par: Dou, Shuguang, et autres
Publié: (2024)
FBNetV5: Neural Architecture Search for Multiple Tasks in One Run
par: Wu, Bichen, et autres
Publié: (2021)
par: Wu, Bichen, et autres
Publié: (2021)
SAGA: Selective Adaptive Gating for Efficient and Expressive Linear Attention
par: Cao, Yuan, et autres
Publié: (2025)
par: Cao, Yuan, et autres
Publié: (2025)
Efficient and Effective In-context Demonstration Selection with Coreset
par: Wang, Zihua, et autres
Publié: (2025)
par: Wang, Zihua, et autres
Publié: (2025)
FlexSelect: Flexible Token Selection for Efficient Long Video Understanding
par: Zhang, Yunzhu, et autres
Publié: (2025)
par: Zhang, Yunzhu, et autres
Publié: (2025)
FAAR: Efficient Frequency-Aware Multi-Task Fine-Tuning via Automatic Rank Selection
par: Fontana, Maxime, et autres
Publié: (2026)
par: Fontana, Maxime, et autres
Publié: (2026)
Progressive Volume Distillation with Active Learning for Efficient NeRF Architecture Conversion
par: Fang, Shuangkang, et autres
Publié: (2023)
par: Fang, Shuangkang, et autres
Publié: (2023)
ALLVB: All-in-One Long Video Understanding Benchmark
par: Tan, Xichen, et autres
Publié: (2025)
par: Tan, Xichen, et autres
Publié: (2025)
Vision-RWKV: Efficient and Scalable Visual Perception with RWKV-Like Architectures
par: Duan, Yuchen, et autres
Publié: (2024)
par: Duan, Yuchen, et autres
Publié: (2024)
Rethinking the Architecture Design for Efficient Generic Event Boundary Detection
par: Zheng, Ziwei, et autres
Publié: (2024)
par: Zheng, Ziwei, et autres
Publié: (2024)
SNED: Superposition Network Architecture Search for Efficient Video Diffusion Model
par: Li, Zhengang, et autres
Publié: (2024)
par: Li, Zhengang, et autres
Publié: (2024)
Documents similaires
-
Advancing TDFN: Precise Fixation Point Generation Using Reconstruction Differences
par: Wang, Shuguang, et autres
Publié: (2025) -
Learning Gaussian Representation for Eye Fixation Prediction
par: Song, Peipei, et autres
Publié: (2024) -
FastOCR: Dynamic Visual Fixation via KV Cache Pruning for Efficient Document Parsing
par: Tang, Zihan, et autres
Publié: (2026) -
Attention-based Pin Site Image Classification in Orthopaedic Patients with External Fixators
par: Wang, Yubo, et autres
Publié: (2026) -
Visual Fixation-Based Retinal Prosthetic Simulation
par: Wu, Yuli, et autres
Publié: (2024)