Task-Driven Fixation Network: An Efficient Architecture with Fixation Selection
Fuente:
arXiv
Salvato in:
| Autori principali: | Wang, Shuguang, Wang, Yuanjing |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Advancing TDFN: Precise Fixation Point Generation Using Reconstruction Differences
di: Wang, Shuguang, et al.
Pubblicazione: (2025)
di: Wang, Shuguang, et al.
Pubblicazione: (2025)
Learning Gaussian Representation for Eye Fixation Prediction
di: Song, Peipei, et al.
Pubblicazione: (2024)
di: Song, Peipei, et al.
Pubblicazione: (2024)
FastOCR: Dynamic Visual Fixation via KV Cache Pruning for Efficient Document Parsing
di: Tang, Zihan, et al.
Pubblicazione: (2026)
di: Tang, Zihan, et al.
Pubblicazione: (2026)
Attention-based Pin Site Image Classification in Orthopaedic Patients with External Fixators
di: Wang, Yubo, et al.
Pubblicazione: (2026)
di: Wang, Yubo, et al.
Pubblicazione: (2026)
Visual Fixation-Based Retinal Prosthetic Simulation
di: Wu, Yuli, et al.
Pubblicazione: (2024)
di: Wu, Yuli, et al.
Pubblicazione: (2024)
Through Their Eyes: Fixation-aligned Tuning for Personalized User Emulation
di: Huang, Lingfeng, et al.
Pubblicazione: (2026)
di: Huang, Lingfeng, et al.
Pubblicazione: (2026)
Deep Learning-Based Fixation Type Prediction for Quality Assurance in Digital Pathology
di: Thaeter, Oskar, et al.
Pubblicazione: (2026)
di: Thaeter, Oskar, et al.
Pubblicazione: (2026)
SaFiRe: Saccade-Fixation Reiteration with Mamba for Referring Image Segmentation
di: Mao, Zhenjie, et al.
Pubblicazione: (2025)
di: Mao, Zhenjie, et al.
Pubblicazione: (2025)
Fixation-based Self-calibration for Eye Tracking in VR Headsets
di: Uramune, Ryusei, et al.
Pubblicazione: (2023)
di: Uramune, Ryusei, et al.
Pubblicazione: (2023)
Raising the Ceiling: Better Empirical Fixation Densities for Saliency Benchmarking
di: Agrawal, Susmit, et al.
Pubblicazione: (2026)
di: Agrawal, Susmit, et al.
Pubblicazione: (2026)
Beyond Perception Errors: Semantic Fixation in Large Vision-Language Models
di: Alam, Md Tanvirul
Pubblicazione: (2026)
di: Alam, Md Tanvirul
Pubblicazione: (2026)
Fusing Foveal Fixations Using Linear Retinal Transformations and Bayesian Experimental Design
di: Williams, Christopher K. I.
Pubblicazione: (2025)
di: Williams, Christopher K. I.
Pubblicazione: (2025)
Distinguishing Target and Non-Target Fixations with EEG and Eye Tracking in Realistic Visual Scenes
di: Sharma, Mansi, et al.
Pubblicazione: (2025)
di: Sharma, Mansi, et al.
Pubblicazione: (2025)
Emergence of Fixational and Saccadic Movements in a Multi-Level Recurrent Attention Model for Vision
di: Pan, Pengcheng, et al.
Pubblicazione: (2025)
di: Pan, Pengcheng, et al.
Pubblicazione: (2025)
FixationFormer: Direct Utilization of Expert Gaze Trajectories for Chest X-Ray Classification
di: Beckmann, Daniel, et al.
Pubblicazione: (2026)
di: Beckmann, Daniel, et al.
Pubblicazione: (2026)
UniCAD: Efficient and Extendable Architecture for Multi-Task Computer-Aided Diagnosis System
di: Zhu, Yitao, et al.
Pubblicazione: (2025)
di: Zhu, Yitao, et al.
Pubblicazione: (2025)
Towards Consistent and Efficient Dataset Distillation via Diffusion-Driven Selection
di: Zhong, Xinhao, et al.
Pubblicazione: (2024)
di: Zhong, Xinhao, et al.
Pubblicazione: (2024)
Look & Mark: Leveraging Radiologist Eye Fixations and Bounding boxes in Multimodal Large Language Models for Chest X-ray Report Generation
di: Kim, Yunsoo, et al.
Pubblicazione: (2025)
di: Kim, Yunsoo, et al.
Pubblicazione: (2025)
evMLP: An Efficient Event-Driven MLP Architecture for Vision
di: Zheng, Zhentan
Pubblicazione: (2025)
di: Zheng, Zhentan
Pubblicazione: (2025)
Debiasing Central Fixation Confounds Reveals a Peripheral "Sweet Spot" for Human-like Scanpaths in Hard-Attention Vision
di: Pan, Pengcheng, et al.
Pubblicazione: (2026)
di: Pan, Pengcheng, et al.
Pubblicazione: (2026)
TR-PTS: Task-Relevant Parameter and Token Selection for Efficient Tuning
di: Luo, Siqi, et al.
Pubblicazione: (2025)
di: Luo, Siqi, et al.
Pubblicazione: (2025)
Why We Look Where We Look: Emergent Human-like Fixations of a Foveated Visual Language Model Maximizing Scene Understanding
di: Murlidaran, Shravan, et al.
Pubblicazione: (2026)
di: Murlidaran, Shravan, et al.
Pubblicazione: (2026)
Cross-Task Benchmarking of CNN Architectures
di: Sherawat, Kamal, et al.
Pubblicazione: (2026)
di: Sherawat, Kamal, et al.
Pubblicazione: (2026)
Modality Exchange Network for Retinogeniculate Visual Pathway Segmentation
di: Han, Hua, et al.
Pubblicazione: (2024)
di: Han, Hua, et al.
Pubblicazione: (2024)
Edge-Efficient Two-Stream Multimodal Architecture for Non-Intrusive Bathroom Fall Detection
di: Wang, Haitian, et al.
Pubblicazione: (2026)
di: Wang, Haitian, et al.
Pubblicazione: (2026)
Human Insights Driven Latent Space for Different Driving Perspectives: A Unified Encoder for Efficient Multi-Task Inference
di: Nguyen, Huy-Dung, et al.
Pubblicazione: (2024)
di: Nguyen, Huy-Dung, et al.
Pubblicazione: (2024)
Domain and Task-Focused Example Selection for Data-Efficient Contrastive Medical Image Segmentation
di: Ward, Tyler, et al.
Pubblicazione: (2025)
di: Ward, Tyler, et al.
Pubblicazione: (2025)
Target Aware Network Architecture Search and Compression for Efficient Knowledge Transfer
di: Basha, S. H. Shabbeer, et al.
Pubblicazione: (2022)
di: Basha, S. H. Shabbeer, et al.
Pubblicazione: (2022)
Adaptive Dynamic Dehazing via Instruction-Driven and Task-Feedback Closed-Loop Optimization for Diverse Downstream Task Adaptation
di: Zhang, Yafei, et al.
Pubblicazione: (2026)
di: Zhang, Yafei, et al.
Pubblicazione: (2026)
DROP: Decouple Re-Identification and Human Parsing with Task-specific Features for Occluded Person Re-identification
di: Dou, Shuguang, et al.
Pubblicazione: (2024)
di: Dou, Shuguang, et al.
Pubblicazione: (2024)
FBNetV5: Neural Architecture Search for Multiple Tasks in One Run
di: Wu, Bichen, et al.
Pubblicazione: (2021)
di: Wu, Bichen, et al.
Pubblicazione: (2021)
SAGA: Selective Adaptive Gating for Efficient and Expressive Linear Attention
di: Cao, Yuan, et al.
Pubblicazione: (2025)
di: Cao, Yuan, et al.
Pubblicazione: (2025)
Efficient and Effective In-context Demonstration Selection with Coreset
di: Wang, Zihua, et al.
Pubblicazione: (2025)
di: Wang, Zihua, et al.
Pubblicazione: (2025)
FlexSelect: Flexible Token Selection for Efficient Long Video Understanding
di: Zhang, Yunzhu, et al.
Pubblicazione: (2025)
di: Zhang, Yunzhu, et al.
Pubblicazione: (2025)
FAAR: Efficient Frequency-Aware Multi-Task Fine-Tuning via Automatic Rank Selection
di: Fontana, Maxime, et al.
Pubblicazione: (2026)
di: Fontana, Maxime, et al.
Pubblicazione: (2026)
Progressive Volume Distillation with Active Learning for Efficient NeRF Architecture Conversion
di: Fang, Shuangkang, et al.
Pubblicazione: (2023)
di: Fang, Shuangkang, et al.
Pubblicazione: (2023)
ALLVB: All-in-One Long Video Understanding Benchmark
di: Tan, Xichen, et al.
Pubblicazione: (2025)
di: Tan, Xichen, et al.
Pubblicazione: (2025)
Vision-RWKV: Efficient and Scalable Visual Perception with RWKV-Like Architectures
di: Duan, Yuchen, et al.
Pubblicazione: (2024)
di: Duan, Yuchen, et al.
Pubblicazione: (2024)
Rethinking the Architecture Design for Efficient Generic Event Boundary Detection
di: Zheng, Ziwei, et al.
Pubblicazione: (2024)
di: Zheng, Ziwei, et al.
Pubblicazione: (2024)
SNED: Superposition Network Architecture Search for Efficient Video Diffusion Model
di: Li, Zhengang, et al.
Pubblicazione: (2024)
di: Li, Zhengang, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Advancing TDFN: Precise Fixation Point Generation Using Reconstruction Differences
di: Wang, Shuguang, et al.
Pubblicazione: (2025) -
Learning Gaussian Representation for Eye Fixation Prediction
di: Song, Peipei, et al.
Pubblicazione: (2024) -
FastOCR: Dynamic Visual Fixation via KV Cache Pruning for Efficient Document Parsing
di: Tang, Zihan, et al.
Pubblicazione: (2026) -
Attention-based Pin Site Image Classification in Orthopaedic Patients with External Fixators
di: Wang, Yubo, et al.
Pubblicazione: (2026) -
Visual Fixation-Based Retinal Prosthetic Simulation
di: Wu, Yuli, et al.
Pubblicazione: (2024)