Salvato in:
| Autori principali: | Mehmood, Tariq, Ahmad, Hamza, Shakeel, Muhammad Haroon, Taj, Murtaza |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2507.11522 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
DFA-CON: A Contrastive Learning Approach for Detecting Copyright Infringement in DeepFake Art
di: Wahab, Haroon, et al.
Pubblicazione: (2025)
di: Wahab, Haroon, et al.
Pubblicazione: (2025)
Camera Calibration through Geometric Constraints from Rotation and Projection Matrices
di: Waleed, Muhammad, et al.
Pubblicazione: (2024)
di: Waleed, Muhammad, et al.
Pubblicazione: (2024)
A Deep Features-Based Approach Using Modified ResNet50 and Gradient Boosting for Visual Sentiments Classification
di: Arslan, Muhammad, et al.
Pubblicazione: (2024)
di: Arslan, Muhammad, et al.
Pubblicazione: (2024)
DocVXQA: Context-Aware Visual Explanations for Document Question Answering
di: Souibgui, Mohamed Ali, et al.
Pubblicazione: (2025)
di: Souibgui, Mohamed Ali, et al.
Pubblicazione: (2025)
S-Chain: Structured Visual Chain-of-Thought For Medicine
di: Le-Duc, Khai, et al.
Pubblicazione: (2025)
di: Le-Duc, Khai, et al.
Pubblicazione: (2025)
Thermal Vision: Pioneering Non-Invasive Temperature Tracking in Congested Spaces
di: Samal, Arijit, et al.
Pubblicazione: (2024)
di: Samal, Arijit, et al.
Pubblicazione: (2024)
Unlocking Generalization for Robotics via Modularity and Scale
di: Dalal, Murtaza
Pubblicazione: (2025)
di: Dalal, Murtaza
Pubblicazione: (2025)
Bias Redistribution in Visual Machine Unlearning: Does Forgetting One Group Harm Another?
di: Haruna, Yunusa, et al.
Pubblicazione: (2026)
di: Haruna, Yunusa, et al.
Pubblicazione: (2026)
Context-Aware Meta-Learning
di: Fifty, Christopher, et al.
Pubblicazione: (2023)
di: Fifty, Christopher, et al.
Pubblicazione: (2023)
PromptHub: Enhancing Multi-Prompt Visual In-Context Learning with Locality-Aware Fusion, Concentration and Alignment
di: Luo, Tianci, et al.
Pubblicazione: (2026)
di: Luo, Tianci, et al.
Pubblicazione: (2026)
A Realistic Protocol for Evaluation of Weakly Supervised Object Localization
di: Murtaza, Shakeeb, et al.
Pubblicazione: (2024)
di: Murtaza, Shakeeb, et al.
Pubblicazione: (2024)
Leveraging Transformers for Weakly Supervised Object Localization in Unconstrained Videos
di: Murtaza, Shakeeb, et al.
Pubblicazione: (2024)
di: Murtaza, Shakeeb, et al.
Pubblicazione: (2024)
Imagine while Reasoning in Space: Multimodal Visualization-of-Thought
di: Li, Chengzu, et al.
Pubblicazione: (2025)
di: Li, Chengzu, et al.
Pubblicazione: (2025)
VisReason: A Large-Scale Dataset for Visual Chain-of-Thought Reasoning
di: Li, Lingxiao, et al.
Pubblicazione: (2025)
di: Li, Lingxiao, et al.
Pubblicazione: (2025)
Exploring State-of-the-art models for Early Detection of Forest Fires
di: Ahmed, Sharjeel, et al.
Pubblicazione: (2025)
di: Ahmed, Sharjeel, et al.
Pubblicazione: (2025)
Spatio-Temporal driven Attention Graph Neural Network with Block Adjacency matrix (STAG-NN-BA) for Remote Land-use Change Detection
di: Nazir, Usman, et al.
Pubblicazione: (2023)
di: Nazir, Usman, et al.
Pubblicazione: (2023)
Test-Time Visual In-Context Tuning
di: Xie, Jiahao, et al.
Pubblicazione: (2025)
di: Xie, Jiahao, et al.
Pubblicazione: (2025)
Personalized Vision via Visual In-Context Learning
di: Jiang, Yuxin, et al.
Pubblicazione: (2025)
di: Jiang, Yuxin, et al.
Pubblicazione: (2025)
Gated-Attention Feature-Fusion Based Framework for Poverty Prediction
di: Ramzan, Muhammad Umer, et al.
Pubblicazione: (2024)
di: Ramzan, Muhammad Umer, et al.
Pubblicazione: (2024)
TeD-Loc: Text Distillation for Weakly Supervised Object Localization
di: Murtaza, Shakeeb, et al.
Pubblicazione: (2025)
di: Murtaza, Shakeeb, et al.
Pubblicazione: (2025)
Context-Aware Multimodal Pretraining
di: Roth, Karsten, et al.
Pubblicazione: (2024)
di: Roth, Karsten, et al.
Pubblicazione: (2024)
Multi-Task Learning for Visually Grounded Reasoning in Gastrointestinal VQA
di: Safwan, Itbaan, et al.
Pubblicazione: (2025)
di: Safwan, Itbaan, et al.
Pubblicazione: (2025)
Improved Crop and Weed Detection with Diverse Data Ensemble Learning
di: Asad, Muhammad Hamza, et al.
Pubblicazione: (2023)
di: Asad, Muhammad Hamza, et al.
Pubblicazione: (2023)
LFRA-Net: A Lightweight Focal and Region-Aware Attention Network for Retinal Vessel Segmentatio
di: Mehmood, Mehwish, et al.
Pubblicazione: (2025)
di: Mehmood, Mehwish, et al.
Pubblicazione: (2025)
CASHG: Context-Aware Stylized Online Handwriting Generation
di: Shin, Jinsu, et al.
Pubblicazione: (2026)
di: Shin, Jinsu, et al.
Pubblicazione: (2026)
Context Sensitivity Improves Human-Machine Visual Alignment
di: Born, Frieda, et al.
Pubblicazione: (2026)
di: Born, Frieda, et al.
Pubblicazione: (2026)
CapCLIP: A Vision-Language Representation Alignment Approach for Wireless Capsule Endoscopy Analysis
di: Wahab, Haroon, et al.
Pubblicazione: (2026)
di: Wahab, Haroon, et al.
Pubblicazione: (2026)
Person Identification from Egocentric Human-Object Interactions using 3D Hand Pose
di: Hamza, Muhammad, et al.
Pubblicazione: (2025)
di: Hamza, Muhammad, et al.
Pubblicazione: (2025)
AnxietyFaceTrack: A Smartphone-Based Non-Intrusive Approach for Detecting Social Anxiety Using Facial Features
di: Sahu, Nilesh Kumar, et al.
Pubblicazione: (2025)
di: Sahu, Nilesh Kumar, et al.
Pubblicazione: (2025)
Chain-of-Visual-Thought: Teaching VLMs to See and Think Better with Continuous Visual Tokens
di: Qin, Yiming, et al.
Pubblicazione: (2025)
di: Qin, Yiming, et al.
Pubblicazione: (2025)
Stable Diffusion Models are Secretly Good at Visual In-Context Learning
di: Oorloff, Trevine, et al.
Pubblicazione: (2025)
di: Oorloff, Trevine, et al.
Pubblicazione: (2025)
The Effects of Grouped Structural Global Pruning of Vision Transformers on Domain Generalisation
di: Riaz, Hamza, et al.
Pubblicazione: (2025)
di: Riaz, Hamza, et al.
Pubblicazione: (2025)
Capturing Context-Aware Route Choice Semantics for Trajectory Representation Learning
di: Cao, Ji, et al.
Pubblicazione: (2025)
di: Cao, Ji, et al.
Pubblicazione: (2025)
Neural Language of Thought Models
di: Wu, Yi-Fu, et al.
Pubblicazione: (2024)
di: Wu, Yi-Fu, et al.
Pubblicazione: (2024)
A three in one bottom-up framework for simultaneous semantic segmentation, instance segmentation and classification of multi-organ nuclei in digital cancer histology
di: Ahmad, Ibtihaj, et al.
Pubblicazione: (2023)
di: Ahmad, Ibtihaj, et al.
Pubblicazione: (2023)
Learning to Compress Contexts for Efficient Knowledge-based Visual Question Answering
di: Weng, Weixi, et al.
Pubblicazione: (2024)
di: Weng, Weixi, et al.
Pubblicazione: (2024)
Architecture-Aware Explanation Auditing for Industrial Visual Inspection
di: Jia, Sibo, et al.
Pubblicazione: (2026)
di: Jia, Sibo, et al.
Pubblicazione: (2026)
Visual Analysis of Prediction Uncertainty in Neural Networks for Deep Image Synthesis
di: Dutta, Soumya, et al.
Pubblicazione: (2024)
di: Dutta, Soumya, et al.
Pubblicazione: (2024)
Deciphering the Underserved: Benchmarking LLM OCR for Low-Resource Scripts
di: Sohail, Muhammad Abdullah, et al.
Pubblicazione: (2024)
di: Sohail, Muhammad Abdullah, et al.
Pubblicazione: (2024)
Context-Based Semantic-Aware Alignment for Semi-Supervised Multi-Label Learning
di: Fan, Heng-Bo, et al.
Pubblicazione: (2024)
di: Fan, Heng-Bo, et al.
Pubblicazione: (2024)
Documenti analoghi
-
DFA-CON: A Contrastive Learning Approach for Detecting Copyright Infringement in DeepFake Art
di: Wahab, Haroon, et al.
Pubblicazione: (2025) -
Camera Calibration through Geometric Constraints from Rotation and Projection Matrices
di: Waleed, Muhammad, et al.
Pubblicazione: (2024) -
A Deep Features-Based Approach Using Modified ResNet50 and Gradient Boosting for Visual Sentiments Classification
di: Arslan, Muhammad, et al.
Pubblicazione: (2024) -
DocVXQA: Context-Aware Visual Explanations for Document Question Answering
di: Souibgui, Mohamed Ali, et al.
Pubblicazione: (2025) -
S-Chain: Structured Visual Chain-of-Thought For Medicine
di: Le-Duc, Khai, et al.
Pubblicazione: (2025)