Enregistré dans:
| Auteurs principaux: | Gouidis, Filippos, Papantoniou, Katerina, Papoutsakis, Konstantinos, Patkos, Theodore, Argyros, Antonis, Plexousakis, Dimitris |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2403.12151 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Recognizing Unseen States of Unknown Objects by Leveraging Knowledge Graphs
par: Gouidis, Filipos, et autres
Publié: (2023)
par: Gouidis, Filipos, et autres
Publié: (2023)
Anticipating Object State Changes in Long Procedural Videos
par: Manousaki, Victoria, et autres
Publié: (2024)
par: Manousaki, Victoria, et autres
Publié: (2024)
Understanding Multimodal Complementarity for Single-Frame Action Anticipation
par: Benavent-Lledo, Manuel, et autres
Publié: (2026)
par: Benavent-Lledo, Manuel, et autres
Publié: (2026)
Action Anticipation at a Glimpse: To What Extent Can Multimodal Cues Replace Video?
par: Benavent-Lledo, Manuel, et autres
Publié: (2025)
par: Benavent-Lledo, Manuel, et autres
Publié: (2025)
Vision-Based Mistake Analysis in Procedural Activities: A Review of Advances and Challenges
par: Bacharidis, Konstantinos, et autres
Publié: (2025)
par: Bacharidis, Konstantinos, et autres
Publié: (2025)
ENACT: Entropy-based Clustering of Attention Input for Reducing the Computational Needs of Object Detection Transformers
par: Savathrakis, Giorgos, et autres
Publié: (2024)
par: Savathrakis, Giorgos, et autres
Publié: (2024)
OCCAM: Class-Agnostic, Training-Free, Prior-Free and Multi-Class Object Counting
par: Spanakis, Michail, et autres
Publié: (2026)
par: Spanakis, Michail, et autres
Publié: (2026)
NLP for The Greek Language: A Longer Survey
par: Papantoniou, Katerina, et autres
Publié: (2024)
par: Papantoniou, Katerina, et autres
Publié: (2024)
D-PoSE: Depth as an Intermediate Representation for 3D Human Pose and Shape Estimation
par: Vasilikopoulos, Nikolaos, et autres
Publié: (2024)
par: Vasilikopoulos, Nikolaos, et autres
Publié: (2024)
DK-PRACTICE: An Intelligent Educational Platform for Personalized Learning Content Recommendations Based on Students Knowledge State
par: Delianidi, Marina, et autres
Publié: (2024)
par: Delianidi, Marina, et autres
Publié: (2024)
Enhancing Monocular 3D Hand Reconstruction with Learned Texture Priors
par: Karvounas, Giorgos, et autres
Publié: (2025)
par: Karvounas, Giorgos, et autres
Publié: (2025)
Exploring Zero-Shot ACSA with Unified Meaning Representation in Chain-of-Thought Prompting
par: Ventirozos, Filippos, et autres
Publié: (2025)
par: Ventirozos, Filippos, et autres
Publié: (2025)
Test-Time Spectrum-Aware Latent Steering for Zero-Shot Generalization in Vision-Language Models
par: Dafnis, Konstantinos M., et autres
Publié: (2025)
par: Dafnis, Konstantinos M., et autres
Publié: (2025)
Y-MAP-Net: Real-time depth, normals, segmentation, multi-label captioning and 2D human pose in RGB images
par: Qammaz, Ammar, et autres
Publié: (2024)
par: Qammaz, Ammar, et autres
Publié: (2024)
Domain-Specific Knowledge Graphs in RAG-Enhanced Healthcare LLMs
par: Anuyah, Sydney, et autres
Publié: (2026)
par: Anuyah, Sydney, et autres
Publié: (2026)
A vision-based framework for human behavior understanding in industrial assembly lines
par: Papoutsakis, Konstantinos, et autres
Publié: (2024)
par: Papoutsakis, Konstantinos, et autres
Publié: (2024)
Enhancing Action Recognition by Leveraging the Hierarchical Structure of Actions and Textual Context
par: Benavent-Lledo, Manuel, et autres
Publié: (2024)
par: Benavent-Lledo, Manuel, et autres
Publié: (2024)
Combining Facial Videos and Biosignals for Stress Estimation During Driving
par: Valergaki, Paraskevi, et autres
Publié: (2026)
par: Valergaki, Paraskevi, et autres
Publié: (2026)
BlendCLIP: Bridging Synthetic and Real Domains for Zero-Shot 3D Object Classification with Multimodal Pretraining
par: Khoche, Ajinkya, et autres
Publié: (2025)
par: Khoche, Ajinkya, et autres
Publié: (2025)
Boosting Object Detection with Zero-Shot Day-Night Domain Adaptation
par: Du, Zhipeng, et autres
Publié: (2023)
par: Du, Zhipeng, et autres
Publié: (2023)
CICA: Content-Injected Contrastive Alignment for Zero-Shot Document Image Classification
par: Sinha, Sankalp, et autres
Publié: (2024)
par: Sinha, Sankalp, et autres
Publié: (2024)
ID-Consistent, Precise Expression Generation with Blendshape-Guided Diffusion
par: Papantoniou, Foivos Paraperas, et autres
Publié: (2025)
par: Papantoniou, Foivos Paraperas, et autres
Publié: (2025)
Will It Zero-Shot?: Predicting Zero-Shot Classification Performance For Arbitrary Queries
par: Robbins, Kevin, et autres
Publié: (2026)
par: Robbins, Kevin, et autres
Publié: (2026)
Schema Augmentation for Zero-Shot Domain Adaptation in Dialogue State Tracking
par: Richardson, Christopher, et autres
Publié: (2024)
par: Richardson, Christopher, et autres
Publié: (2024)
Virtual Classification: Modulating Domain-Specific Knowledge for Multidomain Crowd Counting
par: Guo, Mingyue, et autres
Publié: (2024)
par: Guo, Mingyue, et autres
Publié: (2024)
Interpreting and Analysing CLIP's Zero-Shot Image Classification via Mutual Knowledge
par: Sammani, Fawaz, et autres
Publié: (2024)
par: Sammani, Fawaz, et autres
Publié: (2024)
Zero-Training Task-Specific Model Synthesis for Few-Shot Medical Image Classification
par: Qin, Yao, et autres
Publié: (2025)
par: Qin, Yao, et autres
Publié: (2025)
Optimizing Latent Graph Representations of Surgical Scenes for Zero-Shot Domain Transfer
par: Satyanaik, Siddhant, et autres
Publié: (2024)
par: Satyanaik, Siddhant, et autres
Publié: (2024)
Pushing Boundaries: Exploring Zero Shot Object Classification with Large Multimodal Models
par: Islam, Ashhadul, et autres
Publié: (2023)
par: Islam, Ashhadul, et autres
Publié: (2023)
TSPE: Task-Specific Prompt Ensemble for Improved Zero-Shot Audio Classification
par: Anand, Nishit, et autres
Publié: (2024)
par: Anand, Nishit, et autres
Publié: (2024)
Enhancing Zero-Shot Facial Expression Recognition by LLM Knowledge Transfer
par: Zhao, Zengqun, et autres
Publié: (2024)
par: Zhao, Zengqun, et autres
Publié: (2024)
Categorical Knowledge Fused Recognition: Fusing Hierarchical Knowledge with Image Classification through Aligning and Deep Metric Learning
par: Zhao, Yunfeng, et autres
Publié: (2024)
par: Zhao, Yunfeng, et autres
Publié: (2024)
Domain-Specific Improvement on Psychotherapy Chatbot Using Assistant
par: Kang, Cheng, et autres
Publié: (2024)
par: Kang, Cheng, et autres
Publié: (2024)
Energy-based Models are Zero-Shot Planners for Compositional Scene Rearrangement
par: Gkanatsios, Nikolaos, et autres
Publié: (2023)
par: Gkanatsios, Nikolaos, et autres
Publié: (2023)
Insert In Style: A Zero-Shot Generative Framework for Harmonious Cross-Domain Object Composition
par: Chittersu, Raghu Vamsi, et autres
Publié: (2025)
par: Chittersu, Raghu Vamsi, et autres
Publié: (2025)
UPRE: Zero-Shot Domain Adaptation for Object Detection via Unified Prompt and Representation Enhancement
par: Zhang, Xiao, et autres
Publié: (2025)
par: Zhang, Xiao, et autres
Publié: (2025)
Fine-Grained Zero-Shot Object Detection
par: Ma, Hongxu, et autres
Publié: (2025)
par: Ma, Hongxu, et autres
Publié: (2025)
Text-guided Zero-Shot Object Localization
par: Wang, Jingjing, et autres
Publié: (2024)
par: Wang, Jingjing, et autres
Publié: (2024)
Zero-Shot Multi-Object Scene Completion
par: Iwase, Shun, et autres
Publié: (2024)
par: Iwase, Shun, et autres
Publié: (2024)
Enhancing Feedback Control Schemes through Semantic Configuration in Online Environments
par: Andreas P. Constantinou, et autres
Publié: (2020)
par: Andreas P. Constantinou, et autres
Publié: (2020)
Documents similaires
-
Recognizing Unseen States of Unknown Objects by Leveraging Knowledge Graphs
par: Gouidis, Filipos, et autres
Publié: (2023) -
Anticipating Object State Changes in Long Procedural Videos
par: Manousaki, Victoria, et autres
Publié: (2024) -
Understanding Multimodal Complementarity for Single-Frame Action Anticipation
par: Benavent-Lledo, Manuel, et autres
Publié: (2026) -
Action Anticipation at a Glimpse: To What Extent Can Multimodal Cues Replace Video?
par: Benavent-Lledo, Manuel, et autres
Publié: (2025) -
Vision-Based Mistake Analysis in Procedural Activities: A Review of Advances and Challenges
par: Bacharidis, Konstantinos, et autres
Publié: (2025)