Enregistré dans:
| Auteurs principaux: | Park, Ji-Hoon, Ju, Yeong-Joon, Lee, Seong-Whan |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2402.10404 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
MIRe: Enhancing Multimodal Queries Representation via Fusion-Free Modality Interaction for Multimodal Retrieval
par: Ju, Yeong-Joon, et autres
Publié: (2024)
par: Ju, Yeong-Joon, et autres
Publié: (2024)
DarSwin: Distortion Aware Radial Swin Transformer
par: Athwale, Akshaya, et autres
Publié: (2023)
par: Athwale, Akshaya, et autres
Publié: (2023)
Semantic Depth Matters: Explaining Errors of Deep Vision Networks through Perceived Class Similarities
par: Filus, Katarzyna, et autres
Publié: (2025)
par: Filus, Katarzyna, et autres
Publié: (2025)
Identity-free Artificial Emotional Intelligence via Micro-Gesture Understanding
par: Gao, Rong, et autres
Publié: (2024)
par: Gao, Rong, et autres
Publié: (2024)
Deepfakes on Demand: the rise of accessible non-consensual deepfake image generators
par: Hawkins, Will, et autres
Publié: (2025)
par: Hawkins, Will, et autres
Publié: (2025)
Matrix-Valued LogSumExp Approximation for Colour Morphology
par: Kahra, Marvin, et autres
Publié: (2024)
par: Kahra, Marvin, et autres
Publié: (2024)
Colour Morphological Distance Ordering based on the Log-Exp-Supremum
par: Kahra, Marvin, et autres
Publié: (2025)
par: Kahra, Marvin, et autres
Publié: (2025)
Sequence Transferability and Task Order Selection in Continual Learning
par: Nguyen, Thinh, et autres
Publié: (2025)
par: Nguyen, Thinh, et autres
Publié: (2025)
From Volume Rendering to 3D Gaussian Splatting: Theory and Applications
par: Matias, Vitor Pereira, et autres
Publié: (2025)
par: Matias, Vitor Pereira, et autres
Publié: (2025)
What is the Visual Cognition Gap between Humans and Multimodal LLMs?
par: Cao, Xu, et autres
Publié: (2024)
par: Cao, Xu, et autres
Publié: (2024)
Animation Needs Attention: A Holistic Approach to Slides Animation Comprehension with Visual-Language Models
par: Jiang, Yifan, et autres
Publié: (2025)
par: Jiang, Yifan, et autres
Publié: (2025)
DQE-CIR: Distinctive Query Embeddings through Learnable Attribute Weights and Target Relative Negative Sampling in Composed Image Retrieval
par: Park, Geon, et autres
Publié: (2026)
par: Park, Geon, et autres
Publié: (2026)
MedShapeNet -- A Large-Scale Dataset of 3D Medical Shapes for Computer Vision
par: Li, Jianning, et autres
Publié: (2023)
par: Li, Jianning, et autres
Publié: (2023)
A Hierarchically Feature Reconstructed Autoencoder for Unsupervised Anomaly Detection
par: Chen, Honghui, et autres
Publié: (2024)
par: Chen, Honghui, et autres
Publié: (2024)
Semantic Prioritization in Visual Counterfactual Explanations with Weighted Segmentation and Auto-Adaptive Region Selection
par: Zhang, Lintong, et autres
Publié: (2025)
par: Zhang, Lintong, et autres
Publié: (2025)
Universal Adversarial Perturbations for Vision-Language Pre-trained Models
par: Zhang, Peng-Fei, et autres
Publié: (2024)
par: Zhang, Peng-Fei, et autres
Publié: (2024)
AIDOVECL: AI-generated Dataset of Outpainted Vehicles for Eye-level Classification and Localization
par: Kazemi, Amir, et autres
Publié: (2024)
par: Kazemi, Amir, et autres
Publié: (2024)
Accelerating Large Kernel Convolutions with Nested Winograd Transformation.pdf
par: Jiang, Jingbo, et autres
Publié: (2021)
par: Jiang, Jingbo, et autres
Publié: (2021)
Empowering Manufacturers with Privacy-Preserving AI Tools: A Case Study in Privacy-Preserving Machine Learning to Solve Real-World Problems
par: Ji, Xiaoyu, et autres
Publié: (2025)
par: Ji, Xiaoyu, et autres
Publié: (2025)
Pedestrian intention prediction in Adverse Weather Conditions with Spiking Neural Networks and Dynamic Vision Sensors
par: Sakhai, Mustafa, et autres
Publié: (2024)
par: Sakhai, Mustafa, et autres
Publié: (2024)
VACoDe: Visual Augmented Contrastive Decoding
par: Kim, Sihyeon, et autres
Publié: (2024)
par: Kim, Sihyeon, et autres
Publié: (2024)
HAAP: Vision-context Hierarchical Attention Autoregressive with Adaptive Permutation for Scene Text Recognition
par: Chen, Honghui, et autres
Publié: (2024)
par: Chen, Honghui, et autres
Publié: (2024)
Rethinking Evaluation of Multiple Sclerosis (MS) Lesion Segmentation Models
par: Basit, Abdul, et autres
Publié: (2026)
par: Basit, Abdul, et autres
Publié: (2026)
A lifted Bregman strategy for training unfolded proximal neural network Gaussian denoisers
par: Wang, Xiaoyu, et autres
Publié: (2024)
par: Wang, Xiaoyu, et autres
Publié: (2024)
Socratic Planner: Self-QA-Based Zero-Shot Planning for Embodied Instruction Following
par: Shin, Suyeon, et autres
Publié: (2024)
par: Shin, Suyeon, et autres
Publié: (2024)
Upper-body free-breathing Magnetic Resonance Fingerprinting applied to the quantification of water T1 and fat fraction
par: Slioussarenko, Constantin, et autres
Publié: (2024)
par: Slioussarenko, Constantin, et autres
Publié: (2024)
African Gender Classification Using Clothing Identification Via Deep Learning
par: Ozechi, Samuel
Publié: (2025)
par: Ozechi, Samuel
Publié: (2025)
On Discrete Prompt Optimization for Diffusion Models
par: Wang, Ruochen, et autres
Publié: (2024)
par: Wang, Ruochen, et autres
Publié: (2024)
Representative Feature Extraction During Diffusion Process for Sketch Extraction with One Example
par: Yun, Kwan, et autres
Publié: (2024)
par: Yun, Kwan, et autres
Publié: (2024)
Semantic2Graph: Graph-based Multi-modal Feature Fusion for Action Segmentation in Videos
par: Zhang, Junbin, et autres
Publié: (2022)
par: Zhang, Junbin, et autres
Publié: (2022)
Leveraging CNN and IoT for Effective E-Waste Management
par: Nadar, Ajesh Thangaraj, et autres
Publié: (2025)
par: Nadar, Ajesh Thangaraj, et autres
Publié: (2025)
SASWISE-UE: Segmentation and Synthesis with Interpretable Scalable Ensembles for Uncertainty Estimation
par: Chen, Weijie, et autres
Publié: (2024)
par: Chen, Weijie, et autres
Publié: (2024)
Reconstructing Gridded Data from Higher Autocorrelations
par: Casper, W. Riley, et autres
Publié: (2025)
par: Casper, W. Riley, et autres
Publié: (2025)
FST.ai 2.0: An Explainable AI Ecosystem for Fair, Fast, and Inclusive Decision-Making in Olympic and Paralympic Taekwondo
par: Shariatmadar, Keivan, et autres
Publié: (2025)
par: Shariatmadar, Keivan, et autres
Publié: (2025)
Vision transformer-based multi-camera multi-object tracking framework for dairy cow monitoring
par: Abbas, Kumail, et autres
Publié: (2025)
par: Abbas, Kumail, et autres
Publié: (2025)
MCoT-RE: Multi-Faceted Chain-of-Thought and Re-Ranking for Training-Free Zero-Shot Composed Image Retrieval
par: Park, Jeong-Woo, et autres
Publié: (2025)
par: Park, Jeong-Woo, et autres
Publié: (2025)
Evaluation of (Un-)Supervised Machine Learning Methods for GNSS Interference Classification with Real-World Data Discrepancies
par: Heublein, Lucas, et autres
Publié: (2025)
par: Heublein, Lucas, et autres
Publié: (2025)
Representation Selection via Cross-Model Agreement using Canonical Correlation Analysis
par: Lewis, Dylan B., et autres
Publié: (2026)
par: Lewis, Dylan B., et autres
Publié: (2026)
Surrealistic-like Image Generation with Vision-Language Models
par: Ayten, Elif, et autres
Publié: (2024)
par: Ayten, Elif, et autres
Publié: (2024)
TIFu: Tri-directional Implicit Function for High-Fidelity 3D Character Reconstruction
par: Lim, Byoungsung, et autres
Publié: (2024)
par: Lim, Byoungsung, et autres
Publié: (2024)
Documents similaires
-
MIRe: Enhancing Multimodal Queries Representation via Fusion-Free Modality Interaction for Multimodal Retrieval
par: Ju, Yeong-Joon, et autres
Publié: (2024) -
DarSwin: Distortion Aware Radial Swin Transformer
par: Athwale, Akshaya, et autres
Publié: (2023) -
Semantic Depth Matters: Explaining Errors of Deep Vision Networks through Perceived Class Similarities
par: Filus, Katarzyna, et autres
Publié: (2025) -
Identity-free Artificial Emotional Intelligence via Micro-Gesture Understanding
par: Gao, Rong, et autres
Publié: (2024) -
Deepfakes on Demand: the rise of accessible non-consensual deepfake image generators
par: Hawkins, Will, et autres
Publié: (2025)