GTA: Guided Transfer of Spatial Attention from Object-Centric Representations
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Seo, SeokHyun, Hong, Jinwoo, Chae, JungWoo, Kim, Kyungyul, Hwang, Sangheum |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Parallel Rescaling: Rebalancing Consistency Guidance for Personalized Diffusion Models
par: Chae, JungWoo, et autres
Publié: (2025)
par: Chae, JungWoo, et autres
Publié: (2025)
APT: Adaptive Personalized Training for Diffusion Models with Limited Data
par: Chae, JungWoo, et autres
Publié: (2025)
par: Chae, JungWoo, et autres
Publié: (2025)
StochCA: A Novel Approach for Exploiting Pretrained Models with Cross-Attention
par: Seo, Seungwon, et autres
Publié: (2024)
par: Seo, Seungwon, et autres
Publié: (2024)
Enhanced OoD Detection through Cross-Modal Alignment of Multi-Modal Representations
par: Kim, Jeonghyeon, et autres
Publié: (2025)
par: Kim, Jeonghyeon, et autres
Publié: (2025)
Localized Concept Erasure in Text-to-Image Diffusion Models via High-Level Representation Misdirection
par: Lee, Uichan, et autres
Publié: (2026)
par: Lee, Uichan, et autres
Publié: (2026)
Reflexive Guidance: Improving OoDD in Vision-Language Models via Self-Guided Image-Adaptive Concept Generation
par: Kim, Jihyo, et autres
Publié: (2024)
par: Kim, Jihyo, et autres
Publié: (2024)
Focusing Where Vision Matters: Selective Training for Large Vision Language Models via Visual Information Gain
par: Lee, Seulbi, et autres
Publié: (2026)
par: Lee, Seulbi, et autres
Publié: (2026)
GTA: Global Tracklet Association for Multi-Object Tracking in Sports
par: Sun, Jiacheng, et autres
Publié: (2024)
par: Sun, Jiacheng, et autres
Publié: (2024)
Reconstruction-Guided Slot Curriculum: Addressing Object Over-Fragmentation in Video Object-Centric Learning
par: Moon, WonJun, et autres
Publié: (2026)
par: Moon, WonJun, et autres
Publié: (2026)
Contrast-Guided Cross-Modal Distillation for Thermal Object Detection
par: Kim, SiWoo, et autres
Publié: (2025)
par: Kim, SiWoo, et autres
Publié: (2025)
SpatialBoost: Enhancing Visual Representation through Language-Guided Reasoning
par: Jeon, Byungwoo, et autres
Publié: (2026)
par: Jeon, Byungwoo, et autres
Publié: (2026)
From Vicious to Virtuous Cycles: Synergistic Representation Learning for Unsupervised Video Object-Centric Learning
par: Seong, Hyun Seok, et autres
Publié: (2026)
par: Seong, Hyun Seok, et autres
Publié: (2026)
SlotVTG: Object-Centric Adapter for Generalizable Video Temporal Grounding
par: Han, Jiwook, et autres
Publié: (2026)
par: Han, Jiwook, et autres
Publié: (2026)
Object-Centric Representation Learning for Enhanced 3D Semantic Scene Graph Prediction
par: Heo, KunHo, et autres
Publié: (2025)
par: Heo, KunHo, et autres
Publié: (2025)
Leveraging Image Augmentation for Object Manipulation: Towards Interpretable Controllability in Object-Centric Learning
par: Kim, Jinwoo, et autres
Publié: (2023)
par: Kim, Jinwoo, et autres
Publié: (2023)
Learning Global Object-Centric Representations via Disentangled Slot Attention
par: Chen, Tonglin, et autres
Publié: (2024)
par: Chen, Tonglin, et autres
Publié: (2024)
GaussianFlow SLAM: Monocular Gaussian Splatting SLAM Guided by GaussianFlow
par: Seo, Dong-Uk, et autres
Publié: (2026)
par: Seo, Dong-Uk, et autres
Publié: (2026)
Diffusion-Based User-Guided Data Augmentation for Coronary Stenosis Detection
par: Seo, Sumin, et autres
Publié: (2025)
par: Seo, Sumin, et autres
Publié: (2025)
EAGLE: Eigen Aggregation Learning for Object-Centric Unsupervised Semantic Segmentation
par: Kim, Chanyoung, et autres
Publié: (2024)
par: Kim, Chanyoung, et autres
Publié: (2024)
QASA: Quality-Guided K-Adaptive Slot Attention for Unsupervised Object-Centric Learning
par: Ouyang, Tianran, et autres
Publié: (2026)
par: Ouyang, Tianran, et autres
Publié: (2026)
Grouped Discrete Representation Guides Object-Centric Learning
par: Zhao, Rongzhen, et autres
Publié: (2024)
par: Zhao, Rongzhen, et autres
Publié: (2024)
An Anisotropic Cross-View Texture Transfer with Multi-Reference Non-Local Attention for CT Slice Interpolation
par: Uhm, Kwang-Hyun, et autres
Publié: (2025)
par: Uhm, Kwang-Hyun, et autres
Publié: (2025)
Fine-Grained Open-Vocabulary Object Recognition via User-Guided Segmentation
par: Ahn, Jinwoo, et autres
Publié: (2024)
par: Ahn, Jinwoo, et autres
Publié: (2024)
GTA-Crime: A Synthetic Dataset and Generation Framework for Fatal Violence Detection with Adversarial Snippet-Level Domain Adaptation
par: Kim, Seongho, et autres
Publié: (2025)
par: Kim, Seongho, et autres
Publié: (2025)
Disentangled Object-Centric Image Representation for Robotic Manipulation
par: Emukpere, David, et autres
Publié: (2025)
par: Emukpere, David, et autres
Publié: (2025)
Spatial Reasoning in Foundation Models: Benchmarking Object-Centric Spatial Understanding
par: Mirjalili, Vahid, et autres
Publié: (2025)
par: Mirjalili, Vahid, et autres
Publié: (2025)
CausalSpatial: A Benchmark for Object-Centric Causal Spatial Reasoning
par: Ma, Wenxin, et autres
Publié: (2026)
par: Ma, Wenxin, et autres
Publié: (2026)
Learning Object-Centric Representations in SAR Images with Multi-Level Feature Fusion
par: Jang, Oh-Tae, et autres
Publié: (2025)
par: Jang, Oh-Tae, et autres
Publié: (2025)
MAIR++: Improving Multi-view Attention Inverse Rendering with Implicit Lighting Representation
par: Choi, JunYong, et autres
Publié: (2024)
par: Choi, JunYong, et autres
Publié: (2024)
Learning to Compose: Improving Object Centric Learning by Injecting Compositionality
par: Jung, Whie, et autres
Publié: (2024)
par: Jung, Whie, et autres
Publié: (2024)
Top-Down Guidance for Learning Object-Centric Representations
par: Zou, Junhong, et autres
Publié: (2024)
par: Zou, Junhong, et autres
Publié: (2024)
Organized Grouped Discrete Representation for Object-Centric Learning
par: Zhao, Rongzhen, et autres
Publié: (2024)
par: Zhao, Rongzhen, et autres
Publié: (2024)
Slot-VAE: Object-Centric Scene Generation with Slot Attention
par: Wang, Yanbo, et autres
Publié: (2023)
par: Wang, Yanbo, et autres
Publié: (2023)
Object-Centric World Model for Language-Guided Manipulation
par: Jeong, Youngjoon, et autres
Publié: (2025)
par: Jeong, Youngjoon, et autres
Publié: (2025)
Video Spatial Reasoning with Object-Centric 3D Rollout
par: Tang, Haoran, et autres
Publié: (2025)
par: Tang, Haoran, et autres
Publié: (2025)
DeFloMat: Detection with Flow Matching for Stable and Efficient Generative Object Localization
par: Lee, Hansang, et autres
Publié: (2025)
par: Lee, Hansang, et autres
Publié: (2025)
GTA: A Geometry-Aware Attention Mechanism for Multi-View Transformers
par: Miyato, Takeru, et autres
Publié: (2023)
par: Miyato, Takeru, et autres
Publié: (2023)
MASH-VLM: Mitigating Action-Scene Hallucination in Video-LLMs through Disentangled Spatial-Temporal Representations
par: Bae, Kyungho, et autres
Publié: (2025)
par: Bae, Kyungho, et autres
Publié: (2025)
FEAST: Fully Connected Expressive Attention for Spatial Transcriptomics
par: Jeong, Taejin, et autres
Publié: (2026)
par: Jeong, Taejin, et autres
Publié: (2026)
Attention Guided CAM: Visual Explanations of Vision Transformer Guided by Self-Attention
par: Leem, Saebom, et autres
Publié: (2024)
par: Leem, Saebom, et autres
Publié: (2024)
Documents similaires
-
Parallel Rescaling: Rebalancing Consistency Guidance for Personalized Diffusion Models
par: Chae, JungWoo, et autres
Publié: (2025) -
APT: Adaptive Personalized Training for Diffusion Models with Limited Data
par: Chae, JungWoo, et autres
Publié: (2025) -
StochCA: A Novel Approach for Exploiting Pretrained Models with Cross-Attention
par: Seo, Seungwon, et autres
Publié: (2024) -
Enhanced OoD Detection through Cross-Modal Alignment of Multi-Modal Representations
par: Kim, Jeonghyeon, et autres
Publié: (2025) -
Localized Concept Erasure in Text-to-Image Diffusion Models via High-Level Representation Misdirection
par: Lee, Uichan, et autres
Publié: (2026)