ORIDa: Object-centric Real-world Image Composition Dataset
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Kim, Jinwoo, Han, Sangmin, Jeong, Jinho, Choi, Jiwoo, Kim, Dongyoung, Kim, Seon Joo |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Latent Space Super-Resolution for Higher-Resolution Image Generation with Diffusion Models
par: Jeong, Jinho, et autres
Publié: (2025)
par: Jeong, Jinho, et autres
Publié: (2025)
APT: Improving Diffusion Models for High Resolution Image Generation with Adaptive Path Tracing
par: Han, Sangmin, et autres
Publié: (2025)
par: Han, Sangmin, et autres
Publié: (2025)
Accelerating Image Super-Resolution Networks with Pixel-Level Classification
par: Jeong, Jinho, et autres
Publié: (2024)
par: Jeong, Jinho, et autres
Publié: (2024)
Attentive Illumination Decomposition Model for Multi-Illuminant White Balancing
par: Kim, Dongyoung, et autres
Publié: (2024)
par: Kim, Dongyoung, et autres
Publié: (2024)
Leveraging Image Augmentation for Object Manipulation: Towards Interpretable Controllability in Object-Centric Learning
par: Kim, Jinwoo, et autres
Publié: (2023)
par: Kim, Jinwoo, et autres
Publié: (2023)
CCMNet: Leveraging Calibrated Color Correction Matrices for Cross-Camera Color Constancy
par: Kim, Dongyoung, et autres
Publié: (2025)
par: Kim, Dongyoung, et autres
Publié: (2025)
ATTIQA: Generalizable Image Quality Feature Extractor using Attribute-aware Pretraining
par: Kwon, Daekyu, et autres
Publié: (2024)
par: Kwon, Daekyu, et autres
Publié: (2024)
Real-Time Person Image Synthesis Using a Flow Matching Model
par: Jeong, Jiwoo, et autres
Publié: (2025)
par: Jeong, Jiwoo, et autres
Publié: (2025)
SpatialBoost: Enhancing Visual Representation through Language-Guided Reasoning
par: Jeon, Byungwoo, et autres
Publié: (2026)
par: Jeon, Byungwoo, et autres
Publié: (2026)
Informative Object-centric Next Best View for Object-aware 3D Gaussian Splatting in Cluttered Scenes
par: Jeong, Seunghoon, et autres
Publié: (2026)
par: Jeong, Seunghoon, et autres
Publié: (2026)
Learning to Enhance Aperture Phasor Field for Non-Line-of-Sight Imaging
par: Cho, In, et autres
Publié: (2024)
par: Cho, In, et autres
Publié: (2024)
RawGen: Learning Camera Raw Image Generation
par: Kim, Dongyoung, et autres
Publié: (2026)
par: Kim, Dongyoung, et autres
Publié: (2026)
SlotVTG: Object-Centric Adapter for Generalizable Video Temporal Grounding
par: Han, Jiwook, et autres
Publié: (2026)
par: Han, Jiwook, et autres
Publié: (2026)
Seam360GS: Seamless 360° Gaussian Splatting from Real-World Omnidirectional Images
par: Shin, Changha, et autres
Publié: (2025)
par: Shin, Changha, et autres
Publié: (2025)
A Review of Image Retrieval Techniques: Data Augmentation and Adversarial Learning Approaches
par: Jinwoo, Kim
Publié: (2024)
par: Jinwoo, Kim
Publié: (2024)
Hierarchically Structured Neural Bones for Reconstructing Animatable Objects from Casual Videos
par: Jeon, Subin, et autres
Publié: (2024)
par: Jeon, Subin, et autres
Publié: (2024)
Object Aware Egocentric Online Action Detection
par: An, Joungbin, et autres
Publié: (2024)
par: An, Joungbin, et autres
Publié: (2024)
Dual-Stream Diffusion for World-Model Augmented Vision-Language-Action Model
par: Won, John, et autres
Publié: (2025)
par: Won, John, et autres
Publié: (2025)
OmniLocalRF: Omnidirectional Local Radiance Fields from Dynamic Videos
par: Choi, Dongyoung, et autres
Publié: (2024)
par: Choi, Dongyoung, et autres
Publié: (2024)
CaddieSet: A Golf Swing Dataset with Human Joint Features and Ball Information
par: Jung, Seunghyeon, et autres
Publié: (2025)
par: Jung, Seunghyeon, et autres
Publié: (2025)
Global Geometry Is Not Enough for Vision Representations
par: Chung, Jiwan, et autres
Publié: (2026)
par: Chung, Jiwan, et autres
Publié: (2026)
Object-aware Sound Source Localization via Audio-Visual Scene Understanding
par: Um, Sung Jin, et autres
Publié: (2025)
par: Um, Sung Jin, et autres
Publié: (2025)
RoboCurate: Harnessing Diversity with Action-Verified Neural Trajectory for Robot Learning
par: Kim, Seungku, et autres
Publié: (2026)
par: Kim, Seungku, et autres
Publié: (2026)
ExploreGS: Explorable 3D Scene Reconstruction with Virtual Camera Samplings and Diffusion Priors
par: Kim, Minsu, et autres
Publié: (2025)
par: Kim, Minsu, et autres
Publié: (2025)
RITUAL: Random Image Transformations as a Universal Anti-hallucination Lever in Large Vision Language Models
par: Woo, Sangmin, et autres
Publié: (2024)
par: Woo, Sangmin, et autres
Publié: (2024)
Building UI/UX Dataset for Dark Pattern Detection and YOLOv12x-based Real-Time Object Recognition Detection System
par: Jang, Se-Young, et autres
Publié: (2025)
par: Jang, Se-Young, et autres
Publié: (2025)
From Adaptation to Generalization: Adaptive Visual Prompting for Medical Image Segmentation
par: Çetinkaya, Evren, et autres
Publié: (2026)
par: Çetinkaya, Evren, et autres
Publié: (2026)
Open-ended Hierarchical Streaming Video Understanding with Vision Language Models
par: Kang, Hyolim, et autres
Publié: (2025)
par: Kang, Hyolim, et autres
Publié: (2025)
Text-Guided 6D Object Pose Rearrangement via Closed-Loop VLM Agents
par: Baik, Sangwon, et autres
Publié: (2026)
par: Baik, Sangwon, et autres
Publié: (2026)
ProtoOcc: Accurate, Efficient 3D Occupancy Prediction Using Dual Branch Encoder-Prototype Query Decoder
par: Kim, Jungho, et autres
Publié: (2024)
par: Kim, Jungho, et autres
Publié: (2024)
Towards Real-world Event-guided Low-light Video Enhancement and Deblurring
par: Kim, Taewoo, et autres
Publié: (2024)
par: Kim, Taewoo, et autres
Publié: (2024)
Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors
par: Jeon, Subin, et autres
Publié: (2025)
par: Jeon, Subin, et autres
Publié: (2025)
Domain Reduction Strategy for Non Line of Sight Imaging
par: Shim, Hyunbo, et autres
Publié: (2023)
par: Shim, Hyunbo, et autres
Publié: (2023)
NVS-Adapter: Plug-and-Play Novel View Synthesis from a Single Image
par: Jeong, Yoonwoo, et autres
Publié: (2023)
par: Jeong, Yoonwoo, et autres
Publié: (2023)
Why Can't I Open My Drawer? Mitigating Object-Driven Shortcuts in Zero-Shot Compositional Action Recognition
par: Ahn, Geo, et autres
Publié: (2026)
par: Ahn, Geo, et autres
Publié: (2026)
HiCM$^2$: Hierarchical Compact Memory Modeling for Dense Video Captioning
par: Kim, Minkuk, et autres
Publié: (2024)
par: Kim, Minkuk, et autres
Publié: (2024)
Do You Remember? Dense Video Captioning with Cross-Modal Memory Retrieval
par: Kim, Minkuk, et autres
Publié: (2024)
par: Kim, Minkuk, et autres
Publié: (2024)
DeVI: Physics-based Dexterous Human-Object Interaction via Synthetic Video Imitation
par: Kim, Hyeonwoo, et autres
Publié: (2026)
par: Kim, Hyeonwoo, et autres
Publié: (2026)
Visual Representation Learning with Stochastic Frame Prediction
par: Jang, Huiwon, et autres
Publié: (2024)
par: Jang, Huiwon, et autres
Publié: (2024)
CompSplat: Compression-aware 3D Gaussian Splatting for Real-world Video
par: Song, Hojun, et autres
Publié: (2026)
par: Song, Hojun, et autres
Publié: (2026)
Documents similaires
-
Latent Space Super-Resolution for Higher-Resolution Image Generation with Diffusion Models
par: Jeong, Jinho, et autres
Publié: (2025) -
APT: Improving Diffusion Models for High Resolution Image Generation with Adaptive Path Tracing
par: Han, Sangmin, et autres
Publié: (2025) -
Accelerating Image Super-Resolution Networks with Pixel-Level Classification
par: Jeong, Jinho, et autres
Publié: (2024) -
Attentive Illumination Decomposition Model for Multi-Illuminant White Balancing
par: Kim, Dongyoung, et autres
Publié: (2024) -
Leveraging Image Augmentation for Object Manipulation: Towards Interpretable Controllability in Object-Centric Learning
par: Kim, Jinwoo, et autres
Publié: (2023)