Auto-regressive transformation for image alignment
Fuente:
arXiv
Guardado en:
| Autores principales: | Lee, Kanggeon, Lee, Soochahn, Lee, Kyoung Mu |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
MatRes: Zero-Shot Test-Time Model Adaptation for Simultaneous Matching and Restoration
por: Lee, Kanggeon, et al.
Publicado: (2026)
por: Lee, Kanggeon, et al.
Publicado: (2026)
Particle Diffusion Matching: Random Walk Correspondence Search for the Alignment of Standard and Ultra-Widefield Fundus Images
por: Lee, Kanggeon, et al.
Publicado: (2026)
por: Lee, Kanggeon, et al.
Publicado: (2026)
Active Diffusion Matching: Score-based Iterative Alignment of Cross-Modal Retinal Images
por: Lee, Kanggeon, et al.
Publicado: (2026)
por: Lee, Kanggeon, et al.
Publicado: (2026)
Vector Scaffolding: Inter-Scale Orchestration for Differentiable Image Vectorization
por: Lee, Jaerin, et al.
Publicado: (2026)
por: Lee, Jaerin, et al.
Publicado: (2026)
MEIL-NeRF: Memory-Efficient Incremental Learning of Neural Radiance Fields
por: Chung, Jaeyoung, et al.
Publicado: (2022)
por: Chung, Jaeyoung, et al.
Publicado: (2022)
InpaintSLat: Inpainting Structured 3D Latents via Initial Noise Optimization
por: Chung, Jaeyoung, et al.
Publicado: (2026)
por: Chung, Jaeyoung, et al.
Publicado: (2026)
SemanticDraw: Towards Real-Time Interactive Content Creation from Image Diffusion Models
por: Lee, Jaerin, et al.
Publicado: (2024)
por: Lee, Jaerin, et al.
Publicado: (2024)
CLOSER: Towards Better Representation Learning for Few-Shot Class-Incremental Learning
por: Oh, Junghun, et al.
Publicado: (2024)
por: Oh, Junghun, et al.
Publicado: (2024)
Generative Phomosaic with Structure-Aligned and Personalized Diffusion
por: Chung, Jaeyoung, et al.
Publicado: (2026)
por: Chung, Jaeyoung, et al.
Publicado: (2026)
TeHOR: Text-Guided 3D Human and Object Reconstruction with Textures
por: Nam, Hyeongjin, et al.
Publicado: (2026)
por: Nam, Hyeongjin, et al.
Publicado: (2026)
DeClotH: Decomposable 3D Cloth and Human Body Reconstruction from a Single Image
por: Nam, Hyeongjin, et al.
Publicado: (2025)
por: Nam, Hyeongjin, et al.
Publicado: (2025)
Reasoning-Augmented Representations for Multimodal Retrieval
por: Zhang, Jianrui, et al.
Publicado: (2026)
por: Zhang, Jianrui, et al.
Publicado: (2026)
CoAPT: Context Attribute words for Prompt Tuning
por: Lee, Gun, et al.
Publicado: (2024)
por: Lee, Gun, et al.
Publicado: (2024)
Pisces: An Auto-regressive Foundation Model for Image Understanding and Generation
por: Xu, Zhiyang, et al.
Publicado: (2025)
por: Xu, Zhiyang, et al.
Publicado: (2025)
Multi-modal Auto-regressive Modeling via Visual Words
por: Peng, Tianshuo, et al.
Publicado: (2024)
por: Peng, Tianshuo, et al.
Publicado: (2024)
SelfSwapper: Self-Supervised Face Swapping via Shape Agnostic Masked AutoEncoder
por: Lee, Jaeseong, et al.
Publicado: (2024)
por: Lee, Jaeseong, et al.
Publicado: (2024)
ZipAR: Parallel Auto-regressive Image Generation through Spatial Locality
por: He, Yefei, et al.
Publicado: (2024)
por: He, Yefei, et al.
Publicado: (2024)
UniTalk: Towards Universal Active Speaker Detection in Real World Scenarios
por: Nguyen, Le Thien Phuc, et al.
Publicado: (2025)
por: Nguyen, Le Thien Phuc, et al.
Publicado: (2025)
DeepAf: One-Shot Spatiospectral Auto-Focus Model for Digital Pathology
por: Yeganeh, Yousef, et al.
Publicado: (2025)
por: Yeganeh, Yousef, et al.
Publicado: (2025)
Open-MAGVIT2: An Open-Source Project Toward Democratizing Auto-regressive Visual Generation
por: Luo, Zhuoyan, et al.
Publicado: (2024)
por: Luo, Zhuoyan, et al.
Publicado: (2024)
Training-free Detection of AI-generated images via Cropping Robustness
por: Choi, Sungik, et al.
Publicado: (2025)
por: Choi, Sungik, et al.
Publicado: (2025)
TexTailor: Customized Text-aligned Texturing via Effective Resampling
por: Lee, Suin, et al.
Publicado: (2025)
por: Lee, Suin, et al.
Publicado: (2025)
See, Hear, and Understand: Benchmarking Audiovisual Human Speech Understanding in Multimodal Large Language Models
por: Nguyen, Le Thien Phuc, et al.
Publicado: (2025)
por: Nguyen, Le Thien Phuc, et al.
Publicado: (2025)
CD-FKD: Cross-Domain Feature Knowledge Distillation for Robust Single-Domain Generalization in Object Detection
por: Lee, Junseok, et al.
Publicado: (2026)
por: Lee, Junseok, et al.
Publicado: (2026)
CRiM-GS: Continuous Rigid Motion-Aware Gaussian Splatting from Motion-Blurred Images
por: Lee, Jungho, et al.
Publicado: (2024)
por: Lee, Jungho, et al.
Publicado: (2024)
DiagNet: Detecting Objects using Diagonal Constraints on Adjacency Matrix of Graph Neural Network
por: Lee, Chong Hyun, et al.
Publicado: (2025)
por: Lee, Chong Hyun, et al.
Publicado: (2025)
Stabilizing Open-Set Test-Time Adaptation via Primary-Auxiliary Filtering and Knowledge-Integrated Prediction
por: Lee, Byung-Joon, et al.
Publicado: (2025)
por: Lee, Byung-Joon, et al.
Publicado: (2025)
A computer vision-based model for occupancy detection using low-resolution thermal images
por: Cui, Xue, et al.
Publicado: (2025)
por: Cui, Xue, et al.
Publicado: (2025)
SwiftVGGT: A Scalable Visual Geometry Grounded Transformer for Large-Scale Scenes
por: Lee, Jungho, et al.
Publicado: (2025)
por: Lee, Jungho, et al.
Publicado: (2025)
StarryGazer: Leveraging Monocular Depth Estimation Models for Domain-Agnostic Single Depth Image Completion
por: Hong, Sangmin, et al.
Publicado: (2025)
por: Hong, Sangmin, et al.
Publicado: (2025)
GS-Blur: A 3D Scene-Based Dataset for Realistic Image Deblurring
por: Lee, Dongwoo, et al.
Publicado: (2024)
por: Lee, Dongwoo, et al.
Publicado: (2024)
HIPPO-Video: Simulating Watch Histories with Large Language Models for Personalized Video Highlighting
por: Lee, Jeongeun, et al.
Publicado: (2025)
por: Lee, Jeongeun, et al.
Publicado: (2025)
Personalized Reward Modeling for Text-to-Image Generation
por: Lee, Jeongeun, et al.
Publicado: (2025)
por: Lee, Jeongeun, et al.
Publicado: (2025)
The Effects of Mixed Sample Data Augmentation are Class Dependent
por: Lee, Haeil, et al.
Publicado: (2023)
por: Lee, Haeil, et al.
Publicado: (2023)
Domain Generalization with Vital Phase Augmentation
por: Lee, Ingyun, et al.
Publicado: (2023)
por: Lee, Ingyun, et al.
Publicado: (2023)
Knowledge-Guided Textual Reasoning for Explainable Video Anomaly Detection via LLMs
por: Lee, Hari
Publicado: (2025)
por: Lee, Hari
Publicado: (2025)
CLIMB: Controllable Longitudinal Brain Image Generation using Mamba-based Latent Diffusion Model and Gaussian-aligned Autoencoder
por: Dao, Duy-Phuong, et al.
Publicado: (2026)
por: Dao, Duy-Phuong, et al.
Publicado: (2026)
Identifying bias in CNN image classification using image scrambling and transforms
por: Erukude, Sai Teja
Publicado: (2025)
por: Erukude, Sai Teja
Publicado: (2025)
Gabor-guided transformer for single image deraining
por: He, Sijin, et al.
Publicado: (2024)
por: He, Sijin, et al.
Publicado: (2024)
Segment Any 3D Object with Language
por: Lee, Seungjun, et al.
Publicado: (2024)
por: Lee, Seungjun, et al.
Publicado: (2024)
Ejemplares similares
-
MatRes: Zero-Shot Test-Time Model Adaptation for Simultaneous Matching and Restoration
por: Lee, Kanggeon, et al.
Publicado: (2026) -
Particle Diffusion Matching: Random Walk Correspondence Search for the Alignment of Standard and Ultra-Widefield Fundus Images
por: Lee, Kanggeon, et al.
Publicado: (2026) -
Active Diffusion Matching: Score-based Iterative Alignment of Cross-Modal Retinal Images
por: Lee, Kanggeon, et al.
Publicado: (2026) -
Vector Scaffolding: Inter-Scale Orchestration for Differentiable Image Vectorization
por: Lee, Jaerin, et al.
Publicado: (2026) -
MEIL-NeRF: Memory-Efficient Incremental Learning of Neural Radiance Fields
por: Chung, Jaeyoung, et al.
Publicado: (2022)