Ctrl123: Consistent Novel View Synthesis via Closed-Loop Transcription
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhao, Hongxiang, Dai, Xili, Wang, Jianan, Tong, Shengbang, Zhang, Jingyuan, Wang, Weida, Zhang, Lei, Ma, Yi |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Image Clustering via the Principle of Rate Reduction in the Age of Pretrained Models
par: Chu, Tianzhe, et autres
Publié: (2023)
par: Chu, Tianzhe, et autres
Publié: (2023)
Unposed Sparse Views Room Layout Reconstruction in the Age of Pretrain Model
par: Huang, Yaxuan, et autres
Publié: (2025)
par: Huang, Yaxuan, et autres
Publié: (2025)
GaussCtrl: Multi-View Consistent Text-Driven 3D Gaussian Splatting Editing
par: Wu, Jing, et autres
Publié: (2024)
par: Wu, Jing, et autres
Publié: (2024)
EmoCtrl: Controllable Emotional Image Content Generation
par: Yang, Jingyuan, et autres
Publié: (2025)
par: Yang, Jingyuan, et autres
Publié: (2025)
Cascade-Zero123: One Image to Highly Consistent 3D with Self-Prompted Nearby Views
par: Chen, Yabo, et autres
Publié: (2023)
par: Chen, Yabo, et autres
Publié: (2023)
Recollection from Pensieve: Novel View Synthesis via Learning from Uncalibrated Videos
par: Wang, Ruoyu, et autres
Publié: (2025)
par: Wang, Ruoyu, et autres
Publié: (2025)
Self-Ensembling Gaussian Splatting for Few-Shot Novel View Synthesis
par: Zhao, Chen, et autres
Publié: (2024)
par: Zhao, Chen, et autres
Publié: (2024)
NEMTO: Neural Environment Matting for Novel View and Relighting Synthesis of Transparent Objects
par: Wang, Dongqing, et autres
Publié: (2023)
par: Wang, Dongqing, et autres
Publié: (2023)
Ctrl-VI: Controllable Video Synthesis via Variational Inference
par: Duan, Haoyi, et autres
Publié: (2025)
par: Duan, Haoyi, et autres
Publié: (2025)
ConsistEdit: Highly Consistent and Precise Training-free Visual Editing
par: Yin, Zixin, et autres
Publié: (2025)
par: Yin, Zixin, et autres
Publié: (2025)
BlobCtrl: Taming Controllable Blob for Element-level Image Editing
par: Li, Yaowei, et autres
Publié: (2025)
par: Li, Yaowei, et autres
Publié: (2025)
CloseUpShot: Close-up Novel View Synthesis from Sparse-views via Point-conditioned Diffusion Model
par: Zhang, Yuqi, et autres
Publié: (2025)
par: Zhang, Yuqi, et autres
Publié: (2025)
Enhancing Close-up Novel View Synthesis via Pseudo-labeling
par: Xia, Jiatong, et autres
Publié: (2025)
par: Xia, Jiatong, et autres
Publié: (2025)
Pointmap-Conditioned Diffusion for Consistent Novel View Synthesis
par: Nguyen, Thang-Anh-Quan, et autres
Publié: (2025)
par: Nguyen, Thang-Anh-Quan, et autres
Publié: (2025)
View-Consistent 3D Editing with Gaussian Splatting
par: Wang, Yuxuan, et autres
Publié: (2024)
par: Wang, Yuxuan, et autres
Publié: (2024)
Structure Consistent Gaussian Splatting with Matching Prior for Few-shot Novel View Synthesis
par: Peng, Rui, et autres
Publié: (2024)
par: Peng, Rui, et autres
Publié: (2024)
Consistent Time-of-Flight Depth Denoising via Graph-Informed Geometric Attention
par: Wang, Weida, et autres
Publié: (2025)
par: Wang, Weida, et autres
Publié: (2025)
Asymmetric Idiosyncrasies in Multimodal Models
par: Tao, Muzi, et autres
Publié: (2026)
par: Tao, Muzi, et autres
Publié: (2026)
SpikeNVS: Enhancing Novel View Synthesis from Blurry Images via Spike Camera
par: Dai, Gaole, et autres
Publié: (2024)
par: Dai, Gaole, et autres
Publié: (2024)
Seeing from Another Perspective: Evaluating Multi-View Understanding in MLLMs
par: Yeh, Chun-Hsiao, et autres
Publié: (2025)
par: Yeh, Chun-Hsiao, et autres
Publié: (2025)
CMC: Few-shot Novel View Synthesis via Cross-view Multiplane Consistency
par: Zhu, Hanxin, et autres
Publié: (2024)
par: Zhu, Hanxin, et autres
Publié: (2024)
Consistent-1-to-3: Consistent Image to 3D View Synthesis via Geometry-aware Diffusion Models
par: Ye, Jianglong, et autres
Publié: (2023)
par: Ye, Jianglong, et autres
Publié: (2023)
RelaCtrl: Relevance-Guided Efficient Control for Diffusion Transformers
par: Cao, Ke, et autres
Publié: (2025)
par: Cao, Ke, et autres
Publié: (2025)
Connecting Joint-Embedding Predictive Architecture with Contrastive Self-supervised Learning
par: Mo, Shentong, et autres
Publié: (2024)
par: Mo, Shentong, et autres
Publié: (2024)
NerfBaselines: Consistent and Reproducible Evaluation of Novel View Synthesis Methods
par: Kulhanek, Jonas, et autres
Publié: (2024)
par: Kulhanek, Jonas, et autres
Publié: (2024)
High-Fidelity Novel View Synthesis via Splatting-Guided Diffusion
par: Zhang, Xiang, et autres
Publié: (2025)
par: Zhang, Xiang, et autres
Publié: (2025)
From Intention to Execution: Probing the Generalization Boundaries of Vision-Language-Action Models
par: Fang, Irving, et autres
Publié: (2025)
par: Fang, Irving, et autres
Publié: (2025)
EndoCogniAgent: Closed-Loop Agentic Reasoning with Self-Consistency Validation for Endoscopic Diagnosis
par: Tang, Yi, et autres
Publié: (2025)
par: Tang, Yi, et autres
Publié: (2025)
Reconstructing Topology-Consistent Face Mesh by Volume Rendering from Multi-View Images
par: Wang, Yating, et autres
Publié: (2024)
par: Wang, Yating, et autres
Publié: (2024)
Ctrl-U: Robust Conditional Image Generation via Uncertainty-aware Reward Modeling
par: Zhang, Guiyu, et autres
Publié: (2024)
par: Zhang, Guiyu, et autres
Publié: (2024)
Diffusion Transformers with Representation Autoencoders
par: Zheng, Boyang, et autres
Publié: (2025)
par: Zheng, Boyang, et autres
Publié: (2025)
CtrlVDiff: Controllable Video Generation via Unified Multimodal Video Diffusion
par: Xi, Dianbing, et autres
Publié: (2025)
par: Xi, Dianbing, et autres
Publié: (2025)
WonderFree: Enhancing Novel View Quality and Cross-View Consistency for 3D Scene Exploration
par: Ni, Chaojun, et autres
Publié: (2025)
par: Ni, Chaojun, et autres
Publié: (2025)
BAFNet: Bilateral Attention Fusion Network for Lightweight Semantic Segmentation of Urban Remote Sensing Images
par: Wang, Wentao, et autres
Publié: (2024)
par: Wang, Wentao, et autres
Publié: (2024)
XScale-NVS: Cross-Scale Novel View Synthesis with Hash Featurized Manifold
par: Wang, Guangyu, et autres
Publié: (2024)
par: Wang, Guangyu, et autres
Publié: (2024)
MultiDiff: Consistent Novel View Synthesis from a Single Image
par: Müller, Norman, et autres
Publié: (2024)
par: Müller, Norman, et autres
Publié: (2024)
Learn Your Scales: Towards Scale-Consistent Generative Novel View Synthesis
par: Forghani, Fereshteh, et autres
Publié: (2025)
par: Forghani, Fereshteh, et autres
Publié: (2025)
WAVE: Warp-Based View Guidance for Consistent Novel View Synthesis Using a Single Image
par: Park, Jiwoo, et autres
Publié: (2025)
par: Park, Jiwoo, et autres
Publié: (2025)
Diff3DS: Generating View-Consistent 3D Sketch via Differentiable Curve Rendering
par: Zhang, Yibo, et autres
Publié: (2024)
par: Zhang, Yibo, et autres
Publié: (2024)
XLD: A Cross-Lane Dataset for Benchmarking Novel Driving View Synthesis
par: Li, Hao, et autres
Publié: (2024)
par: Li, Hao, et autres
Publié: (2024)
Documents similaires
-
Image Clustering via the Principle of Rate Reduction in the Age of Pretrained Models
par: Chu, Tianzhe, et autres
Publié: (2023) -
Unposed Sparse Views Room Layout Reconstruction in the Age of Pretrain Model
par: Huang, Yaxuan, et autres
Publié: (2025) -
GaussCtrl: Multi-View Consistent Text-Driven 3D Gaussian Splatting Editing
par: Wu, Jing, et autres
Publié: (2024) -
EmoCtrl: Controllable Emotional Image Content Generation
par: Yang, Jingyuan, et autres
Publié: (2025) -
Cascade-Zero123: One Image to Highly Consistent 3D with Self-Prompted Nearby Views
par: Chen, Yabo, et autres
Publié: (2023)