Fixing the Perspective: A Critical Examination of Zero-1-to-3
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yu, Jack, Jia, Xueying, Sun, Charlie, Wang, Prince |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Accelerating Non-Maximum Suppression: A Graph Theory Perspective
par: Si, King-Siong, et autres
Publié: (2024)
par: Si, King-Siong, et autres
Publié: (2024)
Trainable Fixed-Point Quantization for Deep Learning Acceleration on FPGAs
par: Dai, Dingyi, et autres
Publié: (2024)
par: Dai, Dingyi, et autres
Publié: (2024)
PointFix: Learning to Fix Domain Bias for Robust Online Stereo Adaptation
par: Kim, Kwonyoung, et autres
Publié: (2022)
par: Kim, Kwonyoung, et autres
Publié: (2022)
LLaVA-Critic-R1: Your Critic Model is Secretly a Strong Policy Model
par: Wang, Xiyao, et autres
Publié: (2025)
par: Wang, Xiyao, et autres
Publié: (2025)
Lie Detector: Unified Backdoor Detection via Cross-Examination Framework
par: Wang, Xuan, et autres
Publié: (2025)
par: Wang, Xuan, et autres
Publié: (2025)
T3: Test-Time Model Merging in VLMs for Zero-Shot Medical Imaging Analysis
par: Imam, Raza, et autres
Publié: (2025)
par: Imam, Raza, et autres
Publié: (2025)
Accelerating Deep Learning with Fixed Time Budget
par: Khan, Muhammad Asif, et autres
Publié: (2024)
par: Khan, Muhammad Asif, et autres
Publié: (2024)
Zero-shot domain adaptation based on dual-level mix and contrast
par: Zhe, Yu, et autres
Publié: (2024)
par: Zhe, Yu, et autres
Publié: (2024)
MM-Zero: Self-Evolving Multi-Model Vision Language Models From Zero Data
par: Li, Zongxia, et autres
Publié: (2026)
par: Li, Zongxia, et autres
Publié: (2026)
FGGP: Fixed-Rate Gradient-First Gradual Pruning
par: Zhu, Lingkai, et autres
Publié: (2024)
par: Zhu, Lingkai, et autres
Publié: (2024)
UM3: Unsupervised Map to Map Matching
par: Ying, Chaolong, et autres
Publié: (2025)
par: Ying, Chaolong, et autres
Publié: (2025)
Rethinking Autoencoders for Medical Anomaly Detection from A Theoretical Perspective
par: Cai, Yu, et autres
Publié: (2024)
par: Cai, Yu, et autres
Publié: (2024)
A New Perspective on Privacy Protection in Federated Learning with Granular-Ball Computing
par: Lai, Guannan, et autres
Publié: (2025)
par: Lai, Guannan, et autres
Publié: (2025)
Beyond Training: Dynamic Token Merging for Zero-Shot Video Understanding
par: Zhang, Yiming, et autres
Publié: (2024)
par: Zhang, Yiming, et autres
Publié: (2024)
Pose Splatter: A 3D Gaussian Splatting Model for Quantifying Animal Pose and Appearance
par: Goffinet, Jack, et autres
Publié: (2025)
par: Goffinet, Jack, et autres
Publié: (2025)
A Geometric Perspective on Diffusion Models
par: Chen, Defang, et autres
Publié: (2023)
par: Chen, Defang, et autres
Publié: (2023)
Improving Robustness of LiDAR-Camera Fusion Model against Weather Corruption from Fusion Strategy Perspective
par: Huang, Yihao, et autres
Publié: (2024)
par: Huang, Yihao, et autres
Publié: (2024)
DiffusionOPD: A Unified Perspective of On-Policy Distillation in Diffusion Models
par: Li, Quanhao, et autres
Publié: (2026)
par: Li, Quanhao, et autres
Publié: (2026)
Synthetic Data is Sufficient for Zero-Shot Visual Generalization from Offline Data
par: Güzel, Ahmet H., et autres
Publié: (2025)
par: Güzel, Ahmet H., et autres
Publié: (2025)
ZeroDiff: Solidified Visual-Semantic Correlation in Zero-Shot Learning
par: Ye, Zihan, et autres
Publié: (2024)
par: Ye, Zihan, et autres
Publié: (2024)
Attention IoU: Examining Biases in CelebA using Attention Maps
par: Serianni, Aaron, et autres
Publié: (2025)
par: Serianni, Aaron, et autres
Publié: (2025)
Revisiting Neural Networks for Continual Learning: An Architectural Perspective
par: Lu, Aojun, et autres
Publié: (2024)
par: Lu, Aojun, et autres
Publié: (2024)
LRM-Zero: Training Large Reconstruction Models with Synthesized Data
par: Xie, Desai, et autres
Publié: (2024)
par: Xie, Desai, et autres
Publié: (2024)
Self-Evolving Visual Concept Library using Vision-Language Critics
par: Sehgal, Atharva, et autres
Publié: (2025)
par: Sehgal, Atharva, et autres
Publié: (2025)
ORIGEN: Zero-Shot 3D Orientation Grounding in Text-to-Image Generation
par: Min, Yunhong, et autres
Publié: (2025)
par: Min, Yunhong, et autres
Publié: (2025)
Set a Thief to Catch a Thief: Combating Label Noise through Noisy Meta Learning
par: Wang, Hanxuan, et autres
Publié: (2025)
par: Wang, Hanxuan, et autres
Publié: (2025)
VAR-3D: View-aware Auto-Regressive Model for Text-to-3D Generation via a 3D Tokenizer
par: Han, Zongcheng, et autres
Publié: (2026)
par: Han, Zongcheng, et autres
Publié: (2026)
Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling
par: Wu, Qirui, et autres
Publié: (2024)
par: Wu, Qirui, et autres
Publié: (2024)
Splatt3R: Zero-shot Gaussian Splatting from Uncalibrated Image Pairs
par: Smart, Brandon, et autres
Publié: (2024)
par: Smart, Brandon, et autres
Publié: (2024)
MCL-AD: Multimodal Collaboration Learning for Zero-Shot 3D Anomaly Detection
par: Li, Gang, et autres
Publié: (2025)
par: Li, Gang, et autres
Publié: (2025)
SEVD: Synthetic Event-based Vision Dataset for Ego and Fixed Traffic Perception
par: Aliminati, Manideep Reddy, et autres
Publié: (2024)
par: Aliminati, Manideep Reddy, et autres
Publié: (2024)
Rethinking the Stability-Plasticity Trade-off in Continual Learning from an Architectural Perspective
par: Lu, Aojun, et autres
Publié: (2025)
par: Lu, Aojun, et autres
Publié: (2025)
MetaSlot: Break Through the Fixed Number of Slots in Object-Centric Learning
par: Liu, Hongjia, et autres
Publié: (2025)
par: Liu, Hongjia, et autres
Publié: (2025)
Beyond Fixed Formulas: Data-Driven Linear Predictor for Efficient Diffusion Models
par: Shen, Zhirong, et autres
Publié: (2026)
par: Shen, Zhirong, et autres
Publié: (2026)
Preventing Catastrophic Overfitting in Fast Adversarial Training: A Bi-level Optimization Perspective
par: Wang, Zhaoxin, et autres
Publié: (2024)
par: Wang, Zhaoxin, et autres
Publié: (2024)
The Illusion of Progress? A Critical Look at Test-Time Adaptation for Vision-Language Models
par: Sheng, Lijun, et autres
Publié: (2025)
par: Sheng, Lijun, et autres
Publié: (2025)
SiamMM: A Mixture Model Perspective on Deep Unsupervised Learning
par: Wang, Xiaodong, et autres
Publié: (2025)
par: Wang, Xiaodong, et autres
Publié: (2025)
Why Does RL Generalize Better Than SFT? A Data-Centric Perspective on VLM Post-Training
par: Lu, Aojun, et autres
Publié: (2026)
par: Lu, Aojun, et autres
Publié: (2026)
Zero-Shot Neural Architecture Search: Challenges, Solutions, and Opportunities
par: Li, Guihong, et autres
Publié: (2023)
par: Li, Guihong, et autres
Publié: (2023)
FedA3I: Annotation Quality-Aware Aggregation for Federated Medical Image Segmentation against Heterogeneous Annotation Noise
par: Wu, Nannan, et autres
Publié: (2023)
par: Wu, Nannan, et autres
Publié: (2023)
Documents similaires
-
Accelerating Non-Maximum Suppression: A Graph Theory Perspective
par: Si, King-Siong, et autres
Publié: (2024) -
Trainable Fixed-Point Quantization for Deep Learning Acceleration on FPGAs
par: Dai, Dingyi, et autres
Publié: (2024) -
PointFix: Learning to Fix Domain Bias for Robust Online Stereo Adaptation
par: Kim, Kwonyoung, et autres
Publié: (2022) -
LLaVA-Critic-R1: Your Critic Model is Secretly a Strong Policy Model
par: Wang, Xiyao, et autres
Publié: (2025) -
Lie Detector: Unified Backdoor Detection via Cross-Examination Framework
par: Wang, Xuan, et autres
Publié: (2025)