PlaneCycle: Training-Free 2D-to-3D Lifting of Foundation Models Without Adapters
Fuente:
arXiv
Guardado en:
| Autores principales: | Yu, Yinghong, Li, Guangyuan, Yang, Jiancheng |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
3D-LFM: Lifting Foundation Model
por: Dabhi, Mosam, et al.
Publicado: (2023)
por: Dabhi, Mosam, et al.
Publicado: (2023)
Towards Scalable Spatial Intelligence via 2D-to-3D Data Lifting
por: Miao, Xingyu, et al.
Publicado: (2025)
por: Miao, Xingyu, et al.
Publicado: (2025)
Training-Free Dual Hyperbolic Adapters for Better Cross-Modal Reasoning
por: Zhang, Yi, et al.
Publicado: (2025)
por: Zhang, Yi, et al.
Publicado: (2025)
Object Agnostic 3D Lifting in Space and Time
por: Fusco, Christopher, et al.
Publicado: (2024)
por: Fusco, Christopher, et al.
Publicado: (2024)
Triad: Vision Foundation Model for 3D Magnetic Resonance Imaging
por: Wang, Shansong, et al.
Publicado: (2025)
por: Wang, Shansong, et al.
Publicado: (2025)
Lifting Unlabeled Internet-level Data for 3D Scene Understanding
por: Chen, Yixin, et al.
Publicado: (2026)
por: Chen, Yixin, et al.
Publicado: (2026)
Segment, Lift and Fit: Automatic 3D Shape Labeling from 2D Prompts
por: Li, Jianhao, et al.
Publicado: (2024)
por: Li, Jianhao, et al.
Publicado: (2024)
VGGT-CD: Training-Free Robust Registration for 3D Change Detection
por: Zhang, Wei, et al.
Publicado: (2026)
por: Zhang, Wei, et al.
Publicado: (2026)
3D-Adapter: Geometry-Consistent Multi-View Diffusion for High-Quality 3D Generation
por: Chen, Hansheng, et al.
Publicado: (2024)
por: Chen, Hansheng, et al.
Publicado: (2024)
HexPlane Representation for 3D Semantic Scene Understanding
por: Chen, Zeren, et al.
Publicado: (2025)
por: Chen, Zeren, et al.
Publicado: (2025)
3DTurboQuant: Training-Free Near-Optimal Quantization for 3D Reconstruction Models
por: Lee, Jae Joong
Publicado: (2026)
por: Lee, Jae Joong
Publicado: (2026)
L3D-Pose: Lifting Pose for 3D Avatars from a Single Camera in the Wild
por: Debnath, Soumyaratna, et al.
Publicado: (2025)
por: Debnath, Soumyaratna, et al.
Publicado: (2025)
FMGS: Foundation Model Embedded 3D Gaussian Splatting for Holistic 3D Scene Understanding
por: Zuo, Xingxing, et al.
Publicado: (2024)
por: Zuo, Xingxing, et al.
Publicado: (2024)
Omni123: Exploring 3D Native Foundation Models with Limited 3D Data by Unifying Text to 2D and 3D Generation
por: Ye, Chongjie, et al.
Publicado: (2026)
por: Ye, Chongjie, et al.
Publicado: (2026)
Just Add Geometry: Gradient-Free Open-Vocabulary 3D Detection Without Human-in-the-Loop
por: Goel, Atharv, et al.
Publicado: (2025)
por: Goel, Atharv, et al.
Publicado: (2025)
D3: Training-Free AI-Generated Video Detection Using Second-Order Features
por: Zheng, Chende, et al.
Publicado: (2025)
por: Zheng, Chende, et al.
Publicado: (2025)
Adapting 2D Multi-Modal Large Language Model for 3D CT Image Analysis
por: Yu, Yang, et al.
Publicado: (2026)
por: Yu, Yang, et al.
Publicado: (2026)
HouseLayout3D: A Benchmark and Training-Free Baseline for 3D Layout Estimation in the Wild
por: Bieri, Valentin, et al.
Publicado: (2025)
por: Bieri, Valentin, et al.
Publicado: (2025)
How Much 3D Do Video Foundation Models Encode?
por: Huang, Zixuan, et al.
Publicado: (2025)
por: Huang, Zixuan, et al.
Publicado: (2025)
FaceChain-FACT: Face Adapter with Decoupled Training for Identity-preserved Personalization
por: Yu, Cheng, et al.
Publicado: (2024)
por: Yu, Cheng, et al.
Publicado: (2024)
Surgical-DINO: Adapter Learning of Foundation Models for Depth Estimation in Endoscopic Surgery
por: Cui, Beilei, et al.
Publicado: (2024)
por: Cui, Beilei, et al.
Publicado: (2024)
Frankenstein: Generating Semantic-Compositional 3D Scenes in One Tri-Plane
por: Yan, Han, et al.
Publicado: (2024)
por: Yan, Han, et al.
Publicado: (2024)
MRN: Harnessing 2D Vision Foundation Models for Diagnosing Parkinson's Disease with Limited 3D MR Data
por: Shaodong, Ding, et al.
Publicado: (2025)
por: Shaodong, Ding, et al.
Publicado: (2025)
3D Foundation Model for Generalizable Disease Detection in Head Computed Tomography
por: Zhu, Weicheng, et al.
Publicado: (2025)
por: Zhu, Weicheng, et al.
Publicado: (2025)
FreeOrbit4D: Training-Free Arbitrary Camera Redirection for Monocular Videos via Foreground-Complete 4D Reconstruction
por: Cao, Wei, et al.
Publicado: (2026)
por: Cao, Wei, et al.
Publicado: (2026)
Synergistic Foundation Models for Semi-Supervised Fetal Cardiac Ultrasound Analysis: SAM-Med2D Boundary Refinement and DINOv3 Semantic Enhancement
por: Zhuang, Tonghao, et al.
Publicado: (2026)
por: Zhuang, Tonghao, et al.
Publicado: (2026)
CAT: Contrastive Adapter Training for Personalized Image Generation
por: Park, Jae Wan, et al.
Publicado: (2024)
por: Park, Jae Wan, et al.
Publicado: (2024)
Preventing Shortcuts in Adapter Training via Providing the Shortcuts
por: Goyal, Anujraaj Argo, et al.
Publicado: (2025)
por: Goyal, Anujraaj Argo, et al.
Publicado: (2025)
DM-Adapter: Domain-Aware Mixture-of-Adapters for Text-Based Person Retrieval
por: Liu, Yating, et al.
Publicado: (2025)
por: Liu, Yating, et al.
Publicado: (2025)
Dr. Seg: Revisiting GRPO Training for Visual Large Language Models through Perception-Oriented Design
por: Sun, Haoxiang, et al.
Publicado: (2026)
por: Sun, Haoxiang, et al.
Publicado: (2026)
Chain-of-Models Pre-Training: Rethinking Training Acceleration of Vision Foundation Models
por: Fan, Jiawei, et al.
Publicado: (2026)
por: Fan, Jiawei, et al.
Publicado: (2026)
CoRe3D: Collaborative Reasoning as a Foundation for 3D Intelligence
por: Yu, Tianjiao, et al.
Publicado: (2025)
por: Yu, Tianjiao, et al.
Publicado: (2025)
MedPruner: Training-Free Hierarchical Token Pruning for Efficient 3D Medical Image Understanding in Vision-Language Models
por: Liu, Shengyuan, et al.
Publicado: (2026)
por: Liu, Shengyuan, et al.
Publicado: (2026)
GEN3D: Generating Domain-Free 3D Scenes from a Single Image
por: Zhang, Yuxin, et al.
Publicado: (2025)
por: Zhang, Yuxin, et al.
Publicado: (2025)
Enhance Then Search: An Augmentation-Search Strategy with Foundation Models for Cross-Domain Few-Shot Object Detection
por: Pan, Jiancheng, et al.
Publicado: (2025)
por: Pan, Jiancheng, et al.
Publicado: (2025)
EyeFound: A Multimodal Generalist Foundation Model for Ophthalmic Imaging
por: Shi, Danli, et al.
Publicado: (2024)
por: Shi, Danli, et al.
Publicado: (2024)
LiFT: Lifted Inter-slice Feature Trajectories for 3D Image Generation from 2D Generators
por: Zhang, Xinhe, et al.
Publicado: (2026)
por: Zhang, Xinhe, et al.
Publicado: (2026)
Sparse3DPR: Training-Free 3D Hierarchical Scene Parsing and Task-Adaptive Subgraph Reasoning from Sparse RGB Views
por: Feng, Haida, et al.
Publicado: (2025)
por: Feng, Haida, et al.
Publicado: (2025)
TAP-CT: 3D Task-Agnostic Pretraining of Computed Tomography Foundation Models
por: Veenboer, Tim, et al.
Publicado: (2025)
por: Veenboer, Tim, et al.
Publicado: (2025)
Highly Compressed Tokenizer Can Generate Without Training
por: Beyer, L. Lao, et al.
Publicado: (2025)
por: Beyer, L. Lao, et al.
Publicado: (2025)
Ejemplares similares
-
3D-LFM: Lifting Foundation Model
por: Dabhi, Mosam, et al.
Publicado: (2023) -
Towards Scalable Spatial Intelligence via 2D-to-3D Data Lifting
por: Miao, Xingyu, et al.
Publicado: (2025) -
Training-Free Dual Hyperbolic Adapters for Better Cross-Modal Reasoning
por: Zhang, Yi, et al.
Publicado: (2025) -
Object Agnostic 3D Lifting in Space and Time
por: Fusco, Christopher, et al.
Publicado: (2024) -
Triad: Vision Foundation Model for 3D Magnetic Resonance Imaging
por: Wang, Shansong, et al.
Publicado: (2025)