FSViewFusion: Few-Shots View Generation of Novel Objects
Fuente:
arXiv
Guardado en:
| Autores principales: | Hussain, Rukhshanda, Lim, Hui Xian Grace, Chen, Borchun, Shah, Mubarak, Lim, Ser Nam |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
AirSketch: Generative Motion to Sketch
por: Lim, Hui Xian Grace, et al.
Publicado: (2024)
por: Lim, Hui Xian Grace, et al.
Publicado: (2024)
Towards Chunk-Wise Generation for Long Videos
por: Zhang, Siyang, et al.
Publicado: (2024)
por: Zhang, Siyang, et al.
Publicado: (2024)
VideoMerge: Towards Training-free Long Video Generation
por: Zhang, Siyang, et al.
Publicado: (2025)
por: Zhang, Siyang, et al.
Publicado: (2025)
Composing Object Relations and Attributes for Image-Text Matching
por: Pham, Khoi, et al.
Publicado: (2024)
por: Pham, Khoi, et al.
Publicado: (2024)
Towards Unified 3D Object Detection via Algorithm and Data Unification
por: Li, Zhuoling, et al.
Publicado: (2024)
por: Li, Zhuoling, et al.
Publicado: (2024)
Beyond Generation: Unlocking Universal Editing via Self-Supervised Fine-Tuning
por: Chen, Harold Haodong, et al.
Publicado: (2024)
por: Chen, Harold Haodong, et al.
Publicado: (2024)
Scene Co-pilot: Procedural Text to Video Generation with Human in the Loop
por: Qian, Zhaofang, et al.
Publicado: (2024)
por: Qian, Zhaofang, et al.
Publicado: (2024)
Cross-View Open-Vocabulary Object Detection in Aerial Imagery
por: Kini, Jyoti, et al.
Publicado: (2025)
por: Kini, Jyoti, et al.
Publicado: (2025)
Object Recognition as Next Token Prediction
por: Yue, Kaiyu, et al.
Publicado: (2023)
por: Yue, Kaiyu, et al.
Publicado: (2023)
DreamMask: Boosting Open-vocabulary Panoptic Segmentation with Synthetic Data
por: Tu, Yuanpeng, et al.
Publicado: (2025)
por: Tu, Yuanpeng, et al.
Publicado: (2025)
Fast Encoding and Decoding for Implicit Video Representation
por: Chen, Hao, et al.
Publicado: (2024)
por: Chen, Hao, et al.
Publicado: (2024)
Hierarchical Fine-grained Preference Optimization for Physically Plausible Video Generation
por: Chen, Harold Haodong, et al.
Publicado: (2025)
por: Chen, Harold Haodong, et al.
Publicado: (2025)
Video Decomposition Prior: A Methodology to Decompose Videos into Layers
por: Shrivastava, Gaurav, et al.
Publicado: (2024)
por: Shrivastava, Gaurav, et al.
Publicado: (2024)
Mitigating Dialogue Hallucination for Large Vision Language Models via Adversarial Instruction Tuning
por: Park, Dongmin, et al.
Publicado: (2024)
por: Park, Dongmin, et al.
Publicado: (2024)
Niagara: Normal-Integrated Geometric Affine Field for Scene Reconstruction from a Single View
por: Wu, Xianzu, et al.
Publicado: (2025)
por: Wu, Xianzu, et al.
Publicado: (2025)
DiReCT: Disentangled Regularization of Contrastive Trajectories for Physics-Refined Video Generation
por: Meyarian, Abolfazl, et al.
Publicado: (2026)
por: Meyarian, Abolfazl, et al.
Publicado: (2026)
Language-free Compositional Action Generation via Decoupling Refinement
por: Liu, Xiao, et al.
Publicado: (2023)
por: Liu, Xiao, et al.
Publicado: (2023)
Spherical Linear Interpolation and Text-Anchoring for Zero-shot Composed Image Retrieval
por: Jang, Young Kyun, et al.
Publicado: (2024)
por: Jang, Young Kyun, et al.
Publicado: (2024)
Generalization-Enhanced Few-Shot Object Detection in Remote Sensing
por: Lin, Hui, et al.
Publicado: (2025)
por: Lin, Hui, et al.
Publicado: (2025)
What can Off-the-Shelves Large Multi-Modal Models do for Dynamic Scene Graph Generation?
por: Cui, Xuanming, et al.
Publicado: (2025)
por: Cui, Xuanming, et al.
Publicado: (2025)
Self-Ensembling Gaussian Splatting for Few-Shot Novel View Synthesis
por: Zhao, Chen, et al.
Publicado: (2024)
por: Zhao, Chen, et al.
Publicado: (2024)
LARM: Large Auto-Regressive Model for Long-Horizon Embodied Intelligence
por: Li, Zhuoling, et al.
Publicado: (2024)
por: Li, Zhuoling, et al.
Publicado: (2024)
BOOKAGENT: Orchestrating Safety-Aware Visual Narratives via Multi-Agent Cognitive Calibration
por: Gao, Bo, et al.
Publicado: (2026)
por: Gao, Bo, et al.
Publicado: (2026)
Generic Objects as Pose Probes for Few-shot View Synthesis
por: Gao, Zhirui, et al.
Publicado: (2024)
por: Gao, Zhirui, et al.
Publicado: (2024)
Prompting classes: Exploring the Power of Prompt Class Learning in Weakly Supervised Semantic Segmentation
por: Murugesan, Balamurali, et al.
Publicado: (2023)
por: Murugesan, Balamurali, et al.
Publicado: (2023)
CLAMP: Contrastive LAnguage Model Prompt-tuning
por: Teterwak, Piotr, et al.
Publicado: (2023)
por: Teterwak, Piotr, et al.
Publicado: (2023)
Visual Delta Generator with Large Multi-modal Models for Semi-supervised Composed Image Retrieval
por: Jang, Young Kyun, et al.
Publicado: (2024)
por: Jang, Young Kyun, et al.
Publicado: (2024)
Knowledge NeRF: Few-shot Novel View Synthesis for Dynamic Articulated Objects
por: Cai, Wenxiao, et al.
Publicado: (2024)
por: Cai, Wenxiao, et al.
Publicado: (2024)
OP-LoRA: The Blessing of Dimensionality
por: Teterwak, Piotr, et al.
Publicado: (2024)
por: Teterwak, Piotr, et al.
Publicado: (2024)
TriDF: Triplane-Accelerated Density Fields for Few-Shot Remote Sensing Novel View Synthesis
por: Kang, Jiaming, et al.
Publicado: (2025)
por: Kang, Jiaming, et al.
Publicado: (2025)
LASER: A Neuro-Symbolic Framework for Learning Spatial-Temporal Scene Graphs with Weak Supervision
por: Huang, Jiani, et al.
Publicado: (2023)
por: Huang, Jiani, et al.
Publicado: (2023)
DetailCLIP: Detail-Oriented CLIP for Fine-Grained Tasks
por: Monsefi, Amin Karimi, et al.
Publicado: (2024)
por: Monsefi, Amin Karimi, et al.
Publicado: (2024)
Towards Generalized Few-Shot Open-Set Object Detection
por: Su, Binyi, et al.
Publicado: (2022)
por: Su, Binyi, et al.
Publicado: (2022)
Towards Cross-modal Backward-compatible Representation Learning for Vision-Language Models
por: Jang, Young Kyun, et al.
Publicado: (2024)
por: Jang, Young Kyun, et al.
Publicado: (2024)
Distilling Vision-Language Pretraining for Efficient Cross-Modal Retrieval
por: Jang, Young Kyun, et al.
Publicado: (2024)
por: Jang, Young Kyun, et al.
Publicado: (2024)
MA-LMM: Memory-Augmented Large Multimodal Model for Long-Term Video Understanding
por: He, Bo, et al.
Publicado: (2024)
por: He, Bo, et al.
Publicado: (2024)
DLaVA: Document Language and Vision Assistant for Answer Localization with Enhanced Interpretability and Trustworthiness
por: Mohammadshirazi, Ahmad, et al.
Publicado: (2024)
por: Mohammadshirazi, Ahmad, et al.
Publicado: (2024)
Few-Shot Object Detection: Research Advances and Challenges
por: Xin, Zhimeng, et al.
Publicado: (2024)
por: Xin, Zhimeng, et al.
Publicado: (2024)
Unify the Views: View-Consistent Prototype Learning for Few-Shot Segmentation
por: Liu, Hongli, et al.
Publicado: (2026)
por: Liu, Hongli, et al.
Publicado: (2026)
Object-level Correlation for Few-Shot Segmentation
por: Wen, Chunlin, et al.
Publicado: (2025)
por: Wen, Chunlin, et al.
Publicado: (2025)
Ejemplares similares
-
AirSketch: Generative Motion to Sketch
por: Lim, Hui Xian Grace, et al.
Publicado: (2024) -
Towards Chunk-Wise Generation for Long Videos
por: Zhang, Siyang, et al.
Publicado: (2024) -
VideoMerge: Towards Training-free Long Video Generation
por: Zhang, Siyang, et al.
Publicado: (2025) -
Composing Object Relations and Attributes for Image-Text Matching
por: Pham, Khoi, et al.
Publicado: (2024) -
Towards Unified 3D Object Detection via Algorithm and Data Unification
por: Li, Zhuoling, et al.
Publicado: (2024)