Less is More: Data-Efficient Adaptation for Controllable Text-to-Video Generation
Fuente:
arXiv
Salvato in:
| Autori principali: | Cheng, Shihan, Kulkarni, Nilesh, Hyde, David, Smirnov, Dmitriy |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
AIDOVECL: AI-generated Dataset of Outpainted Vehicles for Eye-level Classification and Localization
di: Kazemi, Amir, et al.
Pubblicazione: (2024)
di: Kazemi, Amir, et al.
Pubblicazione: (2024)
A Hybrid Multimodal Deep Learning Framework for Intelligent Fashion Recommendation
di: Kalashi, Kamand, et al.
Pubblicazione: (2025)
di: Kalashi, Kamand, et al.
Pubblicazione: (2025)
PhysMorph-GS: Render-Guided Volumetric Morphing with Differentiable Physics
di: Song, Chang-Yong, et al.
Pubblicazione: (2025)
di: Song, Chang-Yong, et al.
Pubblicazione: (2025)
TexTile: A Differentiable Metric for Texture Tileability
di: Rodriguez-Pardo, Carlos, et al.
Pubblicazione: (2024)
di: Rodriguez-Pardo, Carlos, et al.
Pubblicazione: (2024)
Deep Spectral Meshes: Multi-Frequency Facial Mesh Processing with Graph Neural Networks
di: Kosk, Robert, et al.
Pubblicazione: (2024)
di: Kosk, Robert, et al.
Pubblicazione: (2024)
Skullptor: High Fidelity 3D Head Reconstruction in Seconds with Multi-View Normal Prediction
di: Artru, Noé, et al.
Pubblicazione: (2026)
di: Artru, Noé, et al.
Pubblicazione: (2026)
ROI-GS: Interest-based Local Quality 3D Gaussian Splatting
di: Bui, Quoc-Anh, et al.
Pubblicazione: (2025)
di: Bui, Quoc-Anh, et al.
Pubblicazione: (2025)
ROI-NeRFs: Hi-Fi Visualization of Objects of Interest within a Scene by NeRFs Composition
di: Bui, Quoc-Anh, et al.
Pubblicazione: (2025)
di: Bui, Quoc-Anh, et al.
Pubblicazione: (2025)
SQuARE: Structured Query & Adaptive Retrieval Engine For Tabular Formats
di: Gondhalekar, Chinmay, et al.
Pubblicazione: (2025)
di: Gondhalekar, Chinmay, et al.
Pubblicazione: (2025)
Light Field Display Point Rendering
di: Gavane, Ajinkya, et al.
Pubblicazione: (2025)
di: Gavane, Ajinkya, et al.
Pubblicazione: (2025)
MatDecompSDF: High-Fidelity 3D Shape and PBR Material Decomposition from Multi-View Images
di: Wang, Chengyu, et al.
Pubblicazione: (2025)
di: Wang, Chengyu, et al.
Pubblicazione: (2025)
Transforming faces into video stories -- VideoFace2.0
di: Brkljač, Branko, et al.
Pubblicazione: (2025)
di: Brkljač, Branko, et al.
Pubblicazione: (2025)
Sequential PatchCore: Anomaly Detection for Surface Inspection using Synthetic Impurities
di: Mao, Runzhou, et al.
Pubblicazione: (2025)
di: Mao, Runzhou, et al.
Pubblicazione: (2025)
X2Video: Adapting Diffusion Models for Multimodal Controllable Neural Video Rendering
di: Huang, Zhitong, et al.
Pubblicazione: (2025)
di: Huang, Zhitong, et al.
Pubblicazione: (2025)
FLoD: Integrating Flexible Level of Detail into 3D Gaussian Splatting for Customizable Rendering
di: Seo, Yunji, et al.
Pubblicazione: (2024)
di: Seo, Yunji, et al.
Pubblicazione: (2024)
Structured Basis Function Networks: Loss-Centric Multi-Hypothesis Ensembles with Controllable Diversity
di: Dominguez, Alejandro Rodriguez, et al.
Pubblicazione: (2025)
di: Dominguez, Alejandro Rodriguez, et al.
Pubblicazione: (2025)
Lightweight MRI-Based Automated Segmentation of Pancreatic Cancer with Auto3DSeg
di: Jha, Keshav, et al.
Pubblicazione: (2025)
di: Jha, Keshav, et al.
Pubblicazione: (2025)
A New Perspective on Drawing Venn Diagrams for Data Visualization
di: Csanády, Bálint
Pubblicazione: (2026)
di: Csanády, Bálint
Pubblicazione: (2026)
Inverse 3D Microscopy Rendering for Cell Shape Inference with Active Mesh
di: Ichbiah, Sacha, et al.
Pubblicazione: (2023)
di: Ichbiah, Sacha, et al.
Pubblicazione: (2023)
APEX: Large-scale Multi-task Aesthetic-Informed Popularity Prediction for AI-Generated Music
di: Husain, Jaavid Aktar, et al.
Pubblicazione: (2026)
di: Husain, Jaavid Aktar, et al.
Pubblicazione: (2026)
Real-World En Call Center Transcripts Dataset with PII Redaction
di: Dao, Ha, et al.
Pubblicazione: (2025)
di: Dao, Ha, et al.
Pubblicazione: (2025)
Advancing Annotat3D with Harpia: A CUDA-Accelerated Library For Large-Scale Volumetric Data Segmentation
di: de Araujo, Camila Machado, et al.
Pubblicazione: (2025)
di: de Araujo, Camila Machado, et al.
Pubblicazione: (2025)
TRACES: Temporal Recall with Contextual Embeddings for Real-Time Video Anomaly Detection
di: Siddiqui, Yousuf Ahmed, et al.
Pubblicazione: (2025)
di: Siddiqui, Yousuf Ahmed, et al.
Pubblicazione: (2025)
Advancing Brain Tumor Segmentation via Attention-based 3D U-Net Architecture and Digital Image Processing
di: Gad, Eyad, et al.
Pubblicazione: (2025)
di: Gad, Eyad, et al.
Pubblicazione: (2025)
How Will It Drape Like? Capturing Fabric Mechanics from Depth Images
di: Rodriguez-Pardo, Carlos, et al.
Pubblicazione: (2023)
di: Rodriguez-Pardo, Carlos, et al.
Pubblicazione: (2023)
Air Quality Prediction Using LOESS-ARIMA and Multi-Scale CNN-BiLSTM with Residual-Gated Attention
di: Pahari, Soham, et al.
Pubblicazione: (2025)
di: Pahari, Soham, et al.
Pubblicazione: (2025)
LVCD: Reference-based Lineart Video Colorization with Diffusion Models
di: Huang, Zhitong, et al.
Pubblicazione: (2024)
di: Huang, Zhitong, et al.
Pubblicazione: (2024)
AQFusionNet: Multimodal Deep Learning for Air Quality Index Prediction with Imagery and Sensor Data
di: Kushal, Koushik Ahmed, et al.
Pubblicazione: (2025)
di: Kushal, Koushik Ahmed, et al.
Pubblicazione: (2025)
HOSC: A Periodic Activation with Saturation Control for High-Fidelity Implicit Neural Representations
di: Wlodarczyk, Michal Jan, et al.
Pubblicazione: (2026)
di: Wlodarczyk, Michal Jan, et al.
Pubblicazione: (2026)
VocSim: A Training-free Benchmark for Zero-shot Content Identity in Single-source Audio
di: Basha, Maris, et al.
Pubblicazione: (2025)
di: Basha, Maris, et al.
Pubblicazione: (2025)
Dense Video Understanding with Gated Residual Tokenization
di: Zhang, Haichao, et al.
Pubblicazione: (2025)
di: Zhang, Haichao, et al.
Pubblicazione: (2025)
Deep Interest Mining for Intent-Enriched Semantic IDs in Multimodal Generative Recommendation
di: Zeng, Yangchen, et al.
Pubblicazione: (2026)
di: Zeng, Yangchen, et al.
Pubblicazione: (2026)
AVATAAR: Agentic Video Answering via Temporal Adaptive Alignment and Reasoning
di: Patel, Urjitkumar, et al.
Pubblicazione: (2025)
di: Patel, Urjitkumar, et al.
Pubblicazione: (2025)
LinkedOut: Linking World Knowledge Representation Out of Video LLM for Next-Generation Video Recommendation
di: Zhang, Haichao, et al.
Pubblicazione: (2025)
di: Zhang, Haichao, et al.
Pubblicazione: (2025)
Reconstructing Curves from Sparse Samples on Riemannian Manifolds
di: Marin, Diana, et al.
Pubblicazione: (2024)
di: Marin, Diana, et al.
Pubblicazione: (2024)
TerraSeg: Self-Supervised Ground Segmentation for Any LiDAR
di: Lentsch, Ted, et al.
Pubblicazione: (2026)
di: Lentsch, Ted, et al.
Pubblicazione: (2026)
UNION: Unsupervised 3D Object Detection using Object Appearance-based Pseudo-Classes
di: Lentsch, Ted, et al.
Pubblicazione: (2024)
di: Lentsch, Ted, et al.
Pubblicazione: (2024)
Decoder Generates Manufacturable Structures: A Framework for 3D-Printable Object Synthesis
di: Kumar, Abhishek
Pubblicazione: (2026)
di: Kumar, Abhishek
Pubblicazione: (2026)
Machine Learning for Coding Retail Product Names to Consumer-Price Categories: A Rule-plus-Bag-of-Words Pipeline with Reliability-Weighted Human-in-the-Loop Labeling
di: Beskorovainyi, Vladimir
Pubblicazione: (2026)
di: Beskorovainyi, Vladimir
Pubblicazione: (2026)
SShaDe: scalable shape deformation via local representations
di: Maggioli, Filippo, et al.
Pubblicazione: (2024)
di: Maggioli, Filippo, et al.
Pubblicazione: (2024)
Documenti analoghi
-
AIDOVECL: AI-generated Dataset of Outpainted Vehicles for Eye-level Classification and Localization
di: Kazemi, Amir, et al.
Pubblicazione: (2024) -
A Hybrid Multimodal Deep Learning Framework for Intelligent Fashion Recommendation
di: Kalashi, Kamand, et al.
Pubblicazione: (2025) -
PhysMorph-GS: Render-Guided Volumetric Morphing with Differentiable Physics
di: Song, Chang-Yong, et al.
Pubblicazione: (2025) -
TexTile: A Differentiable Metric for Texture Tileability
di: Rodriguez-Pardo, Carlos, et al.
Pubblicazione: (2024) -
Deep Spectral Meshes: Multi-Frequency Facial Mesh Processing with Graph Neural Networks
di: Kosk, Robert, et al.
Pubblicazione: (2024)