RAVEN: Rethinking Adversarial Video Generation with Efficient Tri-plane Networks
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ghosh, Partha, Sanyal, Soubhik, Schmid, Cordelia, Schölkopf, Bernhard |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
SCULPT: Shape-Conditioned Unpaired Learning of Pose-dependent Clothed and Textured Human Meshes
par: Sanyal, Soubhik, et autres
Publié: (2023)
par: Sanyal, Soubhik, et autres
Publié: (2023)
Time-, Memory- and Parameter-Efficient Visual Adaptation
par: Mercea, Otniel-Bogdan, et autres
Publié: (2024)
par: Mercea, Otniel-Bogdan, et autres
Publié: (2024)
Generation is Required for Data-Efficient Perception
par: Brady, Jack, et autres
Publié: (2025)
par: Brady, Jack, et autres
Publié: (2025)
Generative Zoo
par: Niewiadomski, Tomasz, et autres
Publié: (2024)
par: Niewiadomski, Tomasz, et autres
Publié: (2024)
CAViAR: Critic-Augmented Video Agentic Reasoning
par: Menon, Sachit, et autres
Publié: (2025)
par: Menon, Sachit, et autres
Publié: (2025)
ViViDex: Learning Vision-based Dexterous Manipulation from Human Videos
par: Chen, Zerui, et autres
Publié: (2024)
par: Chen, Zerui, et autres
Publié: (2024)
DataDream: Few-shot Guided Dataset Generation
par: Kim, Jae Myung, et autres
Publié: (2024)
par: Kim, Jae Myung, et autres
Publié: (2024)
Hyperbolic Busemann Neural Networks
par: Chen, Ziheng, et autres
Publié: (2026)
par: Chen, Ziheng, et autres
Publié: (2026)
MoReVQA: Exploring Modular Reasoning Models for Video Question Answering
par: Min, Juhong, et autres
Publié: (2024)
par: Min, Juhong, et autres
Publié: (2024)
CaptionFormer: Unified Segmentation, Tracking, and Captioning for Spatio-Temporal Objects
par: Fiastre, Gabriel, et autres
Publié: (2025)
par: Fiastre, Gabriel, et autres
Publié: (2025)
A-I-RAVEN and I-RAVEN-Mesh: Two New Benchmarks for Abstract Visual Reasoning
par: Małkiński, Mikołaj, et autres
Publié: (2024)
par: Małkiński, Mikołaj, et autres
Publié: (2024)
Grounded Video Caption Generation
par: Kazakos, Evangelos, et autres
Publié: (2024)
par: Kazakos, Evangelos, et autres
Publié: (2024)
Minerva-Ego: Spatiotemporal Hints for Egocentric Video Understanding
par: Nagrani, Arsha, et autres
Publié: (2026)
par: Nagrani, Arsha, et autres
Publié: (2026)
Video to Video Generative Adversarial Network for Few-shot Learning Based on Policy Gradient
par: Ma, Yintai, et autres
Publié: (2024)
par: Ma, Yintai, et autres
Publié: (2024)
MINERVA: Evaluating Complex Video Reasoning
par: Nagrani, Arsha, et autres
Publié: (2025)
par: Nagrani, Arsha, et autres
Publié: (2025)
Large-scale Pre-training for Grounded Video Caption Generation
par: Kazakos, Evangelos, et autres
Publié: (2025)
par: Kazakos, Evangelos, et autres
Publié: (2025)
Rethinking JEPA: Compute-Efficient Video SSL with Frozen Teachers
par: Li, Xianhang, et autres
Publié: (2025)
par: Li, Xianhang, et autres
Publié: (2025)
Rays as Pixels: Learning A Joint Distribution of Videos and Camera Trajectories
par: Jang, Wonbong, et autres
Publié: (2026)
par: Jang, Wonbong, et autres
Publié: (2026)
Evaluating the Adversarial Robustness of Semantic Segmentation: Trying Harder Pays Off
par: Halmosi, Levente, et autres
Publié: (2024)
par: Halmosi, Levente, et autres
Publié: (2024)
Diffusion-Based Representation Learning
par: Mittal, Sarthak, et autres
Publié: (2021)
par: Mittal, Sarthak, et autres
Publié: (2021)
Drifting Fields are not Conservative
par: Franz, Leonard T., et autres
Publié: (2026)
par: Franz, Leonard T., et autres
Publié: (2026)
RAVEN: Query-Guided Representation Alignment for Question Answering over Audio, Video, Embedded Sensors, and Natural Language
par: Biswas, Subrata, et autres
Publié: (2025)
par: Biswas, Subrata, et autres
Publié: (2025)
What Drives Compositional Generalization? The Importance of Continuous Training Objectives in Visual Generative Models
par: Farid, Karim, et autres
Publié: (2025)
par: Farid, Karim, et autres
Publié: (2025)
Chapter-Llama: Efficient Chaptering in Hour-Long Videos with LLMs
par: Ventura, Lucas, et autres
Publié: (2025)
par: Ventura, Lucas, et autres
Publié: (2025)
Language-Guided Image Tokenization for Generation
par: Zha, Kaiwen, et autres
Publié: (2024)
par: Zha, Kaiwen, et autres
Publié: (2024)
Verbalized Machine Learning: Revisiting Machine Learning with Language Models
par: Xiao, Tim Z., et autres
Publié: (2024)
par: Xiao, Tim Z., et autres
Publié: (2024)
Structure by Architecture: Structured Representations without Regularization
par: Leeb, Felix, et autres
Publié: (2020)
par: Leeb, Felix, et autres
Publié: (2020)
RECODE: Reasoning Through Code Generation for Visual Question Answering
par: Shen, Junhong, et autres
Publié: (2025)
par: Shen, Junhong, et autres
Publié: (2025)
Visual Lexicon: Rich Image Features in Language Space
par: Wang, XuDong, et autres
Publié: (2024)
par: Wang, XuDong, et autres
Publié: (2024)
GraphDreamer: Compositional 3D Scene Synthesis from Scene Graphs
par: Gao, Gege, et autres
Publié: (2023)
par: Gao, Gege, et autres
Publié: (2023)
Improving Generative Adversarial Networks with Self-Distillation
par: Nowinowski, Antoni, et autres
Publié: (2026)
par: Nowinowski, Antoni, et autres
Publié: (2026)
Ghost on the Shell: An Expressive Representation of General 3D Shapes
par: Liu, Zhen, et autres
Publié: (2023)
par: Liu, Zhen, et autres
Publié: (2023)
A Cost-Efficient Approach for Creating Virtual Fitting Room using Generative Adversarial Networks (GANs)
par: Attallah, Kirolos, et autres
Publié: (2024)
par: Attallah, Kirolos, et autres
Publié: (2024)
Virtual Fitting Room: Generating Arbitrarily Long Videos of Virtual Try-On from a Single Image -- Technical Preview
par: Chen, Jun-Kun, et autres
Publié: (2025)
par: Chen, Jun-Kun, et autres
Publié: (2025)
BrickNet: Graph-Backed Generative Brick Assembly
par: Kulits, Peter, et autres
Publié: (2026)
par: Kulits, Peter, et autres
Publié: (2026)
Generative Adversarial Networks Bridging Art and Machine Intelligence
par: Song, Junhao, et autres
Publié: (2025)
par: Song, Junhao, et autres
Publié: (2025)
Nested Annealed Training Scheme for Generative Adversarial Networks
par: Wan, Chang, et autres
Publié: (2025)
par: Wan, Chang, et autres
Publié: (2025)
Synthetic Medical Imaging Generation with Generative Adversarial Networks For Plain Radiographs
par: McNulty, John R., et autres
Publié: (2024)
par: McNulty, John R., et autres
Publié: (2024)
Synthetic Melanoma Image Generation and Evaluation Using Generative Adversarial Networks
par: Lin, Pei-Yu, et autres
Publié: (2026)
par: Lin, Pei-Yu, et autres
Publié: (2026)
Ego4OOD: Rethinking Egocentric Video Domain Generalization via Covariate Shift Scoring
par: Vaseqi, Zahra, et autres
Publié: (2026)
par: Vaseqi, Zahra, et autres
Publié: (2026)
Documents similaires
-
SCULPT: Shape-Conditioned Unpaired Learning of Pose-dependent Clothed and Textured Human Meshes
par: Sanyal, Soubhik, et autres
Publié: (2023) -
Time-, Memory- and Parameter-Efficient Visual Adaptation
par: Mercea, Otniel-Bogdan, et autres
Publié: (2024) -
Generation is Required for Data-Efficient Perception
par: Brady, Jack, et autres
Publié: (2025) -
Generative Zoo
par: Niewiadomski, Tomasz, et autres
Publié: (2024) -
CAViAR: Critic-Augmented Video Agentic Reasoning
par: Menon, Sachit, et autres
Publié: (2025)