DreamDistribution: Learning Prompt Distribution for Diverse In-distribution Generation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhao, Brian Nlong, Xiao, Yuhang, Xu, Jiashu, Jiang, Xinyang, Yang, Yifan, Li, Dongsheng, Itti, Laurent, Vineet, Vibhav, Ge, Yunhao |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Probabilistic Prompt Distribution Learning for Animal Pose Estimation
par: Rao, Jiyong, et autres
Publié: (2025)
par: Rao, Jiyong, et autres
Publié: (2025)
Three-Step Nav: A Hierarchical Global-Local Planner for Zero-Shot Vision-and-Language Navigation
par: Zheng, Wanrong, et autres
Publié: (2026)
par: Zheng, Wanrong, et autres
Publié: (2026)
RiTTA: Modeling Event Relations in Text-to-Audio Generation
par: He, Yuhang, et autres
Publié: (2024)
par: He, Yuhang, et autres
Publié: (2024)
Riemannian-Geometric Fingerprints of Generative Models
par: Song, Hae Jin, et autres
Publié: (2025)
par: Song, Hae Jin, et autres
Publié: (2025)
Physics Knowledge in Frontier Models: A Diagnostic Study of Failure Modes
par: Bagdonaviciute, Ieva, et autres
Publié: (2025)
par: Bagdonaviciute, Ieva, et autres
Publié: (2025)
Web-Scale Collection of Video Data for 4D Animal Reconstruction
par: Zhao, Brian Nlong, et autres
Publié: (2025)
par: Zhao, Brian Nlong, et autres
Publié: (2025)
Perforated Backpropagation: A Neuroscience Inspired Extension to Artificial Neural Networks
par: Brenner, Rorry, et autres
Publié: (2025)
par: Brenner, Rorry, et autres
Publié: (2025)
Prompt Disentanglement via Language Guidance and Representation Alignment for Domain Generalization
par: Cheng, De, et autres
Publié: (2025)
par: Cheng, De, et autres
Publié: (2025)
Test-time Prompt Refinement for Text-to-Image Models
par: Khan, Mohammad Abdul Hafeez, et autres
Publié: (2025)
par: Khan, Mohammad Abdul Hafeez, et autres
Publié: (2025)
Robustness Analysis on Foundational Segmentation Models
par: Schiappa, Madeline Chantry, et autres
Publié: (2023)
par: Schiappa, Madeline Chantry, et autres
Publié: (2023)
StreamReady: Learning What to Answer and When in Long Streaming Videos
par: Azad, Shehreen, et autres
Publié: (2026)
par: Azad, Shehreen, et autres
Publié: (2026)
Similarity Distribution based Membership Inference Attack on Person Re-identification
par: Gao, Junyao, et autres
Publié: (2022)
par: Gao, Junyao, et autres
Publié: (2022)
HPT++: Hierarchically Prompting Vision-Language Models with Multi-Granularity Knowledge Generation and Improved Structure Modeling
par: Wang, Yubin, et autres
Publié: (2024)
par: Wang, Yubin, et autres
Publié: (2024)
PEEKABOO: Interactive Video Generation via Masked-Diffusion
par: Jain, Yash, et autres
Publié: (2023)
par: Jain, Yash, et autres
Publié: (2023)
ActPrompt: In-Domain Feature Adaptation via Action Cues for Video Temporal Grounding
par: Wang, Yubin, et autres
Publié: (2024)
par: Wang, Yubin, et autres
Publié: (2024)
Navigating Hallucinations for Reasoning of Unintentional Activities
par: Grover, Shresth, et autres
Publié: (2024)
par: Grover, Shresth, et autres
Publié: (2024)
Exposing the Achilles' Heel: Evaluating LLMs Ability to Handle Mistakes in Mathematical Reasoning
par: Singh, Joykirat, et autres
Publié: (2024)
par: Singh, Joykirat, et autres
Publié: (2024)
Dream-Box: Object-wise Outlier Generation for Out-of-Distribution Detection
par: Isaac-Medina, Brian K. S., et autres
Publié: (2025)
par: Isaac-Medina, Brian K. S., et autres
Publié: (2025)
Spatially Prompted Visual Trajectory Prediction for Egocentric Manipulation
par: Li, Yifan, et autres
Publié: (2026)
par: Li, Yifan, et autres
Publié: (2026)
A Large-Scale Analysis on Contextual Self-Supervised Video Representation Learning
par: Kumar, Akash, et autres
Publié: (2025)
par: Kumar, Akash, et autres
Publié: (2025)
Online Video Quality Enhancement with Spatial-Temporal Look-up Tables
par: Qu, Zefan, et autres
Publié: (2023)
par: Qu, Zefan, et autres
Publié: (2023)
Bird's Eye View Based Pretrained World model for Visual Navigation
par: Lekkala, Kiran, et autres
Publié: (2023)
par: Lekkala, Kiran, et autres
Publié: (2023)
ReVision: Scaling Computer-Use Agents via Temporal Visual Redundancy Reduction
par: Abaskohi, Amirhossein, et autres
Publié: (2026)
par: Abaskohi, Amirhossein, et autres
Publié: (2026)
HierarQ: Task-Aware Hierarchical Q-Former for Enhanced Video Understanding
par: Azad, Shehreen, et autres
Publié: (2025)
par: Azad, Shehreen, et autres
Publié: (2025)
On Occlusions in Video Action Detection: Benchmark Datasets And Training Recipes
par: Modi, Rajat, et autres
Publié: (2024)
par: Modi, Rajat, et autres
Publié: (2024)
Exploring Interpretability for Visual Prompt Tuning with Cross-layer Concepts
par: Wang, Yubin, et autres
Publié: (2025)
par: Wang, Yubin, et autres
Publié: (2025)
What MLLMs Learn about When they Learn about Multimodal Reasoning
par: Chung, Jiwan, et autres
Publié: (2025)
par: Chung, Jiwan, et autres
Publié: (2025)
Orchestrating the Symphony of Prompt Distribution Learning for Human-Object Interaction Detection
par: Jia, Mingda, et autres
Publié: (2024)
par: Jia, Mingda, et autres
Publié: (2024)
OmViD: Omni-supervised active learning for video action detection
par: Rana, Aayush, et autres
Publié: (2025)
par: Rana, Aayush, et autres
Publié: (2025)
DiffPhysBA: Diffusion-based Physical Backdoor Attack against Person Re-Identification in Real-World
par: Sun, Wenli, et autres
Publié: (2024)
par: Sun, Wenli, et autres
Publié: (2024)
OS-Marathon: Benchmarking Computer-Use Agents on Long-Horizon Repetitive Tasks
par: Wu, Jing, et autres
Publié: (2026)
par: Wu, Jing, et autres
Publié: (2026)
String Seed of Thought: Prompting LLMs for Distribution-Faithful and Diverse Generation
par: Misaki, Kou, et autres
Publié: (2025)
par: Misaki, Kou, et autres
Publié: (2025)
Distributionally Robust Newsvendor on a Metric
par: Foussoul, Ayoub, et autres
Publié: (2024)
par: Foussoul, Ayoub, et autres
Publié: (2024)
Value Explicit Pretraining for Learning Transferable Representations
par: Lekkala, Kiran, et autres
Publié: (2023)
par: Lekkala, Kiran, et autres
Publié: (2023)
Reasoning-Driven Multimodal LLM for Domain Generalization
par: Xu, Zhipeng, et autres
Publié: (2026)
par: Xu, Zhipeng, et autres
Publié: (2026)
Any-Shift Prompting for Generalization over Distributions
par: Xiao, Zehao, et autres
Publié: (2024)
par: Xiao, Zehao, et autres
Publié: (2024)
Patch-Prompt Aligned Bayesian Prompt Tuning for Vision-Language Models
par: Liu, Xinyang, et autres
Publié: (2023)
par: Liu, Xinyang, et autres
Publié: (2023)
Securing Multi-turn Conversational Language Models From Distributed Backdoor Triggers
par: Tong, Terry, et autres
Publié: (2024)
par: Tong, Terry, et autres
Publié: (2024)
CoDoL: Conditional Domain Prompt Learning for Out-of-Distribution Generalization
par: Zhang, Min, et autres
Publié: (2025)
par: Zhang, Min, et autres
Publié: (2025)
Understanding and Improving Training-free Loss-based Diffusion Guidance
par: Shen, Yifei, et autres
Publié: (2024)
par: Shen, Yifei, et autres
Publié: (2024)
Documents similaires
-
Probabilistic Prompt Distribution Learning for Animal Pose Estimation
par: Rao, Jiyong, et autres
Publié: (2025) -
Three-Step Nav: A Hierarchical Global-Local Planner for Zero-Shot Vision-and-Language Navigation
par: Zheng, Wanrong, et autres
Publié: (2026) -
RiTTA: Modeling Event Relations in Text-to-Audio Generation
par: He, Yuhang, et autres
Publié: (2024) -
Riemannian-Geometric Fingerprints of Generative Models
par: Song, Hae Jin, et autres
Publié: (2025) -
Physics Knowledge in Frontier Models: A Diagnostic Study of Failure Modes
par: Bagdonaviciute, Ieva, et autres
Publié: (2025)