Gespeichert in:
| Hauptverfasser: | An, Jingkun, Zhu, Yinghao, Li, Zongjian, Zhou, Enshen, Feng, Haoran, Huang, Xijie, Chen, Bohua, Shi, Yemin, Pan, Chengwei |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | https://arxiv.org/abs/2403.13352 |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Medical MLLM is Vulnerable: Cross-Modality Jailbreak and Mismatched Attacks on Medical Multimodal Large Language Models
von: Huang, Xijie, et al.
Veröffentlicht: (2024)
von: Huang, Xijie, et al.
Veröffentlicht: (2024)
SoPo: Text-to-Motion Generation Using Semi-Online Preference Optimization
von: Tan, Xiaofeng, et al.
Veröffentlicht: (2024)
von: Tan, Xiaofeng, et al.
Veröffentlicht: (2024)
Scalable Ranked Preference Optimization for Text-to-Image Generation
von: Karthik, Shyamgopal, et al.
Veröffentlicht: (2024)
von: Karthik, Shyamgopal, et al.
Veröffentlicht: (2024)
LightM-UNet: Mamba Assists in Lightweight UNet for Medical Image Segmentation
von: Liao, Weibin, et al.
Veröffentlicht: (2024)
von: Liao, Weibin, et al.
Veröffentlicht: (2024)
Rich Human Feedback for Text-to-Image Generation
von: Liang, Youwei, et al.
Veröffentlicht: (2023)
von: Liang, Youwei, et al.
Veröffentlicht: (2023)
WebCode2M: A Real-World Dataset for Code Generation from Webpage Designs
von: Gui, Yi, et al.
Veröffentlicht: (2024)
von: Gui, Yi, et al.
Veröffentlicht: (2024)
SUDO: Enhancing Text-to-Image Diffusion Models with Self-Supervised Direct Preference Optimization
von: Peng, Liang, et al.
Veröffentlicht: (2025)
von: Peng, Liang, et al.
Veröffentlicht: (2025)
SuperGS: Consistent and Detailed 3D Super-Resolution Scene Reconstruction via Gaussian Splatting
von: Xie, Shiyun, et al.
Veröffentlicht: (2025)
von: Xie, Shiyun, et al.
Veröffentlicht: (2025)
SuperGS: Super-Resolution 3D Gaussian Splatting Enhanced by Variational Residual Features and Uncertainty-Augmented Learning
von: Xie, Shiyun, et al.
Veröffentlicht: (2024)
von: Xie, Shiyun, et al.
Veröffentlicht: (2024)
OSPO: Object-Centric Self-Improving Preference Optimization for Text-to-Image Generation
von: Oh, Yoonjin, et al.
Veröffentlicht: (2025)
von: Oh, Yoonjin, et al.
Veröffentlicht: (2025)
Text-driven 3D Human Generation via Contrastive Preference Optimization
von: Zhou, Pengfei, et al.
Veröffentlicht: (2025)
von: Zhou, Pengfei, et al.
Veröffentlicht: (2025)
Helios: Real Real-Time Long Video Generation Model
von: Yuan, Shenghai, et al.
Veröffentlicht: (2026)
von: Yuan, Shenghai, et al.
Veröffentlicht: (2026)
Invisible Relevance Bias: Text-Image Retrieval Models Prefer AI-Generated Images
von: Xu, Shicheng, et al.
Veröffentlicht: (2023)
von: Xu, Shicheng, et al.
Veröffentlicht: (2023)
StyGazeTalk: Learning Stylized Generation of Gaze and Head Dynamics
von: Shi, Chengwei, et al.
Veröffentlicht: (2025)
von: Shi, Chengwei, et al.
Veröffentlicht: (2025)
Towards Open-World Referring Expression Comprehension: A Benchmark with Training-free Multi-task Consistency Checker
von: Wu, Zongjian, et al.
Veröffentlicht: (2026)
von: Wu, Zongjian, et al.
Veröffentlicht: (2026)
TIGeR: Tool-Integrated Geometric Reasoning in Vision-Language Models for Robotics
von: Han, Yi, et al.
Veröffentlicht: (2025)
von: Han, Yi, et al.
Veröffentlicht: (2025)
Compositional Text-to-Image Generation Via Region-aware Bimodal Direct Preference Optimization
von: Liu, Zhuohan, et al.
Veröffentlicht: (2026)
von: Liu, Zhuohan, et al.
Veröffentlicht: (2026)
HARIVO: Harnessing Text-to-Image Models for Video Generation
von: Kwon, Mingi, et al.
Veröffentlicht: (2024)
von: Kwon, Mingi, et al.
Veröffentlicht: (2024)
Preference Score Distillation: Leveraging 2D Rewards to Align Text-to-3D Generation with Human Preference
von: Leng, Jiaqi, et al.
Veröffentlicht: (2026)
von: Leng, Jiaqi, et al.
Veröffentlicht: (2026)
Premier: Personalized Preference Modulation with Learnable User Embedding in Text-to-Image Generation
von: Wang, Zihao, et al.
Veröffentlicht: (2026)
von: Wang, Zihao, et al.
Veröffentlicht: (2026)
Learning Multi-dimensional Human Preference for Text-to-Image Generation
von: Zhang, Sixian, et al.
Veröffentlicht: (2024)
von: Zhang, Sixian, et al.
Veröffentlicht: (2024)
Preference Adaptive and Sequential Text-to-Image Generation
von: Nabati, Ofir, et al.
Veröffentlicht: (2024)
von: Nabati, Ofir, et al.
Veröffentlicht: (2024)
Expressive Text-to-Image Generation with Rich Text
von: Ge, Songwei, et al.
Veröffentlicht: (2023)
von: Ge, Songwei, et al.
Veröffentlicht: (2023)
IGenBench: Benchmarking the Reliability of Text-to-Infographic Generation
von: Tang, Yinghao, et al.
Veröffentlicht: (2026)
von: Tang, Yinghao, et al.
Veröffentlicht: (2026)
RoboRefer: Towards Spatial Referring with Reasoning in Vision-Language Models for Robotics
von: Zhou, Enshen, et al.
Veröffentlicht: (2025)
von: Zhou, Enshen, et al.
Veröffentlicht: (2025)
Bringing Diversity from Diffusion Models to Semantic-Guided Face Asset Generation
von: Cai, Yunxuan, et al.
Veröffentlicht: (2025)
von: Cai, Yunxuan, et al.
Veröffentlicht: (2025)
Generalizing Alignment Paradigm of Text-to-Image Generation with Preferences through $f$-divergence Minimization
von: Sun, Haoyuan, et al.
Veröffentlicht: (2024)
von: Sun, Haoyuan, et al.
Veröffentlicht: (2024)
Training-Free Text-to-Image Compositional Food Generation via Prompt Grafting
von: Pan, Xinyue, et al.
Veröffentlicht: (2026)
von: Pan, Xinyue, et al.
Veröffentlicht: (2026)
EmoGen: Emotional Image Content Generation with Text-to-Image Diffusion Models
von: Yang, Jingyuan, et al.
Veröffentlicht: (2024)
von: Yang, Jingyuan, et al.
Veröffentlicht: (2024)
InstructUDrag: Joint Text Instructions and Object Dragging for Interactive Image Editing
von: Yu, Haoran, et al.
Veröffentlicht: (2025)
von: Yu, Haoran, et al.
Veröffentlicht: (2025)
Anomaly-Preference Image Generation
von: Wang, Fuyun, et al.
Veröffentlicht: (2026)
von: Wang, Fuyun, et al.
Veröffentlicht: (2026)
Optimizing Negative Prompts for Enhanced Aesthetics and Fidelity in Text-To-Image Generation
von: Ogezi, Michael, et al.
Veröffentlicht: (2024)
von: Ogezi, Michael, et al.
Veröffentlicht: (2024)
Curriculum-DPO++: Direct Preference Optimization via Data and Model Curricula for Text-to-Image Generation
von: Croitoru, Florinel-Alin, et al.
Veröffentlicht: (2026)
von: Croitoru, Florinel-Alin, et al.
Veröffentlicht: (2026)
A Difference-in-Difference Approach to Detecting AI-Generated Images
von: Qi, Xinyi, et al.
Veröffentlicht: (2026)
von: Qi, Xinyi, et al.
Veröffentlicht: (2026)
Enhancing MMDiT-Based Text-to-Image Models for Similar Subject Generation
von: Wei, Tianyi, et al.
Veröffentlicht: (2024)
von: Wei, Tianyi, et al.
Veröffentlicht: (2024)
Enhance Multimodal Consistency and Coherence for Text-Image Plan Generation
von: Lu, Xiaoxin, et al.
Veröffentlicht: (2025)
von: Lu, Xiaoxin, et al.
Veröffentlicht: (2025)
Stable-Pose: Leveraging Transformers for Pose-Guided Text-to-Image Generation
von: Wang, Jiajun, et al.
Veröffentlicht: (2024)
von: Wang, Jiajun, et al.
Veröffentlicht: (2024)
Optimizing Prompts for Text-to-Image Generation
von: Hao, Yaru, et al.
Veröffentlicht: (2022)
von: Hao, Yaru, et al.
Veröffentlicht: (2022)
Dual-IPO: Dual-Iterative Preference Optimization for Text-to-Video Generation
von: Yang, Xiaomeng, et al.
Veröffentlicht: (2025)
von: Yang, Xiaomeng, et al.
Veröffentlicht: (2025)
Text4Seg: Reimagining Image Segmentation as Text Generation
von: Lan, Mengcheng, et al.
Veröffentlicht: (2024)
von: Lan, Mengcheng, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
Medical MLLM is Vulnerable: Cross-Modality Jailbreak and Mismatched Attacks on Medical Multimodal Large Language Models
von: Huang, Xijie, et al.
Veröffentlicht: (2024) -
SoPo: Text-to-Motion Generation Using Semi-Online Preference Optimization
von: Tan, Xiaofeng, et al.
Veröffentlicht: (2024) -
Scalable Ranked Preference Optimization for Text-to-Image Generation
von: Karthik, Shyamgopal, et al.
Veröffentlicht: (2024) -
LightM-UNet: Mamba Assists in Lightweight UNet for Medical Image Segmentation
von: Liao, Weibin, et al.
Veröffentlicht: (2024) -
Rich Human Feedback for Text-to-Image Generation
von: Liang, Youwei, et al.
Veröffentlicht: (2023)