Minecraft-ify: Minecraft Style Image Generation with Text-guided Image Editing for In-Game Application
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Kim, Bumsoo, Byun, Sanghyun, Jung, Yonghoon, Shin, Wonseop, Amin, Sareer UI, Seo, Sanghyun |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Make VLM Recognize Visual Hallucination on Cartoon Character Image with Pose Information
par: Kim, Bumsoo, et autres
Publié: (2024)
par: Kim, Bumsoo, et autres
Publié: (2024)
ToonAging: Face Re-Aging upon Artistic Portrait Style Transfer
par: Kim, Bumsoo, et autres
Publié: (2024)
par: Kim, Bumsoo, et autres
Publié: (2024)
MultiFloodSynth: Multi-Annotated Flood Synthetic Dataset Generation
par: Kang, YoonJe, et autres
Publié: (2025)
par: Kang, YoonJe, et autres
Publié: (2025)
InteractEdit: Zero-Shot Editing of Human-Object Interactions in Images
par: Hoe, Jiun Tian, et autres
Publié: (2025)
par: Hoe, Jiun Tian, et autres
Publié: (2025)
Video Anomaly Detection Utilizing Efficient Spatiotemporal Feature Fusion with 3D Convolutions and Long Short‐Term Memory Modules
par: Sareer Ul Amin, et autres
Publié: (2024)
par: Sareer Ul Amin, et autres
Publié: (2024)
InteractDiffusion: Interaction Control in Text-to-Image Diffusion Models
par: Hoe, Jiun Tian, et autres
Publié: (2023)
par: Hoe, Jiun Tian, et autres
Publié: (2023)
Generating Digital Models Using Text-to-3D and Image-to-3D Prompts: Critical Case Study
par: Ziatdinov, Rushan, et autres
Publié: (2025)
par: Ziatdinov, Rushan, et autres
Publié: (2025)
Sound Sparks Motion: Audio and Text Tuning for Video Editing
par: Razlighi, AmirHossein Naghi, et autres
Publié: (2026)
par: Razlighi, AmirHossein Naghi, et autres
Publié: (2026)
ReSyncer: Rewiring Style-based Generator for Unified Audio-Visually Synced Facial Performer
par: Guan, Jiazhi, et autres
Publié: (2024)
par: Guan, Jiazhi, et autres
Publié: (2024)
Kiss3DGen: Repurposing Image Diffusion Models for 3D Asset Generation
par: Lin, Jiantao, et autres
Publié: (2025)
par: Lin, Jiantao, et autres
Publié: (2025)
SemanticGarment: Semantic-Controlled Generation and Editing of 3D Gaussian Garments
par: Wang, Ruiyan, et autres
Publié: (2025)
par: Wang, Ruiyan, et autres
Publié: (2025)
VerbDiff: Text-Only Diffusion Models with Enhanced Interaction Awareness
par: Cha, SeungJu, et autres
Publié: (2025)
par: Cha, SeungJu, et autres
Publié: (2025)
Unveiling Deep Shadows: A Survey and Benchmark on Image and Video Shadow Detection, Removal, and Generation in the Deep Learning Era
par: Hu, Xiaowei, et autres
Publié: (2024)
par: Hu, Xiaowei, et autres
Publié: (2024)
On Copyright Risks of Text-to-Image Diffusion Models
par: Zhang, Yang, et autres
Publié: (2023)
par: Zhang, Yang, et autres
Publié: (2023)
Break-for-Make: Modular Low-Rank Adaptations for Composable Content-Style Customization
par: Xu, Yu, et autres
Publié: (2024)
par: Xu, Yu, et autres
Publié: (2024)
COutfitGAN: Learning to Synthesize Compatible Outfits Supervised by Silhouette Masks and Fashion Styles
par: Zhou, Dongliang, et autres
Publié: (2025)
par: Zhou, Dongliang, et autres
Publié: (2025)
STAR: Skeleton-aware Text-based 4D Avatar Generation with In-Network Motion Retargeting
par: Chai, Zenghao, et autres
Publié: (2024)
par: Chai, Zenghao, et autres
Publié: (2024)
Emu Video: Factorizing Text-to-Video Generation by Explicit Image Conditioning
par: Girdhar, Rohit, et autres
Publié: (2023)
par: Girdhar, Rohit, et autres
Publié: (2023)
Multimodal Cinematic Video Synthesis Using Text-to-Image and Audio Generation Models
par: S, Sridhar, et autres
Publié: (2025)
par: S, Sridhar, et autres
Publié: (2025)
MDD: A Dataset for Text-and-Music Conditioned Duet Dance Generation
par: Gupta, Prerit, et autres
Publié: (2025)
par: Gupta, Prerit, et autres
Publié: (2025)
Extreme Compression of Adaptive Neural Images
par: Hoshikawa, Leo, et autres
Publié: (2024)
par: Hoshikawa, Leo, et autres
Publié: (2024)
Coral Model Generation from Single Images for Virtual Reality Applications
par: Fu, Jie, et autres
Publié: (2024)
par: Fu, Jie, et autres
Publié: (2024)
ChoreoMuse: Robust Music-to-Dance Video Generation with Style Transfer and Beat-Adherent Motion
par: Wang, Xuanchen, et autres
Publié: (2025)
par: Wang, Xuanchen, et autres
Publié: (2025)
Kubrick: Multimodal Agent Collaborations for Synthetic Video Generation
par: He, Liu, et autres
Publié: (2024)
par: He, Liu, et autres
Publié: (2024)
Delta Forcing: Trust Region Steering for Interactive Autoregressive Video Generation
par: Wu, Yuheng, et autres
Publié: (2026)
par: Wu, Yuheng, et autres
Publié: (2026)
TreeMeshGPT: Artistic Mesh Generation with Autoregressive Tree Sequencing
par: Lionar, Stefan, et autres
Publié: (2025)
par: Lionar, Stefan, et autres
Publié: (2025)
HiScene: Creating Hierarchical 3D Scenes with Isometric View Generation
par: Dong, Wenqi, et autres
Publié: (2025)
par: Dong, Wenqi, et autres
Publié: (2025)
AudCast: Audio-Driven Human Video Generation by Cascaded Diffusion Transformers
par: Guan, Jiazhi, et autres
Publié: (2025)
par: Guan, Jiazhi, et autres
Publié: (2025)
PersonaGest: Personalized Co-Speech Gesture Generation with Semantic-Guided Hierarchical Motion Representation
par: Zhao, Junchuan, et autres
Publié: (2026)
par: Zhao, Junchuan, et autres
Publié: (2026)
LAV: Audio-Driven Dynamic Visual Generation with Neural Compression and StyleGAN2
par: Jung, Jongmin, et autres
Publié: (2025)
par: Jung, Jongmin, et autres
Publié: (2025)
BlenderFusion: 3D-Grounded Visual Editing and Generative Compositing
par: Chen, Jiacheng, et autres
Publié: (2025)
par: Chen, Jiacheng, et autres
Publié: (2025)
Text Slider: Efficient and Plug-and-Play Continuous Concept Control for Image/Video Synthesis via LoRA Adapters
par: Chiu, Pin-Yen, et autres
Publié: (2025)
par: Chiu, Pin-Yen, et autres
Publié: (2025)
Cert-LAS: Toward Certified Model Ownership Verification for Text-to-Image Diffusion Models via Layer-Adaptive Smoothing
par: Qi, Leyi, et autres
Publié: (2026)
par: Qi, Leyi, et autres
Publié: (2026)
Relightable Gaussian Splatting for Virtual Production Using Image-Based Illumination
par: Azzarelli, Adrian, et autres
Publié: (2026)
par: Azzarelli, Adrian, et autres
Publié: (2026)
Unison: Harmonizing Motion, Speech, and Sound for Human-Centric Audio-Video Generation
par: Cheng, Shihao, et autres
Publié: (2026)
par: Cheng, Shihao, et autres
Publié: (2026)
DanceEditor: Towards Iterative Editable Music-driven Dance Generation with Open-Vocabulary Descriptions
par: Zhang, Hengyuan, et autres
Publié: (2025)
par: Zhang, Hengyuan, et autres
Publié: (2025)
FairyGen: Storied Cartoon Video from a Single Child-Drawn Character
par: Zheng, Jiayi, et autres
Publié: (2025)
par: Zheng, Jiayi, et autres
Publié: (2025)
Perceive-Sample-Compress: Towards Real-Time 3D Gaussian Splatting
par: Wang, Zijian, et autres
Publié: (2025)
par: Wang, Zijian, et autres
Publié: (2025)
Splatography: Sparse multi-view dynamic Gaussian Splatting for filmmaking challenges
par: Azzarelli, Adrian, et autres
Publié: (2025)
par: Azzarelli, Adrian, et autres
Publié: (2025)
DreamCinema: Cinematic Transfer with Free Camera and 3D Character
par: Chen, Weiliang, et autres
Publié: (2024)
par: Chen, Weiliang, et autres
Publié: (2024)
Documents similaires
-
Make VLM Recognize Visual Hallucination on Cartoon Character Image with Pose Information
par: Kim, Bumsoo, et autres
Publié: (2024) -
ToonAging: Face Re-Aging upon Artistic Portrait Style Transfer
par: Kim, Bumsoo, et autres
Publié: (2024) -
MultiFloodSynth: Multi-Annotated Flood Synthetic Dataset Generation
par: Kang, YoonJe, et autres
Publié: (2025) -
InteractEdit: Zero-Shot Editing of Human-Object Interactions in Images
par: Hoe, Jiun Tian, et autres
Publié: (2025) -
Video Anomaly Detection Utilizing Efficient Spatiotemporal Feature Fusion with 3D Convolutions and Long Short‐Term Memory Modules
par: Sareer Ul Amin, et autres
Publié: (2024)