MobileDiffusion: Instant Text-to-Image Generation on Mobile Devices
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhao, Yang, Xu, Yanwu, Xiao, Zhisheng, Jia, Haolin, Hou, Tingbo |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
MobileViCLIP: An Efficient Video-Text Model for Mobile Devices
par: Yang, Min, et autres
Publié: (2025)
par: Yang, Min, et autres
Publié: (2025)
Mobile-VTON: High-Fidelity On-Device Virtual Try-On
par: Wan, Zhenchen, et autres
Publié: (2026)
par: Wan, Zhenchen, et autres
Publié: (2026)
SnapGen: Taming High-Resolution Text-to-Image Models for Mobile Devices with Efficient Architectures and Training
par: Hu, Dongting, et autres
Publié: (2024)
par: Hu, Dongting, et autres
Publié: (2024)
On-device Sora: Enabling Training-Free Diffusion-based Text-to-Video Generation for Mobile Devices
par: Kim, Bosung, et autres
Publié: (2025)
par: Kim, Bosung, et autres
Publié: (2025)
On-device Sora: Enabling Training-Free Diffusion-based Text-to-Video Generation for Mobile Devices
par: Kim, Bosung, et autres
Publié: (2025)
par: Kim, Bosung, et autres
Publié: (2025)
Instant Preference Alignment for Text-to-Image Diffusion Models
par: Li, Yang, et autres
Publié: (2025)
par: Li, Yang, et autres
Publié: (2025)
Mobile-O: Unified Multimodal Understanding and Generation on Mobile Device
par: Shaker, Abdelrahman, et autres
Publié: (2026)
par: Shaker, Abdelrahman, et autres
Publié: (2026)
ElasticDiT: Efficient Diffusion Transformers via Elastic Architecture and Sparse Attention for High-Resolution Image Generation on Mobile Devices
par: Du, Kunpeng, et autres
Publié: (2026)
par: Du, Kunpeng, et autres
Publié: (2026)
InstantStyle: Free Lunch towards Style-Preserving in Text-to-Image Generation
par: Wang, Haofan, et autres
Publié: (2024)
par: Wang, Haofan, et autres
Publié: (2024)
InstantStyle-Plus: Style Transfer with Content-Preserving in Text-to-Image Generation
par: Wang, Haofan, et autres
Publié: (2024)
par: Wang, Haofan, et autres
Publié: (2024)
MobileI2V: Fast and High-Resolution Image-to-Video on Mobile Devices
par: Zhang, Shuai, et autres
Publié: (2025)
par: Zhang, Shuai, et autres
Publié: (2025)
MobileVLM : A Fast, Strong and Open Vision Language Assistant for Mobile Devices
par: Chu, Xiangxiang, et autres
Publié: (2023)
par: Chu, Xiangxiang, et autres
Publié: (2023)
NanoFLUX: Distillation-Driven Compression of Large Text-to-Image Generation Models for Mobile Devices
par: Chavhan, Ruchika, et autres
Publié: (2026)
par: Chavhan, Ruchika, et autres
Publié: (2026)
Mobile-GS: Real-time Gaussian Splatting for Mobile Devices
par: Du, Xiaobiao, et autres
Publié: (2026)
par: Du, Xiaobiao, et autres
Publié: (2026)
MobileIE: An Extremely Lightweight and Effective ConvNet for Real-Time Image Enhancement on Mobile Devices
par: Yan, Hailong, et autres
Publié: (2025)
par: Yan, Hailong, et autres
Publié: (2025)
Mobile-Agent: Autonomous Multi-Modal Mobile Device Agent with Visual Perception
par: Wang, Junyang, et autres
Publié: (2024)
par: Wang, Junyang, et autres
Publié: (2024)
Mobile-Agent-v2: Mobile Device Operation Assistant with Effective Navigation via Multi-Agent Collaboration
par: Wang, Junyang, et autres
Publié: (2024)
par: Wang, Junyang, et autres
Publié: (2024)
Instant3D: Instant Text-to-3D Generation
par: Li, Ming, et autres
Publié: (2023)
par: Li, Ming, et autres
Publié: (2023)
AMC: AutoML for Model Compression and Acceleration on Mobile Devices
par: He, Yihui, et autres
Publié: (2018)
par: He, Yihui, et autres
Publié: (2018)
Instant 3D Human Avatar Generation using Image Diffusion Models
par: Kolotouros, Nikos, et autres
Publié: (2024)
par: Kolotouros, Nikos, et autres
Publié: (2024)
Towards Lightest Low-Light Image Enhancement Architecture for Mobile Devices
par: Bai, Guangrui, et autres
Publié: (2025)
par: Bai, Guangrui, et autres
Publié: (2025)
LightPure: Realtime Adversarial Image Purification for Mobile Devices Using Diffusion Models
par: Khalili, Hossein, et autres
Publié: (2024)
par: Khalili, Hossein, et autres
Publié: (2024)
Neodragon: Mobile Video Generation using Diffusion Transformer
par: Karnewar, Animesh, et autres
Publié: (2025)
par: Karnewar, Animesh, et autres
Publié: (2025)
FontAdapter: Instant Font Adaptation in Visual Text Generation
par: Koo, Myungkyu, et autres
Publié: (2025)
par: Koo, Myungkyu, et autres
Publié: (2025)
S2DiT: Sandwich Diffusion Transformer for Mobile Streaming Video Generation
par: Zhao, Lin, et autres
Publié: (2026)
par: Zhao, Lin, et autres
Publié: (2026)
Rethinking Diffusion-Based Image Generators for Fundus Fluorescein Angiography Synthesis on Limited Data
par: Yu, Chengzhou, et autres
Publié: (2024)
par: Yu, Chengzhou, et autres
Publié: (2024)
MobilePortrait: Real-Time One-Shot Neural Head Avatars on Mobile Devices
par: Jiang, Jianwen, et autres
Publié: (2024)
par: Jiang, Jianwen, et autres
Publié: (2024)
SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device
par: Wu, Yushu, et autres
Publié: (2024)
par: Wu, Yushu, et autres
Publié: (2024)
MCCD: Multi-Agent Collaboration-based Compositional Diffusion for Complex Text-to-Image Generation
par: Li, Mingcheng, et autres
Publié: (2025)
par: Li, Mingcheng, et autres
Publié: (2025)
InstantIR: Blind Image Restoration with Instant Generative Reference
par: Huang, Jen-Yuan, et autres
Publié: (2024)
par: Huang, Jen-Yuan, et autres
Publié: (2024)
Mobile Augmented Reality Framework with Fusional Localization and Pose Estimation
par: Hou, Songlin, et autres
Publié: (2025)
par: Hou, Songlin, et autres
Publié: (2025)
Now You See It, Now You Don't - Instant Concept Erasure for Safe Text-to-Image and Video Generation
par: Biswas, Shristi Das, et autres
Publié: (2025)
par: Biswas, Shristi Das, et autres
Publié: (2025)
StreamDiT: Real-Time Streaming Text-to-Video Generation
par: Kodaira, Akio, et autres
Publié: (2025)
par: Kodaira, Akio, et autres
Publié: (2025)
InstantEdit: Text-Guided Few-Step Image Editing with Piecewise Rectified Flow
par: Gong, Yiming, et autres
Publié: (2025)
par: Gong, Yiming, et autres
Publié: (2025)
Efficient Neural Light Fields (ENeLF) for Mobile Devices
par: Peng, Austin
Publié: (2024)
par: Peng, Austin
Publié: (2024)
Porting Large Language Models to Mobile Devices for Question Answering
par: Fassold, Hannes
Publié: (2024)
par: Fassold, Hannes
Publié: (2024)
Towards Real-time Video Compressive Sensing on Mobile Devices
par: Cao, Miao, et autres
Publié: (2024)
par: Cao, Miao, et autres
Publié: (2024)
REFRAME: Reflective Surface Real-Time Rendering for Mobile Devices
par: Ji, Chaojie, et autres
Publié: (2024)
par: Ji, Chaojie, et autres
Publié: (2024)
EdgeDAM: Real-time Object Tracking for Mobile Devices
par: Raza, Syed Muhammad, et autres
Publié: (2026)
par: Raza, Syed Muhammad, et autres
Publié: (2026)
Towards Efficient Diffusion-Based Image Editing with Instant Attention Masks
par: Zou, Siyu, et autres
Publié: (2024)
par: Zou, Siyu, et autres
Publié: (2024)
Documents similaires
-
MobileViCLIP: An Efficient Video-Text Model for Mobile Devices
par: Yang, Min, et autres
Publié: (2025) -
Mobile-VTON: High-Fidelity On-Device Virtual Try-On
par: Wan, Zhenchen, et autres
Publié: (2026) -
SnapGen: Taming High-Resolution Text-to-Image Models for Mobile Devices with Efficient Architectures and Training
par: Hu, Dongting, et autres
Publié: (2024) -
On-device Sora: Enabling Training-Free Diffusion-based Text-to-Video Generation for Mobile Devices
par: Kim, Bosung, et autres
Publié: (2025) -
On-device Sora: Enabling Training-Free Diffusion-based Text-to-Video Generation for Mobile Devices
par: Kim, Bosung, et autres
Publié: (2025)