Wan-Image: Pushing the Boundaries of Generative Visual Intelligence
Fuente:
arXiv
Guardado en:
| Autores principales: | Mao, Chaojie, Xie, Chen-Wei, Zhong, Chongyang, Deng, Haoyou, Zhao, Jiaxing, Xiao, Jie, Xing, Jinbo, Zhang, Jingfeng, Zhou, Jingren, Zhang, Jingyi, Dan, Jun, Zhu, Kai, Zhao, Kang, Yan, Keyu, Chen, Minghui, Li, Pandeng, Chen, Shuangle, Shen, Tong, Liu, Yu, Jiang, Yue, Pan, Yulin, Tuo, Yuxiang, Jiang, Zeyinzi, Han, Zhen, Wang, Ang, Zhang, Bang, Ai, Baole, Wen, Bin, Feng, Boang, Yu, Feiwu, Wang, Gang, Zhao, Haiming, Kang, He, Xiang, Jianjing, Zeng, Jianyuan, Wang, Jinkai, Zhou, Junjie, Sun, Ke, Wu, Linqian, Gong, Pei, Wu, Pingyu, Wu, Ruiwen, Su, Tongtong, Zhou, Wenmeng, Shen, Wenting, Yu, Wenyuan, Xu, Xianjun, Huang, Xiaoming, Shen, Xiejie, Xu, Xin, Kou, Yan, Lv, Yangyu, Zhai, Yifan, Huang, Yitong, Zheng, Yun, Hong, Yuntao, Zhang, Zhe, Zhang, Zhicheng |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Wan: Open and Advanced Large-Scale Video Generative Models
por: Wan, Team, et al.
Publicado: (2025)
por: Wan, Team, et al.
Publicado: (2025)
SWIFT:A Scalable lightWeight Infrastructure for Fine-Tuning
por: Zhao, Yuze, et al.
Publicado: (2024)
por: Zhao, Yuze, et al.
Publicado: (2024)
CartoonAlive: Towards Expressive Live2D Modeling from Single Portraits
por: He, Chao, et al.
Publicado: (2025)
por: He, Chao, et al.
Publicado: (2025)
Optimal starting dosing regimen of intravenous oxytocin for labor induction based on the population kinetic‐pharmacodynamic model of uterine contraction frequency
por: Zhiheng Yu, et al.
Publicado: (2024)
por: Zhiheng Yu, et al.
Publicado: (2024)
Wan-Weaver: Interleaved Multi-modal Generation via Decoupled Training
por: Xing, Jinbo, et al.
Publicado: (2026)
por: Xing, Jinbo, et al.
Publicado: (2026)
Learn where to Click from Yourself: On-Policy Self-Distillation for GUI Grounding
por: Zhang, Yan, et al.
Publicado: (2026)
por: Zhang, Yan, et al.
Publicado: (2026)
DiffCLIP: Leveraging Stable Diffusion for Language Grounded 3D Classification
por: Shen, Sitian, et al.
Publicado: (2023)
por: Shen, Sitian, et al.
Publicado: (2023)
Dual‐transcriptome analyses of high‐ and low‐virulence strains of Cryptococcus gattii cocultured with RAW264.7 macrophages
por: Chen Yang, et al.
Publicado: (2025)
por: Chen Yang, et al.
Publicado: (2025)
TPN: Transferable Proto-Learning Network towards Few-shot Document-Level Relation Extraction
por: Zhang, Yu, et al.
Publicado: (2024)
por: Zhang, Yu, et al.
Publicado: (2024)
Track the Answer: Extending TextVQA from Image to Video with Spatio-Temporal Clues
por: Zhang, Yan, et al.
Publicado: (2024)
por: Zhang, Yan, et al.
Publicado: (2024)
Human Aesthetic Preference-Based Large Text-to-Image Model Personalization: Kandinsky Generation as an Example
por: Zhou, Aven-Le, et al.
Publicado: (2024)
por: Zhou, Aven-Le, et al.
Publicado: (2024)
Steering Large Text-to-Image Model for Abstract Art Synthesis: Preference-based Prompt Optimization and Visualization
por: Zhou, Aven-Le, et al.
Publicado: (2024)
por: Zhou, Aven-Le, et al.
Publicado: (2024)
MES-RAG: Bringing Multi-modal, Entity-Storage, and Secure Enhancements to RAG
por: Wu, Pingyu, et al.
Publicado: (2025)
por: Wu, Pingyu, et al.
Publicado: (2025)
Visible‐Light Induced and PIFA Enabled [4+2] Annulation of Alkenes with N‐Aryl Substituted Hydroxamic Acids
por: Yu‐Zhao Wang, et al.
Publicado: (2024)
por: Yu‐Zhao Wang, et al.
Publicado: (2024)
Textoon: Generating Vivid 2D Cartoon Characters from Text Descriptions
por: He, Chao, et al.
Publicado: (2025)
por: He, Chao, et al.
Publicado: (2025)
Quercetin Attenuates Cytokine Storm in Viral Pneumonia via Inhibition of the TLR3‐NF‐κB‐IL‐6 Signaling Axis
por: Yiqun Zhou, et al.
Publicado: (2026)
por: Yiqun Zhou, et al.
Publicado: (2026)
Local Precise Refinement: A Dual-Gated Mixture-of-Experts for Enhancing Foundation Model Generalization against Spectral Shifts
por: Chen, Xi, et al.
Publicado: (2026)
por: Chen, Xi, et al.
Publicado: (2026)
Large Language Model-enhanced Reinforcement Learning for Low-Altitude Economy Networking
por: Cai, Lingyi, et al.
Publicado: (2025)
por: Cai, Lingyi, et al.
Publicado: (2025)
Anatomic Anterior Cruciate Ligament Reconstruction Integrating the Outside‐In and Transtibial Techniques
por: Yongqiang Zhang, et al.
Publicado: (2025)
por: Yongqiang Zhang, et al.
Publicado: (2025)
QoS-Aware Integrated Sensing, Communication, and Control with Movable Antenna
por: Wang, Yike, et al.
Publicado: (2025)
por: Wang, Yike, et al.
Publicado: (2025)
WRAP++: Web discoveRy Amplified Pretraining
por: Zhou, Jiang, et al.
Publicado: (2026)
por: Zhou, Jiang, et al.
Publicado: (2026)
Flexible Optical Fiber Sensor for Non‐Invasive Continuous Monitoring of Human Physiological Signals
por: Qi Yu, et al.
Publicado: (2025)
por: Qi Yu, et al.
Publicado: (2025)
Novel Unsupervised Machine Learning Method for Identifying Falling from Height Hazards in Building Information Models through Path Simulation Sampling
por: Yu Yan, et al.
Publicado: (2024)
por: Yu Yan, et al.
Publicado: (2024)
Efficient Alkaline‐Free Electrooxidation of 5‐Hydroxymethylfurfural to 2,5‐Furandicarboxylic Acid using Electrochemically‐Charged NixCo1‐x(OH)2 as a Redox Mediator
por: Jifang Zhang, et al.
Publicado: (2025)
por: Jifang Zhang, et al.
Publicado: (2025)
Mechanistic Insight into BEOL Thermal Transport via Optical Metrology and Multiphysics Simulation
por: Shen, Yang, et al.
Publicado: (2025)
por: Shen, Yang, et al.
Publicado: (2025)
Single‐cell transcriptomics reveal metastatic CLDN4+ cancer cells underlying the recurrence of malignant pleural effusion in patients with advanced non‐small‐cell lung cancer
por: Xiaoshen Zhang, et al.
Publicado: (2024)
por: Xiaoshen Zhang, et al.
Publicado: (2024)
ACE++: Instruction-Based Image Creation and Editing via Context-Aware Content Filling
por: Mao, Chaojie, et al.
Publicado: (2025)
por: Mao, Chaojie, et al.
Publicado: (2025)
Controllable Text-to-Speech Synthesis with Masked-Autoencoded Style-Rich Representation
por: Wang, Yongqi, et al.
Publicado: (2025)
por: Wang, Yongqi, et al.
Publicado: (2025)
Achieving More with Less: Additive Prompt Tuning for Rehearsal-Free Class-Incremental Learning
por: Chen, Haoran, et al.
Publicado: (2025)
por: Chen, Haoran, et al.
Publicado: (2025)
Intravenous Multifunctional Nanotherapy for Treating Dry Age‐Related Macular Degeneration
por: Xinyi Zhao, et al.
Publicado: (2025)
por: Xinyi Zhao, et al.
Publicado: (2025)
Intravenous Multifunctional Nanotherapy for Treating Dry Age‐Related Macular Degeneration (Adv. Healthcare Mater. 29/2025)
por: Xinyi Zhao, et al.
Publicado: (2025)
por: Xinyi Zhao, et al.
Publicado: (2025)
Numerical Study of Hydrate Dissociation and Heat Stimulation by Hot Water Injection in Gas Hydrate Reservoirs
por: Kaixiang Shen, et al.
Publicado: (2025)
por: Kaixiang Shen, et al.
Publicado: (2025)
Wan-Move: Motion-controllable Video Generation via Latent Trajectory Guidance
por: Chu, Ruihang, et al.
Publicado: (2025)
por: Chu, Ruihang, et al.
Publicado: (2025)
Heating Control Strategy of CO 2 Heat Pump Air Conditioning System of Electric Vehicle Based on Waste Heat Recovery Technology
por: Yan Zhang, et al.
Publicado: (2024)
por: Yan Zhang, et al.
Publicado: (2024)
A Distributed Unit Hydrograph Modeling for Flood Simulation in the Plain River Network Regions
por: Gang Chen, et al.
Publicado: (2025)
por: Gang Chen, et al.
Publicado: (2025)
Beyond Redundancy: Information-aware Unsupervised Multiplex Graph Structure Learning
por: Shen, Zhixiang, et al.
Publicado: (2024)
por: Shen, Zhixiang, et al.
Publicado: (2024)
The stable behavior of low thermal conductivity in 1T-sandwich structure with different components
por: Zhou, E, et al.
Publicado: (2022)
por: Zhou, E, et al.
Publicado: (2022)
GUI-Bee: Align GUI Action Grounding to Novel Environments via Autonomous Exploration
por: Fan, Yue, et al.
Publicado: (2025)
por: Fan, Yue, et al.
Publicado: (2025)
DiffGS: Functional Gaussian Splatting Diffusion
por: Zhou, Junsheng, et al.
Publicado: (2024)
por: Zhou, Junsheng, et al.
Publicado: (2024)
Efficient Pyramid Channel Attention Network for Pathological Myopia Recognition
por: Zhang, Xiaoqing, et al.
Publicado: (2023)
por: Zhang, Xiaoqing, et al.
Publicado: (2023)
Ejemplares similares
-
Wan: Open and Advanced Large-Scale Video Generative Models
por: Wan, Team, et al.
Publicado: (2025) -
SWIFT:A Scalable lightWeight Infrastructure for Fine-Tuning
por: Zhao, Yuze, et al.
Publicado: (2024) -
CartoonAlive: Towards Expressive Live2D Modeling from Single Portraits
por: He, Chao, et al.
Publicado: (2025) -
Optimal starting dosing regimen of intravenous oxytocin for labor induction based on the population kinetic‐pharmacodynamic model of uterine contraction frequency
por: Zhiheng Yu, et al.
Publicado: (2024) -
Wan-Weaver: Interleaved Multi-modal Generation via Decoupled Training
por: Xing, Jinbo, et al.
Publicado: (2026)