LongCat-Image Technical Report
Fuente:
arXiv
Saved in:
| Main Authors: | Meituan LongCat Team, Ma, Hanghang, Tan, Haoxian, Huang, Jiale, Wu, Junqiang, He, Jun-Yan, Gao, Lishuai, Xiao, Songlin, Wei, Xiaoming, Ma, Xiaoqi, Cai, Xunliang, Guan, Yayong, Hu, Jie |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
LongCat-Video Technical Report
by: Meituan LongCat Team, et al.
Published: (2025)
by: Meituan LongCat Team, et al.
Published: (2025)
LongCat-Video-Avatar 1.5 Technical Report
by: Meituan LongCat Team, et al.
Published: (2026)
by: Meituan LongCat Team, et al.
Published: (2026)
LongCat-Flash Technical Report
by: Meituan LongCat Team, et al.
Published: (2025)
by: Meituan LongCat Team, et al.
Published: (2025)
LongCat-Flash-Omni Technical Report
by: Meituan LongCat Team, et al.
Published: (2025)
by: Meituan LongCat Team, et al.
Published: (2025)
LongCat-Flash-Thinking-2601 Technical Report
by: Meituan LongCat Team, et al.
Published: (2026)
by: Meituan LongCat Team, et al.
Published: (2026)
Introducing LongCat-Flash-Thinking: A Technical Report
by: Meituan LongCat Team, et al.
Published: (2025)
by: Meituan LongCat Team, et al.
Published: (2025)
LongCat-Next: Lexicalizing Modalities as Discrete Tokens
by: Meituan LongCat Team, et al.
Published: (2026)
by: Meituan LongCat Team, et al.
Published: (2026)
A Simple Baseline for Unifying Understanding, Generation, and Editing via Vanilla Next-token Prediction
by: Zhu, Jie, et al.
Published: (2026)
by: Zhu, Jie, et al.
Published: (2026)
LongCat-AudioDiT: High-Fidelity Diffusion Text-to-Speech in the Waveform Latent Space
by: Xin, Detai, et al.
Published: (2026)
by: Xin, Detai, et al.
Published: (2026)
Efficient Context Scaling with LongCat ZigZag Attention
by: Zhang, Chen, et al.
Published: (2025)
by: Zhang, Chen, et al.
Published: (2025)
LongCat-Flash-Prover: Advancing Native Formal Reasoning via Agentic Tool-Integrated Reinforcement Learning
by: Wang, Jianing, et al.
Published: (2026)
by: Wang, Jianing, et al.
Published: (2026)
MagicMirror: A Large-Scale Dataset and Benchmark for Fine-Grained Artifacts Assessment in Text-to-Image Generation
by: Wang, Jia, et al.
Published: (2025)
by: Wang, Jia, et al.
Published: (2025)
Image Editing with Diffusion Models: A Survey
by: Wang, Jia, et al.
Published: (2025)
by: Wang, Jia, et al.
Published: (2025)
Forge-and-Quench: Enhancing Image Generation for Higher Fidelity in Unified Multimodal Models
by: Zeng, Yanbing, et al.
Published: (2026)
by: Zeng, Yanbing, et al.
Published: (2026)
Kangaroo: A Powerful Video-Language Model Supporting Long-context Video Input
by: Liu, Jiajun, et al.
Published: (2024)
by: Liu, Jiajun, et al.
Published: (2024)
LongCat-Audio-Codec: An Audio Tokenizer and Detokenizer Solution Designed for Speech Large Language Models
by: Zhao, Xiaohan, et al.
Published: (2025)
by: Zhao, Xiaohan, et al.
Published: (2025)
G-SMOTE-CatBoost-Optuna
by: G-SMOTE-CatBoost-Optuna
Published: (2025)
by: G-SMOTE-CatBoost-Optuna
Published: (2025)
LinVT: Empower Your Image-level Large Language Model to Understand Videos
by: Gao, Lishuai, et al.
Published: (2024)
by: Gao, Lishuai, et al.
Published: (2024)
360Zhinao Technical Report
by: 360Zhinao Team
Published: (2024)
by: 360Zhinao Team
Published: (2024)
Qwen3.5-Omni Technical Report
by: Qwen Team
Published: (2026)
by: Qwen Team
Published: (2026)
Mind DeepResearch Technical Report
by: MindDR Team, et al.
Published: (2026)
by: MindDR Team, et al.
Published: (2026)
Kling-MotionControl Technical Report
by: Kling Team, et al.
Published: (2026)
by: Kling Team, et al.
Published: (2026)
HyperCLOVA X THINK Technical Report
by: NAVER Cloud HyperCLOVA X Team
Published: (2025)
by: NAVER Cloud HyperCLOVA X Team
Published: (2025)
KlingAvatar 2.0 Technical Report
by: Kling Team, et al.
Published: (2025)
by: Kling Team, et al.
Published: (2025)
Demographic‐aware deep learning for multi‐organ segmentation: Mitigating gender and age biases in CT images
by: Junqiang Ma, et al.
Published: (2026)
by: Junqiang Ma, et al.
Published: (2026)
LaSagnA: Language-based Segmentation Assistant for Complex Queries
by: Wei, Cong, et al.
Published: (2024)
by: Wei, Cong, et al.
Published: (2024)
PM2D: A parallel GPU-based code for the kinetic simulation of laser plasma instabilities in large scale plasmas
by: Ma, Hanghang, et al.
Published: (2024)
by: Ma, Hanghang, et al.
Published: (2024)
Fun-Audio-Chat Technical Report
by: Tongyi Fun Team, et al.
Published: (2025)
by: Tongyi Fun Team, et al.
Published: (2025)
Arcee Trinity Large Technical Report
by: Singh, Varun, et al.
Published: (2026)
by: Singh, Varun, et al.
Published: (2026)
Raw Data of Toward Non-Living Training Models: A Trainee-Preferred and Sustainable 3D-Printed Model in Microvascular Anastomosis
by: Junqiang
Published: (2026)
by: Junqiang
Published: (2026)
Cut and paste invariants of moduli spaces of stable maps to toric surfaces
by: Rust, Cat
Published: (2026)
by: Rust, Cat
Published: (2026)
Phenotypic and genotypic evaluation of Turkish bread wheat (Triticum aestivum L.) varieties to stripe rust (Puccinia striiformis f.sp. tritici)
by: Ahmet Cat
Published: (2024)
by: Ahmet Cat
Published: (2024)
GLM-TTS Technical Report
by: Cui, Jiayan, et al.
Published: (2025)
by: Cui, Jiayan, et al.
Published: (2025)
Semi-robust equal-order hybridized discontinuous methods
by: Ma, Xiaoqi, et al.
Published: (2025)
by: Ma, Xiaoqi, et al.
Published: (2025)
Supercloseness of the HDG method on Shishkin mesh for a singularly perturbed convection diffusion problem in 2D
by: Ma, Xiaoqi, et al.
Published: (2024)
by: Ma, Xiaoqi, et al.
Published: (2024)
Technical Report for Ego4D Long-Term Action Anticipation Challenge 2025
by: Chu, Qiaohui, et al.
Published: (2025)
by: Chu, Qiaohui, et al.
Published: (2025)
Phoenix-VL 1.5 Medium Technical Report
by: Phoenix, Team, et al.
Published: (2026)
by: Phoenix, Team, et al.
Published: (2026)
Dynamic Avalanches: Rate-Controlled Switching and Race Conditions
by: Jin, Lishuai, et al.
Published: (2025)
by: Jin, Lishuai, et al.
Published: (2025)
FireRed-Image-Edit-1.0 Technical Report
by: Super Intelligence Team, et al.
Published: (2026)
by: Super Intelligence Team, et al.
Published: (2026)
MOSS-Audio Technical Report
by: Yang, Chen, et al.
Published: (2026)
by: Yang, Chen, et al.
Published: (2026)
Similar Items
-
LongCat-Video Technical Report
by: Meituan LongCat Team, et al.
Published: (2025) -
LongCat-Video-Avatar 1.5 Technical Report
by: Meituan LongCat Team, et al.
Published: (2026) -
LongCat-Flash Technical Report
by: Meituan LongCat Team, et al.
Published: (2025) -
LongCat-Flash-Omni Technical Report
by: Meituan LongCat Team, et al.
Published: (2025) -
LongCat-Flash-Thinking-2601 Technical Report
by: Meituan LongCat Team, et al.
Published: (2026)