Kwai Keye-VL Technical Report
Fuente:
arXiv
Saved in:
| Main Authors: | Kwai Keye Team, Yang, Biao, Wen, Bin, Liu, Changyi, Chu, Chenglong, Song, Chengru, Rao, Chongling, Yi, Chuan, Li, Da, Zang, Dunju, Yang, Fan, Zhou, Guorui, Peng, Hao, Ding, Haojie, Huang, Jiaming, Cao, Jiangxia, Chen, Jiankang, Hua, Jingyun, Ouyang, Jin, Chen, Kaibing, Jiang, Kaiyu, Tang, Kaiyu, Gai, Kun, Zhang, Shengnan, Mao, Siyang, Huang, Sui, Zhang, Tianke, Gao, Tingting, Chen, Wei, Yuan, Wei, Wu, Xiangyu, Hu, Xiao, Lu, Xingyu, Zhou, Yang, Zhang, Yi-Fan, Yang, Yiping, Chen, Yulong, Wu, Zhenhua, Li, Zhenyu, Ling, Zhixin, Li, Ziming, Ma, Dehua, Xu, Di, Gao, Haixuan, Li, Hang, Guo, Jiawei, Wang, Jing, Ren, Lejian, Wei, Muhao, Wang, Qianqian, Hu, Qigen, Wang, Shiyao, Yu, Tao, Luo, Xinchen, Li, Yan, Liang, Yiming, Hu, Yuhang, Lu, Zeyi, Yang, Zhuoran, Zhang, Zixing |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Kwai Keye-VL 1.5 Technical Report
by: Yang, Biao, et al.
Published: (2025)
by: Yang, Biao, et al.
Published: (2025)
R1-Reward: Training Multimodal Reward Model Through Stable Reinforcement Learning
by: Zhang, Yi-Fan, et al.
Published: (2025)
by: Zhang, Yi-Fan, et al.
Published: (2025)
Kwai-STaR: Transform LLMs into State-Transition Reasoners
by: Lu, Xingyu, et al.
Published: (2024)
by: Lu, Xingyu, et al.
Published: (2024)
Thyme: Think Beyond Images
by: Zhang, Yi-Fan, et al.
Published: (2025)
by: Zhang, Yi-Fan, et al.
Published: (2025)
Joint Reward Modeling: Internalizing Chain-of-Thought for Efficient Visual Reward Models
by: Yang, Yankai, et al.
Published: (2026)
by: Yang, Yankai, et al.
Published: (2026)
SpatialReward: Bridging the Perception Gap in Online RL for Image Editing via Explicit Spatial Reasoning
by: Long, Yancheng, et al.
Published: (2026)
by: Long, Yancheng, et al.
Published: (2026)
InstructEngine: Instruction-driven Text-to-Image Alignment
by: Lu, Xingyu, et al.
Published: (2025)
by: Lu, Xingyu, et al.
Published: (2025)
ContextRL: Enhancing MLLM's Knowledge Discovery Efficiency with Context-Augmented RL
by: Lu, Xingyu, et al.
Published: (2026)
by: Lu, Xingyu, et al.
Published: (2026)
Kwai Summary Attention Technical Report
by: Chu, Chenglong, et al.
Published: (2026)
by: Chu, Chenglong, et al.
Published: (2026)
UniRef-Image-Edit: Towards Scalable and Consistent Multi-Reference Image Editing
by: Wei, Hongyang, et al.
Published: (2026)
by: Wei, Hongyang, et al.
Published: (2026)
VCap: Hypergeometric Rewards for Weak-to-Strong Visual Captioning
by: Lu, Xingyu, et al.
Published: (2026)
by: Lu, Xingyu, et al.
Published: (2026)
VideoTemp-o3: Harmonizing Temporal Grounding and Video Understanding in Agentic Thinking-with-Videos
by: Liu, Wenqi, et al.
Published: (2026)
by: Liu, Wenqi, et al.
Published: (2026)
VLM as Policy: Common-Law Content Moderation Framework for Short Video Platform
by: Lu, Xingyu, et al.
Published: (2025)
by: Lu, Xingyu, et al.
Published: (2025)
Why Distillation can Outperform Zero-RL: The Role of Flexible Reasoning
by: Hu, Xiao, et al.
Published: (2025)
by: Hu, Xiao, et al.
Published: (2025)
EVLM: An Efficient Vision-Language Model for Visual Understanding
by: Chen, Kaibing, et al.
Published: (2024)
by: Chen, Kaibing, et al.
Published: (2024)
Nanoscale Drug Delivery Systems for Ovarian Cancer: Targeting Strategies, Theranostic Platforms, and Translational Challenges
by: Xinyue Hu, et al.
Published: (2026)
by: Xinyue Hu, et al.
Published: (2026)
Orbital-selective Superconductivity in the Pressurized Bilayer Nickelate La$_3$Ni$_2$O$_7$: An Infinite Projected Entangled-Pair State Study
by: Chen, Jialin, et al.
Published: (2023)
by: Chen, Jialin, et al.
Published: (2023)
Kelix Technical Report
by: Ding, Boyang, et al.
Published: (2026)
by: Ding, Boyang, et al.
Published: (2026)
Influence of Gate Dimensions on High Power Microwave Injection Effects for AlGaAs / GaAs pHEMT
by: Xuanlin Wang, et al.
Published: (2025)
by: Xuanlin Wang, et al.
Published: (2025)
MGHFT: Multi-Granularity Hierarchical Fusion Transformer for Cross-Modal Sticker Emotion Recognition
by: Chen, Jian, et al.
Published: (2025)
by: Chen, Jian, et al.
Published: (2025)
Ultra‐Fast Response Near‐Infrared Perovskite Quantum Dot Light‐Emitting/Sensing Device for Near Eye Interactive Display
by: Qingkai Zhang, et al.
Published: (2026)
by: Qingkai Zhang, et al.
Published: (2026)
Weakly Supervised Fine-grained Span-Level Framework for Chinese Radiology Report Quality Assurance
by: Wang, Kaiyu, et al.
Published: (2025)
by: Wang, Kaiyu, et al.
Published: (2025)
KAT-V1: Kwai-AutoThink Technical Report
by: Zhan, Zizheng, et al.
Published: (2025)
by: Zhan, Zizheng, et al.
Published: (2025)
Numerical research of flow performance and structure optimization of the U‐tooth impeller
by: Wei Zhang, et al.
Published: (2025)
by: Wei Zhang, et al.
Published: (2025)
Spatial Chain-of-Thought: Bridging Understanding and Generation Models for Spatial Reasoning Generation
by: Chen, Wei, et al.
Published: (2026)
by: Chen, Wei, et al.
Published: (2026)
The evolutionary trajectories and gene regulatory roles of nuclear‐integrated plastid DNA: clues for enhancing environmental adaptation in Caryophyllales
by: Yi Yang, et al.
Published: (2025)
by: Yi Yang, et al.
Published: (2025)
Impact of decision‐making autonomy and social distance on young Chinese children's sharing behaviour
by: Wenjie Zhang, et al.
Published: (2024)
by: Wenjie Zhang, et al.
Published: (2024)
Multilevel Control Functional
by: Li, Kaiyu, et al.
Published: (2023)
by: Li, Kaiyu, et al.
Published: (2023)
Beyond Chunking: Discourse-Aware Hierarchical Retrieval for Long Document Question Answering
by: Chen, Huiyao, et al.
Published: (2025)
by: Chen, Huiyao, et al.
Published: (2025)
Deboronation and Alumination of SCM‐10 Zeolites for Efficient α‐Pinene Isomerization
by: Wei Chen, et al.
Published: (2026)
by: Wei Chen, et al.
Published: (2026)
TimeBrush : An Intelligent Expert System for Restoring Historical Images With Temporal and Stylistic Guidance
by: Kaiyu Zhang
Published: (2025)
by: Kaiyu Zhang
Published: (2025)
Proving Olympiad Inequalities by Synergizing LLMs and Symbolic Reasoning
by: Li, Zenan, et al.
Published: (2025)
by: Li, Zenan, et al.
Published: (2025)
GraphTARIF: Linear Graph Transformer with Augmented Rank and Improved Focus
by: Hu, Zhaolin, et al.
Published: (2025)
by: Hu, Zhaolin, et al.
Published: (2025)
Multifunctional Power Generators beyond Moisture Limitation
by: Yanhui Liu, et al.
Published: (2024)
by: Yanhui Liu, et al.
Published: (2024)
V-Zero: Self-Improving Multimodal Reasoning with Zero Annotation
by: Wang, Han, et al.
Published: (2026)
by: Wang, Han, et al.
Published: (2026)
MOC-3D: Manifold-Order Consistency for Text-to-3D Generation
by: Fan, Chenyang, et al.
Published: (2026)
by: Fan, Chenyang, et al.
Published: (2026)
TaskGalaxy: Scaling Multi-modal Instruction Fine-tuning with Tens of Thousands Vision Task Types
by: Chen, Jiankang, et al.
Published: (2025)
by: Chen, Jiankang, et al.
Published: (2025)
Effect of Cd2+ Doping on Laser Damage Threshold and Optical Performance of KDP Crystals
by: Xiaoyang Dai, et al.
Published: (2025)
by: Xiaoyang Dai, et al.
Published: (2025)
Impact of Frog Height Deviations on Dynamic Response of High‐Speed Metro Trains Negotiating Turnouts
by: Dongliang Zeng, et al.
Published: (2025)
by: Dongliang Zeng, et al.
Published: (2025)
Forsythiaside A ameliorates bleomycin‐induced pulmonary fibrosis by inhibiting oxidative stress and apoptosis
by: Fan Yang, et al.
Published: (2024)
by: Fan Yang, et al.
Published: (2024)
Similar Items
-
Kwai Keye-VL 1.5 Technical Report
by: Yang, Biao, et al.
Published: (2025) -
R1-Reward: Training Multimodal Reward Model Through Stable Reinforcement Learning
by: Zhang, Yi-Fan, et al.
Published: (2025) -
Kwai-STaR: Transform LLMs into State-Transition Reasoners
by: Lu, Xingyu, et al.
Published: (2024) -
Thyme: Think Beyond Images
by: Zhang, Yi-Fan, et al.
Published: (2025) -
Joint Reward Modeling: Internalizing Chain-of-Thought for Efficient Visual Reward Models
by: Yang, Yankai, et al.
Published: (2026)