UniCorn: Towards Self-Improving Unified Multimodal Models through Self-Generated Supervision
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Han, Ruiyan, Fang, Zhen, Sun, XinYu, Ma, Yuchen, Wang, Ziheng, Zeng, Yu, Chen, Zehui, Chen, Lin, Huang, Wenxuan, Xu, Wei-Jie, Cao, Yi, Zhao, Feng |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
UniCorn: A Unified Contrastive Learning Approach for Multi-view Molecular Representation Learning
par: Feng, Shikun, et autres
Publié: (2024)
par: Feng, Shikun, et autres
Publié: (2024)
UniRL: Self-Improving Unified Multimodal Models via Supervised and Reinforcement Learning
par: Mao, Weijia, et autres
Publié: (2025)
par: Mao, Weijia, et autres
Publié: (2025)
UniToken: Harmonizing Multimodal Understanding and Generation through Unified Visual Encoding
par: Jiao, Yang, et autres
Publié: (2025)
par: Jiao, Yang, et autres
Publié: (2025)
UniMRSeg: Unified Modality-Relax Segmentation via Hierarchical Self-Supervised Compensation
par: Zhao, Xiaoqi, et autres
Publié: (2025)
par: Zhao, Xiaoqi, et autres
Publié: (2025)
UniTable: Towards a Unified Framework for Table Recognition via Self-Supervised Pretraining
par: Peng, ShengYun, et autres
Publié: (2024)
par: Peng, ShengYun, et autres
Publié: (2024)
Uni4D: A Unified Self-Supervised Learning Framework for Point Cloud Videos
par: Zuo, Zhi, et autres
Publié: (2025)
par: Zuo, Zhi, et autres
Publié: (2025)
UniFormer: Unifying Convolution and Self-attention for Visual Recognition
par: Li, Kunchang, et autres
Publié: (2022)
par: Li, Kunchang, et autres
Publié: (2022)
CRITICTOOL: Evaluating Self-Critique Capabilities of Large Language Models in Tool-Calling Error Scenarios
par: Huang, Shiting, et autres
Publié: (2025)
par: Huang, Shiting, et autres
Publié: (2025)
UniAPO: Unified Multimodal Automated Prompt Optimization
par: Zhu, Qipeng, et autres
Publié: (2025)
par: Zhu, Qipeng, et autres
Publié: (2025)
C2-Evo: Co-Evolving Multimodal Data and Model for Self-Improving Reasoning
par: Chen, Xiuwei, et autres
Publié: (2025)
par: Chen, Xiuwei, et autres
Publié: (2025)
Advances in Gait Alterations and Rehabilitation After Anterior Cruciate Ligament Reconstruction: Biomechanics and Emerging Technologies
par: TszLeung Yu, et autres
Publié: (2026)
par: TszLeung Yu, et autres
Publié: (2026)
CroMe: Multimodal Fake News Detection using Cross-Modal Tri-Transformer and Metric Learning
par: Choi, Eunjee, et autres
Publié: (2025)
par: Choi, Eunjee, et autres
Publié: (2025)
Towards Unified Approaches in Self-Supervised Event Stream Modeling: Progress and Prospects
par: Zólyomi, Levente, et autres
Publié: (2025)
par: Zólyomi, Levente, et autres
Publié: (2025)
SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards
par: Hong, Jixiang, et autres
Publié: (2025)
par: Hong, Jixiang, et autres
Publié: (2025)
UniPercept: Towards Unified Perceptual-Level Image Understanding across Aesthetics, Quality, Structure, and Texture
par: Cao, Shuo, et autres
Publié: (2025)
par: Cao, Shuo, et autres
Publié: (2025)
Anomaly Detection in Electrocardiograms: Advancing Clinical Diagnosis Through Self-Supervised Learning
par: Jiang, Aofan, et autres
Publié: (2024)
par: Jiang, Aofan, et autres
Publié: (2024)
Masking Improves Contrastive Self-Supervised Learning for ConvNets, and Saliency Tells You Where
par: Chin, Zhi-Yi, et autres
Publié: (2023)
par: Chin, Zhi-Yi, et autres
Publié: (2023)
SGCL: Unifying Self-Supervised and Supervised Learning for Graph Recommendation
par: Zhang, Weizhi, et autres
Publié: (2025)
par: Zhang, Weizhi, et autres
Publié: (2025)
UniGeo: Taming Video Diffusion for Unified Consistent Geometry Estimation
par: Sun, Yang-Tian, et autres
Publié: (2025)
par: Sun, Yang-Tian, et autres
Publié: (2025)
Flow-OPD: On-Policy Distillation for Flow Matching Models
par: Fang, Zhen, et autres
Publié: (2026)
par: Fang, Zhen, et autres
Publié: (2026)
UniSD: Towards a Unified Self-Distillation Framework for Large Language Models
par: Jin, Yiqiao, et autres
Publié: (2026)
par: Jin, Yiqiao, et autres
Publié: (2026)
HUWSOD: Holistic Self-training for Unified Weakly Supervised Object Detection
par: Cao, Liujuan, et autres
Publié: (2024)
par: Cao, Liujuan, et autres
Publié: (2024)
UniFinEval: Towards Unified Evaluation of Financial Multimodal Models across Text, Images and Videos
par: Yang, Zhi, et autres
Publié: (2026)
par: Yang, Zhi, et autres
Publié: (2026)
Towards Cross-View-Consistent Self-Supervised Surround Depth Estimation
par: Ding, Laiyan, et autres
Publié: (2024)
par: Ding, Laiyan, et autres
Publié: (2024)
MathSE: Improving Multimodal Mathematical Reasoning via Self-Evolving Iterative Reflection and Reward-Guided Fine-Tuning
par: Chen, Jinhao, et autres
Publié: (2025)
par: Chen, Jinhao, et autres
Publié: (2025)
Uni-Animator: Towards Unified Visual Colorization
par: Chen, Xinyuan, et autres
Publié: (2026)
par: Chen, Xinyuan, et autres
Publié: (2026)
Demographic-Aware Self-Supervised Anomaly Detection Pretraining for Equitable Rare Cardiac Diagnosis
par: Huang, Chaoqin, et autres
Publié: (2026)
par: Huang, Chaoqin, et autres
Publié: (2026)
UniVLR: Unifying Text and Vision in Visual Latent Reasoning for Multimodal LLMs
par: Jiang, Houcheng, et autres
Publié: (2026)
par: Jiang, Houcheng, et autres
Publié: (2026)
Backdooring Self-Supervised Contrastive Learning by Noisy Alignment
par: Chen, Tuo, et autres
Publié: (2025)
par: Chen, Tuo, et autres
Publié: (2025)
Simulated Cortical Magnification Supports Self-Supervised Object Learning
par: Yu, Zhengyang, et autres
Publié: (2025)
par: Yu, Zhengyang, et autres
Publié: (2025)
V-Zero: Self-Improving Multimodal Reasoning with Zero Annotation
par: Wang, Han, et autres
Publié: (2026)
par: Wang, Han, et autres
Publié: (2026)
UniEval: Unified Holistic Evaluation for Unified Multimodal Understanding and Generation
par: Li, Yi, et autres
Publié: (2025)
par: Li, Yi, et autres
Publié: (2025)
UniMEEC: Towards Unified Multimodal Emotion Recognition and Emotion Cause
par: Hu, Guimin, et autres
Publié: (2024)
par: Hu, Guimin, et autres
Publié: (2024)
On Improving the Algorithm-, Model-, and Data- Efficiency of Self-Supervised Learning
par: Cao, Yun-Hao, et autres
Publié: (2024)
par: Cao, Yun-Hao, et autres
Publié: (2024)
UniT: Toward a Unified Physical Language for Human-to-Humanoid Policy Learning and World Modeling
par: Chen, Boyu, et autres
Publié: (2026)
par: Chen, Boyu, et autres
Publié: (2026)
Temporal Embeddings: Scalable Self-Supervised Temporal Representation Learning from Spatiotemporal Data for Multimodal Computer Vision
par: Cao, Yi, et autres
Publié: (2023)
par: Cao, Yi, et autres
Publié: (2023)
Vision-DeepResearch: Incentivizing DeepResearch Capability in Multimodal Large Language Models
par: Huang, Wenxuan, et autres
Publié: (2026)
par: Huang, Wenxuan, et autres
Publié: (2026)
Retrieval-Confused Generation is a Good Defender for Privacy Violation Attack of Large Language Models
par: Peng, Wanli, et autres
Publié: (2025)
par: Peng, Wanli, et autres
Publié: (2025)
Self-Taught Recognizer: Toward Unsupervised Adaptation for Speech Foundation Models
par: Hu, Yuchen, et autres
Publié: (2024)
par: Hu, Yuchen, et autres
Publié: (2024)
UniTS: A Universal Time Series Analysis Framework Powered by Self-Supervised Representation Learning
par: Liang, Zhiyu, et autres
Publié: (2023)
par: Liang, Zhiyu, et autres
Publié: (2023)
Documents similaires
-
UniCorn: A Unified Contrastive Learning Approach for Multi-view Molecular Representation Learning
par: Feng, Shikun, et autres
Publié: (2024) -
UniRL: Self-Improving Unified Multimodal Models via Supervised and Reinforcement Learning
par: Mao, Weijia, et autres
Publié: (2025) -
UniToken: Harmonizing Multimodal Understanding and Generation through Unified Visual Encoding
par: Jiao, Yang, et autres
Publié: (2025) -
UniMRSeg: Unified Modality-Relax Segmentation via Hierarchical Self-Supervised Compensation
par: Zhao, Xiaoqi, et autres
Publié: (2025) -
UniTable: Towards a Unified Framework for Table Recognition via Self-Supervised Pretraining
par: Peng, ShengYun, et autres
Publié: (2024)