When Models Judge Themselves: Unsupervised Self-Evolution for Multimodal Reasoning
Fuente:
arXiv
Saved in:
| Main Authors: | Wu, Zhengxian, Shi, Kai, Zhang, Chuanrui, Liao, Zirui, Yang, Jun, Yang, Ni, Peng, Qiuying, Zhang, Luyuan, Xu, Hangrui, Su, Tianhuang, Yang, Zhenyu, Lu, Haonan, Wang, Haoqian |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Language-Guided and Motion-Aware Gait Representation for Generalizable Recognition
by: Wu, Zhengxian, et al.
Published: (2026)
by: Wu, Zhengxian, et al.
Published: (2026)
DAGait: Generalized Skeleton-Guided Data Alignment for Gait Recognition
by: Wu, Zhengxian, et al.
Published: (2025)
by: Wu, Zhengxian, et al.
Published: (2025)
Stabilizing Unsupervised Self-Evolution of MLLMs via Continuous Softened Retracing reSampling
by: Yu, Yunyao, et al.
Published: (2026)
by: Yu, Yunyao, et al.
Published: (2026)
DaMo: Data Mixing Optimizer in Fine-tuning Multimodal LLMs for Mobile Phone Agents
by: Shi, Kai, et al.
Published: (2025)
by: Shi, Kai, et al.
Published: (2025)
R3G: A Reasoning--Retrieval--Reranking Framework for Vision-Centric Answer Generation
by: Chen, Zhuohong, et al.
Published: (2026)
by: Chen, Zhuohong, et al.
Published: (2026)
PSGait: Gait Recognition using Parsing Skeleton
by: Xu, Hangrui, et al.
Published: (2025)
by: Xu, Hangrui, et al.
Published: (2025)
Binary Neural Networks for Large Language Model: A Survey
by: Liu, Liangdong, et al.
Published: (2025)
by: Liu, Liangdong, et al.
Published: (2025)
iMoWM: Taming Interactive Multi-Modal World Model for Robotic Manipulation
by: Zhang, Chuanrui, et al.
Published: (2025)
by: Zhang, Chuanrui, et al.
Published: (2025)
Category-level Object Detection, Pose Estimation and Reconstruction from Stereo Images
by: Zhang, Chuanrui, et al.
Published: (2024)
by: Zhang, Chuanrui, et al.
Published: (2024)
TranSplat: Generalizable 3D Gaussian Splatting from Sparse Multi-View Images with Transformers
by: Zhang, Chuanrui, et al.
Published: (2024)
by: Zhang, Chuanrui, et al.
Published: (2024)
Efficient Agent: Optimizing Planning Capability for Multimodal Retrieval Augmented Generation
by: Wang, Yuechen, et al.
Published: (2025)
by: Wang, Yuechen, et al.
Published: (2025)
LLMs Judge Themselves: A Game-Theoretic Framework for Human-Aligned Evaluation
by: Yang, Gao, et al.
Published: (2025)
by: Yang, Gao, et al.
Published: (2025)
Learning to Search: A Decision-Based Agent for Knowledge-Based Visual Question Answering
by: Chen, Zhuohong, et al.
Published: (2026)
by: Chen, Zhuohong, et al.
Published: (2026)
Large Language Models are Demonstration Pre-Selectors for Themselves
by: Jin, Jiarui, et al.
Published: (2025)
by: Jin, Jiarui, et al.
Published: (2025)
From Leaky Thoughts to Private Reasoning: Controlling What LRMs Say to Themselves
by: Puerto, Haritz, et al.
Published: (2026)
by: Puerto, Haritz, et al.
Published: (2026)
Improved Visual-Spatial Reasoning via R1-Zero-Like Training
by: Liao, Zhenyi, et al.
Published: (2025)
by: Liao, Zhenyi, et al.
Published: (2025)
STaR-SQL: Self-Taught Reasoner for Text-to-SQL
by: He, Mingqian, et al.
Published: (2025)
by: He, Mingqian, et al.
Published: (2025)
PRISM: Refracting the Entangled User Behavior Space for E-Commerce Search
by: Zhang, Haoqian, et al.
Published: (2026)
by: Zhang, Haoqian, et al.
Published: (2026)
Self-Attribution Bias: When AI Monitors Go Easy on Themselves
by: Khullar, Dipika, et al.
Published: (2026)
by: Khullar, Dipika, et al.
Published: (2026)
When LLMs Benchmark Themselves: Deconstructing Self-Bias in Automated Evaluation
by: Xu, Wenda, et al.
Published: (2025)
by: Xu, Wenda, et al.
Published: (2025)
Evolution without an Oracle: Driving Effective Evolution with LLM Judges
by: Zhao, Zhe, et al.
Published: (2025)
by: Zhao, Zhe, et al.
Published: (2025)
Anchor-MoE: A Mean-Anchored Mixture of Experts For Probabilistic Regression
by: Su, Baozhuo, et al.
Published: (2025)
by: Su, Baozhuo, et al.
Published: (2025)
When Models Examine Themselves: Vocabulary-Activation Correspondence in Self-Referential Processing
by: Dadfar, Zachary Pedram
Published: (2026)
by: Dadfar, Zachary Pedram
Published: (2026)
Quantifying and Mitigating Self-Preference Bias of LLM Judges
by: Yang, Jinming, et al.
Published: (2026)
by: Yang, Jinming, et al.
Published: (2026)
Multi-Perspective Evidence Synthesis and Reasoning for Unsupervised Multimodal Entity Linking
by: Zhou, Mo, et al.
Published: (2026)
by: Zhou, Mo, et al.
Published: (2026)
MergeTok: Unified Continuous and Discrete Visual Tokenization via Token Merging
by: Zhang, Luyuan, et al.
Published: (2026)
by: Zhang, Luyuan, et al.
Published: (2026)
unMORE: Unsupervised Multi-Object Segmentation via Center-Boundary Reasoning
by: Yang, Yafei, et al.
Published: (2025)
by: Yang, Yafei, et al.
Published: (2025)
Why Reasoning Models Collapse Themselves in Reasoning
by: Zixi, Li
Published: (2025)
by: Zixi, Li
Published: (2025)
MR. Judge: Multimodal Reasoner as a Judge
by: Pi, Renjie, et al.
Published: (2025)
by: Pi, Renjie, et al.
Published: (2025)
LLM-based Multi-Agent Systems: Techniques and Business Perspectives
by: Yang, Yingxuan, et al.
Published: (2024)
by: Yang, Yingxuan, et al.
Published: (2024)
Soybean‐Derived Exosome‐Like Nanovesicles Regulate Lipid Metabolism via Mitochondrial Biogenesis and UCP1/PGC‐1 α Mediated Thermogenesis
by: Zhenzhu Zhu, et al.
Published: (2026)
by: Zhenzhu Zhu, et al.
Published: (2026)
Learning When to Look: A Disentangled Curriculum for Strategic Perception in Multimodal Reasoning
by: Yang, Siqi, et al.
Published: (2025)
by: Yang, Siqi, et al.
Published: (2025)
Reasoning as State Transition: A Representational Analysis of Reasoning Evolution in Large Language Models
by: Zhang, Siyuan, et al.
Published: (2026)
by: Zhang, Siyuan, et al.
Published: (2026)
JudgeBoard: Benchmarking and Enhancing Small Language Models for Reasoning Evaluation
by: Bi, Zhenyu, et al.
Published: (2025)
by: Bi, Zhenyu, et al.
Published: (2025)
VDC-Agent: When Video Detailed Captioners Evolve Themselves via Agentic Self-Reflection
by: Wang, Qiang, et al.
Published: (2025)
by: Wang, Qiang, et al.
Published: (2025)
UDA: Unsupervised Debiasing Alignment for Pair-wise LLM-as-a-Judge
by: Zhang, Yang, et al.
Published: (2025)
by: Zhang, Yang, et al.
Published: (2025)
Resource-Limited Joint Multimodal Sentiment Reasoning and Classification via Chain-of-Thought Enhancement and Distillation
by: Shangguan, Haonan, et al.
Published: (2025)
by: Shangguan, Haonan, et al.
Published: (2025)
Optimization Techniques for Unsupervised Complex Table Reasoning via Self-Training Framework
by: Li, Zhenyu, et al.
Published: (2022)
by: Li, Zhenyu, et al.
Published: (2022)
MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM
by: Dong, Bowen, et al.
Published: (2025)
by: Dong, Bowen, et al.
Published: (2025)
Target-Balanced Score Distillation
by: Xu, Zhou, et al.
Published: (2025)
by: Xu, Zhou, et al.
Published: (2025)
Similar Items
-
Language-Guided and Motion-Aware Gait Representation for Generalizable Recognition
by: Wu, Zhengxian, et al.
Published: (2026) -
DAGait: Generalized Skeleton-Guided Data Alignment for Gait Recognition
by: Wu, Zhengxian, et al.
Published: (2025) -
Stabilizing Unsupervised Self-Evolution of MLLMs via Continuous Softened Retracing reSampling
by: Yu, Yunyao, et al.
Published: (2026) -
DaMo: Data Mixing Optimizer in Fine-tuning Multimodal LLMs for Mobile Phone Agents
by: Shi, Kai, et al.
Published: (2025) -
R3G: A Reasoning--Retrieval--Reranking Framework for Vision-Centric Answer Generation
by: Chen, Zhuohong, et al.
Published: (2026)