DIO: Refining Mutual Information and Causal Chain to Enhance Machine Abstract Reasoning Ability
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Song, Ruizhuo, Yuan, Beiming |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Triple-CFN: Separating Concepts and Features Enhances Machine Abstract Reasoning Ability
par: Song, Ruizhuo, et autres
Publié: (2024)
par: Song, Ruizhuo, et autres
Publié: (2024)
Funny-Valen-Tine: Planning Solution Distribution Enhances Machine Abstract Reasoning Ability
par: Song, Ruizhuo, et autres
Publié: (2024)
par: Song, Ruizhuo, et autres
Publié: (2024)
Johnny: Structuring Representation Space to Enhance Machine Abstract Reasoning Ability
par: Song, Ruizhuo, et autres
Publié: (2025)
par: Song, Ruizhuo, et autres
Publié: (2025)
D4C: Improving Negative Example Quality to Enhance Machine Abstract Reasoning Ability
par: Song, Ruizhuo, et autres
Publié: (2024)
par: Song, Ruizhuo, et autres
Publié: (2024)
Solving the Clustering Reasoning Problems by Modeling a Deep-Learning-Based Probabilistic Model
par: Song, Ruizhuo, et autres
Publié: (2024)
par: Song, Ruizhuo, et autres
Publié: (2024)
EiHi Net: Out-of-Distribution Generalization Paradigm
par: Wei, Qinglai, et autres
Publié: (2022)
par: Wei, Qinglai, et autres
Publié: (2022)
VLM-R$^3$: Region Recognition, Reasoning, and Refinement for Enhanced Multimodal Chain-of-Thought
par: Jiang, Chaoya, et autres
Publié: (2025)
par: Jiang, Chaoya, et autres
Publié: (2025)
Multi-Granularity Mutual Refinement Network for Zero-Shot Learning
par: Wang, Ning, et autres
Publié: (2025)
par: Wang, Ning, et autres
Publié: (2025)
CoT-Pose: Chain-of-Thought Reasoning for 3D Pose Generation from Abstract Prompts
par: Cha, Junuk, et autres
Publié: (2025)
par: Cha, Junuk, et autres
Publié: (2025)
VISTA: Enhancing Vision-Text Alignment in MLLMs via Cross-Modal Mutual Information Maximization
par: Li, Mingxiao, et autres
Publié: (2025)
par: Li, Mingxiao, et autres
Publié: (2025)
DIO: Dataset of 3D Mesh Models of Indoor Objects for Robotics and Computer Vision Applications
par: Nimal, Nillan, et autres
Publié: (2024)
par: Nimal, Nillan, et autres
Publié: (2024)
CoT-Segmenter: Enhancing OOD Detection in Dense Road Scenes via Chain-of-Thought Reasoning
par: Song, Jeonghyo, et autres
Publié: (2025)
par: Song, Jeonghyo, et autres
Publié: (2025)
MIGE: Mutually Enhanced Multimodal Instruction-Based Image Generation and Editing
par: Tian, Xueyun, et autres
Publié: (2025)
par: Tian, Xueyun, et autres
Publié: (2025)
CLGRPO: Reasoning Ability Enhancement for Small VLMs
par: Wang, Fanyi, et autres
Publié: (2025)
par: Wang, Fanyi, et autres
Publié: (2025)
Enhancing Advanced Visual Reasoning Ability of Large Language Models
par: Li, Zhiyuan, et autres
Publié: (2024)
par: Li, Zhiyuan, et autres
Publié: (2024)
Skeleton2vec: A Self-supervised Learning Framework with Contextualized Target Representations for Skeleton Sequence
par: Xu, Ruizhuo, et autres
Publié: (2024)
par: Xu, Ruizhuo, et autres
Publié: (2024)
CausalSpatial: A Benchmark for Object-Centric Causal Spatial Reasoning
par: Ma, Wenxin, et autres
Publié: (2026)
par: Ma, Wenxin, et autres
Publié: (2026)
MIGA: Mutual Information-Guided Attack on Denoising Models for Semantic Manipulation
par: Li, Guanghao, et autres
Publié: (2025)
par: Li, Guanghao, et autres
Publié: (2025)
Enhancing the Reasoning Ability of Multimodal Large Language Models via Mixed Preference Optimization
par: Wang, Weiyun, et autres
Publié: (2024)
par: Wang, Weiyun, et autres
Publié: (2024)
CaST-Bench: Benchmarking Causal Chain-Grounded Spatio-Temporal Reasoning for Video Question Answering
par: Zhang, Mingfang, et autres
Publié: (2026)
par: Zhang, Mingfang, et autres
Publié: (2026)
MutualNeRF: Improve the Performance of NeRF under Limited Samples with Mutual Information Theory
par: Wang, Zifan, et autres
Publié: (2025)
par: Wang, Zifan, et autres
Publié: (2025)
Mutual Information Guided Optimal Transport for Unsupervised Visible-Infrared Person Re-identification
par: Zhang, Zhizhong, et autres
Publié: (2024)
par: Zhang, Zhizhong, et autres
Publié: (2024)
Geospatial Chain of Thought Reasoning for Enhanced Visual Question Answering on Satellite Imagery
par: Shanker, Shambhavi, et autres
Publié: (2025)
par: Shanker, Shambhavi, et autres
Publié: (2025)
OrderChain: Towards General Instruct-Tuning for Stimulating the Ordinal Understanding Ability of MLLM
par: Wang, Jinhong, et autres
Publié: (2025)
par: Wang, Jinhong, et autres
Publié: (2025)
Enhancing 3D Semantic Scene Completion with a Refinement Module
par: Zhang, Dunxing, et autres
Publié: (2025)
par: Zhang, Dunxing, et autres
Publié: (2025)
Improving Visual Reasoning with Iterative Evidence Refinement
par: Shi, Zeru, et autres
Publié: (2026)
par: Shi, Zeru, et autres
Publié: (2026)
Camera-Based Localization and Enhanced Normalized Mutual Information
par: Kunde, Vishnu Teja, et autres
Publié: (2024)
par: Kunde, Vishnu Teja, et autres
Publié: (2024)
Revisiting Mutual Information Maximization for Generalized Category Discovery
par: Tan, Zhaorui, et autres
Publié: (2024)
par: Tan, Zhaorui, et autres
Publié: (2024)
TIMA: Text-Image Mutual Awareness for Balancing Zero-Shot Adversarial Robustness and Generalization Ability
par: Ma, Fengji, et autres
Publié: (2024)
par: Ma, Fengji, et autres
Publié: (2024)
Adaptive Chain-of-Focus Reasoning via Dynamic Visual Search and Zooming for Efficient VLMs
par: Zhang, Xintong, et autres
Publié: (2025)
par: Zhang, Xintong, et autres
Publié: (2025)
OmniRefiner: Reinforcement-Guided Local Diffusion Refinement
par: Liu, Yaoli, et autres
Publié: (2025)
par: Liu, Yaoli, et autres
Publié: (2025)
MI CAM: Mutual Information Weighted Activation Mapping for Causal Visual Explanations of Convolutional Neural Networks
par: Iyer, Ram S, et autres
Publié: (2025)
par: Iyer, Ram S, et autres
Publié: (2025)
VisualQuest: A Benchmark for Abstract Visual Reasoning in MLLMs
par: Xiao, Kelaiti, et autres
Publié: (2025)
par: Xiao, Kelaiti, et autres
Publié: (2025)
A Multi-Agent Framework with Structured Reasoning and Reflective Refinement for Multimodal Empathetic Response Generation
par: Wang, Liping, et autres
Publié: (2026)
par: Wang, Liping, et autres
Publié: (2026)
Mutually Causal Semantic Distillation Network for Zero-Shot Learning
par: Chen, Shiming, et autres
Publié: (2026)
par: Chen, Shiming, et autres
Publié: (2026)
Generating Storytelling Images with Rich Chains-of-Reasoning
par: Song, Xiujie, et autres
Publié: (2025)
par: Song, Xiujie, et autres
Publié: (2025)
ImageGen-CoT: Enhancing Text-to-Image In-context Learning with Chain-of-Thought Reasoning
par: Liao, Jiaqi, et autres
Publié: (2025)
par: Liao, Jiaqi, et autres
Publié: (2025)
Corvid: Improving Multimodal Large Language Models Towards Chain-of-Thought Reasoning
par: Jiang, Jingjing, et autres
Publié: (2025)
par: Jiang, Jingjing, et autres
Publié: (2025)
VG-Refiner: Towards Tool-Refined Referring Grounded Reasoning via Agentic Reinforcement Learning
par: Wang, Yuji, et autres
Publié: (2025)
par: Wang, Yuji, et autres
Publié: (2025)
$A^2R^2$: Advancing Img2LaTeX Conversion via Visual Reasoning with Attention-Guided Refinement
par: Li, Zhecheng, et autres
Publié: (2025)
par: Li, Zhecheng, et autres
Publié: (2025)
Documents similaires
-
Triple-CFN: Separating Concepts and Features Enhances Machine Abstract Reasoning Ability
par: Song, Ruizhuo, et autres
Publié: (2024) -
Funny-Valen-Tine: Planning Solution Distribution Enhances Machine Abstract Reasoning Ability
par: Song, Ruizhuo, et autres
Publié: (2024) -
Johnny: Structuring Representation Space to Enhance Machine Abstract Reasoning Ability
par: Song, Ruizhuo, et autres
Publié: (2025) -
D4C: Improving Negative Example Quality to Enhance Machine Abstract Reasoning Ability
par: Song, Ruizhuo, et autres
Publié: (2024) -
Solving the Clustering Reasoning Problems by Modeling a Deep-Learning-Based Probabilistic Model
par: Song, Ruizhuo, et autres
Publié: (2024)