Aligning Vision to Language: Annotation-Free Multimodal Knowledge Graph Construction for Enhanced LLMs Reasoning
Fuente:
arXiv
Guardado en:
| Autores principales: | Liu, Junming, Meng, Siyuan, Gao, Yanting, Mao, Song, Cai, Pinlong, Yan, Guohang, Chen, Yirong, Bian, Zilin, Wang, Ding, Shi, Botian |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
From Ranking to Selection: A Simple but Efficient Dynamic Passage Selector for Retrieval Augmented Generation
por: Meng, Siyuan, et al.
Publicado: (2025)
por: Meng, Siyuan, et al.
Publicado: (2025)
DeepWriter: A Fact-Grounded Multimodal Writing Assistant Based On Offline Knowledge Base
por: Mao, Song, et al.
Publicado: (2025)
por: Mao, Song, et al.
Publicado: (2025)
RAKG:Document-level Retrieval Augmented Knowledge Graph Construction
por: Zhang, Hairong, et al.
Publicado: (2025)
por: Zhang, Hairong, et al.
Publicado: (2025)
LeanRAG: Knowledge-Graph-Based Generation with Semantic Aggregation and Hierarchical Retrieval
por: Zhang, Yaoze, et al.
Publicado: (2025)
por: Zhang, Yaoze, et al.
Publicado: (2025)
Investigating Redundancy in Multimodal Large Language Models with Multiple Vision Encoders
por: Wang, Yizhou, et al.
Publicado: (2025)
por: Wang, Yizhou, et al.
Publicado: (2025)
HetaRAG: Hybrid Deep Retrieval-Augmented Generation across Heterogeneous Data Stores
por: Yan, Guohang, et al.
Publicado: (2025)
por: Yan, Guohang, et al.
Publicado: (2025)
LimSim++: A Closed-Loop Platform for Deploying Multimodal LLMs in Autonomous Driving
por: Fu, Daocheng, et al.
Publicado: (2024)
por: Fu, Daocheng, et al.
Publicado: (2024)
Mosaic: Data-Free Knowledge Distillation via Mixture-of-Experts for Heterogeneous Distributed Environments
por: Liu, Junming, et al.
Publicado: (2025)
por: Liu, Junming, et al.
Publicado: (2025)
KG-TRACES: Enhancing Large Language Models with Knowledge Graph-constrained Trajectory Reasoning and Attribution Supervision
por: Wu, Rong, et al.
Publicado: (2025)
por: Wu, Rong, et al.
Publicado: (2025)
TrafficMCTS: A Closed-Loop Traffic Flow Generation Framework with Group-Based Monte Carlo Tree Search
por: Fu, Ze, et al.
Publicado: (2023)
por: Fu, Ze, et al.
Publicado: (2023)
MemVerse: Multimodal Memory for Lifelong Learning Agents
por: Liu, Junming, et al.
Publicado: (2025)
por: Liu, Junming, et al.
Publicado: (2025)
MGA: Memory-Driven GUI Agent for Observation-Centric Interaction
por: Cheng, Weihua, et al.
Publicado: (2025)
por: Cheng, Weihua, et al.
Publicado: (2025)
TimeMKG: Knowledge-Infused Causal Reasoning for Multivariate Time Series Modeling
por: Sun, Yifei, et al.
Publicado: (2025)
por: Sun, Yifei, et al.
Publicado: (2025)
LimSim Series: An Autonomous Driving Simulation Platform for Validation and Enhancement
por: Fu, Daocheng, et al.
Publicado: (2025)
por: Fu, Daocheng, et al.
Publicado: (2025)
GDI-Bench: A Benchmark for General Document Intelligence with Vision and Reasoning Decoupling
por: Li, Siqi, et al.
Publicado: (2025)
por: Li, Siqi, et al.
Publicado: (2025)
Self-Evolving Spatial Reasoning in Vision Language Models via Geometric Logic Consistency
por: Liu, Junming, et al.
Publicado: (2026)
por: Liu, Junming, et al.
Publicado: (2026)
DiLu: A Knowledge-Driven Approach to Autonomous Driving with Large Language Models
por: Wen, Licheng, et al.
Publicado: (2023)
por: Wen, Licheng, et al.
Publicado: (2023)
Can We Trust LLMs? Mitigate Overconfidence Bias in LLMs through Knowledge Transfer
por: Yang, Haoyan, et al.
Publicado: (2024)
por: Yang, Haoyan, et al.
Publicado: (2024)
FedRecon: Missing Modality Reconstruction in Heterogeneous Distributed Environments
por: Liu, Junming, et al.
Publicado: (2025)
por: Liu, Junming, et al.
Publicado: (2025)
UR-Bench: A Benchmark for Multi-Hop Reasoning over Ultra-High-Resolution Images
por: Li, Siqi, et al.
Publicado: (2025)
por: Li, Siqi, et al.
Publicado: (2025)
RADAR: Reasoning as Discrimination with Aligned Representations for LLM-based Knowledge Graph Reasoning
por: Xue, Bo, et al.
Publicado: (2026)
por: Xue, Bo, et al.
Publicado: (2026)
Reason-Align-Respond: Aligning LLM Reasoning with Knowledge Graphs for KGQA
por: Shen, Xiangqing, et al.
Publicado: (2025)
por: Shen, Xiangqing, et al.
Publicado: (2025)
SymDrive: Realistic and Controllable Driving Simulator via Symmetric Auto-regressive Online Restoration
por: Liu, Zhiyuan, et al.
Publicado: (2025)
por: Liu, Zhiyuan, et al.
Publicado: (2025)
LLMs for Knowledge Graph Construction and Reasoning: Recent Capabilities and Future Opportunities
por: Zhu, Yuqi, et al.
Publicado: (2023)
por: Zhu, Yuqi, et al.
Publicado: (2023)
Fine-tuning Pre-trained Vision-Language Models in a Human-Annotation-Free Manner
por: Wang, Qian-Wei, et al.
Publicado: (2026)
por: Wang, Qian-Wei, et al.
Publicado: (2026)
MELLA: Bridging Linguistic Capability and Cultural Groundedness for Low-Resource Language MLLMs
por: Gao, Yufei, et al.
Publicado: (2025)
por: Gao, Yufei, et al.
Publicado: (2025)
Vision Enhancing LLMs: Empowering Multimodal Knowledge Storage and Sharing in LLMs
por: Li, Yunxin, et al.
Publicado: (2023)
por: Li, Yunxin, et al.
Publicado: (2023)
Scene-Driven Multimodal Knowledge Graph Construction for Embodied AI
por: Yaoxian, Song, et al.
Publicado: (2023)
por: Yaoxian, Song, et al.
Publicado: (2023)
The Agent's First Day: Benchmarking Learning, Exploration, and Scheduling in the Workplace Scenarios
por: Fu, Daocheng, et al.
Publicado: (2026)
por: Fu, Daocheng, et al.
Publicado: (2026)
Knowledge Graph for Intelligent Generation of Artistic Image Creation: Constructing a New Annotation Hierarchy
por: Kaixin, Jia, et al.
Publicado: (2025)
por: Kaixin, Jia, et al.
Publicado: (2025)
HM-RAG: Hierarchical Multi-Agent Multimodal Retrieval Augmented Generation
por: Liu, Pei, et al.
Publicado: (2025)
por: Liu, Pei, et al.
Publicado: (2025)
Multimodal Reasoning with Multimodal Knowledge Graph
por: Lee, Junlin, et al.
Publicado: (2024)
por: Lee, Junlin, et al.
Publicado: (2024)
A Survey of Knowledge Graph Reasoning on Graph Types: Static, Dynamic, and Multimodal
por: Liang, Ke, et al.
Publicado: (2022)
por: Liang, Ke, et al.
Publicado: (2022)
Continual Multimodal Knowledge Graph Construction
por: Chen, Xiang, et al.
Publicado: (2023)
por: Chen, Xiang, et al.
Publicado: (2023)
MemCoT: Test-Time Scaling through Memory-Driven Chain-of-Thought
por: Lei, Haodong, et al.
Publicado: (2026)
por: Lei, Haodong, et al.
Publicado: (2026)
CodeGraph: Enhancing Graph Reasoning of LLMs with Code
por: Cai, Qiaolong, et al.
Publicado: (2024)
por: Cai, Qiaolong, et al.
Publicado: (2024)
SceneAlign: Aligning Multimodal Reasoning to Scene Graphs in Complex Visual Scenes
por: Wang, Chuhan, et al.
Publicado: (2026)
por: Wang, Chuhan, et al.
Publicado: (2026)
Encoder-Free Knowledge-Graph Reasoning with LLMs via Hyperdimensional Path Retrieval
por: Liu, Yezi, et al.
Publicado: (2025)
por: Liu, Yezi, et al.
Publicado: (2025)
OASim: an Open and Adaptive Simulator based on Neural Rendering for Autonomous Driving
por: Yan, Guohang, et al.
Publicado: (2024)
por: Yan, Guohang, et al.
Publicado: (2024)
Construct, Align, and Reason: Large Ontology Models for Enterprise Knowledge Management
por: Zhang, Yao, et al.
Publicado: (2026)
por: Zhang, Yao, et al.
Publicado: (2026)
Ejemplares similares
-
From Ranking to Selection: A Simple but Efficient Dynamic Passage Selector for Retrieval Augmented Generation
por: Meng, Siyuan, et al.
Publicado: (2025) -
DeepWriter: A Fact-Grounded Multimodal Writing Assistant Based On Offline Knowledge Base
por: Mao, Song, et al.
Publicado: (2025) -
RAKG:Document-level Retrieval Augmented Knowledge Graph Construction
por: Zhang, Hairong, et al.
Publicado: (2025) -
LeanRAG: Knowledge-Graph-Based Generation with Semantic Aggregation and Hierarchical Retrieval
por: Zhang, Yaoze, et al.
Publicado: (2025) -
Investigating Redundancy in Multimodal Large Language Models with Multiple Vision Encoders
por: Wang, Yizhou, et al.
Publicado: (2025)