UKnow: A Unified Knowledge Protocol with Multimodal Knowledge Graph Datasets for Reasoning and Vision-Language Pre-Training
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Gong, Biao, Tan, Shuai, Feng, Yutong, Xie, Xiaoying, Li, Yuyuan, Chen, Chaochao, Zheng, Kecheng, Shen, Yujun, Zhao, Deli |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Mimir: Improving Video Diffusion Models for Precise Text Understanding
par: Tan, Shuai, et autres
Publié: (2024)
par: Tan, Shuai, et autres
Publié: (2024)
PhysRVG: Physics-Aware Unified Reinforcement Learning for Video Generative Models
par: Zhang, Qiyuan, et autres
Publié: (2026)
par: Zhang, Qiyuan, et autres
Publié: (2026)
Check, Locate, Rectify: A Training-Free Layout Calibration System for Text-to-Image Generation
par: Gong, Biao, et autres
Publié: (2023)
par: Gong, Biao, et autres
Publié: (2023)
MedCutMix: A Data-Centric Approach to Improve Radiology Vision-Language Pre-training with Disease Awareness
par: Wang, Sinuo, et autres
Publié: (2025)
par: Wang, Sinuo, et autres
Publié: (2025)
CoDance: An Unbind-Rebind Paradigm for Robust Multi-Subject Animation
par: Tan, Shuai, et autres
Publié: (2026)
par: Tan, Shuai, et autres
Publié: (2026)
Towards Unified Neurosymbolic Reasoning on Knowledge Graphs
par: Lin, Qika, et autres
Publié: (2025)
par: Lin, Qika, et autres
Publié: (2025)
Are Transformers Able to Reason by Connecting Separated Knowledge in Training Data?
par: Yin, Yutong, et autres
Publié: (2025)
par: Yin, Yutong, et autres
Publié: (2025)
Multimodal Reasoning with Multimodal Knowledge Graph
par: Lee, Junlin, et autres
Publié: (2024)
par: Lee, Junlin, et autres
Publié: (2024)
Benchmarking Large Vision-Language Models via Directed Scene Graph for Comprehensive Image Captioning
par: Lu, Fan, et autres
Publié: (2024)
par: Lu, Fan, et autres
Publié: (2024)
Knowledge Reasoning Language Model: Unifying Knowledge and Language for Inductive Knowledge Graph Reasoning
par: Zhuo, Xingrui, et autres
Publié: (2025)
par: Zhuo, Xingrui, et autres
Publié: (2025)
Ranni: Taming Text-to-Image Diffusion for Accurate Instruction Following
par: Feng, Yutong, et autres
Publié: (2023)
par: Feng, Yutong, et autres
Publié: (2023)
Unifying Invariant and Variant Knowledge With Dual‐Hypergraph Contrastive Evolution for Temporal Knowledge Graph Reasoning
par: Fei Chen, et autres
Publié: (2026)
par: Fei Chen, et autres
Publié: (2026)
mmRAG: A Modular Benchmark for Retrieval-Augmented Generation over Text, Tables, and Knowledge Graphs
par: Xu, Chuan, et autres
Publié: (2025)
par: Xu, Chuan, et autres
Publié: (2025)
Contextual AD Narration with Interleaved Multimodal Sequence
par: Wang, Hanlin, et autres
Publié: (2024)
par: Wang, Hanlin, et autres
Publié: (2024)
Scanning Only Once: An End-to-end Framework for Fast Temporal Grounding in Long Videos
par: Pan, Yulin, et autres
Publié: (2023)
par: Pan, Yulin, et autres
Publié: (2023)
Accelerating Pre-training of Multimodal LLMs via Chain-of-Sight
par: Huang, Ziyuan, et autres
Publié: (2024)
par: Huang, Ziyuan, et autres
Publié: (2024)
TOFA: Training-Free One-Shot Federated Adaptation for Vision-Language Models
par: Zhang, Li, et autres
Publié: (2025)
par: Zhang, Li, et autres
Publié: (2025)
A Survey on Recommendation Unlearning: Fundamentals, Taxonomy, Evaluation, and Open Questions
par: Li, Yuyuan, et autres
Publié: (2024)
par: Li, Yuyuan, et autres
Publié: (2024)
SynMotion: Semantic-Visual Adaptation for Motion Customized Video Generation
par: Tan, Shuai, et autres
Publié: (2025)
par: Tan, Shuai, et autres
Publié: (2025)
MMKG-RDS: Reasoning Data Synthesis via Deep Mining of Multimodal Knowledge Graphs
par: Zhan, Lun, et autres
Publié: (2026)
par: Zhan, Lun, et autres
Publié: (2026)
Inductive Reasoning for Temporal Knowledge Graphs with Emerging Entities
par: Zhao, Ze, et autres
Publié: (2026)
par: Zhao, Ze, et autres
Publié: (2026)
G-reasoner: Foundation Models for Unified Reasoning over Graph-structured Knowledge
par: Luo, Linhao, et autres
Publié: (2025)
par: Luo, Linhao, et autres
Publié: (2025)
CHAINSFORMER: Numerical Reasoning on Knowledge Graphs from a Chain Perspective
par: Zhao, Ze, et autres
Publié: (2025)
par: Zhao, Ze, et autres
Publié: (2025)
VAT-KG: Knowledge-Intensive Multimodal Knowledge Graph Dataset for Retrieval-Augmented Generation
par: Park, Hyeongcheol, et autres
Publié: (2025)
par: Park, Hyeongcheol, et autres
Publié: (2025)
Aligning Vision to Language: Annotation-Free Multimodal Knowledge Graph Construction for Enhanced LLMs Reasoning
par: Liu, Junming, et autres
Publié: (2025)
par: Liu, Junming, et autres
Publié: (2025)
KG-Reasoner: A Reinforced Model for End-to-End Multi-Hop Knowledge Graph Reasoning
par: Wang, Shuai, et autres
Publié: (2026)
par: Wang, Shuai, et autres
Publié: (2026)
Unifying Segment Anything in Microscopy with Vision-Language Knowledge
par: Li, Manyu, et autres
Publié: (2025)
par: Li, Manyu, et autres
Publié: (2025)
Token Transforming: A Unified and Training-Free Token Compression Framework for Vision Transformer Acceleration
par: Zeng, Fanhu, et autres
Publié: (2025)
par: Zeng, Fanhu, et autres
Publié: (2025)
DynaGen: Unifying Temporal Knowledge Graph Reasoning with Dynamic Subgraphs and Generative Regularization
par: Shen, Jiawei, et autres
Publié: (2025)
par: Shen, Jiawei, et autres
Publié: (2025)
Topology-Aware Reasoning over Incomplete Knowledge Graph with Graph-Based Soft Prompting
par: Wang, Shuai, et autres
Publié: (2026)
par: Wang, Shuai, et autres
Publié: (2026)
Framer: Interactive Frame Interpolation
par: Wang, Wen, et autres
Publié: (2024)
par: Wang, Wen, et autres
Publié: (2024)
Graph-constrained Reasoning: Faithful Reasoning on Knowledge Graphs with Large Language Models
par: Luo, Linhao, et autres
Publié: (2024)
par: Luo, Linhao, et autres
Publié: (2024)
CURE4Rec: A Benchmark for Recommendation Unlearning with Deeper Influence
par: Chen, Chaochao, et autres
Publié: (2024)
par: Chen, Chaochao, et autres
Publié: (2024)
A Unified Framework for Knowledge Transfer in Bidirectional Model Scaling
par: Shen, Jianlu, et autres
Publié: (2026)
par: Shen, Jianlu, et autres
Publié: (2026)
Dark Side of Modalities: Reinforced Multimodal Distillation for Multimodal Knowledge Graph Reasoning
par: Zhao, Yu, et autres
Publié: (2025)
par: Zhao, Yu, et autres
Publié: (2025)
Unifying Deductive and Abductive Reasoning in Knowledge Graphs with Masked Diffusion Model
par: Gao, Yisen, et autres
Publié: (2025)
par: Gao, Yisen, et autres
Publié: (2025)
Reason-Align-Respond: Aligning LLM Reasoning with Knowledge Graphs for KGQA
par: Shen, Xiangqing, et autres
Publié: (2025)
par: Shen, Xiangqing, et autres
Publié: (2025)
MotionStone: Decoupled Motion Intensity Modulation with Diffusion Transformer for Image-to-Video Generation
par: Shi, Shuwei, et autres
Publié: (2024)
par: Shi, Shuwei, et autres
Publié: (2024)
A Survey of Knowledge Graph Reasoning on Graph Types: Static, Dynamic, and Multimodal
par: Liang, Ke, et autres
Publié: (2022)
par: Liang, Ke, et autres
Publié: (2022)
Beyond Binary Edits Robust Multimodal Knowledge Editing with Adversarial Subspace Alignment
par: Wang, Haoyuan, et autres
Publié: (2026)
par: Wang, Haoyuan, et autres
Publié: (2026)
Documents similaires
-
Mimir: Improving Video Diffusion Models for Precise Text Understanding
par: Tan, Shuai, et autres
Publié: (2024) -
PhysRVG: Physics-Aware Unified Reinforcement Learning for Video Generative Models
par: Zhang, Qiyuan, et autres
Publié: (2026) -
Check, Locate, Rectify: A Training-Free Layout Calibration System for Text-to-Image Generation
par: Gong, Biao, et autres
Publié: (2023) -
MedCutMix: A Data-Centric Approach to Improve Radiology Vision-Language Pre-training with Disease Awareness
par: Wang, Sinuo, et autres
Publié: (2025) -
CoDance: An Unbind-Rebind Paradigm for Robust Multi-Subject Animation
par: Tan, Shuai, et autres
Publié: (2026)