Multi-Dimensional Knowledge Profiling with Large-Scale Literature Database and Hierarchical Retrieval
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Xue, Zhucun, Zhang, Jiangning, Jiang, Juntao, Liu, Jinzhuo, He, Haoyang, Hu, Teng, Hu, Xiaobin, Liu, Yong, Yan, Shuicheng |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
RWKV-UNet: Improving UNet with Long-Range Cooperation for Effective Medical Image Segmentation
von: Jiang, Juntao, et al.
Veröffentlicht: (2025)
von: Jiang, Juntao, et al.
Veröffentlicht: (2025)
M3CoTBench: Benchmark Chain-of-Thought of MLLMs in Medical Image Understanding
von: Jiang, Juntao, et al.
Veröffentlicht: (2026)
von: Jiang, Juntao, et al.
Veröffentlicht: (2026)
IVEBench: Modern Benchmark Suite for Instruction-Guided Video Editing Assessment
von: Chen, Yinan, et al.
Veröffentlicht: (2025)
von: Chen, Yinan, et al.
Veröffentlicht: (2025)
Evolution of Optimization Methods: Algorithms, Scenarios, and Evaluations
von: Zhang, Tong, et al.
Veröffentlicht: (2026)
von: Zhang, Tong, et al.
Veröffentlicht: (2026)
SPIKE: An Adaptive Dual Controller Framework for Cost-Efficient Long-Horizon Game Agents
von: Jiang, Wencan, et al.
Veröffentlicht: (2026)
von: Jiang, Wencan, et al.
Veröffentlicht: (2026)
UniICL: Systematizing Unified Multimodal In-context Learning through a Capability-Oriented Taxonomy
von: Xu, Yicheng, et al.
Veröffentlicht: (2026)
von: Xu, Yicheng, et al.
Veröffentlicht: (2026)
LLM-Oriented Token-Adaptive Knowledge Distillation
von: Xie, Xurong, et al.
Veröffentlicht: (2025)
von: Xie, Xurong, et al.
Veröffentlicht: (2025)
Advancing Narrative Long Video Generation via Training-Free Identity-Aware Memory
von: Liu, Jinzhuo, et al.
Veröffentlicht: (2026)
von: Liu, Jinzhuo, et al.
Veröffentlicht: (2026)
Image Inversion: A Survey from GANs to Diffusion and Beyond
von: Chen, Yinan, et al.
Veröffentlicht: (2025)
von: Chen, Yinan, et al.
Veröffentlicht: (2025)
Visual Multi-Agent System: Mitigating Hallucination Snowballing via Visual Flow
von: Yu, Xinlei, et al.
Veröffentlicht: (2025)
von: Yu, Xinlei, et al.
Veröffentlicht: (2025)
EMOv2: Pushing 5M Vision Model Frontier
von: Zhang, Jiangning, et al.
Veröffentlicht: (2024)
von: Zhang, Jiangning, et al.
Veröffentlicht: (2024)
UltraLBM-UNet: Ultralight Bidirectional Mamba-based Model for Skin Lesion Segmentation
von: Fan, Linxuan, et al.
Veröffentlicht: (2025)
von: Fan, Linxuan, et al.
Veröffentlicht: (2025)
Boosting Reasoning in Large Multimodal Models via Activation Replay
von: Xing, Yun, et al.
Veröffentlicht: (2025)
von: Xing, Yun, et al.
Veröffentlicht: (2025)
OpenVE-3M: A Large-Scale High-Quality Dataset for Instruction-Guided Video Editing
von: He, Haoyang, et al.
Veröffentlicht: (2025)
von: He, Haoyang, et al.
Veröffentlicht: (2025)
InstanceV: Instance-Level Video Generation
von: Chen, Yuheng, et al.
Veröffentlicht: (2025)
von: Chen, Yuheng, et al.
Veröffentlicht: (2025)
UltraVideo: High-Quality UHD Video Dataset with Comprehensive Captions
von: Xue, Zhucun, et al.
Veröffentlicht: (2025)
von: Xue, Zhucun, et al.
Veröffentlicht: (2025)
GPT-4V-AD: Exploring Grounding Potential of VQA-oriented GPT-4V for Zero-shot Anomaly Detection
von: Zhang, Jiangning, et al.
Veröffentlicht: (2023)
von: Zhang, Jiangning, et al.
Veröffentlicht: (2023)
LLaVA-KD: A Framework of Distilling Multimodal Large Language Models
von: Cai, Yuxuan, et al.
Veröffentlicht: (2024)
von: Cai, Yuxuan, et al.
Veröffentlicht: (2024)
A Comprehensive Library for Benchmarking Multi-class Visual Anomaly Detection
von: Zhang, Jiangning, et al.
Veröffentlicht: (2024)
von: Zhang, Jiangning, et al.
Veröffentlicht: (2024)
AdaVideoRAG: Omni-Contextual Adaptive Retrieval-Augmented Efficient Long Video Understanding
von: Xue, Zhucun, et al.
Veröffentlicht: (2025)
von: Xue, Zhucun, et al.
Veröffentlicht: (2025)
Transform Trained Transformer: Accelerating Naive 4K Video Generation Over 10$\times$
von: Zhang, Jiangning, et al.
Veröffentlicht: (2025)
von: Zhang, Jiangning, et al.
Veröffentlicht: (2025)
Visual Document Understanding and Reasoning: A Multi-Agent Collaboration Framework with Agent-Wise Adaptive Test-Time Scaling
von: Yu, Xinlei, et al.
Veröffentlicht: (2025)
von: Yu, Xinlei, et al.
Veröffentlicht: (2025)
TokenAR: Multiple Subject Generation via Autoregressive Token-level enhancement
von: Sun, Haiyue, et al.
Veröffentlicht: (2025)
von: Sun, Haiyue, et al.
Veröffentlicht: (2025)
Dual Latent Memory for Visual Multi-agent System
von: Yu, Xinlei, et al.
Veröffentlicht: (2026)
von: Yu, Xinlei, et al.
Veröffentlicht: (2026)
Improving Autoregressive Visual Generation with Cluster-Oriented Token Prediction
von: Hu, Teng, et al.
Veröffentlicht: (2025)
von: Hu, Teng, et al.
Veröffentlicht: (2025)
Learning Feature Inversion for Multi-class Anomaly Detection under General-purpose COCO-AD Benchmark
von: Zhang, Jiangning, et al.
Veröffentlicht: (2024)
von: Zhang, Jiangning, et al.
Veröffentlicht: (2024)
UltraGen: High-Resolution Video Generation with Hierarchical Attention
von: Hu, Teng, et al.
Veröffentlicht: (2025)
von: Hu, Teng, et al.
Veröffentlicht: (2025)
TIMotion: Temporal and Interactive Framework for Efficient Human-Human Motion Generation
von: Wang, Yabiao, et al.
Veröffentlicht: (2024)
von: Wang, Yabiao, et al.
Veröffentlicht: (2024)
PointSeg: A Training-Free Paradigm for 3D Scene Segmentation via Foundation Models
von: He, Qingdong, et al.
Veröffentlicht: (2024)
von: He, Qingdong, et al.
Veröffentlicht: (2024)
Disco-RAG: Discourse-Aware Retrieval-Augmented Generation
von: Liu, Dongqi, et al.
Veröffentlicht: (2026)
von: Liu, Dongqi, et al.
Veröffentlicht: (2026)
Semantic Frame Interpolation
von: Hong, Yijia, et al.
Veröffentlicht: (2025)
von: Hong, Yijia, et al.
Veröffentlicht: (2025)
VisMem: Latent Vision Memory Unlocks Potential of Vision-Language Models
von: Yu, Xinlei, et al.
Veröffentlicht: (2025)
von: Yu, Xinlei, et al.
Veröffentlicht: (2025)
HumanVideo-MME: Benchmarking MLLMs for Human-Centric Video Understanding
von: Cai, Yuxuan, et al.
Veröffentlicht: (2025)
von: Cai, Yuxuan, et al.
Veröffentlicht: (2025)
Mega-ASR: Towards In-the-wild^2 Speech Recognition via Scaling up Real-world Acoustic Simulation
von: Xie, Zhifei, et al.
Veröffentlicht: (2026)
von: Xie, Zhifei, et al.
Veröffentlicht: (2026)
Finetuning Generative Large Language Models with Discrimination Instructions for Knowledge Graph Completion
von: Liu, Yang, et al.
Veröffentlicht: (2024)
von: Liu, Yang, et al.
Veröffentlicht: (2024)
MobileMamba: Lightweight Multi-Receptive Visual Mamba Network
von: He, Haoyang, et al.
Veröffentlicht: (2024)
von: He, Haoyang, et al.
Veröffentlicht: (2024)
FeRA: Frequency-Energy Constrained Routing for Effective Diffusion Adaptation Fine-Tuning
von: Yin, Bo, et al.
Veröffentlicht: (2025)
von: Yin, Bo, et al.
Veröffentlicht: (2025)
Evolution of Video Generative Foundations
von: Hu, Teng, et al.
Veröffentlicht: (2026)
von: Hu, Teng, et al.
Veröffentlicht: (2026)
Human-MME: A Holistic Evaluation Benchmark for Human-Centric Multimodal Large Language Models
von: Liu, Yuansen, et al.
Veröffentlicht: (2025)
von: Liu, Yuansen, et al.
Veröffentlicht: (2025)
SkillGraph: Self-Evolving Multi-Agent Collaboration with Multimodal Graph Topology
von: Nie, Zheng, et al.
Veröffentlicht: (2026)
von: Nie, Zheng, et al.
Veröffentlicht: (2026)
Ähnliche Einträge
-
RWKV-UNet: Improving UNet with Long-Range Cooperation for Effective Medical Image Segmentation
von: Jiang, Juntao, et al.
Veröffentlicht: (2025) -
M3CoTBench: Benchmark Chain-of-Thought of MLLMs in Medical Image Understanding
von: Jiang, Juntao, et al.
Veröffentlicht: (2026) -
IVEBench: Modern Benchmark Suite for Instruction-Guided Video Editing Assessment
von: Chen, Yinan, et al.
Veröffentlicht: (2025) -
Evolution of Optimization Methods: Algorithms, Scenarios, and Evaluations
von: Zhang, Tong, et al.
Veröffentlicht: (2026) -
SPIKE: An Adaptive Dual Controller Framework for Cost-Efficient Long-Horizon Game Agents
von: Jiang, Wencan, et al.
Veröffentlicht: (2026)