ResearchPulse: Building Method-Experiment Chains through Multi-Document Scientific Inference
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Chen, Qi, Wei, Jingxuan, Yao, Zhuoya, Wang, Haiguang, Wu, Gaowei, Yu, Bihui, Li, Siyuan, Tan, Cheng |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
LLaVA-NeuMT: Selective Layer-Neuron Modulation for Efficient Multilingual Multimodal Translation
par: Wei, Jingxuan, et autres
Publié: (2025)
par: Wei, Jingxuan, et autres
Publié: (2025)
A Survey on Image-text Multimodal Models
par: Guo, Ruifeng, et autres
Publié: (2023)
par: Guo, Ruifeng, et autres
Publié: (2023)
DAT: Dual-Aware Adaptive Transmission for Efficient Multimodal LLM Inference in Edge-Cloud Systems
par: Guo, Qi, et autres
Publié: (2026)
par: Guo, Qi, et autres
Publié: (2026)
High-level Codes and Fine-grained Weights for Online Multi-modal Hashing Retrieval
par: Zhan, Yu-Wei, et autres
Publié: (2024)
par: Zhan, Yu-Wei, et autres
Publié: (2024)
Multi-modal and Metadata Capture Model for Micro Video Popularity Prediction
par: Lu, Jiacheng, et autres
Publié: (2025)
par: Lu, Jiacheng, et autres
Publié: (2025)
TMFNet: Two-Stream Multi-Channels Fusion Networks for Color Image Operation Chain Detection
par: Niu, Yakun, et autres
Publié: (2024)
par: Niu, Yakun, et autres
Publié: (2024)
CDIO: Cross-Domain Inference Optimization with Resource Preference Prediction for Edge-Cloud Collaboration
par: Yang, Zheming, et autres
Publié: (2025)
par: Yang, Zheming, et autres
Publié: (2025)
GGAvatar: Reconstructing Garment-Separated 3D Gaussian Splatting Avatars from Monocular Video
par: Chen, Jingxuan
Publié: (2024)
par: Chen, Jingxuan
Publié: (2024)
FineBadminton: A Multi-Level Dataset for Fine-Grained Badminton Video Understanding
par: He, Xusheng, et autres
Publié: (2025)
par: He, Xusheng, et autres
Publié: (2025)
Virbo: Multimodal Multilingual Avatar Video Generation in Digital Marketing
par: Zhang, Juan, et autres
Publié: (2024)
par: Zhang, Juan, et autres
Publié: (2024)
ASAP: Advancing Semantic Alignment Promotes Multi-Modal Manipulation Detecting and Grounding
par: Zhang, Zhenxing, et autres
Publié: (2024)
par: Zhang, Zhenxing, et autres
Publié: (2024)
Enhancing Few-Shot Classification without Forgetting through Multi-Level Contrastive Constraints
par: Chen, Bingzhi, et autres
Publié: (2024)
par: Chen, Bingzhi, et autres
Publié: (2024)
Characterizing Multimedia Information Environment through Multi-modal Clustering of YouTube Videos
par: Yousefi, Niloofar, et autres
Publié: (2024)
par: Yousefi, Niloofar, et autres
Publié: (2024)
SIN-Bench: Tracing Native Evidence Chains in Long-Context Multimodal Scientific Interleaved Literature
par: Ren, Yiming, et autres
Publié: (2026)
par: Ren, Yiming, et autres
Publié: (2026)
Multi-source Knowledge Enhanced Graph Attention Networks for Multimodal Fact Verification
par: Cao, Han, et autres
Publié: (2024)
par: Cao, Han, et autres
Publié: (2024)
MMoFusion: Multi-modal Co-Speech Motion Generation with Diffusion Model
par: Wang, Sen, et autres
Publié: (2024)
par: Wang, Sen, et autres
Publié: (2024)
Research on Piano Timbre Transformation System Based on Diffusion Model
par: Hsu, Chun-Chieh, et autres
Publié: (2026)
par: Hsu, Chun-Chieh, et autres
Publié: (2026)
Privacy-Preserving Multimedia Mobile Cloud Computing Using Protective Perturbation
par: Tang, Zhongze, et autres
Publié: (2024)
par: Tang, Zhongze, et autres
Publié: (2024)
mPLUG-PaperOwl: Scientific Diagram Analysis with the Multimodal Large Language Model
par: Hu, Anwen, et autres
Publié: (2023)
par: Hu, Anwen, et autres
Publié: (2023)
CineAGI: Character-Consistent Movie Creation through LLM-Orchestrated Multi-Modal Generation and Cross-Scene Integration
par: Xie, Tianyidan, et autres
Publié: (2026)
par: Xie, Tianyidan, et autres
Publié: (2026)
SynthDoc: Bilingual Documents Synthesis for Visual Document Understanding
par: Ding, Chuanghao, et autres
Publié: (2024)
par: Ding, Chuanghao, et autres
Publié: (2024)
Building and Evaluating a Realistic Virtual World for Large Scale Urban Exploration from 360° Videos
par: Takenawa, Mizuki, et autres
Publié: (2025)
par: Takenawa, Mizuki, et autres
Publié: (2025)
EEmo-Bench: A Benchmark for Multi-modal Large Language Models on Image Evoked Emotion Assessment
par: Gao, Lancheng, et autres
Publié: (2025)
par: Gao, Lancheng, et autres
Publié: (2025)
SCI-Reason: A Dataset with Chain-of-Thought Rationales for Complex Multimodal Reasoning in Academic Areas
par: Ma, Chenghao, et autres
Publié: (2025)
par: Ma, Chenghao, et autres
Publié: (2025)
Harnessing Multimodal Large Language Models for Personalized Product Search with Query-aware Refinement
par: Zhang, Beibei, et autres
Publié: (2025)
par: Zhang, Beibei, et autres
Publié: (2025)
Routing Experts: Learning to Route Dynamic Experts in Multi-modal Large Language Models
par: Wu, Qiong, et autres
Publié: (2024)
par: Wu, Qiong, et autres
Publié: (2024)
Accelerating Multi-Condition T2I Generation via Adaptive Condition Offloading and Pruning
par: Kong, Yuxin, et autres
Publié: (2026)
par: Kong, Yuxin, et autres
Publié: (2026)
ARECHO: Autoregressive Evaluation via Chain-Based Hypothesis Optimization for Speech Multi-Metric Estimation
par: Shi, Jiatong, et autres
Publié: (2025)
par: Shi, Jiatong, et autres
Publié: (2025)
Learning Complex Heterogeneous Multimodal Fake News via Social Latent Network Inference
par: Li, Mingxin, et autres
Publié: (2025)
par: Li, Mingxin, et autres
Publié: (2025)
Compression Metadata-assisted RoI Extraction and Adaptive Inference for Efficient Video Analytics
par: Wang, Chengzhi, et autres
Publié: (2025)
par: Wang, Chengzhi, et autres
Publié: (2025)
Self-Training Boosted Multi-Factor Matching Network for Composed Image Retrieval
par: Wen, Haokun, et autres
Publié: (2023)
par: Wen, Haokun, et autres
Publié: (2023)
Realistic Virtual Flood Experience System Using 360° Videos and 3D City Models Constructed from Building Footprints
par: Banno, Tatsuro, et autres
Publié: (2026)
par: Banno, Tatsuro, et autres
Publié: (2026)
HADUA: Hierarchical Attention and Dynamic Uniform Alignment for Robust Cross-Subject Emotion Recognition
par: Tang, Jiahao, et autres
Publié: (2026)
par: Tang, Jiahao, et autres
Publié: (2026)
When Top-ranked Recommendations Fail: Modeling Multi-Granular Negative Feedback for Explainable and Robust Video Recommendation
par: Chen, Siran, et autres
Publié: (2025)
par: Chen, Siran, et autres
Publié: (2025)
MHier-RAG: Multi-Modal RAG for Visual-Rich Document Question-Answering via Hierarchical and Multi-Granularity Reasoning
par: Gong, Ziyu, et autres
Publié: (2025)
par: Gong, Ziyu, et autres
Publié: (2025)
Benchmarking and Improving LVLMs on Event Extraction from Multimedia Documents
par: Xing, Fuyu, et autres
Publié: (2025)
par: Xing, Fuyu, et autres
Publié: (2025)
MultiMediate'24: Multi-Domain Engagement Estimation
par: Müller, Philipp, et autres
Publié: (2024)
par: Müller, Philipp, et autres
Publié: (2024)
Perceptual Quality Assessment of Octree-RAHT Encoded 3D Point Clouds
par: Duan, Dongshuai, et autres
Publié: (2024)
par: Duan, Dongshuai, et autres
Publié: (2024)
CARAT: Contrastive Feature Reconstruction and Aggregation for Multi-Modal Multi-Label Emotion Recognition
par: Peng, Cheng, et autres
Publié: (2023)
par: Peng, Cheng, et autres
Publié: (2023)
DA-PTQ: Drift-Aware Post-Training Quantization for Efficient Vision-Language-Action Models
par: Xu, Siyuan, et autres
Publié: (2026)
par: Xu, Siyuan, et autres
Publié: (2026)
Documents similaires
-
LLaVA-NeuMT: Selective Layer-Neuron Modulation for Efficient Multilingual Multimodal Translation
par: Wei, Jingxuan, et autres
Publié: (2025) -
A Survey on Image-text Multimodal Models
par: Guo, Ruifeng, et autres
Publié: (2023) -
DAT: Dual-Aware Adaptive Transmission for Efficient Multimodal LLM Inference in Edge-Cloud Systems
par: Guo, Qi, et autres
Publié: (2026) -
High-level Codes and Fine-grained Weights for Online Multi-modal Hashing Retrieval
par: Zhan, Yu-Wei, et autres
Publié: (2024) -
Multi-modal and Metadata Capture Model for Micro Video Popularity Prediction
par: Lu, Jiacheng, et autres
Publié: (2025)