LogiStory: A Logic-Aware Framework for Multi-Image Story Visualization
Fuente:
arXiv
Salvato in:
| Autori principali: | Meng, Chutian, Ma, Fan, Zhang, Chi, Miao, Jiaxu, Yang, Yi, Zhuang, Yueting |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models
di: Meng, Chutian, et al.
Pubblicazione: (2024)
di: Meng, Chutian, et al.
Pubblicazione: (2024)
StoryAgent: Customized Storytelling Video Generation via Multi-Agent Collaboration
di: Hu, Panwen, et al.
Pubblicazione: (2024)
di: Hu, Panwen, et al.
Pubblicazione: (2024)
Scene-Aware Vectorized Memory Multi-Agent Framework with Cross-Modal Differentiated Quantization VLMs for Visually Impaired Assistance
di: Wang, Xiangxiang, et al.
Pubblicazione: (2025)
di: Wang, Xiangxiang, et al.
Pubblicazione: (2025)
Facilitating Video Story Interaction with Multi-Agent Collaborative System
di: Zhang, Yiwen, et al.
Pubblicazione: (2025)
di: Zhang, Yiwen, et al.
Pubblicazione: (2025)
Visual Multi-Agent System: Mitigating Hallucination Snowballing via Visual Flow
di: Yu, Xinlei, et al.
Pubblicazione: (2025)
di: Yu, Xinlei, et al.
Pubblicazione: (2025)
AstroVLM: Expert Multi-agent Collaborative Reasoning for Astronomical Imaging Quality Diagnosis
di: Han, Yaohui, et al.
Pubblicazione: (2026)
di: Han, Yaohui, et al.
Pubblicazione: (2026)
FetalAgents: A Multi-Agent System for Fetal Ultrasound Image and Video Analysis
di: Hu, Xiaotian, et al.
Pubblicazione: (2026)
di: Hu, Xiaotian, et al.
Pubblicazione: (2026)
VideoMultiAgents: A Multi-Agent Framework for Video Question Answering
di: Kugo, Noriyuki, et al.
Pubblicazione: (2025)
di: Kugo, Noriyuki, et al.
Pubblicazione: (2025)
HiMemFormer: Hierarchical Memory-Aware Transformer for Multi-Agent Action Anticipation
di: Wang, Zirui, et al.
Pubblicazione: (2024)
di: Wang, Zirui, et al.
Pubblicazione: (2024)
Multi-Agent Amodal Completion: Direct Synthesis with Fine-Grained Semantic Guidance
di: Fan, Hongxing, et al.
Pubblicazione: (2025)
di: Fan, Hongxing, et al.
Pubblicazione: (2025)
Towards Reliable Fetal Ultrasound Interpretation with Multi-Agent Collaboration
di: Hu, Xiaotian, et al.
Pubblicazione: (2026)
di: Hu, Xiaotian, et al.
Pubblicazione: (2026)
VideoChat-M1: Collaborative Policy Planning for Video Understanding via Multi-Agent Reinforcement Learning
di: Chen, Boyu, et al.
Pubblicazione: (2025)
di: Chen, Boyu, et al.
Pubblicazione: (2025)
TraF-Align: Trajectory-aware Feature Alignment for Asynchronous Multi-agent Perception
di: Song, Zhiying, et al.
Pubblicazione: (2025)
di: Song, Zhiying, et al.
Pubblicazione: (2025)
DVM-SLAM: Decentralized Visual Monocular Simultaneous Localization and Mapping for Multi-Agent Systems
di: Bird, Joshua, et al.
Pubblicazione: (2025)
di: Bird, Joshua, et al.
Pubblicazione: (2025)
Visual Sensor Pose Optimisation Using Visibility Models for Smart Cities
di: Arnold, Eduardo, et al.
Pubblicazione: (2021)
di: Arnold, Eduardo, et al.
Pubblicazione: (2021)
What Makes Good Collaborative Views? Contrastive Mutual Information Maximization for Multi-Agent Perception
di: Su, Wanfang, et al.
Pubblicazione: (2024)
di: Su, Wanfang, et al.
Pubblicazione: (2024)
IMAGAgent: Orchestrating Multi-Turn Image Editing via Constraint-Aware Planning and Reflection
di: Shen, Fei, et al.
Pubblicazione: (2026)
di: Shen, Fei, et al.
Pubblicazione: (2026)
RADAR: A Risk-Aware Dynamic Multi-Agent Framework for LLM Safety Evaluation via Role-Specialized Collaboration
di: Chen, Xiuyuan, et al.
Pubblicazione: (2025)
di: Chen, Xiuyuan, et al.
Pubblicazione: (2025)
SPACE: 3D Spatial Co-operation and Exploration Framework for Robust Mapping and Coverage with Multi-Robot Systems
di: Ghanta, Sai Krishna, et al.
Pubblicazione: (2024)
di: Ghanta, Sai Krishna, et al.
Pubblicazione: (2024)
AniMaker: Multi-Agent Animated Storytelling with MCTS-Driven Clip Generation
di: Shi, Haoyuan, et al.
Pubblicazione: (2025)
di: Shi, Haoyuan, et al.
Pubblicazione: (2025)
MAG-3D: Multi-Agent Grounded Reasoning for 3D Understanding
di: Zheng, Henry, et al.
Pubblicazione: (2026)
di: Zheng, Henry, et al.
Pubblicazione: (2026)
Learning Collective Dynamics of Multi-Agent Systems using Event-based Vision
di: Lee, Minah, et al.
Pubblicazione: (2024)
di: Lee, Minah, et al.
Pubblicazione: (2024)
TranSPORTmer: A Holistic Approach to Trajectory Understanding in Multi-Agent Sports
di: Capellera, Guillem, et al.
Pubblicazione: (2024)
di: Capellera, Guillem, et al.
Pubblicazione: (2024)
A Multi-Agent Perception-Action Alliance for Efficient Long Video Reasoning
di: Xu, Yichang, et al.
Pubblicazione: (2026)
di: Xu, Yichang, et al.
Pubblicazione: (2026)
Hollywood Town: Long-Video Generation via Cross-Modal Multi-Agent Orchestration
di: Wei, Zheng, et al.
Pubblicazione: (2025)
di: Wei, Zheng, et al.
Pubblicazione: (2025)
ReCCur: A Recursive Corner-Case Curation Framework for Robust Vision-Language Understanding in Open and Edge Scenarios
di: Wei, Yihan, et al.
Pubblicazione: (2026)
di: Wei, Yihan, et al.
Pubblicazione: (2026)
Active Scout: Multi-Target Tracking Using Neural Radiance Fields in Dense Urban Environments
di: Hsu, Christopher D., et al.
Pubblicazione: (2024)
di: Hsu, Christopher D., et al.
Pubblicazione: (2024)
ProCrit: Self-Elicited Multi-Perspective Reasoning with Critic-Guided Revision for Multimodal Sarcasm Detection
di: Xu, Yingjia, et al.
Pubblicazione: (2026)
di: Xu, Yingjia, et al.
Pubblicazione: (2026)
AgentCVR: Active Multi-Agent Cross-Video Reasoning via Script-Simulated Reinforcement Learning
di: Qiu, Yilun, et al.
Pubblicazione: (2026)
di: Qiu, Yilun, et al.
Pubblicazione: (2026)
An Artifact-based Agent Framework for Adaptive and Reproducible Medical Image Processing
di: Zuo, Lianrui, et al.
Pubblicazione: (2026)
di: Zuo, Lianrui, et al.
Pubblicazione: (2026)
A Case Study of Counting the Number of Unique Users in Linear and Non-Linear Trails -- A Multi-Agent System Approach
di: Rahman, Tanvir
Pubblicazione: (2025)
di: Rahman, Tanvir
Pubblicazione: (2025)
End-to-End Autonomous Driving through V2X Cooperation
di: Yu, Haibao, et al.
Pubblicazione: (2024)
di: Yu, Haibao, et al.
Pubblicazione: (2024)
MAViS: A Multi-Agent Framework for Long-Sequence Video Storytelling
di: Wang, Qian, et al.
Pubblicazione: (2025)
di: Wang, Qian, et al.
Pubblicazione: (2025)
MaCTG: Multi-Agent Collaborative Thought Graph for Automatic Programming
di: Zhao, Zixiao, et al.
Pubblicazione: (2024)
di: Zhao, Zixiao, et al.
Pubblicazione: (2024)
AIDE: Agentically Improve Visual Language Model with Domain Experts
di: Chiu, Ming-Chang, et al.
Pubblicazione: (2025)
di: Chiu, Ming-Chang, et al.
Pubblicazione: (2025)
CollaMamba: Efficient Collaborative Perception with Cross-Agent Spatial-Temporal State Space Model
di: Li, Yang, et al.
Pubblicazione: (2024)
di: Li, Yang, et al.
Pubblicazione: (2024)
AutoGen Driven Multi Agent Framework for Iterative Crime Data Analysis and Prediction
di: Fatima, Syeda Kisaa, et al.
Pubblicazione: (2025)
di: Fatima, Syeda Kisaa, et al.
Pubblicazione: (2025)
StarCraftImage: A Dataset For Prototyping Spatial Reasoning Methods For Multi-Agent Environments
di: Kulinski, Sean, et al.
Pubblicazione: (2024)
di: Kulinski, Sean, et al.
Pubblicazione: (2024)
Unified End-to-End V2X Cooperative Autonomous Driving
di: Li, Zhiwei, et al.
Pubblicazione: (2024)
di: Li, Zhiwei, et al.
Pubblicazione: (2024)
Multi-Agent VQA: Exploring Multi-Agent Foundation Models in Zero-Shot Visual Question Answering
di: Jiang, Bowen, et al.
Pubblicazione: (2024)
di: Jiang, Bowen, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models
di: Meng, Chutian, et al.
Pubblicazione: (2024) -
StoryAgent: Customized Storytelling Video Generation via Multi-Agent Collaboration
di: Hu, Panwen, et al.
Pubblicazione: (2024) -
Scene-Aware Vectorized Memory Multi-Agent Framework with Cross-Modal Differentiated Quantization VLMs for Visually Impaired Assistance
di: Wang, Xiangxiang, et al.
Pubblicazione: (2025) -
Facilitating Video Story Interaction with Multi-Agent Collaborative System
di: Zhang, Yiwen, et al.
Pubblicazione: (2025) -
Visual Multi-Agent System: Mitigating Hallucination Snowballing via Visual Flow
di: Yu, Xinlei, et al.
Pubblicazione: (2025)