DATAREEL: Automated Data-Driven Video Story Generation with Animations
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Mahbub, Ridwan, Aziz, Syem, Ahmed, Mahir, Rahman, Shadikur, Rahman, Mizanur, Joty, Shafiq, Hoque, Enamul |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
LLM-Based Data Science Agents: A Survey of Capabilities, Challenges, and Future Directions
par: Rahman, Mizanur, et autres
Publié: (2025)
par: Rahman, Mizanur, et autres
Publié: (2025)
DashboardQA: Benchmarking Multimodal Agents for Question Answering on Interactive Dashboards
par: Kartha, Aaryaman, et autres
Publié: (2025)
par: Kartha, Aaryaman, et autres
Publié: (2025)
Text2Vis: A Challenging and Diverse Benchmark for Generating Multimodal Visualizations from Text
par: Rahman, Mizanur, et autres
Publié: (2025)
par: Rahman, Mizanur, et autres
Publié: (2025)
From Charts to Fair Narratives: Uncovering and Mitigating Geo-Economic Biases in Chart-to-Text
par: Mahbub, Ridwan, et autres
Publié: (2025)
par: Mahbub, Ridwan, et autres
Publié: (2025)
Aligning Text, Code, and Vision: A Multi-Objective Reinforcement Learning Framework for Text-to-Visualization
par: Rahman, Mizanur, et autres
Publié: (2026)
par: Rahman, Mizanur, et autres
Publié: (2026)
DataNarrative: Automated Data-Driven Storytelling with Visualizations and Texts
par: Islam, Mohammed Saidul, et autres
Publié: (2024)
par: Islam, Mohammed Saidul, et autres
Publié: (2024)
ChartGemma: Visual Instruction-tuning for Chart Reasoning in the Wild
par: Masry, Ahmed, et autres
Publié: (2024)
par: Masry, Ahmed, et autres
Publié: (2024)
Open-RAG: Enhanced Retrieval-Augmented Reasoning with Open-Source Large Language Models
par: Islam, Shayekh Bin, et autres
Publié: (2024)
par: Islam, Shayekh Bin, et autres
Publié: (2024)
Judging the Judges: Can Large Vision-Language Models Fairly Evaluate Chart Comprehension and Reasoning?
par: Laskar, Md Tahmid Rahman, et autres
Publié: (2025)
par: Laskar, Md Tahmid Rahman, et autres
Publié: (2025)
Deploying Tiny LVLM Judges for Real-World Evaluation of Chart Models: Lessons Learned and Best Practices
par: Laskar, Md Tahmid Rahman, et autres
Publié: (2025)
par: Laskar, Md Tahmid Rahman, et autres
Publié: (2025)
The Perils of Chart Deception: How Misleading Visualizations Affect Vision-Language Models
par: Mahbub, Ridwan, et autres
Publié: (2025)
par: Mahbub, Ridwan, et autres
Publié: (2025)
ChartQAPro: A More Diverse and Challenging Benchmark for Chart Question Answering
par: Masry, Ahmed, et autres
Publié: (2025)
par: Masry, Ahmed, et autres
Publié: (2025)
A Systematic Survey and Critical Review on Evaluating Large Language Models: Challenges, Limitations, and Recommendations
par: Laskar, Md Tahmid Rahman, et autres
Publié: (2024)
par: Laskar, Md Tahmid Rahman, et autres
Publié: (2024)
Lost in Translation: Do LVLM Judges Generalize Across Languages?
par: Laskar, Md Tahmid Rahman, et autres
Publié: (2026)
par: Laskar, Md Tahmid Rahman, et autres
Publié: (2026)
Automated User Story Generation with Test Case Specification Using Large Language Model
par: Rahman, Tajmilur, et autres
Publié: (2024)
par: Rahman, Tajmilur, et autres
Publié: (2024)
Multi-Armed Bandits-Based Optimization of Decision Trees
par: Shanto, Hasibul Karim, et autres
Publié: (2025)
par: Shanto, Hasibul Karim, et autres
Publié: (2025)
Grid2Guide: A* Enabled Small Language Model for Indoor Navigation
par: Haque, Md. Wasiul, et autres
Publié: (2025)
par: Haque, Md. Wasiul, et autres
Publié: (2025)
BEADs: Bias Evaluation Across Domains
par: Raza, Shaina, et autres
Publié: (2024)
par: Raza, Shaina, et autres
Publié: (2024)
Experimental Validation of Sensor Fusion-based GNSS Spoofing Attack Detection Framework for Autonomous Vehicles
par: Dasgupta, Sagar, et autres
Publié: (2024)
par: Dasgupta, Sagar, et autres
Publié: (2024)
NAACL2025 Tutorial: Adaptation of Large Language Models
par: Ke, Zixuan, et autres
Publié: (2025)
par: Ke, Zixuan, et autres
Publié: (2025)
Harnessing LLM Agents with Skill Programs
par: Liu, Hongjun, et autres
Publié: (2026)
par: Liu, Hongjun, et autres
Publié: (2026)
ChartInstruct: Instruction Tuning for Chart Comprehension and Reasoning
par: Masry, Ahmed, et autres
Publié: (2024)
par: Masry, Ahmed, et autres
Publié: (2024)
Comparative Evaluation of Deep Learning Models for Fake Image Detection
par: Pakala, Akhitha, et autres
Publié: (2026)
par: Pakala, Akhitha, et autres
Publié: (2026)
BootPIG: Bootstrapping Zero-shot Personalized Image Generation Capabilities in Pretrained Diffusion Models
par: Purushwalkam, Senthil, et autres
Publié: (2024)
par: Purushwalkam, Senthil, et autres
Publié: (2024)
Helpful Agent Meets Deceptive Judge: Understanding Vulnerabilities in Agentic Workflows
par: Ming, Yifei, et autres
Publié: (2025)
par: Ming, Yifei, et autres
Publié: (2025)
V2CE: Video to Continuous Events Simulator
par: Zhang, Zhongyang, et autres
Publié: (2023)
par: Zhang, Zhongyang, et autres
Publié: (2023)
Democratizing LLMs for Low-Resource Languages by Leveraging their English Dominant Abilities with Linguistically-Diverse Prompts
par: Nguyen, Xuan-Phi, et autres
Publié: (2023)
par: Nguyen, Xuan-Phi, et autres
Publié: (2023)
Vision-Based Localization and LLM-based Navigation for Indoor Environments
par: Rahimi, Keyan, et autres
Publié: (2025)
par: Rahimi, Keyan, et autres
Publié: (2025)
Synthetic Data-Driven Multi-Architecture Framework for Automated Polyp Segmentation Through Integrated Detection and Mask Generation
par: Peter, Ojonugwa Oluwafemi Ejiga, et autres
Publié: (2025)
par: Peter, Ojonugwa Oluwafemi Ejiga, et autres
Publié: (2025)
Automated Toll Management System Using RFID and Image Processing
par: Ahmed, Raihan, et autres
Publié: (2024)
par: Ahmed, Raihan, et autres
Publié: (2024)
Agile Story-Point Estimation: Is RAG a Better Way to Go?
par: Maha, Lamyea, et autres
Publié: (2026)
par: Maha, Lamyea, et autres
Publié: (2026)
CodeChain: Towards Modular Code Generation Through Chain of Self-revisions with Representative Sub-modules
par: Le, Hung, et autres
Publié: (2023)
par: Le, Hung, et autres
Publié: (2023)
Modeling Uncertainty and Using Post-fusion as Fallback Improves Retrieval Augmented Generation with LLMs
par: Liu, Ye, et autres
Publié: (2023)
par: Liu, Ye, et autres
Publié: (2023)
Synthesizing Agentic Data for Web Agents with Progressive Difficulty Enhancement Mechanisms
par: Pandit, Shrey, et autres
Publié: (2025)
par: Pandit, Shrey, et autres
Publié: (2025)
FocalLens: Visualizing Narratives through Focalization
par: Alam, S M Raihanul, et autres
Publié: (2026)
par: Alam, S M Raihanul, et autres
Publié: (2026)
Least-Loaded Expert Parallelism: Load Balancing An Imbalanced Mixture-of-Experts
par: Nguyen, Xuan-Phi, et autres
Publié: (2026)
par: Nguyen, Xuan-Phi, et autres
Publié: (2026)
J4R: Learning to Judge with Equivalent Initial State Group Relative Policy Optimization
par: Xu, Austin, et autres
Publié: (2025)
par: Xu, Austin, et autres
Publié: (2025)
Learning Planning-based Reasoning by Trajectories Collection and Process Reward Synthesizing
par: Jiao, Fangkai, et autres
Publié: (2024)
par: Jiao, Fangkai, et autres
Publié: (2024)
Automating Patch Set Generation from Code Review Comments Using Large Language Models
par: Rahman, Tajmilur, et autres
Publié: (2024)
par: Rahman, Tajmilur, et autres
Publié: (2024)
Efficient Story Point Estimation With Comparative Learning
par: Khan, Monoshiz Mahbub, et autres
Publié: (2025)
par: Khan, Monoshiz Mahbub, et autres
Publié: (2025)
Documents similaires
-
LLM-Based Data Science Agents: A Survey of Capabilities, Challenges, and Future Directions
par: Rahman, Mizanur, et autres
Publié: (2025) -
DashboardQA: Benchmarking Multimodal Agents for Question Answering on Interactive Dashboards
par: Kartha, Aaryaman, et autres
Publié: (2025) -
Text2Vis: A Challenging and Diverse Benchmark for Generating Multimodal Visualizations from Text
par: Rahman, Mizanur, et autres
Publié: (2025) -
From Charts to Fair Narratives: Uncovering and Mitigating Geo-Economic Biases in Chart-to-Text
par: Mahbub, Ridwan, et autres
Publié: (2025) -
Aligning Text, Code, and Vision: A Multi-Objective Reinforcement Learning Framework for Text-to-Visualization
par: Rahman, Mizanur, et autres
Publié: (2026)