Jr. AI Scientist and Its Risk Report: Autonomous Scientific Exploration from a Baseline Paper
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Miyai, Atsuyuki, Toyooka, Mashiro, Otonari, Takashi, Zhao, Zaiying, Aizawa, Kiyoharu |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Paper Reconstruction Evaluation: Evaluating Presentation and Hallucination in AI-written Papers
par: Miyai, Atsuyuki, et autres
Publié: (2026)
par: Miyai, Atsuyuki, et autres
Publié: (2026)
JMMMU-Pro: Image-based Japanese Multi-discipline Multimodal Understanding Benchmark via Vibe Benchmark Construction
par: Miyai, Atsuyuki, et autres
Publié: (2025)
par: Miyai, Atsuyuki, et autres
Publié: (2025)
Manga109-v2026: Revisiting Manga109 Annotations for Modern Manga Understanding
par: Baek, Jeonghun, et autres
Publié: (2026)
par: Baek, Jeonghun, et autres
Publié: (2026)
A Highly Clean Recipe Dataset with Ingredient States Annotation for State Probing Task
par: Toyooka, Mashiro, et autres
Publié: (2025)
par: Toyooka, Mashiro, et autres
Publié: (2025)
Entity-NeRF: Detecting and Removing Moving Entities in Urban Scenes
par: Otonari, Takashi, et autres
Publié: (2024)
par: Otonari, Takashi, et autres
Publié: (2024)
GL-MCM: Global and Local Maximum Concept Matching for Zero-Shot Out-of-Distribution Detection
par: Miyai, Atsuyuki, et autres
Publié: (2023)
par: Miyai, Atsuyuki, et autres
Publié: (2023)
MangaVQA and MangaLMM: A Benchmark and Specialized Model for Multimodal Manga Understanding
par: Baek, Jeonghun, et autres
Publié: (2025)
par: Baek, Jeonghun, et autres
Publié: (2025)
A Benchmark and Evaluation for Real-World Out-of-Distribution Detection Using Vision-Language Models
par: Noda, Shiho, et autres
Publié: (2025)
par: Noda, Shiho, et autres
Publié: (2025)
WebChoreArena: Evaluating Web Browsing Agents on Realistic Tedious Web Tasks
par: Miyai, Atsuyuki, et autres
Publié: (2025)
par: Miyai, Atsuyuki, et autres
Publié: (2025)
JMMMU: A Japanese Massive Multi-discipline Multimodal Understanding Benchmark for Culture-aware Evaluation
par: Onohara, Shota, et autres
Publié: (2024)
par: Onohara, Shota, et autres
Publié: (2024)
Harnessing PDF Data for Improving Japanese Large Multimodal Models
par: Baek, Jeonghun, et autres
Publié: (2025)
par: Baek, Jeonghun, et autres
Publié: (2025)
Unsolvable Problem Detection: Robust Understanding Evaluation for Large Multimodal Models
par: Miyai, Atsuyuki, et autres
Publié: (2024)
par: Miyai, Atsuyuki, et autres
Publié: (2024)
PaperBanana: Automating Academic Illustration for AI Scientists
par: Zhu, Dawei, et autres
Publié: (2026)
par: Zhu, Dawei, et autres
Publié: (2026)
Manga109Dialog: A Large-scale Dialogue Dataset for Comics Speaker Detection
par: Li, Yingxuan, et autres
Publié: (2023)
par: Li, Yingxuan, et autres
Publié: (2023)
Guided Image Synthesis via Initial Image Editing in Diffusion Model
par: Mao, Jiafeng, et autres
Publié: (2023)
par: Mao, Jiafeng, et autres
Publié: (2023)
The Lottery Ticket Hypothesis in Denoising: Towards Semantic-Driven Initialization
par: Mao, Jiafeng, et autres
Publié: (2023)
par: Mao, Jiafeng, et autres
Publié: (2023)
Bias Beyond Demographics: Probing Decision Boundaries in Black-Box LVLMs via Counterfactual VQA
par: Zhao, Zaiying, et autres
Publié: (2025)
par: Zhao, Zaiying, et autres
Publié: (2025)
FoodMLLM-JP: Leveraging Multimodal Large Language Models for Japanese Recipe Generation
par: Imajuku, Yuki, et autres
Publié: (2024)
par: Imajuku, Yuki, et autres
Publié: (2024)
MangaUB: A Manga Understanding Benchmark for Large Multimodal Models
par: Ikuta, Hikaru, et autres
Publié: (2024)
par: Ikuta, Hikaru, et autres
Publié: (2024)
Training-Free Sketch-Guided Diffusion with Latent Optimization
par: Ding, Sandra Zhang, et autres
Publié: (2024)
par: Ding, Sandra Zhang, et autres
Publié: (2024)
PerFace: Metric Learning in Perceptual Facial Similarity for Enhanced Face Anonymization
par: Kumagai, Haruka, et autres
Publié: (2025)
par: Kumagai, Haruka, et autres
Publié: (2025)
Can Multimodal Foundation Models Understand Schematic Diagrams? An Empirical Study on Information-Seeking QA over Scientific Papers
par: Zhao, Yilun, et autres
Publié: (2025)
par: Zhao, Yilun, et autres
Publié: (2025)
Language-guided Detection and Mitigation of Unknown Dataset Bias
par: Zhao, Zaiying, et autres
Publié: (2024)
par: Zhao, Zaiying, et autres
Publié: (2024)
On the Risk of Misleading Reports: Diagnosing Textual Biases in Multimodal Clinical AI
par: Restrepo, David, et autres
Publié: (2025)
par: Restrepo, David, et autres
Publié: (2025)
FoodLogAthl-218: Constructing a Real-World Food Image Dataset Using Dietary Management Applications
par: Watanabe, Mitsuki, et autres
Publié: (2025)
par: Watanabe, Mitsuki, et autres
Publié: (2025)
Zero-Shot Character Identification and Speaker Prediction in Comics via Iterative Multimodal Fusion
par: Li, Yingxuan, et autres
Publié: (2024)
par: Li, Yingxuan, et autres
Publié: (2024)
SPIQA: A Dataset for Multimodal Question Answering on Scientific Papers
par: Pramanick, Shraman, et autres
Publié: (2024)
par: Pramanick, Shraman, et autres
Publié: (2024)
Generalized Out-of-Distribution Detection and Beyond in Vision Language Model Era: A Survey
par: Miyai, Atsuyuki, et autres
Publié: (2024)
par: Miyai, Atsuyuki, et autres
Publié: (2024)
Retrieval-Augmented Layout Transformer for Content-Aware Layout Generation
par: Horita, Daichi, et autres
Publié: (2023)
par: Horita, Daichi, et autres
Publié: (2023)
HaploVL: A Single-Transformer Baseline for Multi-Modal Understanding
par: Yang, Rui, et autres
Publié: (2025)
par: Yang, Rui, et autres
Publié: (2025)
Paper2Poster: Towards Multimodal Poster Automation from Scientific Papers
par: Pang, Wei, et autres
Publié: (2025)
par: Pang, Wei, et autres
Publié: (2025)
Paper2Video: Automatic Video Generation from Scientific Papers
par: Zhu, Zeyu, et autres
Publié: (2025)
par: Zhu, Zeyu, et autres
Publié: (2025)
CollEX -- A Multimodal Agentic RAG System Enabling Interactive Exploration of Scientific Collections
par: Schneider, Florian, et autres
Publié: (2025)
par: Schneider, Florian, et autres
Publié: (2025)
Paper2Web: Let's Make Your Paper Alive!
par: Chen, Yuhang, et autres
Publié: (2025)
par: Chen, Yuhang, et autres
Publié: (2025)
Bilingual Text-to-Motion Generation: A New Benchmark and Baselines
par: Weng, Wanjiang, et autres
Publié: (2026)
par: Weng, Wanjiang, et autres
Publié: (2026)
ScienceBoard: Evaluating Multimodal Autonomous Agents in Realistic Scientific Workflows
par: Sun, Qiushi, et autres
Publié: (2025)
par: Sun, Qiushi, et autres
Publié: (2025)
An AI-Powered Autonomous Underwater System for Sea Exploration and Scientific Research
par: Almazrouei, Hamad, et autres
Publié: (2025)
par: Almazrouei, Hamad, et autres
Publié: (2025)
GUI-Bee: Align GUI Action Grounding to Novel Environments via Autonomous Exploration
par: Fan, Yue, et autres
Publié: (2025)
par: Fan, Yue, et autres
Publié: (2025)
Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report
par: Lab, Shanghai AI, et autres
Publié: (2025)
par: Lab, Shanghai AI, et autres
Publié: (2025)
Enhancing Agentic Autonomous Scientific Discovery with Vision-Language Model Capabilities
par: Gandhi, Kahaan, et autres
Publié: (2025)
par: Gandhi, Kahaan, et autres
Publié: (2025)
Documents similaires
-
Paper Reconstruction Evaluation: Evaluating Presentation and Hallucination in AI-written Papers
par: Miyai, Atsuyuki, et autres
Publié: (2026) -
JMMMU-Pro: Image-based Japanese Multi-discipline Multimodal Understanding Benchmark via Vibe Benchmark Construction
par: Miyai, Atsuyuki, et autres
Publié: (2025) -
Manga109-v2026: Revisiting Manga109 Annotations for Modern Manga Understanding
par: Baek, Jeonghun, et autres
Publié: (2026) -
A Highly Clean Recipe Dataset with Ingredient States Annotation for State Probing Task
par: Toyooka, Mashiro, et autres
Publié: (2025) -
Entity-NeRF: Detecting and Removing Moving Entities in Urban Scenes
par: Otonari, Takashi, et autres
Publié: (2024)