Experimenting active and sequential learning in a medieval music manuscript
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Sharma, Sachin, Simonetta, Federico, Flammini, Michele |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Beyond Vision: Contextually Enriched Image Captioning with Multi-Modal Retrieval
par: Quy, Nguyen Lam Phu, et autres
Publié: (2025)
par: Quy, Nguyen Lam Phu, et autres
Publié: (2025)
CLIP-Joint-Detect: End-to-End Joint Training of Object Detectors with Contrastive Vision-Language Supervision
par: Raoufi, Behnam, et autres
Publié: (2025)
par: Raoufi, Behnam, et autres
Publié: (2025)
Detecting Legend Items on Historical Maps Using GPT-4o with In-Context Learning
par: Kirsanova, Sofia, et autres
Publié: (2025)
par: Kirsanova, Sofia, et autres
Publié: (2025)
From eye to AI: studying rodent social behavior in the era of machine Learning
par: Chindemi, Giuseppe, et autres
Publié: (2025)
par: Chindemi, Giuseppe, et autres
Publié: (2025)
DualPrompt-MedCap: A Dual-Prompt Enhanced Approach for Medical Image Captioning
par: Zhao, Yining, et autres
Publié: (2025)
par: Zhao, Yining, et autres
Publié: (2025)
Decoding the Surgical Scene: A Scoping Review of Scene Graphs in Surgery
par: Henriques, Angelo, et autres
Publié: (2025)
par: Henriques, Angelo, et autres
Publié: (2025)
From Dead Pixels to Editable Slides: Infographic Reconstruction into Native Google Slides via Vision-Language Region Understanding
par: Gonzalez, Leonardo
Publié: (2026)
par: Gonzalez, Leonardo
Publié: (2026)
From Cheap to Pro: A Learning-based Adaptive Camera Parameter Network for Professional-Style Imaging
par: Li, Fuchen, et autres
Publié: (2025)
par: Li, Fuchen, et autres
Publié: (2025)
SSD-GS: Scattering and Shadow Decomposition for Relightable 3D Gaussian Splatting
par: Zheng, Iris, et autres
Publié: (2026)
par: Zheng, Iris, et autres
Publié: (2026)
MSGS: Multispectral 3D Gaussian Splatting
par: Zheng, Iris, et autres
Publié: (2026)
par: Zheng, Iris, et autres
Publié: (2026)
SERA-H: Beyond Native Sentinel Spatial Limits for High-Resolution Canopy Height Mapping
par: Boudras, Thomas, et autres
Publié: (2025)
par: Boudras, Thomas, et autres
Publié: (2025)
Gaussian Splatting: 3D Reconstruction and Novel View Synthesis, a Review
par: Dalal, Anurag, et autres
Publié: (2024)
par: Dalal, Anurag, et autres
Publié: (2024)
Vision-Language Cross-Attention for Real-Time Autonomous Driving
par: Patapati, Santosh, et autres
Publié: (2025)
par: Patapati, Santosh, et autres
Publié: (2025)
3DreamBooth: High-Fidelity 3D Subject-Driven Video Generation Model
par: Ko, Hyun-kyu, et autres
Publié: (2026)
par: Ko, Hyun-kyu, et autres
Publié: (2026)
LiftAvatar: Kinematic-Space Completion for Expression-Controlled 3D Gaussian Avatar Animation
par: Wei, Hualiang, et autres
Publié: (2026)
par: Wei, Hualiang, et autres
Publié: (2026)
Dynamic Arthroscopic Navigation System for Anterior Cruciate Ligament Reconstruction Based on Multi-level Memory Architecture
par: Wang, Shuo, et autres
Publié: (2025)
par: Wang, Shuo, et autres
Publié: (2025)
SurgicalMamba: Dual-Path SSD with State Regramming for Online Surgical Phase Recognition
par: Oh, Sukju, et autres
Publié: (2026)
par: Oh, Sukju, et autres
Publié: (2026)
AVATAAR: Agentic Video Answering via Temporal Adaptive Alignment and Reasoning
par: Patel, Urjitkumar, et autres
Publié: (2025)
par: Patel, Urjitkumar, et autres
Publié: (2025)
Context in object detection: a systematic literature review
par: Jamali, Mahtab, et autres
Publié: (2025)
par: Jamali, Mahtab, et autres
Publié: (2025)
Mask-Conditioned Voxel Diffusion for Joint Geometry and Color Inpainting
par: Sumuk, Aarya
Publié: (2026)
par: Sumuk, Aarya
Publié: (2026)
Pedestrian Detection in Low-Light Conditions: A Comprehensive Survey
par: Ghari, Bahareh, et autres
Publié: (2024)
par: Ghari, Bahareh, et autres
Publié: (2024)
PhysVideoGenerator: Towards Physically Aware Video Generation via Latent Physics Guidance
par: Satish, Siddarth Nilol Kundur, et autres
Publié: (2026)
par: Satish, Siddarth Nilol Kundur, et autres
Publié: (2026)
FlowIBR: Leveraging Pre-Training for Efficient Neural Image-Based Rendering of Dynamic Scenes
par: Büsching, Marcel, et autres
Publié: (2023)
par: Büsching, Marcel, et autres
Publié: (2023)
IMASHRIMP: Automatic White Shrimp (Penaeus vannamei) Biometrical Analysis from Laboratory Images Using Computer Vision and Deep Learning
par: González, Abiam Remache, et autres
Publié: (2025)
par: González, Abiam Remache, et autres
Publié: (2025)
OCC-MLLM-CoT-Alpha: Towards Multi-stage Occlusion Recognition Based on Large Language Models via 3D-Aware Supervision and Chain-of-Thoughts Guidance
par: Wang, Chaoyi, et autres
Publié: (2025)
par: Wang, Chaoyi, et autres
Publié: (2025)
NOAH: Benchmarking Narrative Prior driven Hallucination and Omission in Video Large Language Models
par: Lee, Kyuho, et autres
Publié: (2025)
par: Lee, Kyuho, et autres
Publié: (2025)
Reducing Object Hallucination in LVLMs via Emphasizing Image-negative Tokens
par: Shen, Meng, et autres
Publié: (2026)
par: Shen, Meng, et autres
Publié: (2026)
Towards a Generalizable Fusion Architecture for Multimodal Object Detection
par: Berjawi, Jad, et autres
Publié: (2025)
par: Berjawi, Jad, et autres
Publié: (2025)
A Simple Baseline for Streaming Video Understanding
par: Shen, Yujiao, et autres
Publié: (2026)
par: Shen, Yujiao, et autres
Publié: (2026)
EmoVerse: A MLLMs-Driven Emotion Representation Dataset for Interpretable Visual Emotion Analysis
par: Guo, Yijie, et autres
Publié: (2025)
par: Guo, Yijie, et autres
Publié: (2025)
SimWorld: A Unified Benchmark for Simulator-Conditioned Scene Generation via World Model
par: Li, Xinqing, et autres
Publié: (2025)
par: Li, Xinqing, et autres
Publié: (2025)
SCA-Net: Spatial-Contextual Aggregation Network for Enhanced Small Building and Road Change Detection
par: Gholibeigi, Emad, et autres
Publié: (2026)
par: Gholibeigi, Emad, et autres
Publié: (2026)
Synthetic-Child: An AIGC-Based Synthetic Data Pipeline for Privacy-Preserving Child Posture Estimation
par: Zeng, Taowen
Publié: (2026)
par: Zeng, Taowen
Publié: (2026)
Exploring Surround-View Fisheye Camera 3D Object Detection
par: Li, Changcai, et autres
Publié: (2025)
par: Li, Changcai, et autres
Publié: (2025)
A Vision-Language Model for Focal Liver Lesion Classification
par: Jian, Song, et autres
Publié: (2025)
par: Jian, Song, et autres
Publié: (2025)
Car Object Counting and Position Estimation via Extension of the CLIP-EBC Framework
par: Jung, Seoik, et autres
Publié: (2025)
par: Jung, Seoik, et autres
Publié: (2025)
Pixel-Level Pavement Distress Assessment Using Instance Segmentation
par: Dewick, Logan, et autres
Publié: (2026)
par: Dewick, Logan, et autres
Publié: (2026)
Vi-SAFE: A Spatial-Temporal Framework for Efficient Violence Detection in Public Surveillance
par: Chang, Ligang, et autres
Publié: (2025)
par: Chang, Ligang, et autres
Publié: (2025)
A Reverse Causal Framework to Mitigate Spurious Correlations for Debiasing Scene Graph Generation
par: Sun, Shuzhou, et autres
Publié: (2025)
par: Sun, Shuzhou, et autres
Publié: (2025)
Action Anticipation from SoccerNet Football Video Broadcasts
par: Dalal, Mohamad, et autres
Publié: (2025)
par: Dalal, Mohamad, et autres
Publié: (2025)
Documents similaires
-
Beyond Vision: Contextually Enriched Image Captioning with Multi-Modal Retrieval
par: Quy, Nguyen Lam Phu, et autres
Publié: (2025) -
CLIP-Joint-Detect: End-to-End Joint Training of Object Detectors with Contrastive Vision-Language Supervision
par: Raoufi, Behnam, et autres
Publié: (2025) -
Detecting Legend Items on Historical Maps Using GPT-4o with In-Context Learning
par: Kirsanova, Sofia, et autres
Publié: (2025) -
From eye to AI: studying rodent social behavior in the era of machine Learning
par: Chindemi, Giuseppe, et autres
Publié: (2025) -
DualPrompt-MedCap: A Dual-Prompt Enhanced Approach for Medical Image Captioning
par: Zhao, Yining, et autres
Publié: (2025)