Guardado en:
| Autores principales: | Galatolo, Gabriele, Nanni, Mirco |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2512.07415 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Early Explorations of Lightweight Models for Wound Segmentation on Mobile Devices
por: Borst, Vanessa, et al.
Publicado: (2024)
por: Borst, Vanessa, et al.
Publicado: (2024)
Learning Generative Interactive Environments By Trained Agent Exploration
por: Kazemi, Naser, et al.
Publicado: (2024)
por: Kazemi, Naser, et al.
Publicado: (2024)
Visual RAG: Expanding MLLM visual knowledge without fine-tuning
por: Bonomo, Mirco, et al.
Publicado: (2025)
por: Bonomo, Mirco, et al.
Publicado: (2025)
LEPA: Learning Geometric Equivariance in Satellite Remote Sensing Data with a Predictive Architecture
por: Scheurer, Erik, et al.
Publicado: (2026)
por: Scheurer, Erik, et al.
Publicado: (2026)
ULS+: Data-driven Model Adaptation Enhances Lesion Segmentation
por: Weber, Rianne, et al.
Publicado: (2026)
por: Weber, Rianne, et al.
Publicado: (2026)
GenHOI: Generalizing Text-driven 4D Human-Object Interaction Synthesis for Unseen Objects
por: Li, Shujia, et al.
Publicado: (2025)
por: Li, Shujia, et al.
Publicado: (2025)
PQ-DAF: Pose-driven Quality-controlled Data Augmentation for Data-scarce Driver Distraction Detection
por: Sun, Haibin, et al.
Publicado: (2025)
por: Sun, Haibin, et al.
Publicado: (2025)
M$^2$-Miner: Multi-Agent Enhanced MCTS for Mobile GUI Agent Data Mining
por: Lv, Rui, et al.
Publicado: (2026)
por: Lv, Rui, et al.
Publicado: (2026)
MobileAgeNet: Lightweight Facial Age Estimation for Mobile Deployment
por: Kumar, Arun, et al.
Publicado: (2026)
por: Kumar, Arun, et al.
Publicado: (2026)
Mini-o3: Scaling Up Reasoning Patterns and Interaction Turns for Visual Search
por: Lai, Xin, et al.
Publicado: (2025)
por: Lai, Xin, et al.
Publicado: (2025)
Mobile Video Diffusion
por: Yahia, Haitam Ben, et al.
Publicado: (2024)
por: Yahia, Haitam Ben, et al.
Publicado: (2024)
Finding Lottery Tickets in Vision Models via Data-driven Spectral Foresight Pruning
por: Iurada, Leonardo, et al.
Publicado: (2024)
por: Iurada, Leonardo, et al.
Publicado: (2024)
Exploration of Reproducible Generated Image Detection
por: Duan, Yihang
Publicado: (2025)
por: Duan, Yihang
Publicado: (2025)
MobilePortrait: Real-Time One-Shot Neural Head Avatars on Mobile Devices
por: Jiang, Jianwen, et al.
Publicado: (2024)
por: Jiang, Jianwen, et al.
Publicado: (2024)
Comprehensive Exploration of Synthetic Data Generation: A Survey
por: Bauer, André, et al.
Publicado: (2024)
por: Bauer, André, et al.
Publicado: (2024)
VERSE: Visual Embedding Reduction and Space Exploration. Clustering-Guided Insights for Training Data Enhancement in Visually-Rich Document Understanding
por: de Rodrigo, Ignacio, et al.
Publicado: (2026)
por: de Rodrigo, Ignacio, et al.
Publicado: (2026)
PQV-Mobile: A Combined Pruning and Quantization Toolkit to Optimize Vision Transformers for Mobile Applications
por: Bhardwaj, Kshitij
Publicado: (2024)
por: Bhardwaj, Kshitij
Publicado: (2024)
Visual Prompt Discovery via Semantic Exploration
por: Kim, Jaechang, et al.
Publicado: (2026)
por: Kim, Jaechang, et al.
Publicado: (2026)
ConsNoTrainLoRA: Data-driven Weight Initialization of Low-rank Adapters using Constraints
por: Das, Debasmit, et al.
Publicado: (2025)
por: Das, Debasmit, et al.
Publicado: (2025)
From Neurons to Computation: Biological Reservoir Computing for Pattern Recognition
por: Iannello, Ludovico, et al.
Publicado: (2025)
por: Iannello, Ludovico, et al.
Publicado: (2025)
Sekai: A Video Dataset towards World Exploration
por: Li, Zhen, et al.
Publicado: (2025)
por: Li, Zhen, et al.
Publicado: (2025)
Apollo: An Exploration of Video Understanding in Large Multimodal Models
por: Zohar, Orr, et al.
Publicado: (2024)
por: Zohar, Orr, et al.
Publicado: (2024)
Manifold-Aware Exploration for Reinforcement Learning in Video Generation
por: Zheng, Mingzhe, et al.
Publicado: (2026)
por: Zheng, Mingzhe, et al.
Publicado: (2026)
From Neural Activity to Computation: Biological Reservoirs for Pattern Recognition in Digit Classification
por: Iannello, Ludovico, et al.
Publicado: (2025)
por: Iannello, Ludovico, et al.
Publicado: (2025)
Socratic-Geo: Synthetic Data Generation and Geometric Reasoning via Multi-Agent Interaction
por: Jiao, Zhengbo, et al.
Publicado: (2026)
por: Jiao, Zhengbo, et al.
Publicado: (2026)
Twisted Convolutional Networks (TCNs): Enhancing Feature Interactions for Non-Spatial Data Classification
por: Lian, Junbo Jacob, et al.
Publicado: (2024)
por: Lian, Junbo Jacob, et al.
Publicado: (2024)
GUI-Xplore: Empowering Generalizable GUI Agents with One Exploration
por: Sun, Yuchen, et al.
Publicado: (2025)
por: Sun, Yuchen, et al.
Publicado: (2025)
Colors Matter: AI-Driven Exploration of Human Feature Colors
por: Alyoubi, Rama, et al.
Publicado: (2025)
por: Alyoubi, Rama, et al.
Publicado: (2025)
Iterative Zoom-In: Temporal Interval Exploration for Long Video Understanding
por: Li, Chenglin, et al.
Publicado: (2025)
por: Li, Chenglin, et al.
Publicado: (2025)
From Question to Exploration: Test-Time Adaptation in Semantic Segmentation?
por: Yi, Chang'an, et al.
Publicado: (2023)
por: Yi, Chang'an, et al.
Publicado: (2023)
Enhancing Human-Computer Interaction in Chest X-ray Analysis using Vision and Language Model with Eye Gaze Patterns
por: Kim, Yunsoo, et al.
Publicado: (2024)
por: Kim, Yunsoo, et al.
Publicado: (2024)
Mobile-Seed: Joint Semantic Segmentation and Boundary Detection for Mobile Robots
por: Liao, Youqi, et al.
Publicado: (2023)
por: Liao, Youqi, et al.
Publicado: (2023)
An AI-Powered Autonomous Underwater System for Sea Exploration and Scientific Research
por: Almazrouei, Hamad, et al.
Publicado: (2025)
por: Almazrouei, Hamad, et al.
Publicado: (2025)
SAGE: Spuriousness-Aware Guided Prompt Exploration for Mitigating Multimodal Bias
por: Ye, Wenqian, et al.
Publicado: (2025)
por: Ye, Wenqian, et al.
Publicado: (2025)
Virgo: A Preliminary Exploration on Reproducing o1-like MLLM
por: Du, Yifan, et al.
Publicado: (2025)
por: Du, Yifan, et al.
Publicado: (2025)
Bayesian Exploration of Pre-trained Models for Low-shot Image Classification
por: Miao, Yibo, et al.
Publicado: (2024)
por: Miao, Yibo, et al.
Publicado: (2024)
Multi-path Exploration and Feedback Adjustment for Text-to-Image Person Retrieval
por: Kang, Bin, et al.
Publicado: (2024)
por: Kang, Bin, et al.
Publicado: (2024)
OptiScene: LLM-driven Indoor Scene Layout Generation via Scaled Human-aligned Data Synthesis and Multi-Stage Preference Optimization
por: Yang, Yixuan, et al.
Publicado: (2025)
por: Yang, Yixuan, et al.
Publicado: (2025)
Multimodal Mathematical Reasoning Embedded in Aerial Vehicle Imagery: Benchmarking, Analysis, and Exploration
por: Zhou, Yue, et al.
Publicado: (2025)
por: Zhou, Yue, et al.
Publicado: (2025)
HMID-Net: An Exploration of Masked Image Modeling and Knowledge Distillation in Hyperbolic Space
por: Wang, Changli, et al.
Publicado: (2025)
por: Wang, Changli, et al.
Publicado: (2025)
Ejemplares similares
-
Early Explorations of Lightweight Models for Wound Segmentation on Mobile Devices
por: Borst, Vanessa, et al.
Publicado: (2024) -
Learning Generative Interactive Environments By Trained Agent Exploration
por: Kazemi, Naser, et al.
Publicado: (2024) -
Visual RAG: Expanding MLLM visual knowledge without fine-tuning
por: Bonomo, Mirco, et al.
Publicado: (2025) -
LEPA: Learning Geometric Equivariance in Satellite Remote Sensing Data with a Predictive Architecture
por: Scheurer, Erik, et al.
Publicado: (2026) -
ULS+: Data-driven Model Adaptation Enhances Lesion Segmentation
por: Weber, Rianne, et al.
Publicado: (2026)