Enregistré dans:
| Auteurs principaux: | Wu, Qingyu, Han, Yuxuan, Li, Haijun, Xu, Zhao, Zhao, Jianshan, Jin, Xu, Wang, Longyue, Luo, Weihua |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2602.07014 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Collaborative AI Enhances Image Understanding in Materials Science
par: Yin, Ruoyan Avery, et autres
Publié: (2025)
par: Yin, Ruoyan Avery, et autres
Publié: (2025)
SUN Team's Contribution to ABAW 2024 Competition: Audio-visual Valence-Arousal Estimation and Expression Recognition
par: Dresvyanskiy, Denis, et autres
Publié: (2024)
par: Dresvyanskiy, Denis, et autres
Publié: (2024)
OmniAcc: Personalized Accessibility Assistant Using Generative AI
par: Karki, Siddhant, et autres
Publié: (2025)
par: Karki, Siddhant, et autres
Publié: (2025)
Precision at Scale: Domain-Specific Datasets On-Demand
par: Rodríguez-de-Vera, Jesús M, et autres
Publié: (2024)
par: Rodríguez-de-Vera, Jesús M, et autres
Publié: (2024)
Lightweight Low-SNR-Robust Semantic Communication System for Autonomous Driving
par: Ren, Ruixing, et autres
Publié: (2026)
par: Ren, Ruixing, et autres
Publié: (2026)
CLIP-Joint-Detect: End-to-End Joint Training of Object Detectors with Contrastive Vision-Language Supervision
par: Raoufi, Behnam, et autres
Publié: (2025)
par: Raoufi, Behnam, et autres
Publié: (2025)
Ultra-Reduced-Impact-Encased-Logging (URIEL): propose a new method for selective sustainable logging and post-harvest silvicultural treatment in tropical forest using airborne robotics systems
par: Albiero, Daniel, et autres
Publié: (2026)
par: Albiero, Daniel, et autres
Publié: (2026)
FlightScope: An Experimental Comparative Review of Aircraft Detection Algorithms in Satellite Imagery
par: Ghazouali, Safouane El, et autres
Publié: (2024)
par: Ghazouali, Safouane El, et autres
Publié: (2024)
Step-CoT: Stepwise Visual Chain-of-Thought for Medical Visual Question Answering
par: Fan, Lin, et autres
Publié: (2026)
par: Fan, Lin, et autres
Publié: (2026)
Habitat Classification from Ground-Level Imagery Using Deep Neural Networks
par: Shi, Hongrui, et autres
Publié: (2025)
par: Shi, Hongrui, et autres
Publié: (2025)
Deep Learning methodology for the identification of wood species using high-resolution macroscopic images
par: Herrera-Poyatos, David, et autres
Publié: (2024)
par: Herrera-Poyatos, David, et autres
Publié: (2024)
AI-Dentify: Deep learning for proximal caries detection on bitewing x-ray -- HUNT4 Oral Health Study
par: de Frutos, Javier Pérez, et autres
Publié: (2023)
par: de Frutos, Javier Pérez, et autres
Publié: (2023)
U-Net-Like Spiking Neural Networks for Single Image Dehazing
par: Li, Huibin, et autres
Publié: (2025)
par: Li, Huibin, et autres
Publié: (2025)
GroundCap: A Visually Grounded Image Captioning Dataset
par: Oliveira, Daniel A. P., et autres
Publié: (2025)
par: Oliveira, Daniel A. P., et autres
Publié: (2025)
OpenMap: Instruction Grounding via Open-Vocabulary Visual-Language Mapping
par: Li, Danyang, et autres
Publié: (2025)
par: Li, Danyang, et autres
Publié: (2025)
Evaluation Metric for Quality Control and Generative Models in Histopathology Images
par: Jeevan, Pranav, et autres
Publié: (2024)
par: Jeevan, Pranav, et autres
Publié: (2024)
ICG: Improving Cover Image Generation via MLLM-based Prompting and Personalized Preference Alignment
par: Bian, Zhipeng, et autres
Publié: (2026)
par: Bian, Zhipeng, et autres
Publié: (2026)
Decoupling Vision and Language: Codebook Anchored Visual Adaptation
par: Wu, Jason, et autres
Publié: (2026)
par: Wu, Jason, et autres
Publié: (2026)
H-FCBFormer Hierarchical Fully Convolutional Branch Transformer for Occlusal Contact Segmentation with Articulating Paper
par: Banks, Ryan, et autres
Publié: (2024)
par: Banks, Ryan, et autres
Publié: (2024)
PhysNote: Self-Knowledge Notes for Evolvable Physical Reasoning in Vision-Language Model
par: Zhang, Sinin, et autres
Publié: (2026)
par: Zhang, Sinin, et autres
Publié: (2026)
A Grounded Memory System For Smart Personal Assistants
par: Ocker, Felix, et autres
Publié: (2025)
par: Ocker, Felix, et autres
Publié: (2025)
Hybrid Image Resolution Quality Metric (HIRQM):A Comprehensive Perceptual Image Quality Assessment Framework
par: Mondem, Vineesh Kumar Reddy
Publié: (2025)
par: Mondem, Vineesh Kumar Reddy
Publié: (2025)
ADPv2: A Hierarchical Histological Tissue Type-Annotated Dataset for Potential Biomarker Discovery of Colorectal Disease
par: Yang, Zhiyuan, et autres
Publié: (2025)
par: Yang, Zhiyuan, et autres
Publié: (2025)
IMUVIE: Pickup Timeline Action Localization via Motion Movies
par: Clapham, John, et autres
Publié: (2024)
par: Clapham, John, et autres
Publié: (2024)
NeuGrasp: Generalizable Neural Surface Reconstruction with Background Priors for Material-Agnostic Object Grasp Detection
par: Fan, Qingyu, et autres
Publié: (2025)
par: Fan, Qingyu, et autres
Publié: (2025)
Physics-R1: An Audited Olympiad Corpus and Recipe for Visual Physics Reasoning
par: Yang, Shan
Publié: (2026)
par: Yang, Shan
Publié: (2026)
CCVA-FL: Cross-Client Variations Adaptive Federated Learning for Medical Imaging
par: Gupta, Sunny, et autres
Publié: (2024)
par: Gupta, Sunny, et autres
Publié: (2024)
Normalizing Flow-Based Metric for Image Generation
par: Jeevan, Pranav, et autres
Publié: (2024)
par: Jeevan, Pranav, et autres
Publié: (2024)
UAV-assisted Visual SLAM Generating Reconstructed 3D Scene Graphs in GPS-denied Environments
par: Radwan, Ahmed, et autres
Publié: (2024)
par: Radwan, Ahmed, et autres
Publié: (2024)
Taming the Tail: Leveraging Asymmetric Loss and Pade Approximation to Overcome Medical Image Long-Tailed Class Imbalance
par: Kashyap, Pankhi, et autres
Publié: (2024)
par: Kashyap, Pankhi, et autres
Publié: (2024)
Open Gaze: Open Source eye tracker for smartphone devices using Deep Learning
par: reddy, Sushmanth, et autres
Publié: (2023)
par: reddy, Sushmanth, et autres
Publié: (2023)
YETI (YET to Intervene) Proactive Interventions by Multimodal AI Agents in Augmented Reality Tasks
par: Bandyopadhyay, Saptarashmi, et autres
Publié: (2025)
par: Bandyopadhyay, Saptarashmi, et autres
Publié: (2025)
Analyzing Quality, Bias, and Performance in Text-to-Image Generative Models
par: Masrourisaadat, Nila, et autres
Publié: (2024)
par: Masrourisaadat, Nila, et autres
Publié: (2024)
Visible Iris Area as a Quality Metric for Reliable Iris Recognition Under Pupil Dilation and Eyelid Occlusion
par: Pessaud, Jack, et autres
Publié: (2025)
par: Pessaud, Jack, et autres
Publié: (2025)
CrystalDiT: A Diffusion Transformer for Crystal Generation
par: Yi, Xiaohan, et autres
Publié: (2025)
par: Yi, Xiaohan, et autres
Publié: (2025)
Boundary-Protection W8A8 HiFloat8 Quantization for Large-Scale Text-to-Video Diffusion Transformers
par: Zhao, Yiming
Publié: (2026)
par: Zhao, Yiming
Publié: (2026)
Single-Shot Metric Depth from Focused Plenoptic Cameras
par: Lasheras-Hernandez, Blanca, et autres
Publié: (2024)
par: Lasheras-Hernandez, Blanca, et autres
Publié: (2024)
Beyond Localization: A Comprehensive Diagnosis of Perspective-Conditioned Spatial Reasoning in MLLMs from Omnidirectional Images
par: Chen, Yuangong, et autres
Publié: (2026)
par: Chen, Yuangong, et autres
Publié: (2026)
AGOP as Explanation: From Feature Learning to Per-Sample Attribution in Image Classifiers
par: Katakam, Raj Kiran Gupta
Publié: (2026)
par: Katakam, Raj Kiran Gupta
Publié: (2026)
Application of Sensitivity Analysis Methods for Studying Neural Network Models
par: Miao, Jiaxuan, et autres
Publié: (2025)
par: Miao, Jiaxuan, et autres
Publié: (2025)
Documents similaires
-
Collaborative AI Enhances Image Understanding in Materials Science
par: Yin, Ruoyan Avery, et autres
Publié: (2025) -
SUN Team's Contribution to ABAW 2024 Competition: Audio-visual Valence-Arousal Estimation and Expression Recognition
par: Dresvyanskiy, Denis, et autres
Publié: (2024) -
OmniAcc: Personalized Accessibility Assistant Using Generative AI
par: Karki, Siddhant, et autres
Publié: (2025) -
Precision at Scale: Domain-Specific Datasets On-Demand
par: Rodríguez-de-Vera, Jesús M, et autres
Publié: (2024) -
Lightweight Low-SNR-Robust Semantic Communication System for Autonomous Driving
par: Ren, Ruixing, et autres
Publié: (2026)