Crowdsourcing of Real-world Image Annotation via Visual Properties
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Diao, Xiaolei, Giunchiglia, Fausto |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
What can Computer Vision learn from Ranganathan?
par: Bagchi, Mayukh, et autres
Publié: (2026)
par: Bagchi, Mayukh, et autres
Publié: (2026)
Adversarial Testing for Visual Grounding via Image-Aware Property Reduction
par: Chang, Zhiyuan, et autres
Publié: (2024)
par: Chang, Zhiyuan, et autres
Publié: (2024)
MedVR: Annotation-Free Medical Visual Reasoning via Agentic Reinforcement Learning
par: Jiang, Zheng, et autres
Publié: (2026)
par: Jiang, Zheng, et autres
Publié: (2026)
CHUG: Crowdsourced User-Generated HDR Video Quality Dataset
par: Saini, Shreshth, et autres
Publié: (2025)
par: Saini, Shreshth, et autres
Publié: (2025)
Automatic Image-Level Morphological Trait Annotation for Organismal Images
par: Pahuja, Vardaan, et autres
Publié: (2026)
par: Pahuja, Vardaan, et autres
Publié: (2026)
KARST: Multi-Kernel Kronecker Adaptation with Re-Scaling Transmission for Visual Classification
par: Zhu, Yue, et autres
Publié: (2025)
par: Zhu, Yue, et autres
Publié: (2025)
Weakly-supervised Medical Image Segmentation with Gaze Annotations
par: Zhong, Yuan, et autres
Publié: (2024)
par: Zhong, Yuan, et autres
Publié: (2024)
WorldSense: Evaluating Real-world Omnimodal Understanding for Multimodal LLMs
par: Hong, Jack, et autres
Publié: (2025)
par: Hong, Jack, et autres
Publié: (2025)
LICA: Layered Image Composition Annotations for Graphic Design Research
par: Hirsch, Elad, et autres
Publié: (2026)
par: Hirsch, Elad, et autres
Publié: (2026)
Adding Thermal Awareness to Visual Systems in Real-Time via Distilled Diffusion Models
par: Guo, Yuchen, et autres
Publié: (2026)
par: Guo, Yuchen, et autres
Publié: (2026)
RealGeneral: Unifying Visual Generation via Temporal In-Context Learning with Video Models
par: Lin, Yijing, et autres
Publié: (2025)
par: Lin, Yijing, et autres
Publié: (2025)
EFCM: Efficient Fine-tuning on Compressed Models for deployment of large models in medical image analysis
par: Li, Shaojie, et autres
Publié: (2024)
par: Li, Shaojie, et autres
Publié: (2024)
DCS-ST for Classification of Breast Cancer Histopathology Images with Limited Annotations
par: Suxing, Liu, et autres
Publié: (2025)
par: Suxing, Liu, et autres
Publié: (2025)
FedIA: Federated Medical Image Segmentation with Heterogeneous Annotation Completeness
par: Xiang, Yangyang, et autres
Publié: (2024)
par: Xiang, Yangyang, et autres
Publié: (2024)
BadSR: Stealthy Label Backdoor Attacks on Image Super-Resolution
par: Guo, Ji, et autres
Publié: (2025)
par: Guo, Ji, et autres
Publié: (2025)
OpenMoCap: Rethinking Optical Motion Capture under Real-world Occlusion
par: Qian, Chen, et autres
Publié: (2025)
par: Qian, Chen, et autres
Publié: (2025)
Diffusion Curriculum: Synthetic-to-Real Data Curriculum via Image-Guided Diffusion
par: Liang, Yijun, et autres
Publié: (2024)
par: Liang, Yijun, et autres
Publié: (2024)
RealGen: Photorealistic Text-to-Image Generation via Detector-Guided Rewards
par: Ye, Junyan, et autres
Publié: (2025)
par: Ye, Junyan, et autres
Publié: (2025)
From Simple to Professional: A Combinatorial Controllable Image Captioning Agent
par: Wang, Xinran, et autres
Publié: (2024)
par: Wang, Xinran, et autres
Publié: (2024)
WebChain: A Large-Scale Human-Annotated Dataset of Real-World Web Interaction Traces
par: Fan, Sicheng, et autres
Publié: (2026)
par: Fan, Sicheng, et autres
Publié: (2026)
Exploring Annotation-free Image Captioning with Retrieval-augmented Pseudo Sentence Generation
par: Li, Zhiyuan, et autres
Publié: (2023)
par: Li, Zhiyuan, et autres
Publié: (2023)
REMOTE: Real-time Ego-motion Tracking for Various Endoscopes via Multimodal Visual Feature Learning
par: Shao, Liangjing, et autres
Publié: (2025)
par: Shao, Liangjing, et autres
Publié: (2025)
StyleVAR: Controllable Image Style Transfer via Visual Autoregressive Modeling
par: Jing, Liqi, et autres
Publié: (2026)
par: Jing, Liqi, et autres
Publié: (2026)
Textual and Visual Prompt Fusion for Image Editing via Step-Wise Alignment
par: Feng, Zhanbo, et autres
Publié: (2023)
par: Feng, Zhanbo, et autres
Publié: (2023)
Visual Autoregressive Modeling: Scalable Image Generation via Next-Scale Prediction
par: Tian, Keyu, et autres
Publié: (2024)
par: Tian, Keyu, et autres
Publié: (2024)
Evaluating the Effectiveness of Video Anomaly Detection in the Wild: Online Learning and Inference for Real-world Deployment
par: Yao, Shanle, et autres
Publié: (2024)
par: Yao, Shanle, et autres
Publié: (2024)
Is this Generated Person Existed in Real-world? Fine-grained Detecting and Calibrating Abnormal Human-body
par: Wang, Zeqing, et autres
Publié: (2024)
par: Wang, Zeqing, et autres
Publié: (2024)
STARFlow: Spatial Temporal Feature Re-embedding with Attentive Learning for Real-world Scene Flow
par: Lu, Zhiyang, et autres
Publié: (2024)
par: Lu, Zhiyang, et autres
Publié: (2024)
SSRFlow: Semantic-aware Fusion with Spatial Temporal Re-embedding for Real-world Scene Flow
par: Lu, Zhiyang, et autres
Publié: (2024)
par: Lu, Zhiyang, et autres
Publié: (2024)
Zero-Shot Automatic Annotation and Instance Segmentation using LLM-Generated Datasets: Eliminating Field Imaging and Manual Annotation for Deep Learning Model Development
par: Sapkota, Ranjan, et autres
Publié: (2024)
par: Sapkota, Ranjan, et autres
Publié: (2024)
Imagine for Me: Creative Conceptual Blending of Real Images and Text via Blended Attention
par: Cho, Wonwoong, et autres
Publié: (2025)
par: Cho, Wonwoong, et autres
Publié: (2025)
Real-Time Visual Attribution Streaming in Thinking Model
par: Kang, Seil, et autres
Publié: (2026)
par: Kang, Seil, et autres
Publié: (2026)
DriveGenVLM: Real-world Video Generation for Vision Language Model based Autonomous Driving
par: Fu, Yongjie, et autres
Publié: (2024)
par: Fu, Yongjie, et autres
Publié: (2024)
Enhancing Geo-localization for Crowdsourced Flood Imagery via LLM-Guided Attention
par: Xu, Fengyi, et autres
Publié: (2025)
par: Xu, Fengyi, et autres
Publié: (2025)
BrainVis: Exploring the Bridge between Brain and Visual Signals via Image Reconstruction
par: Fu, Honghao, et autres
Publié: (2023)
par: Fu, Honghao, et autres
Publié: (2023)
Divide, Weight, and Route: Difficulty-Aware Optimization with Dynamic Expert Fusion for Long-tailed Recognition
par: Wei, Xiaolei, et autres
Publié: (2025)
par: Wei, Xiaolei, et autres
Publié: (2025)
Real-Time On-the-Go Annotation Framework Using YOLO for Automated Dataset Generation
par: Salem, Mohamed Abdallah, et autres
Publié: (2025)
par: Salem, Mohamed Abdallah, et autres
Publié: (2025)
GUIDE: Resolving Domain Bias in GUI Agents through Real-Time Web Video Retrieval and Plug-and-Play Annotation
par: Xie, Rui, et autres
Publié: (2026)
par: Xie, Rui, et autres
Publié: (2026)
A Study of Commonsense Reasoning over Visual Object Properties
par: Kolari, Abhishek, et autres
Publié: (2025)
par: Kolari, Abhishek, et autres
Publié: (2025)
Affinity-Graph-Guided Contractive Learning for Pretext-Free Medical Image Segmentation with Minimal Annotation
par: Cheng, Zehua, et autres
Publié: (2024)
par: Cheng, Zehua, et autres
Publié: (2024)
Documents similaires
-
What can Computer Vision learn from Ranganathan?
par: Bagchi, Mayukh, et autres
Publié: (2026) -
Adversarial Testing for Visual Grounding via Image-Aware Property Reduction
par: Chang, Zhiyuan, et autres
Publié: (2024) -
MedVR: Annotation-Free Medical Visual Reasoning via Agentic Reinforcement Learning
par: Jiang, Zheng, et autres
Publié: (2026) -
CHUG: Crowdsourced User-Generated HDR Video Quality Dataset
par: Saini, Shreshth, et autres
Publié: (2025) -
Automatic Image-Level Morphological Trait Annotation for Organismal Images
par: Pahuja, Vardaan, et autres
Publié: (2026)