MNIST-Gen: A Modular MNIST-Style Dataset Generation Using Hierarchical Semantics, Reinforcement Learning, and Category Theory
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Shaeri, Pouya, Karimi, Arash, Middel, Ariane |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Explainable Human-in-the-Loop Segmentation via Critic Feedback Signals
par: Shaeri, Pouya, et autres
Publié: (2025)
par: Shaeri, Pouya, et autres
Publié: (2025)
A Multimodal Physics-Informed Neural Network Approach for Mean Radiant Temperature Modeling
par: Shaeri, Pouya, et autres
Publié: (2025)
par: Shaeri, Pouya, et autres
Publié: (2025)
GenColor: Generative Color-Concept Association in Visual Design
par: Hou, Yihan, et autres
Publié: (2025)
par: Hou, Yihan, et autres
Publié: (2025)
Iris Style Transfer: Enhancing Iris Recognition with Style Features and Privacy Preservation through Neural Style Transfer
par: Wang, Mengdi, et autres
Publié: (2025)
par: Wang, Mengdi, et autres
Publié: (2025)
Bridging Text and Image for Artist Style Transfer via Contrastive Learning
par: Liu, Zhi-Song, et autres
Publié: (2024)
par: Liu, Zhi-Song, et autres
Publié: (2024)
L-WISE: Boosting Human Visual Category Learning Through Model-Based Image Selection and Enhancement
par: Talbot, Morgan B., et autres
Publié: (2024)
par: Talbot, Morgan B., et autres
Publié: (2024)
Beyond Object Categories: Multi-Attribute Reference Understanding for Visual Grounding
par: Guo, Hao, et autres
Publié: (2025)
par: Guo, Hao, et autres
Publié: (2025)
Category-aware EEG image generation based on wavelet transform and contrast semantic loss
par: Zhang, Enshang, et autres
Publié: (2025)
par: Zhang, Enshang, et autres
Publié: (2025)
PoseDriver: A Unified Approach to Multi-Category Skeleton Detection for Autonomous Driving
par: Borhani, Yasamin, et autres
Publié: (2026)
par: Borhani, Yasamin, et autres
Publié: (2026)
Conveying Meaning through Gestures: An Investigation into Semantic Co-Speech Gesture Generation
par: Voss, Hendric, et autres
Publié: (2025)
par: Voss, Hendric, et autres
Publié: (2025)
CinePreGen: Camera Controllable Video Previsualization via Engine-powered Diffusion
par: Chen, Yiran, et autres
Publié: (2024)
par: Chen, Yiran, et autres
Publié: (2024)
A Survey of Body and Face Motion: Datasets, Performance Evaluation Metrics and Generative Techniques
par: Sookha, Lownish Rai, et autres
Publié: (2025)
par: Sookha, Lownish Rai, et autres
Publié: (2025)
SketchFlex: Facilitating Spatial-Semantic Coherence in Text-to-Image Generation with Region-Based Sketches
par: Lin, Haichuan, et autres
Publié: (2025)
par: Lin, Haichuan, et autres
Publié: (2025)
ImaGGen: Zero-Shot Generation of Co-Speech Semantic Gestures Grounded in Language and Image Input
par: Voss, Hendric, et autres
Publié: (2025)
par: Voss, Hendric, et autres
Publié: (2025)
EduGage: Methods and Dataset for Sensor-Based Momentary Assessment of Engagement in Self-Guided Video Learning
par: Leng, Zikang, et autres
Publié: (2026)
par: Leng, Zikang, et autres
Publié: (2026)
HaDR: Applying Domain Randomization for Generating Synthetic Multimodal Dataset for Hand Instance Segmentation in Cluttered Industrial Environments
par: Grushko, Stefan, et autres
Publié: (2023)
par: Grushko, Stefan, et autres
Publié: (2023)
Surgment: Segmentation-enabled Semantic Search and Creation of Visual Question and Feedback to Support Video-Based Surgery Learning
par: Wang, Jingying, et autres
Publié: (2024)
par: Wang, Jingying, et autres
Publié: (2024)
Semantic Draw Engineering for Text-to-Image Creation
par: Li, Yang, et autres
Publié: (2023)
par: Li, Yang, et autres
Publié: (2023)
Oracle-MNIST: a Dataset of Oracle Characters for Benchmarking Machine Learning Algorithms
par: Wang, Mei, et autres
Publié: (2022)
par: Wang, Mei, et autres
Publié: (2022)
AgentSense: Virtual Sensor Data Generation Using LLM Agents in Simulated Home Environments
par: Leng, Zikang, et autres
Publié: (2025)
par: Leng, Zikang, et autres
Publié: (2025)
Rehabilitation Exercise Quality Assessment and Feedback Generation Using Large Language Models with Prompt Engineering
par: Tang, Jessica, et autres
Publié: (2025)
par: Tang, Jessica, et autres
Publié: (2025)
ChartGen: Scaling Chart Understanding Via Code-Guided Synthetic Chart Generation
par: Kondic, Jovana, et autres
Publié: (2025)
par: Kondic, Jovana, et autres
Publié: (2025)
Confidence Contours: Uncertainty-Aware Annotation for Medical Semantic Segmentation
par: Ye, Andre, et autres
Publié: (2023)
par: Ye, Andre, et autres
Publié: (2023)
SemLayer: Semantic-aware Generative Segmentation and Layer Construction for Abstract Icons
par: Xu, Haiyang, et autres
Publié: (2026)
par: Xu, Haiyang, et autres
Publié: (2026)
Collection Space Navigator: An Interactive Visualization Interface for Multidimensional Datasets
par: Ohm, Tillmann, et autres
Publié: (2023)
par: Ohm, Tillmann, et autres
Publié: (2023)
Weak-Annotation of HAR Datasets using Vision Foundation Models
par: Bock, Marius, et autres
Publié: (2024)
par: Bock, Marius, et autres
Publié: (2024)
WEAR: An Outdoor Sports Dataset for Wearable and Egocentric Activity Recognition
par: Bock, Marius, et autres
Publié: (2023)
par: Bock, Marius, et autres
Publié: (2023)
Positive-First Most Ambiguous: A Simple Active Learning Criterion for Interactive Retrieval of Rare Categories
par: Zaher, Kawtar, et autres
Publié: (2026)
par: Zaher, Kawtar, et autres
Publié: (2026)
Visual Neural Decoding via Improved Visual-EEG Semantic Consistency
par: Chen, Hongzhou, et autres
Publié: (2024)
par: Chen, Hongzhou, et autres
Publié: (2024)
Aria Gen 2 Pilot Dataset
par: Kong, Chen, et autres
Publié: (2025)
par: Kong, Chen, et autres
Publié: (2025)
SimVecVis: A Dataset for Enhancing MLLMs in Visualization Understanding
par: Liu, Can, et autres
Publié: (2025)
par: Liu, Can, et autres
Publié: (2025)
VideoA11y: Method and Dataset for Accessible Video Description
par: Li, Chaoyu, et autres
Publié: (2025)
par: Li, Chaoyu, et autres
Publié: (2025)
A Multimodal Dataset of Student Oral Presentations with Sensors and Evaluation Data
par: Becerra, Alvaro, et autres
Publié: (2026)
par: Becerra, Alvaro, et autres
Publié: (2026)
Adaptive 3D UI Placement in Mixed Reality Using Deep Reinforcement Learning
par: Lu, Feiyu, et autres
Publié: (2025)
par: Lu, Feiyu, et autres
Publié: (2025)
A Dataset for Crucial Object Recognition in Blind and Low-Vision Individuals' Navigation
par: Islam, Md Touhidul, et autres
Publié: (2024)
par: Islam, Md Touhidul, et autres
Publié: (2024)
EgoPressure: A Dataset for Hand Pressure and Pose Estimation in Egocentric Vision
par: Zhao, Yiming, et autres
Publié: (2024)
par: Zhao, Yiming, et autres
Publié: (2024)
Time-Resolved MNIST Dataset for Single-Photon Recognition
par: Suonsivu, Aleksi, et autres
Publié: (2024)
par: Suonsivu, Aleksi, et autres
Publié: (2024)
M2LADS Demo: A System for Generating Multimodal Learning Analytics Dashboards
par: Becerra, Alvaro, et autres
Publié: (2025)
par: Becerra, Alvaro, et autres
Publié: (2025)
Not all Blends are Equal: The BLEMORE Dataset of Blended Emotion Expressions with Relative Salience Annotations
par: Lachmann, Tim, et autres
Publié: (2026)
par: Lachmann, Tim, et autres
Publié: (2026)
E-ANT: A Large-Scale Dataset for Efficient Automatic GUI NavigaTion
par: Wang, Ke, et autres
Publié: (2024)
par: Wang, Ke, et autres
Publié: (2024)
Documents similaires
-
Explainable Human-in-the-Loop Segmentation via Critic Feedback Signals
par: Shaeri, Pouya, et autres
Publié: (2025) -
A Multimodal Physics-Informed Neural Network Approach for Mean Radiant Temperature Modeling
par: Shaeri, Pouya, et autres
Publié: (2025) -
GenColor: Generative Color-Concept Association in Visual Design
par: Hou, Yihan, et autres
Publié: (2025) -
Iris Style Transfer: Enhancing Iris Recognition with Style Features and Privacy Preservation through Neural Style Transfer
par: Wang, Mengdi, et autres
Publié: (2025) -
Bridging Text and Image for Artist Style Transfer via Contrastive Learning
par: Liu, Zhi-Song, et autres
Publié: (2024)