TaxaDiffusion: Progressively Trained Diffusion Model for Fine-Grained Species Generation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Monsefi, Amin Karimi, Khurana, Mridul, Ramnath, Rajiv, Karpatne, Anuj, Chao, Wei-Lun, Zhang, Cheng |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
TaxaAdapter: Vision Taxonomy Models are Key to Fine-grained Image Generation over the Tree of Life
par: Khurana, Mridul, et autres
Publié: (2026)
par: Khurana, Mridul, et autres
Publié: (2026)
SeamCam: Quantifying Seamless Camouflage via Multi-Cue Visual Detectability
par: Monsefi, Amin Karimi, et autres
Publié: (2026)
par: Monsefi, Amin Karimi, et autres
Publié: (2026)
KnobGen: Controlling the Sophistication of Artwork in Sketch-Based Diffusion Models
par: Navard, Pouyan, et autres
Publié: (2024)
par: Navard, Pouyan, et autres
Publié: (2024)
Controlla: Learning Controllability via Graph-Constrained Latent Geometry
par: Murthy, Jamuna S., et autres
Publié: (2026)
par: Murthy, Jamuna S., et autres
Publié: (2026)
Frequency-Guided Masking for Enhanced Vision Self-Supervised Learning
par: Monsefi, Amin Karimi, et autres
Publié: (2024)
par: Monsefi, Amin Karimi, et autres
Publié: (2024)
DetailCLIP: Detail-Oriented CLIP for Fine-Grained Tasks
par: Monsefi, Amin Karimi, et autres
Publié: (2024)
par: Monsefi, Amin Karimi, et autres
Publié: (2024)
DiReCT: Disentangled Regularization of Contrastive Trajectories for Physics-Refined Video Generation
par: Meyarian, Abolfazl, et autres
Publié: (2026)
par: Meyarian, Abolfazl, et autres
Publié: (2026)
Hierarchical Conditioning of Diffusion Models Using Tree-of-Life for Studying Species Evolution
par: Khurana, Mridul, et autres
Publié: (2024)
par: Khurana, Mridul, et autres
Publié: (2024)
Beyond Loss Guidance: Using PDE Residuals as Spectral Attention in Diffusion Neural Operators
par: Sawhney, Medha, et autres
Publié: (2025)
par: Sawhney, Medha, et autres
Publié: (2025)
Masked LoGoNet: Fast and Accurate 3D Image Analysis for Medical Domain
par: Monsefi, Amin Karimi, et autres
Publié: (2024)
par: Monsefi, Amin Karimi, et autres
Publié: (2024)
Open World Scene Graph Generation using Vision Language Models
par: Dutta, Amartya, et autres
Publié: (2025)
par: Dutta, Amartya, et autres
Publié: (2025)
Prompt-CAM: Making Vision Transformers Interpretable for Fine-Grained Analysis
par: Chowdhury, Arpita, et autres
Publié: (2025)
par: Chowdhury, Arpita, et autres
Publié: (2025)
A Simple Interpretable Transformer for Fine-Grained Image Classification and Analysis
par: Paul, Dipanjyoti, et autres
Publié: (2023)
par: Paul, Dipanjyoti, et autres
Publié: (2023)
CrashFormer: A Multimodal Architecture to Predict the Risk of Crash
par: Monsefi, Amin Karimi, et autres
Publié: (2024)
par: Monsefi, Amin Karimi, et autres
Publié: (2024)
Face Adapter for Pre-Trained Diffusion Models with Fine-Grained ID and Attribute Control
par: Han, Yue, et autres
Publié: (2024)
par: Han, Yue, et autres
Publié: (2024)
PartEdit: Fine-Grained Image Editing using Pre-Trained Diffusion Models
par: Cvejic, Aleksandar, et autres
Publié: (2025)
par: Cvejic, Aleksandar, et autres
Publié: (2025)
ReasonAct: Progressive Training for Fine-Grained Video Reasoning in Small Models
par: Liu, Jiaxin, et autres
Publié: (2025)
par: Liu, Jiaxin, et autres
Publié: (2025)
Spectral Progressive Diffusion for Efficient Image and Video Generation
par: Xiao, Howard, et autres
Publié: (2026)
par: Xiao, Howard, et autres
Publié: (2026)
Finer-Personalization Rank: Fine-Grained Retrieval Examines Identity Preservation for Personalized Generation
par: Kilrain, Connor, et autres
Publié: (2025)
par: Kilrain, Connor, et autres
Publié: (2025)
Using Diffusion Priors for Video Amodal Segmentation
par: Chen, Kaihua, et autres
Publié: (2024)
par: Chen, Kaihua, et autres
Publié: (2024)
Fine-Grained Erasure in Text-to-Image Diffusion-based Foundation Models
par: Thakral, Kartik, et autres
Publié: (2025)
par: Thakral, Kartik, et autres
Publié: (2025)
Fish-Vista: A Multi-Purpose Dataset for Understanding & Identification of Traits from Images
par: Mehrab, Kazi Sajeed, et autres
Publié: (2024)
par: Mehrab, Kazi Sajeed, et autres
Publié: (2024)
Task-Oriented Human Grasp Synthesis via Context- and Task-Aware Diffusers
par: Liu, An-Lun, et autres
Publié: (2025)
par: Liu, An-Lun, et autres
Publié: (2025)
FineDiffusion: Scaling up Diffusion Models for Fine-grained Image Generation with 10,000 Classes
par: Pan, Ziying, et autres
Publié: (2024)
par: Pan, Ziying, et autres
Publié: (2024)
Prompt Sliders for Fine-Grained Control, Editing and Erasing of Concepts in Diffusion Models
par: Sridhar, Deepak, et autres
Publié: (2024)
par: Sridhar, Deepak, et autres
Publié: (2024)
DenseDPO: Fine-Grained Temporal Preference Optimization for Video Diffusion Models
par: Wu, Ziyi, et autres
Publié: (2025)
par: Wu, Ziyi, et autres
Publié: (2025)
Arena as Offline Reward: Efficient Fine-Grained Preference Optimization for Diffusion Models
par: Li, Zhikai, et autres
Publié: (2026)
par: Li, Zhikai, et autres
Publié: (2026)
AttriCtrl: Fine-Grained Control of Aesthetic Attribute Intensity in Diffusion Models
par: Chen, Die, et autres
Publié: (2025)
par: Chen, Die, et autres
Publié: (2025)
Step-level Reward for Free in RL-based T2I Diffusion Model Fine-tuning
par: Liao, Xinyao, et autres
Publié: (2025)
par: Liao, Xinyao, et autres
Publié: (2025)
DTGen: Generative Diffusion-Based Few-Shot Data Augmentation for Fine-Grained Dirty Tableware Recognition
par: Hao, Lifei, et autres
Publié: (2025)
par: Hao, Lifei, et autres
Publié: (2025)
Improving Fine-Grained Control via Aggregation of Multiple Diffusion Models
par: Yue, Conghan, et autres
Publié: (2024)
par: Yue, Conghan, et autres
Publié: (2024)
Consistent Diffusion: Denoising Diffusion Model with Data-Consistent Training for Image Restoration
par: Cheng, Xinlong, et autres
Publié: (2024)
par: Cheng, Xinlong, et autres
Publié: (2024)
PreciseControl: Enhancing Text-To-Image Diffusion Models with Fine-Grained Attribute Control
par: Parihar, Rishubh, et autres
Publié: (2024)
par: Parihar, Rishubh, et autres
Publié: (2024)
Chirpy3D: Part-Aware Multi-View Diffusion for Creative Fine-Grained Object Generation
par: Ng, Kam Woh, et autres
Publié: (2025)
par: Ng, Kam Woh, et autres
Publié: (2025)
FinePOSE: Fine-Grained Prompt-Driven 3D Human Pose Estimation via Diffusion Models
par: Xu, Jinglin, et autres
Publié: (2024)
par: Xu, Jinglin, et autres
Publié: (2024)
Anatomically Guided Latent Diffusion for Brain MRI Progression Modeling
par: Wan, Cheng, et autres
Publié: (2026)
par: Wan, Cheng, et autres
Publié: (2026)
BiTDiff: Fine-Grained 3D Conducting Motion Generation via BiMamba-Transformer Diffusion
par: Jia, Tianzhi, et autres
Publié: (2026)
par: Jia, Tianzhi, et autres
Publié: (2026)
VLM4Bio: A Benchmark Dataset to Evaluate Pretrained Vision-Language Models for Trait Discovery from Biological Images
par: Maruf, M., et autres
Publié: (2024)
par: Maruf, M., et autres
Publié: (2024)
DocParseNet: Advanced Semantic Segmentation and OCR Embeddings for Efficient Scanned Document Annotation
par: Mohammadshirazi, Ahmad, et autres
Publié: (2024)
par: Mohammadshirazi, Ahmad, et autres
Publié: (2024)
Static Segmentation by Tracking: A Label-Efficient Approach for Fine-Grained Specimen Image Segmentation
par: Feng, Zhenyang, et autres
Publié: (2025)
par: Feng, Zhenyang, et autres
Publié: (2025)
Documents similaires
-
TaxaAdapter: Vision Taxonomy Models are Key to Fine-grained Image Generation over the Tree of Life
par: Khurana, Mridul, et autres
Publié: (2026) -
SeamCam: Quantifying Seamless Camouflage via Multi-Cue Visual Detectability
par: Monsefi, Amin Karimi, et autres
Publié: (2026) -
KnobGen: Controlling the Sophistication of Artwork in Sketch-Based Diffusion Models
par: Navard, Pouyan, et autres
Publié: (2024) -
Controlla: Learning Controllability via Graph-Constrained Latent Geometry
par: Murthy, Jamuna S., et autres
Publié: (2026) -
Frequency-Guided Masking for Enhanced Vision Self-Supervised Learning
par: Monsefi, Amin Karimi, et autres
Publié: (2024)