A Cat Is A Cat (Not A Dog!): Unraveling Information Mix-ups in Text-to-Image Encoders through Causal Analysis and Embedding Optimization
Fuente:
arXiv
Salvato in:
| Autori principali: | Chen, Chieh-Yun, Tseng, Chiang, Tsao, Li-Wu, Shuai, Hong-Han |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Ranking-based Preference Optimization for Diffusion Models from Implicit User Feedback
di: Wu, Yi-Lun, et al.
Pubblicazione: (2025)
di: Wu, Yi-Lun, et al.
Pubblicazione: (2025)
LongCat-Image Technical Report
di: Meituan LongCat Team, et al.
Pubblicazione: (2025)
di: Meituan LongCat Team, et al.
Pubblicazione: (2025)
Benchmark Analysis of Various Pre-trained Deep Learning Models on ASSIRA Cats and Dogs Dataset
di: Himel, Galib Muhammad Shahriar, et al.
Pubblicazione: (2024)
di: Himel, Galib Muhammad Shahriar, et al.
Pubblicazione: (2024)
Color Me Correctly: Bridging Perceptual Color Spaces and Text Embeddings for Improved Diffusion Generation
di: Tsai, Sung-Lin, et al.
Pubblicazione: (2025)
di: Tsai, Sung-Lin, et al.
Pubblicazione: (2025)
Urine Potassium Concentration Analysis in Dogs and Cats: A Case‐Based Review
di: Helen S. Philp, et al.
Pubblicazione: (2025)
di: Helen S. Philp, et al.
Pubblicazione: (2025)
LongCat-Video Technical Report
di: Meituan LongCat Team, et al.
Pubblicazione: (2025)
di: Meituan LongCat Team, et al.
Pubblicazione: (2025)
Siamese Networks for Cat Re-Identification: Exploring Neural Models for Cat Instance Recognition
di: Trein, Tobias, et al.
Pubblicazione: (2025)
di: Trein, Tobias, et al.
Pubblicazione: (2025)
LongCat-Video-Avatar 1.5 Technical Report
di: Meituan LongCat Team, et al.
Pubblicazione: (2026)
di: Meituan LongCat Team, et al.
Pubblicazione: (2026)
Debiasing Diffusion Model: Enhancing Fairness through Latent Representation Learning in Stable Diffusion Model
di: Huang, Lin-Chun, et al.
Pubblicazione: (2025)
di: Huang, Lin-Chun, et al.
Pubblicazione: (2025)
Cats vs Dogs, Photons vs Hadrons
di: Visconti, Francesco
Pubblicazione: (2022)
di: Visconti, Francesco
Pubblicazione: (2022)
Text-Guided Semantic Image Encoder
di: Thirukovalluru, Raghuveer, et al.
Pubblicazione: (2025)
di: Thirukovalluru, Raghuveer, et al.
Pubblicazione: (2025)
Automated Detection of Cat Facial Landmarks
di: Martvel, George, et al.
Pubblicazione: (2023)
di: Martvel, George, et al.
Pubblicazione: (2023)
LongCat-Next: Lexicalizing Modalities as Discrete Tokens
di: Meituan LongCat Team, et al.
Pubblicazione: (2026)
di: Meituan LongCat Team, et al.
Pubblicazione: (2026)
Abdominal Doppler Ultrasonography in Clinical Practice in Cats and Dogs
di: ESİN, Çağatay, et al.
Pubblicazione: (2025)
di: ESİN, Çağatay, et al.
Pubblicazione: (2025)
Retrospective Evaluation of the Prevalence and Prognosis of Hypochloremia in Dogs and Cats
di: Yu Ueda, et al.
Pubblicazione: (2025)
di: Yu Ueda, et al.
Pubblicazione: (2025)
Language-Image Alignment with Fixed Text Encoders
di: Yang, Jingfeng, et al.
Pubblicazione: (2025)
di: Yang, Jingfeng, et al.
Pubblicazione: (2025)
The Comparison of Individual Cat Recognition Using Neural Networks
di: Li, Mingxuan, et al.
Pubblicazione: (2024)
di: Li, Mingxuan, et al.
Pubblicazione: (2024)
Cat-AIR: Content and Task-Aware All-in-One Image Restoration
di: Jiang, Jiachen, et al.
Pubblicazione: (2025)
di: Jiang, Jiachen, et al.
Pubblicazione: (2025)
CatCMA : Stochastic Optimization for Mixed-Category Problems
di: Hamano, Ryoki, et al.
Pubblicazione: (2024)
di: Hamano, Ryoki, et al.
Pubblicazione: (2024)
Dog Tired: A Cross‐Sectional Examination of the Relation Between Dog and/or Cat Ownership and Owners' Sleep
di: Courtney J. Bolstad, et al.
Pubblicazione: (2025)
di: Courtney J. Bolstad, et al.
Pubblicazione: (2025)
RECOVER Guidelines: Newborn Resuscitation in Dogs and Cats. Clinical Guidelines
di: Manuel Boller, et al.
Pubblicazione: (2025)
di: Manuel Boller, et al.
Pubblicazione: (2025)
Retrospective Evaluation of Hyperbilirubinemia in Cats and Dogs With Septic Peritonitis or Pyothorax
di: Frederick John Benham‐Crosswell, et al.
Pubblicazione: (2025)
di: Frederick John Benham‐Crosswell, et al.
Pubblicazione: (2025)
UNIT: Unifying Image and Text Recognition in One Vision Encoder
di: Zhu, Yi, et al.
Pubblicazione: (2024)
di: Zhu, Yi, et al.
Pubblicazione: (2024)
CoRe: Context-Regularized Text Embedding Learning for Text-to-Image Personalization
di: Wu, Feize, et al.
Pubblicazione: (2024)
di: Wu, Feize, et al.
Pubblicazione: (2024)
TF-TI2I: Training-Free Text-and-Image-to-Image Generation via Multi-Modal Implicit-Context Learning in Text-to-Image Models
di: Hsiao, Teng-Fang, et al.
Pubblicazione: (2025)
di: Hsiao, Teng-Fang, et al.
Pubblicazione: (2025)
TextBoost: Boosting Text Encoder for Personalized Text-to-Image Generation
di: Park, NaHyeon, et al.
Pubblicazione: (2024)
di: Park, NaHyeon, et al.
Pubblicazione: (2024)
Ticks and Tick‐Borne Pathogens Encountered by Dogs and Cats: A North European Perspective
di: Jani J. Sormunen, et al.
Pubblicazione: (2025)
di: Jani J. Sormunen, et al.
Pubblicazione: (2025)
Scaling Down Text Encoders of Text-to-Image Diffusion Models
di: Wang, Lifu, et al.
Pubblicazione: (2025)
di: Wang, Lifu, et al.
Pubblicazione: (2025)
FaceCat: Enhancing Face Recognition Security with a Unified Diffusion Model
di: Chen, Jiawei, et al.
Pubblicazione: (2024)
di: Chen, Jiawei, et al.
Pubblicazione: (2024)
CatLIP: CLIP-level Visual Recognition Accuracy with 2.7x Faster Pre-training on Web-scale Image-Text Data
di: Mehta, Sachin, et al.
Pubblicazione: (2024)
di: Mehta, Sachin, et al.
Pubblicazione: (2024)
A Cat In The Matrix
di: Elliott, Gareth
Pubblicazione: (2025)
di: Elliott, Gareth
Pubblicazione: (2025)
RECOVER Guidelines: Newborn Resuscitation in Dogs and Cats. Evidence and Knowledge Gap Analysis With Treatment Recommendations
di: Manuel Boller, et al.
Pubblicazione: (2025)
di: Manuel Boller, et al.
Pubblicazione: (2025)
T2I-Copilot: A Training-Free Multi-Agent Text-to-Image System for Enhanced Prompt Interpretation and Interactive Generation
di: Chen, Chieh-Yun, et al.
Pubblicazione: (2025)
di: Chen, Chieh-Yun, et al.
Pubblicazione: (2025)
CDPDNet: Integrating Text Guidance with Hybrid Vision Encoders for Medical Image Segmentation
di: Wu, Jiong, et al.
Pubblicazione: (2025)
di: Wu, Jiong, et al.
Pubblicazione: (2025)
Cat: Post-Training Quantization Error Reduction via Cluster-based Affine Transformation
di: Zoljodi, Ali, et al.
Pubblicazione: (2025)
di: Zoljodi, Ali, et al.
Pubblicazione: (2025)
WetCat: Enabling Automated Skill Assessment in Wet-Lab Cataract Surgery Videos
di: Ghamsarian, Negin, et al.
Pubblicazione: (2025)
di: Ghamsarian, Negin, et al.
Pubblicazione: (2025)
CatFree3D: Category-agnostic 3D Object Detection with Diffusion
di: Bian, Wenjing, et al.
Pubblicazione: (2024)
di: Bian, Wenjing, et al.
Pubblicazione: (2024)
DragText: Rethinking Text Embedding in Point-based Image Editing
di: Choi, Gayoon, et al.
Pubblicazione: (2024)
di: Choi, Gayoon, et al.
Pubblicazione: (2024)
Fine-Grained Cat Breed Recognition with Global Context Vision Transformer
di: Hera, Mowmita Parvin, et al.
Pubblicazione: (2026)
di: Hera, Mowmita Parvin, et al.
Pubblicazione: (2026)
Improving Image Coding for Machines through Optimizing Encoder via Auxiliary Loss
di: Iino, Kei, et al.
Pubblicazione: (2024)
di: Iino, Kei, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Ranking-based Preference Optimization for Diffusion Models from Implicit User Feedback
di: Wu, Yi-Lun, et al.
Pubblicazione: (2025) -
LongCat-Image Technical Report
di: Meituan LongCat Team, et al.
Pubblicazione: (2025) -
Benchmark Analysis of Various Pre-trained Deep Learning Models on ASSIRA Cats and Dogs Dataset
di: Himel, Galib Muhammad Shahriar, et al.
Pubblicazione: (2024) -
Color Me Correctly: Bridging Perceptual Color Spaces and Text Embeddings for Improved Diffusion Generation
di: Tsai, Sung-Lin, et al.
Pubblicazione: (2025) -
Urine Potassium Concentration Analysis in Dogs and Cats: A Case‐Based Review
di: Helen S. Philp, et al.
Pubblicazione: (2025)