DanceText: A Training-Free Layered Framework for Controllable Multilingual Text Transformation in Images
Fuente:
arXiv
Guardado en:
| Autores principales: | Yu, Zhenyu, Idris, Mohd Yamani Idna, Wang, Hua, Wang, Pei, Qureshi, Rizwan, Raza, Shaina, Chadha, Aman, Xiang, Yong, Chen, Zhixiang |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
DC4CR: When Cloud Removal Meets Diffusion Control in Remote Sensing
por: Yu, Zhenyu, et al.
Publicado: (2025)
por: Yu, Zhenyu, et al.
Publicado: (2025)
SatelliteCalculator: A Multi-Task Vision Foundation Model for Quantitative Remote Sensing Inversion
por: Yu, Zhenyu, et al.
Publicado: (2025)
por: Yu, Zhenyu, et al.
Publicado: (2025)
SatelliteFormula: Multi-Modal Symbolic Regression from Remote Sensing Imagery for Physics Discovery
por: Yu, Zhenyu, et al.
Publicado: (2025)
por: Yu, Zhenyu, et al.
Publicado: (2025)
Improved implicit diffusion model with knowledge distillation to estimate the spatial distribution density of carbon stock in remote sensing imagery
por: Yu, Zhenyu, et al.
Publicado: (2024)
por: Yu, Zhenyu, et al.
Publicado: (2024)
Rainy: Unlocking Satellite Calibration for Deep Learning in Precipitation
por: Yu, Zhenyu, et al.
Publicado: (2025)
por: Yu, Zhenyu, et al.
Publicado: (2025)
DeCorStory: Gram-Schmidt Prompt Embedding Decorrelation for Consistent Storytelling
por: Sarkar, Ayushman, et al.
Publicado: (2026)
por: Sarkar, Ayushman, et al.
Publicado: (2026)
Reasoning in Computer Vision: Taxonomy, Models, Tasks, and Methodologies
por: Sarkar, Ayushman, et al.
Publicado: (2025)
por: Sarkar, Ayushman, et al.
Publicado: (2025)
From Physics to Foundation Models: A Review of AI-Driven Quantitative Remote Sensing Inversion
por: Yu, Zhenyu, et al.
Publicado: (2025)
por: Yu, Zhenyu, et al.
Publicado: (2025)
A Layered Self-Supervised Knowledge Distillation Framework for Efficient Multimodal Learning on the Edge
por: Dahri, Tarique, et al.
Publicado: (2025)
por: Dahri, Tarique, et al.
Publicado: (2025)
Prompting Away Stereotypes? Evaluating Bias in Text-to-Image Models for Occupations
por: Raza, Shaina, et al.
Publicado: (2025)
por: Raza, Shaina, et al.
Publicado: (2025)
A Diffusion-Based Framework for Terrain-Aware Remote Sensing Image Reconstruction
por: Yu, Zhenyu, et al.
Publicado: (2025)
por: Yu, Zhenyu, et al.
Publicado: (2025)
ForgetMe: Evaluating Selective Forgetting in Generative Models
por: Yu, Zhenyu, et al.
Publicado: (2025)
por: Yu, Zhenyu, et al.
Publicado: (2025)
SEABAD: A Tropical Bird Activity Detection Dataset for Passive Acoustic Monitoring
por: Zabidi, Muhammad Mun'im Ahmad, et al.
Publicado: (2026)
por: Zabidi, Muhammad Mun'im Ahmad, et al.
Publicado: (2026)
CaST-POI: Candidate-Conditioned Spatiotemporal Modeling for Next POI Recommendation
por: Yu, Zhenyu, et al.
Publicado: (2026)
por: Yu, Zhenyu, et al.
Publicado: (2026)
ADS-POI: Agentic Spatiotemporal State Decomposition for Next Point-of-Interest Recommendation
por: Yu, Zhenyu, et al.
Publicado: (2026)
por: Yu, Zhenyu, et al.
Publicado: (2026)
Just as Humans Need Vaccines, So Do Models: Model Immunization to Combat Falsehoods
por: Raza, Shaina, et al.
Publicado: (2025)
por: Raza, Shaina, et al.
Publicado: (2025)
Bombardier Beetle Optimizer: A Novel Bio-Inspired Algorithm for Global Optimization
por: Shehadeh, Hisham A., et al.
Publicado: (2025)
por: Shehadeh, Hisham A., et al.
Publicado: (2025)
StoryState: Agent-Based State Control for Consistent and Editable Storybooks
por: Sarkar, Ayushman, et al.
Publicado: (2026)
por: Sarkar, Ayushman, et al.
Publicado: (2026)
ReDiStory: Region-Disentangled Diffusion for Consistent Visual Story Generation
por: Sarkar, Ayushman, et al.
Publicado: (2026)
por: Sarkar, Ayushman, et al.
Publicado: (2026)
Reliability Analysis of Psychological Concept Extraction and Classification in User-penned Text
por: Garg, Muskan, et al.
Publicado: (2024)
por: Garg, Muskan, et al.
Publicado: (2024)
Hybrid Firefly Algorithm and Sperm Swarm Optimization Algorithm using Newton-Raphson Method (HFASSON) and its application in CR-VANET
por: T, Rehannara Beegum, et al.
Publicado: (2025)
por: T, Rehannara Beegum, et al.
Publicado: (2025)
Refining Text-to-Image Generation: Towards Accurate Training-Free Glyph-Enhanced Image Generation
por: Lakhanpal, Sanyam, et al.
Publicado: (2024)
por: Lakhanpal, Sanyam, et al.
Publicado: (2024)
Transcending Domains through Text-to-Image Diffusion: A Source-Free Approach to Domain Adaptation
por: Chopra, Shivang, et al.
Publicado: (2023)
por: Chopra, Shivang, et al.
Publicado: (2023)
The Deepfakes We Missed: We Built Detectors for a Threat That Didn't Arrive
por: Raza, Shaina
Publicado: (2026)
por: Raza, Shaina
Publicado: (2026)
SQL-of-Thought: Multi-agentic Text-to-SQL with Guided Error Correction
por: Chaturvedi, Saumya, et al.
Publicado: (2025)
por: Chaturvedi, Saumya, et al.
Publicado: (2025)
Simulating Meaning, Nevermore! Introducing ICR: A Semiotic-Hermeneutic Metric for Evaluating Meaning in LLM Text Summaries
por: Perez, Natalie, et al.
Publicado: (2026)
por: Perez, Natalie, et al.
Publicado: (2026)
Text-to-Image Representativity Fairness Evaluation Framework
por: Yamani, Asma, et al.
Publicado: (2024)
por: Yamani, Asma, et al.
Publicado: (2024)
EasyText: Controllable Diffusion Transformer for Multilingual Text Rendering
por: Lu, Runnan, et al.
Publicado: (2025)
por: Lu, Runnan, et al.
Publicado: (2025)
FreeText: Training-Free Text Rendering in Diffusion Transformers via Attention Localization and Spectral Glyph Injection
por: Zhang, Ruiqiang, et al.
Publicado: (2026)
por: Zhang, Ruiqiang, et al.
Publicado: (2026)
Multimodal Large Language Models for Image, Text, and Speech Data Augmentation: A Survey
por: Sapkota, Ranjan, et al.
Publicado: (2025)
por: Sapkota, Ranjan, et al.
Publicado: (2025)
Can Large Language Models Infer Causal Relationships from Real-World Text?
por: Saklad, Ryan, et al.
Publicado: (2025)
por: Saklad, Ryan, et al.
Publicado: (2025)
Towards Responsible Multimodal Medical Reasoning via Context-Aligned Vision-Language Models
por: Khan, Sumra, et al.
Publicado: (2026)
por: Khan, Sumra, et al.
Publicado: (2026)
MagicGeo: Training-Free Text-Guided Geometric Diagram Generation
por: Wang, Junxiao, et al.
Publicado: (2025)
por: Wang, Junxiao, et al.
Publicado: (2025)
SKETCH: Structured Knowledge Enhanced Text Comprehension for Holistic Retrieval
por: Mahalingam, Aakash, et al.
Publicado: (2024)
por: Mahalingam, Aakash, et al.
Publicado: (2024)
PART: Progressive Alignment Representation Training for Multilingual Speech-To-Text with LLMs
por: Zhang, Pei, et al.
Publicado: (2025)
por: Zhang, Pei, et al.
Publicado: (2025)
Beyond Content: How Grammatical Gender Shapes Visual Representation in Text-to-Image Models
por: Saeed, Muhammed, et al.
Publicado: (2025)
por: Saeed, Muhammed, et al.
Publicado: (2025)
AnyText: Multilingual Visual Text Generation And Editing
por: Tuo, Yuxiang, et al.
Publicado: (2023)
por: Tuo, Yuxiang, et al.
Publicado: (2023)
Multilingual and Explainable Text Detoxification with Parallel Corpora
por: Dementieva, Daryna, et al.
Publicado: (2024)
por: Dementieva, Daryna, et al.
Publicado: (2024)
CustomDancer: Customized Dance Recommendation by Text-Dance Retrieval
por: Qin, Yawen, et al.
Publicado: (2026)
por: Qin, Yawen, et al.
Publicado: (2026)
TextFlux: An OCR-Free DiT Model for High-Fidelity Multilingual Scene Text Synthesis
por: Xie, Yu, et al.
Publicado: (2025)
por: Xie, Yu, et al.
Publicado: (2025)
Ejemplares similares
-
DC4CR: When Cloud Removal Meets Diffusion Control in Remote Sensing
por: Yu, Zhenyu, et al.
Publicado: (2025) -
SatelliteCalculator: A Multi-Task Vision Foundation Model for Quantitative Remote Sensing Inversion
por: Yu, Zhenyu, et al.
Publicado: (2025) -
SatelliteFormula: Multi-Modal Symbolic Regression from Remote Sensing Imagery for Physics Discovery
por: Yu, Zhenyu, et al.
Publicado: (2025) -
Improved implicit diffusion model with knowledge distillation to estimate the spatial distribution density of carbon stock in remote sensing imagery
por: Yu, Zhenyu, et al.
Publicado: (2024) -
Rainy: Unlocking Satellite Calibration for Deep Learning in Precipitation
por: Yu, Zhenyu, et al.
Publicado: (2025)