Text Image Generation for Low-Resource Languages with Dual Translation Learning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Noguchi, Chihiro, Fukuda, Shun, Mihara, Shoichiro, Yamanaka, Masao |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Road Obstacle Detection based on Unknown Objectness Scores
par: Noguchi, Chihiro, et autres
Publié: (2024)
par: Noguchi, Chihiro, et autres
Publié: (2024)
Pseudo-Expert Regularized Offline RL for End-to-End Autonomous Driving in Photorealistic Closed-Loop Environments
par: Noguchi, Chihiro, et autres
Publié: (2025)
par: Noguchi, Chihiro, et autres
Publié: (2025)
From Binary to Semantic: Utilizing Large-Scale Binary Occupancy Data for 3D Semantic Occupancy Prediction
par: Noguchi, Chihiro, et autres
Publié: (2025)
par: Noguchi, Chihiro, et autres
Publié: (2025)
Left-Right Symmetry Breaking in CLIP-style Vision-Language Models Trained on Synthetic Spatial-Relation Data
par: Yamamoto, Takaki, et autres
Publié: (2026)
par: Yamamoto, Takaki, et autres
Publié: (2026)
Handwritten Text Recognition for Low Resource Languages
par: Dey, Sayantan, et autres
Publié: (2025)
par: Dey, Sayantan, et autres
Publié: (2025)
The Language of Touch: Translating Vibrations into Text with Dual-Branch Learning
par: Chen, Jin, et autres
Publié: (2026)
par: Chen, Jin, et autres
Publié: (2026)
Global-Local Dual Perception for MLLMs in High-Resolution Text-Rich Image Translation
par: Lu, Junxin, et autres
Publié: (2026)
par: Lu, Junxin, et autres
Publié: (2026)
Improving Image-to-Image Translation via a Rectified Flow Reformulation
par: Iizuka, Satoshi, et autres
Publié: (2026)
par: Iizuka, Satoshi, et autres
Publié: (2026)
STELLAR: Scene Text Editor for Low-Resource Languages and Real-World Data
par: Seo, Yongdeuk, et autres
Publié: (2025)
par: Seo, Yongdeuk, et autres
Publié: (2025)
NSYNC: Negative Synthetic Image Generation for Contrastive Training to Improve Stylized Text-To-Image Translation
par: Ozturk, Serkan, et autres
Publié: (2025)
par: Ozturk, Serkan, et autres
Publié: (2025)
Multi-View Synergistic Learning with Vision-Language Adaption for Low-Resource Biomedical Image Classification
par: Luo, Xiaoliu, et autres
Publié: (2026)
par: Luo, Xiaoliu, et autres
Publié: (2026)
High-Quality Medical Image Generation from Free-hand Sketch
par: Cap, Quan Huu, et autres
Publié: (2024)
par: Cap, Quan Huu, et autres
Publié: (2024)
Synergistic Dual Spatial-aware Generation of Image-to-Text and Text-to-Image
par: Zhao, Yu, et autres
Publié: (2024)
par: Zhao, Yu, et autres
Publié: (2024)
Spectral Normalization and Dual Contrastive Regularization for Image-to-Image Translation
par: Zhao, Chen, et autres
Publié: (2023)
par: Zhao, Chen, et autres
Publié: (2023)
Learning Dual-Domain Multi-Scale Representations for Single Image Deraining
par: Zou, Shun, et autres
Publié: (2025)
par: Zou, Shun, et autres
Publié: (2025)
DTVI: Dual-Stage Textual and Visual Intervention for Safe Text-to-Image Generation
par: Tan, Binhong, et autres
Publié: (2026)
par: Tan, Binhong, et autres
Publié: (2026)
Frequency-Controlled Diffusion Model for Versatile Text-Guided Image-to-Image Translation
par: Gao, Xiang, et autres
Publié: (2024)
par: Gao, Xiang, et autres
Publié: (2024)
Cross-Language Learning within Arabic Script for Low-Resource HTR
par: Al-azzawi, Sana, et autres
Publié: (2026)
par: Al-azzawi, Sana, et autres
Publié: (2026)
Dual Recursive Feedback on Generation and Appearance Latents for Pose-Robust Text-to-Image Diffusion
par: Kim, Jiwon, et autres
Publié: (2025)
par: Kim, Jiwon, et autres
Publié: (2025)
Text in the Dark: Extremely Low-Light Text Image Enhancement
par: Lin, Che-Tsung, et autres
Publié: (2024)
par: Lin, Che-Tsung, et autres
Publié: (2024)
Exploring Low-Resource Medical Image Classification with Weakly Supervised Prompt Learning
par: Zheng, Fudan, et autres
Publié: (2024)
par: Zheng, Fudan, et autres
Publié: (2024)
Dual Prompt Learning for Adapting Vision-Language Models to Downstream Image-Text Retrieval
par: Wang, Yifan, et autres
Publié: (2025)
par: Wang, Yifan, et autres
Publié: (2025)
American Sign Language Video to Text Translation
par: Roy, Parsheeta, et autres
Publié: (2024)
par: Roy, Parsheeta, et autres
Publié: (2024)
Deterministic Image-to-Image Translation via Denoising Brownian Bridge Models with Dual Approximators
par: Xiao, Bohan, et autres
Publié: (2025)
par: Xiao, Bohan, et autres
Publié: (2025)
Braille to Text Translation for Bengali Language: A Geometric Approach
par: Kamal, Minhas, et autres
Publié: (2020)
par: Kamal, Minhas, et autres
Publié: (2020)
End-to-end Training for Text-to-Image Synthesis using Dual-Text Embeddings
par: Ahmed, Yeruru Asrar, et autres
Publié: (2025)
par: Ahmed, Yeruru Asrar, et autres
Publié: (2025)
Bridging Different Language Models and Generative Vision Models for Text-to-Image Generation
par: Zhao, Shihao, et autres
Publié: (2024)
par: Zhao, Shihao, et autres
Publié: (2024)
DAFT-GAN: Dual Affine Transformation Generative Adversarial Network for Text-Guided Image Inpainting
par: Lee, Jihoon, et autres
Publié: (2024)
par: Lee, Jihoon, et autres
Publié: (2024)
Benchmarking Attention Mechanisms and Consistency Regularization Semi-Supervised Learning for Post-Flood Building Damage Assessment in Satellite Images
par: Yu, Jiaxi, et autres
Publié: (2024)
par: Yu, Jiaxi, et autres
Publié: (2024)
LowCLIP: Adapting the CLIP Model Architecture for Low-Resource Languages in Multimodal Image Retrieval Task
par: Asgarov, Ali, et autres
Publié: (2024)
par: Asgarov, Ali, et autres
Publié: (2024)
Translation-Enhanced Multilingual Text-to-Image Generation
par: Li, Yaoyiran, et autres
Publié: (2023)
par: Li, Yaoyiran, et autres
Publié: (2023)
Urban Safety Perception Assessments via Integrating Multimodal Large Language Models with Street View Images
par: Zhang, Jiaxin, et autres
Publié: (2024)
par: Zhang, Jiaxin, et autres
Publié: (2024)
Evaluating Vision Language Model Adaptations for Radiology Report Generation in Low-Resource Languages
par: Salmè, Marco, et autres
Publié: (2025)
par: Salmè, Marco, et autres
Publié: (2025)
Learning Multi-dimensional Human Preference for Text-to-Image Generation
par: Zhang, Sixian, et autres
Publié: (2024)
par: Zhang, Sixian, et autres
Publié: (2024)
Learning Continuous 3D Words for Text-to-Image Generation
par: Cheng, Ta-Ying, et autres
Publié: (2024)
par: Cheng, Ta-Ying, et autres
Publié: (2024)
AITTI: Learning Adaptive Inclusive Token for Text-to-Image Generation
par: Hou, Xinyu, et autres
Publié: (2024)
par: Hou, Xinyu, et autres
Publié: (2024)
Learning to Sample Effective and Diverse Prompts for Text-to-Image Generation
par: Yun, Taeyoung, et autres
Publié: (2025)
par: Yun, Taeyoung, et autres
Publié: (2025)
Learning Disentangled Identifiers for Action-Customized Text-to-Image Generation
par: Huang, Siteng, et autres
Publié: (2023)
par: Huang, Siteng, et autres
Publié: (2023)
Identity-Preserving Text-to-Image Generation via Dual-Level Feature Decoupling and Expert-Guided Fusion
par: Chen, Kewen, et autres
Publié: (2025)
par: Chen, Kewen, et autres
Publié: (2025)
Beyond Flat Text: Dual Self-inherited Guidance for Visual Text Generation
par: Luo, Minxing, et autres
Publié: (2025)
par: Luo, Minxing, et autres
Publié: (2025)
Documents similaires
-
Road Obstacle Detection based on Unknown Objectness Scores
par: Noguchi, Chihiro, et autres
Publié: (2024) -
Pseudo-Expert Regularized Offline RL for End-to-End Autonomous Driving in Photorealistic Closed-Loop Environments
par: Noguchi, Chihiro, et autres
Publié: (2025) -
From Binary to Semantic: Utilizing Large-Scale Binary Occupancy Data for 3D Semantic Occupancy Prediction
par: Noguchi, Chihiro, et autres
Publié: (2025) -
Left-Right Symmetry Breaking in CLIP-style Vision-Language Models Trained on Synthetic Spatial-Relation Data
par: Yamamoto, Takaki, et autres
Publié: (2026) -
Handwritten Text Recognition for Low Resource Languages
par: Dey, Sayantan, et autres
Publié: (2025)