Text images processing system using artificial intelligence models
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Bahjat, Aya Kaysan |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Automated document processing system for government agencies using DBNET++ and BART models
par: Bahjat, Aya Kaysan
Publié: (2025)
par: Bahjat, Aya Kaysan
Publié: (2025)
A survey of facial recognition techniques
par: Bahjat, Aya Kaysan
Publié: (2026)
par: Bahjat, Aya Kaysan
Publié: (2026)
VolTex: Food Volume Estimation using Text-Guided Segmentation and Neural Surface Reconstruction
par: AlMughrabi, Ahmad, et autres
Publié: (2025)
par: AlMughrabi, Ahmad, et autres
Publié: (2025)
Alignment of 3D woodblock geometrical models and 2D orthographic projection image
par: Nguyen, Minh DUc, et autres
Publié: (2024)
par: Nguyen, Minh DUc, et autres
Publié: (2024)
3D Human Face Reconstruction with 3DMM face model from RGB image
par: Jiang, Zhangnan, et autres
Publié: (2026)
par: Jiang, Zhangnan, et autres
Publié: (2026)
SMPL-GPTexture: Dual-View 3D Human Texture Estimation using Text-to-Image Generation Models
par: Tu, Mingxiao, et autres
Publié: (2025)
par: Tu, Mingxiao, et autres
Publié: (2025)
TextToon: Real-Time Text Toonify Head Avatar from Single Video
par: Song, Luchuan, et autres
Publié: (2024)
par: Song, Luchuan, et autres
Publié: (2024)
MultiAct: Text-to-Motion Generation from Composite Text via Tailored Attention Guidance
par: Sala, Nathan, et autres
Publié: (2026)
par: Sala, Nathan, et autres
Publié: (2026)
Text2CAD: Generating Sequential CAD Models from Beginner-to-Expert Level Text Prompts
par: Khan, Mohammad Sadil, et autres
Publié: (2024)
par: Khan, Mohammad Sadil, et autres
Publié: (2024)
Text2NeRF: Text-Driven 3D Scene Generation with Neural Radiance Fields
par: Zhang, Jingbo, et autres
Publié: (2023)
par: Zhang, Jingbo, et autres
Publié: (2023)
Text-to-Vector Generation with Neural Path Representation
par: Zhang, Peiying, et autres
Publié: (2024)
par: Zhang, Peiying, et autres
Publié: (2024)
ImagenHub: Standardizing the evaluation of conditional image generation models
par: Ku, Max, et autres
Publié: (2023)
par: Ku, Max, et autres
Publié: (2023)
LCM-Lookahead for Encoder-based Text-to-Image Personalization
par: Gal, Rinon, et autres
Publié: (2024)
par: Gal, Rinon, et autres
Publié: (2024)
AniClipart: Clipart Animation with Text-to-Video Priors
par: Wu, Ronghuan, et autres
Publié: (2024)
par: Wu, Ronghuan, et autres
Publié: (2024)
Generating Human Interaction Motions in Scenes with Text Control
par: Yi, Hongwei, et autres
Publié: (2024)
par: Yi, Hongwei, et autres
Publié: (2024)
Gaussian highpass guided image filtering
par: Zhao, Lei, et autres
Publié: (2025)
par: Zhao, Lei, et autres
Publié: (2025)
RGB$\leftrightarrow$X: Image decomposition and synthesis using material- and lighting-aware diffusion models
par: Zeng, Zheng, et autres
Publié: (2024)
par: Zeng, Zheng, et autres
Publié: (2024)
Style Customization of Text-to-Vector Generation with Image Diffusion Priors
par: Zhang, Peiying, et autres
Publié: (2025)
par: Zhang, Peiying, et autres
Publié: (2025)
A Survey On Text-to-3D Contents Generation In The Wild
par: Jiang, Chenhan
Publié: (2024)
par: Jiang, Chenhan
Publié: (2024)
ART-DECO: Arbitrary Text Guidance for 3D Detailizer Construction
par: Chen, Qimin, et autres
Publié: (2025)
par: Chen, Qimin, et autres
Publié: (2025)
Bokeh Diffusion: Defocus Blur Control in Text-to-Image Diffusion Models
par: Fortes, Armando, et autres
Publié: (2025)
par: Fortes, Armando, et autres
Publié: (2025)
Blended Point Cloud Diffusion for Localized Text-guided Shape Editing
par: Sella, Etai, et autres
Publié: (2025)
par: Sella, Etai, et autres
Publié: (2025)
MotionFix: Text-Driven 3D Human Motion Editing
par: Athanasiou, Nikos, et autres
Publié: (2024)
par: Athanasiou, Nikos, et autres
Publié: (2024)
MatAtlas: Text-driven Consistent Geometry Texturing and Material Assignment
par: Ceylan, Duygu, et autres
Publié: (2024)
par: Ceylan, Duygu, et autres
Publié: (2024)
NIVeL: Neural Implicit Vector Layers for Text-to-Vector Generation
par: Thamizharasan, Vikas, et autres
Publié: (2024)
par: Thamizharasan, Vikas, et autres
Publié: (2024)
GaussianEditor: Editing 3D Gaussians Delicately with Text Instructions
par: Wang, Junjie, et autres
Publié: (2023)
par: Wang, Junjie, et autres
Publié: (2023)
TexPro: Text-guided PBR Texturing with Procedural Material Modeling
par: Dang, Ziqiang, et autres
Publié: (2024)
par: Dang, Ziqiang, et autres
Publié: (2024)
BiPO: Bidirectional Partial Occlusion Network for Text-to-Motion Synthesis
par: Hong, Seong-Eun, et autres
Publié: (2024)
par: Hong, Seong-Eun, et autres
Publié: (2024)
DressCode: Autoregressively Sewing and Generating Garments from Text Guidance
par: He, Kai, et autres
Publié: (2024)
par: He, Kai, et autres
Publié: (2024)
WordRobe: Text-Guided Generation of Textured 3D Garments
par: Srivastava, Astitva, et autres
Publié: (2024)
par: Srivastava, Astitva, et autres
Publié: (2024)
LGTM: Local-to-Global Text-Driven Human Motion Diffusion Model
par: Sun, Haowen, et autres
Publié: (2024)
par: Sun, Haowen, et autres
Publié: (2024)
FlipSketch: Flipping Static Drawings to Text-Guided Sketch Animations
par: Bandyopadhyay, Hmrishav, et autres
Publié: (2024)
par: Bandyopadhyay, Hmrishav, et autres
Publié: (2024)
MatSwap: Light-aware material transfers in images
par: Lopes, Ivan, et autres
Publié: (2025)
par: Lopes, Ivan, et autres
Publié: (2025)
StyleHumanCLIP: Text-guided Garment Manipulation for StyleGAN-Human
par: Yoshikawa, Takato, et autres
Publié: (2023)
par: Yoshikawa, Takato, et autres
Publié: (2023)
CLIPtortionist: Zero-shot Text-driven Deformation for Manufactured 3D Shapes
par: Xu, Xianghao, et autres
Publié: (2024)
par: Xu, Xianghao, et autres
Publié: (2024)
CT4D: Consistent Text-to-4D Generation with Animatable Meshes
par: Chen, Ce, et autres
Publié: (2024)
par: Chen, Ce, et autres
Publié: (2024)
Dream-in-Style: Text-to-3D Generation Using Stylized Score Distillation
par: Kompanowski, Hubert, et autres
Publié: (2024)
par: Kompanowski, Hubert, et autres
Publié: (2024)
Dynamic Motion Synthesis: Masked Audio-Text Conditioned Spatio-Temporal Transformers
par: Anisetty, Sohan, et autres
Publié: (2024)
par: Anisetty, Sohan, et autres
Publié: (2024)
IntrinsicEdit: Precise generative image manipulation in intrinsic space
par: Lyu, Linjie, et autres
Publié: (2025)
par: Lyu, Linjie, et autres
Publié: (2025)
PromptVFX: Text-Driven Fields for Open-World 3D Gaussian Animation
par: Kiray, Mert, et autres
Publié: (2025)
par: Kiray, Mert, et autres
Publié: (2025)
Documents similaires
-
Automated document processing system for government agencies using DBNET++ and BART models
par: Bahjat, Aya Kaysan
Publié: (2025) -
A survey of facial recognition techniques
par: Bahjat, Aya Kaysan
Publié: (2026) -
VolTex: Food Volume Estimation using Text-Guided Segmentation and Neural Surface Reconstruction
par: AlMughrabi, Ahmad, et autres
Publié: (2025) -
Alignment of 3D woodblock geometrical models and 2D orthographic projection image
par: Nguyen, Minh DUc, et autres
Publié: (2024) -
3D Human Face Reconstruction with 3DMM face model from RGB image
par: Jiang, Zhangnan, et autres
Publié: (2026)