Global-Local Aware Scene Text Editing
Fuente:
arXiv
Guardado en:
| Autores principales: | Yang, Fuxiang, Su, Tonghua, Di, Donglin, Chen, Yin, Wu, Xiangqian, Wang, Zhongjie, Fan, Lei |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
DiTalker: A Unified DiT-based Framework for High-Quality and Speaking Styles Controllable Portrait Animation
por: Feng, He, et al.
Publicado: (2025)
por: Feng, He, et al.
Publicado: (2025)
FOCA: Frequency-Oriented Cross-Domain Forgery Detection, Localization and Explanation via Multi-Modal Large Language Model
por: Liu, Zhou, et al.
Publicado: (2026)
por: Liu, Zhou, et al.
Publicado: (2026)
EFDiT: Efficient Fine-grained Image Generation Using Diffusion Transformer Models
por: Wang, Kun, et al.
Publicado: (2025)
por: Wang, Kun, et al.
Publicado: (2025)
Adams Bashforth Moulton Solver for Inversion and Editing in Rectified Flow
por: Ma, Yongjia, et al.
Publicado: (2025)
por: Ma, Yongjia, et al.
Publicado: (2025)
CogPortrait: Fine-Grained Eye-Region Control in Portrait Animation via Hierarchical Agent Planning
por: Feng, He, et al.
Publicado: (2026)
por: Feng, He, et al.
Publicado: (2026)
GUSLO: General and Unified Structured Light Optimization
por: Wan, Tinglei, et al.
Publicado: (2025)
por: Wan, Tinglei, et al.
Publicado: (2025)
Spatially Gene Expression Prediction using Dual-Scale Contrastive Learning
por: Qu, Mingcheng, et al.
Publicado: (2025)
por: Qu, Mingcheng, et al.
Publicado: (2025)
Chain of World: World Model Thinking in Latent Motion
por: Yang, Fuxiang, et al.
Publicado: (2026)
por: Yang, Fuxiang, et al.
Publicado: (2026)
Multimodal Cancer Survival Analysis via Hypergraph Learning with Cross-Modality Rebalance
por: Qu, Mingcheng, et al.
Publicado: (2025)
por: Qu, Mingcheng, et al.
Publicado: (2025)
Memory-Augmented Incomplete Multimodal Survival Prediction via Cross-Slide and Gene-Attentive Hypergraph Learning
por: Qu, Mingcheng, et al.
Publicado: (2025)
por: Qu, Mingcheng, et al.
Publicado: (2025)
One-Shot Pose-Driving Face Animation Platform
por: Feng, He, et al.
Publicado: (2024)
por: Feng, He, et al.
Publicado: (2024)
Real Face Video Animation Platform
por: Chen, Xiaokai, et al.
Publicado: (2024)
por: Chen, Xiaokai, et al.
Publicado: (2024)
DH-FaceVid-1K: A Large-Scale High-Quality Dataset for Face Video Generation
por: Di, Donglin, et al.
Publicado: (2024)
por: Di, Donglin, et al.
Publicado: (2024)
Balancing Stability and Plasticity in Pretrained Detector: A Dual-Path Framework for Incremental Object Detection
por: Li, Songze, et al.
Publicado: (2025)
por: Li, Songze, et al.
Publicado: (2025)
DUKAE: DUal-level Knowledge Accumulation and Ensemble for Pre-Trained Model-Based Continual Learning
por: Li, Songze, et al.
Publicado: (2025)
por: Li, Songze, et al.
Publicado: (2025)
Multimodal Continual Instruction Tuning with Dynamic Gradient Guidance
por: Li, Songze, et al.
Publicado: (2025)
por: Li, Songze, et al.
Publicado: (2025)
Tuning-Free Long Video Generation via Global-Local Collaborative Diffusion
por: Ma, Yongjia, et al.
Publicado: (2025)
por: Ma, Yongjia, et al.
Publicado: (2025)
GAOT: Generating Articulated Objects Through Text-Guided Diffusion Models
por: Sun, Hao, et al.
Publicado: (2025)
por: Sun, Hao, et al.
Publicado: (2025)
Salvaging the Overlooked: Leveraging Class-Aware Contrastive Learning for Multi-Class Anomaly Detection
por: Fan, Lei, et al.
Publicado: (2024)
por: Fan, Lei, et al.
Publicado: (2024)
Recognition-Synergistic Scene Text Editing
por: Fang, Zhengyao, et al.
Publicado: (2025)
por: Fang, Zhengyao, et al.
Publicado: (2025)
TextSculptor: Training and Benchmarking Scene Text Editing
por: Lin, Yiheng, et al.
Publicado: (2026)
por: Lin, Yiheng, et al.
Publicado: (2026)
TrAME: Trajectory-Anchored Multi-View Editing for Text-Guided 3D Gaussian Splatting Manipulation
por: Luo, Chaofan, et al.
Publicado: (2024)
por: Luo, Chaofan, et al.
Publicado: (2024)
Watch Your Steps: Local Image and Scene Editing by Text Instructions
por: Mirzaei, Ashkan, et al.
Publicado: (2023)
por: Mirzaei, Ashkan, et al.
Publicado: (2023)
LatentEditor: Text Driven Local Editing of 3D Scenes
por: Khalid, Umar, et al.
Publicado: (2023)
por: Khalid, Umar, et al.
Publicado: (2023)
Mono4DEditor: Text-Driven 4D Scene Editing from Monocular Video via Point-Level Localization of Language-Embedded Gaussians
por: Shi, Jin-Chuan, et al.
Publicado: (2025)
por: Shi, Jin-Chuan, et al.
Publicado: (2025)
TextCtrl: Diffusion-based Scene Text Editing with Prior Guidance Control
por: Zeng, Weichao, et al.
Publicado: (2024)
por: Zeng, Weichao, et al.
Publicado: (2024)
MANTA: A Large-Scale Multi-View and Visual-Text Anomaly Detection Dataset for Tiny Objects
por: Fan, Lei, et al.
Publicado: (2024)
por: Fan, Lei, et al.
Publicado: (2024)
FLUX-Text: A Simple and Advanced Diffusion Transformer Baseline for Scene Text Editing
por: Lan, Rui, et al.
Publicado: (2025)
por: Lan, Rui, et al.
Publicado: (2025)
Towards Training-Free Scene Text Editing
por: Li, Yubo, et al.
Publicado: (2026)
por: Li, Yubo, et al.
Publicado: (2026)
Gaze into the Details: Locality-Sensitive Enhancement for OCTA Retinal Vessel Segmentation
por: Huang, Tuopusen, et al.
Publicado: (2026)
por: Huang, Tuopusen, et al.
Publicado: (2026)
GlyphMastero: A Glyph Encoder for High-Fidelity Scene Text Editing
por: Wang, Tong, et al.
Publicado: (2025)
por: Wang, Tong, et al.
Publicado: (2025)
Localized Gaussian Splatting Editing with Contextual Awareness
por: Xiao, Hanyuan, et al.
Publicado: (2024)
por: Xiao, Hanyuan, et al.
Publicado: (2024)
Hypergraph Tversky-Aware Domain Incremental Learning for Brain Tumor Segmentation with Missing Modalities
por: Wang, Junze, et al.
Publicado: (2025)
por: Wang, Junze, et al.
Publicado: (2025)
Physics-Aware 3D Gaussian Editing for Driving Scene Generation
por: Zhou, Feng, et al.
Publicado: (2026)
por: Zhou, Feng, et al.
Publicado: (2026)
Edit Fidelity Field: Semantics-Aware Region Isolation for Training-Free Scene Text Editing
por: Li, Guandong, et al.
Publicado: (2026)
por: Li, Guandong, et al.
Publicado: (2026)
SyncNoise: Geometrically Consistent Noise Prediction for Text-based 3D Scene Editing
por: Li, Ruihuang, et al.
Publicado: (2024)
por: Li, Ruihuang, et al.
Publicado: (2024)
TextMastero: Mastering High-Quality Scene Text Editing in Diverse Languages and Styles
por: Wang, Tong, et al.
Publicado: (2024)
por: Wang, Tong, et al.
Publicado: (2024)
Free-Editor: Zero-shot Text-driven 3D Scene Editing
por: Karim, Nazmul, et al.
Publicado: (2023)
por: Karim, Nazmul, et al.
Publicado: (2023)
ToCoAD: Two-Stage Contrastive Learning for Industrial Anomaly Detection
por: Liang, Yun, et al.
Publicado: (2024)
por: Liang, Yun, et al.
Publicado: (2024)
Self-Prompting Diffusion Transformer for Open-Vocabulary Scene Text Editing via In-Context Learning
por: Li, Hongxi, et al.
Publicado: (2026)
por: Li, Hongxi, et al.
Publicado: (2026)
Ejemplares similares
-
DiTalker: A Unified DiT-based Framework for High-Quality and Speaking Styles Controllable Portrait Animation
por: Feng, He, et al.
Publicado: (2025) -
FOCA: Frequency-Oriented Cross-Domain Forgery Detection, Localization and Explanation via Multi-Modal Large Language Model
por: Liu, Zhou, et al.
Publicado: (2026) -
EFDiT: Efficient Fine-grained Image Generation Using Diffusion Transformer Models
por: Wang, Kun, et al.
Publicado: (2025) -
Adams Bashforth Moulton Solver for Inversion and Editing in Rectified Flow
por: Ma, Yongjia, et al.
Publicado: (2025) -
CogPortrait: Fine-Grained Eye-Region Control in Portrait Animation via Hierarchical Agent Planning
por: Feng, He, et al.
Publicado: (2026)