CalliMaster: Mastering Page-level Chinese Calligraphy via Layout-guided Spatial Planning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Xu, Tianshuo, Hong, Tiantian, Chen, Zhifei, Chao, Fei, Chen, Ying-cong |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
UniCalli: A Unified Diffusion Framework for Column-Level Generation and Recognition of Chinese Calligraphy
par: Xu, Tianshuo, et autres
Publié: (2025)
par: Xu, Tianshuo, et autres
Publié: (2025)
CalliReader: Contextualizing Chinese Calligraphy via an Embedding-Aligned Vision-Language Model
par: Luo, Yuxuan, et autres
Publié: (2025)
par: Luo, Yuxuan, et autres
Publié: (2025)
Motion Forcing: A Decoupled Framework for Robust Video Generation in Motion Dynamics
par: Xu, Tianshuo, et autres
Publié: (2026)
par: Xu, Tianshuo, et autres
Publié: (2026)
Spatial Diffusion for Cell Layout Generation
par: Li, Chen, et autres
Publié: (2024)
par: Li, Chen, et autres
Publié: (2024)
Few-shot Calligraphy Style Learning
par: Chen, Fangda, et autres
Publié: (2024)
par: Chen, Fangda, et autres
Publié: (2024)
InkDiffuser: High-Fidelity One-shot Chinese Calligraphy via Differentiable Morphological Optimization
par: Shi, Kunchong, et autres
Publié: (2026)
par: Shi, Kunchong, et autres
Publié: (2026)
GNeRP: Gaussian-guided Neural Reconstruction of Reflective Objects with Noisy Polarization Priors
par: Yang, LI, et autres
Publié: (2024)
par: Yang, LI, et autres
Publié: (2024)
Improving Joint Embedding Predictive Architecture with Diffusion Noise
par: Qiu, Yuping, et autres
Publié: (2025)
par: Qiu, Yuping, et autres
Publié: (2025)
PhysMaster: Mastering Physical Representation for Video Generation via Reinforcement Learning
par: Ji, Sihui, et autres
Publié: (2025)
par: Ji, Sihui, et autres
Publié: (2025)
Moyun: A Diffusion-Based Model for Style-Specific Chinese Calligraphy Generation
par: Liu, Kaiyuan, et autres
Publié: (2024)
par: Liu, Kaiyuan, et autres
Publié: (2024)
iTryOn: Mastering Interactive Video Virtual Try-On with Spatial-Semantic Guidance
par: Zheng, Jun, et autres
Publié: (2026)
par: Zheng, Jun, et autres
Publié: (2026)
MCCD: A Multi-Attribute Chinese Calligraphy Character Dataset Annotated with Script Styles, Dynasties, and Calligraphers
par: Zhao, Yixin, et autres
Publié: (2025)
par: Zhao, Yixin, et autres
Publié: (2025)
Decoupling Layout from Glyph in Online Chinese Handwriting Generation
par: Ren, Min-Si, et autres
Publié: (2024)
par: Ren, Min-Si, et autres
Publié: (2024)
Shu Dao: A Calligraphy Score Framework Linking Calligraphy, Music, and Performance
par: Huang, Lican
Publié: (2026)
par: Huang, Lican
Publié: (2026)
LLM-Optic: Unveiling the Capabilities of Large Language Models for Universal Visual Grounding
par: Zhao, Haoyu, et autres
Publié: (2024)
par: Zhao, Haoyu, et autres
Publié: (2024)
Personalized Image Filter: Mastering Your Photographic Style
par: Zhu, Chengxuan, et autres
Publié: (2025)
par: Zhu, Chengxuan, et autres
Publié: (2025)
ResMaster: Mastering High-Resolution Image Generation via Structural and Fine-Grained Guidance
par: Shi, Shuwei, et autres
Publié: (2024)
par: Shi, Shuwei, et autres
Publié: (2024)
Motion Dreamer: Boundary Conditional Motion Reasoning for Physically Coherent Video Generation
par: Xu, Tianshuo, et autres
Publié: (2024)
par: Xu, Tianshuo, et autres
Publié: (2024)
Text-Anchored Score Composition: Tackling Condition Misalignment in Text-to-Image Diffusion Models
par: Wang, Luozhou, et autres
Publié: (2023)
par: Wang, Luozhou, et autres
Publié: (2023)
Layout2Scene: 3D Semantic Layout Guided Scene Generation via Geometry and Appearance Diffusion Priors
par: Chen, Minglin, et autres
Publié: (2025)
par: Chen, Minglin, et autres
Publié: (2025)
ReLayout: Towards Real-World Document Understanding via Layout-enhanced Pre-training
par: Jiang, Zhouqiang, et autres
Publié: (2024)
par: Jiang, Zhouqiang, et autres
Publié: (2024)
LayoutDiT: Exploring Content-Graphic Balance in Layout Generation with Diffusion Transformer
par: Li, Yu, et autres
Publié: (2024)
par: Li, Yu, et autres
Publié: (2024)
Uni-Renderer: Unifying Rendering and Inverse Rendering Via Dual Stream Diffusion
par: Chen, Zhifei, et autres
Publié: (2024)
par: Chen, Zhifei, et autres
Publié: (2024)
Universal Multi-view Black-box Attack against Object Detectors via Layout Optimization
par: Wang, Donghua, et autres
Publié: (2024)
par: Wang, Donghua, et autres
Publié: (2024)
LayoutDETR: Detection Transformer Is a Good Multimodal Layout Designer
par: Yu, Ning, et autres
Publié: (2022)
par: Yu, Ning, et autres
Publié: (2022)
No More Ambiguity in 360° Room Layout via Bi-Layout Estimation
par: Tsai, Yu-Ju, et autres
Publié: (2024)
par: Tsai, Yu-Ju, et autres
Publié: (2024)
Perceive-then-Plan: Layout-as-Policy for Monocular 3D Scene Layout Estimation
par: Zhou, Junwei, et autres
Publié: (2026)
par: Zhou, Junwei, et autres
Publié: (2026)
Multitwine: Multi-Object Compositing with Text and Layout Control
par: Tarrés, Gemma Canet, et autres
Publié: (2025)
par: Tarrés, Gemma Canet, et autres
Publié: (2025)
FlexPainter: Flexible and Multi-View Consistent Texture Generation
par: Yan, Dongyu, et autres
Publié: (2025)
par: Yan, Dongyu, et autres
Publié: (2025)
LayoutAgent: A Vision-Language Agent Guided Compositional Diffusion for Spatial Layout Planning
par: Fan, Zezhong, et autres
Publié: (2025)
par: Fan, Zezhong, et autres
Publié: (2025)
SPATIALGEN: Layout-guided 3D Indoor Scene Generation
par: Fang, Chuan, et autres
Publié: (2025)
par: Fang, Chuan, et autres
Publié: (2025)
Imaginarium: Vision-guided High-Quality 3D Scene Layout Generation
par: Zhu, Xiaoming, et autres
Publié: (2025)
par: Zhu, Xiaoming, et autres
Publié: (2025)
VideoMemory: Toward Consistent Video Generation via Memory Integration
par: Zhou, Jinsong, et autres
Publié: (2026)
par: Zhou, Jinsong, et autres
Publié: (2026)
DyST-XL: Dynamic Layout Planning and Content Control for Compositional Text-to-Video Generation
par: He, Weijie, et autres
Publié: (2025)
par: He, Weijie, et autres
Publié: (2025)
RoboTracer: Mastering Spatial Trace with Reasoning in Vision-Language Models for Robotics
par: Zhou, Enshen, et autres
Publié: (2025)
par: Zhou, Enshen, et autres
Publié: (2025)
RoboStressBench: Benchmarking VLM Robustness to Physical Visual Stress in Embodied Scenes
par: Wu, Leyi, et autres
Publié: (2026)
par: Wu, Leyi, et autres
Publié: (2026)
STANCE: Motion Coherent Video Generation Via Sparse-to-Dense Anchored Encoding
par: Chen, Zhifei, et autres
Publié: (2025)
par: Chen, Zhifei, et autres
Publié: (2025)
TimeStep Master: Asymmetrical Mixture of Timestep LoRA Experts for Versatile and Efficient Diffusion Models in Vision
par: Zhuang, Shaobin, et autres
Publié: (2025)
par: Zhuang, Shaobin, et autres
Publié: (2025)
LAYOUTDREAMER: Physics-guided Layout for Text-to-3D Compositional Scene Generation
par: Zhou, Yang, et autres
Publié: (2025)
par: Zhou, Yang, et autres
Publié: (2025)
3DTrajMaster: Mastering 3D Trajectory for Multi-Entity Motion in Video Generation
par: Fu, Xiao, et autres
Publié: (2024)
par: Fu, Xiao, et autres
Publié: (2024)
Documents similaires
-
UniCalli: A Unified Diffusion Framework for Column-Level Generation and Recognition of Chinese Calligraphy
par: Xu, Tianshuo, et autres
Publié: (2025) -
CalliReader: Contextualizing Chinese Calligraphy via an Embedding-Aligned Vision-Language Model
par: Luo, Yuxuan, et autres
Publié: (2025) -
Motion Forcing: A Decoupled Framework for Robust Video Generation in Motion Dynamics
par: Xu, Tianshuo, et autres
Publié: (2026) -
Spatial Diffusion for Cell Layout Generation
par: Li, Chen, et autres
Publié: (2024) -
Few-shot Calligraphy Style Learning
par: Chen, Fangda, et autres
Publié: (2024)