GeoLoom: High-quality Geometric Diagram Generation from Textual Input
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wei, Xiaojing, Zhang, Ting, He, Wei, Wang, Jingdong, Huang, Hua |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
MagicGeo: Training-Free Text-Guided Geometric Diagram Generation
par: Wang, Junxiao, et autres
Publié: (2025)
par: Wang, Junxiao, et autres
Publié: (2025)
Loom: Diffusion-Transformer for Interleaved Generation
par: Ye, Mingcheng, et autres
Publié: (2025)
par: Ye, Mingcheng, et autres
Publié: (2025)
On Multi-Step Theorem Prediction via Non-Parametric Structural Priors
par: Zhao, Junbo, et autres
Publié: (2026)
par: Zhao, Junbo, et autres
Publié: (2026)
TrajLoom: Dense Future Trajectory Generation from Video
par: Zhang, Zewei, et autres
Publié: (2026)
par: Zhang, Zewei, et autres
Publié: (2026)
Beyond the Textual: Generating Coherent Visual Options for MCQs
par: Wang, Wanqiang, et autres
Publié: (2025)
par: Wang, Wanqiang, et autres
Publié: (2025)
VideoLoom: A Video Large Language Model for Joint Spatial-Temporal Understanding
par: Shi, Jiapeng, et autres
Publié: (2026)
par: Shi, Jiapeng, et autres
Publié: (2026)
OmniEval: A Benchmark for Evaluating Omni-modal Models with Visual, Auditory, and Textual Inputs
par: Zhang, Yiman, et autres
Publié: (2025)
par: Zhang, Yiman, et autres
Publié: (2025)
Low-Biased General Annotated Dataset Generation
par: Jiang, Dengyang, et autres
Publié: (2024)
par: Jiang, Dengyang, et autres
Publié: (2024)
LoomNet: Enhancing Multi-View Image Generation via Latent Space Weaving
par: Federico, Giulio, et autres
Publié: (2025)
par: Federico, Giulio, et autres
Publié: (2025)
Diagram-Driven Course Questions Generation
par: Zhang, Xinyu, et autres
Publié: (2024)
par: Zhang, Xinyu, et autres
Publié: (2024)
Socratic-Geo: Synthetic Data Generation and Geometric Reasoning via Multi-Agent Interaction
par: Jiao, Zhengbo, et autres
Publié: (2026)
par: Jiao, Zhengbo, et autres
Publié: (2026)
Historical Astronomical Diagrams Decomposition in Geometric Primitives
par: Kalleli, Syrine, et autres
Publié: (2024)
par: Kalleli, Syrine, et autres
Publié: (2024)
GeoReF: Geometric Alignment Across Shape Variation for Category-level Object Pose Refinement
par: Zheng, Linfang, et autres
Publié: (2024)
par: Zheng, Linfang, et autres
Publié: (2024)
GeoVideo: Introducing Geometric Regularization into Video Generation Model
par: Bai, Yunpeng, et autres
Publié: (2025)
par: Bai, Yunpeng, et autres
Publié: (2025)
GeoSDF: Plane Geometry Diagram Synthesis via Signed Distance Field
par: Zhang, Chengrui, et autres
Publié: (2025)
par: Zhang, Chengrui, et autres
Publié: (2025)
Bringing Textual Prompt to AI-Generated Image Quality Assessment
par: Qu, Bowen, et autres
Publié: (2024)
par: Qu, Bowen, et autres
Publié: (2024)
BGG: Bridging the Geometric Gap between Cross-View images by Vision Foundation Model Adaptation for Geo-Localization
par: Wang, Wei, et autres
Publié: (2026)
par: Wang, Wei, et autres
Publié: (2026)
DISPLAY: Directable Human-Object Interaction Video Generation via Sparse Motion Guidance and Multi-Task Auxiliary
par: Guan, Jiazhi, et autres
Publié: (2026)
par: Guan, Jiazhi, et autres
Publié: (2026)
HiRes-LLaVA: Restoring Fragmentation Input in High-Resolution Large Vision-Language Models
par: Huang, Runhui, et autres
Publié: (2024)
par: Huang, Runhui, et autres
Publié: (2024)
TagFog: Textual Anchor Guidance and Fake Outlier Generation for Visual Out-of-Distribution Detection
par: Chen, Jiankang, et autres
Publié: (2024)
par: Chen, Jiankang, et autres
Publié: (2024)
Textual Inversion and Self-supervised Refinement for Radiology Report Generation
par: Luo, Yuanjiang, et autres
Publié: (2024)
par: Luo, Yuanjiang, et autres
Publié: (2024)
Distilling Textual Priors from LLM to Efficient Image Fusion
par: Zhang, Ran, et autres
Publié: (2025)
par: Zhang, Ran, et autres
Publié: (2025)
Sora Generates Videos with Stunning Geometrical Consistency
par: Li, Xuanyi, et autres
Publié: (2024)
par: Li, Xuanyi, et autres
Publié: (2024)
MoReact: Generating Reactive Motion from Textual Descriptions
par: Xu, Xiyan, et autres
Publié: (2025)
par: Xu, Xiyan, et autres
Publié: (2025)
LiDARDraft: Generating LiDAR Point Cloud from Versatile Inputs
par: Wei, Haiyun, et autres
Publié: (2025)
par: Wei, Haiyun, et autres
Publié: (2025)
Visual Textualization for Image Prompted Object Detection
par: Wu, Yongjian, et autres
Publié: (2025)
par: Wu, Yongjian, et autres
Publié: (2025)
TeSG: Textual Semantic Guidance for Infrared and Visible Image Fusion
par: Zhu, Mingrui, et autres
Publié: (2025)
par: Zhu, Mingrui, et autres
Publié: (2025)
Enhancing Cross-View Geo-Localization Generalization via Global-Local Consistency and Geometric Equivariance
par: Wang, Xiaowei, et autres
Publié: (2025)
par: Wang, Xiaowei, et autres
Publié: (2025)
Improving Image Restoration through Removing Degradations in Textual Representations
par: Lin, Jingbo, et autres
Publié: (2023)
par: Lin, Jingbo, et autres
Publié: (2023)
UniPPTBench: A Unified Benchmark for Presentation Generation Across Diverse Input Settings
par: Zhao, Bo, et autres
Publié: (2026)
par: Zhao, Bo, et autres
Publié: (2026)
RxnCaption: Reformulating Reaction Diagram Parsing as Visual Prompt Guided Captioning
par: Song, Jiahe, et autres
Publié: (2025)
par: Song, Jiahe, et autres
Publié: (2025)
Are Classification Robustness and Explanation Robustness Really Strongly Correlated? An Analysis Through Input Loss Landscape
par: Chen, Tiejin, et autres
Publié: (2024)
par: Chen, Tiejin, et autres
Publié: (2024)
G2Face: High-Fidelity Reversible Face Anonymization via Generative and Geometric Priors
par: Yang, Haoxin, et autres
Publié: (2024)
par: Yang, Haoxin, et autres
Publié: (2024)
No Other Representation Component Is Needed: Diffusion Transformers Can Provide Representation Guidance by Themselves
par: Jiang, Dengyang, et autres
Publié: (2025)
par: Jiang, Dengyang, et autres
Publié: (2025)
RealCustom++: Representing Images as Real Textual Word for Real-Time Customization
par: Mao, Zhendong, et autres
Publié: (2024)
par: Mao, Zhendong, et autres
Publié: (2024)
Landscape-Awareness for Geometric View Diffusion Model
par: Chen, Yan-Ting, et autres
Publié: (2026)
par: Chen, Yan-Ting, et autres
Publié: (2026)
PBR3DGen: A VLM-guided Mesh Generation with High-quality PBR Texture
par: Wei, Xiaokang, et autres
Publié: (2025)
par: Wei, Xiaokang, et autres
Publié: (2025)
CoT4Det: A Chain-of-Thought Framework for Perception-Oriented Vision-Language Tasks
par: Qi, Yu, et autres
Publié: (2025)
par: Qi, Yu, et autres
Publié: (2025)
HIRI-ViT: Scaling Vision Transformer with High Resolution Inputs
par: Yao, Ting, et autres
Publié: (2024)
par: Yao, Ting, et autres
Publié: (2024)
Textual Decomposition Then Sub-motion-space Scattering for Open-Vocabulary Motion Generation
par: Fan, Ke, et autres
Publié: (2024)
par: Fan, Ke, et autres
Publié: (2024)
Documents similaires
-
MagicGeo: Training-Free Text-Guided Geometric Diagram Generation
par: Wang, Junxiao, et autres
Publié: (2025) -
Loom: Diffusion-Transformer for Interleaved Generation
par: Ye, Mingcheng, et autres
Publié: (2025) -
On Multi-Step Theorem Prediction via Non-Parametric Structural Priors
par: Zhao, Junbo, et autres
Publié: (2026) -
TrajLoom: Dense Future Trajectory Generation from Video
par: Zhang, Zewei, et autres
Publié: (2026) -
Beyond the Textual: Generating Coherent Visual Options for MCQs
par: Wang, Wanqiang, et autres
Publié: (2025)