Enregistré dans:
| Auteurs principaux: | Xiao, Hongcan, Xiao, Xinyue, Wang, Yilin, Zhang, Yue, Qi, Yonggang |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2604.08042 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
StickMotion: Generating 3D Human Motions by Drawing a Stickman
par: Wang, Tao, et autres
Publié: (2025)
par: Wang, Tao, et autres
Publié: (2025)
ShadowDraw: From Any Object to Shadow-Drawing Compositional Art
par: Luo, Rundong, et autres
Publié: (2025)
par: Luo, Rundong, et autres
Publié: (2025)
VS-LLM: Visual-Semantic Depression Assessment based on LLM for Drawing Projection Test
par: Wu, Meiqi, et autres
Publié: (2025)
par: Wu, Meiqi, et autres
Publié: (2025)
From Drawings to Decisions: A Hybrid Vision-Language Framework for Parsing 2D Engineering Drawings into Structured Manufacturing Knowledge
par: Khan, Muhammad Tayyab, et autres
Publié: (2025)
par: Khan, Muhammad Tayyab, et autres
Publié: (2025)
Text-Enhanced Panoptic Symbol Spotting in CAD Drawings
par: Liu, Xianlin, et autres
Publié: (2025)
par: Liu, Xianlin, et autres
Publié: (2025)
ViRED: Prediction of Visual Relations in Engineering Drawings
par: Gu, Chao, et autres
Publié: (2024)
par: Gu, Chao, et autres
Publié: (2024)
SridBench: Benchmark of Scientific Research Illustration Drawing of Image Generation Model
par: Chang, Yifan, et autres
Publié: (2025)
par: Chang, Yifan, et autres
Publié: (2025)
MechVQA: Benchmarking and Enhancing Multimodal LLMs on Comprehensive Mechanical Drawing Understanding
par: Kou, Qian, et autres
Publié: (2026)
par: Kou, Qian, et autres
Publié: (2026)
Reinforcing Spatial Reasoning in Vision-Language Models with Interwoven Thinking and Visual Drawing
par: Wu, Junfei, et autres
Publié: (2025)
par: Wu, Junfei, et autres
Publié: (2025)
DrawMotion: Generating 3D Human Motions by Freehand Drawing
par: Wang, Tao, et autres
Publié: (2026)
par: Wang, Tao, et autres
Publié: (2026)
Fine-Tuning Vision-Language Model for Automated Engineering Drawing Information Extraction
par: Khan, Muhammad Tayyab, et autres
Publié: (2024)
par: Khan, Muhammad Tayyab, et autres
Publié: (2024)
PhyDrawGen: Physically Grounded Diagram Generation from Natural Language
par: Haque, Nafiul, et autres
Publié: (2026)
par: Haque, Nafiul, et autres
Publié: (2026)
Draw-In-Mind: Rebalancing Designer-Painter Roles in Unified Multimodal Models Benefits Image Editing
par: Zeng, Ziyun, et autres
Publié: (2025)
par: Zeng, Ziyun, et autres
Publié: (2025)
DrawVideo: Generating Long Video from Storyboard Keyframe Sketches
par: Xu, Chuanzhi, et autres
Publié: (2026)
par: Xu, Chuanzhi, et autres
Publié: (2026)
The Image Reconstruction Game: Drawing Common Ground Through Iterative Multimodal Dialogue
par: Hakimov, Sherzod, et autres
Publié: (2026)
par: Hakimov, Sherzod, et autres
Publié: (2026)
Few Channels Draw The Whole Picture: Revealing Massive Activations in Diffusion Transformers
par: Turri, Evelyn, et autres
Publié: (2026)
par: Turri, Evelyn, et autres
Publié: (2026)
PCEvE: Part Contribution Evaluation Based Model Explanation for Human Figure Drawing Assessment and Beyond
par: Lee, Jongseo, et autres
Publié: (2024)
par: Lee, Jongseo, et autres
Publié: (2024)
Think-Before-Draw: Decomposing Emotion Semantics & Fine-Grained Controllable Expressive Talking Head Generation
par: Shi, Hanlei, et autres
Publié: (2025)
par: Shi, Hanlei, et autres
Publié: (2025)
Generating Sketches in a Hierarchical Auto-Regressive Process for Flexible Sketch Drawing Manipulation at Stroke-Level
par: Zang, Sicong, et autres
Publié: (2025)
par: Zang, Sicong, et autres
Publié: (2025)
PanGu-Draw: Advancing Resource-Efficient Text-to-Image Synthesis with Time-Decoupled Training and Reusable Coop-Diffusion
par: Lu, Guansong, et autres
Publié: (2023)
par: Lu, Guansong, et autres
Publié: (2023)
Drawing the Line: Deep Segmentation for Extracting Art from Ancient Etruscan Mirrors
par: Sterzinger, Rafael, et autres
Publié: (2024)
par: Sterzinger, Rafael, et autres
Publié: (2024)
Automated Parsing of Engineering Drawings for Structured Information Extraction Using a Fine-tuned Document Understanding Transformer
par: Khan, Muhammad Tayyab, et autres
Publié: (2025)
par: Khan, Muhammad Tayyab, et autres
Publié: (2025)
PyPotteryInk: One-Step Diffusion Model for Sketch to Publication-ready Archaeological Drawings
par: Cardarelli, Lorenzo
Publié: (2025)
par: Cardarelli, Lorenzo
Publié: (2025)
Pencils to Pixels: A Systematic Study of Creative Drawings across Children, Adults and AI
par: Nath, Surabhi S, et autres
Publié: (2025)
par: Nath, Surabhi S, et autres
Publié: (2025)
How to Enable LLM with 3D Capacity? A Survey of Spatial Reasoning in LLM
par: Zha, Jirong, et autres
Publié: (2025)
par: Zha, Jirong, et autres
Publié: (2025)
Draw Your Mind: Personalized Generation via Condition-Level Modeling in Text-to-Image Diffusion Models
par: Kim, Hyungjin, et autres
Publié: (2025)
par: Kim, Hyungjin, et autres
Publié: (2025)
Spatial 3D-LLM: Exploring Spatial Awareness in 3D Vision-Language Models
par: Wang, Xiaoyan, et autres
Publié: (2025)
par: Wang, Xiaoyan, et autres
Publié: (2025)
3D-Agent:Tri-Modal Multi-Agent Collaboration for Scalable 3D Object Annotation
par: Zhang, Jusheng, et autres
Publié: (2026)
par: Zhang, Jusheng, et autres
Publié: (2026)
3D-VCD: Hallucination Mitigation in 3D-LLM Embodied Agents through Visual Contrastive Decoding
par: Ogunleye, Makanjuola, et autres
Publié: (2026)
par: Ogunleye, Makanjuola, et autres
Publié: (2026)
RegionPLC: Regional Point-Language Contrastive Learning for Open-World 3D Scene Understanding
par: Yang, Jihan, et autres
Publié: (2023)
par: Yang, Jihan, et autres
Publié: (2023)
Is Contrastive Distillation Enough for Learning Comprehensive 3D Representations?
par: Zhang, Yifan, et autres
Publié: (2024)
par: Zhang, Yifan, et autres
Publié: (2024)
Semantic Aware Feature Extraction for Enhanced 3D Reconstruction
par: Nap, Ronald, et autres
Publié: (2026)
par: Nap, Ronald, et autres
Publié: (2026)
Speed3R: Sparse Feed-forward 3D Reconstruction Models
par: Ren, Weining, et autres
Publié: (2026)
par: Ren, Weining, et autres
Publié: (2026)
Real-Time Intuitive AI Drawing System for Collaboration: Enhancing Human Creativity through Formal and Contextual Intent Integration
par: Song, Jookyung, et autres
Publié: (2025)
par: Song, Jookyung, et autres
Publié: (2025)
A Multi-Stage Hybrid Framework for Automated Interpretation of Multi-View Engineering Drawings Using Vision Language Model
par: Khan, Muhammad Tayyab, et autres
Publié: (2025)
par: Khan, Muhammad Tayyab, et autres
Publié: (2025)
Wonder3D++: Cross-domain Diffusion for High-fidelity 3D Generation from a Single Image
par: Yang, Yuxiao, et autres
Publié: (2025)
par: Yang, Yuxiao, et autres
Publié: (2025)
MUSES: 3D-Controllable Image Generation via Multi-Modal Agent Collaboration
par: Ding, Yanbo, et autres
Publié: (2024)
par: Ding, Yanbo, et autres
Publié: (2024)
Spatio-Temporal Token Pruning for Efficient High-Resolution GUI Agents
par: Xu, Zhou, et autres
Publié: (2026)
par: Xu, Zhou, et autres
Publié: (2026)
TGBFormer: Transformer-GraphFormer Blender Network for Video Object Detection
par: Qi, Qiang, et autres
Publié: (2025)
par: Qi, Qiang, et autres
Publié: (2025)
Hyperbolic Contrastive Learning for Hierarchical 3D Point Cloud Embedding
par: Liu, Yingjie, et autres
Publié: (2025)
par: Liu, Yingjie, et autres
Publié: (2025)
Documents similaires
-
StickMotion: Generating 3D Human Motions by Drawing a Stickman
par: Wang, Tao, et autres
Publié: (2025) -
ShadowDraw: From Any Object to Shadow-Drawing Compositional Art
par: Luo, Rundong, et autres
Publié: (2025) -
VS-LLM: Visual-Semantic Depression Assessment based on LLM for Drawing Projection Test
par: Wu, Meiqi, et autres
Publié: (2025) -
From Drawings to Decisions: A Hybrid Vision-Language Framework for Parsing 2D Engineering Drawings into Structured Manufacturing Knowledge
par: Khan, Muhammad Tayyab, et autres
Publié: (2025) -
Text-Enhanced Panoptic Symbol Spotting in CAD Drawings
par: Liu, Xianlin, et autres
Publié: (2025)