SketchAgent: Generating Structured Diagrams from Hand-Drawn Sketches
Fuente:
arXiv
Guardado en:
| Autores principales: | Tan, Cheng, Chen, Qi, Wei, Jingxuan, Wu, Gaowei, Gao, Zhangyang, Li, Siyuan, Yu, Bihui, Guo, Ruifeng, Li, Stan Z. |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
From Words to Structured Visuals: A Benchmark and Framework for Text-to-Diagram Generation and Editing
por: Wei, Jingxuan, et al.
Publicado: (2024)
por: Wei, Jingxuan, et al.
Publicado: (2024)
SketchAgent: Language-Driven Sequential Sketch Generation
por: Vinker, Yael, et al.
Publicado: (2024)
por: Vinker, Yael, et al.
Publicado: (2024)
Boosting the Power of Small Multimodal Reasoning Models to Match Larger Models with Self-Consistency Training
por: Tan, Cheng, et al.
Publicado: (2023)
por: Tan, Cheng, et al.
Publicado: (2023)
Retrieval Meets Reasoning: Even High-school Textbook Knowledge Benefits Multimodal Reasoning
por: Tan, Cheng, et al.
Publicado: (2024)
por: Tan, Cheng, et al.
Publicado: (2024)
RT-Sketch: Goal-Conditioned Imitation Learning from Hand-Drawn Sketches
por: Sundaresan, Priya, et al.
Publicado: (2024)
por: Sundaresan, Priya, et al.
Publicado: (2024)
Sketch-MoMa: Teleoperation for Mobile Manipulator via Interpretation of Hand-Drawn Sketches
por: Tanada, Kosei, et al.
Publicado: (2024)
por: Tanada, Kosei, et al.
Publicado: (2024)
Sketch2MinSurf: Vision-Language Guided Generation of Editable Minimal Surfaces from Hand-Drawn Sketches
por: Wang, Wenda, et al.
Publicado: (2026)
por: Wang, Wenda, et al.
Publicado: (2026)
Sketch-to-Skill: Bootstrapping Robot Learning with Human Drawn Trajectory Sketches
por: Yu, Peihong, et al.
Publicado: (2025)
por: Yu, Peihong, et al.
Publicado: (2025)
ResearchPulse: Building Method-Experiment Chains through Multi-Document Scientific Inference
por: Chen, Qi, et al.
Publicado: (2025)
por: Chen, Qi, et al.
Publicado: (2025)
SketchMind: A Multi-Agent Cognitive Framework for Assessing Student-Drawn Scientific Sketches
por: Latif, Ehsan, et al.
Publicado: (2025)
por: Latif, Ehsan, et al.
Publicado: (2025)
SimVPv2: Towards Simple yet Powerful Spatiotemporal Predictive Learning
por: Tan, Cheng, et al.
Publicado: (2022)
por: Tan, Cheng, et al.
Publicado: (2022)
Sketch2Topo: Using Hand-Drawn Inputs for Diffusion-Based Topology Optimization
por: Feng, Shuyue, et al.
Publicado: (2026)
por: Feng, Shuyue, et al.
Publicado: (2026)
FoldToken2: Learning compact, invariant and generative protein structure language
por: Gao, Zhangyang, et al.
Publicado: (2024)
por: Gao, Zhangyang, et al.
Publicado: (2024)
USTEP: Spatio-Temporal Predictive Learning under A Unified View
por: Tan, Cheng, et al.
Publicado: (2023)
por: Tan, Cheng, et al.
Publicado: (2023)
Peer Review as A Multi-Turn and Long-Context Dialogue with Role-Based Interactions
por: Tan, Cheng, et al.
Publicado: (2024)
por: Tan, Cheng, et al.
Publicado: (2024)
VidSketch: Hand-drawn Sketch-Driven Video Generation with Diffusion Control
por: Jiang, Lifan, et al.
Publicado: (2025)
por: Jiang, Lifan, et al.
Publicado: (2025)
Do Generalised Classifiers really work on Human Drawn Sketches?
por: Bandyopadhyay, Hmrishav, et al.
Publicado: (2024)
por: Bandyopadhyay, Hmrishav, et al.
Publicado: (2024)
Sentence-Level or Token-Level? A Comprehensive Study on Knowledge Distillation
por: Wei, Jingxuan, et al.
Publicado: (2024)
por: Wei, Jingxuan, et al.
Publicado: (2024)
RDesign: Hierarchical Data-efficient Representation Learning for Tertiary Structure-based RNA Design
por: Tan, Cheng, et al.
Publicado: (2023)
por: Tan, Cheng, et al.
Publicado: (2023)
Sketch2BIM: A Multi-Agent Human-AI Collaborative Pipeline to Convert Hand-Drawn Floor Plans to 3D BIM
por: Ratul, Abir Khan, et al.
Publicado: (2025)
por: Ratul, Abir Khan, et al.
Publicado: (2025)
SketchJudge: A Diagnostic Benchmark for Grading Hand-drawn Diagrams with Multimodal Large Language Models
por: Su, Yuhang, et al.
Publicado: (2026)
por: Su, Yuhang, et al.
Publicado: (2026)
AlphaFold Database Debiasing for Robust Inverse Folding
por: Tan, Cheng, et al.
Publicado: (2025)
por: Tan, Cheng, et al.
Publicado: (2025)
Content-Conditioned Generation of Stylized Free hand Sketches
por: Liu, Jiajun, et al.
Publicado: (2024)
por: Liu, Jiajun, et al.
Publicado: (2024)
"Stack It Up!": 3D Stable Structure Generation from 2D Hand-drawn Sketch
por: Xu, Yiqing, et al.
Publicado: (2025)
por: Xu, Yiqing, et al.
Publicado: (2025)
SketchDream: Sketch-based Text-to-3D Generation and Editing
por: Liu, Feng-Lin, et al.
Publicado: (2024)
por: Liu, Feng-Lin, et al.
Publicado: (2024)
SketchVideo: Sketch-based Video Generation and Editing
por: Liu, Feng-Lin, et al.
Publicado: (2025)
por: Liu, Feng-Lin, et al.
Publicado: (2025)
Stroke2Sketch: Harnessing Stroke Attributes for Training-Free Sketch Generation
por: Yang, Rui, et al.
Publicado: (2025)
por: Yang, Rui, et al.
Publicado: (2025)
AirSketch: Generative Motion to Sketch
por: Lim, Hui Xian Grace, et al.
Publicado: (2024)
por: Lim, Hui Xian Grace, et al.
Publicado: (2024)
ChartMind: A Comprehensive Benchmark for Complex Real-world Multimodal Chart Question Answering
por: Wei, Jingxuan, et al.
Publicado: (2025)
por: Wei, Jingxuan, et al.
Publicado: (2025)
LLaVA-NeuMT: Selective Layer-Neuron Modulation for Efficient Multilingual Multimodal Translation
por: Wei, Jingxuan, et al.
Publicado: (2025)
por: Wei, Jingxuan, et al.
Publicado: (2025)
Re-Dock: Towards Flexible and Realistic Molecular Docking with Diffusion Bridge
por: Huang, Yufei, et al.
Publicado: (2024)
por: Huang, Yufei, et al.
Publicado: (2024)
UniIF: Unified Molecule Inverse Folding
por: Gao, Zhangyang, et al.
Publicado: (2024)
por: Gao, Zhangyang, et al.
Publicado: (2024)
Sketch2PoseNet: Efficient and Generalized Sketch to 3D Human Pose Prediction
por: Wang, Li, et al.
Publicado: (2025)
por: Wang, Li, et al.
Publicado: (2025)
SketchFill: Sketch-Guided Code Generation for Imputing Derived Missing Values
por: Zhang, Yunfan, et al.
Publicado: (2024)
por: Zhang, Yunfan, et al.
Publicado: (2024)
SketchFaceGS: Real-Time Sketch-Driven Face Editing and Generation with Gaussian Splatting
por: Li, Bo, et al.
Publicado: (2026)
por: Li, Bo, et al.
Publicado: (2026)
LLM-Sketch: Enhancing Network Sketches with LLM
por: Li, Yuanpeng, et al.
Publicado: (2025)
por: Li, Yuanpeng, et al.
Publicado: (2025)
CoProSketch: Controllable and Progressive Sketch Generation with Diffusion Model
por: Zhan, Ruohao, et al.
Publicado: (2025)
por: Zhan, Ruohao, et al.
Publicado: (2025)
Sketch2Anim: Towards Transferring Sketch Storyboards into 3D Animation
por: Zhong, Lei, et al.
Publicado: (2025)
por: Zhong, Lei, et al.
Publicado: (2025)
SketchTriplet: Self-Supervised Scenarized Sketch-Text-Image Triplet Generation
por: Wu, Zhenbei, et al.
Publicado: (2024)
por: Wu, Zhenbei, et al.
Publicado: (2024)
Sketch-to-Layout: Sketch-Guided Multimodal Layout Generation
por: Brioschi, Riccardo, et al.
Publicado: (2025)
por: Brioschi, Riccardo, et al.
Publicado: (2025)
Ejemplares similares
-
From Words to Structured Visuals: A Benchmark and Framework for Text-to-Diagram Generation and Editing
por: Wei, Jingxuan, et al.
Publicado: (2024) -
SketchAgent: Language-Driven Sequential Sketch Generation
por: Vinker, Yael, et al.
Publicado: (2024) -
Boosting the Power of Small Multimodal Reasoning Models to Match Larger Models with Self-Consistency Training
por: Tan, Cheng, et al.
Publicado: (2023) -
Retrieval Meets Reasoning: Even High-school Textbook Knowledge Benefits Multimodal Reasoning
por: Tan, Cheng, et al.
Publicado: (2024) -
RT-Sketch: Goal-Conditioned Imitation Learning from Hand-Drawn Sketches
por: Sundaresan, Priya, et al.
Publicado: (2024)