DeepIcon: A Hierarchical Network for Layer-wise Icon Vectorization
Fuente:
arXiv
Saved in:
| Main Authors: | Bing, Qi, Zhang, Chaoyi, Cai, Weidong |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Learning to Synthesize Graphics Programs for Geometric Artworks
by: Bing, Qi, et al.
Published: (2024)
by: Bing, Qi, et al.
Published: (2024)
Through the Magnifying Glass: Adaptive Perception Magnification for Hallucination-Free VLM Decoding
by: Mao, Shunqi, et al.
Published: (2025)
by: Mao, Shunqi, et al.
Published: (2025)
Exploring Annotation-free Image Captioning with Retrieval-augmented Pseudo Sentence Generation
by: Li, Zhiyuan, et al.
Published: (2023)
by: Li, Zhiyuan, et al.
Published: (2023)
Channel-wise Vector Quantization
by: Song, Wei, et al.
Published: (2026)
by: Song, Wei, et al.
Published: (2026)
Enhancing Advanced Visual Reasoning Ability of Large Language Models
by: Li, Zhiyuan, et al.
Published: (2024)
by: Li, Zhiyuan, et al.
Published: (2024)
Controllable Contextualized Image Captioning: Directing the Visual Narrative through User-Defined Highlights
by: Mao, Shunqi, et al.
Published: (2024)
by: Mao, Shunqi, et al.
Published: (2024)
Synthetically Trained Icon Proposals for Parsing and Summarizing Infographics
by: Madan, Spandan, et al.
Published: (2018)
by: Madan, Spandan, et al.
Published: (2018)
SemLayer: Semantic-aware Generative Segmentation and Layer Construction for Abstract Icons
by: Xu, Haiyang, et al.
Published: (2026)
by: Xu, Haiyang, et al.
Published: (2026)
Multimodal Causal Reasoning Benchmark: Challenging Vision Large Language Models to Discern Causal Links Across Modalities
by: Li, Zhiyuan, et al.
Published: (2024)
by: Li, Zhiyuan, et al.
Published: (2024)
LP-DETR: Layer-wise Progressive Relations for Object Detection
by: Kang, Zhengjian, et al.
Published: (2025)
by: Kang, Zhengjian, et al.
Published: (2025)
LayerCache: Exploiting Layer-wise Velocity Heterogeneity for Efficient Flow Matching Inference
by: Li, Guandong
Published: (2026)
by: Li, Guandong
Published: (2026)
An analysis of HOI: using a training-free method with multimodal visual foundation models when only the test set is available, without the training set
by: Ai, Chaoyi
Published: (2024)
by: Ai, Chaoyi
Published: (2024)
Beyond Point-wise Neural Collapse: A Topology-Aware Hierarchical Classifier for Class-Incremental Learning
by: Yi, Huiyu, et al.
Published: (2026)
by: Yi, Huiyu, et al.
Published: (2026)
Fine-Tuning Stable Diffusion XL for Stylistic Icon Generation: A Comparison of Caption Size
by: Sultan, Youssef, et al.
Published: (2024)
by: Sultan, Youssef, et al.
Published: (2024)
Layer-wise Model Merging for Unsupervised Domain Adaptation in Segmentation Tasks
by: Alcover-Couso, Roberto, et al.
Published: (2024)
by: Alcover-Couso, Roberto, et al.
Published: (2024)
STNet: Deep Audio-Visual Fusion Network for Robust Speaker Tracking
by: Li, Yidi, et al.
Published: (2024)
by: Li, Yidi, et al.
Published: (2024)
CA-W3D: Leveraging Context-Aware Knowledge for Weakly Supervised Monocular 3D Detection
by: Liu, Chupeng, et al.
Published: (2025)
by: Liu, Chupeng, et al.
Published: (2025)
UniME-V2: MLLM-as-a-Judge for Universal Multimodal Embedding Learning
by: Gu, Tiancheng, et al.
Published: (2025)
by: Gu, Tiancheng, et al.
Published: (2025)
Pack-PTQ: Advancing Post-training Quantization of Neural Networks by Pack-wise Reconstruction
by: Li, Changjun, et al.
Published: (2025)
by: Li, Changjun, et al.
Published: (2025)
SDAR-VL: Stable and Efficient Block-wise Diffusion for Vision-Language Understanding
by: Cheng, Shuang, et al.
Published: (2025)
by: Cheng, Shuang, et al.
Published: (2025)
Enhanced Multimodal Hate Video Detection via Channel-wise and Modality-wise Fusion
by: Zhang, Yinghui, et al.
Published: (2025)
by: Zhang, Yinghui, et al.
Published: (2025)
CoViPAL: Layer-wise Contextualized Visual Token Pruning for Large Vision-Language Models
by: Tang, Zicong, et al.
Published: (2025)
by: Tang, Zicong, et al.
Published: (2025)
Feature Map Convergence Evaluation for Functional Module
by: Zhang, Ludan, et al.
Published: (2024)
by: Zhang, Ludan, et al.
Published: (2024)
Restrictive Hierarchical Semantic Segmentation for Stratified Tooth Layer Detection
by: Banks, Ryan, et al.
Published: (2025)
by: Banks, Ryan, et al.
Published: (2025)
3DGS-Enhancer: Enhancing Unbounded 3D Gaussian Splatting with View-consistent 2D Diffusion Priors
by: Liu, Xi, et al.
Published: (2024)
by: Liu, Xi, et al.
Published: (2024)
PaRot: Patch-Wise Rotation-Invariant Network via Feature Disentanglement and Pose Restoration
by: Zhang, Dingxin, et al.
Published: (2023)
by: Zhang, Dingxin, et al.
Published: (2023)
HoloEv-Net: Efficient Event-based Action Recognition via Holographic Spatial Embedding and Global Spectral Gating
by: Hao, Weidong
Published: (2026)
by: Hao, Weidong
Published: (2026)
DS$^2$Net: Detail-Semantic Deep Supervision Network for Medical Image Segmentation
by: Huang, Zhaohong, et al.
Published: (2025)
by: Huang, Zhaohong, et al.
Published: (2025)
YOLO-PPA based Efficient Traffic Sign Detection for Cruise Control in Autonomous Driving
by: Zhang, Jingyu, et al.
Published: (2024)
by: Zhang, Jingyu, et al.
Published: (2024)
AccidentSim: Generating Vehicle Collision Videos with Physically Realistic Collision Trajectories from Real-World Accident Reports
by: Zhang, Xiangwen, et al.
Published: (2025)
by: Zhang, Xiangwen, et al.
Published: (2025)
ViTree: Single-path Neural Tree for Step-wise Interpretable Fine-grained Visual Categorization
by: Lao, Danning, et al.
Published: (2024)
by: Lao, Danning, et al.
Published: (2024)
DFVEdit: Conditional Delta Flow Vector for Zero-shot Video Editing
by: Cai, Lingling, et al.
Published: (2025)
by: Cai, Lingling, et al.
Published: (2025)
Module-wise Adaptive Adversarial Training for End-to-end Autonomous Driving
by: Zhang, Tianyuan, et al.
Published: (2024)
by: Zhang, Tianyuan, et al.
Published: (2024)
VQ-Map: Bird's-Eye-View Map Layout Estimation in Tokenized Discrete Space via Vector Quantization
by: Zhang, Yiwei, et al.
Published: (2024)
by: Zhang, Yiwei, et al.
Published: (2024)
Enhancing Out-of-Distribution Detection with Multitesting-based Layer-wise Feature Fusion
by: Li, Jiawei, et al.
Published: (2024)
by: Li, Jiawei, et al.
Published: (2024)
LARV: Data-Free Layer-wise Adaptive Rescaling Veneer for Model Merging
by: Wang, Xinyu, et al.
Published: (2026)
by: Wang, Xinyu, et al.
Published: (2026)
Sentiment-oriented Transformer-based Variational Autoencoder Network for Live Video Commenting
by: Fu, Fengyi, et al.
Published: (2024)
by: Fu, Fengyi, et al.
Published: (2024)
DeepInsert: Early Layer Bypass for Efficient and Performant Multimodal Understanding
by: Choraria, Moulik, et al.
Published: (2025)
by: Choraria, Moulik, et al.
Published: (2025)
Dig2DIG: Dig into Diffusion Information Gains for Image Fusion
by: Cao, Bing, et al.
Published: (2025)
by: Cao, Bing, et al.
Published: (2025)
VirPro: Visual-referred Probabilistic Prompt Learning for Weakly-Supervised Monocular 3D Detection
by: Liu, Chupeng, et al.
Published: (2026)
by: Liu, Chupeng, et al.
Published: (2026)
Similar Items
-
Learning to Synthesize Graphics Programs for Geometric Artworks
by: Bing, Qi, et al.
Published: (2024) -
Through the Magnifying Glass: Adaptive Perception Magnification for Hallucination-Free VLM Decoding
by: Mao, Shunqi, et al.
Published: (2025) -
Exploring Annotation-free Image Captioning with Retrieval-augmented Pseudo Sentence Generation
by: Li, Zhiyuan, et al.
Published: (2023) -
Channel-wise Vector Quantization
by: Song, Wei, et al.
Published: (2026) -
Enhancing Advanced Visual Reasoning Ability of Large Language Models
by: Li, Zhiyuan, et al.
Published: (2024)