VSAL: A Vision Solver with Adaptive Layouts for Graph Property Detection
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Xie, Jiahao, Tong, Guangmo |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
LANS: A Layout-Aware Neural Solver for Plane Geometry Problem
par: Li, Zhong-Zhi, et autres
Publié: (2023)
par: Li, Zhong-Zhi, et autres
Publié: (2023)
LayoutVLM: Differentiable Optimization of 3D Layout via Vision-Language Models
par: Sun, Fan-Yun, et autres
Publié: (2024)
par: Sun, Fan-Yun, et autres
Publié: (2024)
PP-DocLayout: A Unified Document Layout Detection Model to Accelerate Large-Scale Data Construction
par: Sun, Ting, et autres
Publié: (2025)
par: Sun, Ting, et autres
Publié: (2025)
Sketch-to-Layout: Sketch-Guided Multimodal Layout Generation
par: Brioschi, Riccardo, et autres
Publié: (2025)
par: Brioschi, Riccardo, et autres
Publié: (2025)
LayoutAgent: A Vision-Language Agent Guided Compositional Diffusion for Spatial Layout Planning
par: Fan, Zezhong, et autres
Publié: (2025)
par: Fan, Zezhong, et autres
Publié: (2025)
Seeing is Improving: Visual Feedback for Iterative Text Layout Refinement
par: Guo, Junrong, et autres
Publié: (2026)
par: Guo, Junrong, et autres
Publié: (2026)
CellMamba: Adaptive Mamba for Accurate and Efficient Cell Detection
par: Liu, Ruochen, et autres
Publié: (2025)
par: Liu, Ruochen, et autres
Publié: (2025)
TAP-VL: Text Layout-Aware Pre-training for Enriched Vision-Language Models
par: Fhima, Jonathan, et autres
Publié: (2024)
par: Fhima, Jonathan, et autres
Publié: (2024)
LTOS: Layout-controllable Text-Object Synthesis via Adaptive Cross-attention Fusions
par: Zhao, Xiaoran, et autres
Publié: (2024)
par: Zhao, Xiaoran, et autres
Publié: (2024)
Learning to Pose Problems: Reasoning-Driven and Solver-Adaptive Data Synthesis
par: Wei, Yongxian, et autres
Publié: (2025)
par: Wei, Yongxian, et autres
Publié: (2025)
Constrained Layout Generation with Factor Graphs
par: Dupty, Mohammed Haroon, et autres
Publié: (2024)
par: Dupty, Mohammed Haroon, et autres
Publié: (2024)
RanLayNet: A Dataset for Document Layout Detection used for Domain Adaptation and Generalization
par: Anand, Avinash, et autres
Publié: (2024)
par: Anand, Avinash, et autres
Publié: (2024)
Content-Aware Ad Banner Layout Generation with Two-Stage Chain-of-Thought in Vision Language Models
par: Yoshitake, Kei, et autres
Publié: (2025)
par: Yoshitake, Kei, et autres
Publié: (2025)
Utilizing Graph Generation for Enhanced Domain Adaptive Object Detection
par: Wang, Mu
Publié: (2024)
par: Wang, Mu
Publié: (2024)
HouseLayout3D: A Benchmark and Training-Free Baseline for 3D Layout Estimation in the Wild
par: Bieri, Valentin, et autres
Publié: (2025)
par: Bieri, Valentin, et autres
Publié: (2025)
Enhancing Breast Cancer Detection with Vision Transformers and Graph Neural Networks
par: Cai, Yeming, et autres
Publié: (2025)
par: Cai, Yeming, et autres
Publié: (2025)
Robo-SGG: Exploiting Layout-Oriented Normalization and Restitution Can Improve Robust Scene Graph Generation
par: Lv, Changsheng, et autres
Publié: (2025)
par: Lv, Changsheng, et autres
Publié: (2025)
Layout-Conditioned Autoregressive Text-to-Image Generation via Structured Masking
par: Zheng, Zirui, et autres
Publié: (2025)
par: Zheng, Zirui, et autres
Publié: (2025)
Check Field Detection Agent (CFD-Agent) using Multimodal Large Language and Vision Language Models
par: Halder, Sourav, et autres
Publié: (2025)
par: Halder, Sourav, et autres
Publié: (2025)
Automatic Layout Planning for Visually-Rich Documents with Instruction-Following Models
par: Zhu, Wanrong, et autres
Publié: (2024)
par: Zhu, Wanrong, et autres
Publié: (2024)
SAMamba: Adaptive State Space Modeling with Hierarchical Vision for Infrared Small Target Detection
par: Xu, Wenhao, et autres
Publié: (2025)
par: Xu, Wenhao, et autres
Publié: (2025)
Fine-Grained Instruction-Guided Graph Reasoning for Vision-and-Language Navigation
par: Liu, Yaohua, et autres
Publié: (2025)
par: Liu, Yaohua, et autres
Publié: (2025)
GROVER: Graph-guided Representation of Omics and Vision with Expert Regulation for Adaptive Spatial Multi-omics Fusion
par: Xiao, Yongjun, et autres
Publié: (2025)
par: Xiao, Yongjun, et autres
Publié: (2025)
Enhancing Object Coherence in Layout-to-Image Synthesis
par: Wang, Yibin, et autres
Publié: (2023)
par: Wang, Yibin, et autres
Publié: (2023)
Adaptive Camera Sensor for Vision Models
par: Baek, Eunsu, et autres
Publié: (2025)
par: Baek, Eunsu, et autres
Publié: (2025)
LIDAR: Lightweight Adaptive Cue-Aware Fusion Vision Mamba for Multimodal Segmentation of Structural Cracks
par: Liu, Hui, et autres
Publié: (2025)
par: Liu, Hui, et autres
Publié: (2025)
Point2RBox-v2: Rethinking Point-supervised Oriented Object Detection with Spatial Layout Among Instances
par: Yu, Yi, et autres
Publié: (2025)
par: Yu, Yi, et autres
Publié: (2025)
Free-Lunch Long Video Generation via Layer-Adaptive O.O.D Correction
par: Tian, Jiahao, et autres
Publié: (2026)
par: Tian, Jiahao, et autres
Publié: (2026)
A-VL: Adaptive Attention for Large Vision-Language Models
par: Zhang, Junyang, et autres
Publié: (2024)
par: Zhang, Junyang, et autres
Publié: (2024)
Training-free Composite Scene Generation for Layout-to-Image Synthesis
par: Liu, Jiaqi, et autres
Publié: (2024)
par: Liu, Jiaqi, et autres
Publié: (2024)
ILDiff: Generate Transparent Animated Stickers by Implicit Layout Distillation
par: Zhang, Ting, et autres
Publié: (2024)
par: Zhang, Ting, et autres
Publié: (2024)
MKSNet: Advanced Small Object Detection in Remote Sensing Imagery with Multi-Kernel and Dual Attention Mechanisms
par: Zhang, Jiahao, et autres
Publié: (2025)
par: Zhang, Jiahao, et autres
Publié: (2025)
BiomedAP: A Vision-Informed Dual-Anchor Framework with Gated Cross-Modal Fusion for Robust Medical Vision-Language Adaptation
par: Tong, Huanyang, et autres
Publié: (2026)
par: Tong, Huanyang, et autres
Publié: (2026)
Simple Token-Efficient Vision-Language Model for Case-level Pathology Synoptic Report Generation
par: Yang, Zhiyuan, et autres
Publié: (2026)
par: Yang, Zhiyuan, et autres
Publié: (2026)
Layout-and-Retouch: A Dual-stage Framework for Improving Diversity in Personalized Image Generation
par: Kim, Kangyeol, et autres
Publié: (2024)
par: Kim, Kangyeol, et autres
Publié: (2024)
RoBus: A Multimodal Dataset for Controllable Road Networks and Building Layouts Generation
par: Li, Tao, et autres
Publié: (2024)
par: Li, Tao, et autres
Publié: (2024)
Outlier-Robust Diffusion Solvers for Inverse Problems
par: Zheng, Yang, et autres
Publié: (2026)
par: Zheng, Yang, et autres
Publié: (2026)
Phantasia: Context-Adaptive Backdoors in Vision Language Models
par: Tran, Nam Duong, et autres
Publié: (2026)
par: Tran, Nam Duong, et autres
Publié: (2026)
Retrieval-Augmented Prompt for OOD Detection
par: Han, Ruisong, et autres
Publié: (2025)
par: Han, Ruisong, et autres
Publié: (2025)
LocRef-Diffusion:Tuning-Free Layout and Appearance-Guided Generation
par: Deng, Fan, et autres
Publié: (2024)
par: Deng, Fan, et autres
Publié: (2024)
Documents similaires
-
LANS: A Layout-Aware Neural Solver for Plane Geometry Problem
par: Li, Zhong-Zhi, et autres
Publié: (2023) -
LayoutVLM: Differentiable Optimization of 3D Layout via Vision-Language Models
par: Sun, Fan-Yun, et autres
Publié: (2024) -
PP-DocLayout: A Unified Document Layout Detection Model to Accelerate Large-Scale Data Construction
par: Sun, Ting, et autres
Publié: (2025) -
Sketch-to-Layout: Sketch-Guided Multimodal Layout Generation
par: Brioschi, Riccardo, et autres
Publié: (2025) -
LayoutAgent: A Vision-Language Agent Guided Compositional Diffusion for Spatial Layout Planning
par: Fan, Zezhong, et autres
Publié: (2025)