Learning-based Stage Verification System in Manual Assembly Scenarios
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhang, Xingjian, Duan, Yutong, Chen, Zaishu |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Manual-PA: Learning 3D Part Assembly from Instruction Diagrams
por: Zhang, Jiahao, et al.
Publicado: (2024)
por: Zhang, Jiahao, et al.
Publicado: (2024)
PostureObjectstitch: Anomaly Image Generation Considering Assembly Relationships in Industrial Scenarios
por: Tong, Zebei, et al.
Publicado: (2026)
por: Tong, Zebei, et al.
Publicado: (2026)
Anomaly Triplet-Net: Progress Recognition Model Using Deep Metric Learning Considering Occlusion for Manual Assembly Work
por: Kitsukawa, Takumi, et al.
Publicado: (2025)
por: Kitsukawa, Takumi, et al.
Publicado: (2025)
UniSync: Towards Generalizable and High-Fidelity Lip Synchronization for Challenging Scenarios
por: Fan, Ruidi, et al.
Publicado: (2026)
por: Fan, Ruidi, et al.
Publicado: (2026)
Where, Not What: Compelling Video LLMs to Learn Geometric Causality for 3D-Grounding
por: Zhong, Yutong
Publicado: (2025)
por: Zhong, Yutong
Publicado: (2025)
Two-Stage Adaptive Network for Semi-Supervised Cross-Domain Crater Detection under Varying Scenario Distributions
por: Liu, Yifan, et al.
Publicado: (2023)
por: Liu, Yifan, et al.
Publicado: (2023)
Dataset Ownership Verification for Pre-trained Masked Models
por: Xie, Yuechen, et al.
Publicado: (2025)
por: Xie, Yuechen, et al.
Publicado: (2025)
Proc-GS: Procedural Building Generation for City Assembly with 3D Gaussians
por: Li, Yixuan, et al.
Publicado: (2024)
por: Li, Yixuan, et al.
Publicado: (2024)
SURDS: Benchmarking Spatial Understanding and Reasoning in Driving Scenarios with Vision Language Models
por: Guo, Xianda, et al.
Publicado: (2024)
por: Guo, Xianda, et al.
Publicado: (2024)
Pair2Scene: Learning Local Object Relations for Procedural Scene Generation
por: Ran, Xingjian, et al.
Publicado: (2026)
por: Ran, Xingjian, et al.
Publicado: (2026)
CheckManual: A New Challenge and Benchmark for Manual-based Appliance Manipulation
por: Long, Yuxing, et al.
Publicado: (2025)
por: Long, Yuxing, et al.
Publicado: (2025)
CityLLaVA: Efficient Fine-Tuning for VLMs in City Scenario
por: Duan, Zhizhao, et al.
Publicado: (2024)
por: Duan, Zhizhao, et al.
Publicado: (2024)
Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning
por: Zhong, Hanwen, et al.
Publicado: (2025)
por: Zhong, Hanwen, et al.
Publicado: (2025)
A Siamese-based Verification System for Open-set Architecture Attribution of Synthetic Images
por: Abady, Lydia, et al.
Publicado: (2023)
por: Abady, Lydia, et al.
Publicado: (2023)
Two-Stage Human Verification using HandCAPTCHA and Anti-Spoofed Finger Biometrics with Feature Selection
por: Bera, Asish, et al.
Publicado: (2024)
por: Bera, Asish, et al.
Publicado: (2024)
GOReloc: Graph-based Object-Level Relocalization for Visual SLAM
por: Wang, Yutong, et al.
Publicado: (2024)
por: Wang, Yutong, et al.
Publicado: (2024)
Towards Accurate One-Stage Object Detection with AP-Loss
por: Chen, Kean, et al.
Publicado: (2019)
por: Chen, Kean, et al.
Publicado: (2019)
Vision-based Vehicle Re-identification in Bridge Scenario using Flock Similarity
por: Zhang, Chunfeng, et al.
Publicado: (2024)
por: Zhang, Chunfeng, et al.
Publicado: (2024)
Deterministic World Models for Verification of Closed-loop Vision-based Systems
por: Geng, Yuang, et al.
Publicado: (2025)
por: Geng, Yuang, et al.
Publicado: (2025)
WCCNet: Wavelet-context Cooperative Network for Efficient Multispectral Pedestrian Detection
por: Wang, Xingjian, et al.
Publicado: (2023)
por: Wang, Xingjian, et al.
Publicado: (2023)
Expressive Speech-driven Facial Animation with controllable emotions
por: Chen, Yutong, et al.
Publicado: (2023)
por: Chen, Yutong, et al.
Publicado: (2023)
TinyLLaVA-Video-R1: Towards Smaller LMMs for Video Reasoning
por: Zhang, Xingjian, et al.
Publicado: (2025)
por: Zhang, Xingjian, et al.
Publicado: (2025)
TemPose-TF-ASF: Two-Stage Bidirectional Stroke Context Fusion for Badminton Stroke Classification
por: Liu, Tzu-Yu, et al.
Publicado: (2026)
por: Liu, Tzu-Yu, et al.
Publicado: (2026)
Causality-based Transfer of Driving Scenarios to Unseen Intersections
por: Glasmacher, Christoph, et al.
Publicado: (2024)
por: Glasmacher, Christoph, et al.
Publicado: (2024)
Learning Spatial-Preserving Hierarchical Representations for Digital Pathology
por: Wu, Weiyi, et al.
Publicado: (2024)
por: Wu, Weiyi, et al.
Publicado: (2024)
Verification Mirage: Mapping the Reliability Boundary of Self-Verification in Medical VQA
por: Jin, Ruinan, et al.
Publicado: (2026)
por: Jin, Ruinan, et al.
Publicado: (2026)
SegHist: A General Segmentation-based Framework for Chinese Historical Document Text Line Detection
por: Hu, Xingjian, et al.
Publicado: (2024)
por: Hu, Xingjian, et al.
Publicado: (2024)
Self-supervised One-Stage Learning for RF-based Multi-Person Pose Estimation
por: Shin, Seunghwan, et al.
Publicado: (2025)
por: Shin, Seunghwan, et al.
Publicado: (2025)
A Multi-Stage Optimization Framework for Deploying Learned Image Compression on FPGAs
por: Fang, Jiaxun, et al.
Publicado: (2025)
por: Fang, Jiaxun, et al.
Publicado: (2025)
Diffusion-based Light Field Synthesis
por: Gao, Ruisheng, et al.
Publicado: (2024)
por: Gao, Ruisheng, et al.
Publicado: (2024)
InstanceAssemble: Layout-Aware Image Generation via Instance Assembling Attention
por: Xiang, Qiang, et al.
Publicado: (2025)
por: Xiang, Qiang, et al.
Publicado: (2025)
CoReVLA: A Dual-Stage End-to-End Autonomous Driving Framework for Long-Tail Scenarios via Collect-and-Refine
por: Fang, Shiyu, et al.
Publicado: (2025)
por: Fang, Shiyu, et al.
Publicado: (2025)
PanAdapter: Two-Stage Fine-Tuning with Spatial-Spectral Priors Injecting for Pansharpening
por: Wu, RuoCheng, et al.
Publicado: (2024)
por: Wu, RuoCheng, et al.
Publicado: (2024)
Boosting Segment Anything Model to Generalize Visually Non-Salient Scenarios
por: Guo, Guangqian, et al.
Publicado: (2026)
por: Guo, Guangqian, et al.
Publicado: (2026)
Metadata-Driven Federated Learning of Connectional Brain Templates in Non-IID Multi-Domain Scenarios
por: Chen, Geng, et al.
Publicado: (2024)
por: Chen, Geng, et al.
Publicado: (2024)
Traffic-MLLM: Curiosity-Regularized Supervised Learning for Traffic Scenario Case-Based Reasoning
por: Xiu, Waikit, et al.
Publicado: (2025)
por: Xiu, Waikit, et al.
Publicado: (2025)
Vision-based Perception for Autonomous Vehicles in Obstacle Avoidance Scenarios
por: Phan, Van-Hoang-Anh, et al.
Publicado: (2025)
por: Phan, Van-Hoang-Anh, et al.
Publicado: (2025)
LenslessFace: An End-to-End Optimized Lensless System for Privacy-Preserving Face Verification
por: Cai, Xin, et al.
Publicado: (2024)
por: Cai, Xin, et al.
Publicado: (2024)
Add-SD: Rational Generation without Manual Reference
por: Yang, Lingfeng, et al.
Publicado: (2024)
por: Yang, Lingfeng, et al.
Publicado: (2024)
Dynamic Risk Assessment Methodology with an LDM-based System for Parking Scenarios
por: Cañas, Paola Natalia, et al.
Publicado: (2024)
por: Cañas, Paola Natalia, et al.
Publicado: (2024)
Ejemplares similares
-
Manual-PA: Learning 3D Part Assembly from Instruction Diagrams
por: Zhang, Jiahao, et al.
Publicado: (2024) -
PostureObjectstitch: Anomaly Image Generation Considering Assembly Relationships in Industrial Scenarios
por: Tong, Zebei, et al.
Publicado: (2026) -
Anomaly Triplet-Net: Progress Recognition Model Using Deep Metric Learning Considering Occlusion for Manual Assembly Work
por: Kitsukawa, Takumi, et al.
Publicado: (2025) -
UniSync: Towards Generalizable and High-Fidelity Lip Synchronization for Challenging Scenarios
por: Fan, Ruidi, et al.
Publicado: (2026) -
Where, Not What: Compelling Video LLMs to Learn Geometric Causality for 3D-Grounding
por: Zhong, Yutong
Publicado: (2025)