Traffic Scene Parsing through the TSP6K Dataset
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Jiang, Peng-Tao, Yang, Yuqi, Cao, Yang, Hou, Qibin, Cheng, Ming-Ming, Shen, Chunhua |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Multi-Task Dense Prediction via Mixture of Low-Rank Experts
par: Yang, Yuqi, et autres
Publié: (2024)
par: Yang, Yuqi, et autres
Publié: (2024)
DFormerv2: Geometry Self-Attention for RGBD Semantic Segmentation
par: Yin, Bo-Wen, et autres
Publié: (2025)
par: Yin, Bo-Wen, et autres
Publié: (2025)
ControlSR: Taming Diffusion Models for Consistent Real-World Image Super Resolution
par: Wan, Yuhao, et autres
Publié: (2024)
par: Wan, Yuhao, et autres
Publié: (2024)
A Comprehensive Survey on Video Scene Parsing:Advances, Challenges, and Prospects
par: Xie, Guohuan, et autres
Publié: (2025)
par: Xie, Guohuan, et autres
Publié: (2025)
Salient Object Detection in Traffic Scene through the TSOD10K Dataset
par: Qiu, Yu, et autres
Publié: (2025)
par: Qiu, Yu, et autres
Publié: (2025)
A Glimpse to Compress: Dynamic Visual Token Pruning for Large Vision-Language Models
par: Zeng, Quan-Sheng, et autres
Publié: (2025)
par: Zeng, Quan-Sheng, et autres
Publié: (2025)
StoryDiffusion: Consistent Self-Attention for Long-Range Image and Video Generation
par: Zhou, Yupeng, et autres
Publié: (2024)
par: Zhou, Yupeng, et autres
Publié: (2024)
GeoWorld: Unlocking the Potential of Geometry Models to Facilitate High-Fidelity 3D Scene Generation
par: Wan, Yuhao, et autres
Publié: (2025)
par: Wan, Yuhao, et autres
Publié: (2025)
Rethinking Token-Level Policy Optimization for Multimodal Chain-of-Thought
par: Li, Yunheng, et autres
Publié: (2026)
par: Li, Yunheng, et autres
Publié: (2026)
OmniSegmentor: A Flexible Multi-Modal Learning Framework for Semantic Segmentation
par: Yin, Bo-Wen, et autres
Publié: (2025)
par: Yin, Bo-Wen, et autres
Publié: (2025)
Cascade-CLIP: Cascaded Vision-Language Embeddings Alignment for Zero-Shot Semantic Segmentation
par: Li, Yunheng, et autres
Publié: (2024)
par: Li, Yunheng, et autres
Publié: (2024)
KAC: Kolmogorov-Arnold Classifier for Continual Learning
par: Hu, Yusong, et autres
Publié: (2025)
par: Hu, Yusong, et autres
Publié: (2025)
DFormer: Rethinking RGBD Representation Learning for Semantic Segmentation
par: Yin, Bowen, et autres
Publié: (2023)
par: Yin, Bowen, et autres
Publié: (2023)
Zone Evaluation: Revealing Spatial Bias in Object Detection
par: Zheng, Zhaohui, et autres
Publié: (2023)
par: Zheng, Zhaohui, et autres
Publié: (2023)
CrossKD: Cross-Head Knowledge Distillation for Object Detection
par: Wang, Jiabao, et autres
Publié: (2023)
par: Wang, Jiabao, et autres
Publié: (2023)
Unbiased Region-Language Alignment for Open-Vocabulary Dense Prediction
par: Li, Yunheng, et autres
Publié: (2024)
par: Li, Yunheng, et autres
Publié: (2024)
Revisiting Efficient Semantic Segmentation: Learning Offsets for Better Spatial and Class Feature Alignment
par: Zhang, Shi-Chen, et autres
Publié: (2025)
par: Zhang, Shi-Chen, et autres
Publié: (2025)
Sora Generates Videos with Stunning Geometrical Consistency
par: Li, Xuanyi, et autres
Publié: (2024)
par: Li, Xuanyi, et autres
Publié: (2024)
PLoc: A New Evaluation Criterion Based on Physical Location for Autonomous Driving Datasets
par: Yang, Ruining, et autres
Publié: (2024)
par: Yang, Ruining, et autres
Publié: (2024)
TempSamp-R1: Effective Temporal Sampling with Reinforcement Fine-Tuning for Video LLMs
par: Li, Yunheng, et autres
Publié: (2025)
par: Li, Yunheng, et autres
Publié: (2025)
RAD: A Comprehensive Dataset for Benchmarking the Robustness of Image Anomaly Detection
par: Cheng, Yuqi, et autres
Publié: (2024)
par: Cheng, Yuqi, et autres
Publié: (2024)
Contrastive Masked Autoencoders are Stronger Vision Learners
par: Huang, Zhicheng, et autres
Publié: (2022)
par: Huang, Zhicheng, et autres
Publié: (2022)
SRFormerV2: Taking a Closer Look at Permuted Self-Attention for Image Super-Resolution
par: Zhou, Yupeng, et autres
Publié: (2023)
par: Zhou, Yupeng, et autres
Publié: (2023)
Referring Camouflaged Object Detection
par: Zhang, Xuying, et autres
Publié: (2023)
par: Zhang, Xuying, et autres
Publié: (2023)
High-Quality Mask Tuning Matters for Open-Vocabulary Segmentation
par: Zeng, Quan-Sheng, et autres
Publié: (2024)
par: Zeng, Quan-Sheng, et autres
Publié: (2024)
AgeBooth: Controllable Facial Aging and Rejuvenation via Diffusion Models
par: Zhu, Shihao, et autres
Publié: (2025)
par: Zhu, Shihao, et autres
Publié: (2025)
SceneParser: Hierarchical Scene Parsing for Visual Semantics Understanding
par: Xu, Pengxin, et autres
Publié: (2026)
par: Xu, Pengxin, et autres
Publié: (2026)
YOLO-MS: Rethinking Multi-Scale Representation Learning for Real-time Object Detection
par: Chen, Yuming, et autres
Publié: (2023)
par: Chen, Yuming, et autres
Publié: (2023)
Towards Stable 3D Object Detection
par: Wang, Jiabao, et autres
Publié: (2024)
par: Wang, Jiabao, et autres
Publié: (2024)
Advances in Deep Concealed Scene Understanding
par: Fan, Deng-Ping, et autres
Publié: (2023)
par: Fan, Deng-Ping, et autres
Publié: (2023)
SARDet-100K: Towards Open-Source Benchmark and ToolKit for Large-Scale SAR Object Detection
par: Li, Yuxuan, et autres
Publié: (2024)
par: Li, Yuxuan, et autres
Publié: (2024)
SM3Det: A Unified Model for Multi-Modal Remote Sensing Object Detection
par: Li, Yuxuan, et autres
Publié: (2024)
par: Li, Yuxuan, et autres
Publié: (2024)
OPUS: Occupancy Prediction Using a Sparse Set
par: Wang, Jiabao, et autres
Publié: (2024)
par: Wang, Jiabao, et autres
Publié: (2024)
K-LoRA: Unlocking Training-Free Fusion of Any Subject and Style LoRAs
par: Ouyang, Ziheng, et autres
Publié: (2025)
par: Ouyang, Ziheng, et autres
Publié: (2025)
The Consistency Critic: Correcting Inconsistencies in Generated Images via Reference-Guided Attentive Alignment
par: Ouyang, Ziheng, et autres
Publié: (2025)
par: Ouyang, Ziheng, et autres
Publié: (2025)
StyleDiffusion: Prompt-Embedding Inversion for Text-Based Editing
par: Li, Senmao, et autres
Publié: (2023)
par: Li, Senmao, et autres
Publié: (2023)
SAM Struggles in Concealed Scenes -- Empirical Study on Segment Anything
par: Ji, Ge-Peng, et autres
Publié: (2023)
par: Ji, Ge-Peng, et autres
Publié: (2023)
A Pedestrian-Vehicle Interaction Benchmark and Annotation Framework for Unstructured Scenes via Uncalibrated Cameras
par: Peng, Haoyang, et autres
Publié: (2026)
par: Peng, Haoyang, et autres
Publié: (2026)
Zippo: Zipping Color and Transparency Distributions into a Single Diffusion Model
par: Xie, Kangyang, et autres
Publié: (2024)
par: Xie, Kangyang, et autres
Publié: (2024)
Strip R-CNN: Large Strip Convolution for Remote Sensing Object Detection
par: Yuan, Xinbin, et autres
Publié: (2025)
par: Yuan, Xinbin, et autres
Publié: (2025)
Documents similaires
-
Multi-Task Dense Prediction via Mixture of Low-Rank Experts
par: Yang, Yuqi, et autres
Publié: (2024) -
DFormerv2: Geometry Self-Attention for RGBD Semantic Segmentation
par: Yin, Bo-Wen, et autres
Publié: (2025) -
ControlSR: Taming Diffusion Models for Consistent Real-World Image Super Resolution
par: Wan, Yuhao, et autres
Publié: (2024) -
A Comprehensive Survey on Video Scene Parsing:Advances, Challenges, and Prospects
par: Xie, Guohuan, et autres
Publié: (2025) -
Salient Object Detection in Traffic Scene through the TSOD10K Dataset
par: Qiu, Yu, et autres
Publié: (2025)