MITS: A Large-Scale Multimodal Benchmark Dataset for Intelligent Traffic Surveillance
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhao, Kaikai, Liu, Zhaoxiang, Wang, Peng, Wang, Xin, Ma, Zhicheng, Xu, Yajun, Zhang, Wenjing, Nan, Yibing, Wang, Kai, Lian, Shiguo |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
KAConvNet: Kolmogorov-Arnold Convolutional Networks for Vision Recognition
di: Liu, Zhaoxiang, et al.
Pubblicazione: (2026)
di: Liu, Zhaoxiang, et al.
Pubblicazione: (2026)
A Multimodal Benchmark Dataset and Model for Crop Disease Diagnosis
di: Liu, Xiang, et al.
Pubblicazione: (2025)
di: Liu, Xiang, et al.
Pubblicazione: (2025)
What is the best model? Application-driven Evaluation for Large Language Models
di: Lian, Shiguo, et al.
Pubblicazione: (2024)
di: Lian, Shiguo, et al.
Pubblicazione: (2024)
CHiSafetyBench: A Chinese Hierarchical Safety Benchmark for Large Language Models
di: Zhang, Wenjing, et al.
Pubblicazione: (2024)
di: Zhang, Wenjing, et al.
Pubblicazione: (2024)
Data-Driven Deepfake Image Detection Method -- The 2024 Global Deepfake Image Detection Challenge
di: Zhu, Xiaoya, et al.
Pubblicazione: (2025)
di: Zhu, Xiaoya, et al.
Pubblicazione: (2025)
Piculet: Specialized Models-Guided Hallucination Decrease for MultiModal Large Language Models
di: Wang, Kohou, et al.
Pubblicazione: (2024)
di: Wang, Kohou, et al.
Pubblicazione: (2024)
A Large Vision-Language Model based Environment Perception System for Visually Impaired People
di: Chen, Zezhou, et al.
Pubblicazione: (2025)
di: Chen, Zezhou, et al.
Pubblicazione: (2025)
SLearnLLM: A Self-Learning Framework for Efficient Domain-Specific Adaptation of Large Language Models
di: Liu, Xiang, et al.
Pubblicazione: (2025)
di: Liu, Xiang, et al.
Pubblicazione: (2025)
Mixture of Heterogeneous Grouped Experts for Language Modeling
di: Ma, Zhicheng, et al.
Pubblicazione: (2026)
di: Ma, Zhicheng, et al.
Pubblicazione: (2026)
Methodology of Adapting Large English Language Models for Specific Cultural Contexts
di: Zhang, Wenjing, et al.
Pubblicazione: (2024)
di: Zhang, Wenjing, et al.
Pubblicazione: (2024)
Patch-wise Auto-Encoder for Visual Anomaly Detection
di: Cui, Yajie, et al.
Pubblicazione: (2023)
di: Cui, Yajie, et al.
Pubblicazione: (2023)
TP3M: Transformer-based Pseudo 3D Image Matching with Reference Image
di: Han, Liming, et al.
Pubblicazione: (2024)
di: Han, Liming, et al.
Pubblicazione: (2024)
A Systematic Security Evaluation of OpenClaw and Its Variants
di: Wang, Yuhang, et al.
Pubblicazione: (2026)
di: Wang, Yuhang, et al.
Pubblicazione: (2026)
DAST: Difficulty-Adaptive Slow-Thinking for Large Reasoning Models
di: Shen, Yi, et al.
Pubblicazione: (2025)
di: Shen, Yi, et al.
Pubblicazione: (2025)
GlitchMiner: Mining Glitch Tokens in Large Language Models via Gradient-based Discrete Optimization
di: Wu, Zihui, et al.
Pubblicazione: (2024)
di: Wu, Zihui, et al.
Pubblicazione: (2024)
Safety Evaluation of DeepSeek Models in Chinese Contexts
di: Zhang, Wenjing, et al.
Pubblicazione: (2025)
di: Zhang, Wenjing, et al.
Pubblicazione: (2025)
HEAL: Hindsight Entropy-Assisted Learning for Reasoning Distillation
di: Zhang, Wenjing, et al.
Pubblicazione: (2026)
di: Zhang, Wenjing, et al.
Pubblicazione: (2026)
Quantifying the Capability Boundary of DeepSeek Models: An Application-Driven Performance Analysis
di: Zhao, Kaikai, et al.
Pubblicazione: (2025)
di: Zhao, Kaikai, et al.
Pubblicazione: (2025)
LeMiCa: Lexicographic Minimax Path Caching for Efficient Diffusion-Based Video Generation
di: Gao, Huanlin, et al.
Pubblicazione: (2025)
di: Gao, Huanlin, et al.
Pubblicazione: (2025)
PSTF-AttControl: Per-Subject-Tuning-Free Personalized Image Generation with Controllable Face Attributes
di: liu, Xiang, et al.
Pubblicazione: (2025)
di: liu, Xiang, et al.
Pubblicazione: (2025)
From Assistant to Double Agent: Formalizing and Benchmarking Attacks on OpenClaw for Personalized Local AI Agent
di: Wang, Yuhang, et al.
Pubblicazione: (2026)
di: Wang, Yuhang, et al.
Pubblicazione: (2026)
MediaClaw: Multimodal Intelligent-Agent Platform Technical Report
di: Zhao, Shaoan, et al.
Pubblicazione: (2026)
di: Zhao, Shaoan, et al.
Pubblicazione: (2026)
Nurse Alarm Management in the ICU : Insights and Future Directions From an Observational Study
di: Xin Wang, et al.
Pubblicazione: (2025)
di: Xin Wang, et al.
Pubblicazione: (2025)
EmoBench-M: Benchmarking Emotional Intelligence for Multimodal Large Language Models
di: Hu, He, et al.
Pubblicazione: (2025)
di: Hu, He, et al.
Pubblicazione: (2025)
PEBench: A Fictitious Dataset to Benchmark Machine Unlearning for Multimodal Large Language Models
di: Xu, Zhaopan, et al.
Pubblicazione: (2025)
di: Xu, Zhaopan, et al.
Pubblicazione: (2025)
TIR-Agent: Training an Explorative and Efficient Agent for Image Restoration
di: Zhang, Yisheng, et al.
Pubblicazione: (2026)
di: Zhang, Yisheng, et al.
Pubblicazione: (2026)
NetBench: A Large-Scale and Comprehensive Network Traffic Benchmark Dataset for Foundation Models
di: Qian, Chen, et al.
Pubblicazione: (2024)
di: Qian, Chen, et al.
Pubblicazione: (2024)
Strength Analysis of Carbon Fiber Composite Flywheel Energy Storage Rotor Based on Progressive Damage Failure
di: Yajun Wang, et al.
Pubblicazione: (2024)
di: Yajun Wang, et al.
Pubblicazione: (2024)
Optimizing for the Shortest Path in Denoising Diffusion Model
di: Chen, Ping, et al.
Pubblicazione: (2025)
di: Chen, Ping, et al.
Pubblicazione: (2025)
HouseTS: A Large-Scale, Multimodal Spatiotemporal U.S. Housing Dataset and Benchmark
di: Wang, Shengkun, et al.
Pubblicazione: (2025)
di: Wang, Shengkun, et al.
Pubblicazione: (2025)
Cooperative Path Planning for Persistent Surveillance in Large‐Scale Environment with UAV‐UGV System
di: Jiahui Wang, et al.
Pubblicazione: (2024)
di: Jiahui Wang, et al.
Pubblicazione: (2024)
Beyond Geometry: Artistic Disparity Synthesis for Immersive 2D-to-3D
di: Chen, Ping, et al.
Pubblicazione: (2026)
di: Chen, Ping, et al.
Pubblicazione: (2026)
Traffic Sign Recognition in Autonomous Driving: Dataset, Benchmark, and Field Experiment
di: Zhao, Guoyang, et al.
Pubblicazione: (2026)
di: Zhao, Guoyang, et al.
Pubblicazione: (2026)
Hierarchical Deep Fusion Framework for Multi-dimensional Facial Forgery Detection -- The 2024 Global Deepfake Image Detection Challenge
di: Wang, Kohou, et al.
Pubblicazione: (2025)
di: Wang, Kohou, et al.
Pubblicazione: (2025)
ACCIDENT: A Benchmark Dataset for Vehicle Accident Detection from Traffic Surveillance Videos
di: Picek, Lukas, et al.
Pubblicazione: (2026)
di: Picek, Lukas, et al.
Pubblicazione: (2026)
MIntRec2.0: A Large-scale Benchmark Dataset for Multimodal Intent Recognition and Out-of-scope Detection in Conversations
di: Zhang, Hanlei, et al.
Pubblicazione: (2024)
di: Zhang, Hanlei, et al.
Pubblicazione: (2024)
Safety Evaluation and Enhancement of DeepSeek Models in Chinese Contexts
di: Zhang, Wenjing, et al.
Pubblicazione: (2025)
di: Zhang, Wenjing, et al.
Pubblicazione: (2025)
MITS: A Quantum Sorcerer Stone For Designing Surface Codes
di: Chatterjee, Avimita, et al.
Pubblicazione: (2024)
di: Chatterjee, Avimita, et al.
Pubblicazione: (2024)
Learning Traffic Crashes as Language: Datasets, Benchmarks, and What-if Causal Analyses
di: Fan, Zhiwen, et al.
Pubblicazione: (2024)
di: Fan, Zhiwen, et al.
Pubblicazione: (2024)
SurveillanceVQA-589K: A Benchmark for Comprehensive Surveillance Video-Language Understanding with Large Models
di: Liu, Bo, et al.
Pubblicazione: (2025)
di: Liu, Bo, et al.
Pubblicazione: (2025)
Documenti analoghi
-
KAConvNet: Kolmogorov-Arnold Convolutional Networks for Vision Recognition
di: Liu, Zhaoxiang, et al.
Pubblicazione: (2026) -
A Multimodal Benchmark Dataset and Model for Crop Disease Diagnosis
di: Liu, Xiang, et al.
Pubblicazione: (2025) -
What is the best model? Application-driven Evaluation for Large Language Models
di: Lian, Shiguo, et al.
Pubblicazione: (2024) -
CHiSafetyBench: A Chinese Hierarchical Safety Benchmark for Large Language Models
di: Zhang, Wenjing, et al.
Pubblicazione: (2024) -
Data-Driven Deepfake Image Detection Method -- The 2024 Global Deepfake Image Detection Challenge
di: Zhu, Xiaoya, et al.
Pubblicazione: (2025)