AllTheDocks road safety dataset: A cyclist's perspective and experience
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Chiang, Chia-Yen, Zhong, Ruikang, Ding, Jennifer, Wood, Joseph, Bee, Stephen, Jaber, Mona |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Intelligent Travel Activity Monitoring: Generalized Distributed Acoustic Sensing Approaches
par: Zhong, Ruikang, et autres
Publié: (2025)
par: Zhong, Ruikang, et autres
Publié: (2025)
RoboTron-Mani: All-in-One Multimodal Large Model for Robotic Manipulation
par: Yan, Feng, et autres
Publié: (2024)
par: Yan, Feng, et autres
Publié: (2024)
One Framework to Rule Them All: Unifying Multimodal Tasks with LLM Neural-Tuning
par: Sun, Hao, et autres
Publié: (2024)
par: Sun, Hao, et autres
Publié: (2024)
Recognizing Everything from All Modalities at Once: Grounded Multimodal Universal Information Extraction
par: Zhang, Meishan, et autres
Publié: (2024)
par: Zhang, Meishan, et autres
Publié: (2024)
RoSMM: A Robust and Secure Multi-Modal Watermarking Framework for Diffusion Models
par: Fang, ZhongLi, et autres
Publié: (2025)
par: Fang, ZhongLi, et autres
Publié: (2025)
A multimodal stress detection dataset with facial expressions and physiological signals
par: Hosseini, Majid, et autres
Publié: (2022)
par: Hosseini, Majid, et autres
Publié: (2022)
Short-Form Video Viewing Behavior Analysis and Multi-Step Viewing Time Prediction
par: Yen, Vu Thi Hai, et autres
Publié: (2026)
par: Yen, Vu Thi Hai, et autres
Publié: (2026)
ASAP: Advancing Semantic Alignment Promotes Multi-Modal Manipulation Detecting and Grounding
par: Zhang, Zhenxing, et autres
Publié: (2024)
par: Zhang, Zhenxing, et autres
Publié: (2024)
Revisiting Vision-Language Features Adaptation and Inconsistency for Social Media Popularity Prediction
par: Hsu, Chih-Chung, et autres
Publié: (2024)
par: Hsu, Chih-Chung, et autres
Publié: (2024)
PRISM: Exposing and Resolving Spurious Isolation in Federated Multimodal Continual Learning
par: Wu, Beining, et autres
Publié: (2026)
par: Wu, Beining, et autres
Publié: (2026)
Make Graph-based Referring Expression Comprehension Great Again through Expression-guided Dynamic Gating and Regression
par: Ke, Jingcheng, et autres
Publié: (2024)
par: Ke, Jingcheng, et autres
Publié: (2024)
FakeSV-VLM: Taming VLM for Detecting Fake Short-Video News via Progressive Mixture-Of-Experts Adapter
par: Wang, Junxi, et autres
Publié: (2025)
par: Wang, Junxi, et autres
Publié: (2025)
Chinese-LiPS: A Chinese audio-visual speech recognition dataset with Lip-reading and Presentation Slides
par: Zhao, Jinghua, et autres
Publié: (2025)
par: Zhao, Jinghua, et autres
Publié: (2025)
Anchoring Trends: Mitigating Social Media Popularity Prediction Drift via Feature Clustering and Expansion
par: Lee, Chia-Ming, et autres
Publié: (2025)
par: Lee, Chia-Ming, et autres
Publié: (2025)
Towards Alleviating Text-to-Image Retrieval Hallucination for CLIP in Zero-shot Learning
par: Wang, Hanyao, et autres
Publié: (2024)
par: Wang, Hanyao, et autres
Publié: (2024)
SCI-Reason: A Dataset with Chain-of-Thought Rationales for Complex Multimodal Reasoning in Academic Areas
par: Ma, Chenghao, et autres
Publié: (2025)
par: Ma, Chenghao, et autres
Publié: (2025)
Diffusion Model-Based Size Variable Virtual Try-On Technology and Evaluation Method
par: Zhang, Shufang, et autres
Publié: (2025)
par: Zhang, Shufang, et autres
Publié: (2025)
VARFVV: View-Adaptive Real-Time Interactive Free-View Video Streaming with Edge Computing
par: Hu, Qiang, et autres
Publié: (2025)
par: Hu, Qiang, et autres
Publié: (2025)
Multimodal LLM-based Query Paraphrasing for Video Search
par: Wu, Jiaxin, et autres
Publié: (2024)
par: Wu, Jiaxin, et autres
Publié: (2024)
Music4All A+A: A Multimodal Dataset for Music Information Retrieval Tasks
par: Geiger, Jonas, et autres
Publié: (2025)
par: Geiger, Jonas, et autres
Publié: (2025)
RoboTron-Drive: All-in-One Large Multimodal Model for Autonomous Driving
par: Huang, Zhijian, et autres
Publié: (2024)
par: Huang, Zhijian, et autres
Publié: (2024)
Not All Attention is Needed: Parameter and Computation Efficient Transfer Learning for Multi-modal Large Language Models
par: Wu, Qiong, et autres
Publié: (2024)
par: Wu, Qiong, et autres
Publié: (2024)
MISS: Memory-efficient Instance Segmentation Framework By Visual Inductive Priors Flow Propagation
par: Hsu, Chih-Chung, et autres
Publié: (2024)
par: Hsu, Chih-Chung, et autres
Publié: (2024)
Stemphonic: All-at-once Flexible Multi-stem Music Generation
par: Wu, Shih-Lun, et autres
Publié: (2026)
par: Wu, Shih-Lun, et autres
Publié: (2026)
A low complexity contextual stacked ensemble-learning approach for pedestrian intent prediction
par: Chiang, Chia-Yen, et autres
Publié: (2024)
par: Chiang, Chia-Yen, et autres
Publié: (2024)
DeepTextMark: A Deep Learning-Driven Text Watermarking Approach for Identifying Large Language Model Generated Text
par: Munyer, Travis, et autres
Publié: (2023)
par: Munyer, Travis, et autres
Publié: (2023)
Dynamic Interaction-Aware and Causality-Disentangled Framework for Multimodal Sentiment Analysis
par: Dong, Guangyuan, et autres
Publié: (2026)
par: Dong, Guangyuan, et autres
Publié: (2026)
Enabling immersive experiences in challenging network conditions
par: Aggarwal, Pooja, et autres
Publié: (2023)
par: Aggarwal, Pooja, et autres
Publié: (2023)
Interoperable Provenance Authentication of Broadcast Media using Open Standards-based Metadata, Watermarking and Cryptography
par: Simmons, John C., et autres
Publié: (2024)
par: Simmons, John C., et autres
Publié: (2024)
ChartAdapter: Large Vision-Language Model for Chart Summarization
par: Xu, Peixin, et autres
Publié: (2024)
par: Xu, Peixin, et autres
Publié: (2024)
One Size Doesn't Fit All: Age-Aware Gamification Mechanics for Multimedia Learning Environments
par: Kaißer, Sarah, et autres
Publié: (2025)
par: Kaißer, Sarah, et autres
Publié: (2025)
GustosonicSense: Towards understanding the design of playful gustosonic eating experiences
par: Wang, Yan, et autres
Publié: (2024)
par: Wang, Yan, et autres
Publié: (2024)
Differential Multimodal Transformers
par: Li, Jerry, et autres
Publié: (2025)
par: Li, Jerry, et autres
Publié: (2025)
Augment Before Copy-Paste: Data and Memory Efficiency-Oriented Instance Segmentation Framework for Sport-scenes
par: Hsu, Chih-Chung, et autres
Publié: (2024)
par: Hsu, Chih-Chung, et autres
Publié: (2024)
Multimodal Infusion Tuning for Large Models
par: Sun, Hao, et autres
Publié: (2024)
par: Sun, Hao, et autres
Publié: (2024)
A Single Atlas is All You Need: Decoder-Side Gaussian Splatting for Immersive Video
par: Mieloch, Dawid, et autres
Publié: (2026)
par: Mieloch, Dawid, et autres
Publié: (2026)
PiGW: A Plug-in Generative Watermarking Framework
par: Ma, Rui, et autres
Publié: (2024)
par: Ma, Rui, et autres
Publié: (2024)
A CLIP-based siamese approach for meme classification
par: Huertas-Tato, Javier, et autres
Publié: (2024)
par: Huertas-Tato, Javier, et autres
Publié: (2024)
Music Arena: Live Evaluation for Text-to-Music
par: Kim, Yonghyun, et autres
Publié: (2025)
par: Kim, Yonghyun, et autres
Publié: (2025)
A Survey on Energy Consumption and Environmental Impact of Video Streaming
par: Afzal, Samira, et autres
Publié: (2024)
par: Afzal, Samira, et autres
Publié: (2024)
Documents similaires
-
Intelligent Travel Activity Monitoring: Generalized Distributed Acoustic Sensing Approaches
par: Zhong, Ruikang, et autres
Publié: (2025) -
RoboTron-Mani: All-in-One Multimodal Large Model for Robotic Manipulation
par: Yan, Feng, et autres
Publié: (2024) -
One Framework to Rule Them All: Unifying Multimodal Tasks with LLM Neural-Tuning
par: Sun, Hao, et autres
Publié: (2024) -
Recognizing Everything from All Modalities at Once: Grounded Multimodal Universal Information Extraction
par: Zhang, Meishan, et autres
Publié: (2024) -
RoSMM: A Robust and Secure Multi-Modal Watermarking Framework for Diffusion Models
par: Fang, ZhongLi, et autres
Publié: (2025)