Fast Low-parameter Video Activity Localization in Collaborative Learning Environments
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Jatla, Venkatesh, Teeparthi, Sravani, Egala, Ugesh, Pattichis, Sylvia Celedon, Patticis, Marios S. |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Long-term Human Participation Assessment In Collaborative Learning Environments Using Dynamic Scene Analysis
par: Shi, Wenjing, et autres
Publié: (2024)
par: Shi, Wenjing, et autres
Publié: (2024)
LINEA: Fast and Accurate Line Detection Using Scalable Transformers
par: Janampa, Sebastian, et autres
Publié: (2025)
par: Janampa, Sebastian, et autres
Publié: (2025)
Understanding Neural Network Systems for Image Analysis using Vector Spaces and Inverse Maps
par: Pattichis, Rebecca, et autres
Publié: (2024)
par: Pattichis, Rebecca, et autres
Publié: (2024)
Inverting Neural Networks: New Methods to Generate Neural Network Inputs from Prescribed Outputs
par: Pattichis, Rebecca, et autres
Publié: (2026)
par: Pattichis, Rebecca, et autres
Publié: (2026)
DT-LSD: Deformable Transformer-based Line Segment Detection
par: Janampa, Sebastian, et autres
Publié: (2024)
par: Janampa, Sebastian, et autres
Publié: (2024)
SOFI: Multi-Scale Deformable Transformer for Camera Calibration with Enhanced Line Queries
par: Janampa, Sebastian, et autres
Publié: (2024)
par: Janampa, Sebastian, et autres
Publié: (2024)
DETRPose: Real-time end-to-end transformer model for multi-person pose estimation
par: Janampa, Sebastian, et autres
Publié: (2025)
par: Janampa, Sebastian, et autres
Publié: (2025)
Modality-Collaborative Low-Rank Decomposers for Few-Shot Video Domain Adaptation
par: Wanyan, Yuyang, et autres
Publié: (2025)
par: Wanyan, Yuyang, et autres
Publié: (2025)
DraftAttention: Fast Video Diffusion via Low-Resolution Attention Guidance
par: Shen, Xuan, et autres
Publié: (2025)
par: Shen, Xuan, et autres
Publié: (2025)
Personalized Image Editing in Text-to-Image Diffusion Models via Collaborative Direct Preference Optimization
par: Dunlop, Connor, et autres
Publié: (2025)
par: Dunlop, Connor, et autres
Publié: (2025)
Seeing Fast and Slow: Learning the Flow of Time in Videos
par: Wu, Yen-Siang, et autres
Publié: (2026)
par: Wu, Yen-Siang, et autres
Publié: (2026)
Accurate and Fast Compressed Video Captioning
par: Shen, Yaojie, et autres
Publié: (2023)
par: Shen, Yaojie, et autres
Publié: (2023)
FastInit: Fast Noise Initialization for Temporally Consistent Video Generation
par: Bai, Chengyu, et autres
Publié: (2025)
par: Bai, Chengyu, et autres
Publié: (2025)
Collaborative Few-Step Distillation and Low-Bit Quantization for Wan2.2 Dual-Expert Video Diffusion Models
par: Du, Jinyang, et autres
Publié: (2026)
par: Du, Jinyang, et autres
Publié: (2026)
Learning Local and Global Temporal Contexts for Video Semantic Segmentation
par: Sun, Guolei, et autres
Publié: (2022)
par: Sun, Guolei, et autres
Publié: (2022)
Fast Autoregressive Video Generation with Diagonal Decoding
par: Ye, Yang, et autres
Publié: (2025)
par: Ye, Yang, et autres
Publié: (2025)
A Survey on Video Anomaly Detection via Deep Learning: Human, Vehicle, and Environment
par: Noghre, Ghazal Alinezhad, et autres
Publié: (2025)
par: Noghre, Ghazal Alinezhad, et autres
Publié: (2025)
FastCar: Cache Attentive Replay for Fast Auto-Regressive Video Generation on the Edge
par: Shen, Xuan, et autres
Publié: (2025)
par: Shen, Xuan, et autres
Publié: (2025)
Multi-Focused Video Group Activities Hashing
par: Qi, Zhongmiao, et autres
Publié: (2025)
par: Qi, Zhongmiao, et autres
Publié: (2025)
FastV-RAG: Towards Fast and Fine-Grained Video QA with Retrieval-Augmented Generation
par: Li, Gen, et autres
Publié: (2026)
par: Li, Gen, et autres
Publié: (2026)
Landmark-based Localization using Stereo Vision and Deep Learning in GPS-Denied Battlefield Environment
par: Sapkota, Ganesh, et autres
Publié: (2024)
par: Sapkota, Ganesh, et autres
Publié: (2024)
Perceiving Beyond Language Priors: Enhancing Visual Comprehension and Attention in Multimodal Models
par: Ghatkesar, Aarti, et autres
Publié: (2025)
par: Ghatkesar, Aarti, et autres
Publié: (2025)
3D Gaze Tracking for Studying Collaborative Interactions in Mixed-Reality Environments
par: Davalos, Eduardo, et autres
Publié: (2024)
par: Davalos, Eduardo, et autres
Publié: (2024)
Localizing Events in Videos with Multimodal Queries
par: Zhang, Gengyuan, et autres
Publié: (2024)
par: Zhang, Gengyuan, et autres
Publié: (2024)
Fast and Memory-Efficient Video Diffusion Using Streamlined Inference
par: Zhan, Zheng, et autres
Publié: (2024)
par: Zhan, Zheng, et autres
Publié: (2024)
V-Stylist: Video Stylization via Collaboration and Reflection of MLLM Agents
par: Yue, Zhengrong, et autres
Publié: (2025)
par: Yue, Zhengrong, et autres
Publié: (2025)
CoAgent: Collaborative Planning and Consistency Agent for Coherent Video Generation
par: Zeng, Qinglin, et autres
Publié: (2025)
par: Zeng, Qinglin, et autres
Publié: (2025)
Think-Clip-Sample: Slow-Fast Frame Selection for Video Understanding
par: Tan, Wenhui, et autres
Publié: (2026)
par: Tan, Wenhui, et autres
Publié: (2026)
SwiftTry: Fast and Consistent Video Virtual Try-On with Diffusion Models
par: Nguyen, Hung, et autres
Publié: (2024)
par: Nguyen, Hung, et autres
Publié: (2024)
On Equivariance and Fast Sampling in Video Diffusion Models Trained with Warped Noise
par: Liu, Chao, et autres
Publié: (2025)
par: Liu, Chao, et autres
Publié: (2025)
Collaborative Learning for 3D Hand-Object Reconstruction and Compositional Action Recognition from Egocentric RGB Videos Using Superquadrics
par: Tse, Tze Ho Elden, et autres
Publié: (2025)
par: Tse, Tze Ho Elden, et autres
Publié: (2025)
Video-Based Performance Evaluation for ECR Drills in Synthetic Training Environments
par: Rayala, Surya, et autres
Publié: (2025)
par: Rayala, Surya, et autres
Publié: (2025)
Video2Game: Real-time, Interactive, Realistic and Browser-Compatible Environment from a Single Video
par: Xia, Hongchi, et autres
Publié: (2024)
par: Xia, Hongchi, et autres
Publié: (2024)
DepthDark: Robust Monocular Depth Estimation for Low-Light Environments
par: Zeng, Longjian, et autres
Publié: (2025)
par: Zeng, Longjian, et autres
Publié: (2025)
Describe Anything: Detailed Localized Image and Video Captioning
par: Lian, Long, et autres
Publié: (2025)
par: Lian, Long, et autres
Publié: (2025)
Empowering Morphing Attack Detection using Interpretable Image-Text Foundation Model
par: Patwardhan, Sushrut, et autres
Publié: (2025)
par: Patwardhan, Sushrut, et autres
Publié: (2025)
SCRAMBLe : Enhancing Multimodal LLM Compositionality with Synthetic Preference Data
par: Mishra, Samarth, et autres
Publié: (2025)
par: Mishra, Samarth, et autres
Publié: (2025)
Top-down Activity Representation Learning for Video Question Answering
par: Wang, Yanan, et autres
Publié: (2024)
par: Wang, Yanan, et autres
Publié: (2024)
VideoMLA: Low-Rank Latent KV Cache for Minute-Scale Autoregressive Video Diffusion
par: Yesiltepe, Hidir, et autres
Publié: (2026)
par: Yesiltepe, Hidir, et autres
Publié: (2026)
Weakly-Supervised Image Forgery Localization via Vision-Language Collaborative Reasoning Framework
par: Sheng, Ziqi, et autres
Publié: (2025)
par: Sheng, Ziqi, et autres
Publié: (2025)
Documents similaires
-
Long-term Human Participation Assessment In Collaborative Learning Environments Using Dynamic Scene Analysis
par: Shi, Wenjing, et autres
Publié: (2024) -
LINEA: Fast and Accurate Line Detection Using Scalable Transformers
par: Janampa, Sebastian, et autres
Publié: (2025) -
Understanding Neural Network Systems for Image Analysis using Vector Spaces and Inverse Maps
par: Pattichis, Rebecca, et autres
Publié: (2024) -
Inverting Neural Networks: New Methods to Generate Neural Network Inputs from Prescribed Outputs
par: Pattichis, Rebecca, et autres
Publié: (2026) -
DT-LSD: Deformable Transformer-based Line Segment Detection
par: Janampa, Sebastian, et autres
Publié: (2024)