EDSNet: Efficient-DSNet for Video Summarization
Fuente:
arXiv
Salvato in:
| Autori principali: | Prasad, Ashish, Jeevan, Pranav, Sethi, Amit |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Which Backbone to Use: A Resource-efficient Domain Specific Comparison for Computer Vision
di: Jeevan, Pranav, et al.
Pubblicazione: (2024)
di: Jeevan, Pranav, et al.
Pubblicazione: (2024)
WaveMix: A Resource-efficient Neural Network for Image Analysis
di: Jeevan, Pranav, et al.
Pubblicazione: (2022)
di: Jeevan, Pranav, et al.
Pubblicazione: (2022)
WaveMixSR-V2: Enhancing Super-resolution with Higher Efficiency
di: Jeevan, Pranav, et al.
Pubblicazione: (2024)
di: Jeevan, Pranav, et al.
Pubblicazione: (2024)
Normalizing Flow-Based Metric for Image Generation
di: Jeevan, Pranav, et al.
Pubblicazione: (2024)
di: Jeevan, Pranav, et al.
Pubblicazione: (2024)
FLD+: Data-efficient Evaluation Metric for Generative Models
di: Jeevan, Pranav, et al.
Pubblicazione: (2024)
di: Jeevan, Pranav, et al.
Pubblicazione: (2024)
CCVA-FL: Cross-Client Variations Adaptive Federated Learning for Medical Imaging
di: Gupta, Sunny, et al.
Pubblicazione: (2024)
di: Gupta, Sunny, et al.
Pubblicazione: (2024)
Evaluation Metric for Quality Control and Generative Models in Histopathology Images
di: Jeevan, Pranav, et al.
Pubblicazione: (2024)
di: Jeevan, Pranav, et al.
Pubblicazione: (2024)
GeoPos: A Minimal Positional Encoding for Enhanced Fine-Grained Details in Image Synthesis Using Convolutional Neural Networks
di: Hosseini, Mehran, et al.
Pubblicazione: (2024)
di: Hosseini, Mehran, et al.
Pubblicazione: (2024)
Taming the Tail: Leveraging Asymmetric Loss and Pade Approximation to Overcome Medical Image Long-Tailed Class Imbalance
di: Kashyap, Pankhi, et al.
Pubblicazione: (2024)
di: Kashyap, Pankhi, et al.
Pubblicazione: (2024)
FEDTAIL: Federated Long-Tailed Domain Generalization with Sharpness-Guided Gradient Matching
di: Gupta, Sunny, et al.
Pubblicazione: (2025)
di: Gupta, Sunny, et al.
Pubblicazione: (2025)
ADAT: Time-Series-Aware Adaptive Transformer Architecture for Sign Language Translation
di: Shahin, Nada, et al.
Pubblicazione: (2025)
di: Shahin, Nada, et al.
Pubblicazione: (2025)
GLoT: A Novel Gated-Logarithmic Transformer for Efficient Sign Language Translation
di: Shahin, Nada, et al.
Pubblicazione: (2025)
di: Shahin, Nada, et al.
Pubblicazione: (2025)
Neural Fields for 3D Tracking of Anatomy and Surgical Instruments in Monocular Laparoscopic Video Clips
di: Gerats, Beerend G. A., et al.
Pubblicazione: (2024)
di: Gerats, Beerend G. A., et al.
Pubblicazione: (2024)
FedStein: Enhancing Multi-Domain Federated Learning Through James-Stein Estimator
di: Gupta, Sunny, et al.
Pubblicazione: (2024)
di: Gupta, Sunny, et al.
Pubblicazione: (2024)
UniVarFL: Uniformity and Variance Regularized Federated Learning for Heterogeneous Data
di: Gupta, Sunny, et al.
Pubblicazione: (2025)
di: Gupta, Sunny, et al.
Pubblicazione: (2025)
FedAlign: Federated Domain Generalization with Cross-Client Feature Alignment
di: Gupta, Sunny, et al.
Pubblicazione: (2025)
di: Gupta, Sunny, et al.
Pubblicazione: (2025)
VersaGen: Unleashing Versatile Visual Control for Text-to-Image Synthesis
di: Chen, Zhipeng, et al.
Pubblicazione: (2024)
di: Chen, Zhipeng, et al.
Pubblicazione: (2024)
Intrinsic Image Fusion for Multi-View 3D Material Reconstruction
di: Kocsis, Peter, et al.
Pubblicazione: (2025)
di: Kocsis, Peter, et al.
Pubblicazione: (2025)
IntrinsiX: High-Quality PBR Generation using Image Priors
di: Kocsis, Peter, et al.
Pubblicazione: (2025)
di: Kocsis, Peter, et al.
Pubblicazione: (2025)
A Lightweight and Extensible Cell Segmentation and Classification Model for Whole Slide Images
di: Shvetsov, Nikita, et al.
Pubblicazione: (2025)
di: Shvetsov, Nikita, et al.
Pubblicazione: (2025)
Scalable Face Security Vision Foundation Model for Deepfake, Diffusion, and Spoofing Detection
di: Wang, Gaojian, et al.
Pubblicazione: (2025)
di: Wang, Gaojian, et al.
Pubblicazione: (2025)
Reference Dataset and Benchmark for Reconstructing Laser Parameters from On-axis Video in Powder Bed Fusion of Bulk Stainless Steel
di: Blanc, Cyril, et al.
Pubblicazione: (2024)
di: Blanc, Cyril, et al.
Pubblicazione: (2024)
FOCUS on Contamination: Hydrology-Informed Noise-Aware Learning for Geospatial PFAS Mapping
di: Khan, Jowaria, et al.
Pubblicazione: (2025)
di: Khan, Jowaria, et al.
Pubblicazione: (2025)
BG-YOLO: A Bidirectional-Guided Method for Underwater Object Detection
di: Zhang, Jian, et al.
Pubblicazione: (2024)
di: Zhang, Jian, et al.
Pubblicazione: (2024)
COLORA: Efficient Fine-Tuning for Convolutional Models with a Study Case on Optical Coherence Tomography Image Classification
di: Rivera, Mariano, et al.
Pubblicazione: (2025)
di: Rivera, Mariano, et al.
Pubblicazione: (2025)
Detecting AI-Generated Videos with Spiking Neural Networks
di: Jang, Minsuk, et al.
Pubblicazione: (2026)
di: Jang, Minsuk, et al.
Pubblicazione: (2026)
Learning to Expand Images for Efficient Visual Autoregressive Modeling
di: Yang, Ruiqing, et al.
Pubblicazione: (2025)
di: Yang, Ruiqing, et al.
Pubblicazione: (2025)
A Light Perspective for 3D Object Detection
di: Pederiva, Marcelo Eduardo, et al.
Pubblicazione: (2025)
di: Pederiva, Marcelo Eduardo, et al.
Pubblicazione: (2025)
Combining Absolute and Semi-Generalized Relative Poses for Visual Localization
di: Panek, Vojtech, et al.
Pubblicazione: (2024)
di: Panek, Vojtech, et al.
Pubblicazione: (2024)
A Guide to Structureless Visual Localization
di: Panek, Vojtech, et al.
Pubblicazione: (2025)
di: Panek, Vojtech, et al.
Pubblicazione: (2025)
Facial Attribute Based Text Guided Face Anonymization
di: Muştu, Mustafa İzzet, et al.
Pubblicazione: (2025)
di: Muştu, Mustafa İzzet, et al.
Pubblicazione: (2025)
Privacy-Preserving Structureless Visual Localization via Image Obfuscation
di: Panek, Vojtech, et al.
Pubblicazione: (2026)
di: Panek, Vojtech, et al.
Pubblicazione: (2026)
A Two-stage Transformer Framework for Temporal Localization of Distracted Driver Behaviors
di: Doan, Gia-Bao, et al.
Pubblicazione: (2026)
di: Doan, Gia-Bao, et al.
Pubblicazione: (2026)
Break the Brake, Not the Wheel: Untargeted Jailbreak via Entropy Maximization
di: He, Mengqi, et al.
Pubblicazione: (2026)
di: He, Mengqi, et al.
Pubblicazione: (2026)
LightFFDNets: Lightweight Convolutional Neural Networks for Rapid Facial Forgery Detection
di: Jabbarlı, Günel, et al.
Pubblicazione: (2024)
di: Jabbarlı, Günel, et al.
Pubblicazione: (2024)
Dynamic Residual Encoding with Slide-Level Contrastive Learning for End-to-End Whole Slide Image Representation
di: Jin, Jing, et al.
Pubblicazione: (2025)
di: Jin, Jing, et al.
Pubblicazione: (2025)
GPT4o-Receipt: A Dataset and Human Study for AI-Generated Document Forensics
di: Zhang, Yan, et al.
Pubblicazione: (2026)
di: Zhang, Yan, et al.
Pubblicazione: (2026)
SelvaMask: Segmenting Trees in Tropical Forests and Beyond
di: Duguay, Simon-Olivier, et al.
Pubblicazione: (2026)
di: Duguay, Simon-Olivier, et al.
Pubblicazione: (2026)
Optimizing the image correction pipeline for pedestrian detection in the thermal-infrared domain
di: Karam, Christophe, et al.
Pubblicazione: (2024)
di: Karam, Christophe, et al.
Pubblicazione: (2024)
PCRI: Measuring Context Robustness in Multimodal Models for Enterprise Applications
di: Patel, Hitesh Laxmichand, et al.
Pubblicazione: (2025)
di: Patel, Hitesh Laxmichand, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Which Backbone to Use: A Resource-efficient Domain Specific Comparison for Computer Vision
di: Jeevan, Pranav, et al.
Pubblicazione: (2024) -
WaveMix: A Resource-efficient Neural Network for Image Analysis
di: Jeevan, Pranav, et al.
Pubblicazione: (2022) -
WaveMixSR-V2: Enhancing Super-resolution with Higher Efficiency
di: Jeevan, Pranav, et al.
Pubblicazione: (2024) -
Normalizing Flow-Based Metric for Image Generation
di: Jeevan, Pranav, et al.
Pubblicazione: (2024) -
FLD+: Data-efficient Evaluation Metric for Generative Models
di: Jeevan, Pranav, et al.
Pubblicazione: (2024)