ForeSea: AI Forensic Search with Multi-modal Queries for Video Surveillance
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Park, Hyojin, Li, Yi, Cho, Janghoon, Choi, Sungha, Lee, Jungsoo, Jing, Taotao, Zhang, Shuai, Hayat, Munawar, Gao, Dashan, Bi, Ning, Porikli, Fatih |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Generalized Contrastive Learning for Universal Multimodal Retrieval
par: Lee, Jungsoo, et autres
Publié: (2025)
par: Lee, Jungsoo, et autres
Publié: (2025)
FLoC: Facility Location-Based Efficient Visual Token Compression for Long Video Understanding
par: Cho, Janghoon, et autres
Publié: (2025)
par: Cho, Janghoon, et autres
Publié: (2025)
CustomKD: Customizing Large Vision Foundation for Edge Model Improvement via Knowledge Distillation
par: Lee, Jungsoo, et autres
Publié: (2025)
par: Lee, Jungsoo, et autres
Publié: (2025)
Personalized OVSS: Understanding Personal Concept in Open-Vocabulary Semantic Segmentation
par: Park, Sunghyun, et autres
Publié: (2025)
par: Park, Sunghyun, et autres
Publié: (2025)
CA-LoRA: Concept-Aware LoRA for Domain-Aligned Segmentation Dataset Generation
par: Park, Minho, et autres
Publié: (2025)
par: Park, Minho, et autres
Publié: (2025)
Attention Guided Alignment in Efficient Vision-Language Models
par: Mahajan, Shweta, et autres
Publié: (2025)
par: Mahajan, Shweta, et autres
Publié: (2025)
PosSAM: Panoptic Open-vocabulary Segment Anything
par: VS, Vibashan, et autres
Publié: (2024)
par: VS, Vibashan, et autres
Publié: (2024)
Resolving the Identity Crisis in Text-to-Image Generation
par: Borse, Shubhankar, et autres
Publié: (2025)
par: Borse, Shubhankar, et autres
Publié: (2025)
DDIL: Diversity Enhancing Diffusion Distillation With Imitation Learning
par: Garrepalli, Risheek, et autres
Publié: (2024)
par: Garrepalli, Risheek, et autres
Publié: (2024)
ConsNoTrainLoRA: Data-driven Weight Initialization of Low-rank Adapters using Constraints
par: Das, Debasmit, et autres
Publié: (2025)
par: Das, Debasmit, et autres
Publié: (2025)
HyperNet Fields: Efficiently Training Hypernetworks without Ground Truth by Learning Weight Trajectories
par: Hedlin, Eric, et autres
Publié: (2024)
par: Hedlin, Eric, et autres
Publié: (2024)
Memory-Efficient Fine-Tuning Diffusion Transformers via Dynamic Patch Sampling and Block Skipping
par: Park, Sunghyun, et autres
Publié: (2026)
par: Park, Sunghyun, et autres
Publié: (2026)
DuoLoRA : Cycle-consistent and Rank-disentangled Content-Style Personalization
par: Roy, Aniket, et autres
Publié: (2025)
par: Roy, Aniket, et autres
Publié: (2025)
OCAI: Improving Optical Flow Estimation by Occlusion and Consistency Aware Interpolation
par: Jeong, Jisoo, et autres
Publié: (2024)
par: Jeong, Jisoo, et autres
Publié: (2024)
MultiHuman-Testbench: Benchmarking Image Generation for Multiple Humans
par: Borse, Shubhankar, et autres
Publié: (2025)
par: Borse, Shubhankar, et autres
Publié: (2025)
Do-Undo Bench: Reversibility for Action Understanding in Image Generation
par: Mahajan, Shweta, et autres
Publié: (2025)
par: Mahajan, Shweta, et autres
Publié: (2025)
SubZero: Composing Subject, Style, and Action via Zero-Shot Personalization
par: Borse, Shubhankar, et autres
Publié: (2025)
par: Borse, Shubhankar, et autres
Publié: (2025)
DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos
par: Yasarla, Rajeev, et autres
Publié: (2025)
par: Yasarla, Rajeev, et autres
Publié: (2025)
MADI: Masking-Augmented Diffusion with Inference-Time Scaling for Visual Editing
par: Kadambi, Shreya, et autres
Publié: (2025)
par: Kadambi, Shreya, et autres
Publié: (2025)
Ar2Can: An Architect and an Artist Leveraging a Canvas for Multi-Human Generation
par: Borse, Shubhankar, et autres
Publié: (2025)
par: Borse, Shubhankar, et autres
Publié: (2025)
EdgeRelight360: Text-Conditioned 360-Degree HDR Image Generation for Real-Time On-Device Video Portrait Relighting
par: Lin, Min-Hui, et autres
Publié: (2024)
par: Lin, Min-Hui, et autres
Publié: (2024)
FouRA: Fourier Low Rank Adaptation
par: Borse, Shubhankar, et autres
Publié: (2024)
par: Borse, Shubhankar, et autres
Publié: (2024)
Erasing Undesirable Influence in Diffusion Models
par: Wu, Jing, et autres
Publié: (2024)
par: Wu, Jing, et autres
Publié: (2024)
Tripartite Weight-Space Ensemble for Few-Shot Class-Incremental Learning
par: Lee, Juntae, et autres
Publié: (2025)
par: Lee, Juntae, et autres
Publié: (2025)
Hollowed Net for On-Device Personalization of Text-to-Image Diffusion Models
par: Cho, Wonguk, et autres
Publié: (2024)
par: Cho, Wonguk, et autres
Publié: (2024)
Airborne Bacterial Communities: Diversity, Survival Strategies and Functional Roles in the Atmosphere
par: Jungsoo Park, et autres
Publié: (2026)
par: Jungsoo Park, et autres
Publié: (2026)
Unexpected Shifts in Sleep Architecture Associated with Cognitive Impairment
par: Hyeonseul Park, et autres
Publié: (2025)
par: Hyeonseul Park, et autres
Publié: (2025)
Comparative Study of Key Reactions Affecting Nitrogen Oxide Formation in Methane Laminar Premixed Flame
par: Jonghyun Kim, et autres
Publié: (2024)
par: Jonghyun Kim, et autres
Publié: (2024)
MoViE: Mobile Diffusion for Video Editing
par: Karjauv, Adil, et autres
Publié: (2024)
par: Karjauv, Adil, et autres
Publié: (2024)
MAMo: Leveraging Memory and Attention for Monocular Video Depth Estimation
par: Yasarla, Rajeev, et autres
Publié: (2023)
par: Yasarla, Rajeev, et autres
Publié: (2023)
TOKON: TOKenization-Optimized Normalization for time series analysis with a large language model
par: Yang, Janghoon
Publié: (2025)
par: Yang, Janghoon
Publié: (2025)
Context information can be more important than reasoning for time series forecasting with a large language model
par: Yang, Janghoon
Publié: (2025)
par: Yang, Janghoon
Publié: (2025)
Object-Centric Diffusion for Efficient Video Editing
par: Kahatapitiya, Kumara, et autres
Publié: (2024)
par: Kahatapitiya, Kumara, et autres
Publié: (2024)
Hidden Bias in the Machine: Stereotypes in Text-to-Image Models
par: Porikli, Sedat, et autres
Publié: (2025)
par: Porikli, Sedat, et autres
Publié: (2025)
Feature Diversification and Adaptation for Federated Domain Generalization
par: Yang, Seunghan, et autres
Publié: (2024)
par: Yang, Seunghan, et autres
Publié: (2024)
How Are Spousal Carers' Health and Self‐Perceptions of Ageing Reshaped in Caregiving Situations? The Mediating Role of Psychological Resources
par: Hyojin Choi, et autres
Publié: (2025)
par: Hyojin Choi, et autres
Publié: (2025)
Segmentation-Free Guidance for Text-to-Image Diffusion Models
par: Azarian, Kambiz, et autres
Publié: (2024)
par: Azarian, Kambiz, et autres
Publié: (2024)
H3O: Hyper-Efficient 3D Occupancy Prediction with Heterogeneous Supervision
par: Shi, Yunxiao, et autres
Publié: (2025)
par: Shi, Yunxiao, et autres
Publié: (2025)
Zero-Shot Adaptation of Parameter-Efficient Fine-Tuning in Diffusion Models
par: Farhadzadeh, Farzad, et autres
Publié: (2025)
par: Farhadzadeh, Farzad, et autres
Publié: (2025)
LoRA-X: Bridging Foundation Models with Training-Free Cross-Model Adaptation
par: Farhadzadeh, Farzad, et autres
Publié: (2025)
par: Farhadzadeh, Farzad, et autres
Publié: (2025)
Documents similaires
-
Generalized Contrastive Learning for Universal Multimodal Retrieval
par: Lee, Jungsoo, et autres
Publié: (2025) -
FLoC: Facility Location-Based Efficient Visual Token Compression for Long Video Understanding
par: Cho, Janghoon, et autres
Publié: (2025) -
CustomKD: Customizing Large Vision Foundation for Edge Model Improvement via Knowledge Distillation
par: Lee, Jungsoo, et autres
Publié: (2025) -
Personalized OVSS: Understanding Personal Concept in Open-Vocabulary Semantic Segmentation
par: Park, Sunghyun, et autres
Publié: (2025) -
CA-LoRA: Concept-Aware LoRA for Domain-Aligned Segmentation Dataset Generation
par: Park, Minho, et autres
Publié: (2025)