Vidformer: Drop-in Declarative Optimization for Rendering Video-Native Query Results
Fuente:
arXiv
Saved in:
| Main Authors: | Winecki, Dominik, Nandi, Arnab |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Optimal Bounds-Only Pruning for Spatial AkNN Joins
by: Winecki, Dominik
Published: (2026)
by: Winecki, Dominik
Published: (2026)
NeedleDB: A Generative-AI Based System for Accurate and Efficient Image Retrieval using Complex Natural Language Queries
by: Erfanian, Mahdi, et al.
Published: (2026)
by: Erfanian, Mahdi, et al.
Published: (2026)
Vega-Video: Integrating Video into the Grammar of Graphics
by: Winecki, Dominik, et al.
Published: (2026)
by: Winecki, Dominik, et al.
Published: (2026)
A Conceptual Model of Intelligent Multimedia Data Rendered using Flying Light Specks
by: Yazdani, Nima, et al.
Published: (2024)
by: Yazdani, Nima, et al.
Published: (2024)
MaskSearch: Querying Image Masks at Scale
by: He, Dong, et al.
Published: (2023)
by: He, Dong, et al.
Published: (2023)
Demonstration of MaskSearch: Efficiently Querying Image Masks for Machine Learning Workflows
by: Wei, Lindsey Linxi, et al.
Published: (2024)
by: Wei, Lindsey Linxi, et al.
Published: (2024)
A Review of Media Copyright Management using Blockchain Technologies from the Academic and Business Perspectives
by: García, Roberto, et al.
Published: (2023)
by: García, Roberto, et al.
Published: (2023)
Human-Data Interaction, Exploration, and Visualization in the AI Era: Challenges and Opportunities
by: Fekete, Jean-Daniel, et al.
Published: (2026)
by: Fekete, Jean-Daniel, et al.
Published: (2026)
QoS-QoE Translation with Large Language Model
by: Yu, Yingjie, et al.
Published: (2026)
by: Yu, Yingjie, et al.
Published: (2026)
PETLP: A Privacy-by-Design Pipeline for Social Media Data in AI Research
by: Oh, Nick, et al.
Published: (2025)
by: Oh, Nick, et al.
Published: (2025)
HeGTa: Leveraging Heterogeneous Graph-enhanced Large Language Models for Few-shot Complex Table Understanding
by: Jin, Rihui, et al.
Published: (2024)
by: Jin, Rihui, et al.
Published: (2024)
Interdependency Matters: Graph Alignment for Multivariate Time Series Anomaly Detection
by: Wang, Yuanyi, et al.
Published: (2024)
by: Wang, Yuanyi, et al.
Published: (2024)
LazyVLM: Neuro-Symbolic Approach to Video Analytics
by: Jian, Xiangru, et al.
Published: (2025)
by: Jian, Xiangru, et al.
Published: (2025)
Multimodal LLM-based Query Paraphrasing for Video Search
by: Wu, Jiaxin, et al.
Published: (2024)
by: Wu, Jiaxin, et al.
Published: (2024)
Globally and Locally Optimized Pannini Projection for High FoV Rendering of 360-degree Images
by: Jabar, Falah, et al.
Published: (2024)
by: Jabar, Falah, et al.
Published: (2024)
Continual Multimodal Knowledge Graph Construction
by: Chen, Xiang, et al.
Published: (2023)
by: Chen, Xiang, et al.
Published: (2023)
FLARE: Full-Modality Long-Video Audiovisual Retrieval Benchmark with User-Simulated Queries
by: You, Qijie, et al.
Published: (2026)
by: You, Qijie, et al.
Published: (2026)
Declarative Privacy-Preserving Inference Queries
by: Guan, Hong, et al.
Published: (2024)
by: Guan, Hong, et al.
Published: (2024)
Results of the 2025 Video Browser Showdown
by: Rossetto, Luca, et al.
Published: (2025)
by: Rossetto, Luca, et al.
Published: (2025)
Results of the 2024 Video Browser Showdown
by: Rossetto, Luca, et al.
Published: (2024)
by: Rossetto, Luca, et al.
Published: (2024)
Photoshop Batch Rendering Using Actions for Stylistic Video Editing
by: De La Fuente, Tessa
Published: (2025)
by: De La Fuente, Tessa
Published: (2025)
RenderBox: Expressive Performance Rendering with Text Control
by: Zhang, Huan, et al.
Published: (2025)
by: Zhang, Huan, et al.
Published: (2025)
A Modular Graph-Native Query Optimization Framework
by: Lyu, Bingqing, et al.
Published: (2024)
by: Lyu, Bingqing, et al.
Published: (2024)
Joint Optimization of Buffer Delay and HARQ for Video Communications
by: Cheng, Baoping, et al.
Published: (2024)
by: Cheng, Baoping, et al.
Published: (2024)
Video Super-Resolution for Optimized Bitrate and Green Online Streaming
by: Menon, Vignesh V, et al.
Published: (2024)
by: Menon, Vignesh V, et al.
Published: (2024)
Health+: Empowering Individuals via Unifying Health Data
by: Maiyya, Sujaya, et al.
Published: (2026)
by: Maiyya, Sujaya, et al.
Published: (2026)
Introduction of a tree-based technique for efficient and real-time label retrieval in the object tracking system
by: Benrazek, Ala-Eddine, et al.
Published: (2022)
by: Benrazek, Ala-Eddine, et al.
Published: (2022)
Multimodal Neural Databases
by: Trappolini, Giovanni, et al.
Published: (2023)
by: Trappolini, Giovanni, et al.
Published: (2023)
A Declarative Query Language for Scientific Machine Learning
by: Jamil, Hasan M
Published: (2024)
by: Jamil, Hasan M
Published: (2024)
Primary Multimedia Objects and 'Educational Metadata' A Fundamental Dilemma for Developers of Multimedia Archives; Evaluation of Digital Library Impact and User Communities by Analysis of Usage Patterns; The KYVL Kentuckiana Digital Library Project: Background and Current Status; DPDx Collection.
by: Shabajee, Paul, et al.
Published: (2002)
by: Shabajee, Paul, et al.
Published: (2002)
Exposure Completing for Temporally Consistent Neural High Dynamic Range Video Rendering
by: Cui, Jiahao, et al.
Published: (2024)
by: Cui, Jiahao, et al.
Published: (2024)
RenCon 2025: Revival of the Expressive Performance Rendering Competition
by: Zhang, Huan, et al.
Published: (2026)
by: Zhang, Huan, et al.
Published: (2026)
Towards Unified Representation of Multi-Modal Pre-training for 3D Understanding via Differentiable Rendering
by: Fei, Ben, et al.
Published: (2024)
by: Fei, Ben, et al.
Published: (2024)
TAROT: Towards Optimization-Driven Adaptive FEC Parameter Tuning for Video Streaming
by: Sidhu, Jashanjot Singh, et al.
Published: (2026)
by: Sidhu, Jashanjot Singh, et al.
Published: (2026)
Cross-Modal Entity Matching for Visually Rich Documents
by: Sarkhel, Ritesh, et al.
Published: (2023)
by: Sarkhel, Ritesh, et al.
Published: (2023)
3DMambaIPF: A State Space Model for Iterative Point Cloud Filtering via Differentiable Rendering
by: Zhou, Qingyuan, et al.
Published: (2024)
by: Zhou, Qingyuan, et al.
Published: (2024)
QuMATL: Query-based Multi-annotator Tendency Learning
by: Zhang, Liyun, et al.
Published: (2025)
by: Zhang, Liyun, et al.
Published: (2025)
Nagare Media Engine: A System for Cloud- and Edge-Native Network-based Multimedia Workflows
by: Neugebauer, Matthias
Published: (2025)
by: Neugebauer, Matthias
Published: (2025)
Tile-Weighted Rate-Distortion Optimized Packet Scheduling for 360$^\circ$ VR Video Streaming
by: Wang, Haopeng, et al.
Published: (2024)
by: Wang, Haopeng, et al.
Published: (2024)
Harnessing Multimodal Large Language Models for Personalized Product Search with Query-aware Refinement
by: Zhang, Beibei, et al.
Published: (2025)
by: Zhang, Beibei, et al.
Published: (2025)
Similar Items
-
Optimal Bounds-Only Pruning for Spatial AkNN Joins
by: Winecki, Dominik
Published: (2026) -
NeedleDB: A Generative-AI Based System for Accurate and Efficient Image Retrieval using Complex Natural Language Queries
by: Erfanian, Mahdi, et al.
Published: (2026) -
Vega-Video: Integrating Video into the Grammar of Graphics
by: Winecki, Dominik, et al.
Published: (2026) -
A Conceptual Model of Intelligent Multimedia Data Rendered using Flying Light Specks
by: Yazdani, Nima, et al.
Published: (2024) -
MaskSearch: Querying Image Masks at Scale
by: He, Dong, et al.
Published: (2023)