Tokenizing Motion: A Generative Approach for Scene Dynamics Compression
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yin, Shanzhi, Zhang, Zihan, Chen, Bolin, Wang, Shiqi, Ye, Yan |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Towards Efficient 3D Gaussian Human Avatar Compression: A Prior-Guided Framework
par: Yin, Shanzhi, et autres
Publié: (2025)
par: Yin, Shanzhi, et autres
Publié: (2025)
Dual encoding feature filtering generalized attention UNET for retinal vessel segmentation
par: Islam, Md Tauhidul, et autres
Publié: (2025)
par: Islam, Md Tauhidul, et autres
Publié: (2025)
Lightweight Hypercomplex MRI Reconstruction: A Generalized Kronecker-Parameterized Approach
par: Zhang, Haosen, et autres
Publié: (2025)
par: Zhang, Haosen, et autres
Publié: (2025)
Neural Image Compression Using Masked Sparse Visual Representation
par: Jiang, Wei, et autres
Publié: (2023)
par: Jiang, Wei, et autres
Publié: (2023)
Generative Human Video Compression with Multi-granularity Temporal Trajectory Factorization
par: Yin, Shanzhi, et autres
Publié: (2024)
par: Yin, Shanzhi, et autres
Publié: (2024)
A Low-dose CT Reconstruction Network Based on TV-regularized OSEM Algorithm
par: An, Ran, et autres
Publié: (2024)
par: An, Ran, et autres
Publié: (2024)
Multispectral Remote Sensing for Weed Detection in West Australian Agricultural Lands
par: Wang, Haitian, et autres
Publié: (2025)
par: Wang, Haitian, et autres
Publié: (2025)
Generative Visual Compression: A Review
par: Chen, Bolin, et autres
Publié: (2024)
par: Chen, Bolin, et autres
Publié: (2024)
Large Scale Masked Autoencoding for Reducing Label Requirements on SAR Data
par: Allen, Matt, et autres
Publié: (2023)
par: Allen, Matt, et autres
Publié: (2023)
Make Lossy Compression Meaningful for Low-Light Images
par: Cai, Shilv, et autres
Publié: (2023)
par: Cai, Shilv, et autres
Publié: (2023)
PtychoFormer: A Transformer-based Model for Ptychographic Phase Retrieval
par: Nakahata, Ryuma, et autres
Publié: (2024)
par: Nakahata, Ryuma, et autres
Publié: (2024)
HyperColorization: Propagating spatially sparse noisy spectral clues for reconstructing hyperspectral images
par: Aydin, M. Kerem, et autres
Publié: (2024)
par: Aydin, M. Kerem, et autres
Publié: (2024)
A systematic review: Deep learning-based methods for pneumonia region detection
par: Xu, Xinmei
Publié: (2024)
par: Xu, Xinmei
Publié: (2024)
Adaptive Local Frequency Filtering for Fourier-Encoded Implicit Neural Representations
par: Shi, Ligen, et autres
Publié: (2026)
par: Shi, Ligen, et autres
Publié: (2026)
Dataset of soil images with corresponding particle size distributions for photogranulometry
par: St-Cyr, Thomas Plante, et autres
Publié: (2025)
par: St-Cyr, Thomas Plante, et autres
Publié: (2025)
Beyond GFVC: A Progressive Face Video Compression Framework with Adaptive Visual Tokens
par: Chen, Bolin, et autres
Publié: (2024)
par: Chen, Bolin, et autres
Publié: (2024)
Serpent: Scalable and Efficient Image Restoration via Multi-scale Structured State Space Models
par: Sepehri, Mohammad Shahab, et autres
Publié: (2024)
par: Sepehri, Mohammad Shahab, et autres
Publié: (2024)
Interactive 3D Segmentation for Primary Gross Tumor Volume in Oropharyngeal Cancer
par: Saukkoriipi, Mikko, et autres
Publié: (2024)
par: Saukkoriipi, Mikko, et autres
Publié: (2024)
Multimodal 3D Brain Tumor Segmentation with Adversarial Training and Conditional Random Field
par: Jiang, Lan, et autres
Publié: (2024)
par: Jiang, Lan, et autres
Publié: (2024)
Compressing Human Body Video with Interactive Semantics: A Generative Approach
par: Chen, Bolin, et autres
Publié: (2025)
par: Chen, Bolin, et autres
Publié: (2025)
Deep Learning-Based Transfer Learning for Classification of Cassava Disease
par: Junior, Ademir G. Costa, et autres
Publié: (2025)
par: Junior, Ademir G. Costa, et autres
Publié: (2025)
Ensemble YOLO Framework for Multi-Domain Mitotic Figure Detection in Histopathology Images
par: Kelam, Navya Sri, et autres
Publié: (2025)
par: Kelam, Navya Sri, et autres
Publié: (2025)
Hessian-Based Lightweight Neural Network HessNet for State-of-the-Art Brain Vessel Segmentation on a Minimal Training Dataset
par: Bernadotte, Alexandra, et autres
Publié: (2025)
par: Bernadotte, Alexandra, et autres
Publié: (2025)
Comparative Analysis of Deep Learning Architectures for Multi-Disease Classification of Single-Label Chest X-rays
par: Bahram, Ali M., et autres
Publié: (2026)
par: Bahram, Ali M., et autres
Publié: (2026)
Slice-Consistent 3D Volumetric Brain CT-to-MRI Translation with 2D Brownian Bridge Diffusion Model
par: Choo, Kyobin, et autres
Publié: (2024)
par: Choo, Kyobin, et autres
Publié: (2024)
Distance Estimation in Outdoor Driving Environments Using Phase-only Correlation Method with Event Cameras
par: Kobayashi, Masataka, et autres
Publié: (2025)
par: Kobayashi, Masataka, et autres
Publié: (2025)
DiracDiffusion: Denoising and Incremental Reconstruction with Assured Data-Consistency
par: Fabian, Zalan, et autres
Publié: (2023)
par: Fabian, Zalan, et autres
Publié: (2023)
CompaCT: Fractal-Based Heuristic Pixel Segmentation for Lossless Compression of High-Color DICOM Medical Images
par: Khan, Taaha
Publié: (2023)
par: Khan, Taaha
Publié: (2023)
T2LR-Net: An unrolling network learning transformed tensor low-rank prior for dynamic MR image reconstruction
par: Zhang, Yinghao, et autres
Publié: (2022)
par: Zhang, Yinghao, et autres
Publié: (2022)
A Machine Vision Approach to Preliminary Skin Lesion Assessments
par: Khreis, Ali, et autres
Publié: (2026)
par: Khreis, Ali, et autres
Publié: (2026)
Large-scale data extraction from the UNOS organ donor documents
par: Rychlik, Marek, et autres
Publié: (2023)
par: Rychlik, Marek, et autres
Publié: (2023)
A Lightweight Dual-Mode Optimization for Generative Face Video Coding
par: Zhang, Zihan, et autres
Publié: (2025)
par: Zhang, Zihan, et autres
Publié: (2025)
Bridging Knowledge Gap Between Image Inpainting and Large-Area Visible Watermark Removal
par: Leng, Yicheng, et autres
Publié: (2025)
par: Leng, Yicheng, et autres
Publié: (2025)
DPER: Diffusion Prior Driven Neural Representation for Limited Angle and Sparse View CT Reconstruction
par: Du, Chenhe, et autres
Publié: (2024)
par: Du, Chenhe, et autres
Publié: (2024)
Comparative Analysis of Image Enhancement Techniques for Brain Tumor Segmentation: Contrast, Histogram, and Hybrid Approaches
par: Saifullah, Shoffan, et autres
Publié: (2024)
par: Saifullah, Shoffan, et autres
Publié: (2024)
Hierarchical Multi-Scale Graph Learning with Knowledge-Guided Attention for Whole-Slide Image Survival Analysis
par: Xu, Bin, et autres
Publié: (2026)
par: Xu, Bin, et autres
Publié: (2026)
Kuro Siwo: 33 billion $m^2$ under the water. A global multi-temporal satellite dataset for rapid flood mapping
par: Bountos, Nikolaos Ioannis, et autres
Publié: (2023)
par: Bountos, Nikolaos Ioannis, et autres
Publié: (2023)
The Skin Game: Revolutionizing Standards for AI Dermatology Model Comparison
par: Miętkiewicz, Łukasz, et autres
Publié: (2025)
par: Miętkiewicz, Łukasz, et autres
Publié: (2025)
A framework for river connectivity classification using temporal image processing and attention based neural networks
par: Becker, Timothy James, et autres
Publié: (2025)
par: Becker, Timothy James, et autres
Publié: (2025)
Autoencoded Image Compression for Secure and Fast Transmission
par: Naveen, Aryan Kashyap, et autres
Publié: (2024)
par: Naveen, Aryan Kashyap, et autres
Publié: (2024)
Documents similaires
-
Towards Efficient 3D Gaussian Human Avatar Compression: A Prior-Guided Framework
par: Yin, Shanzhi, et autres
Publié: (2025) -
Dual encoding feature filtering generalized attention UNET for retinal vessel segmentation
par: Islam, Md Tauhidul, et autres
Publié: (2025) -
Lightweight Hypercomplex MRI Reconstruction: A Generalized Kronecker-Parameterized Approach
par: Zhang, Haosen, et autres
Publié: (2025) -
Neural Image Compression Using Masked Sparse Visual Representation
par: Jiang, Wei, et autres
Publié: (2023) -
Generative Human Video Compression with Multi-granularity Temporal Trajectory Factorization
par: Yin, Shanzhi, et autres
Publié: (2024)