Efficient and Accurate Image Provenance Analysis: A Scalable Pipeline for Large-scale Images
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Lai, Jiewei, Zhang, Lan, Tang, Chen, Sun, Pengcheng |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Fully Automatic Content-Aware Tiling Pipeline for Pathology Whole Slide Images
par: Jabar, Falah, et autres
Publié: (2024)
par: Jabar, Falah, et autres
Publié: (2024)
Rethinking Vision Transformer for Large-Scale Fine-Grained Image Retrieval
par: Jiang, Xin, et autres
Publié: (2025)
par: Jiang, Xin, et autres
Publié: (2025)
NeedleDB: A Generative-AI Based System for Accurate and Efficient Image Retrieval using Complex Natural Language Queries
par: Erfanian, Mahdi, et autres
Publié: (2026)
par: Erfanian, Mahdi, et autres
Publié: (2026)
DVF: Advancing Robust and Accurate Fine-Grained Image Retrieval with Retrieval Guidelines
par: Jiang, Xin, et autres
Publié: (2024)
par: Jiang, Xin, et autres
Publié: (2024)
EEmo-Bench: A Benchmark for Multi-modal Large Language Models on Image Evoked Emotion Assessment
par: Gao, Lancheng, et autres
Publié: (2025)
par: Gao, Lancheng, et autres
Publié: (2025)
Enhanced Quality Aware-Scalable Underwater Image Compression
par: Zhu, Linwei, et autres
Publié: (2025)
par: Zhu, Linwei, et autres
Publié: (2025)
Structured Image-based Coding for Efficient Gaussian Splatting Compression
par: Martin, Pedro, et autres
Publié: (2026)
par: Martin, Pedro, et autres
Publié: (2026)
Predictive Sampling for Efficient Pairwise Subjective Image Quality Assessment
par: Mohammadi, Shima, et autres
Publié: (2023)
par: Mohammadi, Shima, et autres
Publié: (2023)
Relationship Analysis of Image-Text Pair in SNS Posts
par: Nabeoka, Takuto, et autres
Publié: (2025)
par: Nabeoka, Takuto, et autres
Publié: (2025)
STIV: Scalable Text and Image Conditioned Video Generation
par: Lin, Zongyu, et autres
Publié: (2024)
par: Lin, Zongyu, et autres
Publié: (2024)
Perceptual-oriented Learned Image Compression with Dynamic Kernel
par: Fu, Nianxiang, et autres
Publié: (2024)
par: Fu, Nianxiang, et autres
Publié: (2024)
A Large-scale Dataset with Behavior, Attributes, and Content of Mobile Short-video Platform
par: Shang, Yu, et autres
Publié: (2025)
par: Shang, Yu, et autres
Publié: (2025)
MarkIt: Training-Free Visual Markers for Precise Video Temporal Grounding
par: Fang, Pengcheng, et autres
Publié: (2026)
par: Fang, Pengcheng, et autres
Publié: (2026)
Personalized Image Generation with Large Multimodal Models
par: Xu, Yiyan, et autres
Publié: (2024)
par: Xu, Yiyan, et autres
Publié: (2024)
PixelatedScatter: Arbitrary-level Visual Abstraction for Large-scale Multiclass Scatterplots
par: Guo, Ziheng, et autres
Publié: (2025)
par: Guo, Ziheng, et autres
Publié: (2025)
A 3D-Cascading Crossing Coupling Framework for Hyperchaotic Map Construction and Its Application to Color Image Encryption
par: Sun, Jilei, et autres
Publié: (2025)
par: Sun, Jilei, et autres
Publié: (2025)
RFNNS: Robust Fixed Neural Network Steganography with Universal Text-to-Image Models
par: Cheng, Yu, et autres
Publié: (2025)
par: Cheng, Yu, et autres
Publié: (2025)
Learning Switchable Priors for Neural Image Compression
par: Zhang, Haotian, et autres
Publié: (2025)
par: Zhang, Haotian, et autres
Publié: (2025)
Evaluation of Objective Image Quality Metrics for High-Fidelity Image Compression
par: Mohammadi, Shima, et autres
Publié: (2025)
par: Mohammadi, Shima, et autres
Publié: (2025)
Both Text and Images Leaked! A Systematic Analysis of Data Contamination in Multimodal LLM
par: Song, Dingjie, et autres
Publié: (2024)
par: Song, Dingjie, et autres
Publié: (2024)
ABC: Adaptive BayesNet Structure Learning for Computational Scalable Multi-task Image Compression
par: Zhang, Yufeng, et autres
Publié: (2025)
par: Zhang, Yufeng, et autres
Publié: (2025)
Atom: Efficient On-Device Video-Language Pipelines Through Modular Reuse
par: Panchal, Kunjal, et autres
Publié: (2025)
par: Panchal, Kunjal, et autres
Publié: (2025)
UniAnimate-DiT: Human Image Animation with Large-Scale Video Diffusion Transformer
par: Wang, Xiang, et autres
Publié: (2025)
par: Wang, Xiang, et autres
Publié: (2025)
Security Analysis of Thumbnail-Preserving Image Encryption and a New Framework
par: Xie, Dong, et autres
Publié: (2025)
par: Xie, Dong, et autres
Publié: (2025)
Probing Commonsense Reasoning Capability of Text-to-Image Generative Models via Non-visual Description
par: Pan, Mianzhi, et autres
Publié: (2023)
par: Pan, Mianzhi, et autres
Publié: (2023)
SPP-SCL: Semi-Push-Pull Supervised Contrastive Learning for Image-Text Sentiment Analysis and Beyond
par: Wu, Jiesheng, et autres
Publié: (2026)
par: Wu, Jiesheng, et autres
Publié: (2026)
SmartSplat: Feature-Smart Gaussians for Scalable Compression of Ultra-High-Resolution Images
par: Li, Linfei, et autres
Publié: (2025)
par: Li, Linfei, et autres
Publié: (2025)
Latent Feature-Guided Conditional Diffusion for Generative Image Semantic Communication
par: Chen, Zehao, et autres
Publié: (2025)
par: Chen, Zehao, et autres
Publié: (2025)
Large-scale Multi-Modal Pre-trained Models: A Comprehensive Survey
par: Wang, Xiao, et autres
Publié: (2023)
par: Wang, Xiao, et autres
Publié: (2023)
StyleSpeaker: Audio-Enhanced Fine-Grained Style Modeling for Speech-Driven 3D Facial Animation
par: Yang, An, et autres
Publié: (2025)
par: Yang, An, et autres
Publié: (2025)
Simple but Effective Raw-Data Level Multimodal Fusion for Composed Image Retrieval
par: Wen, Haokun, et autres
Publié: (2024)
par: Wen, Haokun, et autres
Publié: (2024)
Scalable Image Coding for Humans and Machines Using Feature Fusion Network
par: Shindo, Takahiro, et autres
Publié: (2024)
par: Shindo, Takahiro, et autres
Publié: (2024)
ProMSC-MIS: Prompt-based Multimodal Semantic Communication for Multi-Spectral Image Segmentation
par: Zhang, Haoshuo, et autres
Publié: (2025)
par: Zhang, Haoshuo, et autres
Publié: (2025)
ImageScope: Unifying Language-Guided Image Retrieval via Large Multimodal Model Collective Reasoning
par: Luo, Pengfei, et autres
Publié: (2025)
par: Luo, Pengfei, et autres
Publié: (2025)
Efficient Constraining of Transcoding in DNA-Based Image Storage
par: Sayyed, Sara Al, et autres
Publié: (2025)
par: Sayyed, Sara Al, et autres
Publié: (2025)
Toward Scalable Image Feature Compression: A Content-Adaptive and Diffusion-Based Approach
par: Guo, Sha, et autres
Publié: (2024)
par: Guo, Sha, et autres
Publié: (2024)
Image is All You Need to Empower Large-scale Diffusion Models for In-Domain Generation
par: Cao, Pu, et autres
Publié: (2023)
par: Cao, Pu, et autres
Publié: (2023)
ViFusion: In-Network Tensor Fusion for Scalable Video Feature Indexing
par: Wang, Yisu, et autres
Publié: (2025)
par: Wang, Yisu, et autres
Publié: (2025)
Interoperable Provenance Authentication of Broadcast Media using Open Standards-based Metadata, Watermarking and Cryptography
par: Simmons, John C., et autres
Publié: (2024)
par: Simmons, John C., et autres
Publié: (2024)
LLMER: Crafting Interactive Extended Reality Worlds with JSON Data Generated by Large Language Models
par: Chen, Jiangong, et autres
Publié: (2025)
par: Chen, Jiangong, et autres
Publié: (2025)
Documents similaires
-
Fully Automatic Content-Aware Tiling Pipeline for Pathology Whole Slide Images
par: Jabar, Falah, et autres
Publié: (2024) -
Rethinking Vision Transformer for Large-Scale Fine-Grained Image Retrieval
par: Jiang, Xin, et autres
Publié: (2025) -
NeedleDB: A Generative-AI Based System for Accurate and Efficient Image Retrieval using Complex Natural Language Queries
par: Erfanian, Mahdi, et autres
Publié: (2026) -
DVF: Advancing Robust and Accurate Fine-Grained Image Retrieval with Retrieval Guidelines
par: Jiang, Xin, et autres
Publié: (2024) -
EEmo-Bench: A Benchmark for Multi-modal Large Language Models on Image Evoked Emotion Assessment
par: Gao, Lancheng, et autres
Publié: (2025)