yley123/MatSynth-Captions-Text-Prompts-for-Material-Videos: MatSynth-Captions-Text-Prompts-for-Material-Videos
Fuente:
Zenodo
Enregistré dans:
| Auteur principal: | BOWEN |
|---|---|
| Format: | Recurso digital |
| Publié: |
Zenodo
2025
|
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
MatSynth: A Modern PBR Materials Dataset
par: Vecchio, Giuseppe, et autres
Publié: (2024)
par: Vecchio, Giuseppe, et autres
Publié: (2024)
VideoMat: Extracting PBR Materials from Video Diffusion Models
par: Munkberg, Jacob, et autres
Publié: (2025)
par: Munkberg, Jacob, et autres
Publié: (2025)
VideoMat: Extracting PBR Materials from Video Diffusion Models
par: J. Munkberg, et autres
Publié: (2025)
par: J. Munkberg, et autres
Publié: (2025)
Image Captions are Natural Prompts for Text-to-Image Models
par: Lei, Shiye, et autres
Publié: (2023)
par: Lei, Shiye, et autres
Publié: (2023)
Text Data-Centric Image Captioning with Interactive Prompts
par: Wang, Yiyu, et autres
Publié: (2024)
par: Wang, Yiyu, et autres
Publié: (2024)
VRMDiff: Text-Guided Video Referring Matting Generation of Diffusion
par: Yang, Lehan, et autres
Publié: (2025)
par: Yang, Lehan, et autres
Publié: (2025)
VideoNeuMat: Neural Material Extraction from Generative Video Models
par: Xue, Bowen, et autres
Publié: (2026)
par: Xue, Bowen, et autres
Publié: (2026)
MatAtlas: Text-driven Consistent Geometry Texturing and Material Assignment
par: Ceylan, Duygu, et autres
Publié: (2024)
par: Ceylan, Duygu, et autres
Publié: (2024)
Synth$^2$: Boosting Visual-Language Models with Synthetic Captions and Image Embeddings
par: Sharifzadeh, Sahand, et autres
Publié: (2024)
par: Sharifzadeh, Sahand, et autres
Publié: (2024)
Generative Video Matting
par: Ge, Yongtao, et autres
Publié: (2025)
par: Ge, Yongtao, et autres
Publié: (2025)
VideoMatGen: PBR Materials through Joint Generative Modeling
par: Hasselgren, Jon, et autres
Publié: (2026)
par: Hasselgren, Jon, et autres
Publié: (2026)
Caption Anything in Video: Fine-grained Object-centric Captioning via Spatiotemporal Multimodal Prompting
par: Tang, Yunlong, et autres
Publié: (2025)
par: Tang, Yunlong, et autres
Publié: (2025)
Structured Captions Improve Prompt Adherence in Text-to-Image Models (Re-LAION-Caption 19M)
par: Merchant, Nicholas, et autres
Publié: (2025)
par: Merchant, Nicholas, et autres
Publié: (2025)
MatNexus: A Comprehensive Text Mining and Analysis Suite for Materials Discover
par: Zhang, Lei, et autres
Publié: (2023)
par: Zhang, Lei, et autres
Publié: (2023)
It's Just Another Day: Unique Video Captioning by Discriminative Prompting
par: Perrett, Toby, et autres
Publié: (2024)
par: Perrett, Toby, et autres
Publié: (2024)
HowToCaption: Prompting LLMs to Transform Video Annotations at Scale
par: Shvetsova, Nina, et autres
Publié: (2023)
par: Shvetsova, Nina, et autres
Publié: (2023)
MatAnyone: Stable Video Matting with Consistent Memory Propagation
par: Yang, Peiqing, et autres
Publié: (2025)
par: Yang, Peiqing, et autres
Publié: (2025)
Expertized Caption Auto-Enhancement for Video-Text Retrieval
par: Yang, Baoyao, et autres
Publié: (2025)
par: Yang, Baoyao, et autres
Publié: (2025)
Pretrained Image-Text Models are Secretly Video Captioners
par: Zhang, Chunhui, et autres
Publié: (2025)
par: Zhang, Chunhui, et autres
Publié: (2025)
Learning to Rank Caption Chains for Video-Text Alignment
par: Blume, Ansel, et autres
Publié: (2026)
par: Blume, Ansel, et autres
Publié: (2026)
VC4VG: Optimizing Video Captions for Text-to-Video Generation
par: Du, Yang, et autres
Publié: (2025)
par: Du, Yang, et autres
Publié: (2025)
VoCap: Video Object Captioning and Segmentation from Any Prompt
par: Uijlings, Jasper, et autres
Publié: (2025)
par: Uijlings, Jasper, et autres
Publié: (2025)
ViPCap: Retrieval Text-Based Visual Prompts for Lightweight Image Captioning
par: Kim, Taewhan, et autres
Publié: (2024)
par: Kim, Taewhan, et autres
Publié: (2024)
LeMat-Synth: a multi-modal toolbox to curate broad synthesis procedure databases from scientific literature
par: Lederbauer, Magdalena, et autres
Publié: (2025)
par: Lederbauer, Magdalena, et autres
Publié: (2025)
Post-Training Quantization for Video Matting
par: Zhu, Tianrui, et autres
Publié: (2025)
par: Zhu, Tianrui, et autres
Publié: (2025)
SynthVLM: Towards High-Quality and Efficient Synthesis of Image-Caption Datasets for Vision-Language Models
par: Liu, Zheng, et autres
Publié: (2024)
par: Liu, Zheng, et autres
Publié: (2024)
TALC: Time-Aligned Captions for Multi-Scene Text-to-Video Generation
par: Bansal, Hritik, et autres
Publié: (2024)
par: Bansal, Hritik, et autres
Publié: (2024)
MatAnyone 2: Scaling Video Matting via a Learned Quality Evaluator
par: Yang, Peiqing, et autres
Publié: (2025)
par: Yang, Peiqing, et autres
Publié: (2025)
MatPhys: Learning Material-Aware Physics Parameters for Deformable Object Simulation from Videos
par: Yang, Yang, et autres
Publié: (2026)
par: Yang, Yang, et autres
Publié: (2026)
TA-Prompting: Enhancing Video Large Language Models for Dense Video Captioning via Temporal Anchors
par: Cheng, Wei-Yuan, et autres
Publié: (2026)
par: Cheng, Wei-Yuan, et autres
Publié: (2026)
VidCapBench: A Comprehensive Benchmark of Video Captioning for Controllable Text-to-Video Generation
par: Chen, Xinlong, et autres
Publié: (2025)
par: Chen, Xinlong, et autres
Publié: (2025)
Narrating the Video: Boosting Text-Video Retrieval via Comprehensive Utilization of Frame-Level Captions
par: Hur, Chan, et autres
Publié: (2025)
par: Hur, Chan, et autres
Publié: (2025)
Live Video Captioning
par: Blanco-Fernández, Eduardo, et autres
Publié: (2024)
par: Blanco-Fernández, Eduardo, et autres
Publié: (2024)
Captioning for Text-Video Retrieval via Dual-Group Direct Preference Optimization
par: Lee, Ji Soo, et autres
Publié: (2025)
par: Lee, Ji Soo, et autres
Publié: (2025)
OPCap:Object-aware Prompting Captioning
par: Huang, Feiyang
Publié: (2024)
par: Huang, Feiyang
Publié: (2024)
Robustness Assessment and Enhancement of Text Watermarking for Google's SynthID
par: Han, Xia, et autres
Publié: (2025)
par: Han, Xia, et autres
Publié: (2025)
RxnCaption: Reformulating Reaction Diagram Parsing as Visual Prompt Guided Captioning
par: Song, Jiahe, et autres
Publié: (2025)
par: Song, Jiahe, et autres
Publié: (2025)
RealMat: Realistic Materials with Diffusion and Reinforcement Learning
par: Zhou, Xilong, et autres
Publié: (2025)
par: Zhou, Xilong, et autres
Publié: (2025)
MatFuse: Controllable Material Generation with Diffusion Models
par: Vecchio, Giuseppe, et autres
Publié: (2023)
par: Vecchio, Giuseppe, et autres
Publié: (2023)
SynthTextEval: Synthetic Text Data Generation and Evaluation for High-Stakes Domains
par: Ramesh, Krithika, et autres
Publié: (2025)
par: Ramesh, Krithika, et autres
Publié: (2025)
Documents similaires
-
MatSynth: A Modern PBR Materials Dataset
par: Vecchio, Giuseppe, et autres
Publié: (2024) -
VideoMat: Extracting PBR Materials from Video Diffusion Models
par: Munkberg, Jacob, et autres
Publié: (2025) -
VideoMat: Extracting PBR Materials from Video Diffusion Models
par: J. Munkberg, et autres
Publié: (2025) -
Image Captions are Natural Prompts for Text-to-Image Models
par: Lei, Shiye, et autres
Publié: (2023) -
Text Data-Centric Image Captioning with Interactive Prompts
par: Wang, Yiyu, et autres
Publié: (2024)