TOP:A New Target-Audience Oriented Content Paraphrase Task
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Lin, Boda, Shi, Jiaxin, Yan, Haolong, Tang, Binghao, Gong, Xiaocheng, Li, Si |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Multimodal LLM-based Query Paraphrasing for Video Search
par: Wu, Jiaxin, et autres
Publié: (2024)
par: Wu, Jiaxin, et autres
Publié: (2024)
Multimodal Interaction Modeling via Self-Supervised Multi-Task Learning for Review Helpfulness Prediction
par: Gong, HongLin, et autres
Publié: (2024)
par: Gong, HongLin, et autres
Publié: (2024)
Personalized Playback Technology: How Short Video Services Create Excellent User Experience
par: Deng, Weihui, et autres
Publié: (2024)
par: Deng, Weihui, et autres
Publié: (2024)
A Large-scale Dataset with Behavior, Attributes, and Content of Mobile Short-video Platform
par: Shang, Yu, et autres
Publié: (2025)
par: Shang, Yu, et autres
Publié: (2025)
TPIFM: A Task-Aware Model for Evaluating Perceptual Interaction Fluency in Remote AR Collaboration
par: Song, Jiarun, et autres
Publié: (2026)
par: Song, Jiarun, et autres
Publié: (2026)
Mining the Social Fabric: Unveiling Communities for Fake News Detection in Short Videos
par: Gong, Haisong, et autres
Publié: (2025)
par: Gong, Haisong, et autres
Publié: (2025)
Federated Multi-Task Clustering
par: Dai, Suyan, et autres
Publié: (2025)
par: Dai, Suyan, et autres
Publié: (2025)
Think before You Leap: Content-Aware Low-Cost Edge-Assisted Video Semantic Segmentation
par: Yan, Mingxuan, et autres
Publié: (2024)
par: Yan, Mingxuan, et autres
Publié: (2024)
MM-InstructEval: Zero-Shot Evaluation of (Multimodal) Large Language Models on Multimodal Reasoning Tasks
par: Yang, Xiaocui, et autres
Publié: (2024)
par: Yang, Xiaocui, et autres
Publié: (2024)
Content-Adaptive Rate-Quality Curve Prediction Model in Media Processing System
par: Yin, Shibo, et autres
Publié: (2024)
par: Yin, Shibo, et autres
Publié: (2024)
Modeling the Popularity of Events on Web by Sparsity and Mutual-Excitation Guided Graph Neural Network
par: Deng, Jiaxin, et autres
Publié: (2024)
par: Deng, Jiaxin, et autres
Publié: (2024)
Designing Effective AI Explanations for Misinformation Detection: A Comparative Study of Content, Social, and Combined Explanations
par: Gong, Yeaeun, et autres
Publié: (2025)
par: Gong, Yeaeun, et autres
Publié: (2025)
CDI-DTI: A Strong Cross-domain Interpretable Drug-Target Interaction Prediction Framework Based on Multi-Strategy Fusion
par: Li, Xiangyu, et autres
Publié: (2025)
par: Li, Xiangyu, et autres
Publié: (2025)
The Future is Meta: Metadata, Formats and Perspectives towards Interactive and Personalized AV Content
par: Weller, Alexander, et autres
Publié: (2024)
par: Weller, Alexander, et autres
Publié: (2024)
Fully Automatic Content-Aware Tiling Pipeline for Pathology Whole Slide Images
par: Jabar, Falah, et autres
Publié: (2024)
par: Jabar, Falah, et autres
Publié: (2024)
Multi Agents Semantic Emotion Aligned Music to Image Generation with Music Derived Captions
par: Shi, Junchang, et autres
Publié: (2025)
par: Shi, Junchang, et autres
Publié: (2025)
VSpeechLM: A Visual Speech Language Model for Visual Text-to-Speech Task
par: Wang, Yuyue, et autres
Publié: (2025)
par: Wang, Yuyue, et autres
Publié: (2025)
Task Presentation and Human Perception in Interactive Video Retrieval
par: Willis, Nina, et autres
Publié: (2024)
par: Willis, Nina, et autres
Publié: (2024)
Prototypical Prompting for Text-to-image Person Re-identification
par: Yan, Shuanglin, et autres
Publié: (2024)
par: Yan, Shuanglin, et autres
Publié: (2024)
Learning Complex Heterogeneous Multimodal Fake News via Social Latent Network Inference
par: Li, Mingxin, et autres
Publié: (2025)
par: Li, Mingxin, et autres
Publié: (2025)
Enhancing Cross-Prompt Transferability in Vision-Language Models through Contextual Injection of Target Tokens
par: Yang, Xikang, et autres
Publié: (2024)
par: Yang, Xikang, et autres
Publié: (2024)
AsCL: An Asymmetry-sensitive Contrastive Learning Method for Image-Text Retrieval with Cross-Modal Fusion
par: Gong, Ziyu, et autres
Publié: (2024)
par: Gong, Ziyu, et autres
Publié: (2024)
DetailVerifyBench: A Benchmark for Dense Hallucination Localization in Long Image Captions
par: Wang, Xinran, et autres
Publié: (2026)
par: Wang, Xinran, et autres
Publié: (2026)
A Survey on Multimodal Benchmarks: In the Era of Large AI Models
par: Li, Lin, et autres
Publié: (2024)
par: Li, Lin, et autres
Publié: (2024)
Efficient Geometry Compression and Communication for 3D Gaussian Splatting Point Clouds
par: Xie, Liang, et autres
Publié: (2025)
par: Xie, Liang, et autres
Publié: (2025)
Rethinking Vision Transformer for Large-Scale Fine-Grained Image Retrieval
par: Jiang, Xin, et autres
Publié: (2025)
par: Jiang, Xin, et autres
Publié: (2025)
NeR-SC: Adapting Neural Video Representation to Screen Content
par: Shi, Ruohan, et autres
Publié: (2026)
par: Shi, Ruohan, et autres
Publié: (2026)
Seeing Text in the Dark: Algorithm and Benchmark
par: Xu, Chengpei, et autres
Publié: (2024)
par: Xu, Chengpei, et autres
Publié: (2024)
Learning Contrastive Self-Distillation for Ultra-Fine-Grained Visual Categorization Targeting Limited Samples
par: Fang, Ziye, et autres
Publié: (2023)
par: Fang, Ziye, et autres
Publié: (2023)
Exploring Modality Disruption in Multimodal Fake News Detection
par: Liu, Moyang, et autres
Publié: (2025)
par: Liu, Moyang, et autres
Publié: (2025)
Beyond Forced Modality Balance: Intrinsic Information Budgets for Multimodal Learning
par: Xiong, Zechang, et autres
Publié: (2026)
par: Xiong, Zechang, et autres
Publié: (2026)
Is One-Shot In-Context Learning Helpful for Data Selection in Task-Specific Fine-Tuning of Multimodal LLMs?
par: An, Xiao, et autres
Publié: (2026)
par: An, Xiao, et autres
Publié: (2026)
Modeling Human Responses to Multimodal AI Content
par: Shen, Zhiqi, et autres
Publié: (2025)
par: Shen, Zhiqi, et autres
Publié: (2025)
Deconfounded Reasoning for Multimodal Fake News Detection via Causal Intervention
par: Liu, Moyang, et autres
Publié: (2025)
par: Liu, Moyang, et autres
Publié: (2025)
Efficient and Accurate Image Provenance Analysis: A Scalable Pipeline for Large-scale Images
par: Lai, Jiewei, et autres
Publié: (2025)
par: Lai, Jiewei, et autres
Publié: (2025)
DiffCL: A Diffusion-Based Contrastive Learning Framework with Semantic Alignment for Multimodal Recommendations
par: Song, Qiya, et autres
Publié: (2025)
par: Song, Qiya, et autres
Publié: (2025)
Towards Real-World Stickers Use: A New Dataset for Multi-Tag Sticker Recognition
par: Wang, Bingbing, et autres
Publié: (2024)
par: Wang, Bingbing, et autres
Publié: (2024)
XGC-AVis: Towards Audio-Visual Content Understanding with a Multi-Agent Collaborative System
par: Cao, Yuqin, et autres
Publié: (2025)
par: Cao, Yuqin, et autres
Publié: (2025)
Graph-based Interaction Augmentation Network for Robust Multimodal Sentiment Analysis
par: Zhangfeng, Hu, et autres
Publié: (2025)
par: Zhangfeng, Hu, et autres
Publié: (2025)
Reply with Sticker: New Dataset and Model for Sticker Retrieval
par: Liang, Bin, et autres
Publié: (2024)
par: Liang, Bin, et autres
Publié: (2024)
Documents similaires
-
Multimodal LLM-based Query Paraphrasing for Video Search
par: Wu, Jiaxin, et autres
Publié: (2024) -
Multimodal Interaction Modeling via Self-Supervised Multi-Task Learning for Review Helpfulness Prediction
par: Gong, HongLin, et autres
Publié: (2024) -
Personalized Playback Technology: How Short Video Services Create Excellent User Experience
par: Deng, Weihui, et autres
Publié: (2024) -
A Large-scale Dataset with Behavior, Attributes, and Content of Mobile Short-video Platform
par: Shang, Yu, et autres
Publié: (2025) -
TPIFM: A Task-Aware Model for Evaluating Perceptual Interaction Fluency in Remote AR Collaboration
par: Song, Jiarun, et autres
Publié: (2026)