TOP:A New Target-Audience Oriented Content Paraphrase Task
Fuente:
arXiv
Guardado en:
| Autores principales: | Lin, Boda, Shi, Jiaxin, Yan, Haolong, Tang, Binghao, Gong, Xiaocheng, Li, Si |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Multimodal LLM-based Query Paraphrasing for Video Search
por: Wu, Jiaxin, et al.
Publicado: (2024)
por: Wu, Jiaxin, et al.
Publicado: (2024)
Multimodal Interaction Modeling via Self-Supervised Multi-Task Learning for Review Helpfulness Prediction
por: Gong, HongLin, et al.
Publicado: (2024)
por: Gong, HongLin, et al.
Publicado: (2024)
Personalized Playback Technology: How Short Video Services Create Excellent User Experience
por: Deng, Weihui, et al.
Publicado: (2024)
por: Deng, Weihui, et al.
Publicado: (2024)
A Large-scale Dataset with Behavior, Attributes, and Content of Mobile Short-video Platform
por: Shang, Yu, et al.
Publicado: (2025)
por: Shang, Yu, et al.
Publicado: (2025)
TPIFM: A Task-Aware Model for Evaluating Perceptual Interaction Fluency in Remote AR Collaboration
por: Song, Jiarun, et al.
Publicado: (2026)
por: Song, Jiarun, et al.
Publicado: (2026)
Mining the Social Fabric: Unveiling Communities for Fake News Detection in Short Videos
por: Gong, Haisong, et al.
Publicado: (2025)
por: Gong, Haisong, et al.
Publicado: (2025)
Federated Multi-Task Clustering
por: Dai, Suyan, et al.
Publicado: (2025)
por: Dai, Suyan, et al.
Publicado: (2025)
Think before You Leap: Content-Aware Low-Cost Edge-Assisted Video Semantic Segmentation
por: Yan, Mingxuan, et al.
Publicado: (2024)
por: Yan, Mingxuan, et al.
Publicado: (2024)
MM-InstructEval: Zero-Shot Evaluation of (Multimodal) Large Language Models on Multimodal Reasoning Tasks
por: Yang, Xiaocui, et al.
Publicado: (2024)
por: Yang, Xiaocui, et al.
Publicado: (2024)
Content-Adaptive Rate-Quality Curve Prediction Model in Media Processing System
por: Yin, Shibo, et al.
Publicado: (2024)
por: Yin, Shibo, et al.
Publicado: (2024)
Modeling the Popularity of Events on Web by Sparsity and Mutual-Excitation Guided Graph Neural Network
por: Deng, Jiaxin, et al.
Publicado: (2024)
por: Deng, Jiaxin, et al.
Publicado: (2024)
Designing Effective AI Explanations for Misinformation Detection: A Comparative Study of Content, Social, and Combined Explanations
por: Gong, Yeaeun, et al.
Publicado: (2025)
por: Gong, Yeaeun, et al.
Publicado: (2025)
CDI-DTI: A Strong Cross-domain Interpretable Drug-Target Interaction Prediction Framework Based on Multi-Strategy Fusion
por: Li, Xiangyu, et al.
Publicado: (2025)
por: Li, Xiangyu, et al.
Publicado: (2025)
The Future is Meta: Metadata, Formats and Perspectives towards Interactive and Personalized AV Content
por: Weller, Alexander, et al.
Publicado: (2024)
por: Weller, Alexander, et al.
Publicado: (2024)
Fully Automatic Content-Aware Tiling Pipeline for Pathology Whole Slide Images
por: Jabar, Falah, et al.
Publicado: (2024)
por: Jabar, Falah, et al.
Publicado: (2024)
Multi Agents Semantic Emotion Aligned Music to Image Generation with Music Derived Captions
por: Shi, Junchang, et al.
Publicado: (2025)
por: Shi, Junchang, et al.
Publicado: (2025)
VSpeechLM: A Visual Speech Language Model for Visual Text-to-Speech Task
por: Wang, Yuyue, et al.
Publicado: (2025)
por: Wang, Yuyue, et al.
Publicado: (2025)
Task Presentation and Human Perception in Interactive Video Retrieval
por: Willis, Nina, et al.
Publicado: (2024)
por: Willis, Nina, et al.
Publicado: (2024)
Prototypical Prompting for Text-to-image Person Re-identification
por: Yan, Shuanglin, et al.
Publicado: (2024)
por: Yan, Shuanglin, et al.
Publicado: (2024)
Learning Complex Heterogeneous Multimodal Fake News via Social Latent Network Inference
por: Li, Mingxin, et al.
Publicado: (2025)
por: Li, Mingxin, et al.
Publicado: (2025)
Enhancing Cross-Prompt Transferability in Vision-Language Models through Contextual Injection of Target Tokens
por: Yang, Xikang, et al.
Publicado: (2024)
por: Yang, Xikang, et al.
Publicado: (2024)
AsCL: An Asymmetry-sensitive Contrastive Learning Method for Image-Text Retrieval with Cross-Modal Fusion
por: Gong, Ziyu, et al.
Publicado: (2024)
por: Gong, Ziyu, et al.
Publicado: (2024)
DetailVerifyBench: A Benchmark for Dense Hallucination Localization in Long Image Captions
por: Wang, Xinran, et al.
Publicado: (2026)
por: Wang, Xinran, et al.
Publicado: (2026)
A Survey on Multimodal Benchmarks: In the Era of Large AI Models
por: Li, Lin, et al.
Publicado: (2024)
por: Li, Lin, et al.
Publicado: (2024)
Efficient Geometry Compression and Communication for 3D Gaussian Splatting Point Clouds
por: Xie, Liang, et al.
Publicado: (2025)
por: Xie, Liang, et al.
Publicado: (2025)
Rethinking Vision Transformer for Large-Scale Fine-Grained Image Retrieval
por: Jiang, Xin, et al.
Publicado: (2025)
por: Jiang, Xin, et al.
Publicado: (2025)
NeR-SC: Adapting Neural Video Representation to Screen Content
por: Shi, Ruohan, et al.
Publicado: (2026)
por: Shi, Ruohan, et al.
Publicado: (2026)
Seeing Text in the Dark: Algorithm and Benchmark
por: Xu, Chengpei, et al.
Publicado: (2024)
por: Xu, Chengpei, et al.
Publicado: (2024)
Learning Contrastive Self-Distillation for Ultra-Fine-Grained Visual Categorization Targeting Limited Samples
por: Fang, Ziye, et al.
Publicado: (2023)
por: Fang, Ziye, et al.
Publicado: (2023)
Exploring Modality Disruption in Multimodal Fake News Detection
por: Liu, Moyang, et al.
Publicado: (2025)
por: Liu, Moyang, et al.
Publicado: (2025)
Beyond Forced Modality Balance: Intrinsic Information Budgets for Multimodal Learning
por: Xiong, Zechang, et al.
Publicado: (2026)
por: Xiong, Zechang, et al.
Publicado: (2026)
Is One-Shot In-Context Learning Helpful for Data Selection in Task-Specific Fine-Tuning of Multimodal LLMs?
por: An, Xiao, et al.
Publicado: (2026)
por: An, Xiao, et al.
Publicado: (2026)
Modeling Human Responses to Multimodal AI Content
por: Shen, Zhiqi, et al.
Publicado: (2025)
por: Shen, Zhiqi, et al.
Publicado: (2025)
Deconfounded Reasoning for Multimodal Fake News Detection via Causal Intervention
por: Liu, Moyang, et al.
Publicado: (2025)
por: Liu, Moyang, et al.
Publicado: (2025)
Efficient and Accurate Image Provenance Analysis: A Scalable Pipeline for Large-scale Images
por: Lai, Jiewei, et al.
Publicado: (2025)
por: Lai, Jiewei, et al.
Publicado: (2025)
DiffCL: A Diffusion-Based Contrastive Learning Framework with Semantic Alignment for Multimodal Recommendations
por: Song, Qiya, et al.
Publicado: (2025)
por: Song, Qiya, et al.
Publicado: (2025)
Towards Real-World Stickers Use: A New Dataset for Multi-Tag Sticker Recognition
por: Wang, Bingbing, et al.
Publicado: (2024)
por: Wang, Bingbing, et al.
Publicado: (2024)
XGC-AVis: Towards Audio-Visual Content Understanding with a Multi-Agent Collaborative System
por: Cao, Yuqin, et al.
Publicado: (2025)
por: Cao, Yuqin, et al.
Publicado: (2025)
Graph-based Interaction Augmentation Network for Robust Multimodal Sentiment Analysis
por: Zhangfeng, Hu, et al.
Publicado: (2025)
por: Zhangfeng, Hu, et al.
Publicado: (2025)
Reply with Sticker: New Dataset and Model for Sticker Retrieval
por: Liang, Bin, et al.
Publicado: (2024)
por: Liang, Bin, et al.
Publicado: (2024)
Ejemplares similares
-
Multimodal LLM-based Query Paraphrasing for Video Search
por: Wu, Jiaxin, et al.
Publicado: (2024) -
Multimodal Interaction Modeling via Self-Supervised Multi-Task Learning for Review Helpfulness Prediction
por: Gong, HongLin, et al.
Publicado: (2024) -
Personalized Playback Technology: How Short Video Services Create Excellent User Experience
por: Deng, Weihui, et al.
Publicado: (2024) -
A Large-scale Dataset with Behavior, Attributes, and Content of Mobile Short-video Platform
por: Shang, Yu, et al.
Publicado: (2025) -
TPIFM: A Task-Aware Model for Evaluating Perceptual Interaction Fluency in Remote AR Collaboration
por: Song, Jiarun, et al.
Publicado: (2026)