Cognitive-Inspired Hierarchical Attention Fusion With Visual and Textual for Cross-Domain Sequential Recommendation
Fuente:
arXiv
Guardado en:
| Autores principales: | Wu, Wangyu, Chen, Zhenhong, Song, Siqi, Qiu, Xianglin, Huang, Xiaowei, Ma, Fei, Xiao, Jimin |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Image Fusion for Cross-Domain Sequential Recommendation
por: Wu, Wangyu, et al.
Publicado: (2024)
por: Wu, Wangyu, et al.
Publicado: (2024)
LLM-Enhanced Multimodal Fusion for Cross-Domain Sequential Recommendation
por: Wu, Wangyu, et al.
Publicado: (2025)
por: Wu, Wangyu, et al.
Publicado: (2025)
Tag-Enriched Multi-Attention with Large Language Models for Cross-Domain Sequential Recommendation
por: Wu, Wangyu, et al.
Publicado: (2025)
por: Wu, Wangyu, et al.
Publicado: (2025)
Image Augmentation Agent for Weakly Supervised Semantic Segmentation
por: Wu, Wangyu, et al.
Publicado: (2024)
por: Wu, Wangyu, et al.
Publicado: (2024)
Prompt Categories Cluster for Weakly Supervised Semantic Segmentation
por: Wu, Wangyu, et al.
Publicado: (2024)
por: Wu, Wangyu, et al.
Publicado: (2024)
Contrastive Prompt Clustering for Weakly Supervised Semantic Segmentation
por: Wu, Wangyu, et al.
Publicado: (2025)
por: Wu, Wangyu, et al.
Publicado: (2025)
SynthSeg-Agents: Multi-Agent Synthetic Data Generation for Zero-Shot Weakly Supervised Semantic Segmentation
por: Wu, Wangyu, et al.
Publicado: (2025)
por: Wu, Wangyu, et al.
Publicado: (2025)
Adaptive Patch Contrast for Weakly Supervised Semantic Segmentation
por: Wu, Wangyu, et al.
Publicado: (2024)
por: Wu, Wangyu, et al.
Publicado: (2024)
Image Augmentation with Controlled Diffusion for Weakly-Supervised Semantic Segmentation
por: Wu, Wangyu, et al.
Publicado: (2023)
por: Wu, Wangyu, et al.
Publicado: (2023)
Hierarchical Modeling for Medical Visual Question Answering with Cross-Attention Fusion
por: Zhang, Junkai, et al.
Publicado: (2025)
por: Zhang, Junkai, et al.
Publicado: (2025)
Textual and Visual Guided Task Adaptation for Source-Free Cross-Domain Few-Shot Segmentation
por: Liu, Jianming, et al.
Publicado: (2025)
por: Liu, Jianming, et al.
Publicado: (2025)
Context Patch Fusion With Class Token Enhancement for Weakly Supervised Semantic Segmentation
por: Fu, Yiyang, et al.
Publicado: (2026)
por: Fu, Yiyang, et al.
Publicado: (2026)
FGML-DG: Feynman-Inspired Cognitive Science Paradigm for Cross-Domain Medical Image Segmentation
por: Song, Yucheng, et al.
Publicado: (2026)
por: Song, Yucheng, et al.
Publicado: (2026)
Feature Fusion Transferability Aware Transformer for Unsupervised Domain Adaptation
por: Yu, Xiaowei, et al.
Publicado: (2024)
por: Yu, Xiaowei, et al.
Publicado: (2024)
CrossFuse: A Novel Cross Attention Mechanism based Infrared and Visible Image Fusion Approach
por: Li, Hui, et al.
Publicado: (2024)
por: Li, Hui, et al.
Publicado: (2024)
Learning Positional Attention for Sequential Recommendation
por: Luo, Fan, et al.
Publicado: (2024)
por: Luo, Fan, et al.
Publicado: (2024)
Textual and Visual Prompt Fusion for Image Editing via Step-Wise Alignment
por: Feng, Zhanbo, et al.
Publicado: (2023)
por: Feng, Zhanbo, et al.
Publicado: (2023)
Towards Visuospatial Cognition via Hierarchical Fusion of Visual Experts
por: Feng, Qi
Publicado: (2025)
por: Feng, Qi
Publicado: (2025)
TextFusion: Unveiling the Power of Textual Semantics for Controllable Image Fusion
por: Cheng, Chunyang, et al.
Publicado: (2023)
por: Cheng, Chunyang, et al.
Publicado: (2023)
TrajFusionNet: Pedestrian Crossing Intention Prediction via Fusion of Sequential and Visual Trajectory Representations
por: Landry, François G., et al.
Publicado: (2025)
por: Landry, François G., et al.
Publicado: (2025)
Hierarchical Cross-Attention Network for Virtual Try-On
por: Tang, Hao, et al.
Publicado: (2024)
por: Tang, Hao, et al.
Publicado: (2024)
Inconsistency-Aware Cross-Attention for Audio-Visual Fusion in Dimensional Emotion Recognition
por: Rajasekhar, G, et al.
Publicado: (2024)
por: Rajasekhar, G, et al.
Publicado: (2024)
VIFO: Visual Feature Empowered Multivariate Time Series Forecasting with Cross-Modal Fusion
por: Wang, Yanlong, et al.
Publicado: (2025)
por: Wang, Yanlong, et al.
Publicado: (2025)
VISTA: A Visual and Textual Attention Dataset for Interpreting Multimodal Models
por: Harshit, et al.
Publicado: (2024)
por: Harshit, et al.
Publicado: (2024)
Focus-to-Perceive Representation Learning: A Cognition-Inspired Hierarchical Framework for Endoscopic Video Analysis
por: Zhang, Yuan, et al.
Publicado: (2026)
por: Zhang, Yuan, et al.
Publicado: (2026)
Self-Supervised Visual Prompting for Cross-Domain Road Damage Detection
por: Xiao, Xi, et al.
Publicado: (2025)
por: Xiao, Xi, et al.
Publicado: (2025)
Cross-Attention Fusion of Visual and Geometric Features for Large Vocabulary Arabic Lipreading
por: Daou, Samar, et al.
Publicado: (2024)
por: Daou, Samar, et al.
Publicado: (2024)
Cross Attentional Audio-Visual Fusion for Dimensional Emotion Recognition
por: Praveen, R. Gnana, et al.
Publicado: (2021)
por: Praveen, R. Gnana, et al.
Publicado: (2021)
Task-Generalized Adaptive Cross-Domain Learning for Multimodal Image Fusion
por: Wang, Mengyu, et al.
Publicado: (2025)
por: Wang, Mengyu, et al.
Publicado: (2025)
Temporal Attention for Cross-View Sequential Image Localization
por: Yuan, Dong, et al.
Publicado: (2024)
por: Yuan, Dong, et al.
Publicado: (2024)
Butter: Frequency Consistency and Hierarchical Fusion for Autonomous Driving Object Detection
por: Lin, Xiaojian, et al.
Publicado: (2025)
por: Lin, Xiaojian, et al.
Publicado: (2025)
Few-Shot Medical Image Segmentation with Large Kernel Attention
por: Wu, Xiaoxiao, et al.
Publicado: (2024)
por: Wu, Xiaoxiao, et al.
Publicado: (2024)
Audio-Visual Person Verification based on Recursive Fusion of Joint Cross-Attention
por: Praveen, R. Gnana, et al.
Publicado: (2024)
por: Praveen, R. Gnana, et al.
Publicado: (2024)
Zero-Shot Image Moderation in Google Ads with LLM-Assisted Textual Descriptions and Cross-modal Co-embeddings
por: Luo, Enming, et al.
Publicado: (2024)
por: Luo, Enming, et al.
Publicado: (2024)
Hierarchical and Step-Layer-Wise Tuning of Attention Specialty for Multi-Instance Synthesis in Diffusion Transformers
por: Zhang, Chunyang, et al.
Publicado: (2025)
por: Zhang, Chunyang, et al.
Publicado: (2025)
Cross-Hierarchical Bidirectional Consistency Learning for Fine-Grained Visual Classification
por: Gao, Pengxiang, et al.
Publicado: (2025)
por: Gao, Pengxiang, et al.
Publicado: (2025)
VAEER: Visual Attention-Inspired Emotion Elicitation Reasoning
por: Man, Fanhang, et al.
Publicado: (2025)
por: Man, Fanhang, et al.
Publicado: (2025)
MealRec: Multi-granularity Sequential Modeling via Hierarchical Diffusion Models for Micro-Video Recommendation
por: Dong, Xinxin, et al.
Publicado: (2026)
por: Dong, Xinxin, et al.
Publicado: (2026)
Beyond Images: Adaptive Fusion of Visual and Textual Data for Food Classification
por: Mittal, Prateek, et al.
Publicado: (2023)
por: Mittal, Prateek, et al.
Publicado: (2023)
SeCG: Semantic-Enhanced 3D Visual Grounding via Cross-modal Graph Attention
por: Xiao, Feng, et al.
Publicado: (2024)
por: Xiao, Feng, et al.
Publicado: (2024)
Ejemplares similares
-
Image Fusion for Cross-Domain Sequential Recommendation
por: Wu, Wangyu, et al.
Publicado: (2024) -
LLM-Enhanced Multimodal Fusion for Cross-Domain Sequential Recommendation
por: Wu, Wangyu, et al.
Publicado: (2025) -
Tag-Enriched Multi-Attention with Large Language Models for Cross-Domain Sequential Recommendation
por: Wu, Wangyu, et al.
Publicado: (2025) -
Image Augmentation Agent for Weakly Supervised Semantic Segmentation
por: Wu, Wangyu, et al.
Publicado: (2024) -
Prompt Categories Cluster for Weakly Supervised Semantic Segmentation
por: Wu, Wangyu, et al.
Publicado: (2024)