Guardado en:
| Autores principales: | Shao, Run, Yang, Cheng, Li, Qiujun, Zhu, Qing, Zhang, Yongjun, Li, YanSheng, Liu, Yu, Tang, Yong, Liu, Dapeng, Yang, Shizhong, Li, Haifeng |
|---|---|
| Formato: | Preprint |
| Publicado: |
2023
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2401.00546 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
AllSpark: Reborn Labeled Features from Unlabeled in Transformer for Semi-Supervised Semantic Segmentation
por: Wang, Haonan, et al.
Publicado: (2024)
por: Wang, Haonan, et al.
Publicado: (2024)
LocationAgent: A Hierarchical Agent for Image Geolocation via Decoupling Strategy and Evidence from Parametric Knowledge
por: Li, Qiujun, et al.
Publicado: (2026)
por: Li, Qiujun, et al.
Publicado: (2026)
RS-GPT4V: A Unified Multimodal Instruction-Following Dataset for Remote Sensing Image Understanding
por: Xu, Linrui, et al.
Publicado: (2024)
por: Xu, Linrui, et al.
Publicado: (2024)
Fabrication and Analysis of the Wear Properties of High‐Vanadium High‐Speed Steel through Spark Plasma Sintering
por: Shuaiwu Tong, et al.
Publicado: (2024)
por: Shuaiwu Tong, et al.
Publicado: (2024)
Adaptive Channel Estimation and Hybrid Beamforming for RIS aided Vehicular Communication
por: Li, Tianyou, et al.
Publicado: (2026)
por: Li, Tianyou, et al.
Publicado: (2026)
STA-GANN: A Valid and Generalizable Spatio-Temporal Kriging Approach
por: Li, Yujie, et al.
Publicado: (2025)
por: Li, Yujie, et al.
Publicado: (2025)
PixelRefer: A Unified Framework for Spatio-Temporal Object Referring with Arbitrary Granularity
por: Yuan, Yuqian, et al.
Publicado: (2025)
por: Yuan, Yuqian, et al.
Publicado: (2025)
The Wittgensteinian Representation Hypothesis: Is Language the Attractor of Multimodal Convergence?
por: Zhang, Zhaoyang, et al.
Publicado: (2026)
por: Zhang, Zhaoyang, et al.
Publicado: (2026)
Genesis: Multimodal Driving Scene Generation with Spatio-Temporal and Cross-Modal Consistency
por: Guo, Xiangyu, et al.
Publicado: (2025)
por: Guo, Xiangyu, et al.
Publicado: (2025)
SpaceVLLM: Endowing Multimodal Large Language Model with Spatio-Temporal Video Grounding Capability
por: Wang, Jiankang, et al.
Publicado: (2025)
por: Wang, Jiankang, et al.
Publicado: (2025)
Spatio-Temporal Few-Shot Learning via Diffusive Neural Network Generation
por: Yuan, Yuan, et al.
Publicado: (2024)
por: Yuan, Yuan, et al.
Publicado: (2024)
Value-Decomposed Reinforcement Learning Framework for Taxiway Routing with Hierarchical Conflict-Aware Observations
por: Zhou, Shizhong, et al.
Publicado: (2026)
por: Zhou, Shizhong, et al.
Publicado: (2026)
A Refer-and-Ground Multimodal Large Language Model for Biomedicine
por: Huang, Xiaoshuang, et al.
Publicado: (2024)
por: Huang, Xiaoshuang, et al.
Publicado: (2024)
LiDAR Prompted Spatio-Temporal Multi-View Stereo for Autonomous Driving
por: Sun, Qihao, et al.
Publicado: (2026)
por: Sun, Qihao, et al.
Publicado: (2026)
Unleashing the Potential of Multimodal LLMs for Zero-Shot Spatio-Temporal Video Grounding
por: Yang, Zaiquan, et al.
Publicado: (2025)
por: Yang, Zaiquan, et al.
Publicado: (2025)
Jointly Modeling Spatio-Temporal Features of Tactile Signals for Action Classification
por: Lin, Jimmy, et al.
Publicado: (2024)
por: Lin, Jimmy, et al.
Publicado: (2024)
Crip Spacetime: Access, Failure, and Accountability in Academic Life. By MargaretPrice, Durham: Duke University Press, 2024. 240 pp. $26.95 (paper). ISBN: 978‐1‐47‐803037‐9; $102.95 (hardcover). ISBN: 978‐1‐47‐802613‐6
por: Leyan Zheng, et al.
Publicado: (2025)
por: Leyan Zheng, et al.
Publicado: (2025)
STaR-Attack: A Spatio-Temporal and Narrative Reasoning Attack Framework for Unified Multimodal Understanding and Generation Models
por: Guo, Shaoxiong, et al.
Publicado: (2025)
por: Guo, Shaoxiong, et al.
Publicado: (2025)
Air Quality Prediction with A Meteorology-Guided Modality-Decoupled Spatio-Temporal Network
por: Yin, Hang, et al.
Publicado: (2025)
por: Yin, Hang, et al.
Publicado: (2025)
Transformer RGBT Tracking with Spatio-Temporal Multimodal Tokens
por: Sun, Dengdi, et al.
Publicado: (2024)
por: Sun, Dengdi, et al.
Publicado: (2024)
Robust Multimodal Semantic Segmentation with Balanced Modality Contributions
por: Tan, Jiaqi, et al.
Publicado: (2025)
por: Tan, Jiaqi, et al.
Publicado: (2025)
Multimodal Contrastive Learning via Uni-Modal Coding and Cross-Modal Prediction for Multimodal Sentiment Analysis
por: Lin, Ronghao, et al.
Publicado: (2022)
por: Lin, Ronghao, et al.
Publicado: (2022)
UniFlow: A Foundation Model for Unified Urban Spatio-Temporal Flow Prediction
por: Yuan, Yuan, et al.
Publicado: (2024)
por: Yuan, Yuan, et al.
Publicado: (2024)
GLIDE: Graph-guided Leap Inference for Diffusion Estimation of Spatio-Temporal Point Processes
por: Zhou, Guanyu, et al.
Publicado: (2026)
por: Zhou, Guanyu, et al.
Publicado: (2026)
Mining Multi-Modality Spatio-Temporal Cues for Video Important Person Identification
por: Wang, Xiao, et al.
Publicado: (2026)
por: Wang, Xiao, et al.
Publicado: (2026)
UrbanGPT: Spatio-Temporal Large Language Models
por: Li, Zhonghang, et al.
Publicado: (2024)
por: Li, Zhonghang, et al.
Publicado: (2024)
AsyReC: A Multimodal Graph-based Framework for Spatio-Temporal Asymmetric Dyadic Relationship Classification
por: Tang, Wang, et al.
Publicado: (2025)
por: Tang, Wang, et al.
Publicado: (2025)
TreeMIL: A Multi-instance Learning Framework for Time Series Anomaly Detection with Inexact Supervision
por: Liu, Chen, et al.
Publicado: (2024)
por: Liu, Chen, et al.
Publicado: (2024)
Learnability in Online Kernel Selection with Memory Constraint via Data-dependent Regret Analysis
por: Li, Junfan, et al.
Publicado: (2024)
por: Li, Junfan, et al.
Publicado: (2024)
Improved Kernel Alignment Regret Bound for Online Kernel Learning
por: Li, Junfan, et al.
Publicado: (2022)
por: Li, Junfan, et al.
Publicado: (2022)
Graph Learning-Driven Multi-Vessel Association: Fusing Multimodal Data for Maritime Intelligence
por: Lu, Yuxu, et al.
Publicado: (2025)
por: Lu, Yuxu, et al.
Publicado: (2025)
Interacted Object Grounding in Spatio-Temporal Human-Object Interactions
por: Liu, Xiaoyang, et al.
Publicado: (2024)
por: Liu, Xiaoyang, et al.
Publicado: (2024)
Decoupled Diffusion Sparks Adaptive Scene Generation
por: Zhou, Yunsong, et al.
Publicado: (2025)
por: Zhou, Yunsong, et al.
Publicado: (2025)
DMTrack: Spatio-Temporal Multimodal Tracking via Dual-Adapter
por: Li, Weihong, et al.
Publicado: (2025)
por: Li, Weihong, et al.
Publicado: (2025)
STQuant: Spatio-Temporal Adaptive Framework for Optimizer Quantization in Large Multimodal Model Training
por: Liu, Minglu, et al.
Publicado: (2026)
por: Liu, Minglu, et al.
Publicado: (2026)
Enhancing SNN-based Spatio-Temporal Learning: A Benchmark Dataset and Cross-Modality Attention Model
por: Zhou, Shibo, et al.
Publicado: (2024)
por: Zhou, Shibo, et al.
Publicado: (2024)
Long Context is Not Long at All: A Prospector of Long-Dependency Data for Large Language Models
por: Chen, Longze, et al.
Publicado: (2024)
por: Chen, Longze, et al.
Publicado: (2024)
Modality-Guided Dynamic Graph Fusion and Temporal Diffusion for Self-Supervised RGB-T Tracking
por: Li, Shenglan, et al.
Publicado: (2025)
por: Li, Shenglan, et al.
Publicado: (2025)
Multimodal Classification via Modal-Aware Interactive Enhancement
por: Jiang, Qing-Yuan, et al.
Publicado: (2024)
por: Jiang, Qing-Yuan, et al.
Publicado: (2024)
Seismic analysis based on a new interval method with incomplete information
por: Liang, Shizhong, et al.
Publicado: (2025)
por: Liang, Shizhong, et al.
Publicado: (2025)
Ejemplares similares
-
AllSpark: Reborn Labeled Features from Unlabeled in Transformer for Semi-Supervised Semantic Segmentation
por: Wang, Haonan, et al.
Publicado: (2024) -
LocationAgent: A Hierarchical Agent for Image Geolocation via Decoupling Strategy and Evidence from Parametric Knowledge
por: Li, Qiujun, et al.
Publicado: (2026) -
RS-GPT4V: A Unified Multimodal Instruction-Following Dataset for Remote Sensing Image Understanding
por: Xu, Linrui, et al.
Publicado: (2024) -
Fabrication and Analysis of the Wear Properties of High‐Vanadium High‐Speed Steel through Spark Plasma Sintering
por: Shuaiwu Tong, et al.
Publicado: (2024) -
Adaptive Channel Estimation and Hybrid Beamforming for RIS aided Vehicular Communication
por: Li, Tianyou, et al.
Publicado: (2026)