Guardado en:
| Autores principales: | Wu, Hanbing, Jiang, Ping, Su, Anyang, Zhao, Chenxu, Fu, Tianyu, Wu, Minghui, Tan, Beiping, Li, Huiying |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2507.19213 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Hypergraph Multi-modal Large Language Model: Exploiting EEG and Eye-tracking Modalities to Evaluate Heterogeneous Responses for Video Understanding
por: Wu, Minghui, et al.
Publicado: (2024)
por: Wu, Minghui, et al.
Publicado: (2024)
Reinforced Domain Selection for Continuous Domain Adaptation
por: Liu, Hanbing, et al.
Publicado: (2025)
por: Liu, Hanbing, et al.
Publicado: (2025)
EyeFormer: Predicting Personalized Scanpaths with Transformer-Guided Reinforcement Learning
por: Jiang, Yue, et al.
Publicado: (2024)
por: Jiang, Yue, et al.
Publicado: (2024)
Full‐thickness nasolabial facial artery flap: A modified surgical approach for reconstruction of lower lip defects
por: Jia Kang, et al.
Publicado: (2024)
por: Jia Kang, et al.
Publicado: (2024)
SEF-MAP: Subspace-Decomposed Expert Fusion for Robust Multimodal HD Map Prediction
por: Fu, Haoxiang, et al.
Publicado: (2026)
por: Fu, Haoxiang, et al.
Publicado: (2026)
Boundary-Guided Learning for Gene Expression Prediction in Spatial Transcriptomics
por: Qu, Mingcheng, et al.
Publicado: (2024)
por: Qu, Mingcheng, et al.
Publicado: (2024)
Insight-A: Attribution-aware for Multimodal Misinformation Detection
por: Wu, Junjie, et al.
Publicado: (2025)
por: Wu, Junjie, et al.
Publicado: (2025)
UPA: Unsupervised Prompt Agent via Tree-Based Search and Selection
por: Peng, Siran, et al.
Publicado: (2026)
por: Peng, Siran, et al.
Publicado: (2026)
MAP: Multi-user Personalization with Collaborative LLM-powered Agents
por: Lee, Christine, et al.
Publicado: (2025)
por: Lee, Christine, et al.
Publicado: (2025)
MAP: Low-compute Model Merging with Amortized Pareto Fronts via Quadratic Approximation
por: Li, Lu, et al.
Publicado: (2024)
por: Li, Lu, et al.
Publicado: (2024)
SDGOCC: Semantic and Depth-Guided Bird's-Eye View Transformation for 3D Multimodal Occupancy Prediction
por: Duan, Zaipeng, et al.
Publicado: (2025)
por: Duan, Zaipeng, et al.
Publicado: (2025)
Mano Technical Report
por: Fu, Tianyu, et al.
Publicado: (2025)
por: Fu, Tianyu, et al.
Publicado: (2025)
Provable Multi-Party Reinforcement Learning with Diverse Human Feedback
por: Zhong, Huiying, et al.
Publicado: (2024)
por: Zhong, Huiying, et al.
Publicado: (2024)
Multi-Task Reinforcement Learning for Enhanced Multimodal LLM-as-a-Judge
por: Wu, Junjie, et al.
Publicado: (2026)
por: Wu, Junjie, et al.
Publicado: (2026)
Trajectory Entropy Reinforcement Learning for Predictable and Robust Control
por: You, Bang, et al.
Publicado: (2025)
por: You, Bang, et al.
Publicado: (2025)
ReMAP-DP: Reprojected Multi-view Aligned PointMaps for Diffusion Policy
por: Yang, Xinzhang, et al.
Publicado: (2026)
por: Yang, Xinzhang, et al.
Publicado: (2026)
E2E Learning Massive MIMO for Multimodal Semantic Non-Orthogonal Transmission and Fusion
por: Wu, Minghui, et al.
Publicado: (2025)
por: Wu, Minghui, et al.
Publicado: (2025)
DeepRAHT: Learning Predictive RAHT for Point Cloud Attribute Compression
por: Fu, Chunyang, et al.
Publicado: (2026)
por: Fu, Chunyang, et al.
Publicado: (2026)
Two-Point Resolution in Spectral Super-Resolution
por: He, Xiaole, et al.
Publicado: (2026)
por: He, Xiaole, et al.
Publicado: (2026)
Point Cloud Quantization through Multimodal Prompting for 3D Understanding
por: Li, Hongxuan, et al.
Publicado: (2025)
por: Li, Hongxuan, et al.
Publicado: (2025)
Deep Reinforcement Learning with Task-Adaptive Retrieval via Hypernetwork
por: Jin, Yonggang, et al.
Publicado: (2023)
por: Jin, Yonggang, et al.
Publicado: (2023)
WorldMAP: Bootstrapping Vision-Language Navigation Trajectory Prediction with Generative World Models
por: Chen, Hongjin, et al.
Publicado: (2026)
por: Chen, Hongjin, et al.
Publicado: (2026)
Efficient MAP Estimation of LLM Judgment Performance with Prior Transfer
por: Qu, Huaizhi, et al.
Publicado: (2025)
por: Qu, Huaizhi, et al.
Publicado: (2025)
CollabVLA: Self-Reflective Vision-Language-Action Model Dreaming Together with Human
por: Sun, Nan, et al.
Publicado: (2025)
por: Sun, Nan, et al.
Publicado: (2025)
Online Self-Calibration Against Hallucination in Vision-Language Models
por: Chen, Minghui, et al.
Publicado: (2026)
por: Chen, Minghui, et al.
Publicado: (2026)
Construction of Healthy Liver of Largemouth Bass (Micropterus salmoides) in the Short Term by Steroidal Saponins before Heat Season Comes
por: Tao Cheng, et al.
Publicado: (2024)
por: Tao Cheng, et al.
Publicado: (2024)
Tea Saponin Exerts Dose-Dependent Dual Effects on Growth and Hepatic Health in Hybrid Grouper ( ♀ × ♂) Fed a High-Lipid, Low-Protein Diet via Redox-Immune Regulation.
por: Guo, Shengrong, et al.
Publicado: (2026)
por: Guo, Shengrong, et al.
Publicado: (2026)
EagleVision: Object-level Attribute Multimodal LLM for Remote Sensing
por: Jiang, Hongxiang, et al.
Publicado: (2025)
por: Jiang, Hongxiang, et al.
Publicado: (2025)
SDG-L: A Semiparametric Deep Gaussian Process based Framework for Battery Capacity Prediction
por: Liu, Hanbing, et al.
Publicado: (2025)
por: Liu, Hanbing, et al.
Publicado: (2025)
NSF-MAP: Neurosymbolic Multimodal Fusion for Robust and Interpretable Anomaly Prediction in Assembly Pipelines
por: Shyalika, Chathurangi, et al.
Publicado: (2025)
por: Shyalika, Chathurangi, et al.
Publicado: (2025)
S2AM3D: Scale-controllable Part Segmentation of 3D Point Clouds
por: Su, Han, et al.
Publicado: (2025)
por: Su, Han, et al.
Publicado: (2025)
Unreal-MAP: Unreal-Engine-Based General Platform for Multi-Agent Reinforcement Learning
por: Hu, Tianyi, et al.
Publicado: (2025)
por: Hu, Tianyi, et al.
Publicado: (2025)
FingerEye: Continuous and Unified Vision-Tactile Sensing for Dexterous Manipulation
por: Xu, Zhixuan, et al.
Publicado: (2026)
por: Xu, Zhixuan, et al.
Publicado: (2026)
Universal Legal Article Prediction via Tight Collaboration between Supervised Classification Model and LLM
por: Chi, Xiao, et al.
Publicado: (2025)
por: Chi, Xiao, et al.
Publicado: (2025)
MME-RealWorld: Could Your Multimodal LLM Challenge High-Resolution Real-World Scenarios that are Difficult for Humans?
por: Zhang, Yi-Fan, et al.
Publicado: (2024)
por: Zhang, Yi-Fan, et al.
Publicado: (2024)
Res-Bench: Benchmarking the Robustness of Multimodal Large Language Models to Dynamic Resolution Input
por: Li, Chenxu, et al.
Publicado: (2025)
por: Li, Chenxu, et al.
Publicado: (2025)
RAG or Learning? Understanding the Limits of LLM Adaptation under Continuous Knowledge Drift in the Real World
por: Liu, Hanbing, et al.
Publicado: (2026)
por: Liu, Hanbing, et al.
Publicado: (2026)
From Personal to Collective: On the Role of Local and Global Memory in LLM Personalization
por: Wang, Zehong, et al.
Publicado: (2025)
por: Wang, Zehong, et al.
Publicado: (2025)
Look & Mark: Leveraging Radiologist Eye Fixations and Bounding boxes in Multimodal Large Language Models for Chest X-ray Report Generation
por: Kim, Yunsoo, et al.
Publicado: (2025)
por: Kim, Yunsoo, et al.
Publicado: (2025)
ConMeC: A Dataset for Metonymy Resolution with Common Nouns
por: Ghosh, Saptarshi, et al.
Publicado: (2025)
por: Ghosh, Saptarshi, et al.
Publicado: (2025)
Ejemplares similares
-
Hypergraph Multi-modal Large Language Model: Exploiting EEG and Eye-tracking Modalities to Evaluate Heterogeneous Responses for Video Understanding
por: Wu, Minghui, et al.
Publicado: (2024) -
Reinforced Domain Selection for Continuous Domain Adaptation
por: Liu, Hanbing, et al.
Publicado: (2025) -
EyeFormer: Predicting Personalized Scanpaths with Transformer-Guided Reinforcement Learning
por: Jiang, Yue, et al.
Publicado: (2024) -
Full‐thickness nasolabial facial artery flap: A modified surgical approach for reconstruction of lower lip defects
por: Jia Kang, et al.
Publicado: (2024) -
SEF-MAP: Subspace-Decomposed Expert Fusion for Robust Multimodal HD Map Prediction
por: Fu, Haoxiang, et al.
Publicado: (2026)