COOPER: A Unified Model for Cooperative Perception and Reasoning in Spatial Intelligence
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhang, Zefeng, Hao, Xiangzhao, Tang, Hengzhu, Zhang, Zhenyu, Sheng, Jiawei, Li, Xiaodong, Li, Zhenyang, Gao, Li, Shi, Daiting, Yin, Dawei, Liu, Tingwen |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Debiasing Multimodal Large Language Models via Noise-Aware Preference Optimization
por: Zhang, Zefeng, et al.
Publicado: (2025)
por: Zhang, Zefeng, et al.
Publicado: (2025)
Exploring Preference-Guided Diffusion Model for Cross-Domain Recommendation
por: Li, Xiaodong, et al.
Publicado: (2025)
por: Li, Xiaodong, et al.
Publicado: (2025)
Multi-Branch Collaborative Learning Network for Video Quality Assessment in Industrial Video Search
por: Tang, Hengzhu, et al.
Publicado: (2025)
por: Tang, Hengzhu, et al.
Publicado: (2025)
S2CDR: Smoothing-Sharpening Process Model for Cross-Domain Recommendation
por: Li, Xiaodong, et al.
Publicado: (2026)
por: Li, Xiaodong, et al.
Publicado: (2026)
CLEAR: Unlocking Generative Potential for Degraded Image Understanding in Unified Multimodal Models
por: Hao, Xiangzhao, et al.
Publicado: (2026)
por: Hao, Xiangzhao, et al.
Publicado: (2026)
CDRNP: Cross-Domain Recommendation to Cold-Start Users via Neural Process
por: Li, Xiaodong, et al.
Publicado: (2024)
por: Li, Xiaodong, et al.
Publicado: (2024)
Exploring the System 1 Thinking Capability of Large Reasoning Models
por: Zhang, Wenyuan, et al.
Publicado: (2025)
por: Zhang, Wenyuan, et al.
Publicado: (2025)
RAG-Enhanced Large Language Models for Dynamic Content Expiration Prediction in Web Search
por: Chen, Tingyu, et al.
Publicado: (2026)
por: Chen, Tingyu, et al.
Publicado: (2026)
LoginMEA: Local-to-Global Interaction Network for Multi-modal Entity Alignment
por: Su, Taoyu, et al.
Publicado: (2024)
por: Su, Taoyu, et al.
Publicado: (2024)
Revealing and Mitigating the Challenge of Detecting Character Knowledge Errors in LLM Role-Playing
por: Zhang, Wenyuan, et al.
Publicado: (2024)
por: Zhang, Wenyuan, et al.
Publicado: (2024)
Optimal Transport Guided Correlation Assignment for Multimodal Entity Linking
por: Zhang, Zefeng, et al.
Publicado: (2024)
por: Zhang, Zefeng, et al.
Publicado: (2024)
Improving Reasoning Capabilities in Small Models through Mixture-of-Layers Distillation with Stepwise Attention on Key Information
por: Chen, Yao, et al.
Publicado: (2026)
por: Chen, Yao, et al.
Publicado: (2026)
Leveraging Generative Models for Real-Time Query-Driven Text Summarization in Large-Scale Web Search
por: Xiong, Zeyu, et al.
Publicado: (2025)
por: Xiong, Zeyu, et al.
Publicado: (2025)
Hyperbolic-PDE GNN: Spectral Graph Neural Networks in the Perspective of A System of Hyperbolic Partial Differential Equations
por: Yue, Juwei, et al.
Publicado: (2025)
por: Yue, Juwei, et al.
Publicado: (2025)
Task-Oriented Communication for Vehicle-to-Infrastructure Cooperative Perception
por: Shao, Jiawei, et al.
Publicado: (2024)
por: Shao, Jiawei, et al.
Publicado: (2024)
Safety Alignment Should Be Made More Than Just A Few Attention Heads
por: Huang, Chao, et al.
Publicado: (2025)
por: Huang, Chao, et al.
Publicado: (2025)
Semantic Communication for Cooperative Perception using HARQ
por: Sheng, Yucheng, et al.
Publicado: (2024)
por: Sheng, Yucheng, et al.
Publicado: (2024)
Large Language Model-Powered Query-Driven Event Timeline Summarization in Industrial Search
por: Wang, Mingyue, et al.
Publicado: (2026)
por: Wang, Mingyue, et al.
Publicado: (2026)
Agentic-R: Learning to Retrieve for Agentic Search
por: Liu, Wenhan, et al.
Publicado: (2026)
por: Liu, Wenhan, et al.
Publicado: (2026)
Mitigating Modality Bias in Multi-modal Entity Alignment from a Causal Perspective
por: Su, Taoyu, et al.
Publicado: (2025)
por: Su, Taoyu, et al.
Publicado: (2025)
Utility-Focused LLM Annotation for Retrieval and Retrieval-Augmented Generation
por: Zhang, Hengran, et al.
Publicado: (2025)
por: Zhang, Hengran, et al.
Publicado: (2025)
I2TTS: Image-indicated Immersive Text-to-speech Synthesis with Spatial Perception
por: Zhang, Jiawei, et al.
Publicado: (2024)
por: Zhang, Jiawei, et al.
Publicado: (2024)
Variational Robust Kalman Filters: A Unified Framework
por: Li, Shilei, et al.
Publicado: (2025)
por: Li, Shilei, et al.
Publicado: (2025)
Personalized Multi-Interest Modeling for Cross-Domain Recommendation to Cold-Start Users
por: Li, Xiaodong, et al.
Publicado: (2026)
por: Li, Xiaodong, et al.
Publicado: (2026)
A Spatial Calibration Method for Robust Cooperative Perception
por: Song, Zhiying, et al.
Publicado: (2023)
por: Song, Zhiying, et al.
Publicado: (2023)
SpatialReasoner: Active Perception for Large-Scale 3D Scene Understanding
por: Zheng, Hongpei, et al.
Publicado: (2025)
por: Zheng, Hongpei, et al.
Publicado: (2025)
The Effect of Visual Perspective on Consumer Viewing and Purchase Intention in Live Streaming
por: Xiaoli Tang, et al.
Publicado: (2025)
por: Xiaoli Tang, et al.
Publicado: (2025)
The Effect of Celebrity Co‐Streamer Type on Consumer Behaviors in Live‐Streaming
por: Xiaoli Tang, et al.
Publicado: (2025)
por: Xiaoli Tang, et al.
Publicado: (2025)
Reconstructing Content via Collaborative Attention to Improve Multimodal Embedding Quality
por: Chen, Jiahan, et al.
Publicado: (2026)
por: Chen, Jiahan, et al.
Publicado: (2026)
MoRL: Reinforced Reasoning for Unified Motion Understanding and Generation
por: Wang, Hongpeng, et al.
Publicado: (2026)
por: Wang, Hongpeng, et al.
Publicado: (2026)
SOTOPIA-$Ω$: Dynamic Strategy Injection Learning and Social Instruction Following Evaluation for Social Agents
por: Zhang, Wenyuan, et al.
Publicado: (2025)
por: Zhang, Wenyuan, et al.
Publicado: (2025)
MathReal: We Keep It Real! A Real Scene Benchmark for Evaluating Math Reasoning in Multimodal Large Language Models
por: Feng, Jun, et al.
Publicado: (2025)
por: Feng, Jun, et al.
Publicado: (2025)
Text-Video Retrieval via Variational Multi-Modal Hypergraph Networks
por: Li, Qian, et al.
Publicado: (2024)
por: Li, Qian, et al.
Publicado: (2024)
UDora: A Unified Red Teaming Framework against LLM Agents by Dynamically Hijacking Their Own Reasoning
por: Zhang, Jiawei, et al.
Publicado: (2025)
por: Zhang, Jiawei, et al.
Publicado: (2025)
GenCRF: Generative Clustering and Reformulation Framework for Enhanced Intent-Driven Information Retrieval
por: Seo, Wonduk, et al.
Publicado: (2024)
por: Seo, Wonduk, et al.
Publicado: (2024)
Unleashing the Power of LLMs in Dense Retrieval with Query Likelihood Modeling
por: Zhang, Hengran, et al.
Publicado: (2025)
por: Zhang, Hengran, et al.
Publicado: (2025)
Powerful and Flexible: Personalized Text-to-Image Generation via Reinforcement Learning
por: Wei, Fanyue, et al.
Publicado: (2024)
por: Wei, Fanyue, et al.
Publicado: (2024)
A Semantic Consistency‐Based Construction Method for Low‐Interaction Intelligent Honeypots
por: Hao Wu, et al.
Publicado: (2026)
por: Hao Wu, et al.
Publicado: (2026)
Enhancing Multimodal Entity and Relation Extraction with Variational Information Bottleneck
por: Cui, Shiyao, et al.
Publicado: (2023)
por: Cui, Shiyao, et al.
Publicado: (2023)
MIRAGE: A Multi-modal Benchmark for Spatial Perception, Reasoning, and Intelligence
por: Liu, Chonghan, et al.
Publicado: (2025)
por: Liu, Chonghan, et al.
Publicado: (2025)
Ejemplares similares
-
Debiasing Multimodal Large Language Models via Noise-Aware Preference Optimization
por: Zhang, Zefeng, et al.
Publicado: (2025) -
Exploring Preference-Guided Diffusion Model for Cross-Domain Recommendation
por: Li, Xiaodong, et al.
Publicado: (2025) -
Multi-Branch Collaborative Learning Network for Video Quality Assessment in Industrial Video Search
por: Tang, Hengzhu, et al.
Publicado: (2025) -
S2CDR: Smoothing-Sharpening Process Model for Cross-Domain Recommendation
por: Li, Xiaodong, et al.
Publicado: (2026) -
CLEAR: Unlocking Generative Potential for Degraded Image Understanding in Unified Multimodal Models
por: Hao, Xiangzhao, et al.
Publicado: (2026)