Multi-Task Domain Adaptation for Language Grounding with 3D Objects
Fuente:
arXiv
Saved in:
| Main Authors: | Sun, Penglei, Song, Yaoxian, Pan, Xinglin, Dong, Peijie, Yang, Xiaofei, Wang, Qiang, Li, Zhixu, Li, Tiefeng, Chu, Xiaowen |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
3D Question Answering for City Scene Understanding
by: Sun, Penglei, et al.
Published: (2024)
by: Sun, Penglei, et al.
Published: (2024)
Learning 6-DoF Fine-grained Grasp Detection Based on Part Affordance Grounding
by: Song, Yaoxian, et al.
Published: (2023)
by: Song, Yaoxian, et al.
Published: (2023)
Towards Coarse-grained Visual Language Navigation Task Planning Enhanced by Event Knowledge Graph
by: Kaichen, Zhao, et al.
Published: (2024)
by: Kaichen, Zhao, et al.
Published: (2024)
City-VLM: Towards Multidomain Perception Scene Understanding via Multimodal Incomplete Learning
by: Sun, Penglei, et al.
Published: (2025)
by: Sun, Penglei, et al.
Published: (2025)
Scene-Driven Multimodal Knowledge Graph Construction for Embodied AI
by: Yaoxian, Song, et al.
Published: (2023)
by: Yaoxian, Song, et al.
Published: (2023)
Pruner-Zero: Evolving Symbolic Pruning Metric from scratch for Large Language Models
by: Dong, Peijie, et al.
Published: (2024)
by: Dong, Peijie, et al.
Published: (2024)
SpatialGrammar: A Domain-Specific Language for LLM-Based 3D Indoor Scene Generation
by: Tang, Song, et al.
Published: (2026)
by: Tang, Song, et al.
Published: (2026)
Should We Really Edit Language Models? On the Evaluation of Edited Language Models
by: Li, Qi, et al.
Published: (2024)
by: Li, Qi, et al.
Published: (2024)
Flickr30K-CFQ: A Compact and Fragmented Query Dataset for Text-image Retrieval
by: Liu, Haoyu, et al.
Published: (2024)
by: Liu, Haoyu, et al.
Published: (2024)
ParZC: Parametric Zero-Cost Proxies for Efficient NAS
by: Dong, Peijie, et al.
Published: (2024)
by: Dong, Peijie, et al.
Published: (2024)
The Multi-Round Diagnostic RAG Framework for Emulating Clinical Reasoning
by: Sun, Penglei, et al.
Published: (2025)
by: Sun, Penglei, et al.
Published: (2025)
Evaluating Semantic Variation in Text-to-Image Synthesis: A Causal Perspective
by: Zhu, Xiangru, et al.
Published: (2024)
by: Zhu, Xiangru, et al.
Published: (2024)
Task Scheduling for Efficient Inference of Large Language Models on Single Moderate GPU Systems
by: Lin, Wenxiang, et al.
Published: (2024)
by: Lin, Wenxiang, et al.
Published: (2024)
Mediator: Memory-efficient LLM Merging with Less Parameter Conflicts and Uncertainty Based Routing
by: Lai, Kunfeng, et al.
Published: (2025)
by: Lai, Kunfeng, et al.
Published: (2025)
Rule-VLN: Bridging Perception and Compliance via Semantic Reasoning and Geometric Rectification
by: Wen, Jiawen, et al.
Published: (2026)
by: Wen, Jiawen, et al.
Published: (2026)
LPZero: Language Model Zero-cost Proxy Search from Zero
by: Dong, Peijie, et al.
Published: (2024)
by: Dong, Peijie, et al.
Published: (2024)
Perovskite-LLM: Knowledge-Enhanced Large Language Models for Perovskite Solar Cell Research
by: Liu, Xiang, et al.
Published: (2025)
by: Liu, Xiang, et al.
Published: (2025)
Parm: Efficient Training of Large Sparsely-Activated Models with Dedicated Schedules
by: Pan, Xinglin, et al.
Published: (2024)
by: Pan, Xinglin, et al.
Published: (2024)
OmniReview: A Large-scale Benchmark and LLM-enhanced Framework for Realistic Reviewer Recommendation
by: Huang, Yehua, et al.
Published: (2026)
by: Huang, Yehua, et al.
Published: (2026)
FinKario: Event-Enhanced Automated Construction of Financial Knowledge Graph
by: Li, Xiang, et al.
Published: (2025)
by: Li, Xiang, et al.
Published: (2025)
LongGenBench: Long-context Generation Benchmark
by: Liu, Xiang, et al.
Published: (2024)
by: Liu, Xiang, et al.
Published: (2024)
Addressing Domain Shift via Imbalance-Aware Domain Adaptation in Embryo Development Assessment
by: Li, Lei, et al.
Published: (2025)
by: Li, Lei, et al.
Published: (2025)
Can Compressed LLMs Truly Act? An Empirical Evaluation of Agentic Capabilities in LLM Compression
by: Dong, Peijie, et al.
Published: (2025)
by: Dong, Peijie, et al.
Published: (2025)
ZipCCL: Efficient Lossless Data Compression of Communication Collectives for Accelerating LLM Training
by: Lin, Wenxiang, et al.
Published: (2026)
by: Lin, Wenxiang, et al.
Published: (2026)
ZipServ: Fast and Memory-Efficient LLM Inference with Hardware-Aware Lossless Compression
by: Fan, Ruibo, et al.
Published: (2026)
by: Fan, Ruibo, et al.
Published: (2026)
BEVUDA++: Geometric-aware Unsupervised Domain Adaptation for Multi-View 3D Object Detection
by: Zhang, Rongyu, et al.
Published: (2025)
by: Zhang, Rongyu, et al.
Published: (2025)
VMRNN: Integrating Vision Mamba and LSTM for Efficient and Accurate Spatiotemporal Forecasting
by: Tang, Yujin, et al.
Published: (2024)
by: Tang, Yujin, et al.
Published: (2024)
RSRWKV: A Linear-Complexity 2D Attention Mechanism for Efficient Remote Sensing Vision Task
by: Li, Chunshan, et al.
Published: (2025)
by: Li, Chunshan, et al.
Published: (2025)
Entropy‐Driven Modulation of Ion Clustering and Polymer Crystallinity for Low‐Temperature Lithium Metal Batteries
by: Junze Guo, et al.
Published: (2025)
by: Junze Guo, et al.
Published: (2025)
Entropy‐Driven Modulation of Ion Clustering and Polymer Crystallinity for Low‐Temperature Lithium Metal Batteries
by: Junze Guo, et al.
Published: (2025)
by: Junze Guo, et al.
Published: (2025)
Position: LLM Inference Should Be Evaluated as Energy-to-Token Production
by: Liu, Xiang, et al.
Published: (2026)
by: Liu, Xiang, et al.
Published: (2026)
Multi-Modal Assistance for Unsupervised Domain Adaptation on Point Cloud 3D Object Detection
by: Zhao, Shenao, et al.
Published: (2025)
by: Zhao, Shenao, et al.
Published: (2025)
SGMAGNet: A Baseline Model for 3D Cloud Phase Structure Reconstruction on a New Passive Active Satellite Benchmark
by: Yang, Chi, et al.
Published: (2025)
by: Yang, Chi, et al.
Published: (2025)
Unified Domain Generalization and Adaptation for Multi-View 3D Object Detection
by: Chang, Gyusam, et al.
Published: (2024)
by: Chang, Gyusam, et al.
Published: (2024)
HierMoE: Accelerating MoE Training with Hierarchical Token Deduplication and Expert Swap
by: Lin, Wenxiang, et al.
Published: (2025)
by: Lin, Wenxiang, et al.
Published: (2025)
From Literature to Lab: Closed-Loop Advancement of Perovskite Solar Cells via Domain Knowledge Guided LLM
by: Sun, Penglei, et al.
Published: (2026)
by: Sun, Penglei, et al.
Published: (2026)
Domain Adaptation from Generated Multi-Weather Images for Unsupervised Maritime Object Classification
by: Song, Dan, et al.
Published: (2025)
by: Song, Dan, et al.
Published: (2025)
Multi-Object 3D Grounding with Dynamic Modules and Language-Informed Spatial Attention
by: Zhang, Haomeng, et al.
Published: (2024)
by: Zhang, Haomeng, et al.
Published: (2024)
The Lottery LLM Hypothesis, Rethinking What Abilities Should LLM Compression Preserve?
by: Tang, Zhenheng, et al.
Published: (2025)
by: Tang, Zhenheng, et al.
Published: (2025)
CLIPoint3D: Language-Grounded Few-Shot Unsupervised 3D Point Cloud Domain Adaptation
by: Singha, Mainak, et al.
Published: (2026)
by: Singha, Mainak, et al.
Published: (2026)
Similar Items
-
3D Question Answering for City Scene Understanding
by: Sun, Penglei, et al.
Published: (2024) -
Learning 6-DoF Fine-grained Grasp Detection Based on Part Affordance Grounding
by: Song, Yaoxian, et al.
Published: (2023) -
Towards Coarse-grained Visual Language Navigation Task Planning Enhanced by Event Knowledge Graph
by: Kaichen, Zhao, et al.
Published: (2024) -
City-VLM: Towards Multidomain Perception Scene Understanding via Multimodal Incomplete Learning
by: Sun, Penglei, et al.
Published: (2025) -
Scene-Driven Multimodal Knowledge Graph Construction for Embodied AI
by: Yaoxian, Song, et al.
Published: (2023)