LLM-PCGC: Large Language Model-based Point Cloud Geometry Compression
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ye, Yuqi, Gao, Wei |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
LINR-PCGC: Lossless Implicit Neural Representations for Point Cloud Geometry Compression
par: Huang, Wenjie, et autres
Publié: (2025)
par: Huang, Wenjie, et autres
Publié: (2025)
UniPCGC: Towards Practical Point Cloud Geometry Compression via an Efficient Unified Approach
par: Wang, Kangli, et autres
Publié: (2025)
par: Wang, Kangli, et autres
Publié: (2025)
PointLLM: Empowering Large Language Models to Understand Point Clouds
par: Xu, Runsen, et autres
Publié: (2023)
par: Xu, Runsen, et autres
Publié: (2023)
Uni3D-LLM: Unifying Point Cloud Perception, Generation and Editing with Large Language Models
par: Liu, Dingning, et autres
Publié: (2024)
par: Liu, Dingning, et autres
Publié: (2024)
Voxel-based Point Cloud Geometry Compression with Space-to-Channel Context
par: Liu, Bojun, et autres
Publié: (2025)
par: Liu, Bojun, et autres
Publié: (2025)
LVLM-Compress-Bench: Benchmarking the Broader Impact of Large Vision-Language Model Compression
par: Kundu, Souvik, et autres
Publié: (2025)
par: Kundu, Souvik, et autres
Publié: (2025)
HybridINR-PCGC: Hybrid Lossless Point Cloud Geometry Compression Bridging Pretrained Model and Implicit Neural Representation
par: Huang, Wenjie, et autres
Publié: (2026)
par: Huang, Wenjie, et autres
Publié: (2026)
Hybrid-Level Instruction Injection for Video Token Compression in Multi-modal Large Language Models
par: Liu, Zhihang, et autres
Publié: (2025)
par: Liu, Zhihang, et autres
Publié: (2025)
High Efficiency Image Compression for Large Visual-Language Models
par: Li, Binzhe, et autres
Publié: (2024)
par: Li, Binzhe, et autres
Publié: (2024)
GROUNDHOG: Grounding Large Language Models to Holistic Segmentation
par: Zhang, Yichi, et autres
Publié: (2024)
par: Zhang, Yichi, et autres
Publié: (2024)
FaceLLM: A Multimodal Large Language Model for Face Understanding
par: Shahreza, Hatef Otroshi, et autres
Publié: (2025)
par: Shahreza, Hatef Otroshi, et autres
Publié: (2025)
Vision Token Reduction via Attention-Driven Self-Compression for Efficient Multimodal Large Language Models
par: Deniz, Omer Faruk, et autres
Publié: (2026)
par: Deniz, Omer Faruk, et autres
Publié: (2026)
Mitigating Multilingual Hallucination in Large Vision-Language Models
par: Qu, Xiaoye, et autres
Publié: (2024)
par: Qu, Xiaoye, et autres
Publié: (2024)
LLM-Optic: Unveiling the Capabilities of Large Language Models for Universal Visual Grounding
par: Zhao, Haoyu, et autres
Publié: (2024)
par: Zhao, Haoyu, et autres
Publié: (2024)
Causal-SAM-LLM: Large Language Models as Causal Reasoners for Robust Medical Segmentation
par: Tang, Tao, et autres
Publié: (2025)
par: Tang, Tao, et autres
Publié: (2025)
Alleviating Hallucination in Large Vision-Language Models with Active Retrieval Augmentation
par: Qu, Xiaoye, et autres
Publié: (2024)
par: Qu, Xiaoye, et autres
Publié: (2024)
UniCode: Learning a Unified Codebook for Multimodal Large Language Models
par: Zheng, Sipeng, et autres
Publié: (2024)
par: Zheng, Sipeng, et autres
Publié: (2024)
MiniGPT-3D: Efficiently Aligning 3D Point Clouds with Large Language Models using 2D Priors
par: Tang, Yuan, et autres
Publié: (2024)
par: Tang, Yuan, et autres
Publié: (2024)
StreetviewLLM: Extracting Geographic Information Using a Chain-of-Thought Multimodal Large Language Model
par: Li, Zongrong, et autres
Publié: (2024)
par: Li, Zongrong, et autres
Publié: (2024)
GeoMotionGPT: Geometry-Aligned Motion Understanding with Large Language Models
par: Ye, Zhankai, et autres
Publié: (2026)
par: Ye, Zhankai, et autres
Publié: (2026)
MLLMReID: Multimodal Large Language Model-based Person Re-identification
par: Yang, Shan, et autres
Publié: (2024)
par: Yang, Shan, et autres
Publié: (2024)
The Point, the Vision and the Text: Does Point Cloud Boost Spatial Reasoning of Large Language Models? A Bias-Controlled Study
par: Zhang, Weichen, et autres
Publié: (2025)
par: Zhang, Weichen, et autres
Publié: (2025)
Image-of-Thought Prompting for Visual Reasoning Refinement in Multimodal Large Language Models
par: Zhou, Qiji, et autres
Publié: (2024)
par: Zhou, Qiji, et autres
Publié: (2024)
PhyGrasp: Generalizing Robotic Grasping with Physics-informed Large Multimodal Models
par: Guo, Dingkun, et autres
Publié: (2024)
par: Guo, Dingkun, et autres
Publié: (2024)
HSSBench: Benchmarking Humanities and Social Sciences Ability for Multimodal Large Language Models
par: Kang, Zhaolu, et autres
Publié: (2025)
par: Kang, Zhaolu, et autres
Publié: (2025)
Delve into Visual Contrastive Decoding for Hallucination Mitigation of Large Vision-Language Models
par: Lee, Yi-Lun, et autres
Publié: (2024)
par: Lee, Yi-Lun, et autres
Publié: (2024)
VTCBench: Can Vision-Language Models Understand Long Context with Vision-Text Compression?
par: Zhao, Hongbo, et autres
Publié: (2025)
par: Zhao, Hongbo, et autres
Publié: (2025)
LatentLLM: Attention-Aware Joint Tensor Compression
par: Koike-Akino, Toshiaki, et autres
Publié: (2025)
par: Koike-Akino, Toshiaki, et autres
Publié: (2025)
Text as Images: Can Multimodal Large Language Models Follow Printed Instructions in Pixels?
par: Li, Xiujun, et autres
Publié: (2023)
par: Li, Xiujun, et autres
Publié: (2023)
Model Composition for Multimodal Large Language Models
par: Chen, Chi, et autres
Publié: (2024)
par: Chen, Chi, et autres
Publié: (2024)
BLINK: Multimodal Large Language Models Can See but Not Perceive
par: Fu, Xingyu, et autres
Publié: (2024)
par: Fu, Xingyu, et autres
Publié: (2024)
Correctable Landmark Discovery via Large Models for Vision-Language Navigation
par: Lin, Bingqian, et autres
Publié: (2024)
par: Lin, Bingqian, et autres
Publié: (2024)
Why Vision Language Models Struggle with Visual Arithmetic? Towards Enhanced Chart and Geometry Understanding
par: Huang, Kung-Hsiang, et autres
Publié: (2025)
par: Huang, Kung-Hsiang, et autres
Publié: (2025)
RestoreAgent: Autonomous Image Restoration Agent via Multimodal Large Language Models
par: Chen, Haoyu, et autres
Publié: (2024)
par: Chen, Haoyu, et autres
Publié: (2024)
TOPA: Extending Large Language Models for Video Understanding via Text-Only Pre-Alignment
par: Li, Wei, et autres
Publié: (2024)
par: Li, Wei, et autres
Publié: (2024)
CBVLM: Training-free Explainable Concept-based Large Vision Language Models for Medical Image Classification
par: Patrício, Cristiano, et autres
Publié: (2025)
par: Patrício, Cristiano, et autres
Publié: (2025)
Med-RewardBench: Benchmarking Reward Models and Judges for Medical Multimodal Large Language Models
par: Ding, Meidan, et autres
Publié: (2025)
par: Ding, Meidan, et autres
Publié: (2025)
BitStack: Any-Size Compression of Large Language Models in Variable Memory Environments
par: Wang, Xinghao, et autres
Publié: (2024)
par: Wang, Xinghao, et autres
Publié: (2024)
Let's Think Outside the Box: Exploring Leap-of-Thought in Large Language Models with Creative Humor Generation
par: Zhong, Shanshan, et autres
Publié: (2023)
par: Zhong, Shanshan, et autres
Publié: (2023)
VLind-Bench: Measuring Language Priors in Large Vision-Language Models
par: Lee, Kang-il, et autres
Publié: (2024)
par: Lee, Kang-il, et autres
Publié: (2024)
Documents similaires
-
LINR-PCGC: Lossless Implicit Neural Representations for Point Cloud Geometry Compression
par: Huang, Wenjie, et autres
Publié: (2025) -
UniPCGC: Towards Practical Point Cloud Geometry Compression via an Efficient Unified Approach
par: Wang, Kangli, et autres
Publié: (2025) -
PointLLM: Empowering Large Language Models to Understand Point Clouds
par: Xu, Runsen, et autres
Publié: (2023) -
Uni3D-LLM: Unifying Point Cloud Perception, Generation and Editing with Large Language Models
par: Liu, Dingning, et autres
Publié: (2024) -
Voxel-based Point Cloud Geometry Compression with Space-to-Channel Context
par: Liu, Bojun, et autres
Publié: (2025)