GePBench: Evaluating Fundamental Geometric Perception for Multimodal Large Language Models
Fuente:
arXiv
Saved in:
| Main Authors: | Xing, Shangyu, Xiang, Changhao, Han, Yuteng, Yue, Yifan, Wu, Zhen, Liu, Xinyu, Wu, Zhangtai, Zhao, Fei, Dai, Xinyu |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Causal Evidence for Attention Head Imbalance in Modality Conflict Hallucination
by: Jiang, Jinrui, et al.
Published: (2026)
by: Jiang, Jinrui, et al.
Published: (2026)
EFUF: Efficient Fine-grained Unlearning Framework for Mitigating Hallucinations in Multimodal Large Language Models
by: Xing, Shangyu, et al.
Published: (2024)
by: Xing, Shangyu, et al.
Published: (2024)
AlignGPT: Multi-modal Large Language Models with Adaptive Alignment Capability
by: Zhao, Fei, et al.
Published: (2024)
by: Zhao, Fei, et al.
Published: (2024)
WebNavigator: Global Web Navigation via Interaction Graph Retrieval
by: Zhang, Xuanwang, et al.
Published: (2026)
by: Zhang, Xuanwang, et al.
Published: (2026)
Lookahead Tree-Based Rollouts for Enhanced Trajectory-Level Exploration in Reinforcement Learning with Verifiable Rewards
by: Xing, Shangyu, et al.
Published: (2025)
by: Xing, Shangyu, et al.
Published: (2025)
Counterfactual Language Reasoning for Explainable Recommendation Systems
by: Li, Guanrong, et al.
Published: (2025)
by: Li, Guanrong, et al.
Published: (2025)
Persona-Aware Alignment Framework for Personalized Dialogue Generation
by: Li, Guanrong, et al.
Published: (2025)
by: Li, Guanrong, et al.
Published: (2025)
Extroversion or Introversion? Controlling The Personality of Your Large Language Models
by: Chen, Yanquan, et al.
Published: (2024)
by: Chen, Yanquan, et al.
Published: (2024)
Fundamental Limits of Routing Attack on Network Overload
by: Wu, Xinyu, et al.
Published: (2024)
by: Wu, Xinyu, et al.
Published: (2024)
Can Large Vision-Language Models Understand Multimodal Sarcasm?
by: Wang, Xinyu, et al.
Published: (2025)
by: Wang, Xinyu, et al.
Published: (2025)
A Preliminary Study on Geometric Unification of Fundamental Physics via S_q^3 Noncommutative Geometry
by: Zheng, Xinyu
Published: (2026)
by: Zheng, Xinyu
Published: (2026)
Check Field Detection Agent (CFD-Agent) using Multimodal Large Language and Vision Language Models
by: Halder, Sourav, et al.
Published: (2025)
by: Halder, Sourav, et al.
Published: (2025)
RealBench: A Chinese Multi-image Understanding Benchmark Close to Real-world Scenarios
by: Zhao, Fei, et al.
Published: (2025)
by: Zhao, Fei, et al.
Published: (2025)
Harmonizing Large Language Models with Collaborative Behavioral Signals for Conversational Recommendation
by: Li, Guanrong, et al.
Published: (2025)
by: Li, Guanrong, et al.
Published: (2025)
PBench: Workload Synthesizer with Real Statistics for Cloud Analytics Benchmarking
by: Zhou, Yan, et al.
Published: (2025)
by: Zhou, Yan, et al.
Published: (2025)
Dynamic Demonstrations Controller for In-Context Learning
by: Zhao, Fei, et al.
Published: (2023)
by: Zhao, Fei, et al.
Published: (2023)
PersuasiveToM: A Benchmark for Evaluating Machine Theory of Mind in Persuasive Dialogues
by: Yu, Fangxu, et al.
Published: (2025)
by: Yu, Fangxu, et al.
Published: (2025)
Are Large Vision Language Models Good Game Players?
by: Wang, Xinyu, et al.
Published: (2025)
by: Wang, Xinyu, et al.
Published: (2025)
Knowledge-aware Dual-side Attribute-enhanced Recommendation
by: Pang, Taotian, et al.
Published: (2024)
by: Pang, Taotian, et al.
Published: (2024)
Emotion-Anchored Contrastive Learning Framework for Emotion Recognition in Conversation
by: Yu, Fangxu, et al.
Published: (2024)
by: Yu, Fangxu, et al.
Published: (2024)
Task-Aware Resolution Optimization for Visual Large Language Models
by: Luo, Weiqing, et al.
Published: (2025)
by: Luo, Weiqing, et al.
Published: (2025)
Detecting Knowledge Boundary of Vision Large Language Models by Sampling-Based Inference
by: Chen, Zhuo, et al.
Published: (2025)
by: Chen, Zhuo, et al.
Published: (2025)
Semantic Consistency Regularization with Large Language Models for Semi-supervised Sentiment Analysis
by: Li, Kunrong, et al.
Published: (2025)
by: Li, Kunrong, et al.
Published: (2025)
A Neural Matrix Decomposition Recommender System Model based on the Multimodal Large Language Model
by: Xiang, Ao, et al.
Published: (2024)
by: Xiang, Ao, et al.
Published: (2024)
Nav-EE: Navigation-Guided Early Exiting for Efficient Vision-Language Models in Autonomous Driving
by: Hu, Haibo, et al.
Published: (2025)
by: Hu, Haibo, et al.
Published: (2025)
Evaluating and Advancing Multimodal Large Language Models in Perception Ability Lens
by: Chen, Feng, et al.
Published: (2024)
by: Chen, Feng, et al.
Published: (2024)
IterQR: An Iterative Framework for LLM-based Query Rewrite in e-Commercial Search System
by: Chen, Shangyu, et al.
Published: (2025)
by: Chen, Shangyu, et al.
Published: (2025)
Growing Trees with an Agent: Accelerating RRTs with Learned, Multi-Step Episodic Exploration
by: Wu, Xinyu
Published: (2025)
by: Wu, Xinyu
Published: (2025)
Fast-Slow Efficient Training for Multimodal Large Language Models via Visual Token Pruning
by: Zhang, Dingkun, et al.
Published: (2026)
by: Zhang, Dingkun, et al.
Published: (2026)
GeARF5/GeIAA33‐GeSWEET14 module balances the secondary metabolic biosynthesis to increase the yield and quality in Gastrodia elata
by: Qun Liu, et al.
Published: (2026)
by: Qun Liu, et al.
Published: (2026)
Dynamic Decision-Making under Model Misspecification
by: Dai, Xinyu
Published: (2025)
by: Dai, Xinyu
Published: (2025)
Graph Neural Network Enhanced Sequential Recommendation Method for Cross-Platform Ad Campaign
by: Li, Xiang, et al.
Published: (2025)
by: Li, Xiang, et al.
Published: (2025)
NavBench: Probing Multimodal Large Language Models for Embodied Navigation
by: Qiao, Yanyuan, et al.
Published: (2025)
by: Qiao, Yanyuan, et al.
Published: (2025)
From Perception to Cognition: A Survey of Vision-Language Interactive Reasoning in Multimodal Large Language Models
by: Zhou, Chenyue, et al.
Published: (2025)
by: Zhou, Chenyue, et al.
Published: (2025)
Dr3: Ask Large Language Models Not to Give Off-Topic Answers in Open Domain Multi-Hop Question Answering
by: Gao, Yuan, et al.
Published: (2024)
by: Gao, Yuan, et al.
Published: (2024)
Why New Nurses of Gen Z in China Are Leaving the Hospitals Within the First Year: A Qualitative Descriptive Study
by: Waner Wu, et al.
Published: (2025)
by: Waner Wu, et al.
Published: (2025)
Harnessing Large Language Models for Seed Generation in Greybox Fuzzing
by: Shi, Wenxuan, et al.
Published: (2024)
by: Shi, Wenxuan, et al.
Published: (2024)
CogGen: A Cognitively Inspired Recursive Framework for Deep Research Report Generation
by: Tian, Kuo, et al.
Published: (2026)
by: Tian, Kuo, et al.
Published: (2026)
Recognize Your Orchestrator: An Entropy Dynamics Perspective for LLM Multi-Agent Systems
by: Zhu, Junze, et al.
Published: (2026)
by: Zhu, Junze, et al.
Published: (2026)
An AI‐Enabled All‐In‐One Visual, Proximity, and Tactile Perception Multimodal Sensor
by: Menghao Pu, et al.
Published: (2025)
by: Menghao Pu, et al.
Published: (2025)
Similar Items
-
Causal Evidence for Attention Head Imbalance in Modality Conflict Hallucination
by: Jiang, Jinrui, et al.
Published: (2026) -
EFUF: Efficient Fine-grained Unlearning Framework for Mitigating Hallucinations in Multimodal Large Language Models
by: Xing, Shangyu, et al.
Published: (2024) -
AlignGPT: Multi-modal Large Language Models with Adaptive Alignment Capability
by: Zhao, Fei, et al.
Published: (2024) -
WebNavigator: Global Web Navigation via Interaction Graph Retrieval
by: Zhang, Xuanwang, et al.
Published: (2026) -
Lookahead Tree-Based Rollouts for Enhanced Trajectory-Level Exploration in Reinforcement Learning with Verifiable Rewards
by: Xing, Shangyu, et al.
Published: (2025)