PalmBench: A Comprehensive Benchmark of Compressed Large Language Models on Mobile Platforms
Fuente:
arXiv
Guardado en:
| Autores principales: | Li, Yilong, Liu, Jingyu, Zhang, Hao, Narayanan, M Badri, Sharma, Utkarsh, Zhang, Shuai, Hu, Pan, Zeng, Yijing, Raghuram, Jayaram, Banerjee, Suman |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Tiny but Mighty: A Software-Hardware Co-Design Approach for Efficient Multimodal Inference on Battery-Powered Small Devices
por: Li, Yilong, et al.
Publicado: (2025)
por: Li, Yilong, et al.
Publicado: (2025)
IntraLayer: A Platform of Digital Finance Platforms
por: Abgaryan, Arman, et al.
Publicado: (2024)
por: Abgaryan, Arman, et al.
Publicado: (2024)
Eisenstein cohomology and congruences for the ratios of Rankin--Selberg $L$-functions
por: Narayanan, P., et al.
Publicado: (2025)
por: Narayanan, P., et al.
Publicado: (2025)
Congruences for the ratios of Rankin--Selberg $L$-functions
por: Narayanan, P., et al.
Publicado: (2025)
por: Narayanan, P., et al.
Publicado: (2025)
A Study of Backdoors in Instruction Fine-tuned Language Models
por: Raghuram, Jayaram, et al.
Publicado: (2024)
por: Raghuram, Jayaram, et al.
Publicado: (2024)
Cast a Wider Net: Coordinated Pass@K Policy Optimization for Code Reasoning
por: Li, Yilong, et al.
Publicado: (2026)
por: Li, Yilong, et al.
Publicado: (2026)
Alethia: A Foundational Encoder for Voice Deepfakes
por: Zhu, Yi, et al.
Publicado: (2026)
por: Zhu, Yi, et al.
Publicado: (2026)
Adaptive Concept Bottleneck for Foundation Models Under Distribution Shifts
por: Choi, Jihye, et al.
Publicado: (2024)
por: Choi, Jihye, et al.
Publicado: (2024)
PALM-Bench: A Comprehensive Benchmark for Personalized Audio-Language Models
por: Wang, Yuwen, et al.
Publicado: (2026)
por: Wang, Yuwen, et al.
Publicado: (2026)
OmniEduBench: A Comprehensive Chinese Benchmark for Evaluating Large Language Models in Education
por: Zhang, Min, et al.
Publicado: (2025)
por: Zhang, Min, et al.
Publicado: (2025)
PeopleSearchBench: A Multi-Dimensional Benchmark for Evaluating AI-Powered People Search Platforms
por: Wang, Wei, et al.
Publicado: (2026)
por: Wang, Wei, et al.
Publicado: (2026)
AudioCodecBench: A Comprehensive Benchmark for Audio Codec Evaluation
por: Wang, Lu, et al.
Publicado: (2025)
por: Wang, Lu, et al.
Publicado: (2025)
LVLM-Compress-Bench: Benchmarking the Broader Impact of Large Vision-Language Model Compression
por: Kundu, Souvik, et al.
Publicado: (2025)
por: Kundu, Souvik, et al.
Publicado: (2025)
DeepPM: A Deep Learning-based Profit Maximization Approach in Social Networks
por: Sharma, Poonam, et al.
Publicado: (2026)
por: Sharma, Poonam, et al.
Publicado: (2026)
A Reverse Reachable Set Based Approach for Motif Oriented Profit maximization in Social Networks
por: Sharma, Poonam, et al.
Publicado: (2025)
por: Sharma, Poonam, et al.
Publicado: (2025)
Profit Maximization in Closed Social Networks
por: Sharma, Poonam, et al.
Publicado: (2026)
por: Sharma, Poonam, et al.
Publicado: (2026)
Profit Maximization for Viral Marketing in Online Social Networks using Two Phase Diffusion Approach
por: Sharma, Poonam, et al.
Publicado: (2026)
por: Sharma, Poonam, et al.
Publicado: (2026)
Saliency-Bench: A Comprehensive Benchmark for Evaluating Visual Explanations
por: Zhang, Yifei, et al.
Publicado: (2023)
por: Zhang, Yifei, et al.
Publicado: (2023)
Gemini: Integrating Full-fledged Sensing upon Millimeter Wave Communications
por: Li, Yilong, et al.
Publicado: (2024)
por: Li, Yilong, et al.
Publicado: (2024)
DebateBench: A Challenging Long Context Reasoning Benchmark For Large Language Models
por: Tiwari, Utkarsh, et al.
Publicado: (2025)
por: Tiwari, Utkarsh, et al.
Publicado: (2025)
ICE-Bench: A Unified and Comprehensive Benchmark for Image Creating and Editing
por: Pan, Yulin, et al.
Publicado: (2025)
por: Pan, Yulin, et al.
Publicado: (2025)
CRUST-Bench: A Comprehensive Benchmark for C-to-safe-Rust Transpilation
por: Khatry, Anirudh, et al.
Publicado: (2025)
por: Khatry, Anirudh, et al.
Publicado: (2025)
ProactiveMobile: A Comprehensive Benchmark for Boosting Proactive Intelligence on Mobile Devices
por: Kong, Dezhi, et al.
Publicado: (2026)
por: Kong, Dezhi, et al.
Publicado: (2026)
DecompileBench: A Comprehensive Benchmark for Evaluating Decompilers in Real-World Scenarios
por: Gao, Zeyu, et al.
Publicado: (2025)
por: Gao, Zeyu, et al.
Publicado: (2025)
Mobile-Bench-v2: A More Realistic and Comprehensive Benchmark for VLM-based Mobile Agents
por: Xu, Weikai, et al.
Publicado: (2025)
por: Xu, Weikai, et al.
Publicado: (2025)
ViStoryBench: Comprehensive Benchmark Suite for Story Visualization
por: Zhuang, Cailin, et al.
Publicado: (2025)
por: Zhuang, Cailin, et al.
Publicado: (2025)
SmartHome-Bench: A Comprehensive Benchmark for Video Anomaly Detection in Smart Homes Using Multi-Modal Large Language Models
por: Zhao, Xinyi, et al.
Publicado: (2025)
por: Zhao, Xinyi, et al.
Publicado: (2025)
JailBench: A Comprehensive Chinese Security Assessment Benchmark for Large Language Models
por: Liu, Shuyi, et al.
Publicado: (2025)
por: Liu, Shuyi, et al.
Publicado: (2025)
DHG-Bench: A Comprehensive Benchmark for Deep Hypergraph Learning
por: Li, Fan, et al.
Publicado: (2025)
por: Li, Fan, et al.
Publicado: (2025)
NbBench: Benchmarking Language Models for Comprehensive Nanobody Tasks
por: Zhang, Yiming, et al.
Publicado: (2025)
por: Zhang, Yiming, et al.
Publicado: (2025)
CoCo-Bench: A Comprehensive Code Benchmark For Multi-task Large Language Model Evaluation
por: Yin, Wenjing, et al.
Publicado: (2025)
por: Yin, Wenjing, et al.
Publicado: (2025)
MultiKernelBench: A Multi-Platform Benchmark for Kernel Generation
por: Wen, Zhongzhen, et al.
Publicado: (2025)
por: Wen, Zhongzhen, et al.
Publicado: (2025)
CFinBench: A Comprehensive Chinese Financial Benchmark for Large Language Models
por: Nie, Ying, et al.
Publicado: (2024)
por: Nie, Ying, et al.
Publicado: (2024)
Inverting Trojans in LLMs
por: Li, Zhengxing, et al.
Publicado: (2025)
por: Li, Zhengxing, et al.
Publicado: (2025)
MobileBench-OL: A Comprehensive Chinese Benchmark for Evaluating Mobile GUI Agents in Real-World Environment
por: Wu, Qinzhuo, et al.
Publicado: (2026)
por: Wu, Qinzhuo, et al.
Publicado: (2026)
DesignBench: A Comprehensive Benchmark for MLLM-based Front-end Code Generation
por: Xiao, Jingyu, et al.
Publicado: (2025)
por: Xiao, Jingyu, et al.
Publicado: (2025)
FAVOR-Bench: A Comprehensive Benchmark for Fine-Grained Video Motion Understanding
por: Tu, Chongjun, et al.
Publicado: (2025)
por: Tu, Chongjun, et al.
Publicado: (2025)
MMT-Bench: A Comprehensive Multimodal Benchmark for Evaluating Large Vision-Language Models Towards Multitask AGI
por: Ying, Kaining, et al.
Publicado: (2024)
por: Ying, Kaining, et al.
Publicado: (2024)
IllusionBench+: A Large-scale and Comprehensive Benchmark for Visual Illusion Understanding in Vision-Language Models
por: Zhang, Yiming, et al.
Publicado: (2025)
por: Zhang, Yiming, et al.
Publicado: (2025)
VLBiasBench: A Comprehensive Benchmark for Evaluating Bias in Large Vision-Language Model
por: Wang, Sibo, et al.
Publicado: (2024)
por: Wang, Sibo, et al.
Publicado: (2024)
Ejemplares similares
-
Tiny but Mighty: A Software-Hardware Co-Design Approach for Efficient Multimodal Inference on Battery-Powered Small Devices
por: Li, Yilong, et al.
Publicado: (2025) -
IntraLayer: A Platform of Digital Finance Platforms
por: Abgaryan, Arman, et al.
Publicado: (2024) -
Eisenstein cohomology and congruences for the ratios of Rankin--Selberg $L$-functions
por: Narayanan, P., et al.
Publicado: (2025) -
Congruences for the ratios of Rankin--Selberg $L$-functions
por: Narayanan, P., et al.
Publicado: (2025) -
A Study of Backdoors in Instruction Fine-tuned Language Models
por: Raghuram, Jayaram, et al.
Publicado: (2024)