PalmBench: A Comprehensive Benchmark of Compressed Large Language Models on Mobile Platforms
Fuente:
arXiv
Salvato in:
| Autori principali: | Li, Yilong, Liu, Jingyu, Zhang, Hao, Narayanan, M Badri, Sharma, Utkarsh, Zhang, Shuai, Hu, Pan, Zeng, Yijing, Raghuram, Jayaram, Banerjee, Suman |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Tiny but Mighty: A Software-Hardware Co-Design Approach for Efficient Multimodal Inference on Battery-Powered Small Devices
di: Li, Yilong, et al.
Pubblicazione: (2025)
di: Li, Yilong, et al.
Pubblicazione: (2025)
IntraLayer: A Platform of Digital Finance Platforms
di: Abgaryan, Arman, et al.
Pubblicazione: (2024)
di: Abgaryan, Arman, et al.
Pubblicazione: (2024)
Eisenstein cohomology and congruences for the ratios of Rankin--Selberg $L$-functions
di: Narayanan, P., et al.
Pubblicazione: (2025)
di: Narayanan, P., et al.
Pubblicazione: (2025)
Congruences for the ratios of Rankin--Selberg $L$-functions
di: Narayanan, P., et al.
Pubblicazione: (2025)
di: Narayanan, P., et al.
Pubblicazione: (2025)
A Study of Backdoors in Instruction Fine-tuned Language Models
di: Raghuram, Jayaram, et al.
Pubblicazione: (2024)
di: Raghuram, Jayaram, et al.
Pubblicazione: (2024)
Cast a Wider Net: Coordinated Pass@K Policy Optimization for Code Reasoning
di: Li, Yilong, et al.
Pubblicazione: (2026)
di: Li, Yilong, et al.
Pubblicazione: (2026)
Alethia: A Foundational Encoder for Voice Deepfakes
di: Zhu, Yi, et al.
Pubblicazione: (2026)
di: Zhu, Yi, et al.
Pubblicazione: (2026)
Adaptive Concept Bottleneck for Foundation Models Under Distribution Shifts
di: Choi, Jihye, et al.
Pubblicazione: (2024)
di: Choi, Jihye, et al.
Pubblicazione: (2024)
PALM-Bench: A Comprehensive Benchmark for Personalized Audio-Language Models
di: Wang, Yuwen, et al.
Pubblicazione: (2026)
di: Wang, Yuwen, et al.
Pubblicazione: (2026)
OmniEduBench: A Comprehensive Chinese Benchmark for Evaluating Large Language Models in Education
di: Zhang, Min, et al.
Pubblicazione: (2025)
di: Zhang, Min, et al.
Pubblicazione: (2025)
PeopleSearchBench: A Multi-Dimensional Benchmark for Evaluating AI-Powered People Search Platforms
di: Wang, Wei, et al.
Pubblicazione: (2026)
di: Wang, Wei, et al.
Pubblicazione: (2026)
AudioCodecBench: A Comprehensive Benchmark for Audio Codec Evaluation
di: Wang, Lu, et al.
Pubblicazione: (2025)
di: Wang, Lu, et al.
Pubblicazione: (2025)
LVLM-Compress-Bench: Benchmarking the Broader Impact of Large Vision-Language Model Compression
di: Kundu, Souvik, et al.
Pubblicazione: (2025)
di: Kundu, Souvik, et al.
Pubblicazione: (2025)
DeepPM: A Deep Learning-based Profit Maximization Approach in Social Networks
di: Sharma, Poonam, et al.
Pubblicazione: (2026)
di: Sharma, Poonam, et al.
Pubblicazione: (2026)
A Reverse Reachable Set Based Approach for Motif Oriented Profit maximization in Social Networks
di: Sharma, Poonam, et al.
Pubblicazione: (2025)
di: Sharma, Poonam, et al.
Pubblicazione: (2025)
Profit Maximization in Closed Social Networks
di: Sharma, Poonam, et al.
Pubblicazione: (2026)
di: Sharma, Poonam, et al.
Pubblicazione: (2026)
Profit Maximization for Viral Marketing in Online Social Networks using Two Phase Diffusion Approach
di: Sharma, Poonam, et al.
Pubblicazione: (2026)
di: Sharma, Poonam, et al.
Pubblicazione: (2026)
Saliency-Bench: A Comprehensive Benchmark for Evaluating Visual Explanations
di: Zhang, Yifei, et al.
Pubblicazione: (2023)
di: Zhang, Yifei, et al.
Pubblicazione: (2023)
Gemini: Integrating Full-fledged Sensing upon Millimeter Wave Communications
di: Li, Yilong, et al.
Pubblicazione: (2024)
di: Li, Yilong, et al.
Pubblicazione: (2024)
DebateBench: A Challenging Long Context Reasoning Benchmark For Large Language Models
di: Tiwari, Utkarsh, et al.
Pubblicazione: (2025)
di: Tiwari, Utkarsh, et al.
Pubblicazione: (2025)
ICE-Bench: A Unified and Comprehensive Benchmark for Image Creating and Editing
di: Pan, Yulin, et al.
Pubblicazione: (2025)
di: Pan, Yulin, et al.
Pubblicazione: (2025)
CRUST-Bench: A Comprehensive Benchmark for C-to-safe-Rust Transpilation
di: Khatry, Anirudh, et al.
Pubblicazione: (2025)
di: Khatry, Anirudh, et al.
Pubblicazione: (2025)
ProactiveMobile: A Comprehensive Benchmark for Boosting Proactive Intelligence on Mobile Devices
di: Kong, Dezhi, et al.
Pubblicazione: (2026)
di: Kong, Dezhi, et al.
Pubblicazione: (2026)
DecompileBench: A Comprehensive Benchmark for Evaluating Decompilers in Real-World Scenarios
di: Gao, Zeyu, et al.
Pubblicazione: (2025)
di: Gao, Zeyu, et al.
Pubblicazione: (2025)
Mobile-Bench-v2: A More Realistic and Comprehensive Benchmark for VLM-based Mobile Agents
di: Xu, Weikai, et al.
Pubblicazione: (2025)
di: Xu, Weikai, et al.
Pubblicazione: (2025)
ViStoryBench: Comprehensive Benchmark Suite for Story Visualization
di: Zhuang, Cailin, et al.
Pubblicazione: (2025)
di: Zhuang, Cailin, et al.
Pubblicazione: (2025)
SmartHome-Bench: A Comprehensive Benchmark for Video Anomaly Detection in Smart Homes Using Multi-Modal Large Language Models
di: Zhao, Xinyi, et al.
Pubblicazione: (2025)
di: Zhao, Xinyi, et al.
Pubblicazione: (2025)
JailBench: A Comprehensive Chinese Security Assessment Benchmark for Large Language Models
di: Liu, Shuyi, et al.
Pubblicazione: (2025)
di: Liu, Shuyi, et al.
Pubblicazione: (2025)
DHG-Bench: A Comprehensive Benchmark for Deep Hypergraph Learning
di: Li, Fan, et al.
Pubblicazione: (2025)
di: Li, Fan, et al.
Pubblicazione: (2025)
NbBench: Benchmarking Language Models for Comprehensive Nanobody Tasks
di: Zhang, Yiming, et al.
Pubblicazione: (2025)
di: Zhang, Yiming, et al.
Pubblicazione: (2025)
CoCo-Bench: A Comprehensive Code Benchmark For Multi-task Large Language Model Evaluation
di: Yin, Wenjing, et al.
Pubblicazione: (2025)
di: Yin, Wenjing, et al.
Pubblicazione: (2025)
MultiKernelBench: A Multi-Platform Benchmark for Kernel Generation
di: Wen, Zhongzhen, et al.
Pubblicazione: (2025)
di: Wen, Zhongzhen, et al.
Pubblicazione: (2025)
CFinBench: A Comprehensive Chinese Financial Benchmark for Large Language Models
di: Nie, Ying, et al.
Pubblicazione: (2024)
di: Nie, Ying, et al.
Pubblicazione: (2024)
Inverting Trojans in LLMs
di: Li, Zhengxing, et al.
Pubblicazione: (2025)
di: Li, Zhengxing, et al.
Pubblicazione: (2025)
MobileBench-OL: A Comprehensive Chinese Benchmark for Evaluating Mobile GUI Agents in Real-World Environment
di: Wu, Qinzhuo, et al.
Pubblicazione: (2026)
di: Wu, Qinzhuo, et al.
Pubblicazione: (2026)
DesignBench: A Comprehensive Benchmark for MLLM-based Front-end Code Generation
di: Xiao, Jingyu, et al.
Pubblicazione: (2025)
di: Xiao, Jingyu, et al.
Pubblicazione: (2025)
FAVOR-Bench: A Comprehensive Benchmark for Fine-Grained Video Motion Understanding
di: Tu, Chongjun, et al.
Pubblicazione: (2025)
di: Tu, Chongjun, et al.
Pubblicazione: (2025)
MMT-Bench: A Comprehensive Multimodal Benchmark for Evaluating Large Vision-Language Models Towards Multitask AGI
di: Ying, Kaining, et al.
Pubblicazione: (2024)
di: Ying, Kaining, et al.
Pubblicazione: (2024)
IllusionBench+: A Large-scale and Comprehensive Benchmark for Visual Illusion Understanding in Vision-Language Models
di: Zhang, Yiming, et al.
Pubblicazione: (2025)
di: Zhang, Yiming, et al.
Pubblicazione: (2025)
VLBiasBench: A Comprehensive Benchmark for Evaluating Bias in Large Vision-Language Model
di: Wang, Sibo, et al.
Pubblicazione: (2024)
di: Wang, Sibo, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Tiny but Mighty: A Software-Hardware Co-Design Approach for Efficient Multimodal Inference on Battery-Powered Small Devices
di: Li, Yilong, et al.
Pubblicazione: (2025) -
IntraLayer: A Platform of Digital Finance Platforms
di: Abgaryan, Arman, et al.
Pubblicazione: (2024) -
Eisenstein cohomology and congruences for the ratios of Rankin--Selberg $L$-functions
di: Narayanan, P., et al.
Pubblicazione: (2025) -
Congruences for the ratios of Rankin--Selberg $L$-functions
di: Narayanan, P., et al.
Pubblicazione: (2025) -
A Study of Backdoors in Instruction Fine-tuned Language Models
di: Raghuram, Jayaram, et al.
Pubblicazione: (2024)