EfficientLLM: Efficiency in Large Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yuan, Zhengqing, Sun, Weixiang, Liu, Yixin, Zhou, Huichi, Zhou, Rong, Li, Yiyang, Zhang, Zheyuan, Song, Wei, Huang, Yue, Jia, Haolong, Murugesan, Keerthiram, Wang, Yu, He, Lifang, Gao, Jianfeng, Sun, Lichao, Ye, Yanfang |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Food4All: A Multi-Agent Framework for Real-time Free Food Discovery with Integrated Nutritional Metadata
par: Yuan, Zhengqing, et autres
Publié: (2025)
par: Yuan, Zhengqing, et autres
Publié: (2025)
Interpretable Graph-Language Modeling for Detecting Youth Illicit Drug Use
par: Li, Yiyang, et autres
Publié: (2025)
par: Li, Yiyang, et autres
Publié: (2025)
Horizon-LM: A RAM-Centric Architecture for LLM Training
par: Yuan, Zhengqing, et autres
Publié: (2026)
par: Yuan, Zhengqing, et autres
Publié: (2026)
ViT-1.58b: Mobile Vision Transformers in the 1-bit Era
par: Yuan, Zhengqing, et autres
Publié: (2024)
par: Yuan, Zhengqing, et autres
Publié: (2024)
NG-Router: Graph-Supervised Multi-Agent Collaboration for Nutrition Question Answering
par: Shi, Kaiwen, et autres
Publié: (2025)
par: Shi, Kaiwen, et autres
Publié: (2025)
LongDA: Benchmarking LLM Agents for Long-Document Data Analysis
par: Li, Yiyang, et autres
Publié: (2026)
par: Li, Yiyang, et autres
Publié: (2026)
Mora: Enabling Generalist Video Generation via A Multi-Agent Framework
par: Yuan, Zhengqing, et autres
Publié: (2024)
par: Yuan, Zhengqing, et autres
Publié: (2024)
TTT-Unet: Enhancing U-Net with Test-Time Training Layers for Biomedical Image Segmentation
par: Zhou, Rong, et autres
Publié: (2024)
par: Zhou, Rong, et autres
Publié: (2024)
MegaTrain: Full Precision Training of 100B+ Parameter Large Language Models on a Single GPU
par: Yuan, Zhengqing, et autres
Publié: (2026)
par: Yuan, Zhengqing, et autres
Publié: (2026)
AgentRouter: A Knowledge-Graph-Guided LLM Router for Collaborative Multi-Agent Question Answering
par: Zhang, Zheyuan, et autres
Publié: (2025)
par: Zhang, Zheyuan, et autres
Publié: (2025)
CiteAudit: You Cited It, But Did You Read It? A Benchmark for Verifying Scientific References in the LLM Era
par: Shi, Kaiwen, et autres
Publié: (2026)
par: Shi, Kaiwen, et autres
Publié: (2026)
BLURR: A Boosted Low-Resource Inference for Vision-Language-Action Models
par: Ma, Xiaoyu, et autres
Publié: (2025)
par: Ma, Xiaoyu, et autres
Publié: (2025)
TinyGPT-V: Efficient Multimodal Large Language Model via Small Backbones
par: Yuan, Zhengqing, et autres
Publié: (2023)
par: Yuan, Zhengqing, et autres
Publié: (2023)
ArtGPT-4: Towards Artistic-understanding Large Vision-Language Models with Enhanced Adapter
par: Yuan, Zhengqing, et autres
Publié: (2023)
par: Yuan, Zhengqing, et autres
Publié: (2023)
3D4D: An Interactive, Editable, 4D World Model via 3D Video Generation
par: He, Yunhong, et autres
Publié: (2025)
par: He, Yunhong, et autres
Publié: (2025)
Social Science Meets LLMs: How Reliable Are Large Language Models in Social Simulations?
par: Huang, Yue, et autres
Publié: (2024)
par: Huang, Yue, et autres
Publié: (2024)
Bora: Biomedical Generalist Video Generation Model
par: Sun, Weixiang, et autres
Publié: (2024)
par: Sun, Weixiang, et autres
Publié: (2024)
Biomedical SAM 2: Segment Anything in Biomedical Images and Videos
par: Yan, Zhiling, et autres
Publié: (2024)
par: Yan, Zhiling, et autres
Publié: (2024)
Drift-Bench: Diagnosing Cooperative Breakdowns in LLM Agents under Input Faults via Multi-Turn Interaction
par: Bao, Han, et autres
Publié: (2026)
par: Bao, Han, et autres
Publié: (2026)
Sora: A Review on Background, Technology, Limitations, and Opportunities of Large Vision Models
par: Liu, Yixin, et autres
Publié: (2024)
par: Liu, Yixin, et autres
Publié: (2024)
Medical Unlearnable Examples: Securing Medical Data from Unauthorized Training via Sparsity-Aware Local Masking
par: Sun, Weixiang, et autres
Publié: (2024)
par: Sun, Weixiang, et autres
Publié: (2024)
MLP-KAN: Unifying Deep Representation and Function Learning
par: He, Yunhong, et autres
Publié: (2024)
par: He, Yunhong, et autres
Publié: (2024)
EfficientLLM: Scalable Pruning-Aware Pretraining for Architecture-Agnostic Edge Language Models
par: Xing, Xingrun, et autres
Publié: (2025)
par: Xing, Xingrun, et autres
Publié: (2025)
Policy4OOD: A Knowledge-Guided World Model for Policy Intervention Simulation against the Opioid Overdose Crisis
par: Ma, Yijun, et autres
Publié: (2026)
par: Ma, Yijun, et autres
Publié: (2026)
Temporal Graph Pattern Machine
par: Ma, Yijun, et autres
Publié: (2026)
par: Ma, Yijun, et autres
Publié: (2026)
STARLING: Self-supervised Training of Text-based Reinforcement Learning Agent with Large Language Models
par: Basavatia, Shreyas, et autres
Publié: (2024)
par: Basavatia, Shreyas, et autres
Publié: (2024)
MOPI-HFRS: A Multi-objective Personalized Health-aware Food Recommendation System with LLM-enhanced Interpretation
par: Zhang, Zheyuan, et autres
Publié: (2024)
par: Zhang, Zheyuan, et autres
Publié: (2024)
NGQA: A Nutritional Graph Question Answering Benchmark for Personalized Health-aware Nutritional Reasoning
par: Zhang, Zheyuan, et autres
Publié: (2024)
par: Zhang, Zheyuan, et autres
Publié: (2024)
MedGPT-oss: Training a General-Purpose Vision-Language Model for Biomedicine
par: Zhang, Kai, et autres
Publié: (2026)
par: Zhang, Kai, et autres
Publié: (2026)
AutoData: A Multi-Agent System for Open Web Data Collection
par: Ma, Tianyi, et autres
Publié: (2025)
par: Ma, Tianyi, et autres
Publié: (2025)
MLLM-as-a-Judge: Assessing Multimodal LLM-as-a-Judge with Vision-Language Benchmark
par: Chen, Dongping, et autres
Publié: (2024)
par: Chen, Dongping, et autres
Publié: (2024)
PreScam: A Benchmark for Predicting Scam Progression from Early Conversations
par: Sun, Weixiang, et autres
Publié: (2026)
par: Sun, Weixiang, et autres
Publié: (2026)
The Unlearning Mirage: A Dynamic Framework for Evaluating LLM Unlearning
par: Shah, Raj Sanjay, et autres
Publié: (2026)
par: Shah, Raj Sanjay, et autres
Publié: (2026)
SAMed-2: Selective Memory Enhanced Medical Segment Anything Model
par: Yan, Zhiling, et autres
Publié: (2025)
par: Yan, Zhiling, et autres
Publié: (2025)
On the Effects of Fine-tuning Language Models for Text-Based Reinforcement Learning
par: Gruppi, Mauricio, et autres
Publié: (2024)
par: Gruppi, Mauricio, et autres
Publié: (2024)
Targeted Advertising on Social Networks Using Online Variational Tensor Regression
par: Idé, Tsuyoshi, et autres
Publié: (2022)
par: Idé, Tsuyoshi, et autres
Publié: (2022)
Can Large Language Models Automatically Jailbreak GPT-4V?
par: Wu, Yuanwei, et autres
Publié: (2024)
par: Wu, Yuanwei, et autres
Publié: (2024)
Empirical Perturbation Analysis of Linear System Solvers from a Data Poisoning Perspective
par: Liu, Yixin, et autres
Publié: (2024)
par: Liu, Yixin, et autres
Publié: (2024)
Why Reasoning Fails to Plan: A Planning-Centric Analysis of Long-Horizon Decision Making in LLM Agents
par: Wang, Zehong, et autres
Publié: (2026)
par: Wang, Zehong, et autres
Publié: (2026)
Jailbreaking GPT-4V via Self-Adversarial Attacks with System Prompts
par: Wu, Yuanwei, et autres
Publié: (2023)
par: Wu, Yuanwei, et autres
Publié: (2023)
Documents similaires
-
Food4All: A Multi-Agent Framework for Real-time Free Food Discovery with Integrated Nutritional Metadata
par: Yuan, Zhengqing, et autres
Publié: (2025) -
Interpretable Graph-Language Modeling for Detecting Youth Illicit Drug Use
par: Li, Yiyang, et autres
Publié: (2025) -
Horizon-LM: A RAM-Centric Architecture for LLM Training
par: Yuan, Zhengqing, et autres
Publié: (2026) -
ViT-1.58b: Mobile Vision Transformers in the 1-bit Era
par: Yuan, Zhengqing, et autres
Publié: (2024) -
NG-Router: Graph-Supervised Multi-Agent Collaboration for Nutrition Question Answering
par: Shi, Kaiwen, et autres
Publié: (2025)