LLM-Metrics: Measuring Research Impact Through Large Language Model Memory
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Shen, Si, Zhao, Wenhua, Zhu, Danhao |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
RevOrder: A Novel Method for Enhanced Arithmetic in Language Models
par: Shen, Si, et autres
Publié: (2024)
par: Shen, Si, et autres
Publié: (2024)
Mitigating Think-Answer Mismatch in LLM Reasoning Through Noise-Aware Advantage Reweighting
par: Shen, Si, et autres
Publié: (2025)
par: Shen, Si, et autres
Publié: (2025)
Empowering Working Memory for Large Language Model Agents
par: Guo, Jing, et autres
Publié: (2023)
par: Guo, Jing, et autres
Publié: (2023)
Cognitive Memory in Large Language Models
par: Shan, Lianlei, et autres
Publié: (2025)
par: Shan, Lianlei, et autres
Publié: (2025)
Measuring and Analyzing Intelligence via Contextual Uncertainty in Large Language Models using Information-Theoretic Metrics
par: Shim, Jae Wan
Publié: (2025)
par: Shim, Jae Wan
Publié: (2025)
Establishing Reliability Metrics for Reward Models in Large Language Models
par: Chen, Yizhou, et autres
Publié: (2025)
par: Chen, Yizhou, et autres
Publié: (2025)
DynLLM: When Large Language Models Meet Dynamic Graph Recommendation
par: Zhao, Ziwei, et autres
Publié: (2024)
par: Zhao, Ziwei, et autres
Publié: (2024)
STEP-LLM: Generating CAD STEP Models from Natural Language with Large Language Models
par: Shi, Xiangyu, et autres
Publié: (2026)
par: Shi, Xiangyu, et autres
Publié: (2026)
Lightweight LLM Agent Memory with Small Language Models
par: Zhang, Jiaquan, et autres
Publié: (2026)
par: Zhang, Jiaquan, et autres
Publié: (2026)
A Survey on the Memory Mechanism of Large Language Model based Agents
par: Zhang, Zeyu, et autres
Publié: (2024)
par: Zhang, Zeyu, et autres
Publié: (2024)
Novelty Adaptation Through Hybrid Large Language Model (LLM)-Symbolic Planning and LLM-guided Reinforcement Learning
par: Lu, Hong, et autres
Publié: (2026)
par: Lu, Hong, et autres
Publié: (2026)
Secret Use of Large Language Model (LLM)
par: Zhang, Zhiping, et autres
Publié: (2024)
par: Zhang, Zhiping, et autres
Publié: (2024)
LUT-LLM: Efficient Large Language Model Inference with Memory-based Computations on FPGAs
par: He, Zifan, et autres
Publié: (2025)
par: He, Zifan, et autres
Publié: (2025)
SpreadsheetLLM: Encoding Spreadsheets for Large Language Models
par: Dong, Haoyu, et autres
Publié: (2024)
par: Dong, Haoyu, et autres
Publié: (2024)
Measuring Social Norms of Large Language Models
par: Yuan, Ye, et autres
Publié: (2024)
par: Yuan, Ye, et autres
Publié: (2024)
Memory in Large Language Models: Mechanisms, Evaluation and Evolution
par: Zhang, Dianxing, et autres
Publié: (2025)
par: Zhang, Dianxing, et autres
Publié: (2025)
Evaluating LLM Metrics Through Real-World Capabilities
par: Miller, Justin K, et autres
Publié: (2025)
par: Miller, Justin K, et autres
Publié: (2025)
DETAIL Matters: Measuring the Impact of Prompt Specificity on Reasoning in Large Language Models
par: Kim, Olivia
Publié: (2025)
par: Kim, Olivia
Publié: (2025)
Measuring Physical-World Privacy Awareness of Large Language Models: An Evaluation Benchmark
par: Shen, Xinjie, et autres
Publié: (2025)
par: Shen, Xinjie, et autres
Publié: (2025)
Perovskite-LLM: Knowledge-Enhanced Large Language Models for Perovskite Solar Cell Research
par: Liu, Xiang, et autres
Publié: (2025)
par: Liu, Xiang, et autres
Publié: (2025)
Towards Repository-Level Program Verification with Large Language Models
par: Zhong, Si Cheng, et autres
Publié: (2025)
par: Zhong, Si Cheng, et autres
Publié: (2025)
Uncertainty Under the Curve: A Sequence-Level Entropy Area Metric for Reasoning LLM
par: Zhu, Yongfu, et autres
Publié: (2025)
par: Zhu, Yongfu, et autres
Publié: (2025)
Safety Layers in Aligned Large Language Models: The Key to LLM Security
par: Li, Shen, et autres
Publié: (2024)
par: Li, Shen, et autres
Publié: (2024)
MemoryRewardBench: Benchmarking Reward Models for Long-Term Memory Management in Large Language Models
par: Tang, Zecheng, et autres
Publié: (2026)
par: Tang, Zecheng, et autres
Publié: (2026)
LLM in a flash: Efficient Large Language Model Inference with Limited Memory
par: Alizadeh, Keivan, et autres
Publié: (2023)
par: Alizadeh, Keivan, et autres
Publié: (2023)
Political-LLM: Large Language Models in Political Science
par: Li, Lincan, et autres
Publié: (2024)
par: Li, Lincan, et autres
Publié: (2024)
Edge-First Language Model Inference: Models, Metrics, and Tradeoffs
par: Jang, SiYoung, et autres
Publié: (2025)
par: Jang, SiYoung, et autres
Publié: (2025)
PMPO: Probabilistic Metric Prompt Optimization for Small and Large Language Models
par: Zhao, Chenzhuo, et autres
Publié: (2025)
par: Zhao, Chenzhuo, et autres
Publié: (2025)
$δ$-mem: Efficient Online Memory for Large Language Models
par: Lei, Jingdi, et autres
Publié: (2026)
par: Lei, Jingdi, et autres
Publié: (2026)
BriLLM: Brain-inspired Large Language Model
par: Zhao, Hai, et autres
Publié: (2025)
par: Zhao, Hai, et autres
Publié: (2025)
Measuring the Impact of Lexical Training Data Coverage on Hallucination Detection in Large Language Models
par: Zhang, Shuo, et autres
Publié: (2025)
par: Zhang, Shuo, et autres
Publié: (2025)
Large Language Models Prompting With Episodic Memory
par: Do, Dai, et autres
Publié: (2024)
par: Do, Dai, et autres
Publié: (2024)
LC-LLM: Explainable Lane-Change Intention and Trajectory Predictions with Large Language Models
par: Peng, Mingxing, et autres
Publié: (2024)
par: Peng, Mingxing, et autres
Publié: (2024)
G-MemLLM: Gated Latent Memory Augmentation for Long-Context Reasoning in Large Language Models
par: Xu, Xun
Publié: (2026)
par: Xu, Xun
Publié: (2026)
From LLM to Conversational Agent: A Memory Enhanced Architecture with Fine-Tuning of Large Language Models
par: Liu, Na, et autres
Publié: (2024)
par: Liu, Na, et autres
Publié: (2024)
PMG : Personalized Multimodal Generation with Large Language Models
par: Shen, Xiaoteng, et autres
Publié: (2024)
par: Shen, Xiaoteng, et autres
Publié: (2024)
ScholarGym: Benchmarking Large Language Model Capabilities in the Information-Gathering Stage of Deep Research
par: Shen, Hao, et autres
Publié: (2026)
par: Shen, Hao, et autres
Publié: (2026)
Predicting Empirical AI Research Outcomes with Language Models
par: Wen, Jiaxin, et autres
Publié: (2025)
par: Wen, Jiaxin, et autres
Publié: (2025)
BackdoorLLM: A Comprehensive Benchmark for Backdoor Attacks and Defenses on Large Language Models
par: Li, Yige, et autres
Publié: (2024)
par: Li, Yige, et autres
Publié: (2024)
The Impact of Reasoning Step Length on Large Language Models
par: Jin, Mingyu, et autres
Publié: (2024)
par: Jin, Mingyu, et autres
Publié: (2024)
Documents similaires
-
RevOrder: A Novel Method for Enhanced Arithmetic in Language Models
par: Shen, Si, et autres
Publié: (2024) -
Mitigating Think-Answer Mismatch in LLM Reasoning Through Noise-Aware Advantage Reweighting
par: Shen, Si, et autres
Publié: (2025) -
Empowering Working Memory for Large Language Model Agents
par: Guo, Jing, et autres
Publié: (2023) -
Cognitive Memory in Large Language Models
par: Shan, Lianlei, et autres
Publié: (2025) -
Measuring and Analyzing Intelligence via Contextual Uncertainty in Large Language Models using Information-Theoretic Metrics
par: Shim, Jae Wan
Publié: (2025)