An Interpretable and Scalable Framework for Evaluating Large Language Models
Fuente:
arXiv
Saved in:
| Main Authors: | Qu, Xinhao, Heng, Qiang, Zeng, Hao, Liu, Xiaoqian |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
InverseScope: Scalable Activation Inversion for Interpreting Large Language Models
by: Luo, Yifan, et al.
Published: (2025)
by: Luo, Yifan, et al.
Published: (2025)
LOGIN: A Large Language Model Consulted Graph Neural Network Training Framework
by: Qiao, Yiran, et al.
Published: (2024)
by: Qiao, Yiran, et al.
Published: (2024)
SUV: Scalable Large Language Model Copyright Compliance with Regularized Selective Unlearning
by: Xu, Tianyang, et al.
Published: (2025)
by: Xu, Tianyang, et al.
Published: (2025)
Evaluating the Factuality of Large Language Models using Large-Scale Knowledge Graphs
by: Liu, Xiaoze, et al.
Published: (2024)
by: Liu, Xiaoze, et al.
Published: (2024)
HyPAC: Cost-Efficient LLMs-Human Hybrid Annotation with PAC Error Guarantees
by: Zeng, Hao, et al.
Published: (2026)
by: Zeng, Hao, et al.
Published: (2026)
Provable Training Data Identification for Large Language Models
by: Liu, Zhenlong, et al.
Published: (2025)
by: Liu, Zhenlong, et al.
Published: (2025)
MALLM-GAN: Multi-Agent Large Language Model as Generative Adversarial Network for Synthesizing Tabular Data
by: Ling, Yaobin, et al.
Published: (2024)
by: Ling, Yaobin, et al.
Published: (2024)
REMA: A Unified Reasoning Manifold Framework for Interpreting Large Language Model
by: Li, Bo, et al.
Published: (2025)
by: Li, Bo, et al.
Published: (2025)
HyperLoad: A Cross-Modality Enhanced Large Language Model-Based Framework for Green Data Center Cooling Load Prediction
by: Jiang, Haoyu, et al.
Published: (2025)
by: Jiang, Haoyu, et al.
Published: (2025)
Distributed Interpretability and Control for Large Language Models
by: Desai, Dev Arpan, et al.
Published: (2026)
by: Desai, Dev Arpan, et al.
Published: (2026)
Diversity-oriented Data Augmentation with Large Language Models
by: Wang, Zaitian, et al.
Published: (2025)
by: Wang, Zaitian, et al.
Published: (2025)
Medical Interpretability and Knowledge Maps of Large Language Models
by: Marinescu, Razvan, et al.
Published: (2025)
by: Marinescu, Razvan, et al.
Published: (2025)
Large-Small Model Collaborative Framework for Federated Continual Learning
by: Yu, Hao, et al.
Published: (2025)
by: Yu, Hao, et al.
Published: (2025)
Singular Value Decomposition on Kronecker Adaptation for Large Language Model
by: Chong, Yee Hin, et al.
Published: (2025)
by: Chong, Yee Hin, et al.
Published: (2025)
LEPO: Latent Reasoning Policy Optimization for Large Language Models
by: Zhou, Yuyan, et al.
Published: (2026)
by: Zhou, Yuyan, et al.
Published: (2026)
Exploring Federated Pruning for Large Language Models
by: Guo, Pengxin, et al.
Published: (2025)
by: Guo, Pengxin, et al.
Published: (2025)
Mobility-Aware Cache Framework for Scalable LLM-Based Human Mobility Simulation
by: Yan, Hua, et al.
Published: (2026)
by: Yan, Hua, et al.
Published: (2026)
Learning Interpretable Rules for Scalable Data Representation and Classification
by: Wang, Zhuo, et al.
Published: (2023)
by: Wang, Zhuo, et al.
Published: (2023)
GWT: Scalable Optimizer State Compression for Large Language Model Training
by: Wen, Ziqing, et al.
Published: (2025)
by: Wen, Ziqing, et al.
Published: (2025)
Curriculum Learning-Guided Progressive Distillation in Large Language Models
by: Cao, Jincheng, et al.
Published: (2026)
by: Cao, Jincheng, et al.
Published: (2026)
Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment
by: Liu, Yang, et al.
Published: (2023)
by: Liu, Yang, et al.
Published: (2023)
Self-supervised Pretraining for Decision Foundation Model: Formulation, Pipeline and Challenges
by: Liu, Xiaoqian, et al.
Published: (2023)
by: Liu, Xiaoqian, et al.
Published: (2023)
RACER: Risk-Aware Calibrated Efficient Routing for Large Language Models
by: Hao, Sai, et al.
Published: (2026)
by: Hao, Sai, et al.
Published: (2026)
Evidence-based Distributional Alignment for Large Language Models
by: Pham, Viet-Thanh, et al.
Published: (2026)
by: Pham, Viet-Thanh, et al.
Published: (2026)
Fine-Grained Interpretation of Political Opinions in Large Language Models
by: Hu, Jingyu, et al.
Published: (2025)
by: Hu, Jingyu, et al.
Published: (2025)
FaultExplainer: Leveraging Large Language Models for Interpretable Fault Detection and Diagnosis
by: Khan, Abdullah, et al.
Published: (2024)
by: Khan, Abdullah, et al.
Published: (2024)
Using Mechanistic Interpretability to Craft Adversarial Attacks against Large Language Models
by: Winninger, Thomas, et al.
Published: (2025)
by: Winninger, Thomas, et al.
Published: (2025)
Rethinking Interpretability in the Era of Large Language Models
by: Singh, Chandan, et al.
Published: (2024)
by: Singh, Chandan, et al.
Published: (2024)
COMPOL: A Unified Neural Operator Framework for Scalable Multi-Physics Simulations
by: Sun, Yifei, et al.
Published: (2025)
by: Sun, Yifei, et al.
Published: (2025)
Can Large Language Models Learn Formal Logic? A Data-Driven Training and Evaluation Framework
by: Xia, Yuan, et al.
Published: (2025)
by: Xia, Yuan, et al.
Published: (2025)
A Time Series Multitask Framework Integrating a Large Language Model, Pre-Trained Time Series Model, and Knowledge Graph
by: Hao, Shule, et al.
Published: (2025)
by: Hao, Shule, et al.
Published: (2025)
Towards Green AI in Fine-tuning Large Language Models via Adaptive Backpropagation
by: Huang, Kai, et al.
Published: (2023)
by: Huang, Kai, et al.
Published: (2023)
A Multi-Faceted Evaluation Framework for Assessing Synthetic Data Generated by Large Language Models
by: Yuan, Yefeng, et al.
Published: (2024)
by: Yuan, Yefeng, et al.
Published: (2024)
Variational Language Concepts for Interpreting Foundation Language Models
by: Wang, Hengyi, et al.
Published: (2024)
by: Wang, Hengyi, et al.
Published: (2024)
Towards Interpretable Physical-Conceptual Catchment-Scale Hydrological Modeling using the Mass-Conserving-Perceptron
by: Wang, Yuan-Heng, et al.
Published: (2024)
by: Wang, Yuan-Heng, et al.
Published: (2024)
Scalable Evaluation and Neural Models for Compositional Generalization
by: Camposampiero, Giacomo, et al.
Published: (2025)
by: Camposampiero, Giacomo, et al.
Published: (2025)
Binary Autoencoder for Mechanistic Interpretability of Large Language Models
by: Cho, Hakaze, et al.
Published: (2025)
by: Cho, Hakaze, et al.
Published: (2025)
PalmBench: A Comprehensive Benchmark of Compressed Large Language Models on Mobile Platforms
by: Li, Yilong, et al.
Published: (2024)
by: Li, Yilong, et al.
Published: (2024)
Evaluating Menu OCR and Translation: A Benchmark for Aligning Human and Automated Evaluations in Large Vision-Language Models
by: Wu, Zhanglin, et al.
Published: (2025)
by: Wu, Zhanglin, et al.
Published: (2025)
An Interpretable Automated Mechanism Design Framework with Large Language Models
by: Liu, Jiayuan, et al.
Published: (2025)
by: Liu, Jiayuan, et al.
Published: (2025)
Similar Items
-
InverseScope: Scalable Activation Inversion for Interpreting Large Language Models
by: Luo, Yifan, et al.
Published: (2025) -
LOGIN: A Large Language Model Consulted Graph Neural Network Training Framework
by: Qiao, Yiran, et al.
Published: (2024) -
SUV: Scalable Large Language Model Copyright Compliance with Regularized Selective Unlearning
by: Xu, Tianyang, et al.
Published: (2025) -
Evaluating the Factuality of Large Language Models using Large-Scale Knowledge Graphs
by: Liu, Xiaoze, et al.
Published: (2024) -
HyPAC: Cost-Efficient LLMs-Human Hybrid Annotation with PAC Error Guarantees
by: Zeng, Hao, et al.
Published: (2026)