RepEval: Effective Text Evaluation with LLM Representation
Fuente:
arXiv
Salvato in:
| Autori principali: | Sheng, Shuqian, Xu, Yi, Zhang, Tianhang, Shen, Zanwei, Fu, Luoyi, Ding, Jiaxin, Zhou, Lei, Gan, Xiaoying, Wang, Xinbing, Zhou, Chenghu |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Good Idea or Not, Representation of LLM Could Tell
di: Xu, Yi, et al.
Pubblicazione: (2024)
di: Xu, Yi, et al.
Pubblicazione: (2024)
Is Reference Necessary in the Evaluation of NLG Systems? When and Where?
di: Sheng, Shuqian, et al.
Pubblicazione: (2024)
di: Sheng, Shuqian, et al.
Pubblicazione: (2024)
Improving LLM Reasoning with Homophily-aware Structural and Semantic Text-Attributed Graph Compression
di: Di, Zijun, et al.
Pubblicazione: (2026)
di: Di, Zijun, et al.
Pubblicazione: (2026)
Exterior Penalty Policy Optimization with Penalty Metric Network under Constraints
di: Gao, Shiqing, et al.
Pubblicazione: (2024)
di: Gao, Shiqing, et al.
Pubblicazione: (2024)
AceParse: A Comprehensive Dataset with Diverse Structured Texts for Academic Literature Parsing
di: Ji, Huawei, et al.
Pubblicazione: (2024)
di: Ji, Huawei, et al.
Pubblicazione: (2024)
<SOG_k>: One LLM Token for Explicit Graph Structural Understanding
di: Wu, Jingyao, et al.
Pubblicazione: (2026)
di: Wu, Jingyao, et al.
Pubblicazione: (2026)
RADAR: Reasoning as Discrimination with Aligned Representations for LLM-based Knowledge Graph Reasoning
di: Xue, Bo, et al.
Pubblicazione: (2026)
di: Xue, Bo, et al.
Pubblicazione: (2026)
Characterizing the Influence of Topology on Graph Learning Tasks
di: Wu, Kailong, et al.
Pubblicazione: (2024)
di: Wu, Kailong, et al.
Pubblicazione: (2024)
OXYGENERATOR: Reconstructing Global Ocean Deoxygenation Over a Century with Deep Learning
di: Lu, Bin, et al.
Pubblicazione: (2024)
di: Lu, Bin, et al.
Pubblicazione: (2024)
Controlling Underestimation Bias in Constrained Reinforcement Learning for Safe Exploration
di: Gao, Shiqing, et al.
Pubblicazione: (2026)
di: Gao, Shiqing, et al.
Pubblicazione: (2026)
Scientific and technological knowledge grows linearly over time
di: Kang, Huquan, et al.
Pubblicazione: (2024)
di: Kang, Huquan, et al.
Pubblicazione: (2024)
Inductive Reasoning for Temporal Knowledge Graphs with Emerging Entities
di: Zhao, Ze, et al.
Pubblicazione: (2026)
di: Zhao, Ze, et al.
Pubblicazione: (2026)
AutoFAIR : Automatic Data FAIRification via Machine Reading
di: Ma, Tingyan, et al.
Pubblicazione: (2024)
di: Ma, Tingyan, et al.
Pubblicazione: (2024)
CHAINSFORMER: Numerical Reasoning on Knowledge Graphs from a Chain Perspective
di: Zhao, Ze, et al.
Pubblicazione: (2025)
di: Zhao, Ze, et al.
Pubblicazione: (2025)
FLAME: Empowering Frozen LLMs for Knowledge Graph Completion
di: Xue, Bo, et al.
Pubblicazione: (2024)
di: Xue, Bo, et al.
Pubblicazione: (2024)
Temporal Generalization Estimation in Evolving Graphs
di: Lu, Bin, et al.
Pubblicazione: (2024)
di: Lu, Bin, et al.
Pubblicazione: (2024)
Extreme Value Policy Optimization for Safe Reinforcement Learning
di: Gao, Shiqing, et al.
Pubblicazione: (2026)
di: Gao, Shiqing, et al.
Pubblicazione: (2026)
VisPCO: Visual Token Pruning Configuration Optimization via Budget-Aware Pareto-Frontier Learning for Vision-Language Models
di: Ji, Huawei, et al.
Pubblicazione: (2026)
di: Ji, Huawei, et al.
Pubblicazione: (2026)
Bayesian Cross-Modal Alignment Learning for Few-Shot Out-of-Distribution Generalization
di: Zhu, Lin, et al.
Pubblicazione: (2025)
di: Zhu, Lin, et al.
Pubblicazione: (2025)
MTSCI: A Conditional Diffusion Model for Multivariate Time Series Consistent Imputation
di: Zhou, Jianping, et al.
Pubblicazione: (2024)
di: Zhou, Jianping, et al.
Pubblicazione: (2024)
LEAP: Unlocking dLLM Parallelism via Lookahead Early-Convergence Token Detection
di: Zhang, Haohui, et al.
Pubblicazione: (2026)
di: Zhang, Haohui, et al.
Pubblicazione: (2026)
Graph Parsing Networks
di: Song, Yunchong, et al.
Pubblicazione: (2024)
di: Song, Yunchong, et al.
Pubblicazione: (2024)
Less is More: Masking Elements in Image Condition Features Avoids Content Leakages in Style Transfer Diffusion Models
di: Zhu, Lin, et al.
Pubblicazione: (2025)
di: Zhu, Lin, et al.
Pubblicazione: (2025)
SLASH the Sink: Sharpening Structural Attention Inside LLMs
di: Liu, Yiming, et al.
Pubblicazione: (2026)
di: Liu, Yiming, et al.
Pubblicazione: (2026)
Compass: Navigating Global Marine Lead Data Integration through Expert-Guided LLM Agent
di: Liu, Yiming, et al.
Pubblicazione: (2026)
di: Liu, Yiming, et al.
Pubblicazione: (2026)
GeoViz: A Multi-View Visualization Platform for Spatio-temporal Knowledge Graph
di: Zhou, Jianping, et al.
Pubblicazione: (2024)
di: Zhou, Jianping, et al.
Pubblicazione: (2024)
Towards Controlled Table-to-Text Generation with Scientific Reasoning
di: Guo, Zhixin, et al.
Pubblicazione: (2023)
di: Guo, Zhixin, et al.
Pubblicazione: (2023)
HarmMetric Eval: Benchmarking Metrics and Judges for LLM Harmfulness Assessment
di: Yang, Langqi, et al.
Pubblicazione: (2025)
di: Yang, Langqi, et al.
Pubblicazione: (2025)
SQLStructEval: Structural Evaluation of LLM Text-to-SQL Generation
di: Zhou, Yixi, et al.
Pubblicazione: (2026)
di: Zhou, Yixi, et al.
Pubblicazione: (2026)
Lambda: Learning Matchable Prior For Entity Alignment with Unlabeled Dangling Cases
di: Yin, Hang, et al.
Pubblicazione: (2024)
di: Yin, Hang, et al.
Pubblicazione: (2024)
Rep2Text: Decoding Full Text from a Single LLM Token Representation
di: Zhao, Haiyan, et al.
Pubblicazione: (2025)
di: Zhao, Haiyan, et al.
Pubblicazione: (2025)
Structured In-context Environment Scaling for Large Language Model Reasoning
di: Yu, Peng, et al.
Pubblicazione: (2025)
di: Yu, Peng, et al.
Pubblicazione: (2025)
G-NAS: Generalizable Neural Architecture Search for Single Domain Generalization Object Detection
di: Wu, Fan, et al.
Pubblicazione: (2024)
di: Wu, Fan, et al.
Pubblicazione: (2024)
GeoGalactica: A Scientific Large Language Model in Geoscience
di: Lin, Zhouhan, et al.
Pubblicazione: (2023)
di: Lin, Zhouhan, et al.
Pubblicazione: (2023)
HuRef: HUman-REadable Fingerprint for Large Language Models
di: Zeng, Boyi, et al.
Pubblicazione: (2023)
di: Zeng, Boyi, et al.
Pubblicazione: (2023)
Sm-Nd Isotope Data Compilation from Geoscientific Literature Using an Automated Tabular Extraction Method
di: Guo, Zhixin, et al.
Pubblicazione: (2024)
di: Guo, Zhixin, et al.
Pubblicazione: (2024)
Rethinking Efficient Graph Coarsening via a Non-Selfishness Principle
di: Bai, Xu, et al.
Pubblicazione: (2026)
di: Bai, Xu, et al.
Pubblicazione: (2026)
AceMap: Knowledge Discovery through Academic Graph
di: Wang, Xinbing, et al.
Pubblicazione: (2024)
di: Wang, Xinbing, et al.
Pubblicazione: (2024)
One-Eval: An Agentic System for Automated and Traceable LLM Evaluation
di: Shen, Chengyu, et al.
Pubblicazione: (2026)
di: Shen, Chengyu, et al.
Pubblicazione: (2026)
SycEval: Evaluating LLM Sycophancy
di: Fanous, Aaron, et al.
Pubblicazione: (2025)
di: Fanous, Aaron, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Good Idea or Not, Representation of LLM Could Tell
di: Xu, Yi, et al.
Pubblicazione: (2024) -
Is Reference Necessary in the Evaluation of NLG Systems? When and Where?
di: Sheng, Shuqian, et al.
Pubblicazione: (2024) -
Improving LLM Reasoning with Homophily-aware Structural and Semantic Text-Attributed Graph Compression
di: Di, Zijun, et al.
Pubblicazione: (2026) -
Exterior Penalty Policy Optimization with Penalty Metric Network under Constraints
di: Gao, Shiqing, et al.
Pubblicazione: (2024) -
AceParse: A Comprehensive Dataset with Diverse Structured Texts for Academic Literature Parsing
di: Ji, Huawei, et al.
Pubblicazione: (2024)