GraphEval: A Lightweight Graph-Based LLM Framework for Idea Evaluation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Feng, Tao, Sun, Yihang, You, Jiaxuan |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
GraphEval: A Knowledge-Graph Based LLM Hallucination Evaluation Framework
par: Sansford, Hannah, et autres
Publié: (2024)
par: Sansford, Hannah, et autres
Publié: (2024)
GMTRouter: Personalized LLM Router over Multi-turn User Interactions
par: Xie, Encheng, et autres
Publié: (2025)
par: Xie, Encheng, et autres
Publié: (2025)
PersonalizedRouter: Personalized LLM Routing via Graph-based User Preference Modeling
par: Dai, Zhongjie, et autres
Publié: (2025)
par: Dai, Zhongjie, et autres
Publié: (2025)
AcademicEval: Live Long-Context LLM Benchmark
par: Zhang, Haozhen, et autres
Publié: (2025)
par: Zhang, Haozhen, et autres
Publié: (2025)
GraphEval36K: Benchmarking Coding and Reasoning Capabilities of Large Language Models on Graph Datasets
par: Wu, Qiming, et autres
Publié: (2024)
par: Wu, Qiming, et autres
Publié: (2024)
Graph World Model
par: Feng, Tao, et autres
Publié: (2025)
par: Feng, Tao, et autres
Publié: (2025)
Graph of Records: Boosting Retrieval Augmented Generation for Long-context Summarization with Graphs
par: Zhang, Haozhen, et autres
Publié: (2024)
par: Zhang, Haozhen, et autres
Publié: (2024)
MemReward: Graph-Based Experience Memory for LLM Reward Prediction with Limited Labels
par: Luo, Tianyang, et autres
Publié: (2026)
par: Luo, Tianyang, et autres
Publié: (2026)
ResearchArcade: Graph Interface for Academic Tasks
par: Xu, Jingjun, et autres
Publié: (2025)
par: Xu, Jingjun, et autres
Publié: (2025)
DiagramEval: Evaluating LLM-Generated Diagrams via Graphs
par: Liang, Chumeng, et autres
Publié: (2025)
par: Liang, Chumeng, et autres
Publié: (2025)
ScholarEval: Research Idea Evaluation Grounded in Literature
par: Moussa, Hanane Nour, et autres
Publié: (2025)
par: Moussa, Hanane Nour, et autres
Publié: (2025)
ThinkEval: Practical Evaluation of Knowledge Leakage in LLM Editing using Thought-based Knowledge Graphs
par: Baser, Manit, et autres
Publié: (2025)
par: Baser, Manit, et autres
Publié: (2025)
Probing the Knowledge Boundary: An Interactive Agentic Framework for Deep Knowledge Extraction
par: Yang, Yuheng, et autres
Publié: (2026)
par: Yang, Yuheng, et autres
Publié: (2026)
GraphRouter: A Graph-based Router for LLM Selections
par: Feng, Tao, et autres
Publié: (2024)
par: Feng, Tao, et autres
Publié: (2024)
Router-R1: Teaching LLMs Multi-Round Routing and Aggregation via Reinforcement Learning
par: Zhang, Haozhen, et autres
Publié: (2025)
par: Zhang, Haozhen, et autres
Publié: (2025)
FusionFactory: Fusing LLM Capabilities with Multi-LLM Log Data
par: Feng, Tao, et autres
Publié: (2025)
par: Feng, Tao, et autres
Publié: (2025)
Debugging Tabular Log as Dynamic Graphs
par: Liang, Chumeng, et autres
Publié: (2025)
par: Liang, Chumeng, et autres
Publié: (2025)
InfiCoEvalChain: A Blockchain-Based Decentralized Framework for Collaborative LLM Evaluation
par: Yang, Yifan, et autres
Publié: (2026)
par: Yang, Yifan, et autres
Publié: (2026)
GUIDE: Towards Scalable Advising for Research Ideas
par: Liu, Yaowenqi, et autres
Publié: (2025)
par: Liu, Yaowenqi, et autres
Publié: (2025)
A Topology-aware Graph Coarsening Framework for Continual Graph Learning
par: Han, Xiaoxue, et autres
Publié: (2024)
par: Han, Xiaoxue, et autres
Publié: (2024)
Learning Dynamic Graphs via Tensorized and Lightweight Graph Convolutional Networks
par: Han, Minglian
Publié: (2025)
par: Han, Minglian
Publié: (2025)
Eval Factsheets: A Structured Framework for Documenting AI Evaluations
par: Bordes, Florian, et autres
Publié: (2025)
par: Bordes, Florian, et autres
Publié: (2025)
A Spectral Framework for Evaluating Geodesic Distances Between Graphs
par: Shuvo, Soumen Sikder, et autres
Publié: (2024)
par: Shuvo, Soumen Sikder, et autres
Publié: (2024)
Network Distance Based on Laplacian Flows on Graphs
par: Bao, Dianbin, et autres
Publié: (2018)
par: Bao, Dianbin, et autres
Publié: (2018)
TinyGraphEstimator: Adapting Lightweight Language Models for Graph Structure Inference
par: Podstawski, Michal
Publié: (2025)
par: Podstawski, Michal
Publié: (2025)
GraphFlow: A Graph-Based Workflow Management for Efficient LLM-Agent Serving
par: Li, Ao, et autres
Publié: (2026)
par: Li, Ao, et autres
Publié: (2026)
CEGRL-TKGR: A Causal Enhanced Graph Representation Learning Framework for Temporal Knowledge Graph Reasoning
par: Sun, Jinze, et autres
Publié: (2024)
par: Sun, Jinze, et autres
Publié: (2024)
Real-World Benchmarks Make Membership Inference Attacks Fail on Diffusion Models
par: Liang, Chumeng, et autres
Publié: (2024)
par: Liang, Chumeng, et autres
Publié: (2024)
R1-Ranker: Teaching LLM Rankers to Reason
par: Feng, Tao, et autres
Publié: (2025)
par: Feng, Tao, et autres
Publié: (2025)
Metric Embedding Initialization-Based Differentially Private and Explainable Graph Clustering
par: You, Haochen, et autres
Publié: (2025)
par: You, Haochen, et autres
Publié: (2025)
DRPG (Decompose, Retrieve, Plan, Generate): An Agentic Framework for Academic Rebuttal
par: Han, Peixuan, et autres
Publié: (2026)
par: Han, Peixuan, et autres
Publié: (2026)
MicroEvoEval: A Systematic Evaluation Framework for Image-Based Microstructure Evolution Prediction
par: Zhang, Qinyi, et autres
Publié: (2025)
par: Zhang, Qinyi, et autres
Publié: (2025)
AGALE: A Graph-Aware Continual Learning Evaluation Framework
par: Zhao, Tianqi, et autres
Publié: (2024)
par: Zhao, Tianqi, et autres
Publié: (2024)
Bridging Domain Adaptation and Graph Neural Networks: A Tensor-Based Framework for Effective Label Propagation
par: Wen, Tao, et autres
Publié: (2025)
par: Wen, Tao, et autres
Publié: (2025)
KG4RecEval: Does Knowledge Graph Really Matter for Recommender Systems?
par: Zhang, Haonan, et autres
Publié: (2024)
par: Zhang, Haonan, et autres
Publié: (2024)
SamGoG: A Sampling-Based Graph-of-Graphs Framework for Imbalanced Graph Classification
par: Wang, Shangyou, et autres
Publié: (2025)
par: Wang, Shangyou, et autres
Publié: (2025)
GraphProp: Training the Graph Foundation Models using Graph Properties
par: Sun, Ziheng, et autres
Publié: (2025)
par: Sun, Ziheng, et autres
Publié: (2025)
EvalQReason: A Framework for Step-Level Reasoning Evaluation in Large Language Models
par: Freja, Shaima Ahmad, et autres
Publié: (2026)
par: Freja, Shaima Ahmad, et autres
Publié: (2026)
GraphVec: Cross-Domain Graph Vectorization for Graph-Level Representation Learning
par: Feng, Qi, et autres
Publié: (2026)
par: Feng, Qi, et autres
Publié: (2026)
RxEval: A Prescription-Level Benchmark for Evaluating LLM Medication Recommendation
par: Chen, Shuhao, et autres
Publié: (2026)
par: Chen, Shuhao, et autres
Publié: (2026)
Documents similaires
-
GraphEval: A Knowledge-Graph Based LLM Hallucination Evaluation Framework
par: Sansford, Hannah, et autres
Publié: (2024) -
GMTRouter: Personalized LLM Router over Multi-turn User Interactions
par: Xie, Encheng, et autres
Publié: (2025) -
PersonalizedRouter: Personalized LLM Routing via Graph-based User Preference Modeling
par: Dai, Zhongjie, et autres
Publié: (2025) -
AcademicEval: Live Long-Context LLM Benchmark
par: Zhang, Haozhen, et autres
Publié: (2025) -
GraphEval36K: Benchmarking Coding and Reasoning Capabilities of Large Language Models on Graph Datasets
par: Wu, Qiming, et autres
Publié: (2024)