SPARK: Self-Play with Asymmetric Reward from Knowledge Graphs
Fuente:
arXiv
Saved in:
| Main Authors: | Park, Hyobin, Kim, Taeseop, Choi, Dong-Geol |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Rethinking Electro-Optical Vision Foundation Models for Remote Sensing Retrieval: A Controlled Comparison with Generalist VFM
by: Park, Hyobin, et al.
Published: (2026)
by: Park, Hyobin, et al.
Published: (2026)
AIS-LLM: A Unified Framework for Maritime Trajectory Prediction, Anomaly Detection, and Collision Risk Assessment with Explainable Forecasting
by: Park, Hyobin, et al.
Published: (2025)
by: Park, Hyobin, et al.
Published: (2025)
SPARK: Search Personalization via Agent-Driven Retrieval and Knowledge-sharing
by: Chhetri, Gaurab, et al.
Published: (2025)
by: Chhetri, Gaurab, et al.
Published: (2025)
PBVS 2024 Solution: Self-Supervised Learning and Sampling Strategies for SAR Classification in Extreme Long-Tail Distribution
by: Kim, Yuhyun, et al.
Published: (2024)
by: Kim, Yuhyun, et al.
Published: (2024)
SPARK: Stepwise Process-Aware Rewards for Reference-Free Reinforcement Learning
by: Rahman, Salman, et al.
Published: (2025)
by: Rahman, Salman, et al.
Published: (2025)
Ignite Forecasting with SPARK: An Efficient Generative Framework for Refining LLMs in Temporal Knowledge Graph Forecasting
by: Yin, Gongzhu, et al.
Published: (2025)
by: Yin, Gongzhu, et al.
Published: (2025)
LoTa-Bench: Benchmarking Language-oriented Task Planners for Embodied Agents
by: Choi, Jae-Woo, et al.
Published: (2024)
by: Choi, Jae-Woo, et al.
Published: (2024)
ReAcTree: Hierarchical LLM Agent Trees with Control Flow for Long-Horizon Task Planning
by: Choi, Jae-Woo, et al.
Published: (2025)
by: Choi, Jae-Woo, et al.
Published: (2025)
GeoX: Mastering Geospatial Reasoning Through Self-Play and Verifiable Rewards
by: Ahn, Kyeongjin, et al.
Published: (2026)
by: Ahn, Kyeongjin, et al.
Published: (2026)
Rewarding Explainability in Drug Repurposing with Knowledge Graphs
by: Nunes, Susana, et al.
Published: (2025)
by: Nunes, Susana, et al.
Published: (2025)
Graph Convolutions Enrich the Self-Attention in Transformers!
by: Choi, Jeongwhan, et al.
Published: (2023)
by: Choi, Jeongwhan, et al.
Published: (2023)
RSCF: Relation-Semantics Consistent Filter for Entity Embedding of Knowledge Graph
by: Kim, Junsik, et al.
Published: (2025)
by: Kim, Junsik, et al.
Published: (2025)
AMXFP4: Taming Activation Outliers with Asymmetric Microscaling Floating-Point for 4-bit LLM Inference
by: Lee, Janghwan, et al.
Published: (2024)
by: Lee, Janghwan, et al.
Published: (2024)
Knowledge Graph-enhanced Large Language Model for Incremental Game PlayTesting
by: Mu, Enhong, et al.
Published: (2025)
by: Mu, Enhong, et al.
Published: (2025)
ProgRAG: Hallucination-Resistant Progressive Retrieval and Reasoning over Knowledge Graphs
by: Park, Minbae, et al.
Published: (2025)
by: Park, Minbae, et al.
Published: (2025)
Verifying LLM-Generated Code in the Context of Software Verification with Ada/SPARK
by: Cramer, Marcos, et al.
Published: (2025)
by: Cramer, Marcos, et al.
Published: (2025)
Mol-AIR: Molecular Reinforcement Learning with Adaptive Intrinsic Rewards for Goal-directed Molecular Generation
by: Park, Jinyeong, et al.
Published: (2024)
by: Park, Jinyeong, et al.
Published: (2024)
Reward-Decomposed Reinforcement Learning for Immersive Video Role-Playing
by: Wang, Miao, et al.
Published: (2026)
by: Wang, Miao, et al.
Published: (2026)
R2-KG: General-Purpose Dual-Agent Framework for Reliable Reasoning on Knowledge Graphs
by: Jo, Sumin, et al.
Published: (2025)
by: Jo, Sumin, et al.
Published: (2025)
Self-HarmLLM: Can Large Language Model Harm Itself?
by: Kim, Heehwan, et al.
Published: (2025)
by: Kim, Heehwan, et al.
Published: (2025)
Enhancing Multi-Hop Knowledge Graph Reasoning through Reward Shaping Techniques
by: Li, Chen, et al.
Published: (2024)
by: Li, Chen, et al.
Published: (2024)
Context-Robust Knowledge Editing for Language Models
by: Park, Haewon, et al.
Published: (2025)
by: Park, Haewon, et al.
Published: (2025)
ReGraM: Region-First Knowledge Graph Reasoning for Medical Question Answering
by: Lee, Chaerin, et al.
Published: (2026)
by: Lee, Chaerin, et al.
Published: (2026)
Generative Subgraph Retrieval for Knowledge Graph-Grounded Dialog Generation
by: Park, Jinyoung, et al.
Published: (2024)
by: Park, Jinyoung, et al.
Published: (2024)
PAIR: Prefix-Aware Internal Reward Model for Multi-Turn Agent Optimization
by: Kim, Wonjoong, et al.
Published: (2026)
by: Kim, Wonjoong, et al.
Published: (2026)
Self-Consistency of the Internal Reward Models Improves Self-Rewarding Language Models
by: Zhou, Xin, et al.
Published: (2025)
by: Zhou, Xin, et al.
Published: (2025)
Dynamic Context Adaptation for Consistent Role-Playing Agents with Retrieval-Augmented Generations
by: Park, Jeiyoon, et al.
Published: (2025)
by: Park, Jeiyoon, et al.
Published: (2025)
MAGE-KT: Multi-Agent Graph-Enhanced Knowledge Tracing with Subgraph Retrieval and Asymmetric Fusion
by: Yu, Chi, et al.
Published: (2026)
by: Yu, Chi, et al.
Published: (2026)
Brittleness and Promise: Knowledge Graph Based Reward Modeling for Diagnostic Reasoning
by: Khatwani, Saksham, et al.
Published: (2025)
by: Khatwani, Saksham, et al.
Published: (2025)
Self-Knowledge Distillation for Learning Ambiguity
by: Park, Hancheol, et al.
Published: (2024)
by: Park, Hancheol, et al.
Published: (2024)
SCPRM: A Schema-aware Cumulative Process Reward Model for Knowledge Graph Question Answering
by: Chen, Jiujiu, et al.
Published: (2026)
by: Chen, Jiujiu, et al.
Published: (2026)
Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration
by: Zhang, Qifan, et al.
Published: (2026)
by: Zhang, Qifan, et al.
Published: (2026)
DSLR: Diversity Enhancement and Structure Learning for Rehearsal-based Graph Continual Learning
by: Choi, Seungyoon, et al.
Published: (2024)
by: Choi, Seungyoon, et al.
Published: (2024)
THINKSAFE: Self-Generated Safety Alignment for Reasoning Models
by: Lee, Seanie, et al.
Published: (2026)
by: Lee, Seanie, et al.
Published: (2026)
Can TabPFN Compete with GNNs for Node Classification via Graph Tabularization?
by: Choi, Jeongwhan, et al.
Published: (2025)
by: Choi, Jeongwhan, et al.
Published: (2025)
Plan-on-Graph: Self-Correcting Adaptive Planning of Large Language Model on Knowledge Graphs
by: Chen, Liyi, et al.
Published: (2024)
by: Chen, Liyi, et al.
Published: (2024)
Unveiling the Significance of Toddler-Inspired Reward Transition in Goal-Oriented Reinforcement Learning
by: Park, Junseok, et al.
Published: (2024)
by: Park, Junseok, et al.
Published: (2024)
Improving Multi-hop Logical Reasoning in Knowledge Graphs with Context-Aware Query Representation Learning
by: Kim, Jeonghoon, et al.
Published: (2024)
by: Kim, Jeonghoon, et al.
Published: (2024)
GOPO: Policy Optimization using Ranked Rewards
by: Choi, Kyuseong, et al.
Published: (2026)
by: Choi, Kyuseong, et al.
Published: (2026)
Knowledge Graphs are Implicit Reward Models: Path-Derived Signals Enable Compositional Reasoning
by: Kansal, Yuval, et al.
Published: (2026)
by: Kansal, Yuval, et al.
Published: (2026)
Similar Items
-
Rethinking Electro-Optical Vision Foundation Models for Remote Sensing Retrieval: A Controlled Comparison with Generalist VFM
by: Park, Hyobin, et al.
Published: (2026) -
AIS-LLM: A Unified Framework for Maritime Trajectory Prediction, Anomaly Detection, and Collision Risk Assessment with Explainable Forecasting
by: Park, Hyobin, et al.
Published: (2025) -
SPARK: Search Personalization via Agent-Driven Retrieval and Knowledge-sharing
by: Chhetri, Gaurab, et al.
Published: (2025) -
PBVS 2024 Solution: Self-Supervised Learning and Sampling Strategies for SAR Classification in Extreme Long-Tail Distribution
by: Kim, Yuhyun, et al.
Published: (2024) -
SPARK: Stepwise Process-Aware Rewards for Reference-Free Reinforcement Learning
by: Rahman, Salman, et al.
Published: (2025)