Graph-KV: Breaking Sequence via Injecting Structural Biases into Large Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Wang, Haoyu, Wang, Peihao, Li, Mufei, Liu, Shikun, Miao, Siqi, Wang, Zhangyang, Li, Pan |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Struc-EMB: The Potential of Structure-Aware Encoding in Language Embeddings
por: Liu, Shikun, et al.
Publicado: (2025)
por: Liu, Shikun, et al.
Publicado: (2025)
Simple Is Effective: The Roles of Graphs and Large Language Models in Knowledge-Graph-Based Retrieval-Augmented Generation
por: Li, Mufei, et al.
Publicado: (2024)
por: Li, Mufei, et al.
Publicado: (2024)
Model Generalization on Text Attribute Graphs: Principles with Large Language Models
por: Wang, Haoyu, et al.
Publicado: (2025)
por: Wang, Haoyu, et al.
Publicado: (2025)
Why Neural Network Can Discover Symbolic Structures with Gradient-based Training: An Algebraic and Geometric Foundation for Neurosymbolic Reasoning
por: Wang, Peihao, et al.
Publicado: (2025)
por: Wang, Peihao, et al.
Publicado: (2025)
Polynomial Width is Sufficient for Set Representation with High-dimensional Features
por: Wang, Peihao, et al.
Publicado: (2023)
por: Wang, Peihao, et al.
Publicado: (2023)
When Do Graph Foundation Models Transfer? A Data-Centric Theory
por: Zhu, Jiajun, et al.
Publicado: (2026)
por: Zhu, Jiajun, et al.
Publicado: (2026)
GraphMaker: Can Diffusion Models Generate Large Attributed Graphs?
por: Li, Mufei, et al.
Publicado: (2023)
por: Li, Mufei, et al.
Publicado: (2023)
Generalization Error Analysis for Sparse Mixture-of-Experts: A Preliminary Study
por: Zhao, Jinze, et al.
Publicado: (2024)
por: Zhao, Jinze, et al.
Publicado: (2024)
$\nabla$-Reasoner: LLM Reasoning via Test-Time Gradient Descent in Latent Space
por: Wang, Peihao, et al.
Publicado: (2026)
por: Wang, Peihao, et al.
Publicado: (2026)
Rethinking Addressing in Language Models via Contexualized Equivariant Positional Encoding
por: Zhu, Jiajun, et al.
Publicado: (2025)
por: Zhu, Jiajun, et al.
Publicado: (2025)
Towards A Universal Graph Structural Encoder
por: Chen, Jialin, et al.
Publicado: (2025)
por: Chen, Jialin, et al.
Publicado: (2025)
Position: Weight Space Should Be a First-Class Generative AI Modality
por: Wang, Zhangyang, et al.
Publicado: (2026)
por: Wang, Zhangyang, et al.
Publicado: (2026)
Understanding and Mitigating Bottlenecks of State Space Models through the Lens of Recency and Over-smoothing
por: Wang, Peihao, et al.
Publicado: (2024)
por: Wang, Peihao, et al.
Publicado: (2024)
Injecting Knowledge Graphs into Large Language Models
por: Coppolillo, Erica
Publicado: (2025)
por: Coppolillo, Erica
Publicado: (2025)
What Can We Learn from State Space Models for Machine Learning on Graphs?
por: Huang, Yinan, et al.
Publicado: (2024)
por: Huang, Yinan, et al.
Publicado: (2024)
Meta ControlNet: Enhancing Task Adaptation via Meta Learning
por: Yang, Junjie, et al.
Publicado: (2023)
por: Yang, Junjie, et al.
Publicado: (2023)
Structural Alignment Improves Graph Test-Time Adaptation
por: Hsu, Hans Hao-Hsun, et al.
Publicado: (2025)
por: Hsu, Hans Hao-Hsun, et al.
Publicado: (2025)
LouisKV: Efficient KV Cache Retrieval for Long Input-Output Sequences
por: Wu, Wenbo, et al.
Publicado: (2025)
por: Wu, Wenbo, et al.
Publicado: (2025)
LLM4XCE: Large Language Models for Extremely Large-Scale Massive MIMO Channel Estimation
por: Li, Renbin, et al.
Publicado: (2025)
por: Li, Renbin, et al.
Publicado: (2025)
GeSS: Benchmarking Geometric Deep Learning under Scientific Applications with Distribution Shifts
por: Zou, Deyu, et al.
Publicado: (2023)
por: Zou, Deyu, et al.
Publicado: (2023)
What Are Good Positional Encodings for Directed Graphs?
por: Huang, Yinan, et al.
Publicado: (2024)
por: Huang, Yinan, et al.
Publicado: (2024)
CommonKV: Compressing KV Cache with Cross-layer Parameter Sharing
por: Wang, Yixuan, et al.
Publicado: (2025)
por: Wang, Yixuan, et al.
Publicado: (2025)
LLaGA: Large Language and Graph Assistant
por: Chen, Runjin, et al.
Publicado: (2024)
por: Chen, Runjin, et al.
Publicado: (2024)
Underestimated Privacy Risks for Minority Populations in Large Language Model Unlearning
por: Wei, Rongzhe, et al.
Publicado: (2024)
por: Wei, Rongzhe, et al.
Publicado: (2024)
Pairwise Alignment Improves Graph Domain Adaptation
por: Liu, Shikun, et al.
Publicado: (2024)
por: Liu, Shikun, et al.
Publicado: (2024)
Enhancing Large Language Models for Time-Series Forecasting via Vector-Injected In-Context Learning
por: Zhang, Jianqi, et al.
Publicado: (2026)
por: Zhang, Jianqi, et al.
Publicado: (2026)
CausalTAD: Injecting Causal Knowledge into Large Language Models for Tabular Anomaly Detection
por: Wang, Ruiqi, et al.
Publicado: (2026)
por: Wang, Ruiqi, et al.
Publicado: (2026)
Beyond Test-Time Memory: State-Space Optimal Control for LLM Reasoning
por: Wang, Peihao, et al.
Publicado: (2026)
por: Wang, Peihao, et al.
Publicado: (2026)
ALISA: Accelerating Large Language Model Inference via Sparsity-Aware KV Caching
por: Zhao, Youpeng, et al.
Publicado: (2024)
por: Zhao, Youpeng, et al.
Publicado: (2024)
Enhancing Large Multimodal Models with Adaptive Sparsity and KV Cache Compression
por: Zhang, Te, et al.
Publicado: (2025)
por: Zhang, Te, et al.
Publicado: (2025)
LongVQ: Long Sequence Modeling with Vector Quantization on Structured Memory
por: Liu, Zicheng, et al.
Publicado: (2024)
por: Liu, Zicheng, et al.
Publicado: (2024)
A Benchmark on Directed Graph Representation Learning in Hardware Designs
por: Wang, Haoyu, et al.
Publicado: (2024)
por: Wang, Haoyu, et al.
Publicado: (2024)
Transformers Are Born Biased: Structural Inductive Biases at Random Initialization and Their Practical Consequences
por: Li, Siquan, et al.
Publicado: (2026)
por: Li, Siquan, et al.
Publicado: (2026)
KV-CAR: KV Cache Compression using Autoencoders and KV Reuse in Large Language Models
por: Roy, Sourjya, et al.
Publicado: (2025)
por: Roy, Sourjya, et al.
Publicado: (2025)
CausalGaze: Unveiling Hallucinations via Counterfactual Graph Intervention in Large Language Models
por: Kong, Linggang, et al.
Publicado: (2026)
por: Kong, Linggang, et al.
Publicado: (2026)
Unlocking Graph Structure Learning with Tree-Guided Large Language Models
por: Zhang, Zhihan, et al.
Publicado: (2025)
por: Zhang, Zhihan, et al.
Publicado: (2025)
Model-Editing-Based Jailbreak against Safety-aligned Large Language Models
por: Li, Yuxi, et al.
Publicado: (2024)
por: Li, Yuxi, et al.
Publicado: (2024)
FlexSP: Accelerating Large Language Model Training via Flexible Sequence Parallelism
por: Wang, Yujie, et al.
Publicado: (2024)
por: Wang, Yujie, et al.
Publicado: (2024)
IceCache: Memory-efficient KV-cache Management for Long-Sequence LLMs
por: Mao, Yuzhen, et al.
Publicado: (2026)
por: Mao, Yuzhen, et al.
Publicado: (2026)
DecepChain: Inducing Deceptive Reasoning in Large Language Models
por: Shen, Wei, et al.
Publicado: (2025)
por: Shen, Wei, et al.
Publicado: (2025)
Ejemplares similares
-
Struc-EMB: The Potential of Structure-Aware Encoding in Language Embeddings
por: Liu, Shikun, et al.
Publicado: (2025) -
Simple Is Effective: The Roles of Graphs and Large Language Models in Knowledge-Graph-Based Retrieval-Augmented Generation
por: Li, Mufei, et al.
Publicado: (2024) -
Model Generalization on Text Attribute Graphs: Principles with Large Language Models
por: Wang, Haoyu, et al.
Publicado: (2025) -
Why Neural Network Can Discover Symbolic Structures with Gradient-based Training: An Algebraic and Geometric Foundation for Neurosymbolic Reasoning
por: Wang, Peihao, et al.
Publicado: (2025) -
Polynomial Width is Sufficient for Set Representation with High-dimensional Features
por: Wang, Peihao, et al.
Publicado: (2023)