DENIAHL: In-Context Features Influence LLM Needle-In-A-Haystack Abilities
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Dai, Hui, Pechi, Dan, Yang, Xinyi, Banga, Garvit, Mantri, Raghav |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
RoboSignature: Robust Signature and Watermarking on Network Attacks
par: Shaan, Aryaman, et autres
Publié: (2024)
par: Shaan, Aryaman, et autres
Publié: (2024)
Needle in the Haystack for Memory Based Large Language Models
par: Nelson, Elliot, et autres
Publié: (2024)
par: Nelson, Elliot, et autres
Publié: (2024)
Hidden in the Haystack: Smaller Needles are More Difficult for LLMs to Find
par: Bianchi, Owen, et autres
Publié: (2025)
par: Bianchi, Owen, et autres
Publié: (2025)
When Every Token Counts: Optimal Segmentation for Low-Resource Language Models
par: Raj, Bharath, et autres
Publié: (2024)
par: Raj, Bharath, et autres
Publié: (2024)
From Haystack to Needle: Label Space Reduction for Zero-shot Classification
par: Vandemoortele, Nathan, et autres
Publié: (2025)
par: Vandemoortele, Nathan, et autres
Publié: (2025)
Multimodal Needle in a Haystack: Benchmarking Long-Context Capability of Multimodal Large Language Models
par: Wang, Hengyi, et autres
Publié: (2024)
par: Wang, Hengyi, et autres
Publié: (2024)
In Search of Needles in a 11M Haystack: Recurrent Memory Finds What LLMs Miss
par: Kuratov, Yuri, et autres
Publié: (2024)
par: Kuratov, Yuri, et autres
Publié: (2024)
From Artificial Needles to Real Haystacks: Improving Retrieval Capabilities in LLMs by Finetuning on Synthetic Data
par: Xiong, Zheyang, et autres
Publié: (2024)
par: Xiong, Zheyang, et autres
Publié: (2024)
Semantic Needles in Document Haystacks: Sensitivity Testing of LLM-as-a-Judge Similarity Scoring
par: Aksoy, Sinan G., et autres
Publié: (2026)
par: Aksoy, Sinan G., et autres
Publié: (2026)
Stress-Testing Long-Context Language Models with Lifelong ICL and Task Haystack
par: Xu, Xiaoyue, et autres
Publié: (2024)
par: Xu, Xiaoyue, et autres
Publié: (2024)
Document Haystack: A Long Context Multimodal Image/Document Understanding Vision LLM Benchmark
par: Huybrechts, Goeric, et autres
Publié: (2025)
par: Huybrechts, Goeric, et autres
Publié: (2025)
Reasoning on Multiple Needles In A Haystack
par: Wang, Yidong
Publié: (2025)
par: Wang, Yidong
Publié: (2025)
Jailbreaking in the Haystack
par: Shah, Rishi Rajesh, et autres
Publié: (2025)
par: Shah, Rishi Rajesh, et autres
Publié: (2025)
Multilingual Needle in a Haystack: Investigating Long-Context Behavior of Multilingual Large Language Models
par: Hengle, Amey, et autres
Publié: (2024)
par: Hengle, Amey, et autres
Publié: (2024)
Longer Context, Deeper Thinking: Uncovering the Role of Long-Context Ability in Reasoning
par: Yang, Wang, et autres
Publié: (2025)
par: Yang, Wang, et autres
Publié: (2025)
100-LongBench: Are de facto Long-Context Benchmarks Literally Evaluating Long-Context Ability?
par: Yang, Wang, et autres
Publié: (2025)
par: Yang, Wang, et autres
Publié: (2025)
Understanding Reasoning Ability of Language Models From the Perspective of Reasoning Paths Aggregation
par: Wang, Xinyi, et autres
Publié: (2024)
par: Wang, Xinyi, et autres
Publié: (2024)
An Empirical Study on Context Length for Open-Domain Dialog Generation
par: Shen, Xinyi, et autres
Publié: (2024)
par: Shen, Xinyi, et autres
Publié: (2024)
Beyond Needle(s) in the Embodied Haystack: Environment, Architecture, and Training Considerations for Long Context Reasoning
par: Kim, Bosung, et autres
Publié: (2025)
par: Kim, Bosung, et autres
Publié: (2025)
Aligning LLMs with Human Uncertainty: A Beta-Bernoulli Calibrator for LLM Forecasting
par: Dai, Hui, et autres
Publié: (2026)
par: Dai, Hui, et autres
Publié: (2026)
Large Language Models Are Latent Variable Models: Explaining and Finding Good Demonstrations for In-Context Learning
par: Wang, Xinyi, et autres
Publié: (2023)
par: Wang, Xinyi, et autres
Publié: (2023)
Losing Visual Needles in Image Haystacks: Vision Language Models are Easily Distracted in Short and Long Contexts
par: Sharma, Aditya, et autres
Publié: (2024)
par: Sharma, Aditya, et autres
Publié: (2024)
Enhancing Multi-Step Reasoning Abilities of Language Models through Direct Q-Function Optimization
par: Ji, Kaixuan, et autres
Publié: (2024)
par: Ji, Kaixuan, et autres
Publié: (2024)
$π^2$: Structure-Originated Reasoning Data Improves Long-Context Reasoning Ability of Large Language Models
par: Do, Quyet V., et autres
Publié: (2026)
par: Do, Quyet V., et autres
Publié: (2026)
LLM Maybe LongLM: Self-Extend LLM Context Window Without Tuning
par: Jin, Hongye, et autres
Publié: (2024)
par: Jin, Hongye, et autres
Publié: (2024)
RLHF: A comprehensive Survey for Cultural, Multimodal and Low Latency Alignment Methods
par: Sharma, Raghav, et autres
Publié: (2025)
par: Sharma, Raghav, et autres
Publié: (2025)
PEEK: Context Map as an Orientation Cache for Long-Context LLM Agents
par: Gu, Zhuohan, et autres
Publié: (2026)
par: Gu, Zhuohan, et autres
Publié: (2026)
DRAGON: Guard LLM Unlearning in Context via Negative Detection and Reasoning
par: Wang, Yaxuan, et autres
Publié: (2025)
par: Wang, Yaxuan, et autres
Publié: (2025)
TTKV: Temporal-Tiered KV Cache for Long-Context LLM Inference
par: Dzikanyanga, Gradwell, et autres
Publié: (2026)
par: Dzikanyanga, Gradwell, et autres
Publié: (2026)
Safety Subspaces are Not Linearly Distinct: A Fine-Tuning Case Study
par: Ponkshe, Kaustubh, et autres
Publié: (2025)
par: Ponkshe, Kaustubh, et autres
Publié: (2025)
MemAgent: Reshaping Long-Context LLM with Multi-Conv RL-based Memory Agent
par: Yu, Hongli, et autres
Publié: (2025)
par: Yu, Hongli, et autres
Publié: (2025)
AQA-Bench: An Interactive Benchmark for Evaluating LLMs' Sequential Reasoning Ability
par: Yang, Siwei, et autres
Publié: (2024)
par: Yang, Siwei, et autres
Publié: (2024)
On the Ability of Transformers to Verify Plans
par: Sarrof, Yash, et autres
Publié: (2026)
par: Sarrof, Yash, et autres
Publié: (2026)
The Lottery LLM Hypothesis, Rethinking What Abilities Should LLM Compression Preserve?
par: Tang, Zhenheng, et autres
Publié: (2025)
par: Tang, Zhenheng, et autres
Publié: (2025)
InfLLM: Training-Free Long-Context Extrapolation for LLMs with an Efficient Context Memory
par: Xiao, Chaojun, et autres
Publié: (2024)
par: Xiao, Chaojun, et autres
Publié: (2024)
LazyLLM: Dynamic Token Pruning for Efficient Long Context LLM Inference
par: Fu, Qichen, et autres
Publié: (2024)
par: Fu, Qichen, et autres
Publié: (2024)
How Well Can a Long Sequence Model Model Long Sequences? Comparing Architechtural Inductive Biases on Long-Context Abilities
par: Huang, Jerry
Publié: (2024)
par: Huang, Jerry
Publié: (2024)
Pre-trained Language Models Improve the Few-shot Prompt Ability of Decision Transformer
par: Yang, Yu, et autres
Publié: (2024)
par: Yang, Yu, et autres
Publié: (2024)
How Is LLM Reasoning Distracted by Irrelevant Context? An Analysis Using a Controlled Benchmark
par: Yang, Minglai, et autres
Publié: (2025)
par: Yang, Minglai, et autres
Publié: (2025)
Emergent Abilities in Large Language Models: A Survey
par: Berti, Leonardo, et autres
Publié: (2025)
par: Berti, Leonardo, et autres
Publié: (2025)
Documents similaires
-
RoboSignature: Robust Signature and Watermarking on Network Attacks
par: Shaan, Aryaman, et autres
Publié: (2024) -
Needle in the Haystack for Memory Based Large Language Models
par: Nelson, Elliot, et autres
Publié: (2024) -
Hidden in the Haystack: Smaller Needles are More Difficult for LLMs to Find
par: Bianchi, Owen, et autres
Publié: (2025) -
When Every Token Counts: Optimal Segmentation for Low-Resource Language Models
par: Raj, Bharath, et autres
Publié: (2024) -
From Haystack to Needle: Label Space Reduction for Zero-shot Classification
par: Vandemoortele, Nathan, et autres
Publié: (2025)