Reducing Distraction in Long-Context Language Models by Focused Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Wu, Zijun, Liu, Bingyuan, Yan, Ran, Chen, Lei, Delteil, Thomas |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
LongR: Unleashing Long-Context Reasoning via Reinforcement Learning with Dense Utility Rewards
di: Ping, Bowen, et al.
Pubblicazione: (2026)
di: Ping, Bowen, et al.
Pubblicazione: (2026)
Distract Large Language Models for Automatic Jailbreak Attack
di: Xiao, Zeguan, et al.
Pubblicazione: (2024)
di: Xiao, Zeguan, et al.
Pubblicazione: (2024)
Losing Visual Needles in Image Haystacks: Vision Language Models are Easily Distracted in Short and Long Contexts
di: Sharma, Aditya, et al.
Pubblicazione: (2024)
di: Sharma, Aditya, et al.
Pubblicazione: (2024)
No More Distractions: an Adaptive Up-Sampling Algorithm to Reduce Data Artifacts
di: Chen, Han
Pubblicazione: (2024)
di: Chen, Han
Pubblicazione: (2024)
LongAct: Harnessing Intrinsic Activation Patterns for Long-Context Reinforcement Learning
di: Ping, Bowen, et al.
Pubblicazione: (2026)
di: Ping, Bowen, et al.
Pubblicazione: (2026)
Focus-LIME: Surgical Interpretation of Long-Context Large Language Models via Proxy-Based Neighborhood Selection
di: Liu, Junhao, et al.
Pubblicazione: (2026)
di: Liu, Junhao, et al.
Pubblicazione: (2026)
Probing the Capacity of Language Model Agents to Operationalize Disparate Experiential Context Despite Distraction
di: George, Sonny, et al.
Pubblicazione: (2024)
di: George, Sonny, et al.
Pubblicazione: (2024)
MuDAF: Long-Context Multi-Document Attention Focusing through Contrastive Learning on Attention Heads
di: Liu, Weihao, et al.
Pubblicazione: (2025)
di: Liu, Weihao, et al.
Pubblicazione: (2025)
SPELL: Self-Play Reinforcement Learning for Evolving Long-Context Language Models
di: Yang, Ziyi, et al.
Pubblicazione: (2025)
di: Yang, Ziyi, et al.
Pubblicazione: (2025)
Long-Context Language Modeling with Parallel Context Encoding
di: Yen, Howard, et al.
Pubblicazione: (2024)
di: Yen, Howard, et al.
Pubblicazione: (2024)
ToM: Leveraging Tree-oriented MapReduce for Long-Context Reasoning in Large Language Models
di: Guo, Jiani, et al.
Pubblicazione: (2025)
di: Guo, Jiani, et al.
Pubblicazione: (2025)
Are GUI Agents Focused Enough? Automated Distraction via Semantic-level UI Element Injection
di: Yang, Wenkui, et al.
Pubblicazione: (2026)
di: Yang, Wenkui, et al.
Pubblicazione: (2026)
Marathon: A Race Through the Realm of Long Context with Large Language Models
di: Zhang, Lei, et al.
Pubblicazione: (2023)
di: Zhang, Lei, et al.
Pubblicazione: (2023)
An Efficient Recipe for Long Context Extension via Middle-Focused Positional Encoding
di: Wu, Tong, et al.
Pubblicazione: (2024)
di: Wu, Tong, et al.
Pubblicazione: (2024)
Focus-dLLM: Accelerating Long-Context Diffusion LLM Inference via Confidence-Guided Context Focusing
di: Long, Lingkun, et al.
Pubblicazione: (2026)
di: Long, Lingkun, et al.
Pubblicazione: (2026)
LLMAEL: Large Language Models are Good Context Augmenters for Entity Linking
di: Xin, Amy, et al.
Pubblicazione: (2024)
di: Xin, Amy, et al.
Pubblicazione: (2024)
A MapReduce Approach to Effectively Utilize Long Context Information in Retrieval Augmented Language Models
di: Zhang, Gongbo, et al.
Pubblicazione: (2024)
di: Zhang, Gongbo, et al.
Pubblicazione: (2024)
Long Context is Not Long at All: A Prospector of Long-Dependency Data for Large Language Models
di: Chen, Longze, et al.
Pubblicazione: (2024)
di: Chen, Longze, et al.
Pubblicazione: (2024)
Chain-of-Thought Matters: Improving Long-Context Language Models with Reasoning Path Supervision
di: Zhu, Dawei, et al.
Pubblicazione: (2025)
di: Zhu, Dawei, et al.
Pubblicazione: (2025)
LongRecipe: Recipe for Efficient Long Context Generalization in Large Language Models
di: Hu, Zhiyuan, et al.
Pubblicazione: (2024)
di: Hu, Zhiyuan, et al.
Pubblicazione: (2024)
Membership Inference Attack against Long-Context Large Language Models
di: Wang, Zixiong, et al.
Pubblicazione: (2024)
di: Wang, Zixiong, et al.
Pubblicazione: (2024)
SEGMENT+: Long Text Processing with Short-Context Language Models
di: Shi, Wei, et al.
Pubblicazione: (2024)
di: Shi, Wei, et al.
Pubblicazione: (2024)
Query-Focused Retrieval Heads Improve Long-Context Reasoning and Re-ranking
di: Zhang, Wuwei, et al.
Pubblicazione: (2025)
di: Zhang, Wuwei, et al.
Pubblicazione: (2025)
LIFBench: Evaluating the Instruction Following Performance and Stability of Large Language Models in Long-Context Scenarios
di: Wu, Xiaodong, et al.
Pubblicazione: (2024)
di: Wu, Xiaodong, et al.
Pubblicazione: (2024)
LongProc: Benchmarking Long-Context Language Models on Long Procedural Generation
di: Ye, Xi, et al.
Pubblicazione: (2025)
di: Ye, Xi, et al.
Pubblicazione: (2025)
FlashBack:Efficient Retrieval-Augmented Language Modeling for Long Context Inference
di: Liu, Runheng, et al.
Pubblicazione: (2024)
di: Liu, Runheng, et al.
Pubblicazione: (2024)
Thus Spake Long-Context Large Language Model
di: Liu, Xiaoran, et al.
Pubblicazione: (2025)
di: Liu, Xiaoran, et al.
Pubblicazione: (2025)
Scaling Context, Not Parameters: Training a Compact 7B Language Model for Efficient Long-Context Processing
di: Wu, Chen, et al.
Pubblicazione: (2025)
di: Wu, Chen, et al.
Pubblicazione: (2025)
Revisiting In-Context Learning with Long Context Language Models
di: Baek, Jinheon, et al.
Pubblicazione: (2024)
di: Baek, Jinheon, et al.
Pubblicazione: (2024)
LinguaLens: Towards Interpreting Linguistic Mechanisms of Large Language Models via Sparse Auto-Encoder
di: Jing, Yi, et al.
Pubblicazione: (2025)
di: Jing, Yi, et al.
Pubblicazione: (2025)
Weaving Context Across Images: Improving Vision-Language Models through Focus-Centric Visual Chains
di: Zhang, Juntian, et al.
Pubblicazione: (2025)
di: Zhang, Juntian, et al.
Pubblicazione: (2025)
TokMem: One-Token Procedural Memory for Large Language Models
di: Wu, Zijun, et al.
Pubblicazione: (2025)
di: Wu, Zijun, et al.
Pubblicazione: (2025)
In-Context Learning with Long-Context Models: An In-Depth Exploration
di: Bertsch, Amanda, et al.
Pubblicazione: (2024)
di: Bertsch, Amanda, et al.
Pubblicazione: (2024)
Understanding the RoPE Extensions of Long-Context LLMs: An Attention Perspective
di: Zhong, Meizhi, et al.
Pubblicazione: (2024)
di: Zhong, Meizhi, et al.
Pubblicazione: (2024)
Interpretable Detection of Out-of-Context Misinformation with Neural-Symbolic-Enhanced Large Multimodal Model
di: Zhang, Yizhou, et al.
Pubblicazione: (2023)
di: Zhang, Yizhou, et al.
Pubblicazione: (2023)
Core Context Aware Transformers for Long Context Language Modeling
di: Chen, Yaofo, et al.
Pubblicazione: (2024)
di: Chen, Yaofo, et al.
Pubblicazione: (2024)
Pop-Up Distractions Reveal Bag-of-Events Behavior in Video Large Language Models
di: Chew, Oscar, et al.
Pubblicazione: (2026)
di: Chew, Oscar, et al.
Pubblicazione: (2026)
RM-Bench: Benchmarking Reward Models of Language Models with Subtlety and Style
di: Liu, Yantao, et al.
Pubblicazione: (2024)
di: Liu, Yantao, et al.
Pubblicazione: (2024)
ROSA-Tuning: Enhancing Long-Context Modeling via Suffix Matching
di: Zheng, Yunao, et al.
Pubblicazione: (2026)
di: Zheng, Yunao, et al.
Pubblicazione: (2026)
MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models
di: Huang, Zhongzhan, et al.
Pubblicazione: (2025)
di: Huang, Zhongzhan, et al.
Pubblicazione: (2025)
Documenti analoghi
-
LongR: Unleashing Long-Context Reasoning via Reinforcement Learning with Dense Utility Rewards
di: Ping, Bowen, et al.
Pubblicazione: (2026) -
Distract Large Language Models for Automatic Jailbreak Attack
di: Xiao, Zeguan, et al.
Pubblicazione: (2024) -
Losing Visual Needles in Image Haystacks: Vision Language Models are Easily Distracted in Short and Long Contexts
di: Sharma, Aditya, et al.
Pubblicazione: (2024) -
No More Distractions: an Adaptive Up-Sampling Algorithm to Reduce Data Artifacts
di: Chen, Han
Pubblicazione: (2024) -
LongAct: Harnessing Intrinsic Activation Patterns for Long-Context Reinforcement Learning
di: Ping, Bowen, et al.
Pubblicazione: (2026)