Focus Directions Make Your Language Models Pay More Attention to Relevant Contexts
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhu, Youxiang, Li, Ruochen, Wang, Danqing, Haehn, Daniel, Liang, Xiaohui |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
UMB@PerAnsSumm 2025: Enhancing Perspective-Aware Summarization with Prompt Optimization and Supervised Fine-Tuning
par: Qi, Kristin, et autres
Publié: (2025)
par: Qi, Kristin, et autres
Publié: (2025)
Paying More Attention to Source Context: Mitigating Unfaithful Translations from Large Language Model
par: Zhang, Hongbin, et autres
Publié: (2024)
par: Zhang, Hongbin, et autres
Publié: (2024)
ReEvalMed: Rethinking Medical Report Evaluation by Aligning Metrics with Real-World Clinical Judgment
par: Li, Ruochen, et autres
Publié: (2025)
par: Li, Ruochen, et autres
Publié: (2025)
Pay More Attention To Audio: Mitigating Imbalance of Cross-Modal Attention in Large Audio Language Models
par: Wang, Junyu, et autres
Publié: (2025)
par: Wang, Junyu, et autres
Publié: (2025)
Make LVLMs Focus: Context-Aware Attention Modulation for Better Multimodal In-Context Learning
par: Li, Yanshu, et autres
Publié: (2025)
par: Li, Yanshu, et autres
Publié: (2025)
Mask-Enhanced Autoregressive Prediction: Pay Less Attention to Learn More
par: Zhuang, Xialie, et autres
Publié: (2025)
par: Zhuang, Xialie, et autres
Publié: (2025)
Cog-TiPRO: Iterative Prompt Refinement with LLMs to Detect Cognitive Decline via Longitudinal Voice Assistant Commands
par: Qi, Kristin, et autres
Publié: (2025)
par: Qi, Kristin, et autres
Publié: (2025)
Unveil Multi-Picture Descriptions for Multilingual Mild Cognitive Impairment Detection via Contrastive Learning
par: Qi, Kristin, et autres
Publié: (2025)
par: Qi, Kristin, et autres
Publié: (2025)
Making Long-Context Language Models Better Multi-Hop Reasoners
par: Li, Yanyang, et autres
Publié: (2024)
par: Li, Yanyang, et autres
Publié: (2024)
Paying Attention to Facts: Quantifying the Knowledge Capacity of Attention Layers
par: Wong, Liang Ze
Publié: (2025)
par: Wong, Liang Ze
Publié: (2025)
Analyzing Multimodal Features of Spontaneous Voice Assistant Commands for Mild Cognitive Impairment Detection
par: Lin, Nana, et autres
Publié: (2024)
par: Lin, Nana, et autres
Publié: (2024)
Why Is Spatial Reasoning Hard for VLMs? An Attention Mechanism Perspective on Focus Areas
par: Chen, Shiqi, et autres
Publié: (2025)
par: Chen, Shiqi, et autres
Publié: (2025)
SurgGoal: Rethinking Surgical Planning Evaluation via Goal-Satisfiability
par: Li, Ruochen, et autres
Publié: (2026)
par: Li, Ruochen, et autres
Publié: (2026)
MuDAF: Long-Context Multi-Document Attention Focusing through Contrastive Learning on Attention Heads
par: Liu, Weihao, et autres
Publié: (2025)
par: Liu, Weihao, et autres
Publié: (2025)
Don't Pay Attention
par: Hammoud, Mohammad, et autres
Publié: (2025)
par: Hammoud, Mohammad, et autres
Publié: (2025)
Make Your LLM Fully Utilize the Context
par: An, Shengnan, et autres
Publié: (2024)
par: An, Shengnan, et autres
Publié: (2024)
Predicting Lung Cancer Patient Prognosis with Large Language Models
par: Hu, Danqing, et autres
Publié: (2024)
par: Hu, Danqing, et autres
Publié: (2024)
TypedThinker: Diversify Large Language Model Reasoning with Typed Thinking
par: Wang, Danqing, et autres
Publié: (2024)
par: Wang, Danqing, et autres
Publié: (2024)
Strategic Planning and Rationalizing on Trees Make LLMs Better Debaters
par: Wang, Danqing, et autres
Publié: (2025)
par: Wang, Danqing, et autres
Publié: (2025)
Learning Less Is More: Premature Upper-Layer Attention Specialization Hurts Language Model Pretraining
par: Zhu, Jinchang, et autres
Publié: (2026)
par: Zhu, Jinchang, et autres
Publié: (2026)
MOSSBench: Is Your Multimodal Language Model Oversensitive to Safe Queries?
par: Li, Xirui, et autres
Publié: (2024)
par: Li, Xirui, et autres
Publié: (2024)
Pay Less Attention to Function Words for Free Robustness of Vision-Language Models
par: Tian, Qiwei, et autres
Publié: (2025)
par: Tian, Qiwei, et autres
Publié: (2025)
DP-OPT: Make Large Language Model Your Privacy-Preserving Prompt Engineer
par: Hong, Junyuan, et autres
Publié: (2023)
par: Hong, Junyuan, et autres
Publié: (2023)
RULER: What's the Real Context Size of Your Long-Context Language Models?
par: Hsieh, Cheng-Ping, et autres
Publié: (2024)
par: Hsieh, Cheng-Ping, et autres
Publié: (2024)
Pay Attention to What Matters
par: Silva, Pedro Luiz, et autres
Publié: (2024)
par: Silva, Pedro Luiz, et autres
Publié: (2024)
Solving for X and Beyond: Can Large Language Models Solve Complex Math Problems with More-Than-Two Unknowns?
par: Kao, Kuei-Chun, et autres
Publié: (2024)
par: Kao, Kuei-Chun, et autres
Publié: (2024)
Reducing Distraction in Long-Context Language Models by Focused Learning
par: Wu, Zijun, et autres
Publié: (2024)
par: Wu, Zijun, et autres
Publié: (2024)
PAINT: Paying Attention to INformed Tokens to Mitigate Hallucination in Large Vision-Language Model
par: Arif, Kazi Hasan Ibn, et autres
Publié: (2025)
par: Arif, Kazi Hasan Ibn, et autres
Publié: (2025)
SelfElicit: Your Language Model Secretly Knows Where is the Relevant Evidence
par: Liu, Zhining, et autres
Publié: (2025)
par: Liu, Zhining, et autres
Publié: (2025)
Large Language Models Know What Makes Exemplary Contexts
par: Long, Quanyu, et autres
Publié: (2024)
par: Long, Quanyu, et autres
Publié: (2024)
Cooperative Strategic Planning Enhances Reasoning Capabilities in Large Language Models
par: Wang, Danqing, et autres
Publié: (2024)
par: Wang, Danqing, et autres
Publié: (2024)
Molly: Making Large Language Model Agents Solve Python Problem More Logically
par: Xiao, Rui, et autres
Publié: (2024)
par: Xiao, Rui, et autres
Publié: (2024)
Bootstrap Your Own Context Length
par: Wang, Liang, et autres
Publié: (2024)
par: Wang, Liang, et autres
Publié: (2024)
Getting More Juice Out of Your Data: Hard Pair Refinement Enhances Visual-Language Models Without Extra Data
par: Wang, Haonan, et autres
Publié: (2023)
par: Wang, Haonan, et autres
Publié: (2023)
Are We Paying Attention to Her? Investigating Gender Disambiguation and Attention in Machine Translation
par: Manna, Chiara, et autres
Publié: (2025)
par: Manna, Chiara, et autres
Publié: (2025)
SCE: Scalable Consistency Ensembles Make Blackbox Large Language Model Generation More Reliable
par: Zhang, Jiaxin, et autres
Publié: (2025)
par: Zhang, Jiaxin, et autres
Publié: (2025)
Making Metadata More FAIR Using Large Language Models
par: Sundaram, Sowmya S., et autres
Publié: (2023)
par: Sundaram, Sowmya S., et autres
Publié: (2023)
There Is More to Refusal in Large Language Models than a Single Direction
par: Joad, Faaiz, et autres
Publié: (2026)
par: Joad, Faaiz, et autres
Publié: (2026)
Attention Reveals More Than Tokens: Training-Free Long-Context Reasoning with Attention-guided Retrieval
par: Zhang, Yuwei, et autres
Publié: (2025)
par: Zhang, Yuwei, et autres
Publié: (2025)
Less is More: Making Smaller Language Models Competent Subgraph Retrievers for Multi-hop KGQA
par: Huang, Wenyu, et autres
Publié: (2024)
par: Huang, Wenyu, et autres
Publié: (2024)
Documents similaires
-
UMB@PerAnsSumm 2025: Enhancing Perspective-Aware Summarization with Prompt Optimization and Supervised Fine-Tuning
par: Qi, Kristin, et autres
Publié: (2025) -
Paying More Attention to Source Context: Mitigating Unfaithful Translations from Large Language Model
par: Zhang, Hongbin, et autres
Publié: (2024) -
ReEvalMed: Rethinking Medical Report Evaluation by Aligning Metrics with Real-World Clinical Judgment
par: Li, Ruochen, et autres
Publié: (2025) -
Pay More Attention To Audio: Mitigating Imbalance of Cross-Modal Attention in Large Audio Language Models
par: Wang, Junyu, et autres
Publié: (2025) -
Make LVLMs Focus: Context-Aware Attention Modulation for Better Multimodal In-Context Learning
par: Li, Yanshu, et autres
Publié: (2025)