Enhancing elusive clues in knowledge learning by contrasting attention of language models
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Gao, Jian, Zhang, Xiao, Wu, Ji, Li, Miao |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Infusing clinical knowledge into tokenisers for language models
von: Hasan, Abul, et al.
Veröffentlicht: (2024)
von: Hasan, Abul, et al.
Veröffentlicht: (2024)
Uncovering inequalities in new knowledge learning by large language models across different languages
von: Wang, Chenglong, et al.
Veröffentlicht: (2025)
von: Wang, Chenglong, et al.
Veröffentlicht: (2025)
Fine-grained graph representation learning for heterogeneous mobile networks with attentive fusion and contrastive learning
von: Liu, Shengheng, et al.
Veröffentlicht: (2024)
von: Liu, Shengheng, et al.
Veröffentlicht: (2024)
Multiview graph dual-attention deep learning and contrastive learning for multi-criteria recommender systems
von: Forouzandeh, Saman, et al.
Veröffentlicht: (2025)
von: Forouzandeh, Saman, et al.
Veröffentlicht: (2025)
Reproducible scaling laws for contrastive language-image learning
von: Cherti, Mehdi, et al.
Veröffentlicht: (2022)
von: Cherti, Mehdi, et al.
Veröffentlicht: (2022)
Applying sparse autoencoders to unlearn knowledge in language models
von: Farrell, Eoin, et al.
Veröffentlicht: (2024)
von: Farrell, Eoin, et al.
Veröffentlicht: (2024)
DEDUCE: Multi-head attention decoupled contrastive learning to discover cancer subtypes based on multi-omics data
von: Pan, Liangrui, et al.
Veröffentlicht: (2023)
von: Pan, Liangrui, et al.
Veröffentlicht: (2023)
Retrieval-augmented in-context learning for multimodal large language models in disease classification
von: Zhan, Zaifu, et al.
Veröffentlicht: (2025)
von: Zhan, Zaifu, et al.
Veröffentlicht: (2025)
Reliable and diverse evaluation of LLM medical knowledge mastery
von: Zhou, Yuxuan, et al.
Veröffentlicht: (2024)
von: Zhou, Yuxuan, et al.
Veröffentlicht: (2024)
Automating construction contract review using knowledge graph-enhanced large language models
von: Zheng, Chunmo, et al.
Veröffentlicht: (2023)
von: Zheng, Chunmo, et al.
Veröffentlicht: (2023)
Emission-GPT: A domain-specific language model agent for knowledge retrieval, emission inventory and data analysis
von: Ye, Jiashu, et al.
Veröffentlicht: (2025)
von: Ye, Jiashu, et al.
Veröffentlicht: (2025)
Efficiency optimization of large-scale language models based on deep learning in natural language processing tasks
von: Mei, Taiyuan, et al.
Veröffentlicht: (2024)
von: Mei, Taiyuan, et al.
Veröffentlicht: (2024)
BadEdit: Backdooring large language models by model editing
von: Li, Yanzhou, et al.
Veröffentlicht: (2024)
von: Li, Yanzhou, et al.
Veröffentlicht: (2024)
Supervised learning pays attention
von: Craig, Erin, et al.
Veröffentlicht: (2025)
von: Craig, Erin, et al.
Veröffentlicht: (2025)
Intra-neuronal attention within language models Relationships between activation and semantics
von: Pichat, Michael, et al.
Veröffentlicht: (2025)
von: Pichat, Michael, et al.
Veröffentlicht: (2025)
EvoOpt-LLM: Evolving industrial optimization models with large language models
von: He, Yiliu, et al.
Veröffentlicht: (2026)
von: He, Yiliu, et al.
Veröffentlicht: (2026)
\(X\)-evolve: Solution space evolution powered by large language models
von: Zhai, Yi, et al.
Veröffentlicht: (2025)
von: Zhai, Yi, et al.
Veröffentlicht: (2025)
Breast tumor classification based on self-supervised contrastive learning from ultrasound videos
von: Tang, Yunxin, et al.
Veröffentlicht: (2024)
von: Tang, Yunxin, et al.
Veröffentlicht: (2024)
Knowledge-aware contrastive heterogeneous molecular graph learning
von: Chen, Mukun, et al.
Veröffentlicht: (2025)
von: Chen, Mukun, et al.
Veröffentlicht: (2025)
Reinforcement learning fine-tuning of language model for instruction following and math reasoning
von: Han, Yifu, et al.
Veröffentlicht: (2025)
von: Han, Yifu, et al.
Veröffentlicht: (2025)
Epistemic diversity across language models mitigates knowledge collapse
von: Hodel, Damian, et al.
Veröffentlicht: (2025)
von: Hodel, Damian, et al.
Veröffentlicht: (2025)
TechGPT-2.0: A large language model project to solve the task of knowledge graph construction
von: Wang, Jiaqi, et al.
Veröffentlicht: (2024)
von: Wang, Jiaqi, et al.
Veröffentlicht: (2024)
Recent advances in deep learning and language models for studying the microbiome
von: Yan, Binghao, et al.
Veröffentlicht: (2024)
von: Yan, Binghao, et al.
Veröffentlicht: (2024)
Dynamic feature selection in medical predictive monitoring by reinforcement learning
von: Chen, Yutong, et al.
Veröffentlicht: (2024)
von: Chen, Yutong, et al.
Veröffentlicht: (2024)
Towards Intelligent Geospatial Data Discovery: a knowledge graph-driven multi-agent framework powered by large language models
von: Liu, Ruixiang, et al.
Veröffentlicht: (2026)
von: Liu, Ruixiang, et al.
Veröffentlicht: (2026)
An end-to-end attention-based approach for learning on graphs
von: Buterez, David, et al.
Veröffentlicht: (2024)
von: Buterez, David, et al.
Veröffentlicht: (2024)
Toward a unified framework for data-efficient evaluation of large language models
von: Liao, Lele, et al.
Veröffentlicht: (2025)
von: Liao, Lele, et al.
Veröffentlicht: (2025)
Bringing legal knowledge to the public by constructing a legal question bank using large-scale pre-trained language model
von: Yuan, Mingruo, et al.
Veröffentlicht: (2025)
von: Yuan, Mingruo, et al.
Veröffentlicht: (2025)
Beyond designer's knowledge: Generating materials design hypotheses via large language models
von: Liu, Quanliang, et al.
Veröffentlicht: (2024)
von: Liu, Quanliang, et al.
Veröffentlicht: (2024)
Agentic reinforcement learning empowers next-generation chemical language models for molecular design and synthesis
von: Li, Hao, et al.
Veröffentlicht: (2026)
von: Li, Hao, et al.
Veröffentlicht: (2026)
Learning states enhanced knowledge tracing: Simulating the diversity in real-world learning process
von: Wang, Shanshan, et al.
Veröffentlicht: (2024)
von: Wang, Shanshan, et al.
Veröffentlicht: (2024)
Leveraging large language models for efficient representation learning for entity resolution
von: Xu, Xiaowei, et al.
Veröffentlicht: (2024)
von: Xu, Xiaowei, et al.
Veröffentlicht: (2024)
ARC-Encoder: learning compressed text representations for large language models
von: Pilchen, Hippolyte, et al.
Veröffentlicht: (2025)
von: Pilchen, Hippolyte, et al.
Veröffentlicht: (2025)
Incorporating simulated spatial context information improves the effectiveness of contrastive learning models
von: Zhu, Lizhen, et al.
Veröffentlicht: (2024)
von: Zhu, Lizhen, et al.
Veröffentlicht: (2024)
GUI-Shift: Enhancing VLM-Based GUI Agents through Self-supervised Reinforcement Learning
von: Gao, Longxi, et al.
Veröffentlicht: (2025)
von: Gao, Longxi, et al.
Veröffentlicht: (2025)
ADMEDTAGGER: an annotation framework for distillation of expert knowledge for the Polish medical language
von: Górski, Franciszek, et al.
Veröffentlicht: (2025)
von: Górski, Franciszek, et al.
Veröffentlicht: (2025)
A large-scale evaluation of commonsense knowledge in humans and large language models
von: Nguyen, Tuan Dung, et al.
Veröffentlicht: (2025)
von: Nguyen, Tuan Dung, et al.
Veröffentlicht: (2025)
Pre-trained knowledge elevates large language models beyond traditional chemical reaction optimizers
von: MacKnight, Robert, et al.
Veröffentlicht: (2025)
von: MacKnight, Robert, et al.
Veröffentlicht: (2025)
Large language models for spreading dynamics in complex systems
von: Jiang, Shuyu, et al.
Veröffentlicht: (2026)
von: Jiang, Shuyu, et al.
Veröffentlicht: (2026)
Meta-learning ecological priors from large language models explains human learning and decision making
von: Jagadish, Akshay K., et al.
Veröffentlicht: (2025)
von: Jagadish, Akshay K., et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Infusing clinical knowledge into tokenisers for language models
von: Hasan, Abul, et al.
Veröffentlicht: (2024) -
Uncovering inequalities in new knowledge learning by large language models across different languages
von: Wang, Chenglong, et al.
Veröffentlicht: (2025) -
Fine-grained graph representation learning for heterogeneous mobile networks with attentive fusion and contrastive learning
von: Liu, Shengheng, et al.
Veröffentlicht: (2024) -
Multiview graph dual-attention deep learning and contrastive learning for multi-criteria recommender systems
von: Forouzandeh, Saman, et al.
Veröffentlicht: (2025) -
Reproducible scaling laws for contrastive language-image learning
von: Cherti, Mehdi, et al.
Veröffentlicht: (2022)