Reinterpreting 'the Company a Word Keeps': Towards Explainable and Ontologically Grounded Language Models
Fuente:
arXiv
Salvato in:
| Autore principale: | Saba, Walid S. |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Word Embeddings Are Steers for Language Models
di: Han, Chi, et al.
Pubblicazione: (2023)
di: Han, Chi, et al.
Pubblicazione: (2023)
CORE: Comprehensive Ontological Relation Evaluation for Large Language Models
di: Dwivedi, Satyam, et al.
Pubblicazione: (2026)
di: Dwivedi, Satyam, et al.
Pubblicazione: (2026)
Explicit Word Density Estimation for Language Modelling
di: Andonov, Jovan, et al.
Pubblicazione: (2024)
di: Andonov, Jovan, et al.
Pubblicazione: (2024)
Human Inspired Progressive Alignment and Comparative Learning for Grounded Word Acquisition
di: Bao, Yuwei, et al.
Pubblicazione: (2023)
di: Bao, Yuwei, et al.
Pubblicazione: (2023)
Towards Ontology-Based Descriptions of Conversations with Qualitatively-Defined Concepts
di: Gendron, Barbara, et al.
Pubblicazione: (2025)
di: Gendron, Barbara, et al.
Pubblicazione: (2025)
Uncovering Deceptive Tendencies in Language Models: A Simulated Company AI Assistant
di: Järviniemi, Olli, et al.
Pubblicazione: (2024)
di: Järviniemi, Olli, et al.
Pubblicazione: (2024)
Explaining Datasets in Words: Statistical Models with Natural Language Parameters
di: Zhong, Ruiqi, et al.
Pubblicazione: (2024)
di: Zhong, Ruiqi, et al.
Pubblicazione: (2024)
Wikontic: Constructing Wikidata-Aligned, Ontology-Aware Knowledge Graphs with Large Language Models
di: Chepurova, Alla, et al.
Pubblicazione: (2025)
di: Chepurova, Alla, et al.
Pubblicazione: (2025)
ALMANACS: A Simulatability Benchmark for Language Model Explainability
di: Mills, Edmund, et al.
Pubblicazione: (2023)
di: Mills, Edmund, et al.
Pubblicazione: (2023)
Ranking Large Language Models without Ground Truth
di: Dhurandhar, Amit, et al.
Pubblicazione: (2024)
di: Dhurandhar, Amit, et al.
Pubblicazione: (2024)
Lexicon-Level Contrastive Visual-Grounding Improves Language Modeling
di: Zhuang, Chengxu, et al.
Pubblicazione: (2024)
di: Zhuang, Chengxu, et al.
Pubblicazione: (2024)
Transcoders Trace Visual Grounding and Hallucinations in Vision-Language Models
di: Damianos, Dimitrios, et al.
Pubblicazione: (2026)
di: Damianos, Dimitrios, et al.
Pubblicazione: (2026)
SWEA: Updating Factual Knowledge in Large Language Models via Subject Word Embedding Altering
di: Li, Xiaopeng, et al.
Pubblicazione: (2024)
di: Li, Xiaopeng, et al.
Pubblicazione: (2024)
Hierarchical Autoregressive Transformers: Combining Byte- and Word-Level Processing for Robust, Adaptable Language Models
di: Neitemeier, Pit, et al.
Pubblicazione: (2025)
di: Neitemeier, Pit, et al.
Pubblicazione: (2025)
Towards Execution-Grounded Automated AI Research
di: Si, Chenglei, et al.
Pubblicazione: (2026)
di: Si, Chenglei, et al.
Pubblicazione: (2026)
Towards Visual Text Grounding of Multimodal Large Language Model
di: Li, Ming, et al.
Pubblicazione: (2025)
di: Li, Ming, et al.
Pubblicazione: (2025)
Construct, Align, and Reason: Large Ontology Models for Enterprise Knowledge Management
di: Zhang, Yao, et al.
Pubblicazione: (2026)
di: Zhang, Yao, et al.
Pubblicazione: (2026)
A Multilingual Sentiment Lexicon for Low-Resource Language Translation using Large Languages Models and Explainable AI
di: Malinga, Melusi, et al.
Pubblicazione: (2024)
di: Malinga, Melusi, et al.
Pubblicazione: (2024)
A Glitch in the Matrix? Locating and Detecting Language Model Grounding with Fakepedia
di: Monea, Giovanni, et al.
Pubblicazione: (2023)
di: Monea, Giovanni, et al.
Pubblicazione: (2023)
RefusalBench: Generative Evaluation of Selective Refusal in Grounded Language Models
di: Muhamed, Aashiq, et al.
Pubblicazione: (2025)
di: Muhamed, Aashiq, et al.
Pubblicazione: (2025)
Towards LLM-guided Causal Explainability for Black-box Text Classifiers
di: Bhattacharjee, Amrita, et al.
Pubblicazione: (2023)
di: Bhattacharjee, Amrita, et al.
Pubblicazione: (2023)
Words as Beacons: Guiding RL Agents with High-Level Language Prompts
di: Ruiz-Gonzalez, Unai, et al.
Pubblicazione: (2024)
di: Ruiz-Gonzalez, Unai, et al.
Pubblicazione: (2024)
Self-Exploring Language Models for Explainable Link Forecasting on Temporal Graphs via Reinforcement Learning
di: Ding, Zifeng, et al.
Pubblicazione: (2025)
di: Ding, Zifeng, et al.
Pubblicazione: (2025)
CaLM: Contrasting Large and Small Language Models to Verify Grounded Generation
di: Hsu, I-Hung, et al.
Pubblicazione: (2024)
di: Hsu, I-Hung, et al.
Pubblicazione: (2024)
Intrinsic Self-Correction in LLMs: Towards Explainable Prompting via Mechanistic Interpretability
di: Lee, Yu-Ting, et al.
Pubblicazione: (2025)
di: Lee, Yu-Ting, et al.
Pubblicazione: (2025)
Modulated Intervention Preference Optimization (MIPO): Keep the Easy, Refine the Difficult
di: Jang, Cheolhun
Pubblicazione: (2024)
di: Jang, Cheolhun
Pubblicazione: (2024)
Towards Trustable Language Models: Investigating Information Quality of Large Language Models
di: Rejeleene, Rick, et al.
Pubblicazione: (2024)
di: Rejeleene, Rick, et al.
Pubblicazione: (2024)
Forget What Matters, Keep the Rest: Selective Unlearning of Informative Tokens
di: Koh, Seunghee, et al.
Pubblicazione: (2026)
di: Koh, Seunghee, et al.
Pubblicazione: (2026)
A Self-matching Training Method with Annotation Embedding Models for Ontology Subsumption Prediction
di: Shiraishi, Yukihiro, et al.
Pubblicazione: (2024)
di: Shiraishi, Yukihiro, et al.
Pubblicazione: (2024)
Towards Aligning Language Models with Textual Feedback
di: Lloret, Saüc Abadal, et al.
Pubblicazione: (2024)
di: Lloret, Saüc Abadal, et al.
Pubblicazione: (2024)
Towards Reasoning Ability of Small Language Models
di: Srivastava, Gaurav, et al.
Pubblicazione: (2025)
di: Srivastava, Gaurav, et al.
Pubblicazione: (2025)
Beyond Words: How Large Language Models Perform in Quantitative Management Problem-Solving
di: Kuzmanko, Jonathan
Pubblicazione: (2025)
di: Kuzmanko, Jonathan
Pubblicazione: (2025)
Word-Sequence Entropy: Towards Uncertainty Estimation in Free-Form Medical Question Answering Applications and Beyond
di: Wang, Zhiyuan, et al.
Pubblicazione: (2024)
di: Wang, Zhiyuan, et al.
Pubblicazione: (2024)
Keeping LLMs Aligned After Fine-tuning: The Crucial Role of Prompt Templates
di: Lyu, Kaifeng, et al.
Pubblicazione: (2024)
di: Lyu, Kaifeng, et al.
Pubblicazione: (2024)
Towards a Unified View of Large Language Model Post-Training
di: Lv, Xingtai, et al.
Pubblicazione: (2025)
di: Lv, Xingtai, et al.
Pubblicazione: (2025)
VideoGEM: Training-free Action Grounding in Videos
di: Vogel, Felix, et al.
Pubblicazione: (2025)
di: Vogel, Felix, et al.
Pubblicazione: (2025)
PLaMo-100B: A Ground-Up Language Model Designed for Japanese Proficiency
di: Elements, Preferred, et al.
Pubblicazione: (2024)
di: Elements, Preferred, et al.
Pubblicazione: (2024)
AfriStereo: A Culturally Grounded Dataset for Evaluating Stereotypical Bias in Large Language Models
di: Beux, Yann Le, et al.
Pubblicazione: (2025)
di: Beux, Yann Le, et al.
Pubblicazione: (2025)
Quantifying and Improving the Robustness of Retrieval-Augmented Language Models Against Spurious Features in Grounding Data
di: Yang, Shiping, et al.
Pubblicazione: (2025)
di: Yang, Shiping, et al.
Pubblicazione: (2025)
Training Acceleration of Low-Rank Decomposed Networks using Sequential Freezing and Rank Quantization
di: Hajimolahoseini, Habib, et al.
Pubblicazione: (2023)
di: Hajimolahoseini, Habib, et al.
Pubblicazione: (2023)
Documenti analoghi
-
Word Embeddings Are Steers for Language Models
di: Han, Chi, et al.
Pubblicazione: (2023) -
CORE: Comprehensive Ontological Relation Evaluation for Large Language Models
di: Dwivedi, Satyam, et al.
Pubblicazione: (2026) -
Explicit Word Density Estimation for Language Modelling
di: Andonov, Jovan, et al.
Pubblicazione: (2024) -
Human Inspired Progressive Alignment and Comparative Learning for Grounded Word Acquisition
di: Bao, Yuwei, et al.
Pubblicazione: (2023) -
Towards Ontology-Based Descriptions of Conversations with Qualitatively-Defined Concepts
di: Gendron, Barbara, et al.
Pubblicazione: (2025)