Salvato in:
| Autori principali: | Rudman, William, Chen, Catherine, Eickhoff, Carsten |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2310.17715 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Stable Anisotropic Regularization
di: Rudman, William, et al.
Pubblicazione: (2023)
di: Rudman, William, et al.
Pubblicazione: (2023)
APP: Accelerated Path Patching with Task-Specific Pruning
di: Andersen, Frauke, et al.
Pubblicazione: (2025)
di: Andersen, Frauke, et al.
Pubblicazione: (2025)
TRIM: Achieving Extreme Sparsity with Targeted Row-wise Iterative Metric-driven Pruning
di: Beck, Florentin, et al.
Pubblicazione: (2025)
di: Beck, Florentin, et al.
Pubblicazione: (2025)
Forgotten Polygons: Multimodal Large Language Models are Shape-Blind
di: Rudman, William, et al.
Pubblicazione: (2025)
di: Rudman, William, et al.
Pubblicazione: (2025)
Is There Knowledge Left to Extract? Evidence of Fragility in Medically Fine-Tuned Vision-Language Models
di: McLaughlin, Oliver, et al.
Pubblicazione: (2026)
di: McLaughlin, Oliver, et al.
Pubblicazione: (2026)
Talking Heads: Understanding Inter-layer Communication in Transformer Language Models
di: Merullo, Jack, et al.
Pubblicazione: (2024)
di: Merullo, Jack, et al.
Pubblicazione: (2024)
When to Call an Apple Red: Humans Follow Introspective Rules, VLMs Don't
di: Nemitz, Jonathan, et al.
Pubblicazione: (2026)
di: Nemitz, Jonathan, et al.
Pubblicazione: (2026)
Mechanisms of Prompt-Induced Hallucination in Vision-Language Models
di: Rudman, William, et al.
Pubblicazione: (2026)
di: Rudman, William, et al.
Pubblicazione: (2026)
A Survey on LLM-Assisted Clinical Trial Recruitment
di: Ghosh, Shrestha, et al.
Pubblicazione: (2025)
di: Ghosh, Shrestha, et al.
Pubblicazione: (2025)
Outliers Dimensions that Disrupt Transformers Are Driven by Frequency
di: Puccetti, Giovanni, et al.
Pubblicazione: (2022)
di: Puccetti, Giovanni, et al.
Pubblicazione: (2022)
Enhancing Retrieval-Augmented Generation: A Study of Best Practices
di: Li, Siran, et al.
Pubblicazione: (2025)
di: Li, Siran, et al.
Pubblicazione: (2025)
What Do VLMs NOTICE? A Mechanistic Interpretability Pipeline for Gaussian-Noise-free Text-Image Corruption and Evaluation
di: Golovanevsky, Michal, et al.
Pubblicazione: (2024)
di: Golovanevsky, Michal, et al.
Pubblicazione: (2024)
The Same But Different: Structural Similarities and Differences in Multilingual Language Modeling
di: Zhang, Ruochen, et al.
Pubblicazione: (2024)
di: Zhang, Ruochen, et al.
Pubblicazione: (2024)
When Silence Is Golden: Can LLMs Learn to Abstain in Temporal QA and Beyond?
di: Zhou, Xinyu, et al.
Pubblicazione: (2026)
di: Zhou, Xinyu, et al.
Pubblicazione: (2026)
From Topology to Retrieval: Decoding Embedding Spaces with Unified Signatures
di: Rottach, Florian, et al.
Pubblicazione: (2025)
di: Rottach, Florian, et al.
Pubblicazione: (2025)
Task-Specific Knowledge Distillation via Intermediate Probes
di: Brown, Ryan, et al.
Pubblicazione: (2026)
di: Brown, Ryan, et al.
Pubblicazione: (2026)
The Persona Paradox: Medical Personas as Behavioral Priors in Clinical Language Models
di: Abdullahi, Tassallah, et al.
Pubblicazione: (2026)
di: Abdullahi, Tassallah, et al.
Pubblicazione: (2026)
Hardware Phi-1.5B: A Large Language Model Encodes Hardware Domain Specific Knowledge
di: Fu, Weimin, et al.
Pubblicazione: (2024)
di: Fu, Weimin, et al.
Pubblicazione: (2024)
Do BERT Embeddings Encode Narrative Dimensions? A Token-Level Probing Analysis of Time, Space, Causality, and Character in Fiction
di: Bei, Beicheng, et al.
Pubblicazione: (2026)
di: Bei, Beicheng, et al.
Pubblicazione: (2026)
Pathway to Relevance: How Cross-Encoders Implement a Semantic Variant of BM25
di: Lu, Meng, et al.
Pubblicazione: (2025)
di: Lu, Meng, et al.
Pubblicazione: (2025)
KBAlign: Efficient Self Adaptation on Specific Knowledge Bases
di: Zeng, Zheni, et al.
Pubblicazione: (2024)
di: Zeng, Zheni, et al.
Pubblicazione: (2024)
MedKP: Medical Dialogue with Knowledge Enhancement and Clinical Pathway Encoding
di: Wu, Jiageng, et al.
Pubblicazione: (2024)
di: Wu, Jiageng, et al.
Pubblicazione: (2024)
Provable Benefits of Task-Specific Prompts for In-context Learning
di: Chang, Xiangyu, et al.
Pubblicazione: (2025)
di: Chang, Xiangyu, et al.
Pubblicazione: (2025)
AnyTaskTune: Advanced Domain-Specific Solutions through Task-Fine-Tuning
di: Cui, Jiaxi, et al.
Pubblicazione: (2024)
di: Cui, Jiaxi, et al.
Pubblicazione: (2024)
AdaptBot: Combining LLM with Knowledge Graphs and Human Input for Generic-to-Specific Task Decomposition and Knowledge Refinement
di: Singh, Shivam, et al.
Pubblicazione: (2025)
di: Singh, Shivam, et al.
Pubblicazione: (2025)
LLMs to Support a Domain Specific Knowledge Assistant
di: Lovin, Maria-Flavia
Pubblicazione: (2025)
di: Lovin, Maria-Flavia
Pubblicazione: (2025)
Can LLMs Generate High-Quality Task-Specific Conversations?
di: Li, Shengqi, et al.
Pubblicazione: (2025)
di: Li, Shengqi, et al.
Pubblicazione: (2025)
LoRA-Augmented Generation (LAG) for Knowledge-Intensive Language Tasks
di: Fleshman, William, et al.
Pubblicazione: (2025)
di: Fleshman, William, et al.
Pubblicazione: (2025)
Is It a Free Lunch for Removing Outliers during Pretraining?
di: Liao, Baohao, et al.
Pubblicazione: (2024)
di: Liao, Baohao, et al.
Pubblicazione: (2024)
Jatmo: Prompt Injection Defense by Task-Specific Finetuning
di: Piet, Julien, et al.
Pubblicazione: (2023)
di: Piet, Julien, et al.
Pubblicazione: (2023)
Anti-Length Shift: Dynamic Outlier Truncation for Training Efficient Reasoning Models
di: Wu, Wei, et al.
Pubblicazione: (2026)
di: Wu, Wei, et al.
Pubblicazione: (2026)
Rethinking the Outlier Distribution in Large Language Models: An In-depth Study
di: Raman, Rahul, et al.
Pubblicazione: (2025)
di: Raman, Rahul, et al.
Pubblicazione: (2025)
From Noise to Signal: When Outliers Seed New Topics
di: Zve, Evangelia, et al.
Pubblicazione: (2026)
di: Zve, Evangelia, et al.
Pubblicazione: (2026)
FROST: Filtering Reasoning Outliers with Attention for Efficient Reasoning
di: Luo, Haozheng, et al.
Pubblicazione: (2026)
di: Luo, Haozheng, et al.
Pubblicazione: (2026)
Controllable and Reliable Knowledge-Intensive Task-Oriented Conversational Agents with Declarative Genie Worksheets
di: Joshi, Harshit, et al.
Pubblicazione: (2024)
di: Joshi, Harshit, et al.
Pubblicazione: (2024)
Knowledge of Knowledge: Exploring Known-Unknowns Uncertainty with Large Language Models
di: Amayuelas, Alfonso, et al.
Pubblicazione: (2023)
di: Amayuelas, Alfonso, et al.
Pubblicazione: (2023)
Task--Specificity Score: Measuring How Much Instructions Really Matter for Supervision
di: Kadasi, Pritam, et al.
Pubblicazione: (2026)
di: Kadasi, Pritam, et al.
Pubblicazione: (2026)
Systematic Outliers in Large Language Models
di: An, Yongqi, et al.
Pubblicazione: (2025)
di: An, Yongqi, et al.
Pubblicazione: (2025)
TreeMatch: A Fully Unsupervised WSD System Using Dependency Knowledge on a Specific Domain
di: Tran, Andrew, et al.
Pubblicazione: (2025)
di: Tran, Andrew, et al.
Pubblicazione: (2025)
Identifying Narrative Patterns and Outliers in Holocaust Testimonies Using Topic Modeling
di: Ifergan, Maxim, et al.
Pubblicazione: (2024)
di: Ifergan, Maxim, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Stable Anisotropic Regularization
di: Rudman, William, et al.
Pubblicazione: (2023) -
APP: Accelerated Path Patching with Task-Specific Pruning
di: Andersen, Frauke, et al.
Pubblicazione: (2025) -
TRIM: Achieving Extreme Sparsity with Targeted Row-wise Iterative Metric-driven Pruning
di: Beck, Florentin, et al.
Pubblicazione: (2025) -
Forgotten Polygons: Multimodal Large Language Models are Shape-Blind
di: Rudman, William, et al.
Pubblicazione: (2025) -
Is There Knowledge Left to Extract? Evidence of Fragility in Medically Fine-Tuned Vision-Language Models
di: McLaughlin, Oliver, et al.
Pubblicazione: (2026)