Representation in large language models
Fuente:
arXiv
Salvato in:
| Autore principale: | Yetman, Cameron |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Alignment faking in large language models
di: Greenblatt, Ryan, et al.
Pubblicazione: (2024)
di: Greenblatt, Ryan, et al.
Pubblicazione: (2024)
Long-form factuality in large language models
di: Wei, Jerry, et al.
Pubblicazione: (2024)
di: Wei, Jerry, et al.
Pubblicazione: (2024)
Can large language models explore in-context?
di: Krishnamurthy, Akshay, et al.
Pubblicazione: (2024)
di: Krishnamurthy, Akshay, et al.
Pubblicazione: (2024)
AI-AI Bias: large language models favor communications generated by large language models
di: Laurito, Walter, et al.
Pubblicazione: (2024)
di: Laurito, Walter, et al.
Pubblicazione: (2024)
Inducing anxiety in large language models can induce bias
di: Coda-Forno, Julian, et al.
Pubblicazione: (2023)
di: Coda-Forno, Julian, et al.
Pubblicazione: (2023)
Post-training makes large language models less human-like
di: Binz, Marcel, et al.
Pubblicazione: (2026)
di: Binz, Marcel, et al.
Pubblicazione: (2026)
Safety and accuracy follow different scaling laws in clinical large language models
di: Wind, Sebastian, et al.
Pubblicazione: (2026)
di: Wind, Sebastian, et al.
Pubblicazione: (2026)
A dataset and benchmark for hospital course summarization with adapted large language models
di: Aali, Asad, et al.
Pubblicazione: (2024)
di: Aali, Asad, et al.
Pubblicazione: (2024)
CogBench: a large language model walks into a psychology lab
di: Coda-Forno, Julian, et al.
Pubblicazione: (2024)
di: Coda-Forno, Julian, et al.
Pubblicazione: (2024)
Multi-step retrieval and reasoning improves radiology question answering with large language models
di: Wind, Sebastian, et al.
Pubblicazione: (2025)
di: Wind, Sebastian, et al.
Pubblicazione: (2025)
SteuerLLM: Local specialized large language model for German tax law analysis
di: Wind, Sebastian, et al.
Pubblicazione: (2026)
di: Wind, Sebastian, et al.
Pubblicazione: (2026)
Multimodal large language model for wheat breeding: a new exploration of smart breeding
di: Yang, Guofeng, et al.
Pubblicazione: (2024)
di: Yang, Guofeng, et al.
Pubblicazione: (2024)
Mathematics with large language models as provers and verifiers
di: Duc, Hieu Le, et al.
Pubblicazione: (2025)
di: Duc, Hieu Le, et al.
Pubblicazione: (2025)
Benchmarking large language models for biomedical natural language processing applications and recommendations
di: Chen, Qingyu, et al.
Pubblicazione: (2023)
di: Chen, Qingyu, et al.
Pubblicazione: (2023)
Physical models realizing the transformer architecture of large language models
di: Chen, Zeqian
Pubblicazione: (2025)
di: Chen, Zeqian
Pubblicazione: (2025)
Zero-shot data citation function classification using transformer-based large language models (LLMs)
di: Byers, Neil, et al.
Pubblicazione: (2025)
di: Byers, Neil, et al.
Pubblicazione: (2025)
The language of time: a language model perspective on time-series foundation models
di: Xie, Yi, et al.
Pubblicazione: (2025)
di: Xie, Yi, et al.
Pubblicazione: (2025)
An artificial intelligence framework for end-to-end rare disease phenotyping from clinical notes using large language models
di: Shyr, Cathy, et al.
Pubblicazione: (2026)
di: Shyr, Cathy, et al.
Pubblicazione: (2026)
Can a large language model be a gaslighter?
di: Li, Wei, et al.
Pubblicazione: (2024)
di: Li, Wei, et al.
Pubblicazione: (2024)
Can large language models replace humans in the systematic review process? Evaluating GPT-4's efficacy in screening and extracting data from peer-reviewed and grey literature in multiple languages
di: Khraisha, Qusai, et al.
Pubblicazione: (2023)
di: Khraisha, Qusai, et al.
Pubblicazione: (2023)
Block removal for large language models through constrained binary optimization
di: Jansen, David, et al.
Pubblicazione: (2026)
di: Jansen, David, et al.
Pubblicazione: (2026)
Extracting effective solutions hidden in large language models via generated comprehensive specialists: case studies in developing electronic devices
di: Tomita, Hikari, et al.
Pubblicazione: (2024)
di: Tomita, Hikari, et al.
Pubblicazione: (2024)
Large language models can learn and generalize steganographic chain-of-thought under process supervision
di: Skaf, Joey, et al.
Pubblicazione: (2025)
di: Skaf, Joey, et al.
Pubblicazione: (2025)
The opportunities and risks of large language models in mental health
di: Lawrence, Hannah R., et al.
Pubblicazione: (2024)
di: Lawrence, Hannah R., et al.
Pubblicazione: (2024)
Attack and defense techniques in large language models: A survey and new perspectives
di: Liao, Zhiyu, et al.
Pubblicazione: (2025)
di: Liao, Zhiyu, et al.
Pubblicazione: (2025)
A general tensor-structured compression scheme for efficient large language models
di: Lu, Ying, et al.
Pubblicazione: (2026)
di: Lu, Ying, et al.
Pubblicazione: (2026)
Auditing language models for hidden objectives
di: Marks, Samuel, et al.
Pubblicazione: (2025)
di: Marks, Samuel, et al.
Pubblicazione: (2025)
Lightweight reranking for language model generations
di: Jain, Siddhartha, et al.
Pubblicazione: (2023)
di: Jain, Siddhartha, et al.
Pubblicazione: (2023)
Extracting books from production language models
di: Ahmed, Ahmed, et al.
Pubblicazione: (2026)
di: Ahmed, Ahmed, et al.
Pubblicazione: (2026)
Fresh in memory: Training-order recency is linearly encoded in language model activations
di: Krasheninnikov, Dmitrii, et al.
Pubblicazione: (2025)
di: Krasheninnikov, Dmitrii, et al.
Pubblicazione: (2025)
On the generalization of language models from in-context learning and finetuning: a controlled study
di: Lampinen, Andrew K., et al.
Pubblicazione: (2025)
di: Lampinen, Andrew K., et al.
Pubblicazione: (2025)
Efficient semantic uncertainty quantification in language models via diversity-steered sampling
di: Park, Ji Won, et al.
Pubblicazione: (2025)
di: Park, Ji Won, et al.
Pubblicazione: (2025)
Vocabulary shapes cross-lingual variation of word-order learnability in language models
di: Martins, Jonas Mayer, et al.
Pubblicazione: (2026)
di: Martins, Jonas Mayer, et al.
Pubblicazione: (2026)
Perturbation: A simple and efficient adversarial tracer for representation learning in language models
di: Rozner, Joshua, et al.
Pubblicazione: (2026)
di: Rozner, Joshua, et al.
Pubblicazione: (2026)
MAP's not dead yet: Uncovering true language model modes by conditioning away degeneracy
di: Yoshida, Davis, et al.
Pubblicazione: (2023)
di: Yoshida, Davis, et al.
Pubblicazione: (2023)
MedicalBERT: enhancing biomedical natural language processing using pretrained BERT-based model
di: Reddy, K. Sahit, et al.
Pubblicazione: (2025)
di: Reddy, K. Sahit, et al.
Pubblicazione: (2025)
Linear probes rely on textual evidence: Results from leakage mitigation studies in language models
di: Boxo, Gerard, et al.
Pubblicazione: (2025)
di: Boxo, Gerard, et al.
Pubblicazione: (2025)
Towards a copilot in BIM authoring tool using a large language model-based agent for intelligent human-machine interaction
di: Du, Changyu, et al.
Pubblicazione: (2024)
di: Du, Changyu, et al.
Pubblicazione: (2024)
A Philosophical Introduction to Language Models -- Part I: Continuity With Classic Debates
di: Millière, Raphaël, et al.
Pubblicazione: (2024)
di: Millière, Raphaël, et al.
Pubblicazione: (2024)
Can social media provide early warning of retraction? Evidence from critical tweets identified by human annotation and large language models
di: Zheng, Er-Te, et al.
Pubblicazione: (2024)
di: Zheng, Er-Te, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Alignment faking in large language models
di: Greenblatt, Ryan, et al.
Pubblicazione: (2024) -
Long-form factuality in large language models
di: Wei, Jerry, et al.
Pubblicazione: (2024) -
Can large language models explore in-context?
di: Krishnamurthy, Akshay, et al.
Pubblicazione: (2024) -
AI-AI Bias: large language models favor communications generated by large language models
di: Laurito, Walter, et al.
Pubblicazione: (2024) -
Inducing anxiety in large language models can induce bias
di: Coda-Forno, Julian, et al.
Pubblicazione: (2023)