Salvato in:
| Autori principali: | Rozner, Joshua, Shain, Cory |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2603.23821 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
BabyLM's First Constructions: Causal probing provides a signal of learning
di: Rozner, Joshua, et al.
Pubblicazione: (2025)
di: Rozner, Joshua, et al.
Pubblicazione: (2025)
Constructions are Revealed in Word Distributions
di: Rozner, Joshua, et al.
Pubblicazione: (2025)
di: Rozner, Joshua, et al.
Pubblicazione: (2025)
On the generalization of language models from in-context learning and finetuning: a controlled study
di: Lampinen, Andrew K., et al.
Pubblicazione: (2025)
di: Lampinen, Andrew K., et al.
Pubblicazione: (2025)
Survey on reinforcement learning for language processing
di: Uc-Cetina, Victor, et al.
Pubblicazione: (2021)
di: Uc-Cetina, Victor, et al.
Pubblicazione: (2021)
A general tensor-structured compression scheme for efficient large language models
di: Lu, Ying, et al.
Pubblicazione: (2026)
di: Lu, Ying, et al.
Pubblicazione: (2026)
Auditing language models for hidden objectives
di: Marks, Samuel, et al.
Pubblicazione: (2025)
di: Marks, Samuel, et al.
Pubblicazione: (2025)
The language of time: a language model perspective on time-series foundation models
di: Xie, Yi, et al.
Pubblicazione: (2025)
di: Xie, Yi, et al.
Pubblicazione: (2025)
Large language models can learn and generalize steganographic chain-of-thought under process supervision
di: Skaf, Joey, et al.
Pubblicazione: (2025)
di: Skaf, Joey, et al.
Pubblicazione: (2025)
A multimodal and temporal foundation model for virtual patient representations at healthcare system scale
di: Zhang, Andrew, et al.
Pubblicazione: (2026)
di: Zhang, Andrew, et al.
Pubblicazione: (2026)
Leveraging large language models for efficient representation learning for entity resolution
di: Xu, Xiaowei, et al.
Pubblicazione: (2024)
di: Xu, Xiaowei, et al.
Pubblicazione: (2024)
Representation in large language models
di: Yetman, Cameron
Pubblicazione: (2025)
di: Yetman, Cameron
Pubblicazione: (2025)
Is Sanskrit the most token-efficient language? A quantitative study using GPT, Gemini, and SentencePiece
di: Kumar, Anshul
Pubblicazione: (2026)
di: Kumar, Anshul
Pubblicazione: (2026)
Alignment faking in large language models
di: Greenblatt, Ryan, et al.
Pubblicazione: (2024)
di: Greenblatt, Ryan, et al.
Pubblicazione: (2024)
Lightweight reranking for language model generations
di: Jain, Siddhartha, et al.
Pubblicazione: (2023)
di: Jain, Siddhartha, et al.
Pubblicazione: (2023)
Extracting books from production language models
di: Ahmed, Ahmed, et al.
Pubblicazione: (2026)
di: Ahmed, Ahmed, et al.
Pubblicazione: (2026)
Long-form factuality in large language models
di: Wei, Jerry, et al.
Pubblicazione: (2024)
di: Wei, Jerry, et al.
Pubblicazione: (2024)
Can large language models explore in-context?
di: Krishnamurthy, Akshay, et al.
Pubblicazione: (2024)
di: Krishnamurthy, Akshay, et al.
Pubblicazione: (2024)
MetaGreen: Meta-Learning Inspired Transformer Selection for Green Semantic Communication
di: Mukherjee, Shubhabrata, et al.
Pubblicazione: (2024)
di: Mukherjee, Shubhabrata, et al.
Pubblicazione: (2024)
Are aligned neural networks adversarially aligned?
di: Carlini, Nicholas, et al.
Pubblicazione: (2023)
di: Carlini, Nicholas, et al.
Pubblicazione: (2023)
Artificial Aphasias in Lesioned Language Models
di: Roll, Nathan, et al.
Pubblicazione: (2026)
di: Roll, Nathan, et al.
Pubblicazione: (2026)
AI-AI Bias: large language models favor communications generated by large language models
di: Laurito, Walter, et al.
Pubblicazione: (2024)
di: Laurito, Walter, et al.
Pubblicazione: (2024)
Explore Theory of Mind: Program-guided adversarial data generation for theory of mind reasoning
di: Sclar, Melanie, et al.
Pubblicazione: (2024)
di: Sclar, Melanie, et al.
Pubblicazione: (2024)
A dataset and benchmark for hospital course summarization with adapted large language models
di: Aali, Asad, et al.
Pubblicazione: (2024)
di: Aali, Asad, et al.
Pubblicazione: (2024)
Directional Concentration Uncertainty: A representational approach to uncertainty quantification for generative models
di: Chattopadhyay, Souradeep, et al.
Pubblicazione: (2026)
di: Chattopadhyay, Souradeep, et al.
Pubblicazione: (2026)
Inducing anxiety in large language models can induce bias
di: Coda-Forno, Julian, et al.
Pubblicazione: (2023)
di: Coda-Forno, Julian, et al.
Pubblicazione: (2023)
Why Fine-Tuning Encourages Hallucinations and How to Fix It
di: Kaplan, Guy, et al.
Pubblicazione: (2026)
di: Kaplan, Guy, et al.
Pubblicazione: (2026)
Post-training makes large language models less human-like
di: Binz, Marcel, et al.
Pubblicazione: (2026)
di: Binz, Marcel, et al.
Pubblicazione: (2026)
MATH-Perturb: Benchmarking LLMs' Math Reasoning Abilities against Hard Perturbations
di: Huang, Kaixuan, et al.
Pubblicazione: (2025)
di: Huang, Kaixuan, et al.
Pubblicazione: (2025)
Safety and accuracy follow different scaling laws in clinical large language models
di: Wind, Sebastian, et al.
Pubblicazione: (2026)
di: Wind, Sebastian, et al.
Pubblicazione: (2026)
Vocabulary shapes cross-lingual variation of word-order learnability in language models
di: Martins, Jonas Mayer, et al.
Pubblicazione: (2026)
di: Martins, Jonas Mayer, et al.
Pubblicazione: (2026)
Fresh in memory: Training-order recency is linearly encoded in language model activations
di: Krasheninnikov, Dmitrii, et al.
Pubblicazione: (2025)
di: Krasheninnikov, Dmitrii, et al.
Pubblicazione: (2025)
Efficient semantic uncertainty quantification in language models via diversity-steered sampling
di: Park, Ji Won, et al.
Pubblicazione: (2025)
di: Park, Ji Won, et al.
Pubblicazione: (2025)
CogBench: a large language model walks into a psychology lab
di: Coda-Forno, Julian, et al.
Pubblicazione: (2024)
di: Coda-Forno, Julian, et al.
Pubblicazione: (2024)
Human-like object concept representations emerge naturally in multimodal large language models
di: Du, Changde, et al.
Pubblicazione: (2024)
di: Du, Changde, et al.
Pubblicazione: (2024)
Benchmarking large language models for biomedical natural language processing applications and recommendations
di: Chen, Qingyu, et al.
Pubblicazione: (2023)
di: Chen, Qingyu, et al.
Pubblicazione: (2023)
SteuerLLM: Local specialized large language model for German tax law analysis
di: Wind, Sebastian, et al.
Pubblicazione: (2026)
di: Wind, Sebastian, et al.
Pubblicazione: (2026)
Multi-step retrieval and reasoning improves radiology question answering with large language models
di: Wind, Sebastian, et al.
Pubblicazione: (2025)
di: Wind, Sebastian, et al.
Pubblicazione: (2025)
MAP's not dead yet: Uncovering true language model modes by conditioning away degeneracy
di: Yoshida, Davis, et al.
Pubblicazione: (2023)
di: Yoshida, Davis, et al.
Pubblicazione: (2023)
Multimodal large language model for wheat breeding: a new exploration of smart breeding
di: Yang, Guofeng, et al.
Pubblicazione: (2024)
di: Yang, Guofeng, et al.
Pubblicazione: (2024)
MedicalBERT: enhancing biomedical natural language processing using pretrained BERT-based model
di: Reddy, K. Sahit, et al.
Pubblicazione: (2025)
di: Reddy, K. Sahit, et al.
Pubblicazione: (2025)
Documenti analoghi
-
BabyLM's First Constructions: Causal probing provides a signal of learning
di: Rozner, Joshua, et al.
Pubblicazione: (2025) -
Constructions are Revealed in Word Distributions
di: Rozner, Joshua, et al.
Pubblicazione: (2025) -
On the generalization of language models from in-context learning and finetuning: a controlled study
di: Lampinen, Andrew K., et al.
Pubblicazione: (2025) -
Survey on reinforcement learning for language processing
di: Uc-Cetina, Victor, et al.
Pubblicazione: (2021) -
A general tensor-structured compression scheme for efficient large language models
di: Lu, Ying, et al.
Pubblicazione: (2026)