Pre-training LLMs using human-like development data corpus
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Bhardwaj, Khushi, Shah, Raj Sanjay, Varma, Sashank |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Development of Cognitive Intelligence in Pre-trained Language Models
par: Shah, Raj Sanjay, et autres
Publié: (2024)
par: Shah, Raj Sanjay, et autres
Publié: (2024)
The potential -- and the pitfalls -- of using pre-trained language models as cognitive science theories
par: Shah, Raj Sanjay, et autres
Publié: (2025)
par: Shah, Raj Sanjay, et autres
Publié: (2025)
How Well Do Deep Learning Models Capture Human Concepts? The Case of the Typicality Effect
par: Vemuri, Siddhartha K., et autres
Publié: (2024)
par: Vemuri, Siddhartha K., et autres
Publié: (2024)
Human Behavioral Benchmarking: Numeric Magnitude Comparison Effects in Large Language Models
par: Shah, Raj Sanjay, et autres
Publié: (2023)
par: Shah, Raj Sanjay, et autres
Publié: (2023)
The World According to LLMs: How Geographic Origin Influences LLMs' Entity Deduction Capabilities
par: Lalai, Harsh Nishant, et autres
Publié: (2025)
par: Lalai, Harsh Nishant, et autres
Publié: (2025)
The Representational Geometry of Number
par: Hu, Zhimin, et autres
Publié: (2026)
par: Hu, Zhimin, et autres
Publié: (2026)
Towards a Path Dependent Account of Category Fluency
par: Heineman, David, et autres
Publié: (2024)
par: Heineman, David, et autres
Publié: (2024)
Are More Tokens Rational? Inference-Time Scaling in Language Models as Adaptive Resource Rationality
par: Hu, Zhimin, et autres
Publié: (2026)
par: Hu, Zhimin, et autres
Publié: (2026)
Modeling Understanding of Story-Based Analogies Using Large Language Models
par: Inani, Kalit, et autres
Publié: (2025)
par: Inani, Kalit, et autres
Publié: (2025)
Natural Mitigation of Catastrophic Interference: Continual Learning in Power-Law Learning Environments
par: Gandhi, Atith, et autres
Publié: (2024)
par: Gandhi, Atith, et autres
Publié: (2024)
When Visuals Aren't the Problem: Evaluating Vision-Language Models on Misleading Data Visualizations
par: Lalai, Harsh Nishant, et autres
Publié: (2026)
par: Lalai, Harsh Nishant, et autres
Publié: (2026)
Understanding Graphical Perception in Data Visualization through Zero-shot Prompting of Vision-Language Models
par: Guo, Grace, et autres
Publié: (2024)
par: Guo, Grace, et autres
Publié: (2024)
Adaptive Layer-skipping in Pre-trained LLMs
par: Luo, Xuan, et autres
Publié: (2025)
par: Luo, Xuan, et autres
Publié: (2025)
Automated Detection of Pre-training Text in Black-box LLMs
par: Hu, Ruihan, et autres
Publié: (2025)
par: Hu, Ruihan, et autres
Publié: (2025)
HumT DumT: Measuring and controlling human-like language in LLMs
par: Cheng, Myra, et autres
Publié: (2025)
par: Cheng, Myra, et autres
Publié: (2025)
STAGE: Simplified Text-Attributed Graph Embeddings Using Pre-trained LLMs
par: Zolnai-Lucas, Aaron, et autres
Publié: (2024)
par: Zolnai-Lucas, Aaron, et autres
Publié: (2024)
From Intentions to Techniques: A Comprehensive Taxonomy and Challenges in Text Watermarking for Large Language Models
par: Lalai, Harsh Nishant, et autres
Publié: (2024)
par: Lalai, Harsh Nishant, et autres
Publié: (2024)
Calibrating Pre-trained Language Classifiers on LLM-generated Noisy Labels via Iterative Refinement
par: Ye, Liqin, et autres
Publié: (2025)
par: Ye, Liqin, et autres
Publié: (2025)
Post-training makes large language models less human-like
par: Binz, Marcel, et autres
Publié: (2026)
par: Binz, Marcel, et autres
Publié: (2026)
CycleDistill: Bootstrapping Machine Translation using LLMs with Cyclical Distillation
par: Halder, Deepon, et autres
Publié: (2025)
par: Halder, Deepon, et autres
Publié: (2025)
TN-Eval: Rubric and Evaluation Protocols for Measuring the Quality of Behavioral Therapy Notes
par: Shah, Raj Sanjay, et autres
Publié: (2025)
par: Shah, Raj Sanjay, et autres
Publié: (2025)
Beyond-RAG: Question Identification and Answer Generation in Real-Time Conversations
par: Agrawal, Garima, et autres
Publié: (2024)
par: Agrawal, Garima, et autres
Publié: (2024)
Evaluating the Pre-Consultation Ability of LLMs using Diagnostic Guidelines
par: Seo, Jean, et autres
Publié: (2026)
par: Seo, Jean, et autres
Publié: (2026)
Rethinking the Outlier Distribution in Large Language Models: An In-depth Study
par: Raman, Rahul, et autres
Publié: (2025)
par: Raman, Rahul, et autres
Publié: (2025)
Knowledge-Instruct: Effective Continual Pre-training from Limited Data using Instructions
par: Ovadia, Oded, et autres
Publié: (2025)
par: Ovadia, Oded, et autres
Publié: (2025)
Exploring the Benefit of Activation Sparsity in Pre-training
par: Zhang, Zhengyan, et autres
Publié: (2024)
par: Zhang, Zhengyan, et autres
Publié: (2024)
Scaling LLM Pre-training with Vocabulary Curriculum
par: Yu, Fangyuan
Publié: (2025)
par: Yu, Fangyuan
Publié: (2025)
Lightweight Clinical Decision Support System using QLoRA-Fine-Tuned LLMs and Retrieval-Augmented Generation
par: Ansari, Mohammad Shoaib, et autres
Publié: (2025)
par: Ansari, Mohammad Shoaib, et autres
Publié: (2025)
The Chameleon Nature of LLMs: Quantifying Multi-Turn Stance Instability in Search-Enabled Language Models
par: Ratnakar, Shivam, et autres
Publié: (2025)
par: Ratnakar, Shivam, et autres
Publié: (2025)
Towards Smarter Hiring: Are Zero-Shot and Few-Shot Pre-trained LLMs Ready for HR Spoken Interview Transcript Analysis?
par: Maity, Subhankar, et autres
Publié: (2025)
par: Maity, Subhankar, et autres
Publié: (2025)
PreCog: Exploring the Relation between Memorization and Performance in Pre-trained Language Models
par: Ranaldi, Leonardo, et autres
Publié: (2023)
par: Ranaldi, Leonardo, et autres
Publié: (2023)
Benchmarking the Performance of Pre-trained LLMs across Urdu NLP Tasks
par: Tahir, Munief Hassan, et autres
Publié: (2024)
par: Tahir, Munief Hassan, et autres
Publié: (2024)
Probing Language Models for Pre-training Data Detection
par: Liu, Zhenhua, et autres
Publié: (2024)
par: Liu, Zhenhua, et autres
Publié: (2024)
Signatures of human-like processing in Transformer forward passes
par: Hu, Jennifer, et autres
Publié: (2025)
par: Hu, Jennifer, et autres
Publié: (2025)
Multilingual Mathematical Reasoning: Advancing Open-Source LLMs in Hindi and English
par: Anand, Avinash, et autres
Publié: (2024)
par: Anand, Avinash, et autres
Publié: (2024)
Interpretable Emergent Language Using Inter-Agent Transformers
par: Bhardwaj, Mannan
Publié: (2025)
par: Bhardwaj, Mannan
Publié: (2025)
Optimizing LLMs for Resource-Constrained Environments: A Survey of Model Compression Techniques
par: Girija, Sanjay Surendranath, et autres
Publié: (2025)
par: Girija, Sanjay Surendranath, et autres
Publié: (2025)
Can LLMs Detect Their Confabulations? Estimating Reliability in Uncertainty-Aware Language Models
par: Zhou, Tianyi, et autres
Publié: (2025)
par: Zhou, Tianyi, et autres
Publié: (2025)
Spike No More: Stabilizing the Pre-training of Large Language Models
par: Takase, Sho, et autres
Publié: (2023)
par: Takase, Sho, et autres
Publié: (2023)
Can Pre-trained Language Models Understand Chinese Humor?
par: Chen, Yuyan, et autres
Publié: (2024)
par: Chen, Yuyan, et autres
Publié: (2024)
Documents similaires
-
Development of Cognitive Intelligence in Pre-trained Language Models
par: Shah, Raj Sanjay, et autres
Publié: (2024) -
The potential -- and the pitfalls -- of using pre-trained language models as cognitive science theories
par: Shah, Raj Sanjay, et autres
Publié: (2025) -
How Well Do Deep Learning Models Capture Human Concepts? The Case of the Typicality Effect
par: Vemuri, Siddhartha K., et autres
Publié: (2024) -
Human Behavioral Benchmarking: Numeric Magnitude Comparison Effects in Large Language Models
par: Shah, Raj Sanjay, et autres
Publié: (2023) -
The World According to LLMs: How Geographic Origin Influences LLMs' Entity Deduction Capabilities
par: Lalai, Harsh Nishant, et autres
Publié: (2025)