Pre-training LLMs using human-like development data corpus
Fuente:
arXiv
Guardado en:
| Autores principales: | Bhardwaj, Khushi, Shah, Raj Sanjay, Varma, Sashank |
|---|---|
| Formato: | Preprint |
| Publicado: |
2023
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Development of Cognitive Intelligence in Pre-trained Language Models
por: Shah, Raj Sanjay, et al.
Publicado: (2024)
por: Shah, Raj Sanjay, et al.
Publicado: (2024)
The potential -- and the pitfalls -- of using pre-trained language models as cognitive science theories
por: Shah, Raj Sanjay, et al.
Publicado: (2025)
por: Shah, Raj Sanjay, et al.
Publicado: (2025)
How Well Do Deep Learning Models Capture Human Concepts? The Case of the Typicality Effect
por: Vemuri, Siddhartha K., et al.
Publicado: (2024)
por: Vemuri, Siddhartha K., et al.
Publicado: (2024)
Human Behavioral Benchmarking: Numeric Magnitude Comparison Effects in Large Language Models
por: Shah, Raj Sanjay, et al.
Publicado: (2023)
por: Shah, Raj Sanjay, et al.
Publicado: (2023)
The World According to LLMs: How Geographic Origin Influences LLMs' Entity Deduction Capabilities
por: Lalai, Harsh Nishant, et al.
Publicado: (2025)
por: Lalai, Harsh Nishant, et al.
Publicado: (2025)
The Representational Geometry of Number
por: Hu, Zhimin, et al.
Publicado: (2026)
por: Hu, Zhimin, et al.
Publicado: (2026)
Towards a Path Dependent Account of Category Fluency
por: Heineman, David, et al.
Publicado: (2024)
por: Heineman, David, et al.
Publicado: (2024)
Are More Tokens Rational? Inference-Time Scaling in Language Models as Adaptive Resource Rationality
por: Hu, Zhimin, et al.
Publicado: (2026)
por: Hu, Zhimin, et al.
Publicado: (2026)
Modeling Understanding of Story-Based Analogies Using Large Language Models
por: Inani, Kalit, et al.
Publicado: (2025)
por: Inani, Kalit, et al.
Publicado: (2025)
Natural Mitigation of Catastrophic Interference: Continual Learning in Power-Law Learning Environments
por: Gandhi, Atith, et al.
Publicado: (2024)
por: Gandhi, Atith, et al.
Publicado: (2024)
When Visuals Aren't the Problem: Evaluating Vision-Language Models on Misleading Data Visualizations
por: Lalai, Harsh Nishant, et al.
Publicado: (2026)
por: Lalai, Harsh Nishant, et al.
Publicado: (2026)
Understanding Graphical Perception in Data Visualization through Zero-shot Prompting of Vision-Language Models
por: Guo, Grace, et al.
Publicado: (2024)
por: Guo, Grace, et al.
Publicado: (2024)
Adaptive Layer-skipping in Pre-trained LLMs
por: Luo, Xuan, et al.
Publicado: (2025)
por: Luo, Xuan, et al.
Publicado: (2025)
Automated Detection of Pre-training Text in Black-box LLMs
por: Hu, Ruihan, et al.
Publicado: (2025)
por: Hu, Ruihan, et al.
Publicado: (2025)
HumT DumT: Measuring and controlling human-like language in LLMs
por: Cheng, Myra, et al.
Publicado: (2025)
por: Cheng, Myra, et al.
Publicado: (2025)
From Intentions to Techniques: A Comprehensive Taxonomy and Challenges in Text Watermarking for Large Language Models
por: Lalai, Harsh Nishant, et al.
Publicado: (2024)
por: Lalai, Harsh Nishant, et al.
Publicado: (2024)
STAGE: Simplified Text-Attributed Graph Embeddings Using Pre-trained LLMs
por: Zolnai-Lucas, Aaron, et al.
Publicado: (2024)
por: Zolnai-Lucas, Aaron, et al.
Publicado: (2024)
Calibrating Pre-trained Language Classifiers on LLM-generated Noisy Labels via Iterative Refinement
por: Ye, Liqin, et al.
Publicado: (2025)
por: Ye, Liqin, et al.
Publicado: (2025)
Post-training makes large language models less human-like
por: Binz, Marcel, et al.
Publicado: (2026)
por: Binz, Marcel, et al.
Publicado: (2026)
CycleDistill: Bootstrapping Machine Translation using LLMs with Cyclical Distillation
por: Halder, Deepon, et al.
Publicado: (2025)
por: Halder, Deepon, et al.
Publicado: (2025)
TN-Eval: Rubric and Evaluation Protocols for Measuring the Quality of Behavioral Therapy Notes
por: Shah, Raj Sanjay, et al.
Publicado: (2025)
por: Shah, Raj Sanjay, et al.
Publicado: (2025)
Beyond-RAG: Question Identification and Answer Generation in Real-Time Conversations
por: Agrawal, Garima, et al.
Publicado: (2024)
por: Agrawal, Garima, et al.
Publicado: (2024)
Evaluating the Pre-Consultation Ability of LLMs using Diagnostic Guidelines
por: Seo, Jean, et al.
Publicado: (2026)
por: Seo, Jean, et al.
Publicado: (2026)
Rethinking the Outlier Distribution in Large Language Models: An In-depth Study
por: Raman, Rahul, et al.
Publicado: (2025)
por: Raman, Rahul, et al.
Publicado: (2025)
Knowledge-Instruct: Effective Continual Pre-training from Limited Data using Instructions
por: Ovadia, Oded, et al.
Publicado: (2025)
por: Ovadia, Oded, et al.
Publicado: (2025)
Exploring the Benefit of Activation Sparsity in Pre-training
por: Zhang, Zhengyan, et al.
Publicado: (2024)
por: Zhang, Zhengyan, et al.
Publicado: (2024)
Scaling LLM Pre-training with Vocabulary Curriculum
por: Yu, Fangyuan
Publicado: (2025)
por: Yu, Fangyuan
Publicado: (2025)
Lightweight Clinical Decision Support System using QLoRA-Fine-Tuned LLMs and Retrieval-Augmented Generation
por: Ansari, Mohammad Shoaib, et al.
Publicado: (2025)
por: Ansari, Mohammad Shoaib, et al.
Publicado: (2025)
The Chameleon Nature of LLMs: Quantifying Multi-Turn Stance Instability in Search-Enabled Language Models
por: Ratnakar, Shivam, et al.
Publicado: (2025)
por: Ratnakar, Shivam, et al.
Publicado: (2025)
Towards Smarter Hiring: Are Zero-Shot and Few-Shot Pre-trained LLMs Ready for HR Spoken Interview Transcript Analysis?
por: Maity, Subhankar, et al.
Publicado: (2025)
por: Maity, Subhankar, et al.
Publicado: (2025)
PreCog: Exploring the Relation between Memorization and Performance in Pre-trained Language Models
por: Ranaldi, Leonardo, et al.
Publicado: (2023)
por: Ranaldi, Leonardo, et al.
Publicado: (2023)
Benchmarking the Performance of Pre-trained LLMs across Urdu NLP Tasks
por: Tahir, Munief Hassan, et al.
Publicado: (2024)
por: Tahir, Munief Hassan, et al.
Publicado: (2024)
Probing Language Models for Pre-training Data Detection
por: Liu, Zhenhua, et al.
Publicado: (2024)
por: Liu, Zhenhua, et al.
Publicado: (2024)
Signatures of human-like processing in Transformer forward passes
por: Hu, Jennifer, et al.
Publicado: (2025)
por: Hu, Jennifer, et al.
Publicado: (2025)
Multilingual Mathematical Reasoning: Advancing Open-Source LLMs in Hindi and English
por: Anand, Avinash, et al.
Publicado: (2024)
por: Anand, Avinash, et al.
Publicado: (2024)
Optimizing LLMs for Resource-Constrained Environments: A Survey of Model Compression Techniques
por: Girija, Sanjay Surendranath, et al.
Publicado: (2025)
por: Girija, Sanjay Surendranath, et al.
Publicado: (2025)
Interpretable Emergent Language Using Inter-Agent Transformers
por: Bhardwaj, Mannan
Publicado: (2025)
por: Bhardwaj, Mannan
Publicado: (2025)
Can LLMs Detect Their Confabulations? Estimating Reliability in Uncertainty-Aware Language Models
por: Zhou, Tianyi, et al.
Publicado: (2025)
por: Zhou, Tianyi, et al.
Publicado: (2025)
Spike No More: Stabilizing the Pre-training of Large Language Models
por: Takase, Sho, et al.
Publicado: (2023)
por: Takase, Sho, et al.
Publicado: (2023)
Can Pre-trained Language Models Understand Chinese Humor?
por: Chen, Yuyan, et al.
Publicado: (2024)
por: Chen, Yuyan, et al.
Publicado: (2024)
Ejemplares similares
-
Development of Cognitive Intelligence in Pre-trained Language Models
por: Shah, Raj Sanjay, et al.
Publicado: (2024) -
The potential -- and the pitfalls -- of using pre-trained language models as cognitive science theories
por: Shah, Raj Sanjay, et al.
Publicado: (2025) -
How Well Do Deep Learning Models Capture Human Concepts? The Case of the Typicality Effect
por: Vemuri, Siddhartha K., et al.
Publicado: (2024) -
Human Behavioral Benchmarking: Numeric Magnitude Comparison Effects in Large Language Models
por: Shah, Raj Sanjay, et al.
Publicado: (2023) -
The World According to LLMs: How Geographic Origin Influences LLMs' Entity Deduction Capabilities
por: Lalai, Harsh Nishant, et al.
Publicado: (2025)