A systematic framework for generating novel experimental hypotheses from language models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Misra, Kanishka, Kim, Najoung |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Vision-and-Language Training Helps Deploy Taxonomic Knowledge but Does Not Fundamentally Alter It
par: Qin, Yulu, et autres
Publié: (2025)
par: Qin, Yulu, et autres
Publié: (2025)
Hey, wait a minute: on at-issue sensitivity in Language Models
par: Kim, Sanghee J., et autres
Publié: (2025)
par: Kim, Sanghee J., et autres
Publié: (2025)
Experimental Contexts Can Facilitate Robust Semantic Property Inference in Language Models, but Inconsistently
par: Misra, Kanishka, et autres
Publié: (2024)
par: Misra, Kanishka, et autres
Publié: (2024)
Code Pretraining Improves Entity Tracking Abilities of Language Models
par: Kim, Najoung, et autres
Publié: (2024)
par: Kim, Najoung, et autres
Publié: (2024)
semantic-features: A User-Friendly Tool for Studying Contextual Word Embeddings in Interpretable Semantic Spaces
par: Ranganathan, Jwalanthi, et autres
Publié: (2025)
par: Ranganathan, Jwalanthi, et autres
Publié: (2025)
Language Models Learn Constructional Semantics, Not To Mention Syntax: Investigating LM Understanding of Paired-Focus Constructions
par: Scivetti, Wesley, et autres
Publié: (2026)
par: Scivetti, Wesley, et autres
Publié: (2026)
Cross-Modal Taxonomic Generalization in (Vision-) Language Models
par: Xu, Tianyang, et autres
Publié: (2026)
par: Xu, Tianyang, et autres
Publié: (2026)
A novel language model for predicting serious adverse event results in clinical trials from their prospective registrations
par: Hu, Qixuan, et autres
Publié: (2025)
par: Hu, Qixuan, et autres
Publié: (2025)
Death of the Novel(ty): Beyond n-Gram Novelty as a Metric for Textual Creativity
par: Saakyan, Arkadiy, et autres
Publié: (2025)
par: Saakyan, Arkadiy, et autres
Publié: (2025)
Is It JUST Semantics? A Case Study of Discourse Particle Understanding in LLMs
par: Sheffield, William, et autres
Publié: (2025)
par: Sheffield, William, et autres
Publié: (2025)
A systematic review of trial-matching pipelines using large language models
par: Morrison, Braxton A., et autres
Publié: (2025)
par: Morrison, Braxton A., et autres
Publié: (2025)
MacBehaviour: An R package for behavioural experimentation on large language models
par: Duan, Xufeng, et autres
Publié: (2024)
par: Duan, Xufeng, et autres
Publié: (2024)
A novel hallucination classification framework
par: Zavhorodnii, Maksym, et autres
Publié: (2025)
par: Zavhorodnii, Maksym, et autres
Publié: (2025)
One Thousand and One Pairs: A "novel" challenge for long-context language models
par: Karpinska, Marzena, et autres
Publié: (2024)
par: Karpinska, Marzena, et autres
Publié: (2024)
Lightweight reranking for language model generations
par: Jain, Siddhartha, et autres
Publié: (2023)
par: Jain, Siddhartha, et autres
Publié: (2023)
Personas as a Way to Model Truthfulness in Language Models
par: Joshi, Nitish, et autres
Publié: (2023)
par: Joshi, Nitish, et autres
Publié: (2023)
Can pre-trained language models generate titles for research papers?
par: Rehman, Tohida, et autres
Publié: (2024)
par: Rehman, Tohida, et autres
Publié: (2024)
Syllable-level lyrics generation from melody exploiting character-level language model
par: Zhang, Zhe, et autres
Publié: (2023)
par: Zhang, Zhe, et autres
Publié: (2023)
Do Language Models Track Entities Across State Changes?
par: Tang, Zilu, et autres
Publié: (2026)
par: Tang, Zilu, et autres
Publié: (2026)
Enhancing textual textbook question answering with large language models and retrieval augmented generation
par: Alawwad, Hessa Abdulrahman, et autres
Publié: (2024)
par: Alawwad, Hessa Abdulrahman, et autres
Publié: (2024)
The "LLM World of Words" English free association norms generated by large language models
par: Abramski, Katherine, et autres
Publié: (2024)
par: Abramski, Katherine, et autres
Publié: (2024)
Reasoning or Reciting? Exploring the Capabilities and Limitations of Language Models Through Counterfactual Tasks
par: Wu, Zhaofeng, et autres
Publié: (2023)
par: Wu, Zhaofeng, et autres
Publié: (2023)
Findings of the BlackboxNLP 2025 Shared Task: Localizing Circuits and Causal Variables in Language Models
par: Arad, Dana, et autres
Publié: (2025)
par: Arad, Dana, et autres
Publié: (2025)
AI-AI Bias: large language models favor communications generated by large language models
par: Laurito, Walter, et autres
Publié: (2024)
par: Laurito, Walter, et autres
Publié: (2024)
Large language models streamline automated systematic review: A preliminary study
par: Chen, Xi, et autres
Publié: (2025)
par: Chen, Xi, et autres
Publié: (2025)
Comparing large language models and human programmers for generating programming code
par: Hou, Wenpin, et autres
Publié: (2024)
par: Hou, Wenpin, et autres
Publié: (2024)
The role of large language models in UI/UX design: A systematic literature review
par: Ahmed, Ammar, et autres
Publié: (2025)
par: Ahmed, Ammar, et autres
Publié: (2025)
Why is constrained neural language generation particularly challenging?
par: Garbacea, Cristina, et autres
Publié: (2022)
par: Garbacea, Cristina, et autres
Publié: (2022)
Are generative AI text annotations systematically biased?
par: Stolwijk, Sjoerd B., et autres
Publié: (2025)
par: Stolwijk, Sjoerd B., et autres
Publié: (2025)
Dissociating language and thought in large language models
par: Mahowald, Kyle, et autres
Publié: (2023)
par: Mahowald, Kyle, et autres
Publié: (2023)
DepressLLM: Interpretable domain-adapted language model for depression detection from real-world narratives
par: Moon, Sehwan, et autres
Publié: (2025)
par: Moon, Sehwan, et autres
Publié: (2025)
ADMEDTAGGER: an annotation framework for distillation of expert knowledge for the Polish medical language
par: Górski, Franciszek, et autres
Publié: (2025)
par: Górski, Franciszek, et autres
Publié: (2025)
Differentially-private text generation degrades output language quality
par: Çano, Erion, et autres
Publié: (2025)
par: Çano, Erion, et autres
Publié: (2025)
Bridging vision language model (VLM) evaluation gaps with a framework for scalable and cost-effective benchmark generation
par: Rädsch, Tim, et autres
Publié: (2025)
par: Rädsch, Tim, et autres
Publié: (2025)
Large language models can consistently generate high-quality content for election disinformation operations
par: Williams, Angus R., et autres
Publié: (2024)
par: Williams, Angus R., et autres
Publié: (2024)
CXR-LLAVA: a multimodal large language model for interpreting chest X-ray images
par: Lee, Seowoo, et autres
Publié: (2023)
par: Lee, Seowoo, et autres
Publié: (2023)
A survey of textual cyber abuse detection using cutting-edge language models and large language models
par: Diaz-Garcia, Jose A., et autres
Publié: (2025)
par: Diaz-Garcia, Jose A., et autres
Publié: (2025)
Fluent dreaming for language models
par: Thompson, T. Ben, et autres
Publié: (2024)
par: Thompson, T. Ben, et autres
Publié: (2024)
Algorithmic progress in language models
par: Ho, Anson, et autres
Publié: (2024)
par: Ho, Anson, et autres
Publié: (2024)
Retrieval augmented generation based dynamic prompting for few-shot biomedical named entity recognition using large language models
par: Ge, Yao, et autres
Publié: (2025)
par: Ge, Yao, et autres
Publié: (2025)
Documents similaires
-
Vision-and-Language Training Helps Deploy Taxonomic Knowledge but Does Not Fundamentally Alter It
par: Qin, Yulu, et autres
Publié: (2025) -
Hey, wait a minute: on at-issue sensitivity in Language Models
par: Kim, Sanghee J., et autres
Publié: (2025) -
Experimental Contexts Can Facilitate Robust Semantic Property Inference in Language Models, but Inconsistently
par: Misra, Kanishka, et autres
Publié: (2024) -
Code Pretraining Improves Entity Tracking Abilities of Language Models
par: Kim, Najoung, et autres
Publié: (2024) -
semantic-features: A User-Friendly Tool for Studying Contextual Word Embeddings in Interpretable Semantic Spaces
par: Ranganathan, Jwalanthi, et autres
Publié: (2025)