Evaluating Large Language Models for Material Selection
Fuente:
arXiv
Saved in:
| Main Authors: | Grandi, Daniele, Jain, Yash Patawari, Groom, Allin, Cramer, Brandon, McComb, Christopher |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
MSEval: A Dataset for Material Selection in Conceptual Design to Evaluate Algorithmic Models
by: Jain, Yash Patawari, et al.
Published: (2024)
by: Jain, Yash Patawari, et al.
Published: (2024)
Exploring the Capabilities of Large Language Models for Generating Diverse Design Solutions
by: Ma, Kevin, et al.
Published: (2024)
by: Ma, Kevin, et al.
Published: (2024)
Evaluating Few-Shot Temporal Reasoning of LLMs for Human Activity Prediction in Smart Environments
by: Doctorarastoo, Maral, et al.
Published: (2026)
by: Doctorarastoo, Maral, et al.
Published: (2026)
On the effectiveness of Large Language Models in the mechanical design domain
by: Grandi, Daniele, et al.
Published: (2025)
by: Grandi, Daniele, et al.
Published: (2025)
Adaptive Learning of Design Strategies over Non-Hierarchical Multi-Fidelity Models via Policy Alignment
by: Agrawal, Akash, et al.
Published: (2024)
by: Agrawal, Akash, et al.
Published: (2024)
Ceci N'est Pas un Drone: Investigating the Impact of Design Representation on Design Decision Making When Using GenAI
by: Xu, Zeda, et al.
Published: (2025)
by: Xu, Zeda, et al.
Published: (2025)
What is isotropic turbulence and why is it important?
by: McComb, David
Published: (2024)
by: McComb, David
Published: (2024)
Adaptive Multi-Fidelity Reinforcement Learning for Variance Reduction in Engineering Design Optimization
by: Agrawal, Akash, et al.
Published: (2025)
by: Agrawal, Akash, et al.
Published: (2025)
Comparative Evaluation of Neural Network Architectures for Generalizable Human Spatial Preference Prediction in Unseen Built Environments
by: Doctorarastoo, Maral, et al.
Published: (2025)
by: Doctorarastoo, Maral, et al.
Published: (2025)
DesignQA: A Multimodal Benchmark for Evaluating Large Language Models' Understanding of Engineering Documentation
by: Doris, Anna C., et al.
Published: (2024)
by: Doris, Anna C., et al.
Published: (2024)
Smooth Like Butter: Evaluating Multi-Lattice Transitions in Property-Augmented Latent Spaces
by: Baldwin, Martha, et al.
Published: (2024)
by: Baldwin, Martha, et al.
Published: (2024)
Evaluating Consistency and Reasoning Capabilities of Large Language Models
by: Saxena, Yash, et al.
Published: (2024)
by: Saxena, Yash, et al.
Published: (2024)
RECALL-MM: A Multimodal Dataset of Consumer Product Recalls for Risk Analysis using Computational Methods and Large Language Models
by: Bolanos, Diana, et al.
Published: (2025)
by: Bolanos, Diana, et al.
Published: (2025)
Selection of Day Roosts by Female Long-Legged Myotis in the Central Oregon Cascade Range
by: Ormsbee, Patricia C., et al.
Published: (1998)
by: Ormsbee, Patricia C., et al.
Published: (1998)
Supervising Ralph Wiggum: Exploring a Metacognitive Co-Regulation Agentic AI Loop for Engineering Design
by: Xu, Zeda, et al.
Published: (2026)
by: Xu, Zeda, et al.
Published: (2026)
Large Language Models (LLMs) as Agents for Augmented Democracy
by: Gudiño-Rosero, Jairo, et al.
Published: (2024)
by: Gudiño-Rosero, Jairo, et al.
Published: (2024)
Evaluating Temporal Consistency in Multi-Turn Language Models
by: Atri, Yash Kumar, et al.
Published: (2026)
by: Atri, Yash Kumar, et al.
Published: (2026)
GARCH-Informed Neural Networks for Volatility Prediction in Financial Markets
by: Xu, Zeda, et al.
Published: (2024)
by: Xu, Zeda, et al.
Published: (2024)
Benchmarking Large Language Models on Answering and Explaining Challenging Medical Questions
by: Chen, Hanjie, et al.
Published: (2024)
by: Chen, Hanjie, et al.
Published: (2024)
From Tokens To Agents: A Researcher's Guide To Understanding Large Language Models
by: Barolo, Daniele
Published: (2026)
by: Barolo, Daniele
Published: (2026)
Persuasion Games using Large Language Models
by: Ramani, Ganesh Prasath, et al.
Published: (2024)
by: Ramani, Ganesh Prasath, et al.
Published: (2024)
PolygloToxicityPrompts: Multilingual Evaluation of Neural Toxic Degeneration in Large Language Models
by: Jain, Devansh, et al.
Published: (2024)
by: Jain, Devansh, et al.
Published: (2024)
Integrating Large Language Models with Graph-based Reasoning for Conversational Question Answering
by: Jain, Parag, et al.
Published: (2024)
by: Jain, Parag, et al.
Published: (2024)
DATE-LM: Benchmarking Data Attribution Evaluation for Large Language Models
by: Jiao, Cathy, et al.
Published: (2025)
by: Jiao, Cathy, et al.
Published: (2025)
Local Prompt Optimization
by: Jain, Yash, et al.
Published: (2025)
by: Jain, Yash, et al.
Published: (2025)
Evaluation of Deontic Conditional Reasoning in Large Language Models: The Case of Wason's Selection Task
by: Abe, Hirohiko, et al.
Published: (2026)
by: Abe, Hirohiko, et al.
Published: (2026)
Measuring Representation Robustness in Large Language Models for Geometry
by: Jawandhia, Vedant, et al.
Published: (2026)
by: Jawandhia, Vedant, et al.
Published: (2026)
Theory-Grounded Evaluation Exposes the Authorship Gap in LLM Personalization
by: Sawant, Yash Ganpat
Published: (2026)
by: Sawant, Yash Ganpat
Published: (2026)
MaterialBENCH: Evaluating College-Level Materials Science Problem-Solving Abilities of Large Language Models
by: Yoshitake, Michiko, et al.
Published: (2024)
by: Yoshitake, Michiko, et al.
Published: (2024)
ILID: Native Script Language Identification for Indian Languages
by: Ingle, Yash, et al.
Published: (2025)
by: Ingle, Yash, et al.
Published: (2025)
Large Language Models' Detection of Political Orientation in Newspapers
by: Buscemi, Alessio, et al.
Published: (2024)
by: Buscemi, Alessio, et al.
Published: (2024)
Chain of Logic: Rule-Based Reasoning with Large Language Models
by: Servantez, Sergio, et al.
Published: (2024)
by: Servantez, Sergio, et al.
Published: (2024)
Large Language Model-guided Document Selection
by: Kong, Xiang, et al.
Published: (2024)
by: Kong, Xiang, et al.
Published: (2024)
Evaluation of the Programming Skills of Large Language Models
by: Heitz, Luc Bryan, et al.
Published: (2024)
by: Heitz, Luc Bryan, et al.
Published: (2024)
Radial Networks: Dynamic Layer Routing for High-Performance Large Language Models
by: Dotzel, Jordan, et al.
Published: (2024)
by: Dotzel, Jordan, et al.
Published: (2024)
Compute Where it Counts: Self Optimizing Language Models
by: Akhauri, Yash, et al.
Published: (2026)
by: Akhauri, Yash, et al.
Published: (2026)
Artificial Impressions: Evaluating Large Language Model Behavior Through the Lens of Trait Impressions
by: Deas, Nicholas, et al.
Published: (2025)
by: Deas, Nicholas, et al.
Published: (2025)
Evaluating the Usage of African-American Vernacular English in Large Language Models
by: Dunlap, Deja, et al.
Published: (2026)
by: Dunlap, Deja, et al.
Published: (2026)
Evaluating Large Language Models with Psychometrics
by: Li, Yuan, et al.
Published: (2024)
by: Li, Yuan, et al.
Published: (2024)
Reading Subtext: Evaluating Large Language Models on Short Story Summarization with Writers
by: Subbiah, Melanie, et al.
Published: (2024)
by: Subbiah, Melanie, et al.
Published: (2024)
Similar Items
-
MSEval: A Dataset for Material Selection in Conceptual Design to Evaluate Algorithmic Models
by: Jain, Yash Patawari, et al.
Published: (2024) -
Exploring the Capabilities of Large Language Models for Generating Diverse Design Solutions
by: Ma, Kevin, et al.
Published: (2024) -
Evaluating Few-Shot Temporal Reasoning of LLMs for Human Activity Prediction in Smart Environments
by: Doctorarastoo, Maral, et al.
Published: (2026) -
On the effectiveness of Large Language Models in the mechanical design domain
by: Grandi, Daniele, et al.
Published: (2025) -
Adaptive Learning of Design Strategies over Non-Hierarchical Multi-Fidelity Models via Policy Alignment
by: Agrawal, Akash, et al.
Published: (2024)