TMIQ: Quantifying Test and Measurement Domain Intelligence in Large Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Olowe, Emmanuel A., Chitnis, Danial |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
LABIIUM: AI-Enhanced Zero-configuration Measurement Automation System
di: Olowe, Emmanuel A., et al.
Pubblicazione: (2024)
di: Olowe, Emmanuel A., et al.
Pubblicazione: (2024)
Policy-Governed LLM Routing with Intent Matching for Instrument Laboratories
di: Olowe, Emmanuel A., et al.
Pubblicazione: (2026)
di: Olowe, Emmanuel A., et al.
Pubblicazione: (2026)
LLM-based AI Agent for Sizing of Analog and Mixed Signal Circuit
di: Liu, Chang, et al.
Pubblicazione: (2025)
di: Liu, Chang, et al.
Pubblicazione: (2025)
How to Measure the Intelligence of Large Language Models?
di: Körber, Nils, et al.
Pubblicazione: (2024)
di: Körber, Nils, et al.
Pubblicazione: (2024)
GenePlan: Evolving Better Generalized PDDL Plans using Large Language Models
di: Murray, Andrew, et al.
Pubblicazione: (2026)
di: Murray, Andrew, et al.
Pubblicazione: (2026)
OFCnetLLM: Large Language Model for Network Monitoring and Alertness
di: Yoon, Hong-Jun, et al.
Pubblicazione: (2025)
di: Yoon, Hong-Jun, et al.
Pubblicazione: (2025)
PerMedCQA: Benchmarking Large Language Models on Medical Consumer Question Answering in Persian Language
di: Jamali, Naghmeh, et al.
Pubblicazione: (2025)
di: Jamali, Naghmeh, et al.
Pubblicazione: (2025)
Quantifying Laziness, Decoding Suboptimality, and Context Degradation in Large Language Models
di: Ma, Yiqing, et al.
Pubblicazione: (2025)
di: Ma, Yiqing, et al.
Pubblicazione: (2025)
Measuring and Analyzing Intelligence via Contextual Uncertainty in Large Language Models using Information-Theoretic Metrics
di: Shim, Jae Wan
Pubblicazione: (2025)
di: Shim, Jae Wan
Pubblicazione: (2025)
Quantifying Self-Preservation Bias in Large Language Models
di: Migliarini, Matteo, et al.
Pubblicazione: (2026)
di: Migliarini, Matteo, et al.
Pubblicazione: (2026)
Problems With Large Language Models for Learner Modelling: Why LLMs Alone Fall Short for Responsible Tutoring in K--12 Education
di: Hooshyar, Danial, et al.
Pubblicazione: (2025)
di: Hooshyar, Danial, et al.
Pubblicazione: (2025)
Polymetis:Large Language Modeling for Multiple Material Domains
di: Huang, Chao, et al.
Pubblicazione: (2024)
di: Huang, Chao, et al.
Pubblicazione: (2024)
Quantifying Fidelity: A Decisive Feature Approach to Comparing Synthetic and Real Imagery
di: Safaei, Danial, et al.
Pubblicazione: (2025)
di: Safaei, Danial, et al.
Pubblicazione: (2025)
DOCS: Quantifying Weight Similarity for Deeper Insights into Large Language Models
di: Min, Zeping, et al.
Pubblicazione: (2025)
di: Min, Zeping, et al.
Pubblicazione: (2025)
"Lost-in-the-Later": Framework for Quantifying Contextual Grounding in Large Language Models
di: Tao, Yufei, et al.
Pubblicazione: (2025)
di: Tao, Yufei, et al.
Pubblicazione: (2025)
xOffense: An Autonomous Multi-Agent Framework for Penetration Testing with Domain-Adapted Large Language Models
di: Luong, Phung Duc, et al.
Pubblicazione: (2025)
di: Luong, Phung Duc, et al.
Pubblicazione: (2025)
VibeCheck: Discover and Quantify Qualitative Differences in Large Language Models
di: Dunlap, Lisa, et al.
Pubblicazione: (2024)
di: Dunlap, Lisa, et al.
Pubblicazione: (2024)
Adversarial Moral Stress Testing of Large Language Models
di: Jamshidi, Saeid, et al.
Pubblicazione: (2026)
di: Jamshidi, Saeid, et al.
Pubblicazione: (2026)
Monotropic Artificial Intelligence: Toward a Cognitive Taxonomy of Domain-Specialized Language Models
di: Filho, Antonio de Sousa Leitão, et al.
Pubblicazione: (2026)
di: Filho, Antonio de Sousa Leitão, et al.
Pubblicazione: (2026)
Large Language Model's Multi-Capability Alignment in Biomedical Domain
di: Wu, Wentao, et al.
Pubblicazione: (2025)
di: Wu, Wentao, et al.
Pubblicazione: (2025)
Jailbreaking Large Vision Language Models in Intelligent Transportation Systems
di: Das, Badhan Chandra, et al.
Pubblicazione: (2025)
di: Das, Badhan Chandra, et al.
Pubblicazione: (2025)
Large Language Models as Planning Domain Generators
di: Oswald, James, et al.
Pubblicazione: (2024)
di: Oswald, James, et al.
Pubblicazione: (2024)
Quantifying Label-Induced Bias in Large Language Model Self- and Cross-Evaluations
di: Saraf, Muskan, et al.
Pubblicazione: (2025)
di: Saraf, Muskan, et al.
Pubblicazione: (2025)
FRoG: Evaluating Fuzzy Reasoning of Generalized Quantifiers in Large Language Models
di: Li, Yiyuan, et al.
Pubblicazione: (2024)
di: Li, Yiyuan, et al.
Pubblicazione: (2024)
Numerical Instability and Chaos: Quantifying the Unpredictability of Large Language Models
di: Islam, Chashi Mahiul, et al.
Pubblicazione: (2026)
di: Islam, Chashi Mahiul, et al.
Pubblicazione: (2026)
Assessing the Capability of Large Language Models for Domain-Specific Ontology Generation
di: Lippolis, Anna Sofia, et al.
Pubblicazione: (2025)
di: Lippolis, Anna Sofia, et al.
Pubblicazione: (2025)
Integrating Domain Knowledge into Process Discovery Using Large Language Models
di: Norouzifar, Ali, et al.
Pubblicazione: (2025)
di: Norouzifar, Ali, et al.
Pubblicazione: (2025)
Structured Cognitive Loop for Behavioral Intelligence in Large Language Model Agents
di: Kim, Myung Ho
Pubblicazione: (2025)
di: Kim, Myung Ho
Pubblicazione: (2025)
BioMistral: A Collection of Open-Source Pretrained Large Language Models for Medical Domains
di: Labrak, Yanis, et al.
Pubblicazione: (2024)
di: Labrak, Yanis, et al.
Pubblicazione: (2024)
Large Language Models in the Travel Domain: An Industrial Experience
di: Di Meglio, Sergio, et al.
Pubblicazione: (2025)
di: Di Meglio, Sergio, et al.
Pubblicazione: (2025)
Quantifying Semantic Emergence in Language Models
di: Chen, Hang, et al.
Pubblicazione: (2024)
di: Chen, Hang, et al.
Pubblicazione: (2024)
Large Language Models and Scientific Discourse: Where's the Intelligence?
di: Collins, Harry, et al.
Pubblicazione: (2026)
di: Collins, Harry, et al.
Pubblicazione: (2026)
Credal Transformer: A Principled Approach for Quantifying and Mitigating Hallucinations in Large Language Models
di: Ji, Shihao, et al.
Pubblicazione: (2025)
di: Ji, Shihao, et al.
Pubblicazione: (2025)
Metamorphic Testing of Large Language Models for Natural Language Processing
di: Cho, Steven, et al.
Pubblicazione: (2025)
di: Cho, Steven, et al.
Pubblicazione: (2025)
Active Testing of Large Language Models via Approximate Neyman Allocation
di: Liu, Zeli, et al.
Pubblicazione: (2026)
di: Liu, Zeli, et al.
Pubblicazione: (2026)
To Mix or To Merge: Toward Multi-Domain Reinforcement Learning for Large Language Models
di: Wang, Haoqing, et al.
Pubblicazione: (2026)
di: Wang, Haoqing, et al.
Pubblicazione: (2026)
Dynamic Guided and Domain Applicable Safeguards for Enhanced Security in Large Language Models
di: Luo, Weidi, et al.
Pubblicazione: (2024)
di: Luo, Weidi, et al.
Pubblicazione: (2024)
Quantifying and Understanding Uncertainty in Large Reasoning Models
di: Li, Yangyi, et al.
Pubblicazione: (2026)
di: Li, Yangyi, et al.
Pubblicazione: (2026)
Measuring and Augmenting Large Language Models for Solving Capture-the-Flag Challenges
di: Ji, Zimo, et al.
Pubblicazione: (2025)
di: Ji, Zimo, et al.
Pubblicazione: (2025)
SOCK: A Benchmark for Measuring Self-Replication in Large Language Models
di: Chavarria, Justin, et al.
Pubblicazione: (2025)
di: Chavarria, Justin, et al.
Pubblicazione: (2025)
Documenti analoghi
-
LABIIUM: AI-Enhanced Zero-configuration Measurement Automation System
di: Olowe, Emmanuel A., et al.
Pubblicazione: (2024) -
Policy-Governed LLM Routing with Intent Matching for Instrument Laboratories
di: Olowe, Emmanuel A., et al.
Pubblicazione: (2026) -
LLM-based AI Agent for Sizing of Analog and Mixed Signal Circuit
di: Liu, Chang, et al.
Pubblicazione: (2025) -
How to Measure the Intelligence of Large Language Models?
di: Körber, Nils, et al.
Pubblicazione: (2024) -
GenePlan: Evolving Better Generalized PDDL Plans using Large Language Models
di: Murray, Andrew, et al.
Pubblicazione: (2026)