Framework-Based Qualitative Analysis of Free Responses of Large Language Models: Algorithmic Fidelity
Fuente:
arXiv
Salvato in:
| Autori principali: | Amirova, Aliya, Fteropoulli, Theodora, Ahmed, Nafiso, Cowie, Martin R., Leibo, Joel Z. |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Simulation Streams: A Programming Paradigm for Controlling Large Language Models and Building Complex Systems with Generative AI
di: Sunehag, Peter, et al.
Pubblicazione: (2025)
di: Sunehag, Peter, et al.
Pubblicazione: (2025)
Evaluating Cooperation in LLM Social Groups through Elected Leadership
di: Faulkner, Ryan, et al.
Pubblicazione: (2026)
di: Faulkner, Ryan, et al.
Pubblicazione: (2026)
How LLMs Distort Our Written Language
di: Abdulhai, Marwa, et al.
Pubblicazione: (2026)
di: Abdulhai, Marwa, et al.
Pubblicazione: (2026)
A Voter-Based Stochastic Rejection-Method Framework for Asymptotically Safe Language Model Outputs
di: Watts, Jake R., et al.
Pubblicazione: (2024)
di: Watts, Jake R., et al.
Pubblicazione: (2024)
A Hybrid Framework for Subject Analysis: Integrating Embedding-Based Regression Models with Large Language Models
di: Liu, Jinyu, et al.
Pubblicazione: (2025)
di: Liu, Jinyu, et al.
Pubblicazione: (2025)
The Arabic AI Fingerprint: Stylometric Analysis and Detection of Large Language Models Text
di: Al-Shaibani, Maged S., et al.
Pubblicazione: (2025)
di: Al-Shaibani, Maged S., et al.
Pubblicazione: (2025)
Meaning Is Not A Metric: Using LLMs to make cultural context legible at scale
di: Kommers, Cody, et al.
Pubblicazione: (2025)
di: Kommers, Cody, et al.
Pubblicazione: (2025)
VibeCheck: Discover and Quantify Qualitative Differences in Large Language Models
di: Dunlap, Lisa, et al.
Pubblicazione: (2024)
di: Dunlap, Lisa, et al.
Pubblicazione: (2024)
FreeEval: A Modular Framework for Trustworthy and Efficient Evaluation of Large Language Models
di: Yu, Zhuohao, et al.
Pubblicazione: (2024)
di: Yu, Zhuohao, et al.
Pubblicazione: (2024)
ChemATP: A Training-Free Chemical Reasoning Framework for Large Language Models
di: Zhang, Mingxu, et al.
Pubblicazione: (2025)
di: Zhang, Mingxu, et al.
Pubblicazione: (2025)
A Framework for Real-time Safeguarding the Text Generation of Large Language Model
di: Dong, Ximing, et al.
Pubblicazione: (2024)
di: Dong, Ximing, et al.
Pubblicazione: (2024)
Cultural Fidelity in Large-Language Models: An Evaluation of Online Language Resources as a Driver of Model Performance in Value Representation
di: Kazemi, Sharif, et al.
Pubblicazione: (2024)
di: Kazemi, Sharif, et al.
Pubblicazione: (2024)
Challenges and Responses in the Practice of Large Language Models
di: Zhu, Hongyin
Pubblicazione: (2024)
di: Zhu, Hongyin
Pubblicazione: (2024)
THRD: A Training-Free Multi-Turn Defense Framework for Jailbreak Attacks on Large Language Models
di: Ma, Zhiqing, et al.
Pubblicazione: (2026)
di: Ma, Zhiqing, et al.
Pubblicazione: (2026)
Training-Free Activation Sparsity in Large Language Models
di: Liu, James, et al.
Pubblicazione: (2024)
di: Liu, James, et al.
Pubblicazione: (2024)
Levels of Analysis for Large Language Models
di: Ku, Alexander Y., et al.
Pubblicazione: (2025)
di: Ku, Alexander Y., et al.
Pubblicazione: (2025)
On the Semantics of Large Language Models
di: Schuele, Martin
Pubblicazione: (2025)
di: Schuele, Martin
Pubblicazione: (2025)
Executing Natural Language-Described Algorithms with Large Language Models: An Investigation
di: Zheng, Xin, et al.
Pubblicazione: (2024)
di: Zheng, Xin, et al.
Pubblicazione: (2024)
Uncovering Implicit Bias in Large Language Models with Concept Learning Dataset
di: Wang, Leroy Z.
Pubblicazione: (2025)
di: Wang, Leroy Z.
Pubblicazione: (2025)
What Makes a Good Response? An Empirical Analysis of Quality in Qualitative Interviews
di: Ivey, Jonathan, et al.
Pubblicazione: (2026)
di: Ivey, Jonathan, et al.
Pubblicazione: (2026)
Large Language Models Produce Responses Perceived to be Empathic
di: Lee, Yoon Kyung, et al.
Pubblicazione: (2024)
di: Lee, Yoon Kyung, et al.
Pubblicazione: (2024)
Enhancing Human-Like Responses in Large Language Models
di: Çalık, Ethem Yağız, et al.
Pubblicazione: (2025)
di: Çalık, Ethem Yağız, et al.
Pubblicazione: (2025)
Simul-LLM: A Framework for Exploring High-Quality Simultaneous Translation with Large Language Models
di: Agostinelli, Victor, et al.
Pubblicazione: (2023)
di: Agostinelli, Victor, et al.
Pubblicazione: (2023)
Dimension-Level Intent Fidelity Evaluation for Large Language Models: Evidence from Structured Prompt Ablation
di: Peng, GAng
Pubblicazione: (2026)
di: Peng, GAng
Pubblicazione: (2026)
Towards Safety and Helpfulness Balanced Responses via Controllable Large Language Models
di: Tuan, Yi-Lin, et al.
Pubblicazione: (2024)
di: Tuan, Yi-Lin, et al.
Pubblicazione: (2024)
Prompt Risk Control: A Rigorous Framework for Responsible Deployment of Large Language Models
di: Zollo, Thomas P., et al.
Pubblicazione: (2023)
di: Zollo, Thomas P., et al.
Pubblicazione: (2023)
Beyond Metrics: A Critical Analysis of the Variability in Large Language Model Evaluation Frameworks
di: Pimentel, Marco AF, et al.
Pubblicazione: (2024)
di: Pimentel, Marco AF, et al.
Pubblicazione: (2024)
Assessing Algorithmic Bias in Language-Based Depression Detection: A Comparison of DNN and LLM Approaches
di: Junias, Obed, et al.
Pubblicazione: (2025)
di: Junias, Obed, et al.
Pubblicazione: (2025)
LUNA: A Model-Based Universal Analysis Framework for Large Language Models
di: Song, Da, et al.
Pubblicazione: (2023)
di: Song, Da, et al.
Pubblicazione: (2023)
BiasFreeBench: a Benchmark for Mitigating Bias in Large Language Model Responses
di: Xu, Xin, et al.
Pubblicazione: (2025)
di: Xu, Xin, et al.
Pubblicazione: (2025)
Emergent Abilities of Large Language Models under Continued Pretraining for Language Adaptation
di: Elhady, Ahmed, et al.
Pubblicazione: (2025)
di: Elhady, Ahmed, et al.
Pubblicazione: (2025)
SEAL: Steerable Reasoning Calibration of Large Language Models for Free
di: Chen, Runjin, et al.
Pubblicazione: (2025)
di: Chen, Runjin, et al.
Pubblicazione: (2025)
Algorithm of Thoughts: Enhancing Exploration of Ideas in Large Language Models
di: Sel, Bilgehan, et al.
Pubblicazione: (2023)
di: Sel, Bilgehan, et al.
Pubblicazione: (2023)
A Comprehensive Evaluation of Large Language Models on Aspect-Based Sentiment Analysis
di: Zhou, Changzhi, et al.
Pubblicazione: (2024)
di: Zhou, Changzhi, et al.
Pubblicazione: (2024)
Large Language Models for Mathematical Analysis
di: Chen, Ziye, et al.
Pubblicazione: (2024)
di: Chen, Ziye, et al.
Pubblicazione: (2024)
Knowledge-tuning Large Language Models with Structured Medical Knowledge Bases for Reliable Response Generation in Chinese
di: Wang, Haochun, et al.
Pubblicazione: (2023)
di: Wang, Haochun, et al.
Pubblicazione: (2023)
CASTILLO: Characterizing Response Length Distributions of Large Language Models
di: Perez-Ramirez, Daniel F., et al.
Pubblicazione: (2025)
di: Perez-Ramirez, Daniel F., et al.
Pubblicazione: (2025)
Output Scouting: Auditing Large Language Models for Catastrophic Responses
di: Bell, Andrew, et al.
Pubblicazione: (2024)
di: Bell, Andrew, et al.
Pubblicazione: (2024)
An exploration of features to improve the generalisability of fake news detection models
di: Hoy, Nathaniel, et al.
Pubblicazione: (2025)
di: Hoy, Nathaniel, et al.
Pubblicazione: (2025)
A Systematic Analysis of Large Language Models with RAG-enabled Dynamic Prompting for Medical Error Detection and Correction
di: Ahmed, Farzad, et al.
Pubblicazione: (2025)
di: Ahmed, Farzad, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Simulation Streams: A Programming Paradigm for Controlling Large Language Models and Building Complex Systems with Generative AI
di: Sunehag, Peter, et al.
Pubblicazione: (2025) -
Evaluating Cooperation in LLM Social Groups through Elected Leadership
di: Faulkner, Ryan, et al.
Pubblicazione: (2026) -
How LLMs Distort Our Written Language
di: Abdulhai, Marwa, et al.
Pubblicazione: (2026) -
A Voter-Based Stochastic Rejection-Method Framework for Asymptotically Safe Language Model Outputs
di: Watts, Jake R., et al.
Pubblicazione: (2024) -
A Hybrid Framework for Subject Analysis: Integrating Embedding-Based Regression Models with Large Language Models
di: Liu, Jinyu, et al.
Pubblicazione: (2025)