Impact of Task Phrasing on Presumptions in Large Language Models
Fuente:
arXiv
Guardado en:
| Autor principal: | Ong, Kenneth J. K. |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Synthetic Data Generation for Phrase Break Prediction with Large Language Model
por: Lee, Hoyeon, et al.
Publicado: (2025)
por: Lee, Hoyeon, et al.
Publicado: (2025)
General Phrase Debiaser: Debiasing Masked Language Models at a Multi-Token Level
por: Shi, Bingkang, et al.
Publicado: (2023)
por: Shi, Bingkang, et al.
Publicado: (2023)
Is Large Language Model Performance on Reasoning Tasks Impacted by Different Ways Questions Are Asked?
por: Song, Seok Hwan, et al.
Publicado: (2025)
por: Song, Seok Hwan, et al.
Publicado: (2025)
Large Language Model Benchmarks in Medical Tasks
por: Yan, Lawrence K. Q., et al.
Publicado: (2024)
por: Yan, Lawrence K. Q., et al.
Publicado: (2024)
TaskBench: Benchmarking Large Language Models for Task Automation
por: Shen, Yongliang, et al.
Publicado: (2023)
por: Shen, Yongliang, et al.
Publicado: (2023)
Same Task, More Tokens: the Impact of Input Length on the Reasoning Performance of Large Language Models
por: Levy, Mosh, et al.
Publicado: (2024)
por: Levy, Mosh, et al.
Publicado: (2024)
Musical Phrase Segmentation via Grammatical Induction
por: Perkins, Reed, et al.
Publicado: (2024)
por: Perkins, Reed, et al.
Publicado: (2024)
Large Language Models Produce Responses Perceived to be Empathic
por: Lee, Yoon Kyung, et al.
Publicado: (2024)
por: Lee, Yoon Kyung, et al.
Publicado: (2024)
Iterative Translation Refinement with Large Language Models
por: Chen, Pinzhen, et al.
Publicado: (2023)
por: Chen, Pinzhen, et al.
Publicado: (2023)
Evaluating Ill-Defined Tasks in Large Language Models
por: Zhou, Yi, et al.
Publicado: (2026)
por: Zhou, Yi, et al.
Publicado: (2026)
Reasoning Capabilities of Large Language Models on Dynamic Tasks
por: Wong, Annie, et al.
Publicado: (2025)
por: Wong, Annie, et al.
Publicado: (2025)
Task-Aligned Tool Recommendation for Large Language Models
por: Gao, Hang, et al.
Publicado: (2024)
por: Gao, Hang, et al.
Publicado: (2024)
Large Language Models Are Self-Taught Reasoners: Enhancing LLM Applications via Tailored Problem-Solving Demonstrations
por: Ong, Kai Tzu-iunn, et al.
Publicado: (2024)
por: Ong, Kai Tzu-iunn, et al.
Publicado: (2024)
Evaluation of Large Language Models for Summarization Tasks in the Medical Domain: A Narrative Review
por: Croxford, Emma, et al.
Publicado: (2024)
por: Croxford, Emma, et al.
Publicado: (2024)
How do Scaling Laws Apply to Knowledge Graph Engineering Tasks? The Impact of Model Size on Large Language Model Performance
por: Heim, Desiree, et al.
Publicado: (2025)
por: Heim, Desiree, et al.
Publicado: (2025)
An analysis of AI Decision under Risk: Prospect theory emerges in Large Language Models
por: Payne, Kenneth
Publicado: (2025)
por: Payne, Kenneth
Publicado: (2025)
Large Language Models can be Guided to Evade AI-Generated Text Detection
por: Lu, Ning, et al.
Publicado: (2023)
por: Lu, Ning, et al.
Publicado: (2023)
Perspective Transition of Large Language Models for Solving Subjective Tasks
por: Wang, Xiaolong, et al.
Publicado: (2025)
por: Wang, Xiaolong, et al.
Publicado: (2025)
Eliciting Causal Abilities in Large Language Models for Reasoning Tasks
por: Wang, Yajing, et al.
Publicado: (2024)
por: Wang, Yajing, et al.
Publicado: (2024)
Characterizing Large Language Models as Rationalizers of Knowledge-intensive Tasks
por: Mishra, Aditi, et al.
Publicado: (2023)
por: Mishra, Aditi, et al.
Publicado: (2023)
Evaluating Large Language Models for Real-World Engineering Tasks
por: Heesch, Rene, et al.
Publicado: (2025)
por: Heesch, Rene, et al.
Publicado: (2025)
Deriving Strategic Market Insights with Large Language Models: A Benchmark for Forward Counterfactual Generation
por: Ong, Keane, et al.
Publicado: (2025)
por: Ong, Keane, et al.
Publicado: (2025)
Exploring the Performance of Large Language Models on Subjective Span Identification Tasks
por: Dmonte, Alphaeus, et al.
Publicado: (2026)
por: Dmonte, Alphaeus, et al.
Publicado: (2026)
Evaluating Large Language Models for Abstract Evaluation Tasks: An Empirical Study
por: Liu, Yinuo, et al.
Publicado: (2026)
por: Liu, Yinuo, et al.
Publicado: (2026)
The Impact of Reasoning Step Length on Large Language Models
por: Jin, Mingyu, et al.
Publicado: (2024)
por: Jin, Mingyu, et al.
Publicado: (2024)
Counting Ability of Large Language Models and Impact of Tokenization
por: Zhang, Xiang, et al.
Publicado: (2024)
por: Zhang, Xiang, et al.
Publicado: (2024)
The Impact of Negated Text on Hallucination with Large Language Models
por: Seo, Jaehyung, et al.
Publicado: (2025)
por: Seo, Jaehyung, et al.
Publicado: (2025)
Fast-Slow-Thinking: Complex Task Solving with Large Language Models
por: Sun, Yiliu, et al.
Publicado: (2025)
por: Sun, Yiliu, et al.
Publicado: (2025)
Aggregation Artifacts in Subjective Tasks Collapse Large Language Models' Posteriors
por: Chochlakis, Georgios, et al.
Publicado: (2024)
por: Chochlakis, Georgios, et al.
Publicado: (2024)
Benchmarking Large Language Models on Multiple Tasks in Bioinformatics NLP with Prompting
por: Jiang, Jiyue, et al.
Publicado: (2025)
por: Jiang, Jiyue, et al.
Publicado: (2025)
MedHELM: Holistic Evaluation of Large Language Models for Medical Tasks
por: Bedi, Suhana, et al.
Publicado: (2025)
por: Bedi, Suhana, et al.
Publicado: (2025)
Mathify: Evaluating Large Language Models on Mathematical Problem Solving Tasks
por: Anand, Avinash, et al.
Publicado: (2024)
por: Anand, Avinash, et al.
Publicado: (2024)
IndicMMLU-Pro: Benchmarking Indic Large Language Models on Multi-Task Language Understanding
por: KJ, Sankalp, et al.
Publicado: (2025)
por: KJ, Sankalp, et al.
Publicado: (2025)
Decomposing the Basic Abilities of Large Language Models: Mitigating Cross-Task Interference in Multi-Task Instruct-Tuning
por: Wang, Bing, et al.
Publicado: (2026)
por: Wang, Bing, et al.
Publicado: (2026)
Strategic Prompting for Conversational Tasks: A Comparative Analysis of Large Language Models Across Diverse Conversational Tasks
por: Joshi, Ratnesh Kumar, et al.
Publicado: (2024)
por: Joshi, Ratnesh Kumar, et al.
Publicado: (2024)
TLoRA: Task-aware Low Rank Adaptation of Large Language Models
por: Lin, Weicheng, et al.
Publicado: (2026)
por: Lin, Weicheng, et al.
Publicado: (2026)
Understanding Artificial Theory of Mind: Perturbed Tasks and Reasoning in Large Language Models
por: Nickel, Christian, et al.
Publicado: (2026)
por: Nickel, Christian, et al.
Publicado: (2026)
Efficient Task Adaptation in Large Language Models via Selective Parameter Optimization
por: Wan, Weijie, et al.
Publicado: (2026)
por: Wan, Weijie, et al.
Publicado: (2026)
Benchmarking Open-Source Large Language Models on Healthcare Text Classification Tasks
por: Guo, Yuting, et al.
Publicado: (2025)
por: Guo, Yuting, et al.
Publicado: (2025)
Can Large Language Models Create New Knowledge for Spatial Reasoning Tasks?
por: Greatrix, Thomas, et al.
Publicado: (2024)
por: Greatrix, Thomas, et al.
Publicado: (2024)
Ejemplares similares
-
Synthetic Data Generation for Phrase Break Prediction with Large Language Model
por: Lee, Hoyeon, et al.
Publicado: (2025) -
General Phrase Debiaser: Debiasing Masked Language Models at a Multi-Token Level
por: Shi, Bingkang, et al.
Publicado: (2023) -
Is Large Language Model Performance on Reasoning Tasks Impacted by Different Ways Questions Are Asked?
por: Song, Seok Hwan, et al.
Publicado: (2025) -
Large Language Model Benchmarks in Medical Tasks
por: Yan, Lawrence K. Q., et al.
Publicado: (2024) -
TaskBench: Benchmarking Large Language Models for Task Automation
por: Shen, Yongliang, et al.
Publicado: (2023)