Saved in:
| Main Authors: | Watson, Jacob, Góes, Fabrício, Volpe, Marco, Medeiros, Talles |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | https://arxiv.org/abs/2412.05200 |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Do LLMs Agree on the Creativity Evaluation of Alternative Uses?
by: Rabeyah, Abdullah Al, et al.
Published: (2024)
by: Rabeyah, Abdullah Al, et al.
Published: (2024)
Scaling Large Language Model Training on Frontier with Low-Bandwidth Partitioning
by: Xu, Lang, et al.
Published: (2025)
by: Xu, Lang, et al.
Published: (2025)
The Frontier of Data Erasure: Machine Unlearning for Large Language Models
by: Qu, Youyang, et al.
Published: (2024)
by: Qu, Youyang, et al.
Published: (2024)
Large Language Models' Reasoning Stalls: An Investigation into the Capabilities of Frontier Models
by: McGinness, Lachlan, et al.
Published: (2025)
by: McGinness, Lachlan, et al.
Published: (2025)
A Case-Based Persistent Memory for a Large Language Model
by: Watson, Ian
Published: (2023)
by: Watson, Ian
Published: (2023)
Frontier Large Language Models Rival State-of-the-Art Planners
by: Corrêa, Augusto B., et al.
Published: (2025)
by: Corrêa, Augusto B., et al.
Published: (2025)
Internal Safety Collapse in Frontier Large Language Models
by: Wu, Yutao, et al.
Published: (2026)
by: Wu, Yutao, et al.
Published: (2026)
A Survey on Large Language Models with Multilingualism: Recent Advances and New Frontiers
by: Huang, Kaiyu, et al.
Published: (2024)
by: Huang, Kaiyu, et al.
Published: (2024)
Exploring the Capabilities of the Frontier Large Language Models for Nuclear Energy Research
by: Almeldein, Ahmed, et al.
Published: (2025)
by: Almeldein, Ahmed, et al.
Published: (2025)
Dynamic Q&A of Clinical Documents with Large Language Models
by: Elgedawy, Ran, et al.
Published: (2024)
by: Elgedawy, Ran, et al.
Published: (2024)
Challenges in Guardrailing Large Language Models for Science
by: Pantha, Nishan, et al.
Published: (2024)
by: Pantha, Nishan, et al.
Published: (2024)
A Survey of Scientific Large Language Models: From Data Foundations to Agent Frontiers
by: Hu, Ming, et al.
Published: (2025)
by: Hu, Ming, et al.
Published: (2025)
The Emergence of Social Science of Large Language Models
by: Jia, Xiao, et al.
Published: (2025)
by: Jia, Xiao, et al.
Published: (2025)
Enhancing Q-Learning with Large Language Model Heuristics
by: Wu, Xiefeng
Published: (2024)
by: Wu, Xiefeng
Published: (2024)
Human-Alignment and Calibration of Inference-Time Uncertainty in Large Language Models
by: Moore, Kyle, et al.
Published: (2025)
by: Moore, Kyle, et al.
Published: (2025)
A Survey on the Applications of Frontier AI, Foundation Models, and Large Language Models to Intelligent Transportation Systems
by: Shoaib, Mohamed R., et al.
Published: (2024)
by: Shoaib, Mohamed R., et al.
Published: (2024)
Revolutionizing Database Q&A with Large Language Models: Comprehensive Benchmark and Evaluation
by: Zheng, Yihang, et al.
Published: (2024)
by: Zheng, Yihang, et al.
Published: (2024)
Enhanced Fine-Tuning of Lightweight Domain-Specific Q&A Model Based on Large Language Models
by: Zhang, Shenglin, et al.
Published: (2024)
by: Zhang, Shenglin, et al.
Published: (2024)
Large Language Model-based Data Science Agent: A Survey
by: Chen, Ke, et al.
Published: (2025)
by: Chen, Ke, et al.
Published: (2025)
An Underexplored Frontier: Large Language Models for Rare Disease Patient Education and Communication -- A scoping review
by: Zhan, Zaifu, et al.
Published: (2026)
by: Zhan, Zaifu, et al.
Published: (2026)
Forecasting Frontier Language Model Agent Capabilities
by: Pimpale, Govind, et al.
Published: (2025)
by: Pimpale, Govind, et al.
Published: (2025)
Assessing the Creativity of Large Language Models: Testing, Limits, and New Frontiers
by: Schapiro, Samuel, et al.
Published: (2026)
by: Schapiro, Samuel, et al.
Published: (2026)
User Privacy and Large Language Models: An Analysis of Frontier Developers' Privacy Policies
by: King, Jennifer, et al.
Published: (2025)
by: King, Jennifer, et al.
Published: (2025)
A Human-Centred Architecture for Large Language Models-Cognitive Assistants in Manufacturing within Quality Management Systems
by: Galdino, Marcos, et al.
Published: (2026)
by: Galdino, Marcos, et al.
Published: (2026)
SpokeN-100: A Cross-Lingual Benchmarking Dataset for The Classification of Spoken Numbers in Different Languages
by: Groh, René, et al.
Published: (2024)
by: Groh, René, et al.
Published: (2024)
Evaluating the Elementary Multilingual Capabilities of Large Language Models with MultiQ
by: Holtermann, Carolin, et al.
Published: (2024)
by: Holtermann, Carolin, et al.
Published: (2024)
Confidence Calibration in Large Language Models
by: Michael, Noam, et al.
Published: (2026)
by: Michael, Noam, et al.
Published: (2026)
ARTIFICIAL NEURAL NETWORKS FOR ESTIMATING TREE VOLUME IN THE BRAZILIAN SAVANNA
by: Talles Hudson Souza Lacerda
Published: (2017)
by: Talles Hudson Souza Lacerda
Published: (2017)
Unified Preference Optimization: Language Model Alignment Beyond the Preference Frontier
by: Badrinath, Anirudhan, et al.
Published: (2024)
by: Badrinath, Anirudhan, et al.
Published: (2024)
Political-LLM: Large Language Models in Political Science
by: Li, Lincan, et al.
Published: (2024)
by: Li, Lincan, et al.
Published: (2024)
Leveraging Large Language Models for Fuzzy String Matching in Political Science
by: Wang, Yu
Published: (2024)
by: Wang, Yu
Published: (2024)
Beyond Static Snapshots: A Grounded Evaluation Framework for Language Models at the Agentic Frontier
by: Henry, Jazmia
Published: (2026)
by: Henry, Jazmia
Published: (2026)
MultiQ&A: An Analysis in Measuring Robustness via Automated Crowdsourcing of Question Perturbations and Answers
by: Cho, Nicole, et al.
Published: (2025)
by: Cho, Nicole, et al.
Published: (2025)
Q-MLLM: Vector Quantization for Robust Multimodal Large Language Model Security
by: Zhao, Wei, et al.
Published: (2025)
by: Zhao, Wei, et al.
Published: (2025)
SciDFM: A Large Language Model with Mixture-of-Experts for Science
by: Sun, Liangtai, et al.
Published: (2024)
by: Sun, Liangtai, et al.
Published: (2024)
MegaScience: Pushing the Frontiers of Post-Training Datasets for Science Reasoning
by: Fan, Run-Ze, et al.
Published: (2025)
by: Fan, Run-Ze, et al.
Published: (2025)
ElectriQ: A Benchmark for Assessing the Response Capability of Large Language Models in Power Marketing
by: Wang, Jinzhi, et al.
Published: (2025)
by: Wang, Jinzhi, et al.
Published: (2025)
AIRS-Bench: a Suite of Tasks for Frontier AI Research Science Agents
by: Lupidi, Alisia, et al.
Published: (2026)
by: Lupidi, Alisia, et al.
Published: (2026)
Towards A Holistic Landscape of Situated Theory of Mind in Large Language Models
by: Ma, Ziqiao, et al.
Published: (2023)
by: Ma, Ziqiao, et al.
Published: (2023)
Sequential Enumeration in Large Language Models
by: Hou, Kuinan, et al.
Published: (2025)
by: Hou, Kuinan, et al.
Published: (2025)
Similar Items
-
Do LLMs Agree on the Creativity Evaluation of Alternative Uses?
by: Rabeyah, Abdullah Al, et al.
Published: (2024) -
Scaling Large Language Model Training on Frontier with Low-Bandwidth Partitioning
by: Xu, Lang, et al.
Published: (2025) -
The Frontier of Data Erasure: Machine Unlearning for Large Language Models
by: Qu, Youyang, et al.
Published: (2024) -
Large Language Models' Reasoning Stalls: An Investigation into the Capabilities of Frontier Models
by: McGinness, Lachlan, et al.
Published: (2025) -
A Case-Based Persistent Memory for a Large Language Model
by: Watson, Ian
Published: (2023)