Exploring the Learning Capabilities of Language Models using LEVERWORLDS
Fuente:
arXiv
Salvato in:
| Autori principali: | Wagner, Eitan, Feder, Amir, Abend, Omri |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Express Your Doubts -- Probabilistic World Modeling Should not be Based on Token logprobs
di: Wagner, Eitan, et al.
Pubblicazione: (2025)
di: Wagner, Eitan, et al.
Pubblicazione: (2025)
CONTESTS: a Framework for Consistency Testing of Span Probabilities in Language Models
di: Wagner, Eitan, et al.
Pubblicazione: (2024)
di: Wagner, Eitan, et al.
Pubblicazione: (2024)
Mind Your Theory: Theory of Mind Goes Deeper Than Reasoning
di: Wagner, Eitan, et al.
Pubblicazione: (2024)
di: Wagner, Eitan, et al.
Pubblicazione: (2024)
Measuring Pragmatic Influence in Large Language Model Instructions
di: Geng, Yilin, et al.
Pubblicazione: (2026)
di: Geng, Yilin, et al.
Pubblicazione: (2026)
The Challenge and Reward of Fair Play in Narrative: A Computational Approach
di: Wagner, Eitan, et al.
Pubblicazione: (2025)
di: Wagner, Eitan, et al.
Pubblicazione: (2025)
Beneath the Surface of Consistency: Exploring Cross-lingual Knowledge Representation Sharing in LLMs
di: Ifergan, Maxim, et al.
Pubblicazione: (2024)
di: Ifergan, Maxim, et al.
Pubblicazione: (2024)
A Language-agnostic Model of Child Language Acquisition
di: Mahon, Louis, et al.
Pubblicazione: (2024)
di: Mahon, Louis, et al.
Pubblicazione: (2024)
Identifying Narrative Patterns and Outliers in Holocaust Testimonies Using Topic Modeling
di: Ifergan, Maxim, et al.
Pubblicazione: (2024)
di: Ifergan, Maxim, et al.
Pubblicazione: (2024)
Unsupervised Location Mapping for Narrative Corpora
di: Wagner, Eitan, et al.
Pubblicazione: (2025)
di: Wagner, Eitan, et al.
Pubblicazione: (2025)
Unsupervised Speech Segmentation: A General Approach Using Speech Language Models
di: Elmakies, Avishai, et al.
Pubblicazione: (2025)
di: Elmakies, Avishai, et al.
Pubblicazione: (2025)
A Nurse is Blue and Elephant is Rugby: Cross Domain Alignment in Large Language Models Reveal Human-like Patterns
di: Yehudai, Asaf, et al.
Pubblicazione: (2024)
di: Yehudai, Asaf, et al.
Pubblicazione: (2024)
Computational Analysis of Character Development in Holocaust Testimonies
di: Shizgal, Esther, et al.
Pubblicazione: (2024)
di: Shizgal, Esther, et al.
Pubblicazione: (2024)
Control Illusion: The Failure of Instruction Hierarchies in Large Language Models
di: Geng, Yilin, et al.
Pubblicazione: (2025)
di: Geng, Yilin, et al.
Pubblicazione: (2025)
Locally Measuring Cross-lingual Lexical Alignment: A Domain and Word Level Perspective
di: Karidi, Taelin, et al.
Pubblicazione: (2024)
di: Karidi, Taelin, et al.
Pubblicazione: (2024)
Generating Benchmarks for Factuality Evaluation of Language Models
di: Muhlgay, Dor, et al.
Pubblicazione: (2023)
di: Muhlgay, Dor, et al.
Pubblicazione: (2023)
Exploring the Word Sense Disambiguation Capabilities of Large Language Models
di: Basile, Pierpaolo, et al.
Pubblicazione: (2025)
di: Basile, Pierpaolo, et al.
Pubblicazione: (2025)
Reasoning or Reciting? Exploring the Capabilities and Limitations of Language Models Through Counterfactual Tasks
di: Wu, Zhaofeng, et al.
Pubblicazione: (2023)
di: Wu, Zhaofeng, et al.
Pubblicazione: (2023)
Toward a Benchmark for Controllable Simulation of Imperfect Students with Large Language Models
di: Apartsin, Alexander, et al.
Pubblicazione: (2026)
di: Apartsin, Alexander, et al.
Pubblicazione: (2026)
Exploring and Benchmarking the Planning Capabilities of Large Language Models
di: Bohnet, Bernd, et al.
Pubblicazione: (2024)
di: Bohnet, Bernd, et al.
Pubblicazione: (2024)
Confidence Improves Self-Consistency in LLMs
di: Taubenfeld, Amir, et al.
Pubblicazione: (2025)
di: Taubenfeld, Amir, et al.
Pubblicazione: (2025)
Exploring the Capabilities of Large Multimodal Models on Dense Text
di: Zhang, Shuo, et al.
Pubblicazione: (2024)
di: Zhang, Shuo, et al.
Pubblicazione: (2024)
Improving the Language Understanding Capabilities of Large Language Models Using Reinforcement Learning
di: Hu, Bokai, et al.
Pubblicazione: (2024)
di: Hu, Bokai, et al.
Pubblicazione: (2024)
Exploring the System 1 Thinking Capability of Large Reasoning Models
di: Zhang, Wenyuan, et al.
Pubblicazione: (2025)
di: Zhang, Wenyuan, et al.
Pubblicazione: (2025)
Unraveling the Capabilities of Language Models in News Summarization
di: Odabaşı, Abdurrahman, et al.
Pubblicazione: (2025)
di: Odabaşı, Abdurrahman, et al.
Pubblicazione: (2025)
Forecasting Frontier Language Model Agent Capabilities
di: Pimpale, Govind, et al.
Pubblicazione: (2025)
di: Pimpale, Govind, et al.
Pubblicazione: (2025)
Explore the Reasoning Capability of LLMs in the Chess Testbed
di: Wang, Shu, et al.
Pubblicazione: (2024)
di: Wang, Shu, et al.
Pubblicazione: (2024)
Pretrained LLMs Learn Multiple Types of Uncertainty
di: Cohen, Roi, et al.
Pubblicazione: (2025)
di: Cohen, Roi, et al.
Pubblicazione: (2025)
$T^5Score$: A Methodology for Automatically Assessing the Quality of LLM Generated Multi-Document Topic Sets
di: Trainin, Itamar, et al.
Pubblicazione: (2024)
di: Trainin, Itamar, et al.
Pubblicazione: (2024)
Exploring Straightforward Conversational Red-Teaming
di: Kour, George, et al.
Pubblicazione: (2024)
di: Kour, George, et al.
Pubblicazione: (2024)
Evaluating Consistency and Reasoning Capabilities of Large Language Models
di: Saxena, Yash, et al.
Pubblicazione: (2024)
di: Saxena, Yash, et al.
Pubblicazione: (2024)
Distilling Mathematical Reasoning Capabilities into Small Language Models
di: Zhu, Xunyu, et al.
Pubblicazione: (2024)
di: Zhu, Xunyu, et al.
Pubblicazione: (2024)
On the Use of Large Language Models to Generate Capability Ontologies
di: da Silva, Luis Miguel Vieira, et al.
Pubblicazione: (2024)
di: da Silva, Luis Miguel Vieira, et al.
Pubblicazione: (2024)
Reasoning Capabilities of Large Language Models on Dynamic Tasks
di: Wong, Annie, et al.
Pubblicazione: (2025)
di: Wong, Annie, et al.
Pubblicazione: (2025)
Unlocking Prompt Infilling Capability for Diffusion Language Models
di: Fujinuma, Yoshinari, et al.
Pubblicazione: (2026)
di: Fujinuma, Yoshinari, et al.
Pubblicazione: (2026)
Do Large Language Models Know What They Are Capable Of?
di: Barkan, Casey O., et al.
Pubblicazione: (2025)
di: Barkan, Casey O., et al.
Pubblicazione: (2025)
Measuring and Benchmarking Large Language Models' Capabilities to Generate Persuasive Language
di: Pauli, Amalie Brogaard, et al.
Pubblicazione: (2024)
di: Pauli, Amalie Brogaard, et al.
Pubblicazione: (2024)
Preservation of Language Understanding Capabilities in Speech-aware Large Language Models
di: Kubis, Marek, et al.
Pubblicazione: (2025)
di: Kubis, Marek, et al.
Pubblicazione: (2025)
FunctionChat-Bench: Comprehensive Evaluation of Language Models' Generative Capabilities in Korean Tool-use Dialogs
di: Lee, Shinbok, et al.
Pubblicazione: (2024)
di: Lee, Shinbok, et al.
Pubblicazione: (2024)
Large Language Model Capabilities in Perioperative Risk Prediction and Prognostication
di: Chung, Philip, et al.
Pubblicazione: (2024)
di: Chung, Philip, et al.
Pubblicazione: (2024)
Unlocking Reasoning Capability on Machine Translation in Large Language Models
di: Rajaee, Sara, et al.
Pubblicazione: (2026)
di: Rajaee, Sara, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Express Your Doubts -- Probabilistic World Modeling Should not be Based on Token logprobs
di: Wagner, Eitan, et al.
Pubblicazione: (2025) -
CONTESTS: a Framework for Consistency Testing of Span Probabilities in Language Models
di: Wagner, Eitan, et al.
Pubblicazione: (2024) -
Mind Your Theory: Theory of Mind Goes Deeper Than Reasoning
di: Wagner, Eitan, et al.
Pubblicazione: (2024) -
Measuring Pragmatic Influence in Large Language Model Instructions
di: Geng, Yilin, et al.
Pubblicazione: (2026) -
The Challenge and Reward of Fair Play in Narrative: A Computational Approach
di: Wagner, Eitan, et al.
Pubblicazione: (2025)