A Behavioural and Representational Evaluation of Goal-Directedness in Language Model Agents
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Arghal, Raghu, Chen, Fade, Dalton, Niall, Kortukov, Evgenii, McNamara, Calum, Nalmpantis, Angelos, Nirvaan, Moksh, Sarti, Gabriele, Giulianelli, Mario |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Evaluating the Goal-Directedness of Large Language Models
par: Everitt, Tom, et autres
Publié: (2025)
par: Everitt, Tom, et autres
Publié: (2025)
Just Do It!? Computer-Use Agents Exhibit Blind Goal-Directedness
par: Shayegani, Erfan, et autres
Publié: (2025)
par: Shayegani, Erfan, et autres
Publié: (2025)
Steering the Herd: A Framework for LLM-based Control of Social Learning
par: Arghal, Raghu, et autres
Publié: (2025)
par: Arghal, Raghu, et autres
Publié: (2025)
Surprisal Minimisation over Goal-directed Alternatives Predicts Production Choice in Dialogue
par: Utting, Tom, et autres
Publié: (2026)
par: Utting, Tom, et autres
Publié: (2026)
LLM Agents in Interaction: Measuring Personality Consistency and Linguistic Alignment in Interacting Populations of Large Language Models
par: Frisch, Ivar, et autres
Publié: (2024)
par: Frisch, Ivar, et autres
Publié: (2024)
Reveal-Bangla: A Dataset for Cross-Lingual Multi-Step Reasoning Evaluation
par: Islam, Khondoker Ittehadul, et autres
Publié: (2025)
par: Islam, Khondoker Ittehadul, et autres
Publié: (2025)
Measuring Goal-Directedness
par: MacDermott, Matt, et autres
Publié: (2024)
par: MacDermott, Matt, et autres
Publié: (2024)
Banking 2.0: The Stablecoin Banking Revolution -- How Digital Assets Are Reshaping Global Finance
par: McNamara, Kevin, et autres
Publié: (2025)
par: McNamara, Kevin, et autres
Publié: (2025)
Exponential Shift: Humans Adapt to AI Economies
par: McNamara, Kevin J, et autres
Publié: (2025)
par: McNamara, Kevin J, et autres
Publié: (2025)
Towards a Similarity-adjusted Surprisal Theory
par: Meister, Clara, et autres
Publié: (2024)
par: Meister, Clara, et autres
Publié: (2024)
Structure-Conditional Minimum Bayes Risk Decoding
par: Eikema, Bryan, et autres
Publié: (2025)
par: Eikema, Bryan, et autres
Publié: (2025)
IT5: Text-to-text Pretraining for Italian Language Understanding and Generation
par: Sarti, Gabriele, et autres
Publié: (2022)
par: Sarti, Gabriele, et autres
Publié: (2022)
Goal-Directedness is in the Eye of the Beholder
par: Rajcic, Nina, et autres
Publié: (2025)
par: Rajcic, Nina, et autres
Publié: (2025)
Towards User-Focused Research in Training Data Attribution for Human-Centered Explainable AI
par: Nguyen, Elisa, et autres
Publié: (2024)
par: Nguyen, Elisa, et autres
Publié: (2024)
Hierarchical Multi-Positive Contrastive Learning for Patent Image Retrieval
par: Kavimandan, Kshitij, et autres
Publié: (2025)
par: Kavimandan, Kshitij, et autres
Publié: (2025)
From Text to Voice: A Reproducible and Verifiable Framework for Evaluating Tool Calling LLM Agents
par: Laskar, Md Tahmid Rahman, et autres
Publié: (2026)
par: Laskar, Md Tahmid Rahman, et autres
Publié: (2026)
To Case or Not to Case: An Empirical Study in Learned Sparse Retrieval
par: Lionis, Emmanouil Georgios, et autres
Publié: (2026)
par: Lionis, Emmanouil Georgios, et autres
Publié: (2026)
Decision-Making Behavior Evaluation Framework for LLMs under Uncertain Context
par: Jia, Jingru, et autres
Publié: (2024)
par: Jia, Jingru, et autres
Publié: (2024)
The AI Shadow War: SaaS vs. Edge Computing Architectures
par: Marpu, Rhea Pritham, et autres
Publié: (2025)
par: Marpu, Rhea Pritham, et autres
Publié: (2025)
Generalized Measures of Anticipation and Responsivity in Online Language Processing
par: Giulianelli, Mario, et autres
Publié: (2024)
par: Giulianelli, Mario, et autres
Publié: (2024)
Is Information Density Uniform when Utterances are Grounded on Perception and Discourse?
par: Gay, Matteo, et autres
Publié: (2026)
par: Gay, Matteo, et autres
Publié: (2026)
Distilling Formal Logic into Neural Spaces: A Kernel Alignment Approach for Signal Temporal Logic
par: Candussio, Sara, et autres
Publié: (2026)
par: Candussio, Sara, et autres
Publié: (2026)
Towards Measuring Goal-Directedness in AI Systems
par: Xu, Dylan, et autres
Publié: (2024)
par: Xu, Dylan, et autres
Publié: (2024)
Improving Neural Question Generation using World Knowledge
par: Gupta, Deepak, et autres
Publié: (2019)
par: Gupta, Deepak, et autres
Publié: (2019)
Cognitively Diverse Multiple-Choice Question Generation: A Hybrid Multi-Agent Framework with Large Language Models
par: Tian, Yu, et autres
Publié: (2026)
par: Tian, Yu, et autres
Publié: (2026)
Unsupervised Word-level Quality Estimation for Machine Translation Through the Lens of Annotators (Dis)agreement
par: Sarti, Gabriele, et autres
Publié: (2025)
par: Sarti, Gabriele, et autres
Publié: (2025)
Choose Your Own Adventure: Interactive E-Books to Improve Word Knowledge and Comprehension Skills
par: Day, Stephanie, et autres
Publié: (2024)
par: Day, Stephanie, et autres
Publié: (2024)
Multi-property Steering of Large Language Models with Dynamic Activation Composition
par: Scalena, Daniel, et autres
Publié: (2024)
par: Scalena, Daniel, et autres
Publié: (2024)
LLM Strategic Reasoning: Agentic Study through Behavioral Game Theory
par: Jia, Jingru, et autres
Publié: (2025)
par: Jia, Jingru, et autres
Publié: (2025)
Measurement and Evaluation: Strategies for School Improvement. The School Leadership Library.
par: McNamara, James F., et autres
Publié: (1999)
par: McNamara, James F., et autres
Publié: (1999)
Quantifying the Plausibility of Context Reliance in Neural Machine Translation
par: Sarti, Gabriele, et autres
Publié: (2023)
par: Sarti, Gabriele, et autres
Publié: (2023)
Beyond Diagnosis: Evaluating Multimodal LLMs for Pathology Localization in Chest Radiographs
par: Gosai, Advait, et autres
Publié: (2025)
par: Gosai, Advait, et autres
Publié: (2025)
Gumbel Machine: Counterfactual Student Writing Generation via Gumbel Noise Steering
par: McNichols, Hunter, et autres
Publié: (2026)
par: McNichols, Hunter, et autres
Publié: (2026)
DeforestVis: Behaviour Analysis of Machine Learning Models with Surrogate Decision Stumps
par: Angelos Chatzimparmpas, et autres
Publié: (2024)
par: Angelos Chatzimparmpas, et autres
Publié: (2024)
Surprise! Uniform Information Density Isn't the Whole Story: Predicting Surprisal Contours in Long-form Discourse
par: Tsipidi, Eleftheria, et autres
Publié: (2024)
par: Tsipidi, Eleftheria, et autres
Publié: (2024)
Bridging Logic and Learning: Decoding Temporal Logic Embeddings via Transformers
par: Candussio, Sara, et autres
Publié: (2025)
par: Candussio, Sara, et autres
Publié: (2025)
Non Verbis, Sed Rebus: Large Language Models are Weak Solvers of Italian Rebuses
par: Sarti, Gabriele, et autres
Publié: (2024)
par: Sarti, Gabriele, et autres
Publié: (2024)
QDER: Query-Specific Document and Entity Representations for Multi-Vector Document Re-Ranking
par: Chatterjee, Shubham, et autres
Publié: (2025)
par: Chatterjee, Shubham, et autres
Publié: (2025)
Mind the Goal: Data-Efficient Goal-Oriented Evaluation of Conversational Agents and Chatbots using Teacher Models
par: Piskala, Deepak Babu, et autres
Publié: (2025)
par: Piskala, Deepak Babu, et autres
Publié: (2025)
Mixer Metaphors: audio interfaces for non-musical applications
par: McNamara, Tace, et autres
Publié: (2025)
par: McNamara, Tace, et autres
Publié: (2025)
Documents similaires
-
Evaluating the Goal-Directedness of Large Language Models
par: Everitt, Tom, et autres
Publié: (2025) -
Just Do It!? Computer-Use Agents Exhibit Blind Goal-Directedness
par: Shayegani, Erfan, et autres
Publié: (2025) -
Steering the Herd: A Framework for LLM-based Control of Social Learning
par: Arghal, Raghu, et autres
Publié: (2025) -
Surprisal Minimisation over Goal-directed Alternatives Predicts Production Choice in Dialogue
par: Utting, Tom, et autres
Publié: (2026) -
LLM Agents in Interaction: Measuring Personality Consistency and Linguistic Alignment in Interacting Populations of Large Language Models
par: Frisch, Ivar, et autres
Publié: (2024)