What is it for a Machine Learning Model to Have a Capability?
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Harding, Jacqueline, Sharadin, Nathaniel |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
How Causal Abstraction Underpins Computational Explanation
par: Geiger, Atticus, et autres
Publié: (2025)
par: Geiger, Atticus, et autres
Publié: (2025)
Check Your LLM's Secret Dictionary! Five Lines of Code Reveal What Your LLM Learned (Including What It Shouldn't Have)
par: Miyashita, Hisashi
Publié: (2026)
par: Miyashita, Hisashi
Publié: (2026)
ALPINE: Unveiling the Planning Capability of Autoregressive Learning in Language Models
par: Wang, Siwei, et autres
Publié: (2024)
par: Wang, Siwei, et autres
Publié: (2024)
Language Models Optimized to Fool Detectors Still Have a Distinct Style (And How to Change It)
par: Soto, Rafael Rivera, et autres
Publié: (2025)
par: Soto, Rafael Rivera, et autres
Publié: (2025)
Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning
par: Jin, Jikai, et autres
Publié: (2025)
par: Jin, Jikai, et autres
Publié: (2025)
Do Large Language Models Have Compositional Ability? An Investigation into Limitations and Scalability
par: Xu, Zhuoyan, et autres
Publié: (2024)
par: Xu, Zhuoyan, et autres
Publié: (2024)
Having Beer after Prayer? Measuring Cultural Bias in Large Language Models
par: Naous, Tarek, et autres
Publié: (2023)
par: Naous, Tarek, et autres
Publié: (2023)
Diversity Measures: Domain-Independent Proxies for Failure in Language Model Queries
par: Ngu, Noel, et autres
Publié: (2023)
par: Ngu, Noel, et autres
Publié: (2023)
ModelGPT: Unleashing LLM's Capabilities for Tailored Model Generation
par: Tang, Zihao, et autres
Publié: (2024)
par: Tang, Zihao, et autres
Publié: (2024)
You Are What You Train: Effects of Data Composition on Training Context-aware Machine Translation Models
par: Mąka, Paweł, et autres
Publié: (2025)
par: Mąka, Paweł, et autres
Publié: (2025)
Exploring and Benchmarking the Planning Capabilities of Large Language Models
par: Bohnet, Bernd, et autres
Publié: (2024)
par: Bohnet, Bernd, et autres
Publié: (2024)
On Calibration of Large Language Models: From Response To Capability
par: Yang, Sin-Han, et autres
Publié: (2026)
par: Yang, Sin-Han, et autres
Publié: (2026)
Prescriptive Scaling Reveals the Evolution of Language Model Capabilities
par: Zhang, Hanlin, et autres
Publié: (2026)
par: Zhang, Hanlin, et autres
Publié: (2026)
Unlocking Reasoning Capabilities in LLMs via Reinforcement Learning Exploration
par: Deng, Wenhao, et autres
Publié: (2025)
par: Deng, Wenhao, et autres
Publié: (2025)
What Makes a Reward Model a Good Teacher? An Optimization Perspective
par: Razin, Noam, et autres
Publié: (2025)
par: Razin, Noam, et autres
Publié: (2025)
Automated Capability Discovery via Foundation Model Self-Exploration
par: Lu, Cong, et autres
Publié: (2025)
par: Lu, Cong, et autres
Publié: (2025)
An exploration of features to improve the generalisability of fake news detection models
par: Hoy, Nathaniel, et autres
Publié: (2025)
par: Hoy, Nathaniel, et autres
Publié: (2025)
Do Language Models Have Bayesian Brains? Distinguishing Stochastic and Deterministic Decision Patterns within Large Language Models
par: Cui, Andrea Yaoyun, et autres
Publié: (2025)
par: Cui, Andrea Yaoyun, et autres
Publié: (2025)
Tutorial on Using Machine Learning and Deep Learning Models for Mental Illness Detection
par: Zhang, Yeyubei, et autres
Publié: (2025)
par: Zhang, Yeyubei, et autres
Publié: (2025)
CityBench: Evaluating the Capabilities of Large Language Models for Urban Tasks
par: Feng, Jie, et autres
Publié: (2024)
par: Feng, Jie, et autres
Publié: (2024)
Disentangling Logic: The Role of Context in Large Language Model Reasoning Capabilities
par: Hua, Wenyue, et autres
Publié: (2024)
par: Hua, Wenyue, et autres
Publié: (2024)
LimiX: Unleashing Structured-Data Modeling Capability for Generalist Intelligence
par: Zhang, Xingxuan, et autres
Publié: (2025)
par: Zhang, Xingxuan, et autres
Publié: (2025)
EffGen: Enabling Small Language Models as Capable Autonomous Agents
par: Srivastava, Gaurav, et autres
Publié: (2026)
par: Srivastava, Gaurav, et autres
Publié: (2026)
Language Diffusion Models are Associative Memories Capable of Retrieving Unseen Data
par: Pham, Bao, et autres
Publié: (2026)
par: Pham, Bao, et autres
Publié: (2026)
CausalARC: Abstract Reasoning with Causal World Models
par: Maasch, Jacqueline, et autres
Publié: (2025)
par: Maasch, Jacqueline, et autres
Publié: (2025)
How to Connect Speech Foundation Models and Large Language Models? What Matters and What Does Not
par: Verdini, Francesco, et autres
Publié: (2024)
par: Verdini, Francesco, et autres
Publié: (2024)
Algorithmic Capabilities of Random Transformers
par: Zhong, Ziqian, et autres
Publié: (2024)
par: Zhong, Ziqian, et autres
Publié: (2024)
Large Language Models Streamline Automated Machine Learning for Clinical Studies
par: Arasteh, Soroosh Tayebi, et autres
Publié: (2023)
par: Arasteh, Soroosh Tayebi, et autres
Publié: (2023)
DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning
par: DeepSeek-AI, et autres
Publié: (2025)
par: DeepSeek-AI, et autres
Publié: (2025)
Scaling In-Context Online Learning Capability of LLMs via Cross-Episode Meta-RL
par: Lin, Xiaofeng, et autres
Publié: (2026)
par: Lin, Xiaofeng, et autres
Publié: (2026)
Generalization v.s. Memorization: Tracing Language Models' Capabilities Back to Pretraining Data
par: Wang, Xinyi, et autres
Publié: (2024)
par: Wang, Xinyi, et autres
Publié: (2024)
MAP-Neo: Highly Capable and Transparent Bilingual Large Language Model Series
par: Zhang, Ge, et autres
Publié: (2024)
par: Zhang, Ge, et autres
Publié: (2024)
Fundamental Safety-Capability Trade-offs in Fine-tuning Large Language Models
par: Chen, Pin-Yu, et autres
Publié: (2025)
par: Chen, Pin-Yu, et autres
Publié: (2025)
What Matters for Model Merging at Scale?
par: Yadav, Prateek, et autres
Publié: (2024)
par: Yadav, Prateek, et autres
Publié: (2024)
RL-PLUS: Countering Capability Boundary Collapse of LLMs in Reinforcement Learning with Hybrid-policy Optimization
par: Dong, Yihong, et autres
Publié: (2025)
par: Dong, Yihong, et autres
Publié: (2025)
Using Large Language Models to Automate and Expedite Reinforcement Learning with Reward Machine
par: Alsadat, Shayan Meshkat, et autres
Publié: (2024)
par: Alsadat, Shayan Meshkat, et autres
Publié: (2024)
IAA: Inner-Adaptor Architecture Empowers Frozen Large Language Model with Multimodal Capabilities
par: Wang, Bin, et autres
Publié: (2024)
par: Wang, Bin, et autres
Publié: (2024)
CTBench: A Comprehensive Benchmark for Evaluating Language Model Capabilities in Clinical Trial Design
par: Neehal, Nafis, et autres
Publié: (2024)
par: Neehal, Nafis, et autres
Publié: (2024)
Why Has Predicting Downstream Capabilities of Frontier AI Models with Scale Remained Elusive?
par: Schaeffer, Rylan, et autres
Publié: (2024)
par: Schaeffer, Rylan, et autres
Publié: (2024)
Self-play with Execution Feedback: Improving Instruction-following Capabilities of Large Language Models
par: Dong, Guanting, et autres
Publié: (2024)
par: Dong, Guanting, et autres
Publié: (2024)
Documents similaires
-
How Causal Abstraction Underpins Computational Explanation
par: Geiger, Atticus, et autres
Publié: (2025) -
Check Your LLM's Secret Dictionary! Five Lines of Code Reveal What Your LLM Learned (Including What It Shouldn't Have)
par: Miyashita, Hisashi
Publié: (2026) -
ALPINE: Unveiling the Planning Capability of Autoregressive Learning in Language Models
par: Wang, Siwei, et autres
Publié: (2024) -
Language Models Optimized to Fool Detectors Still Have a Distinct Style (And How to Change It)
par: Soto, Rafael Rivera, et autres
Publié: (2025) -
Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning
par: Jin, Jikai, et autres
Publié: (2025)