Enregistré dans:
| Auteur principal: | Vallstrom, Daniel |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2404.03685 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Measuring What AI Systems Might Do: Towards A Measurement Science in AI
par: Voudouris, Konstantinos, et autres
Publié: (2026)
par: Voudouris, Konstantinos, et autres
Publié: (2026)
A mathematical theory of evolution for self-designing AIs
par: Harris, Kenneth D
Publié: (2026)
par: Harris, Kenneth D
Publié: (2026)
Bringing AI Participation Down to Scale: A Comment on Open AIs Democratic Inputs to AI Project
par: Moats, David, et autres
Publié: (2024)
par: Moats, David, et autres
Publié: (2024)
Compression, The Fermi Paradox and Artificial Super-Intelligence
par: Bennett, Michael Timothy
Publié: (2021)
par: Bennett, Michael Timothy
Publié: (2021)
Q-Learning-Driven Adaptive Rewiring for Cooperative Control in Heterogeneous Networks
par: Weng, Yi-Ning, et autres
Publié: (2025)
par: Weng, Yi-Ning, et autres
Publié: (2025)
The Anatomy Spread of Online Opinion Polarization: The Pivotal Role of Super-Spreaders in Social Networks
par: Kawahata, Yasuko
Publié: (2023)
par: Kawahata, Yasuko
Publié: (2023)
On the Diminishing Returns of Width for Continual Learning
par: Guha, Etash, et autres
Publié: (2024)
par: Guha, Etash, et autres
Publié: (2024)
Note: Evolutionary Game Theory Focus Informational Health: The Cocktail Party Effect Through Werewolfgame under Incomplete Information and ESS Search Method Using Expected Gains of Repeated Dilemmas
par: Kawahata, Yasuko
Publié: (2024)
par: Kawahata, Yasuko
Publié: (2024)
Runtime Monitoring and Enforcement of Conditional Fairness in Generative AIs
par: Cheng, Chih-Hong, et autres
Publié: (2024)
par: Cheng, Chih-Hong, et autres
Publié: (2024)
The AI Alignment Paradox
par: West, Robert, et autres
Publié: (2024)
par: West, Robert, et autres
Publié: (2024)
The AI Double Standard: Humans Judge All AIs for the Actions of One
par: Manoli, Aikaterina, et autres
Publié: (2024)
par: Manoli, Aikaterina, et autres
Publié: (2024)
What AIs are not Learning (and Why)
par: Stefik, Mark
Publié: (2024)
par: Stefik, Mark
Publié: (2024)
Where AI Assurance Might Go Wrong: Initial lessons from engineering of critical systems
par: Bloomfield, Robin, et autres
Publié: (2025)
par: Bloomfield, Robin, et autres
Publié: (2025)
How to Count AIs: Individuation and Liability for AI Agents
par: Arbel, Yonathan, et autres
Publié: (2026)
par: Arbel, Yonathan, et autres
Publié: (2026)
Utility Engineering: Analyzing and Controlling Emergent Value Systems in AIs
par: Mazeika, Mantas, et autres
Publié: (2025)
par: Mazeika, Mantas, et autres
Publié: (2025)
Decentralized Traffic Flow Optimization Through Intrinsic Motivation
par: Papala, Himaja, et autres
Publié: (2025)
par: Papala, Himaja, et autres
Publié: (2025)
The Illusion of Diminishing Returns: Measuring Long Horizon Execution in LLMs
par: Sinha, Akshit, et autres
Publié: (2025)
par: Sinha, Akshit, et autres
Publié: (2025)
The Diminishing Returns of Early-Exit Decoding in Modern LLMs
par: Wei, Rui, et autres
Publié: (2026)
par: Wei, Rui, et autres
Publié: (2026)
The Psychology of Learning from Machines: Anthropomorphic AI and the Paradox of Automation in Education
par: Qadir, Junaid, et autres
Publié: (2026)
par: Qadir, Junaid, et autres
Publié: (2026)
ShaRP: Explaining Rankings and Preferences with Shapley Values
par: Pliatsika, Venetia, et autres
Publié: (2024)
par: Pliatsika, Venetia, et autres
Publié: (2024)
Beyond Ethics: How Inclusive Innovation Drives Economic Returns in Medical AI
par: Unnikrishnan, Balagopal, et autres
Publié: (2025)
par: Unnikrishnan, Balagopal, et autres
Publié: (2025)
The Adoption Paradox for Veterinary Professionals in China: High Use of Artificial Intelligence Despite Low Familiarity
par: Li, Shumin, et autres
Publié: (2025)
par: Li, Shumin, et autres
Publié: (2025)
Social Media Informatics for Sustainable Cities and Societies: An Overview of the Applications, associated Challenges, and Potential Solutions
par: Khan, Jebran, et autres
Publié: (2024)
par: Khan, Jebran, et autres
Publié: (2024)
Traits of a Leader: User Influence Level Prediction through Sociolinguistic Modeling
par: Katerenchuk, Denys, et autres
Publié: (2025)
par: Katerenchuk, Denys, et autres
Publié: (2025)
Towards an AI Observatory for the Nuclear Sector: A tool for anticipatory governance
par: Verma, Aditi, et autres
Publié: (2025)
par: Verma, Aditi, et autres
Publié: (2025)
A Survey of Physics-Informed AI for Complex Urban Systems
par: Xu, En, et autres
Publié: (2025)
par: Xu, En, et autres
Publié: (2025)
Working with Large Language Models to Enhance Messaging Effectiveness for Vaccine Confidence
par: Gullison, Lucinda, et autres
Publié: (2025)
par: Gullison, Lucinda, et autres
Publié: (2025)
Forecasting Open-Weight AI Model Growth on HuggingFace
par: Bhandari, Kushal Raj, et autres
Publié: (2025)
par: Bhandari, Kushal Raj, et autres
Publié: (2025)
The Cognitive Kardashev Scale: Quantifying the Material Envelope of Civilisational Computation
par: Sharma, Sachin
Publié: (2026)
par: Sharma, Sachin
Publié: (2026)
AIs and Humans with Agency
par: Mumford, David
Publié: (2026)
par: Mumford, David
Publié: (2026)
The Planetary Cost of AI Acceleration, Part II: The 10th Planetary Boundary and the 6.5-Year Countdown
par: Zhu, William Yicheng, et autres
Publié: (2026)
par: Zhu, William Yicheng, et autres
Publié: (2026)
When AIs Judge AIs: The Rise of Agent-as-a-Judge Evaluation for LLMs
par: Yu, Fangyi
Publié: (2025)
par: Yu, Fangyi
Publié: (2025)
Bootstrapping Developmental AIs: From Simple Competences to Intelligent Human-Compatible AIs
par: Stefik, Mark, et autres
Publié: (2023)
par: Stefik, Mark, et autres
Publié: (2023)
Intrinsic Barriers to Explaining Deep Foundation Models
par: Tan, Zhen, et autres
Publié: (2025)
par: Tan, Zhen, et autres
Publié: (2025)
Evolutionary Reinforcement Learning based AI tutor for Socratic Interdisciplinary Instruction
par: Jiang, Mei, et autres
Publié: (2025)
par: Jiang, Mei, et autres
Publié: (2025)
What Is AI Safety? What Do We Want It to Be?
par: Harding, Jacqueline, et autres
Publié: (2025)
par: Harding, Jacqueline, et autres
Publié: (2025)
Implicit Bias-Like Patterns in Reasoning Models
par: Lee, Messi H. J., et autres
Publié: (2025)
par: Lee, Messi H. J., et autres
Publié: (2025)
Math Education Digital Shadows for facilitating learning with LLMs: Math performance, anxiety and confidence in simulated students and AIs
par: Esposito, Naomi, et autres
Publié: (2026)
par: Esposito, Naomi, et autres
Publié: (2026)
Explaining How Quantization Disparately Skews a Model
par: Bellam, Abhimanyu, et autres
Publié: (2025)
par: Bellam, Abhimanyu, et autres
Publié: (2025)
Crafting Desirable Climate Trajectories with RL Explored Socio-Environmental Simulations
par: Rudd-Jones, James, et autres
Publié: (2024)
par: Rudd-Jones, James, et autres
Publié: (2024)
Documents similaires
-
Measuring What AI Systems Might Do: Towards A Measurement Science in AI
par: Voudouris, Konstantinos, et autres
Publié: (2026) -
A mathematical theory of evolution for self-designing AIs
par: Harris, Kenneth D
Publié: (2026) -
Bringing AI Participation Down to Scale: A Comment on Open AIs Democratic Inputs to AI Project
par: Moats, David, et autres
Publié: (2024) -
Compression, The Fermi Paradox and Artificial Super-Intelligence
par: Bennett, Michael Timothy
Publié: (2021) -
Q-Learning-Driven Adaptive Rewiring for Cooperative Control in Heterogeneous Networks
par: Weng, Yi-Ning, et autres
Publié: (2025)