Enregistré dans:
| Auteurs principaux: | Prasad, Hari, Jacob, Chinnu, P, Imthias Ahamed T. |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2407.20383 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Interpretability-Guided Bi-objective Optimization: Aligning Accuracy and Explainability
par: Fouladi, Kasra, et autres
Publié: (2026)
par: Fouladi, Kasra, et autres
Publié: (2026)
The Station: An Open-World Environment for AI-Driven Discovery
par: Chung, Stephen, et autres
Publié: (2025)
par: Chung, Stephen, et autres
Publié: (2025)
Pareto-Optimized Open-Source LLMs for Healthcare via Context Retrieval
par: Bayarri-Planas, Jordi, et autres
Publié: (2024)
par: Bayarri-Planas, Jordi, et autres
Publié: (2024)
A Taxonomy of Omnicidal Futures Involving Artificial Intelligence
par: Critch, Andrew, et autres
Publié: (2025)
par: Critch, Andrew, et autres
Publié: (2025)
Mutagenesis screen to map the functions of parameters of Large Language Models
par: Hu, Yue, et autres
Publié: (2024)
par: Hu, Yue, et autres
Publié: (2024)
A Case-Based Persistent Memory for a Large Language Model
par: Watson, Ian
Publié: (2023)
par: Watson, Ian
Publié: (2023)
Enhancing Multi-Agent Collaboration with Attention-Based Actor-Critic Policies
par: Belinchon, Hugo Garrido-Lestache, et autres
Publié: (2025)
par: Belinchon, Hugo Garrido-Lestache, et autres
Publié: (2025)
Do Chains-of-Thoughts of Large Language Models Suffer from Hallucinations, Cognitive Biases, or Phobias in Bayesian Reasoning?
par: Araya, Roberto
Publié: (2025)
par: Araya, Roberto
Publié: (2025)
Learning Actionable World Models for Industrial Process Control
par: Yan, Peng, et autres
Publié: (2025)
par: Yan, Peng, et autres
Publié: (2025)
Dynamic Observation Policies in Observation Cost-Sensitive Reinforcement Learning
par: Bellinger, Colin, et autres
Publié: (2023)
par: Bellinger, Colin, et autres
Publié: (2023)
How much can change in a year? Revisiting Evaluation in Multi-Agent Reinforcement Learning
par: Singh, Siddarth, et autres
Publié: (2023)
par: Singh, Siddarth, et autres
Publié: (2023)
Efficiently Quantifying Individual Agent Importance in Cooperative MARL
par: Mahjoub, Omayma, et autres
Publié: (2023)
par: Mahjoub, Omayma, et autres
Publié: (2023)
ConciseRL: Conciseness-Guided Reinforcement Learning for Efficient Reasoning Models
par: Dumitru, Razvan-Gabriel, et autres
Publié: (2025)
par: Dumitru, Razvan-Gabriel, et autres
Publié: (2025)
How Data Quality Affects Machine Learning Models for Credit Risk Assessment
par: Maurino, Andrea
Publié: (2025)
par: Maurino, Andrea
Publié: (2025)
Machine Learning and Theory Ladenness -- A Phenomenological Account
par: Termine, Alberto, et autres
Publié: (2024)
par: Termine, Alberto, et autres
Publié: (2024)
Complete Implementation of WXF Chinese Chess Rules
par: Tan, Daniel, et autres
Publié: (2024)
par: Tan, Daniel, et autres
Publié: (2024)
Developing trustworthy AI applications with foundation models
par: Mock, Michael, et autres
Publié: (2024)
par: Mock, Michael, et autres
Publié: (2024)
How VADER is your AI? Towards a definition of artificial intelligence systems appropriate for regulation
par: Bezerra, Leonardo C. T., et autres
Publié: (2024)
par: Bezerra, Leonardo C. T., et autres
Publié: (2024)
Interpolative Decoding: Exploring the Spectrum of Personality Traits in LLMs
par: Yeh, Eric, et autres
Publié: (2025)
par: Yeh, Eric, et autres
Publié: (2025)
Self-evolving expertise in complex non-verifiable subject domains: dialogue as implicit meta-RL
par: Bailey, Richard M.
Publié: (2025)
par: Bailey, Richard M.
Publié: (2025)
Reward is not enough: can we liberate AI from the reinforcement learning paradigm?
par: Glukhov, Vacslav
Publié: (2022)
par: Glukhov, Vacslav
Publié: (2022)
Discerning What Matters: A Multi-Dimensional Assessment of Moral Competence in LLMs
par: Kilov, Daniel, et autres
Publié: (2025)
par: Kilov, Daniel, et autres
Publié: (2025)
From Pixels to Digital Agents: An Empirical Study on the Taxonomy and Technological Trends of Reinforcement Learning Environments
par: Luo, Lijing, et autres
Publié: (2026)
par: Luo, Lijing, et autres
Publié: (2026)
HCAST: Human-Calibrated Autonomy Software Tasks
par: Rein, David, et autres
Publié: (2025)
par: Rein, David, et autres
Publié: (2025)
Sensemaking in Novel Environments: How Human Cognition Can Inform Artificial Agents
par: Patterson, Robert E., et autres
Publié: (2025)
par: Patterson, Robert E., et autres
Publié: (2025)
EduQate: Generating Adaptive Curricula through RMABs in Education Settings
par: Tio, Sidney, et autres
Publié: (2024)
par: Tio, Sidney, et autres
Publié: (2024)
Intervention Complexity as a Canonical Reward and a Measure of Intelligence
par: McCane, Brendan
Publié: (2026)
par: McCane, Brendan
Publié: (2026)
Benchmarking AI for low-resource contexts: Thinking beyond leaderboards
par: Pant, Aakash, et autres
Publié: (2026)
par: Pant, Aakash, et autres
Publié: (2026)
Right-to-Act: A Pre-Execution Non-Compensatory Decision Protocol for AI Systems
par: Lavi, Gadi
Publié: (2026)
par: Lavi, Gadi
Publié: (2026)
ARCTraj: A Dataset and Benchmark of Human Reasoning Trajectories for Abstract Problem Solving
par: Kim, Sejin, et autres
Publié: (2025)
par: Kim, Sejin, et autres
Publié: (2025)
Position Paper: Bounded Alignment: What (Not) To Expect From AGI Agents
par: Minai, Ali A.
Publié: (2025)
par: Minai, Ali A.
Publié: (2025)
Beyond Mimicry: Preference Coherence in LLMs
par: Mikaelson, Luhan, et autres
Publié: (2025)
par: Mikaelson, Luhan, et autres
Publié: (2025)
Not All Explanations are Created Equal: Investigating the Pitfalls of Current XAI Evaluation
par: Shymanski, Joe, et autres
Publié: (2025)
par: Shymanski, Joe, et autres
Publié: (2025)
Fanar: An Arabic-Centric Multimodal Generative AI Platform
par: Fanar Team, et autres
Publié: (2025)
par: Fanar Team, et autres
Publié: (2025)
Decentralizing Coordination in Open Vehicle Fleets for Scalable and Dynamic Task Allocation
par: Lujak, Marin, et autres
Publié: (2024)
par: Lujak, Marin, et autres
Publié: (2024)
QuickSilver -- Speeding up LLM Inference through Dynamic Token Halting, KV Skipping, Contextual Token Fusion, and Adaptive Matryoshka Quantization
par: Khanna, Danush, et autres
Publié: (2025)
par: Khanna, Danush, et autres
Publié: (2025)
Quo Vadis ChatGPT? From Large Language Models to Large Knowledge Models
par: Venkatasubramanian, Venkat, et autres
Publié: (2024)
par: Venkatasubramanian, Venkat, et autres
Publié: (2024)
Matryoshka Policy Gradient for Entropy-Regularized RL: Convergence and Global Optimality
par: Ged, François, et autres
Publié: (2023)
par: Ged, François, et autres
Publié: (2023)
Modeling Emotions and Ethics with Large Language Models
par: Chang, Edward Y.
Publié: (2024)
par: Chang, Edward Y.
Publié: (2024)
Training Language Models to Win Debates with Self-Play Improves Judge Accuracy
par: Arnesen, Samuel, et autres
Publié: (2024)
par: Arnesen, Samuel, et autres
Publié: (2024)
Documents similaires
-
Interpretability-Guided Bi-objective Optimization: Aligning Accuracy and Explainability
par: Fouladi, Kasra, et autres
Publié: (2026) -
The Station: An Open-World Environment for AI-Driven Discovery
par: Chung, Stephen, et autres
Publié: (2025) -
Pareto-Optimized Open-Source LLMs for Healthcare via Context Retrieval
par: Bayarri-Planas, Jordi, et autres
Publié: (2024) -
A Taxonomy of Omnicidal Futures Involving Artificial Intelligence
par: Critch, Andrew, et autres
Publié: (2025) -
Mutagenesis screen to map the functions of parameters of Large Language Models
par: Hu, Yue, et autres
Publié: (2024)