Brief analysis of DeepSeek R1 and its implications for Generative AI
Fuente:
arXiv
Guardado en:
| Autores principales: | Mercer, Sarah, Spillard, Samuel, Martin, Daniel P. |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Benchmark-Driven Selection of AI: Evidence from DeepSeek-R1
por: Spelda, Petr, et al.
Publicado: (2025)
por: Spelda, Petr, et al.
Publicado: (2025)
Are DeepSeek R1 And Other Reasoning Models More Faithful?
por: Chua, James, et al.
Publicado: (2025)
por: Chua, James, et al.
Publicado: (2025)
TimeCluster with PCA is Equivalent to Subspace Identification of Linear Dynamical Systems
por: Hines, Christian L., et al.
Publicado: (2025)
por: Hines, Christian L., et al.
Publicado: (2025)
R1dacted: Investigating Local Censorship in DeepSeek's R1 Language Model
por: Naseh, Ali, et al.
Publicado: (2025)
por: Naseh, Ali, et al.
Publicado: (2025)
Memory Analysis on the Training Course of DeepSeek Models
por: Zhang, Ping, et al.
Publicado: (2025)
por: Zhang, Ping, et al.
Publicado: (2025)
How Effective Is Constitutional AI in Small LLMs? A Study on DeepSeek-R1 and Its Peers
por: Menke, Antonio-Gabriel Chacón, et al.
Publicado: (2025)
por: Menke, Antonio-Gabriel Chacón, et al.
Publicado: (2025)
Challenges in Ensuring AI Safety in DeepSeek-R1 Models: The Shortcomings of Reinforcement Learning Strategies
por: Parmar, Manojkumar, et al.
Publicado: (2025)
por: Parmar, Manojkumar, et al.
Publicado: (2025)
DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning
por: DeepSeek-AI, et al.
Publicado: (2025)
por: DeepSeek-AI, et al.
Publicado: (2025)
A Review of DeepSeek Models' Key Innovative Techniques
por: Wang, Chengen, et al.
Publicado: (2025)
por: Wang, Chengen, et al.
Publicado: (2025)
Quantitative Analysis of Performance Drop in DeepSeek Model Quantization
por: Zhao, Enbo, et al.
Publicado: (2025)
por: Zhao, Enbo, et al.
Publicado: (2025)
DeepSeek on a Trip: Inducing Targeted Visual Hallucinations via Representation Vulnerabilities
por: Islam, Chashi Mahiul, et al.
Publicado: (2025)
por: Islam, Chashi Mahiul, et al.
Publicado: (2025)
Token-Hungry, Yet Precise: DeepSeek R1 Highlights the Need for Multi-Step Reasoning Over Speed in MATH
por: Evstafev, Evgenii
Publicado: (2025)
por: Evstafev, Evgenii
Publicado: (2025)
Applying Psychometrics to Large Language Model Simulated Populations: Recreating the HEXACO Personality Inventory Experiment with Generative Agents
por: Mercer, Sarah, et al.
Publicado: (2025)
por: Mercer, Sarah, et al.
Publicado: (2025)
Quantifying the Capability Boundary of DeepSeek Models: An Application-Driven Performance Analysis
por: Zhao, Kaikai, et al.
Publicado: (2025)
por: Zhao, Kaikai, et al.
Publicado: (2025)
DeepSeek LLM: Scaling Open-Source Language Models with Longtermism
por: DeepSeek-AI, et al.
Publicado: (2024)
por: DeepSeek-AI, et al.
Publicado: (2024)
I'm Sorry Dave: How the old world of personnel security can inform the new world of AI insider risk
por: Martin, Paul, et al.
Publicado: (2025)
por: Martin, Paul, et al.
Publicado: (2025)
DeepSeek-Coder: When the Large Language Model Meets Programming -- The Rise of Code Intelligence
por: Guo, Daya, et al.
Publicado: (2024)
por: Guo, Daya, et al.
Publicado: (2024)
DeepSeek-Coder-V2: Breaking the Barrier of Closed-Source Models in Code Intelligence
por: DeepSeek-AI, et al.
Publicado: (2024)
por: DeepSeek-AI, et al.
Publicado: (2024)
Benchmarking LLM for Code Smells Detection: OpenAI GPT-4.0 vs DeepSeek-V3
por: Sadik, Ahmed R., et al.
Publicado: (2025)
por: Sadik, Ahmed R., et al.
Publicado: (2025)
DeepSeek vs. ChatGPT vs. Claude: A Comparative Study for Scientific Computing and Scientific Machine Learning Tasks
por: Jiang, Qile, et al.
Publicado: (2025)
por: Jiang, Qile, et al.
Publicado: (2025)
DeepSeek-Inspired Exploration of RL-based LLMs and Synergy with Wireless Networks: A Survey
por: Qiao, Yu, et al.
Publicado: (2025)
por: Qiao, Yu, et al.
Publicado: (2025)
DeepSeek-Prover-V1.5: Harnessing Proof Assistant Feedback for Reinforcement Learning and Monte-Carlo Tree Search
por: Xin, Huajian, et al.
Publicado: (2024)
por: Xin, Huajian, et al.
Publicado: (2024)
MHA2MLA-VLM: Enabling DeepSeek's Economical Multi-Head Latent Attention across Vision-Language Models
por: Fan, Xiaoran, et al.
Publicado: (2026)
por: Fan, Xiaoran, et al.
Publicado: (2026)
Challenges and Applications of Large Language Models: A Comparison of GPT and DeepSeek family of models
por: Sharma, Shubham, et al.
Publicado: (2025)
por: Sharma, Shubham, et al.
Publicado: (2025)
A Brief Review of Hypernetworks in Deep Learning
por: Chauhan, Vinod Kumar, et al.
Publicado: (2023)
por: Chauhan, Vinod Kumar, et al.
Publicado: (2023)
Medical Reasoning in LLMs: An In-Depth Analysis of DeepSeek R1
por: Moell, Birger, et al.
Publicado: (2025)
por: Moell, Birger, et al.
Publicado: (2025)
Informative missingness and its implications in semi-supervised learning
por: Wu, Jinran, et al.
Publicado: (2025)
por: Wu, Jinran, et al.
Publicado: (2025)
WideSeek-R1: Exploring Width Scaling for Broad Information Seeking via Multi-Agent Reinforcement Learning
por: Xu, Zelai, et al.
Publicado: (2026)
por: Xu, Zelai, et al.
Publicado: (2026)
EvoGPT-f: An Evolutionary GPT Framework for Benchmarking Formal Math Languages
por: Mercer, Johnathan
Publicado: (2024)
por: Mercer, Johnathan
Publicado: (2024)
Is Power-Seeking AI an Existential Risk?
por: Carlsmith, Joseph
Publicado: (2022)
por: Carlsmith, Joseph
Publicado: (2022)
DeepSeek-R1 Thoughtology: Let's think about LLM Reasoning
por: Marjanović, Sara Vera, et al.
Publicado: (2025)
por: Marjanović, Sara Vera, et al.
Publicado: (2025)
Output Length Effect on DeepSeek-R1's Safety in Forced Thinking
por: Li, Xuying, et al.
Publicado: (2025)
por: Li, Xuying, et al.
Publicado: (2025)
On DeepSeekMoE: Statistical Benefits of Shared Experts and Normalized Sigmoid Gating
por: Nguyen, Huy, et al.
Publicado: (2025)
por: Nguyen, Huy, et al.
Publicado: (2025)
Mode Seeking meets Mean Seeking for Fast Long Video Generation
por: Cai, Shengqu, et al.
Publicado: (2026)
por: Cai, Shengqu, et al.
Publicado: (2026)
Comparative Analysis of OpenAI GPT-4o and DeepSeek R1 for Scientific Text Categorization Using Prompt Engineering
por: Maiti, Aniruddha, et al.
Publicado: (2025)
por: Maiti, Aniruddha, et al.
Publicado: (2025)
A Brief Review for Compression and Transfer Learning Techniques in DeepFake Detection
por: Karathanasis, Andreas, et al.
Publicado: (2025)
por: Karathanasis, Andreas, et al.
Publicado: (2025)
Deep Grokking: Would Deep Neural Networks Generalize Better?
por: Fan, Simin, et al.
Publicado: (2024)
por: Fan, Simin, et al.
Publicado: (2024)
Learning to Look: Seeking Information for Decision Making via Policy Factorization
por: Dass, Shivin, et al.
Publicado: (2024)
por: Dass, Shivin, et al.
Publicado: (2024)
Deep Reinforcement Learning for Robotic Manipulation under Distribution Shift with Bounded Extremum Seeking
por: Saxena, Shaifalee, et al.
Publicado: (2026)
por: Saxena, Shaifalee, et al.
Publicado: (2026)
Combining Adam and its Inverse Counterpart to Enhance Generalization of Deep Learning Optimizers
por: Shi, Tao, et al.
Publicado: (2026)
por: Shi, Tao, et al.
Publicado: (2026)
Ejemplares similares
-
Benchmark-Driven Selection of AI: Evidence from DeepSeek-R1
por: Spelda, Petr, et al.
Publicado: (2025) -
Are DeepSeek R1 And Other Reasoning Models More Faithful?
por: Chua, James, et al.
Publicado: (2025) -
TimeCluster with PCA is Equivalent to Subspace Identification of Linear Dynamical Systems
por: Hines, Christian L., et al.
Publicado: (2025) -
R1dacted: Investigating Local Censorship in DeepSeek's R1 Language Model
por: Naseh, Ali, et al.
Publicado: (2025) -
Memory Analysis on the Training Course of DeepSeek Models
por: Zhang, Ping, et al.
Publicado: (2025)