Deepseek, el unicornio de IA chino, ha lanzado una versión actualizada de su modelo de razonamiento R1, llamado Deepseek-R1-0528. Esta versión mejora las capacidades del modelo en matemáticas, programación y razonamiento lógico general, posicionándolo como una alternativa de código abierto formidable a modelos líderes como Openi’s O3 y Gemini 2.5 Pro de Google.
Mejoras técnicas
La actualización R1-0528 introduce mejoras significativas en la profundidad de razonamiento y la precisión de la inferencia. En particular, el rendimiento del modelo en el punto de referencia de matemáticas AIME 2025 ha aumentado de 70% a 87.5%, lo que refleja un proceso de razonamiento más profundo que promedia 23,000 tokens por pregunta, frente a 12,000 en la versión anterior. Esta mejora se atribuye al aumento de los recursos computacionales y las optimizaciones algorítmicas aplicadas durante el entrenamiento posterior.
Además del razonamiento matemático, el modelo ha mostrado un rendimiento mejorado en las tareas de generación de código. Según los puntos de referencia de LivecodeBench, R1-0528 se ubica justo debajo de los modelos O4 Mini y O3 de OpenAI, superando a los QWen 3 en tareas de generación de código de Grok 3 Mini y Alibaba de Xai.
Pesos de modelo de código abierto
Deepseek continúa su compromiso con el código abierto y las IA de pesas abiertas al liberar R1-0528 bajo la licencia MIT, lo que permite a los desarrolladores modificar e implementar el modelo libremente. Los pesos del modelo están disponibles en la cara abrazada, y se proporciona documentación detallada para la implementación local y la integración de API. Este enfoque contrasta con la naturaleza patentada de muchos modelos de IA líderes, promoviendo la transparencia y la accesibilidad en el desarrollo de IA.
Modelo destilado para despliegue liviano
Reconociendo la necesidad de soluciones de IA más accesibles, Deepseek también ha lanzado una versión destilada de R1-0528, llamada Deepseek-R1-0528-Qwen3-8b. Este modelo, ajustado de la QWEN3-8B de Alibaba usando texto generado por R1-0528, logra el rendimiento de vanguardia entre los modelos de código abierto en el punto de referencia AIME 2024. Está diseñado para funcionar de manera eficiente en una sola GPU, lo que hace que las capacidades de IA avanzadas sean más accesibles para los desarrolladores con recursos computacionales limitados..
Consideraciones de censura
Mientras Los avances de Deepseek en IA son notables, se ha observado que el modelo R1-0528 exhibe una moderación de contenido más estricta en comparación con sus predecesores. Las pruebas independientes revelaron que el modelo evita o proporciona respuestas limitadas a temas políticamente sensibles, como las protestas de Tiananmen Square y el estado de Taiwán, alineando con las regulaciones chinas que exigen modelos de IA para adherirse a las restricciones de contenido.
Implicaciones globales
El lanzamiento de R1-0528 subraya la creciente influencia de China en el sector de IA, desafiando el dominio de las empresas con sede en los Estados Unidos. La capacidad de Deepseek para desarrollar modelos de IA competitivos a una fracción del costo de sus homólogos occidentales ha provocado respuestas de compañías como OpenAI, que han expresado su preocupación sobre el potencial para que estos modelos sea manipulado por el gobierno chino. Este desarrollo destaca la dinámica cambiante en el desarrollo global de IA y la creciente importancia de los modelos de código abierto para fomentar la innovación y la competencia.
Conclusión
El modelo R1-0528 de Deepseek representa un avance significativo en la IA de código abierto, ofreciendo capacidades de razonamiento y accesibilidad mejoradas para los desarrolladores. Al proporcionar un modelo a gran escala y una versión destilada adecuada para la implementación de una sola GPU, Deepseek está avanzando en la democratización de la tecnología de IA. Sin embargo, la adhesión del modelo a las políticas de moderación de contenido refleja la compleja interacción entre el avance tecnológico y el cumplimiento regulatorio. A medida que el panorama de la IA continúa evolucionando, los desarrollos de Deepseek probablemente jugarán un papel fundamental en la configuración del futuro de la IA de código abierto.
Mira el Pesas de código abierto y Pruébalo ahora. Todo el crédito por esta investigación va a los investigadores de este proyecto. Además, siéntete libre de seguirnos Gorjeo Y no olvides unirte a nuestro 95k+ ml de subreddit y suscribirse a Nuestro boletín.
Asif Razzaq es el CEO de MarktechPost Media Inc .. Como empresario e ingeniero visionario, ASIF se compromete a aprovechar el potencial de la inteligencia artificial para el bien social. Su esfuerzo más reciente es el lanzamiento de una plataforma de medios de inteligencia artificial, MarktechPost, que se destaca por su cobertura profunda de noticias de aprendizaje automático y de aprendizaje profundo que es técnicamente sólido y fácilmente comprensible por una audiencia amplia. La plataforma cuenta con más de 2 millones de vistas mensuales, ilustrando su popularidad entre el público.