Inicio Noticias China’s DeepSeek lanza el modelo mejorado de IA R1, lo que aumenta...

China’s DeepSeek lanza el modelo mejorado de IA R1, lo que aumenta la competencia para OpenAI

DeepSeek

La start-up china de inteligencia artificial (IA) DeepSeek ha lanzado una actualización de su modelo de razonamiento lógico R1. Esto aumenta la presión competitiva sobre empresas estadounidenses como OpenAI, según ha informado hoy Reuters.

El modelo chino DeepSeek R1 ha sorprendido a todos

DeepSeek ha lanzado su nuevo modelo en la plataforma para desarrolladores Hugging Face. Sin embargo, aún no ha hecho ningún anuncio público sobre el nuevo modelo, ni ha publicado ninguna descripción o comparación.

En la clasificación LiveCodeBench, que compara el rendimiento de los modelos de IA en programación y ha sido desarrollada por investigadores de la Universidad de California, Berkeley, el Instituto Tecnológico de Massachusetts (MIT) y la Universidad de Cornell, el modelo de razonamiento R1 actualizado se situó solo ligeramente por detrás de los modelos o4 mini y o3 de OpenAI en generación de código, por delante de los modelos Grok 3 mini de xAI y Qwen 3 de Alibaba.

Se trata de un logro significativo para el sector chino de la IA, ya que demuestra que los modelos chinos están a la altura de los mejores del mundo en la exigente disciplina de la generación de código de programas.

DeepSeek está cambiando las reglas del juego

DeepSeek refutó la creencia de que los controles a la exportación de Estados Unidos estaban obstaculizando el progreso chino en IA a principios de este año, cuando lanzó modelos que eran iguales o mejores que los mejores de Estados Unidos a una fracción del precio.

El lanzamiento del modelo R1 provocó una fuerte caída de las acciones tecnológicas fuera de China en enero y cuestionó la opinión de que la expansión de la IA requiere una enorme potencia informática y una gran inversión. Se espera que DeepSeek lance R2, el sucesor de R1. Reuters informó en marzo, citando fuentes, que el lanzamiento de R2 estaba previsto inicialmente para mayo. La empresa también lanzó en marzo una actualización de su gran modelo de lenguaje V3.

El objetivo principal de los modelos de lenguaje es procesar y generar texto.Entre sus puntos fuertes se encuentran el lenguaje fluido y natural, y entre sus capacidades se incluyen la conversación, la traducción, la síntesis y el estilo. Los modelos de razonamiento lógico se centran principalmente en la resolución de problemas y la lógica precisa. Entre sus puntos fuertes se encuentran el razonamiento correcto y sistemático, con menos énfasis en el lenguaje. No se trata solo de que la respuesta suene natural, sino de que sea lógicamente correcta y esté bien pensada, y de que sea capaz de resolver un problema matemático o programar código funcional, por ejemplo.

Fuente: Reuters

DEJA UNA RESPUESTA

Por favor ingrese su comentario!
Por favor ingrese su nombre aquí