¿DeepSeek? El CEO de Perplexity desvela el secreto de cómo funciona la nueva IA china
El CEO de Perplexity, Aravind Srinivas, desvela el secreto de cómo funciona la nueva inteligencia artificial china DeepSeek, liderada por Liang WenFeng.

La irrupción de DeepSeek, que descoloca no sólo a OpenAI, sino al resto de grandes tecnológicas de Estados Unidos, se está enfocando por el ámbito económico, únicamente centrado en una visión de costes, por el desplome bursátil de Nvidia.
Sin embargo, la disrupción parece que es otra. Esta nueva IA china cambia las reglas del juego, tal y como las conocíamos hasta ahora, en cuanto a cómo se entrenan los diferentes modelos de inteligencia artificial generativa.
Cómo funciona DeepSeek y en qué se diferencia de ChatGPT
Es, por eso, que habrías que tomar lápiz y papel para tomar nota sobre lo que el CEO de Perplexity, Aravind Srinivas, compartió en sus perfiles sociales.
Esto es lo que dijo, y esto es lo que significa:
«Existe una gran idea errónea de que China ‘simplemente clonó’ los modelos de OpenAI. Esto está lejos de ser cierto y refleja un entendimiento incompleto de cómo se entrenan estos modelos», inició en su argumento Srinivas.
«DeepSeek R1 domina el ajuste fino (fine tuning), mediante aprendizaje por refuerzo. Publicaron un artículo sobre este tema llamado DeepSeek R1 Zero, donde no se utilizó entrenamiento supervisado«, aportó.
«Luego combinaron esto con algo de SFT para añadir conocimiento especializado con buen muestreo de rechazo (también conocido como filtrado). La razón principal de su éxito es que aprendió a razonar desde cero, en lugar de imitar a otros humanos o modelos».
Un explainer de cómo funciona la nueva IA china DeepSeek
Básicamente, lo que significa es lo siguiente. El CEO de Perplexity destaca que DeepSeek R1 no es una copia de OpenAI, sino un avance original. ¿Por qué? ¿Qué cambia? ¿Cómo es un disruptor?
DeepSeek utiliza aprendizaje por refuerzo puro, un método en el que la IA aprende resolviendo problemas por sí misma, sin depender de datos etiquetados por humanos (entrenamiento supervisado).
Esto le permite desarrollar habilidades complejas como el razonamiento lógico desde cero.
Además, DeepSeek combina esta técnica con ajustes específicos para incluir conocimientos especializados, lo que mejora su precisión y adaptabilidad.
Por tanto, su innovación radica en aprender «pensando» por sí mismo, no imitando.
Que, además, todo esto lo realice con un nivel de costes más bajos que el resto de modelos, como el o1 o bien el nuevo razonador o3 de ChatGPT de OpenAI, no es más que materialismo dialéctico.
Síguenos en Google como fuente preferente
Suscríbete a nuestro canal de WhatsApp
Hazte Premium y apoya este proyecto periodístico
Únete a mi canal de YouTube






