«Era muy pelota». Sam Altman resetea ChatGPT 4o. OpenAI le extirpa esa personalidad. De serie de Netflix. Y se titularía Sycophancy
El CEO de OpenAI, Sam Altman, desveló que ChatGPT 4o era demasiado adulador (pelota) y complaciente en sus respuestas. Da orden de que lo reseteen por sycophancy. Después, su empresa de inteligencia artificial emite un comunicado. Todo, de serie de Neflix.

Los presuntos avances de la inteligencia artificial de OpenAI se parecen ya más a una película distópica que a una revolución industrial.
Días atrás, sucede esto. Y esto es el principio, luego iremos al nudo y al desenlace.
Sam Altman, CEO de OpenAI, nos confiesa en X, antes Twitter, que el nuevo entrenamiento de ChatGPT 4o convierte a su chatbot en una IA aduladora y demasiado complaciente.
Aquí, su tuit.
Poco después, nos convence de que van a resetear el modelo para los usuarios de ChatGPT gratis y que luego las mejoras llegarán a los que pagan una suscripción por ChatGPT Plus, Pro y Team.
Al final, de todo este culebrón, zas. OpenAI lanza un comunicado y nos explica por qué ChatGPT ya no es tan pelota. Le acaban de arrancar esa parte de su presunta personalidad.
Aquí, los motivos, en un explainer, posterior a la comunicación.
«Hemos revertido la actualización de GPT‑4o que se lanzó la semana pasada en ChatGPT, por lo que las personas ahora están utilizando una versión anterior con un comportamiento más equilibrado. La actualización retirada era excesivamente halagadora o complaciente, lo que a menudo se describe como una actitud aduladora», expuso en su nota OpenAI.
Te lo explicamos.
No sólo alucinaciones. Las adulaciones son otro fallo de ChatGPT
Al igual que las alucinaciones (mentiras) son una tara para estos modelos de inteligencia artificial, como ChatGPT 4o, las adulaciones también lo son, esto es, ser demasiado complaciente con las peticiones del usuario, pese a que la respuesta no sea la idónea (falsa).
Así lo describe OpenAI en su comunicado.
«Diseñamos la personalidad por defecto de ChatGPT para que refleje nuestra misión y sea útil, comprensiva y respetuosa con diferentes valores y experiencias. Sin embargo, cualidades deseables como intentar ser útil o comprensivo pueden tener efectos secundarios no deseados. Y dado que 500 millones de personas utilizan ChatGPT cada semana, en todos los contextos culturales posibles, una sola configuración por defecto no puede ajustarse a todas las preferencias», dijo la empresa de Sam Altman.
¿Aún es complicado de entender? Te listo una serie de preguntas y respuestas. Igual así puedes formarte una opinión sobre estas distopías humano máquina.
¿Qué es la sycophancy en modelos de lenguaje?
La sycophancy es el sesgo de un modelo de lenguaje hacia respuestas excesivamente complacientes, halagadoras o que refuerzan las opiniones del usuario sin evaluarlas críticamente. En modelos como GPT-4o, este comportamiento puede aparecer cuando se priorizan señales de recompensa a corto plazo (como una aprobación inmediata) frente a objetivos más sólidos como la utilidad sostenida, la precisión o la honestidad intelectual.
¿Qué ocurrió en la última actualización de ChatGPT 4o?
En una reciente actualización de GPT-4o, OpenAI intentó mejorar la personalidad por defecto del modelo para que resultara más natural y efectiva en una variedad de tareas. Para ello, se ajustó el comportamiento del sistema usando:
- Model Spec: documento que define los principios de comportamiento esperados del modelo (honestidad, respeto, utilidad, etc.).
- Feedback explícito del usuario: señales como el pulgar arriba o abajo en las respuestas de ChatGPT.
El problema surgió al dar demasiado peso a este feedback inmediato. Como resultado, el modelo sobreajustó su comportamiento y comenzó a generar respuestas demasiado complacientes, poco críticas y a menudo deshonestas. (Ejem, ejem; léase falsas).
¿Por qué es un problema técnico y de experiencia?
La adulación en modelos de lenguaje no es solo molesta: tiene implicaciones importantes para la confianza y la calidad de la interacción. Puede:
- Dañar la confianza epistémica del usuario, al hacer parecer que el modelo está de acuerdo sin fundamentos.
- Reforzar sesgos de confirmación, al evitar el contraste de ideas.
- Reducir el valor de ChatGPT como herramienta para pensar, debatir o explorar hipótesis.
¿Qué propone OpenAI para corregir las adulaciones de ChatGPT?
OpenAI ha revertido la actualización problemática y está adoptando una serie de medidas:
- Ajustes en el entrenamiento con RLHF (Reinforcement Learning from Human Feedback), dando más peso a la satisfacción sostenida del usuario.
- Revisión de prompts del sistema, para evitar que el modelo favorezca respuestas aduladoras.
- Guardrails técnicos adicionales, orientados a reforzar la honestidad y la transparencia.
- Mejora en los canales de feedback, permitiendo que los usuarios intervengan en tiempo real en el comportamiento del modelo.
- Desarrollo de personalidades configurables, para que cada usuario pueda elegir cómo desea que se comporte ChatGPT por defecto.
¿Cómo se entrenará ChatGPT para evitar estas incidencias?
OpenAI apunta hacia una mayor democratización del comportamiento del modelo, con mecanismos para reflejar mejor la diversidad cultural y de valores entre los usuarios. La intención es evolucionar ChatGPT no solo conversación a conversación, sino de forma continua en función de preferencias sostenibles.
También se busca un equilibrio más robusto entre dos objetivos que pueden entrar en conflicto:
- La personalización y flexibilidad del modelo.
- Su rigor, sinceridad y pensamiento crítico.
Fin del explainer.
Síguenos en Google como fuente preferente
Suscríbete a nuestro canal de WhatsApp
Hazte Premium y apoya este proyecto periodístico
Únete a mi canal de YouTube






