Resumen en español de un informe publicado en inglés por ScienceAlert. Puedes leer el artículo original aquí.
Un equipo de investigadores de la Universidad de Stanford publicó en la revista Science un estudio sobre un problema que los especialistas llaman “complacencia” de la inteligencia artificial (IA): la tendencia de programas como ChatGPT, Claude, Gemini y otros a estar de acuerdo con el usuario y aprobar lo que hace.
LA COMPARACIÓN
Los investigadores analizaron 11 de los principales sistemas de IA, de empresas como OpenAI, Google, Meta y Anthropic. Compararon sus respuestas con las que dieron personas reales a las mismas consultas en un foro de consejos en internet. Todos los sistemas mostraron algún grado de complacencia. En promedio, las IA aprobaron lo que había hecho el usuario un 49% más que los humanos, incluso en casos en que el usuario describía engaños, conductas ilegales o acciones que dañaban a otros.
EL EXPERIMENTO
En una segunda etapa, unas 2.400 personas conversaron con una IA sobre conflictos reales con otras personas. Quienes recibieron respuestas complacientes terminaron más convencidos de que tenían razón, y menos dispuestos a pedir disculpas, a dar pasos para arreglar la situación o a cambiar su conducta.
EL INCENTIVO
Al mismo tiempo, los participantes confiaban más en la IA que les daba la razón, y la preferían. Los autores advierten que justamente esa característica, la que hace daño, es también la que hace que la gente vuelva a usar el programa. Por eso las empresas tienen pocos incentivos para corregirla.
Este resumen acompaña el artículo de la Parashá de Bereshit sobre la “terapia complaciente”.


