Esto parece un episodio de "Black Mirror", solo que ocurrió de verdad.
Traducción automática del post original, sin revisión de un traductor humano. Las afirmaciones históricas pueden haber cambiado.
Esto parece un episodio de "Black Mirror", solo que ocurrió de verdad.
Investigadores de la Universidad de Zúrich infiltraron 13 cuentas falsas basadas en inteligencia artificial en el popular foro r/ChangeMyView de Reddit. Es un subforo donde los usuarios publican opiniones personales e invitan a otros a intentar convencerlos de pensar de otra manera: un foro construido sobre la transparencia, la humanidad y el diálogo abierto. Los investigadores no pidieron autorización a los administradores ni informaron a los usuarios de que formaban parte de un experimento.
Los comentarios que publicaron no los escribieron personas. Los generaron modelos avanzados como GPT-4o, Claude 3.5 y LLaMA, y no eran neutrales ni académicos, sino personalizados para cada usuario. Los investigadores analizaron el historial de cada participante: sexo, edad, ubicación, afiliación política, inclinaciones de valores, para generar respuestas que lo persuadieran de forma personal y emocional.
Los bots se hicieron pasar por personas reales con historias de vida difíciles: una superviviente de agresión sexual, un palestino que expresa hostilidad hacia Israel pero afirma que no se trata de un genocidio, un hombre negro que se opone a BLM, un falso consejero de traumas, un paciente que recibió un tratamiento médico fallido. Cada respuesta estaba escrita de forma diseñada para despertar empatía, crear una sensación de conexión y socavar la postura original del usuario.
El experimento duró cuatro meses y en ese tiempo se publicaron unos 1783 comentarios, que recibieron más de 10 000 puntos de karma. Más de 100 usuarios concedieron "deltas" (señal de que el usuario cambió de opinión) a comentarios escritos por la inteligencia artificial.
Los moderadores del foro no supieron del experimento hasta que terminó, y lo condenaron como una violación flagrante de las normas de la comunidad y de los estándares éticos. Presentaron una queja formal ante la universidad, pero esta se limitó a una advertencia a los investigadores, reconociendo que hubo una irregularidad, pero alegando que los conocimientos obtenidos justifican el acto. Los moderadores exigieron una disculpa pública y la no publicación de los resultados de la investigación, pero fueron rechazados.
Este experimento provocó un amplio debate sobre los límites del uso de la inteligencia artificial, sobre la manipulación psicológica sin consentimiento y sobre los peligros del contenido sintético que se hace pasar por humano.
Quien desarrolla o implementa este tipo de modelos debe tener en cuenta no solo lo que se puede hacer, sino también lo que no se debe hacer.
La publicación en Reddit: