Saltar al contenido
Tecnología

Los chatbots afrontan los dilemas éticos de una forma muy distinta a las personas

Un estudio de Penn State revela que los modelos de inteligencia artificial ponderan de manera diferente factores humanos cuando deben resolver dilemas éticos y, además, muestran mucha menos indecisión incluso cuando no existe una respuesta claramente correcta.
Por

Tiempo de lectura 3 minutos

Comentarios (0)

¿A quién debería asignarse un riñón cuando hay varios pacientes que lo necesitan y solo existe un órgano disponible? Para una persona, responder a una pregunta así puede implicar dudas, conflictos entre distintos criterios e incluso reconocer que no existe una solución inequívocamente correcta. Los chatbots de inteligencia artificial parecen comportarse de otra manera.

Investigadores de la Universidad Estatal de Pensilvania compararon las decisiones de varios modelos de lenguaje con respuestas humanas obtenidas en estudios académicos anteriores. Los resultados muestran diferencias tanto en los factores que priorizan como en la seguridad con la que llegan a una decisión.

El trabajo no pretende determinar quién decide “mejor”, sino entender qué ocurre cuando sistemas cada vez más utilizados para ofrecer recomendaciones se enfrentan a problemas donde entran en juego valores humanos.

Un riñón para dos pacientes

Los investigadores utilizaron como escenario experimental la asignación de órganos escasos. Presentaron a los modelos parejas de pacientes hipotéticos que necesitaban el mismo riñón y les pidieron que eligieran quién debía recibirlo.

Cada paciente tenía diferentes características, entre ellas la edad, el estado de salud, el número de personas dependientes a su cargo y sus hábitos de consumo de alcohol.

En algunas pruebas se modificaba solamente una característica. En otras, se combinaban varias para observar cómo los modelos resolvían situaciones en las que diferentes criterios podían entrar en conflicto.

Los investigadores utilizaron conjuntos de datos procedentes de estudios anteriores en los que cientos de personas habían respondido a escenarios equivalentes, lo que permitió comparar ambos tipos de decisiones.

La IA puede concentrarse demasiado en un solo factor

Una de las principales diferencias apareció en la manera de ponderar las características de los pacientes.

Según el equipo, las respuestas de los chatbots se alejaban con frecuencia de las elecciones humanas. En determinados escenarios, los modelos podían dar un peso especialmente elevado a una sola característica, como el consumo de alcohol, mientras que las personas tendían a equilibrar diferentes consideraciones.

Esto resulta especialmente relevante porque las decisiones de asignación de recursos escasos rara vez dependen de un único elemento.

El estudio muestra así que la aparente capacidad de un chatbot para ofrecer rápidamente una respuesta no significa necesariamente que esté reproduciendo el proceso de valoración utilizado por las personas.

Los humanos dudan; los chatbots, mucho menos

La segunda diferencia fue especialmente llamativa.

Los investigadores ofrecieron explícitamente la posibilidad de no escoger a ninguno de los dos pacientes y recurrir a una decisión aleatoria, representada mediante el lanzamiento de una moneda.

Las personas mostraban indecisión con cierta frecuencia frente a dilemas difíciles. Los modelos de IA, en cambio, tendían mucho más a elegir directamente una de las alternativas.

Para los investigadores, esta diferencia importa porque muchos dilemas morales no tienen una única solución objetivamente correcta. Mostrar seguridad al responder no elimina esa ambigüedad.

Además, la respuesta de un modelo no debe confundirse con una comprensión moral comparable a la humana: estos sistemas generan resultados a partir de patrones aprendidos y de su configuración, y su comportamiento puede variar según el modelo y la forma en que se formule la pregunta.

El problema de utilizar IA en decisiones de alto riesgo

Hadi Hosseini, responsable del estudio, señala que el objetivo de la investigación no es promover que la IA sustituya el criterio profesional en decisiones médicas o en otros ámbitos de alto riesgo.

La preocupación surge porque estos sistemas ya pueden utilizarse como herramientas de consulta y recomendación.

La asignación de órganos representa un ejemplo extremo, pero el problema puede extenderse a otros escenarios en los que se distribuyen recursos limitados, desde oportunidades laborales hasta determinados servicios.

En todos ellos intervienen criterios que pueden reflejar valores sociales y producir consecuencias importantes para las personas afectadas.

La supervisión humana sigue siendo fundamental

Los resultados refuerzan la necesidad de comprender qué criterios están utilizando los sistemas antes de incorporarlos a procesos sensibles.

Los investigadores plantean que estas diferencias deberían abordarse mediante más investigación y mecanismos de gobernanza y supervisión, con participación de especialistas, reguladores y responsables de políticas públicas.

El trabajo tampoco demuestra que exista una única forma “humana” de resolver un dilema moral. Las propias personas pueden discrepar considerablemente entre sí.

Lo que revela es algo diferente: un chatbot puede entregar una respuesta aparentemente clara y segura incluso cuando el problema que tiene delante está lleno de ambigüedades. Y precisamente esa seguridad puede convertirse en un factor importante a considerar cuando la inteligencia artificial empieza a participar en decisiones que afectan directamente a las personas.

 

 

Fuente: Sinc.

Compartir esta historia

Artículos relacionados