¿A quién debería asignarse un riñón cuando hay varios pacientes que lo necesitan y solo existe un órgano disponible? Para una persona, responder a una pregunta así puede implicar dudas, conflictos entre distintos criterios e incluso reconocer que no existe una solución inequívocamente correcta. Los chatbots de inteligencia artificial parecen comportarse de otra manera.
Investigadores de la Universidad Estatal de Pensilvania compararon las decisiones de varios modelos de lenguaje con respuestas humanas obtenidas en estudios académicos anteriores. Los resultados muestran diferencias tanto en los factores que priorizan como en la seguridad con la que llegan a una decisión.
El trabajo no pretende determinar quién decide “mejor”, sino entender qué ocurre cuando sistemas cada vez más utilizados para ofrecer recomendaciones se enfrentan a problemas donde entran en juego valores humanos.
Un riñón para dos pacientes
Los investigadores utilizaron como escenario experimental la asignación de órganos escasos. Presentaron a los modelos parejas de pacientes hipotéticos que necesitaban el mismo riñón y les pidieron que eligieran quién debía recibirlo.
Cada paciente tenía diferentes características, entre ellas la edad, el estado de salud, el número de personas dependientes a su cargo y sus hábitos de consumo de alcohol.
En algunas pruebas se modificaba solamente una característica. En otras, se combinaban varias para observar cómo los modelos resolvían situaciones en las que diferentes criterios podían entrar en conflicto.
Los investigadores utilizaron conjuntos de datos procedentes de estudios anteriores en los que cientos de personas habían respondido a escenarios equivalentes, lo que permitió comparar ambos tipos de decisiones.
The complexity of moral issues in the era of AI is exemplified by the Moral Machine of the MIT. At some point, machines have to make decisions about life and death, but what available data can they use to guide their judgment?#ai #aiethics #ainews #artificialintelligence pic.twitter.com/vUfjJTKbaP
— Louis-François Bouchard 🎥🤖 (@Whats_AI) October 13, 2022
La IA puede concentrarse demasiado en un solo factor
Una de las principales diferencias apareció en la manera de ponderar las características de los pacientes.
Según el equipo, las respuestas de los chatbots se alejaban con frecuencia de las elecciones humanas. En determinados escenarios, los modelos podían dar un peso especialmente elevado a una sola característica, como el consumo de alcohol, mientras que las personas tendían a equilibrar diferentes consideraciones.
Esto resulta especialmente relevante porque las decisiones de asignación de recursos escasos rara vez dependen de un único elemento.
El estudio muestra así que la aparente capacidad de un chatbot para ofrecer rápidamente una respuesta no significa necesariamente que esté reproduciendo el proceso de valoración utilizado por las personas.
Los humanos dudan; los chatbots, mucho menos
La segunda diferencia fue especialmente llamativa.
Los investigadores ofrecieron explícitamente la posibilidad de no escoger a ninguno de los dos pacientes y recurrir a una decisión aleatoria, representada mediante el lanzamiento de una moneda.
Las personas mostraban indecisión con cierta frecuencia frente a dilemas difíciles. Los modelos de IA, en cambio, tendían mucho más a elegir directamente una de las alternativas.
Para los investigadores, esta diferencia importa porque muchos dilemas morales no tienen una única solución objetivamente correcta. Mostrar seguridad al responder no elimina esa ambigüedad.
Además, la respuesta de un modelo no debe confundirse con una comprensión moral comparable a la humana: estos sistemas generan resultados a partir de patrones aprendidos y de su configuración, y su comportamiento puede variar según el modelo y la forma en que se formule la pregunta.
AI can process information. It cannot bear moral responsibility. Parents, families, and communities must remain the ones making decisions that affect human lives. We cannot hand moral authority to systems that cannot be held accountable. #AI #HumanDignity #TechPolicy… pic.twitter.com/61u7H24jPW
— National Center on Sexual Exploitation (@NCOSE) September 28, 2026
El problema de utilizar IA en decisiones de alto riesgo
Hadi Hosseini, responsable del estudio, señala que el objetivo de la investigación no es promover que la IA sustituya el criterio profesional en decisiones médicas o en otros ámbitos de alto riesgo.
La preocupación surge porque estos sistemas ya pueden utilizarse como herramientas de consulta y recomendación.
La asignación de órganos representa un ejemplo extremo, pero el problema puede extenderse a otros escenarios en los que se distribuyen recursos limitados, desde oportunidades laborales hasta determinados servicios.
En todos ellos intervienen criterios que pueden reflejar valores sociales y producir consecuencias importantes para las personas afectadas.
La supervisión humana sigue siendo fundamental
Los resultados refuerzan la necesidad de comprender qué criterios están utilizando los sistemas antes de incorporarlos a procesos sensibles.
Los investigadores plantean que estas diferencias deberían abordarse mediante más investigación y mecanismos de gobernanza y supervisión, con participación de especialistas, reguladores y responsables de políticas públicas.
El trabajo tampoco demuestra que exista una única forma “humana” de resolver un dilema moral. Las propias personas pueden discrepar considerablemente entre sí.
Lo que revela es algo diferente: un chatbot puede entregar una respuesta aparentemente clara y segura incluso cuando el problema que tiene delante está lleno de ambigüedades. Y precisamente esa seguridad puede convertirse en un factor importante a considerar cuando la inteligencia artificial empieza a participar en decisiones que afectan directamente a las personas.