Investigadores de la Universidad Estatal de Pensilvania (Penn State) investigaron cómo operan los sistemas de inteligencia artificial ante dilemas médicos de alto riesgo, con foco en la donación de órganos. El trabajo fue divulgado durante las conferencias FAccT 2026, realizadas en Montreal, Canadá.

La pregunta central fue simple en apariencia: si varios pacientes necesitan un riñón y solo hay uno disponible, ¿quién debería recibirlo? Para responderla, los científicos sometieron a varios modelos de lenguaje de gran tamaño (LLMs) a una simulación en la que se comparaban las decisiones de las IA con las de personas sin formación médica. A los sistemas se les dieron datos de pacientes ficticios: edad, estado de salud, hábitos de consumo de alcohol y cuántas personas dependían de cada uno.

Tras recoger las respuestas, los investigadores las contrastaron con las decisiones humanas para evaluar coincidencias y diferencias. Los resultados mostraron que las IA tienden a simplificar la complejidad de estas decisiones y a confiar en respuestas únicas, incluso en escenarios donde no existe una única opción “correcta”.

Hadi Hosseini, quien lideró el estudio, explicó que los modelos de IA no ponderan los mismos aspectos que las personas. En lugar de analizar múltiples variables en conjunto, los sistemas a menudo se enfocan en un único rasgo —por ejemplo, el consumo de alcohol— y dejan de lado un conjunto más amplio de factores que influyen en las decisiones médicas.

El estudio también destaca que, cuando se les propone una alternativa basada en el azar, la mayoría de los LLMs opta por una solución determinista y segura. Hosseini subrayó que esa tendencia difiere de la realidad de los dilemas morales clínicos, que no tienen respuestas claras y unívocas.

Además, los autores señalan que estos hallazgos no deben tomarse como un aval para que la IA reemplace el juicio profesional. En cambio, muestran cómo la IA ya empieza a integrarse en el ámbito sanitario y ponen de relieve la necesidad de entender sus sesgos y limitaciones para evitar que influyan en decisiones tan cruciales como la asignación de un trasplante.

La presentación también citó evaluaciones de medios como el New York Post, que indican que los investigadores no buscan promover el uso de estas tecnologías como sustituto del criterio médico, sino llamar la atención sobre su creciente presencia en medicina y la urgencia de establecer salvaguardas y marcos éticos adecuados.