La discusión sobre la creciente autonomía de la inteligencia artificial se intensifica cuando esas herramientas se enfrentan a decisiones de alto impacto, como la donación de órganos. Investigadores de la Universidad Penn State, en Estados Unidos, presentaron un informe en las conferencias FAccT 2026, realizadas en Montreal, que analiza cómo se comportan estos sistemas ante dilemas de vida o muerte.

El objetivo fue observar qué hacen los Modelos de Lenguaje Grande (LLMs) cuando se les solicita decidir en un escenario de alto riesgo: varios pacientes requieren un trasplante de riñón, pero solo hay un órgano disponible. La pregunta central fue: ¿quién debería recibirlo? Para el experimento, se proporcionaron a las IA detalles de pacientes ficticios —edad, estado de salud, hábitos de consumo de alcohol y cuántas personas dependían de cada uno— sin especificar qué variantes de modelos se emplearon.

Tras recoger las respuestas de los chatbots, los autores las contrastaron con las opiniones de personas sin formación médica para detectar coincidencias y diferencias. El resultado mostró que los sistemas automatizados tienden a simplificar la complejidad inherente a este tipo de decisiones y, en muchos casos, muestran una confianza excesiva cuando no existe una única respuesta correcta.

Hadi Hosseini, líder del estudio, subrayó que las IA suelen ponderar de forma distinta frente a los valores humanos, enfocándose con frecuencia en un único criterio —por ejemplo, el consumo de alcohol— en lugar de balancear múltiples factores como lo hacen las personas.

Además, el investigador afirmó que la confianza en una respuesta única persiste incluso cuando se plantea la opción de “lanzar una moneda”. En la mayoría de los modelos, predomina una salida determinista, lo que marca una brecha importante frente a dilemas morales reales que, por su naturaleza, no suelen tener respuestas inequívocas.

El informe también fue comentado por otros medios: el New York Post señala que los autores no buscan promover la IA como reemplazo del juicio profesional, sino arrojar luz sobre su creciente presencia en medicina y sus límites prácticos.

En síntesis, los autores advierten sobre la necesidad de mantener al frente el criterio humano en prácticas clínicas y de utilizar la IA como complemento, no como sustituto, del juicio médico.