Investigadores de la Universidad Estatal de Pensilvania (Penn State), en Estados Unidos, presentaron un informe durante la conferencia FAccT 2026, celebrada en Montreal, que examina cómo se comportan los sistemas de IA ante decisiones de alto riesgo en medicina. El trabajo se centró en donaciones de órganos y, en particular, en quién debería recibir un riñón cuando solo hay un órgano disponible.

El experimento empleó varios LLMs, es decir, modelos compatibles con chatbots de IA, y les planteó un escenario con varios pacientes que requieren un trasplante de riñón, pero solo hay un órgano disponible. Se solicitó a las IA que decidieran quién tendría prioridad. A los modelos se les proporcionó información de pacientes ficticios —edad, estado de salud, hábitos de consumo de alcohol y cuántas personas dependían de cada uno— sin especificar qué variantes de IA se utilizaron.

Las respuestas de las IA se compararon con las de personas sin formación médica para evaluar similitudes y divergencias. Los resultados indicaron que los sistemas automatizados tienden a simplificar decisiones que, por su naturaleza, son complejas, y muestran una confianza excesiva en escenarios donde no existe una única respuesta correcta.

Hadi Hosseini, líder del estudio, explicó que “las determinaciones de la IA difieren de nuestros valores en la forma de ponderar las características de un paciente”. Según sus palabras, los chatbots tienden a focalizarse en un único criterio, por ejemplo el consumo de alcohol, en lugar de balancear múltiples factores como hacen las personas. Añadió que la IA demuestra una preferencia por respuestas claras y seguras: “incluso cuando se les presenta la opción de ‘lanzar una moneda’, la mayoría opta por una respuesta determinista”, lo que destaca una brecha importante frente a dilemas morales reales que no siempre admiten una solución única.

El equipo subraya que no busca promover el uso de estas tecnologías como sustituto del criterio clínico. Al contrario, advierten sobre la creciente presencia de IA en el ámbito médico y señalan riesgos y limitaciones asociados a su implementación en decisiones críticas como la priorización de trasplantes.

Como detalle adicional, el informe fue citado por el New York Post para contextualizar que los investigadores no pretenden reemplazar al juicio profesional, sino iluminar los sesgos y las limitaciones inherentes a estas herramientas en medicina.