Desarrollan un método que mejora la evaluación de la calidad en la predicción de los sistemas de diagnóstico médico

Investigadores de la Universidad Pablo de Olavide han propuesto un método innovador para la evaluación de sistemas de diagnóstico, denominado curva IMCP, que muestra el rendimiento de la clasificación y, por otro lado, identifica para qué valores de la variable objetivo el modelo está ofreciendo mejor o peor calidad en la predicción.

Fuente: Universidad Pablo de Olavide

Sevilla |

08 de julio de 2024

En el campo de la biomedicina, la evaluación de la calidad de los sistemas de diagnóstico es fundamental para garantizar que se aplican soluciones adecuadas. En los modelos predictivos tiene especial relevancia el hecho de que los valores objeto de estudio son de distinta clase (multiclase) y estas clases a su vez presentan una gran variedad en su frecuencia. Es lo que se conoce como desbalanceo o desequilibrio de datos.

En contextos médicos es de suma importancia disponer de un método capaz de mostrar la calidad del sistema en cuanto a las predicciones que realiza. Hasta ahora, para evaluar de forma gráfica la calidad de un sistema de diagnóstico solo existía la curva ROC (Receiver Operating Characteristic), un análisis utilizado para medir el coste/beneficio de decisiones diagnósticas, pero que no funciona con conjuntos de datos multiclase como, por ejemplo, distintos tipos de tumores.

El investigador de la Universidad Pablo de Olavide Jesús Aguilar.

Investigadores del grupo Data Analytics Science & Engineering, liderado por Jesús Aguilar, catedrático de Lenguajes y Sistemas Informáticos de la Universidad Pablo de Olavide, en colaboración con Marcin Michalak, investigador de la Silesian University of Technology (Polonia), han propuesto un método innovador para la evaluación de sistemas de diagnóstico, denominado curva IMCP, que muestra el rendimiento de la clasificación y, por otro lado, identifica para qué valores de la variable objetivo el modelo está ofreciendo mejor o peor calidad en la predicción.

La curva IMPC (Imbalanced Multiclass Classification Performance) ha sido evaluada en la predicción de 35 tipos de tumores a partir de una colección de 6.756 muestras de tumores metastásicos y primarios obtenidos por la Hartwig Medical Foundation (Países Bajos) y el Pan-Cancer Analysis of Whole Genomes Consortium, analizando un total de 511 características. Como resultado, se revela que un modelo predictivo para tumores aparentemente fiable (92,4% de exactitud en la predicción), podría mostrar un comportamiento desigual para diferentes tipos de tumores (bueno en la predicción de melanoma, pero malo en el caso de sarcoma), lo que necesariamente debería conducir a un examen humano más detallado en el caso de ciertos tipos de tumores, en consonancia con la fiabilidad del sistema de diagnóstico para esos casos.

Descripción de la metodología usada para la curva IMCP.

El análisis propuesto por Aguilar y Michalak permite evaluar el rendimiento para cada valor por separado. De este modo, revela en qué casos el rendimiento global oculta distintos resultados para diferentes tipos de valores (multiclase). Así, si el rendimiento global es del 92,4%, podría darse el caso en que el sistema diagnostique el melanoma con una exactitud del 98,6%, pero el sarcoma con 17,5%. Por tanto, la curva IMCP posibilita identificar la fiabilidad de la predicción a partir de conjuntos de datos de distinta clase.

El método, basado en el cálculo de distancias de funciones de distribución de probabilidad, es aplicable en contextos en donde la curva ROC no puede usarse, cubriendo un vacío existente en la actualidad en el campo de machine learning, con utilidad en multitud de disciplinas.

La curva IMCP puede visualizarse con facilidad a partir de las probabilidades de asignación a cada valor de la variable objetivo proporcionadas por el sistema de diagnóstico, mediante el uso de una librería implementada en Python, de acceso libre y código abierto, publicada en https://github.com/adaa-polsl/imcp. El trabajo ha sido publicado por la editorial Springer-Nature.

Referencia:

Aguilar-Ruiz, J.S., Michalak, M. ‘Classification performance assessment for imbalanced multiclass data’. Scientific Reports 14, 10759 (2024).

Últimas publicaciones

#CienciaDirecta

Biotecnología

Desarrollan un tratamiento de purines de cerdo que reduce la emisión de gases de efecto invernadero

Granada | 25 de agosto de 2025

Un equipo de investigación de la Estación Experimental el Zaidín de Granada (CSIC), del Centro Tecnológico EnergyLab y de la Universidad de Copenhague ha aplicado una solución a partir de residuos vegetales para reducir la liberación de sustancias nocivas de los desechos de la ganadería porcina. El hallazgo ofrece una alternativa al uso de productos químicos agresivos y abre la puerta a nuevas formas de gestionar el estiércol con menor impacto ambiental.

Sigue leyendo

#CienciaDirecta

Farmacia

Confirman que el aceite de acebuchina disminuye el daño ocular producido por la hipertensión arterial

Sevilla | 23 de agosto de 2025

Un equipo de investigación de la Universidad de Sevilla ha confirmado que este aceite reduce las alteraciones del ojo provocadas por los niveles elevados de la presión sanguínea. Los resultados del estudio con células y animales validan su potencial uso terapéutico en enfermedades oftálmicas.

Sigue leyendo

#CienciaDirecta

Ciencias de Materiales, Ingeniería Química

Mejoran las cualidades de la paja de trigo para desarrollar lubricantes industriales más sostenibles

Huelva | 20 de agosto de 2025

Un equipo de investigación de la Universidad de Huelva ha obtenido un tipo de celulosa que mejora las propiedades de las grasas industriales y logra pavimentos más resistentes al calor y al desgaste. Así, modifican un residuo agrícola y lo transforman en un material versátil, ecológico y muy útil para el mercado.

Sigue leyendo

#CienciaDirecta

Tu fuente de noticias sobre ciencia andaluza

Más información Suscríbete

¿ERES CIENTÍFICO/A Y QUIERES DIFUNDIR TUS RESULTADOS? CONTÁCTANOS

¿QUIERES CONTACTAR CON UN CIENTÍFICO/A? CONSULTA LA GUÍA EXPERTA

Política de cookies

Este sitio web utiliza cookies para mejorar su experiencia mientras navega por el sitio web. De estas, las cookies que se clasifican como necesarias se almacenan en su navegador, ya que son esenciales para el funcionamiento de las funcionalidades básicas del sitio web. También utilizamos cookies de terceros que nos ayudan a analizar y comprender cómo utiliza este sitio web. Estas cookies se almacenarán en su navegador solo con su consentimiento. También tiene la opción de optar por no recibir estas cookies. Pero la exclusión voluntaria de algunas de estas cookies puede afectar su experiencia de navegación.

Necesarias

Siempre activado

Las cookies necesarias son absolutamente esenciales para que el sitio web funcione correctamente. Esta categoría solo incluye cookies que garantizan funcionalidades básicas y características de seguridad del sitio web. Estas cookies no almacenan ninguna información personal.

Cookie	Duración	Descripción
CONSENT	16 años 7 meses	Esta cookie está configurada por el complemento de consentimiento de cookies de GDPR. La cookie se utiliza para almacenar el consentimiento del usuario para las cookies.
cookielawinfo-checkbox-advertisement	1 año	La cookie se establece mediante el consentimiento de cookies de GDPR para registrar el consentimiento del usuario para las cookies en la categoría "Publicidad".
cookielawinfo-checkbox-analytics	1 año	Estas cookies están configuradas por el complemento de WordPress de consentimiento de cookies de GDPR. La cookie se utiliza para recordar el consentimiento del usuario para las cookies en la categoría "Análisis".
cookielawinfo-checkbox-necessary	1 año	Esta cookie está configurada por el complemento de consentimiento de cookies de GDPR. Las cookies se utilizan para almacenar el consentimiento del usuario para las cookies en la categoría "Necesarias".
cookielawinfo-checkbox-performance	1 año	Esta cookie está configurada por el complemento de consentimiento de cookies de GDPR. La cookie se utiliza para almacenar el consentimiento del usuario para las cookies en la categoría "Rendimiento".
JCS_INENREF	1 hora	La cookie es parte de las medidas de seguridad del sitio web y se utiliza con fines antispam.
JCS_INENTIM	1 hora	La cookie es parte de las medidas de seguridad del sitio web y se utiliza con fines antispam.
PHPSESSID	sessión	Esta cookie es nativa de las aplicaciones PHP. La cookie se utiliza para almacenar e identificar la identificación de sesión única de un usuario con el fin de administrar la sesión del usuario en el sitio web. La cookie es una cookie de sesión y se elimina cuando se cierran todas las ventanas del navegador.

Rendimiento

Las cookies de rendimiento se utilizan para comprender y analizar los índices de rendimiento clave del sitio web, lo que ayuda a brindar una mejor experiencia de usuario a los visitantes.

Cookie	Duración	Descripción
_gat	1 minuto	Google Universal Analytics instala estas cookies para acelerar la tasa de solicitud y limitar la recopilación de datos en sitios de alto tráfico.
YSC	sessión	Estas cookies son establecidas por Youtube y se utilizan para rastrear las vistas de videos incrustados.

Analítica

Las cookies analíticas se utilizan para comprender cómo los visitantes interactúan con el sitio web. Estas cookies ayudan a proporcionar información sobre métricas, el número de visitantes, la tasa de rebote, la fuente de tráfico, etc.

Cookie	Duración	Descripción
_ga	2 años	Esta cookie es instalada por Google Analytics. La cookie se utiliza para calcular los datos de visitantes, sesiones y campañas y realizar un seguimiento del uso del sitio para el informe de análisis del sitio. Las cookies almacenan información de forma anónima y asignan un número generado aleatoriamente para identificar visitantes únicos.
_gid	1 día	Esta cookie es instalada por Google Analytics. La cookie se utiliza para almacenar información sobre cómo los visitantes usan un sitio web y ayuda a crear un informe analítico de cómo está funcionando el sitio web. Los datos recopilados, incluido el número de visitantes, la fuente de donde provienen y las páginas visitadas de forma anónima.

Las cookies publicitarias se utilizan para proporcionar a los visitantes anuncios y campañas de marketing relevantes. Estas cookies rastrean a los visitantes en los sitios web y recopilan información para proporcionar anuncios personalizados.

Cookie	Duración	Descripción
IDE	1 año 24 días	Utilizado por Google DoubleClick y almacena información sobre cómo el usuario utiliza el sitio web y cualquier otro anuncio antes de visitar el sitio web. Se utiliza para presentar a los usuarios anuncios que son relevantes para ellos de acuerdo con el perfil del usuario.
ms-uid	1 año	Estas cookies tienen una finalidad publicitaria. Contienen un valor único generado aleatoriamente que permite a la Plataforma distinguir navegadores y dispositivos. Esta información se utiliza para medir el rendimiento de los anuncios y proporcionar recomendaciones de productos basadas en datos.
NID	6 meses	Esta cookie se utiliza para crear un perfil en función del interés del usuario y mostrar anuncios personalizados a los usuarios.
test_cookie	15 minutos	Esta cookie la establece doubleclick.net. El propósito de la cookie es determinar si el navegador del usuario admite cookies.
VISITOR_INFO1_LIVE	5 meses 27 días	Youtube establece esta cookie. Se utiliza para rastrear la información de los videos de YouTube incrustados en un sitio web.