Logotipo del repositorio

Publicación:
Eficiencia computacional de la implementación de algoritmos en aplicaciones Deep Learning para salud en arquitecturas de gran escala

dc.contributor.advisorBarrios Hernández, Carlos Jaime
dc.contributor.advisorRiveill, Michel
dc.contributor.advisorGarcía Henao, John Anderson
dc.contributor.authorFélix Armando Mejía Cajicá
dc.contributor.evaluatorBarbosa Santillán, Liliana Ibeth
dc.contributor.evaluatorMartínez Abuanza, Víctor
dc.contributor.evaluatorRomo Bucheli, David
dc.contributor.evaluatorBenavides Arévalo, Bernardo Andrés
dc.contributor.evaluatorBautista Rozo, Lola Xiomara
dc.date.accessioned2026-09-05T12:39:24Z
dc.date.created2026-09-03
dc.date.issued2026-09-03
dc.description.abstractEl despliegue de modelos de Deep Learning para el diagnóstico médico está dominado por arquitecturas sobredimensionadas, cuyo costo computacional y energético las vuelve inviables en entornos con recursos computacionales limitados; por esto, los desafíos actuales en el campo del Deep Learning, exigen metodologías que permitan construir modelos compactos, precisos y energéticamente sostenibles sin sacrificar el desempeño diagnóstico. Esta tesis aborda ese problema proponiendo, implementando y validando un marco de trabajo (framework) que consta de tres fases encadenadas de extremo a extremo donde la primera fase se encarga de la búsqueda generativa de arquitecturas neuronales, la segunda fase realiza transferencia de conocimiento mediante la destilación y la tercera realiza un análisis de consumo y eficiencia energética durante la inferencia, todo ello validado en la clasificación multietiqueta de radiografías de tórax del conjunto de datos CheXpert. La primera etapa es GenENAS (Generative Enhanced Neural Architecture Search), un método automático de búsqueda de arquitecturas neuronales que emplea modelos de lenguaje de gran escala (GPT-4 y Llama~2) como optimizadores de caja negra: el LLM propone iterativamente arquitecturas que se entrenan y evalúan, retroalimentándose con el AUC-ROC obtenido. La arquitectura resultante (1.91 M de parámetros, 7.28 MB de memoria, AUC-ROC=0.869) es aproximadamente 30 veces más pequeña que ResNet-152 (58.15 M de parámetros, 232.62 MB, AUC-ROC = 0.875), con una brecha de desempeño de apenas 0.006 puntos en AUC-ROC, lo que evidencia el sobredimensionamiento de las arquitecturas estándar para esta tarea. La segunda etapa transfiere, mediante la destilación de conocimiento, la capacidad predictiva de un modelo maestro mucho mayor (en las pruebas se usó DenseNet-121 con 6.96 M de parámetros, 26.87 MB de memoria) a modelos estudiantes ligeros y compactos (GenENAS encontrado en la primera etapa, MobileNet V2 y EfficientNet-B0). El mejor estudiante destilado iguala prácticamente al maestro en AUC-ROC (0.884 frente a 0.891) con una reducción del 67.9% en el tamaño y el número de parámetros, lo que evidencia que la destilación mejora de forma consistente a todos los estudiantes evaluados. La tercera etapa cuantifica el impacto energético en la inferencia: los modelos compactos destilados reducen en cerca de un 45% el consumo energético y la huella de carbono y prácticamente duplican la eficiencia energética integrada (AUC-ROC por julio) respecto al maestro. En conjunto, la investigación demuestra que la combinación de búsqueda generativa de arquitecturas, destilación de conocimiento y diseño consciente del uso de la energía permite construir modelos robustos, estables y sostenibles, desplegables en dispositivos con recursos limitados y sin dependencia de la nube, promoviendo la democratización de la inteligencia artificial médica en consonancia con el paradigma de la Green AI.
dc.description.abstractenglishThe deployment of Deep Learning models for medical diagnosis is currently dominated by oversized architectures whose computational and energy costs make them impractical for resource-constrained environments. Consequently, current challenges in the field of Deep Learning demand methodologies capable of building compact, accurate, and energy-efficient models without compromising diagnostic performance. This thesis addresses this problem by proposing, implementing, and validating an end-to-end framework composed of three interconnected stages. The first stage performs generative neural architecture search, the second stage applies knowledge transfer through distillation, and the third stage analyzes energy consumption and efficiency during inference. The entire framework is validated on the multi-label classification task of chest X-ray images from the CheXpert dataset. The first stage is GenENAS (Generative Enhanced Neural Architecture Search) stage, an automated neural architecture search method that employs Large Language Models (GPT-4 and Llama~2) as black-box optimizers. The LLM iteratively proposes neural architectures that are trained and evaluated, receiving feedback through the achieved AUC-ROC score. The resulting architecture (1.91~M parameters, 7.28~MB memory footprint, AUC-ROC~=~0.869) is approximately 30 times smaller than ResNet-152 (58.15~M parameters, 232.62~MB, AUC-ROC~=~0.875), while exhibiting only a 0.006-point performance gap in terms of AUC-ROC. These results highlight the degree of over-parameterization present in standard architectures for this task. The second stage transfers the predictive capability of a significantly larger teacher model (DenseNet-121, with 6.96~M parameters and a 26.87~MB memory footprint) to lightweight and compact student models (the GenENAS architecture discovered in the first stage, together with the reference architectures MobileNetV2 and EfficientNet-B0) through Knowledge Distillation. The best distilled student nearly matches the teacher's performance in terms of AUC-ROC (0.884 versus 0.891) while achieving a 67.9% reduction in both model size and parameter count, demonstrating that knowledge distillation consistently improves the performance of all evaluated student models. The third stage quantifies the energy impact during inference. Distilled compact models reduce energy consumption and carbon footprint by approximately 45%. Furthermore, they nearly double the integrated energy efficiency (AUC-ROC per joule) compared to the teacher model. Overall, this research demonstrates that the combination of generative neural architecture search, knowledge distillation, and energy-aware design enables the construction of robust, stable, and sustainable models that can be deployed on resource-constrained devices without relying on cloud infrastructure. In doing so, it promotes the democratization of medical artificial intelligence in alignment with the principles of the Green AI paradigm.
dc.description.cvlachttps://scienti.minciencias.gov.co/cvlac/visualizador/generarCurriculoCv.do?cod_rh=0000262331
dc.description.degreelevelDoctorado
dc.description.degreenameDoctor en Ciencias de la Computación
dc.description.orcid0000-0002-9307-4177
dc.format.mimetypeapplication/pdf
dc.identifier.instnameUniversidad Industrial de Santander
dc.identifier.reponameUniversidad Industrial de Santander
dc.identifier.repourlhttps://noesis.uis.edu.co
dc.identifier.urihttps://noesis.uis.edu.co/handle/20.500.14071/48386
dc.language.isoeng
dc.publisherUniversidad Industrial de Santander
dc.publisher.facultyFacultad de Ingeníerias Fisicomecánicas
dc.publisher.programDoctorado en Ciencias de la Computación
dc.publisher.schoolEscuela de Ingeniería de Sistemas e Informática
dc.rightsinfo:eu-repo/semantics/openAccess
dc.rights.accessrightsinfo:eu-repo/semantics/openAccess
dc.rights.coarhttp://purl.org/coar/access_right/c_abf2
dc.rights.creativecommonsAtribución-NoComercial-SinDerivadas 4.0 Internacional (CC BY-NC-ND 4.0)
dc.rights.licenseAttribution-NonCommercial 4.0 International (CC BY-NC 4.0)
dc.rights.urihttps://creativecommons.org/licenses/by-nc/4.0/
dc.subjectEntrenamiento basado en población (PBT)
dc.subjectbúsqueda de arquitectura neuronal generativa mejorada (GenENAS)
dc.subjectdestilación de conocimiento
dc.subjecteficiencia energética.
dc.subject.keywordopulation Based Training (PBT)
dc.subject.keywordGenerative Enhanced Neural Architecture Search (GenENAS)
dc.subject.keywordKnowledge Distillation
dc.subject.keywordEnergy Efficiency .
dc.titleEficiencia computacional de la implementación de algoritmos en aplicaciones Deep Learning para salud en arquitecturas de gran escala
dc.title.englishComputational efficiency of the implementation of algorithms in Deep Learning applications for health in large-scale architectures
dc.type.coarhttp://purl.org/coar/resource_type/c_db06
dc.type.hasversionhttp://purl.org/coar/version/c_b1a7d7d4d402bcce
dc.type.localTesis/Trabajo de grado - Monografía - Doctorado
dspace.entity.typePublication

Archivos

Bloque original

Mostrando 1 - 3 de 3
Cargando...
Miniatura
Nombre:
Nota de proyecto.pdf
Tamaño:
595.07 KB
Formato:
Adobe Portable Document Format
Cargando...
Miniatura
Nombre:
Documento.pdf
Tamaño:
12.65 MB
Formato:
Adobe Portable Document Format
Cargando...
Miniatura
Nombre:
Carta de autorización.pdf
Tamaño:
100.9 KB
Formato:
Adobe Portable Document Format

Bloque de licencias

Mostrando 1 - 1 de 1
Cargando...
Miniatura
Nombre:
license.txt
Tamaño:
2.17 KB
Formato:
Item-specific license agreed to upon submission
Descripción:

VIGILADA MINEDUCACIÓN

Ordenanza No. 83 de 1.944 (junio 22)

Carácter académico: Universidad

Notificaciones judiciales: notjudiciales@uis.edu.co 

.

Código SNIES: 1204   Nit: 890.201.213-4

Línea Anticorrupción:  +57 (601) 562 9300 EXT: 3633

Línea transparente: +57 (607) 630 3031