
Un pequeño portfolio sobre algunos de los proyectos que presento en clase, sobre análisis de datos, inteligencia artificial, o simplemente ejercicios curiosos sobre la aplicación de algunas herramientas estadísticas o demostraciones de propiedades matemáticas.
Este trabajo presenta ORIÓN, un pipeline secuencial de cuatro agentes LLM especializados —Alnitak, Alnilam, Mintaka y Rigel— diseñado para estimar el riesgo de fallo clínico de ensayos oncológicos de Fase II/III a partir del texto no estructurado de sus protocolos. La arquitectura descompone el proceso en extracción de características clínicas, enriquecimiento mediante la tasa base…
Este trabajo recoge el desarrollo exploratorio del ION-Score, un índice onconutricional continuo (0–100) construido sobre biomarcadores de analítica rutinaria — NLR, PNI, HALP, albúmina sérica y LMR — cuyos pesos derivan de hazard ratios pooled en supervivencia global procedentes de meta-análisis publicados. El pipeline se implementa en R sobre datos NHANES 2015–2023 (N=1.796 participantes oncológicos),…
¿Puede una persona sufrir obesidad y a su vez estar muerta de hambre? Este trabajo analiza, a partir de los datos del NHANES 2021–2023 (n = 8.868), las asociaciones estructurales entre obesidad, malnutrición severa, pobreza y género en población adulta estadounidense mediante modelos loglineales. La principal aportación metodológica es, de nuevo, el índice ponderado de…
¿Puede el déficit nutricional predecir la inflamación silenciosa? Este trabajo analiza, a partir de los datos del NHANES 2021–2023, cómo tres criterios diagnósticos de inflamación subclínica —el ratio CRP/Albúmina, el NLR y el SII— responden al estímulo del déficit nutricional mediante modelos de bioensayo probit y logit. La principal aportación metodológica es la construcción de…
Análisis clúster sobre unas 800 observaciones recogidas en una encuesta del CIS (inquietudes políticas y del marco internacional, 41 variables). La decisión de la cantidad de clústeres con las que quedarse está fuertemente influenciada por la necesidad de interpretación sociológica de cada grupo, y la dificultad que supone esta cuando se trata de más de…
Análisis de correspondencias sobre 200.000 observaciones de las intervenciones del SAMUR en Madrid. Se relacionan los distritos madrileños con los hospitales a los que los pacientes han sido trasladados. Se observan principalmente relaciones demográficas. En varias partes del análisis se aprecia cómo hay máximos en las zonas del centro de la ciudad, siempre es curioso…
Un pequeño ejercicio propuesto en clase para la asignatura de métodos de predicción lineal. A principio de curso los alumnos rellenamos una breve encuesta con la que posteriormente podríamos ver (aplicando lo aprendido en la asignatura) si había alguna relación lineal clara entre las variables escogidas, del estilo: las personas que van a clase en…
Una de las principales técnicas de análisis multivariante, el Análisis de las Componentes Principales aplicado a una base de datos con registros sobre un test de personalidad con 50 variables y 20.000 observaciones, desarrollado en el software estadístico SAS. Notas:– Es la primera práctica de esta signatura (Técnicas Multivariantes I) de tercero de carrera, así…
Inteligencia Artificial: el miedo laboral codificado en algoritmos, fruto de haber creado máquinas que piensan. Un proyecto de final de asignatura en el que me dedico a explorar si las búsquedas de las personas en Google podrían servir como un indicador adelantado de la percepción de riesgo laboral asociado a la automatización.Es obvio que la…