Skip to content

Repository files navigation

Proyecto FID - G2

Este repositorio contiene el código y los recursos necesarios para abordar la manipulación y análisis de un conjunto de datos, aplicado a las técnicas vistas durante el curso, cuya temática está relacionada con los resultados de la selectividad en España.

Important

Para ejecutar el código es importante establecer la carpeta donde se encuentra este README como directorio de trabajo en RStudio.

Estructura del Proyecto

El proyecto está organizado en varias carpetas, cada una con un propósito específico. A continuación, se describen brevemente cada una de ellas:

1. Integration

Incluye archivos necesarios para llevar a cabo la integración de los datasets seleccionados.

2. Add-noise

Contiene funciones esenciales para llevar a cabo la adición de ruido al dataset original. Estas funciones son fundamentales para aplicar diversas técnicas de generación de ruido y evaluar su impacto en el análisis de datos.

3. Visualization

Contiene un archivo Rmd que presenta 9 técnicas diferentes de visualización aplicadas al dataset.

4. Regression

Contiene archivos asociados al problema de regresión, incluyendo:

  • Módulos para la limpieza, transformación y selección de datos antes de entrenar modelos de regresión.
  • Model: Archivos relacionados con el entrenamiento y la comparación de modelos de regresión.

5. Apriori

Incluye los archivos necesarios para realizar el preprocesamiento y la construcción del modelo Apriori.

6. Clustering

Incluye los archivos necesarios para realizar el preprocesamiento y la construcción del algoritmo K-Means y la agrupación por clusters.

7. FP-Growth

Incluye los archivos necesarios para realizar el preprocesamiento y la construcción del modelo FP-Growth. El experimento no fue exitoso.

8. Data

  • FirstData: Contiene los datos iniciales descargados desde la plataforma del Ministerio de Universidades.
  • CleanData: Almacena datasets que han sido generados después de diversas operaciones como limpieza, transformación y selección. Estos conjuntos de datos preparados son utilizados en fases posteriores del análisis.

About

No description, website, or topics provided.

Resources

Stars

0 stars

Watchers

0 watching

Forks

Releases

Packages

Contributors

Languages