Loading repository data…
Loading repository data…
CD-GRUPO3 / repository
📊 Trabajos prácticos - TA047 Ciencia de Datos (1C2025) FIUBA · Cátedra Rodríguez · Repositorio con los TPs realizados durante la cursada.
A transparent discovery signal based on current public GitHub metadata.
This score does not audit code, security, maintainers, documentation quality, or suitability. Verify the repository and its current documentation before adoption.
Grupo 03
Integrantes:
Cada ejercicio incluye análisis, preprocesamiento, modelado, evaluación y visualización de resultados. Se abordaron cuatro ejercicios principales:
Análisis exploratorio sobre datos de viajes en taxis Yellow Cab (EE.UU.), para comprender las características, detectar datos faltantes y valores atípicos, y generar nuevas variables.
Modelos de clasificación binaria para predecir lluvia al día siguiente a partir de datos meteorológicos de Australia, usando Árboles de Decisión, Random Forest y un Ensamble Híbrido (Voting).
Modelos de regresión para predecir el precio de alquiler en Airbnb en Río de Janeiro, entrenando Regresión Lineal, XGBoost y KNN.
Agrupamiento (clustering) de datos musicales de Spotify, utilizando K-Means para identificar grupos y caracterizarlos.
Proyecto de clasificación de sentimiento en críticas cinematográficas en español. El objetivo fue predecir si una crítica es positiva o negativa, utilizando técnicas de procesamiento de lenguaje natural y modelos de machine learning.
Se aplicaron métodos de preprocesamiento como "bag of words" y vectorización del texto, y se entrenaron los siguientes modelos:
Cada modelo fue optimizado mediante búsqueda de hiperparámetros y evaluado con la métrica F1 en un conjunto de prueba. Las predicciones se enviaron a Kaggle para competir en el leaderboard.