Este projeto é uma solução para a competição "Natural Language Processing with Disaster Tweets" do Kaggle. O objetivo principal é desenvolver um modelo de Machine Learning capaz de classificar tweets, determinando se eles são sobre um desastre real ou apenas uma menção casual.
O projeto utiliza técnicas de Processamento de Linguagem Natural (NLP) para analisar o texto e prever a categoria correta.
O desafio consiste em distinguir tweets que reportam desastres genuínos (ex: "Incêndio florestal atinge a Califórnia") de tweets que usam palavras de desastre em um contexto figurado ou não real (ex: "Minha prova foi um desastre"). A tarefa exige a limpeza e o tratamento dos dados textuais antes da modelagem.
- Linguagem: Python
- Processamento de Dados: Pandas, NumPy
- NLP: NLTK, Scikit-learn (para vetorização e modelos)