Un proyecto de Visión Artificial que reacciona a tus gestos en tiempo real superponiendo memes.
Este proyecto utiliza técnicas de Visión por Computadora para detectar puntos de referencia faciales (facial landmarks) en tiempo real mediante la webcam.
El sistema analiza la geometría del rostro para identificar gestos específicos (como sonreír o sacar la lengua) y dispara una respuesta visual inmediata, reemplazando la imagen de la cámara o superponiendo un meme correspondiente al gesto detectado.
El núcleo del proyecto se basa en MediaPipe Face Mesh, que mapea 468 puntos 3D en el rostro.
- Extracción de Puntos Clave: Se monitorean coordenadas específicas de los labios (puntos
61,291,13,14). - Cálculo Geométrico: Se calcula la Distancia Euclidiana entre estos puntos para determinar:
- Ancho de la boca: Para detectar sonrisas.
- Apertura vertical: Para detectar si la boca está abierta o sacando la lengua.
- Umbrales Dinámicos: Si las distancias superan ciertos valores predefinidos (calibrables), se activa el "Trigger" del meme.
- Python 3: Lenguaje principal.
- OpenCV (
cv2): Para la captura de video y procesamiento de imágenes. - MediaPipe: Para la inferencia del modelo de malla facial (Face Mesh).
- NumPy: Para operaciones matemáticas eficientes.
git clone [https://github.com/Natty093/gestos.git]
cd ia-reconocimiento-gestos