A partir de un múltiples frames, nuestro modelo compone un <i>vídeo<
/i> con objetivo de este es poder determinar si es que operación de riesgo o no.
Nuestro modelo utiliza una red convolucional pre-entrenada y, posteriormente, finetuneada en nuestro conjunto de datos.