Redes neuronales convolucionales

¿Qué son las redes neuronales convolucionales?

3 cosas que debe saber

Una red neuronal convolucional (CNN o ConvNet) es una arquitectura de red para Deep Learning que aprende directamente a partir de datos.

Son particularmente útiles para identificar patrones en imágenes con el fin de reconocer objetos, clases y categorías. Además, pueden ser muy eficaces para clasificar datos de audio, señales y series temporales.

Preguntas frecuentes sobre redes neuronales convolucionales (CNN)

Una red neuronal convolucional (CNN o ConvNet) es una arquitectura de Deep Learning que aprende directamente de los datos. Es especialmente útil para identificar patrones en imágenes y reconocer objetos, clases y categorías.

Las capas convolucionales aplican filtros a las imágenes de entrenamiento a diferentes resoluciones, donde cada filtro activa determinadas características. La salida de cada imagen convolucionada se utiliza como entrada para la siguiente capa, pasando de características simples como brillo y bordes a características más complejas.

ReLU (Rectified Linear Unit) permite un entrenamiento más rápido y eficaz al transformar los valores negativos en cero y mantener los valores positivos, garantizando que solo las características activadas se propaguen a la siguiente capa.

El pooling simplifica la salida mediante un submuestreo no lineal, reduciendo el número de parámetros que la red necesita aprender.

Los pesos y sesgos compartidos implican que todas las neuronas de una misma capa detectan la misma característica en diferentes regiones de la imagen, lo que hace que la red sea robusta frente a desplazamientos de los objetos (por ejemplo, reconocer coches independientemente de su posición en la imagen).

Las redes neuronales convolucionales se utilizan en imagen médica para detectar células cancerosas, en procesamiento de audio para la detección de palabras clave, en detección de objetos para la conducción autónoma y en la generación de datos sintéticos mediante redes generativas antagónicas (GAN).

Las redes neuronales convolucionales son especialmente adecuadas cuando se dispone de grandes volúmenes de datos complejos, como imágenes, o cuando se trabaja con señales o series temporales que han sido preparadas para ajustarse a la estructura de la red.

El aprendizaje por transferencia utiliza una red preentrenada para abordar una nueva tarea, lo que requiere menos datos y recursos computacionales que entrenar desde cero. La red preentrenada ya ha aprendido un conjunto rico de características que pueden adaptarse a nuevas tareas de clasificación.