Ponte en Contacto
 Duración 21 horas

Temario del curso

Fundamentos de la Clasificación de Audio

  • Tipos de eventos sonoros: ambientales, mecánicos, generados por humanos.
  • Vista general de casos de uso: vigilancia, monitoreo, automatización.
  • Clasificación vs detección vs segmentación de audio.

Datos de Audio y Extracción de Características

  • Tipos de archivos y formatos de audio.
  • Consideraciones sobre frecuencia de muestreo, enventanado y tamaño de cuadro.
  • Extracción de MFCC, características de cromatografía y mel-espectrogramas.

Preparación y Anotación de Datos

  • Conjuntos de datos UrbanSound8K, ESC-50 y personalizados.
  • Etiquetado de eventos sonoros y límites temporales.
  • Balanceo de conjuntos de datos y aumento de audio.

Construcción de Modelos de Clasificación de Audio

  • Uso de redes neuronales convolucionales (CNN) para audio.
  • Entrada del modelo: forma de onda cruda vs características extraídas.
  • Funciones de pérdida, métricas de evaluación y sobreajuste.

Detección de Eventos y Localización Temporal

  • Estrategias de detección basadas en cuadros y segmentos.
  • Post-procesamiento de detecciones mediante umbrales y suavizado.
  • Visualización de predicciones en líneas de tiempo de audio.

Temas Avanzados y Procesamiento en Tiempo Real

  • Aprendizaje por transferencia para escenarios con pocos datos.
  • Implementación de modelos con TensorFlow Lite o ONNX.
  • Procesamiento de audio en flujo continuo y consideraciones de latencia.

Desarrollo de Proyectos y Escenarios de Aplicación

  • Diseño de una tubería completa: desde la ingesta hasta la clasificación.
  • Desarrollo de un concepto de demostración para vigilancia, control de calidad o monitoreo.
  • Registro de eventos, alertas e integración con paneles de control o API.

Resumen y Próximos Pasos

Requerimientos

  • Comprensión de los conceptos de aprendizaje automático y el entrenamiento de modelos.
  • Experiencia en programación con Python y preprocesamiento de datos.
  • Conocimiento de los fundamentos del audio digital.

Audiencia

  • Científicos de datos.
  • Ingenieros de aprendizaje automático.
  • Investigadores y desarrolladores en procesamiento de señales de audio.

Número de participantes


Precio por participante

Próximos cursos

Categorías Relacionadas