Diferencias
Muestra las diferencias entre dos versiones de la página.
| Ambos lados, revisión anterior Revisión previa Próxima revisión | Revisión previa | ||
|
clase:ia:saa:1_introduccion_ia:ml [2021/07/08 10:10] cesguiro |
— (actual) | ||
|---|---|---|---|
| Línea 1: | Línea 1: | ||
| - | ====== 4 - Aprendizaje automático (machine learning) ====== | ||
| - | |||
| - | Hoy en día, el machine learning se utiliza en multitud de aplicaciones que utilizamos cada día, como un sistema de recomendaciones, | ||
| - | |||
| - | Dentro de los tipos de machine learning, uno de lo más populares hoy en día (y que es en parte responsable del auge de la IA) son las redes neuronales (Neural Nets) y el aprendizaje profundo (Deep Learning). | ||
| - | |||
| - | {{ : | ||
| - | |||
| - | * **Inteligencia artificial (AI)**: Rama de la informática que intenta simular diferentes comportamientos humanos por parte de las máquinas. | ||
| - | |||
| - | * **Aprendizaje automático (ML)**: Es una parte de la inteligencia artificial (pero no la única) que permite a las máquinas aprender a partir de los datos sin ser programadas. | ||
| - | |||
| - | * **Redes neuronales (NN)**: Uno de los tipos de aprendizaje automático (hoy en día, uno de los más populares) | ||
| - | |||
| - | * **Aprendizaje profundo (DL)**: | ||
| - | \\ | ||
| - | |||
| - | ===== Tipos de machine learning ===== | ||
| - | |||
| - | ==== Aprendizaje supervisado/ | ||
| - | |||
| - | En el **aprendizaje supervisado**, | ||
| - | |||
| - | {{ : | ||
| - | |||
| - | Por el contrario, en el aprendizaje no supervisado los datos de entrenamiento no incluyen las soluciones (no están etiquetados). El modelo es capaz de aprender de forma totalmente autónoma. | ||
| - | |||
| - | {{ : | ||
| - | |||
| - | Las dos tareas típicas del aprendizaje supervisado son la **regresión** y la **clasificación**. En las tareas de regresión el algoritmo intenta predecir un valor numérico “objetivo” si se da un conjunto de características, | ||
| - | |||
| - | {{ : | ||
| - | |||
| - | En los problemas de clasificación, | ||
| - | |||
| - | {{ : | ||
| - | |||
| - | Puesto que etiquetar datos suele llevar mucho tiempo y supone un gasto importante, a menudo tendremos un montón de instancias sin etiquetar y unas pocas etiquetadas. Algunos algoritmos pueden ocuparse de datos que están etiquetados en parte. Esto se llama **aprendizaje semisupervisado**. | ||
| - | |||
| - | {{ : | ||
| - | |||
| - | El aprendizaje por refuerzo es algo totalmente diferente. En este caso, la máquina aprende recibiendo “recompensas” (o “castigos”) según las acciones que tome. | ||
| - | |||
| - | {{ : | ||
| - | \\ | ||
| - | |||
| - | ==== Aprendizaje por lotes/ | ||
| - | |||
| - | En el **aprendizaje por lotes** el sistema no puede aprender de forma gradual; tiene que entrenarse usando todos los datos disponibles en ese momento. Una vez se entrena el modelo se lanza a producción, | ||
| - | |||
| - | Uno de los problemas con este tipo de aprendizaje es que entrenar un modelo completo puede tardar varias horas, con lo que normalmente se hace cada 24 horas o cada semana. Si necesitamos actualizar el sistema con datos que cambian con rapidez, necesitamos otras soluciones. | ||
| - | |||
| - | En el **aprendizaje online** el sistema es capaz de aprender de forma gradual, ya sea con datos individuales o en grupos pequeños de datos llamados // | ||
| - | |||
| - | {{ : | ||
| - | |||
| - | También se pueden utilizar este tipo de sistemas cuando el volumen de datos para entrenar es enorme. El algoritmo carga parte de los datos, ejecuta un paso de entrenamiento con esos datos y repite el proceso hasta que ha procesado todos los datos. | ||
| - | |||
| - | {{ : | ||
| - | |||
| - | Un parámetro importante en este tipo de sistemas es la **tasa de aprendizaje**: | ||
| - | \\ \\ | ||
| - | |||
| - | ==== Aprendizaje basado en instancias/ | ||
| - | |||
| - | En el **aprendizaje basado en instancias**, | ||
| - | |||
| - | {{ : | ||
| - | |||
| - | Otra forma de generalizar es crear un modelo a partir de un conjunto de ejemplos y, después, utilizarlo para hacer predicciones. Esto se denomina **aprendizaje basado en modelos**. | ||
| - | |||
| - | {{ : | ||
| - | \\ \\ | ||
| - | |||
| - | ===== Principales problemas del machine learning ===== | ||
| - | |||
| - | Ejemplos de problemas con los datos: | ||
| - | |||
| - | * **Cantidad insuficiente de datos de entrenamiento**: | ||
| - | * **Datos de entrenamiento no representativos**: | ||
| - | * **Datos de mala calidad**: Si nuestros datos de entrenamiento están repletos de errores, valores atípicos y ruido, será más difícil que el sistema detecte patrones subyacentes y tendrá menos probabilidad de funcionar bien.\\ \\ | ||
| - | * **Características no relevantes**: | ||
| - | |||
| - | Ejemplo de problemas con los algoritmos: | ||
| - | |||
| - | * **Sobreajustar los datos de entrenamiento**: | ||
| - | * **Subajustar los datos de entrenamiento**: | ||
| - | |||
| - | ===== Probar y validar ===== | ||
| - | |||
| - | Normalmente, | ||
| - | * **Datos de entrenamiento**: | ||
| - | * **Datos de prueba**: Los datos que utilizamos para comprobar si nuestro modelo generaliza bien.\\ | ||
| - | |||
| - | < | ||
| - | |||