← Lumbre

Fundamentos de Machine Learning · 5.º Modelo, parámetros e hipótesis

← Volver a todos los contenidos
Portada de Modelo, parámetros e hipótesis

Modelo, parámetros e hipótesis

✦ Decir el modelo aprende esconde una estructura precisa: hay un espacio de funciones posibles, unos parámetros que se ajustan, y un sesgo inductivo que decide cuáles explorar · Fundamentos de Machine Learning · Machine Learning · en 6 minutos

Roadwise Consulting

Firmado y verificado · Fernando Castro

Objetivo: Entender un modelo como una familia de funciones parametrizadas, y el entrenamiento como la búsqueda de la mejor hipótesis dentro de un espacio acotado.

6 min 18–30 años
Autoevaluación
Más
Modelo, parámetros e hipótesis

Herramientas de la lección

◉ Entrar a La Matrix Sorpréndeme

Sobre este contenido

Ir a

Volver a Objetos Cursos Explorar Mi cuenta Salir del modo estudio

Modelo, parámetros e hipótesis

Machine learning: funciones de pérdida
Vídeo en español sobre la función de pérdida, el criterio que guía la búsqueda de la mejor hipótesis dentro del modelo.

El modelo como familia de funciones

Una regresión lineal no es una recta: es el conjunto de todas las rectas posibles, cada una definida por su pendiente e intercepto. Al elegir ese modelo, elegimos qué familia de funciones podrá salir del entrenamiento —rectas, y no parábolas—, aunque todavía no sepamos cuál.

Parámetros frente a hiperparámetros

Los parámetros los fija el entrenamiento mirando los datos —la pendiente aprendida—. Los hiperparámetros los decide el practicante antes de empezar —el grado del polinomio, la profundidad del árbol—. Los primeros se aprenden; los segundos se eligen, normalmente con validación.

El espacio de hipótesis

La colección de todas las funciones que el modelo puede representar es su espacio de hipótesis. Un modelo lineal tiene un espacio pobre: solo rectas o planos. Una red profunda, un espacio vastísimo. El entrenamiento solo podrá encontrar la verdad si esta vive dentro de ese espacio.

Una nube de puntos de datos atravesada por muchas curvas candidatas tenues y una única curva resaltada en color coral que ajusta mejor.
El espacio de hipótesis: el modelo admite muchas funciones candidatas y el entrenamiento elige una. Si la verdadera forma no está entre las candidatas, ningún ajuste la encontrará.

Entrenar es buscar

El aprendizaje es una búsqueda y selección dentro del espacio de hipótesis: probar parámetros, medir cuán mal quedan y moverse hacia los que ajustan mejor. Elegir un modelo es, antes que nada, acotar dónde se va a buscar.

El sesgo inductivo

Ningún aprendizaje ocurre sin suposiciones previas: preferir relaciones suaves, o simples, o periódicas. Ese sesgo inductivo es lo que permite generalizar más allá de los datos vistos. Sin sesgo, todo conjunto finito de puntos es igual de compatible con infinitas reglas: no se aprende nada.

Capacidad expresiva frente a riesgo

Un espacio enorme puede aproximar casi cualquier cosa, incluida el ruido: mucho margen para sobreajustar. Un espacio pequeño generaliza con seguridad pero puede quedarse corto y subajustar. La elección del modelo es un ajuste entre flexibilidad y riesgo.

La forma importa

Si la realidad es una curva y elegimos rectas, ninguna cantidad de datos arreglará un techo de error. El modelo impone una estructura al mundo. Buena parte del oficio es intuir, dominar el problema y traducirla a la familia de funciones adecuada.

Objetivo: una función pérdida

Para buscar hace falta un criterio que diga cuándo una hipótesis es mejor. Ese papel lo juega la función pérdida, que puntúa el error del modelo. Todo el entrenamiento es, en el fondo, minimizar esa pérdida sobre los datos.

Errores frecuentes

  • Creer que más entrenamiento ampliará el espacio de hipótesis: el modelo no puede salir de su familia.
  • Confundir parámetros que se aprenden con hiperparámetros que se eligen.

Ejemplo resuelto: elegir la familia de un modelo

Se quiere predecir la demanda de la semana a partir del histórico. El diseño avanza así:

  1. Observar la forma: la demanda sube y baja cada semana, sugiere periodicidad, no una recta.
  2. Acotar el espacio: elegir una familia capaz de representar ondas, no solo líneas rectas.
  3. Distinguir roles: la pendiente o el peso se aprenden; el grado del modelo se elige.
  4. Fijar la pérdida: definir cómo se puntúa el error para que la búsqueda tenga rumbo.
  5. Entrenar y validar: buscar los parámetros que minimizan la pérdida y comprobar que generaliza.

¿Para qué sirve en la realidad?

Buena parte de los fracasos en proyectos de datos no son de código sino de elección: un modelo demasiado rígido tiene un techo de error que ningún dato arregla. Entender el espacio de hipótesis evita prometer lo imposible y guía hacia la familia adecuada.

El «espacio de hipótesis» de un modelo es:

Los hiperparámetros de un modelo se aprenden automáticamente a partir de los datos.

Sin datos no hay hipótesis que valga

El espacio de hipótesis y el sesgo definen qué se puede aprender; los datos deciden cuál de esas candidatas se elige. Un modelo rico con datos pobres quedará determinado al azar; unos datos abundantes apenas rescatan a un modelo demasiado rígido. Las dos piezas importan.

Modelos

Familia de funciones posibles
modelo
Valor que fija el entrenamiento
parametro
Valor que elige el practicante
hiperparametro
Todas las funciones representables
espacio de hipotesis
Suposición previa que permite generalizar
sesgo inductivo

Toca una tarjeta para ver la respuesta.

Ordena del concepto más general al más específico:

Arrastra cada ficha a su categoría (o tócala y luego toca la categoría). También puedes usar el teclado.

Une cada concepto del modelo con lo que define.

      Qué es un modelo

      • Modelo e hipótesis
        • Familia
          • todas las funciones
            • límites del modelo
            • Ajuste
              • parámetros
                • hiperparámetros
                • Búsqueda
                  • minimizar la pérdida
                    • sesgo inductivo
                    • Riesgo
                      • muy rígido subajusta
                        • muy flexible sobreajusta

                      Sabes que tu fenómeno es periódico, pero eliges un modelo lineal. ¿Qué límite de error te impones aunque acumules miles de datos, y qué familia probarías en su lugar?

                      Tu texto se guarda sólo en este dispositivo.

                      Las respuestas y tu progreso se guardan sólo en este dispositivo. Contenido firmado por su autoría mediante Lumbre.

                      Autoevaluación

                      Comprueba lo que aprendiste

                      2 preguntas · ves cada respuesta al momento · el resultado queda guardado en tu historial

                      Iniciar autoevaluación
                      Más sobre esta lección

                      Rutas vivas

                      ¿Y ahora qué? Elige el camino por lo que necesitas

                      No es un listado al azar: cada camino responde una pregunta distinta y te dice por qué.

                      Otra forma de comprenderlo

                      ✦ Explorar el universo completo
                      Explora temas relacionados

                      Conceptos

                      Comentarios

                      Inicia sesión para comentar.

                      Todavía no hay comentarios. Sé la primera persona en opinar.