Video de ejemplo creado con TutorFlow

Cómo funcionan los grandes modelos de lenguaje

Transcripción

Vamos a entender los grandes modelos de lenguaje con imágenes sencillas. Piensa en ellos como sistemas que predicen la siguiente palabra, una y otra vez.

Primero, el modelo lee una cantidad enorme de texto. Ese entrenamiento le ayuda a detectar patrones, como la forma en que las palabras suelen combinarse.

Imagina un autocompletado gigante con una memoria excelente para los patrones. No busca en un diccionario: calcula qué es lo más probable que venga después.

Dentro del modelo hay capas de cálculos que convierten las palabras en números. Esos números le permiten comparar ideas y relacionar significados parecidos.

Cuando escribes un prompt, el modelo se fija en el contexto que lo rodea. Después puntúa muchas palabras candidatas para continuar y elige una.

Repite ese paso, un token tras otro, hasta que la respuesta parece completa. Así que la respuesta no se saca de ningún sitio: se construye palabra a palabra.

En resumen, la idea clave es sencilla: un modelo de lenguaje aprende patrones, usa el contexto y predice el siguiente fragmento de texto. Por eso puede sonar tan sorprendentemente humano.