Ir al contenido
Mastering Claude

Inicio / Qué es un modelo de lenguaje, sin jerga

Qué es un modelo de lenguaje, sin jerga6 minFondation

Predecir la palabra siguiente, nada más

Un modelo de lenguaje solo hace una cosa: predecir el fragmento de texto más probable a continuación de lo que ya ha leído, y una respuesta inventada sale del mismo cálculo que una respuesta exacta, sin que ninguna señal interna las distinga la una de la otra.

Claude no sabe la respuesta a una pregunta: calcula qué fragmento de texto tiene más probabilidades de seguir al que acaba de leer. Esta frase basta para describir el mecanismo entero. Lee el texto recibido, estima una probabilidad para cada fragmento susceptible de venir a continuación, retiene uno, y después repite el mismo cálculo con ese fragmento añadido al texto. No ocurre nada más en su interior.

Por qué una respuesta falsa se parece a una respuesta verdadera

Este mecanismo explica un fenómeno que el centro de ayuda de Claude reconoce como una limitación conocida del producto: Claude puede producir información inventada y mostrar citas que parecen tener autoridad sin estar ancladas en un hecho real. La razón está en el cálculo mismo. Un fragmento plausible y un fragmento exacto son, para ese cálculo, dos candidatos de la misma naturaleza: nada en el proceso reserva un trato particular a la información verificada. Un número de teléfono inventado y un número real se escriben con la misma sintaxis, por lo tanto con una probabilidad comparable a ojos del modelo.

Lo que esto cambia en la forma de leer una respuesta

Una respuesta fluida y bien formulada no es, por tanto, una señal de exactitud: la fluidez viene del mismo cálculo que el eventual error. Un ejemplo hace este punto concreto.

Pregunta: ¿cuál es el número de teléfono del servicio de atención al cliente?
Respuesta: Puedes contactarlos en el 01 42 00 00 00, de lunes a viernes.

Nada en la forma de esta respuesta dice si ese número proviene de una fuente real o de un fragmento plausible producido por el mismo cálculo que el resto de la frase. Verificar este tipo de información por un canal independiente permite zanjar la cuestión; la confianza que inspira la formulación no basta como prueba.

La palabra siguiente, no el razonamiento

Esta descripción también vale para las respuestas largas y los razonamientos detallados: cada paso es a su vez un fragmento predicho a partir de lo que precede, incluyendo a partir de los pasos que el modelo acaba de escribir. Un razonamiento que se encadena bien no es, por tanto, una garantía de exactitud en cada paso, es un encadenamiento de fragmentos plausibles unos respecto a otros. La lección siguiente sobre el token y la ventana precisa lo que el modelo ve realmente para producir cada uno de estos fragmentos.

Figure 1

El bucle de predicción, y su salida hacia una respuesta plausible pero falsa

01
Leer el texto
El modelo lee la totalidad del texto recibido hasta ahora, incluyendo la pregunta y los intercambios anteriores.
02
Estimar las probabilidades
Para cada fragmento susceptible de seguir a este texto, el modelo estima una probabilidad, sin acceder a una base de hechos verificados separada.
03
Elegir un fragmento
El modelo retiene un fragmento entre los más probables y lo añade al texto en curso.
04
Recomenzar
El fragmento elegido pasa a formar parte del texto leído, y el ciclo se reinicia para producir el fragmento siguiente.
05
Fragmento plausible pero falso
Nada en este ciclo reserva un trato particular a un fragmento exacto, lo que a veces produce una respuesta segura y sin embargo falsa.
El esquema muestra el ciclo que Claude ejecuta para producir cada fragmento de texto, y la salida posible hacia un fragmento plausible pero falso, producido por el mismo mecanismo que el resto de la respuesta.
Calíbralo tú mismo

Un usuario pide a Claude el número de teléfono del servicio de atención al cliente de una empresa. Claude responde con un número escrito en el mismo estilo seguro que el resto de su respuesta.

Escribe en una frase lo que esta situación establece, y en una frase lo que no establece.

Lo que hay que recordar
  • Claude produce el fragmento de texto más probable a continuación de lo que ya ha leído, sin consultar una base de hechos separada que validara la respuesta.
  • Una información inventada y una respuesta exacta salen del mismo cálculo de probabilidad, lo que explica que una respuesta falsa pueda parecer tan segura como una respuesta verdadera.
  • El centro de ayuda de Claude reconoce la información inventada y las citas no ancladas como limitaciones conocidas del producto, no como accidentes aislados.
  • Un razonamiento que se encadena bien no es una prueba de exactitud en cada paso, ya que cada paso es a su vez un fragmento predicho.
Hazlo ahora

Abre una conversación con Claude, plantea una pregunta factual precisa cuya respuesta exacta ya conoces, y después escribe en una frase, con tus propias palabras, lo que Claude realmente hizo para producir su respuesta.

Verificar en la fuente

Cada afirmación datable de esta lección remite aquí al texto público que la respalda. Una fuente que no se abre no prueba nada.