Ir al contenido
Mastering Claude

Inicio / Qué es un modelo de lenguaje, sin jerga

Qué es un modelo de lenguaje, sin jerga7 minFondation

Una familia de modelos, una elección entre velocidad y profundidad

Los modelos de una misma familia comparten el mismo entrenamiento base y solo se diferencian realmente por el equilibrio entre la velocidad de la respuesta y la profundidad del razonamiento aplicado antes de responder.

Claude existe en cuatro modelos distintos en el momento de escribir estas líneas, Fable 5.1, Opus 5, Sonnet 5 y Haiku 4.5. Los cuatro salen del mismo entrenamiento base y se diferencian sobre todo por un único ajuste, el equilibrio entre la velocidad de la respuesta y la profundidad del razonamiento aplicado antes de responder.

Una base común, un control diferente

Elegir un modelo equivale a desplazar un control, no a cambiar de herramienta. En un extremo, un modelo responde en unos segundos y sirve para tareas cortas y repetidas, un acuse de recibo, una reformulación, una clasificación de mensajes. En el otro extremo, un modelo tarda más tiempo porque encadena más pasos de razonamiento antes de concluir, algo que importa para un expediente que hay que contrastar o un plan que hay que verificar en varios puntos. La documentación publicada por Anthropic recomienda empezar por Opus 5 para la mayoría de los usos, y reservar Fable 5.1 para las tareas que exigen un razonamiento exigente o que se extienden en numerosos pasos encadenados.

Un ejemplo concreto ayuda a sentir la diferencia. Aquí tienes dos peticiones que un mismo voluntario podría plantear el mismo día.

Petición corta: reformula este mensaje de bienvenida en tres frases más cálidas.
Petición larga: compara los doce presupuestos recibidos este trimestre, señala las
diferencias de precio más marcadas y propón una clasificación argumentada.

La primera tarea se resuelve en unos segundos con un modelo rápido. La segunda gana si se confía a un modelo que se toma el tiempo de contrastar las cifras antes de concluir.

La tarifa sigue el mismo equilibrio

El precio facturado por cada millón de palabras intercambiadas varía fuertemente de un modelo a otro, y esta variación sigue exactamente el mismo eje que la velocidad, el modelo más profundo cuesta más caro, el más rápido cuesta menos. La figura de abajo recoge estas cuatro tarifas tal como se publicaron, con su fuente y su fecha, en lugar de copiarlas aquí donde quedarían obsoletas sin que nadie lo notara.

Recordar los nombres exactos importa menos que recordar el principio: un modelo más profundo no es un modelo que responda mejor a todas las peticiones, es un modelo que responde mejor a las que necesitan varios pasos de razonamiento. La elección del modelo, tratada aquí, actúa sobre una primera palanca. La lección siguiente muestra una segunda, independiente de esta: el orden de las palabras dentro de un mismo mensaje.

Figure 1

La tarifa de entrada por millón de palabras intercambiadas, por modelo

10$ / millón, entrada
Fable 5.1, el nivel más profundo, reservado a un razonamiento exigente o a una tarea que se extiende en numerosos pasos
platform.claude.com, aperçu des modèles, 2026-09-02
5$ / millón, entrada
Opus 5, el nivel recomendado por defecto para la mayoría de las tareas habituales
platform.claude.com, aperçu des modèles, 2026-09-02
2$ / millón, entrada
Sonnet 5, presentado como el mejor equilibrio entre velocidad e inteligencia
platform.claude.com, aperçu des modèles, 2026-09-02
1$ / millón, entrada
Haiku 4.5, el nivel más rápido de la familia, para respuestas inmediatas
platform.claude.com, aperçu des modèles, 2026-09-02
El precio facturado por un millón de palabras enviadas varía hasta diez veces según el modelo elegido, una señal concreta del equilibrio entre velocidad y profundidad descrito en el cuerpo.
Figure 2

La tarifa de entrada de los cuatro modelos, comparada

Fable 5.1
10 $ / millón, entrada
Opus 5
5 $ / millón, entrada
Sonnet 5
2 $ / millón, entrada
Haiku 4.5
1 $ / millón, entrada
platform.claude.com, aperçu des modèles, 2026-09-02
Las barras muestran la relación de uno a diez entre el nivel más profundo y el más rápido, allí donde la lista de valores solo permitía deducirla.
Calíbralo tú mismo

Una voluntaria de una asociación configura su asistente conversacional con el modelo más rápido de la gama para preparar, en unos segundos cada una, las respuestas cortas enviadas cada mañana a las solicitudes de afiliación recibidas por el correo de la asociación.

Escribe en una frase lo que esta situación establece, y en una frase lo que no establece.

Lo que hay que recordar
  • Los cuatro modelos Claude actuales comparten el mismo entrenamiento base y solo se diferencian realmente por un equilibrio entre velocidad de respuesta y profundidad de razonamiento.
  • Un modelo más profundo no trata mejor una tarea corta, simplemente tarda más en volver sobre una pregunta que no lo necesitaba.
  • La documentación publicada por Anthropic recomienda empezar por Opus 5 para la mayoría de las tareas y reservar el modelo más profundo para los razonamientos largos.
  • La tarifa facturada por millón de palabras intercambiadas sigue el mismo eje que la velocidad, y queda obsoleta rápido, lo que justifica comprobarla en la figura fechada en lugar de memorizar una cifra.
Hazlo ahora

Anota en una hoja tres tareas que confías regularmente a tu asistente, y después clasifica cada una bajo velocidad o bajo profundidad apoyándote en la descripción pública de cada modelo antes de cambiar tus ajustes.

Lo que queda por verificar

Estos puntos dependen de una interfaz o de una regla que puede haber cambiado desde la redacción. Verifícalos en tu propia pantalla antes de fiarte de ellos.

  • La tarifa exacta y los nombres de los modelos pueden cambiar, abre la página Resumen de los modelos citada en referencia para ver la versión vigente en el momento de tu lectura.
Verificar en la fuente

Cada afirmación datable de esta lección remite aquí al texto público que la respalda. Una fuente que no se abre no prueba nada.