Inicio / Qué es un modelo de lenguaje, sin jerga
Una familia de modelos, una elección entre velocidad y profundidad
Los modelos de una misma familia comparten el mismo entrenamiento base y solo se diferencian realmente por el equilibrio entre la velocidad de la respuesta y la profundidad del razonamiento aplicado antes de responder.
Claude existe en cuatro modelos distintos en el momento de escribir estas líneas, Fable 5.1, Opus 5, Sonnet 5 y Haiku 4.5. Los cuatro salen del mismo entrenamiento base y se diferencian sobre todo por un único ajuste, el equilibrio entre la velocidad de la respuesta y la profundidad del razonamiento aplicado antes de responder.
Una base común, un control diferente
Elegir un modelo equivale a desplazar un control, no a cambiar de herramienta. En un extremo, un modelo responde en unos segundos y sirve para tareas cortas y repetidas, un acuse de recibo, una reformulación, una clasificación de mensajes. En el otro extremo, un modelo tarda más tiempo porque encadena más pasos de razonamiento antes de concluir, algo que importa para un expediente que hay que contrastar o un plan que hay que verificar en varios puntos. La documentación publicada por Anthropic recomienda empezar por Opus 5 para la mayoría de los usos, y reservar Fable 5.1 para las tareas que exigen un razonamiento exigente o que se extienden en numerosos pasos encadenados.
Un ejemplo concreto ayuda a sentir la diferencia. Aquí tienes dos peticiones que un mismo voluntario podría plantear el mismo día.
Petición corta: reformula este mensaje de bienvenida en tres frases más cálidas.
Petición larga: compara los doce presupuestos recibidos este trimestre, señala las
diferencias de precio más marcadas y propón una clasificación argumentada.
La primera tarea se resuelve en unos segundos con un modelo rápido. La segunda gana si se confía a un modelo que se toma el tiempo de contrastar las cifras antes de concluir.
La tarifa sigue el mismo equilibrio
El precio facturado por cada millón de palabras intercambiadas varía fuertemente de un modelo a otro, y esta variación sigue exactamente el mismo eje que la velocidad, el modelo más profundo cuesta más caro, el más rápido cuesta menos. La figura de abajo recoge estas cuatro tarifas tal como se publicaron, con su fuente y su fecha, en lugar de copiarlas aquí donde quedarían obsoletas sin que nadie lo notara.
Recordar los nombres exactos importa menos que recordar el principio: un modelo más profundo no es un modelo que responda mejor a todas las peticiones, es un modelo que responde mejor a las que necesitan varios pasos de razonamiento. La elección del modelo, tratada aquí, actúa sobre una primera palanca. La lección siguiente muestra una segunda, independiente de esta: el orden de las palabras dentro de un mismo mensaje.
La tarifa de entrada por millón de palabras intercambiadas, por modelo
La tarifa de entrada de los cuatro modelos, comparada
Una voluntaria de una asociación configura su asistente conversacional con el modelo más rápido de la gama para preparar, en unos segundos cada una, las respuestas cortas enviadas cada mañana a las solicitudes de afiliación recibidas por el correo de la asociación.
Escribe en una frase lo que esta situación establece, y en una frase lo que no establece.
Lo que esto establece: Esta elección asocia una tarea de respuestas cortas y repetidas con el modelo que la familia presenta como el más rápido, lo que corresponde al uso para el cual se recomienda este nivel de modelo.
Lo que esto no establece: Esto no establece que ese mismo modelo sirva para una tarea que requiera un razonamiento largo o varios pasos encadenados, un uso para el que se recomienda un modelo más profundo de la misma familia.
Los tres calibrados falsos más frecuentes
- Demasiado amplio El modelo más rápido de la gama sirve igual de bien para tareas que requieren varios pasos de razonamiento complejo.
- Demasiado estrecho Esta elección no permite afirmar nada en absoluto, ya que un solo caso de uso nunca basta para confirmar que un modelo se ajusta a su descripción pública.
- Fuera de lugar Esta elección garantiza que los costes de uso del correo de la asociación se mantendrán bajos este mes.
- Los cuatro modelos Claude actuales comparten el mismo entrenamiento base y solo se diferencian realmente por un equilibrio entre velocidad de respuesta y profundidad de razonamiento.
- Un modelo más profundo no trata mejor una tarea corta, simplemente tarda más en volver sobre una pregunta que no lo necesitaba.
- La documentación publicada por Anthropic recomienda empezar por Opus 5 para la mayoría de las tareas y reservar el modelo más profundo para los razonamientos largos.
- La tarifa facturada por millón de palabras intercambiadas sigue el mismo eje que la velocidad, y queda obsoleta rápido, lo que justifica comprobarla en la figura fechada en lugar de memorizar una cifra.
Anota en una hoja tres tareas que confías regularmente a tu asistente, y después clasifica cada una bajo velocidad o bajo profundidad apoyándote en la descripción pública de cada modelo antes de cambiar tus ajustes.
Estos puntos dependen de una interfaz o de una regla que puede haber cambiado desde la redacción. Verifícalos en tu propia pantalla antes de fiarte de ellos.
- La tarifa exacta y los nombres de los modelos pueden cambiar, abre la página Resumen de los modelos citada en referencia para ver la versión vigente en el momento de tu lectura.
Cada afirmación datable de esta lección remite aquí al texto público que la respalda. Una fuente que no se abre no prueba nada.
- Resumen de los modelos consultée le 2026-09-02
- Precios consultée le 2026-09-02