Claude Opus, Sonnet y Haiku: qué modelo usar en cada caso

Los tres modelos de Claude no son bueno, mejor y el mejor: son tres herramientas para tres trabajos. Cuál usar en cada caso, cuándo importa elegir y cuándo no, y cómo afecta el costo.

Opus, Sonnet, Haiku. Los nombres suenan a menú de degustación, y la mayoría los lee como "bueno, mejor y el mejor". Esa lectura, además de incorrecta, sale cara.

Los tres modelos de Claude son tres herramientas para tres trabajos distintos. Elegir siempre el más potente es como contratar un cirujano para poner curitas: carísimo y sin mejora en el resultado. Elegir siempre el más barato es lo contrario y peor.

Esta guía es el criterio de elección, con la aclaración clave de cuándo la elección importa y cuándo podés ignorarla feliz.

LOS TRES MODELOS Opus, Sonnet, Haiku OpusEl más capaz. Razonamientocomplejo, tareas críticas.SonnetEl equilibrio. Redacción,análisis, programación diaria.HaikuRápido y económico. Volumen detareas simples.

Los tres, en una tabla

Modelo

Perfil

El trabajo típico

Opus

El más capaz

Razonamiento complejo, tareas largas y críticas, los problemas donde el error es caro

Sonnet

El equilibrio

El trabajo diario: redactar, analizar, responder, programar. El caballo de batalla

Haiku

El rápido y económico

Volumen alto de tareas simples: clasificar, extraer, filtrar, rutear

Los nombres designan el rol, no la versión: las generaciones se renuevan (la familia actual es Claude 5, con Haiku 4.5 como el liviano vigente), pero Opus sigue siendo el potente, Sonnet el equilibrio y Haiku el ligero. Eso hace que el criterio de esta guía sobreviva a los lanzamientos.

La primera pregunta: ¿te importa siquiera elegir?

Respuesta corta que ahorra ansiedad: si usás Claude por la aplicación, casi nunca.

La app tiende a resolver la elección sola, y para el usuario de chat, Cowork y proyectos, el modelo es un detalle transparente: pedís el trabajo, sale el trabajo. Preocuparse por el modelo en ese contexto es optimización prematura.

La elección se vuelve una decisión real en dos escenarios:

  1. La API, donde cada modelo tiene su tarifa por millón de tokens y la diferencia entre niveles es grande. Acá el modelo por tarea es la principal palanca de costo, como contamos en la guía de la API de Claude.
  2. El uso intensivo de agentes, donde el modelo define cuánto límite de uso consume cada sesión y cuán lejos llega en tareas largas.

Si no estás en ninguno de los dos, podés dejar de leer acá con la conciencia tranquila. Si estás, sigamos.

El criterio de elección, tarea por tarea

La regla general primero: el mejor modelo es el más barato que resuelve tu tarea con calidad verificada. Se empieza abajo y se sube solo si el resultado lo pide.

Cuándo Haiku

Cuando la tarea es simple, el volumen es alto y el criterio necesario es poco: clasificar mails o tickets, extraer campos de documentos con formato conocido, filtrar y rutear, generar variantes cortas. En estos trabajos, la diferencia de calidad contra los modelos grandes es mínima y la diferencia de costo es enorme. El error más común de los proyectos de API es no usar Haiku donde Haiku alcanza.

Cuándo Sonnet

Casi siempre que haya redacción, análisis o código de todos los días. Es el punto donde capacidad, velocidad y costo se encuentran, y la razón por la que es el modelo por defecto del trabajo real. Si dudás entre dos niveles, la apuesta estadísticamente correcta es Sonnet.

Cuándo Opus

Cuando el problema es genuinamente difícil o el error es genuinamente caro: razonamiento de varios pasos donde los intermedios importan, tareas largas de agente que tienen que sostener coherencia, análisis críticos donde pagarías por el mejor juicio disponible. La pregunta de control: ¿este trabajo se lo darías al socio más senior o alcanza con alguien muy bueno? Opus es el socio senior: para algunas cosas es la única opción sensata, y para el resto es un lujo.

CÓMO ESCALONAR Flujo de documentos por nivel 01Haiku clasifica1000 documentos02Sonnet analiza50 complejos03Opus juzga3 críticos

El patrón que optimiza de verdad: escalonar

Los proyectos maduros no eligen un modelo: encadenan varios.

El ejemplo clásico de procesamiento de documentos: Haiku lee y clasifica los mil documentos (barato, rápido), deriva los cincuenta complejos a Sonnet (análisis serio), y los tres críticos terminan en Opus (el mejor juicio). Cada nivel hace lo que le corresponde, y la factura baja varias veces contra el enfoque de "todo con el mejor".

La misma lógica aplica a los límites de uso en suscripción: las sesiones pesadas de agente consumen según el músculo que piden. Trabajo mecánico con el modelo liviano es límite que te sobra al final del mes.

Cómo afecta el costo, en las dos vías

En la suscripción: no pagás por modelo, pagás el plan, y los modelos vienen incluidos con límites de uso según el nivel (los detalles, en precio de Claude 2026). La elección acá impacta en cuánto límite consumís, no en la factura.

En la API: el modelo es la tarifa. Cada nivel tiene su precio por millón de tokens, publicado en la documentación oficial, y la brecha entre Haiku y Opus es de más de un orden de magnitud. Acá elegir bien no es fineza: es el presupuesto.

La práctica de empresa: re-evaluar trimestral

Un hábito que recomendamos y casi nadie tiene: una vez por trimestre, revisar si cada proceso sigue en el modelo correcto.

Los modelos mejoran generación a generación, y la mejora suele habilitar bajar de nivel: la tarea que hace un año necesitaba el modelo grande, hoy quizás la resuelve el mediano igual de bien y a fracción del costo. Las empresas que nunca revisan pagan tarifas de ayer por capacidades de hoy.

La revisión es simple: tomar una muestra de corridas reales, correrlas en el nivel de abajo, comparar contra el resultado verificado. Si empata, se baja. Veinte minutos que se pagan solos.

En resumen

Opus para lo difícil y crítico, Sonnet para el trabajo diario, Haiku para el volumen simple. En la app, dejá que la elección se resuelva sola; en la API y los agentes intensivos, el modelo por tarea es la palanca de costo número uno, y escalonar niveles es el patrón ganador.

Y la meta-regla que ordena todo: verificá con tus casos reales, no con benchmarks ajenos. Tu tarea, tus documentos, tu vara de calidad. Es la única comparativa que importa.

¿Querés que revisemos qué modelo le corresponde a cada proceso de tu operación? Hablemos.

Fuentes

  1. Claude, página oficial
  2. Planes y precios de Claude
  3. Pricing, Claude Platform Docs