Pilar 2: Delegación estratégica — el modelo correcto para cada tarea de IA

Search for a command to run...

No comments yet. Be the first to comment.
Línea de apertura (opcional, para el feed): En cada sesión nueva, Claude abre el README, escanea el árbol de directorios, busca el pom.xml, encuentra src/main/java... 33 tool calls para orientarse. Co

Línea de apertura (opcional, para el feed): Llevas tres meses usando Claude en tu proyecto Java. Los mismos errores de hace tres meses siguen apareciendo. == para comparar BigDecimal. LocalDate.now()

Línea de apertura (opcional, para el feed): Tu equipo hizo commit directo a main porque "era un cambio pequeño". Dos horas después, toda la rama de producción estaba rota, tres desarrolladores bloquea

Línea de apertura (opcional, para el feed): Llevas seis meses usando Claude para tus decisiones de arquitectura Java. Eres más rápido. Pero ya no sabes si elegirías Spring Security + JWT o Keycloak si

Línea de apertura (opcional, para el feed): Claude generó el controlador REST en 20 segundos. Pasó code review. Llegó a producción. Dos días después, el campo monto devolvía la ciudad del cliente. Aqu

"Usas el mismo modelo de Claude para todo y pagas hasta 10× de más. Aquí está el mapa de cuatro niveles que cambia la factura sin cambiar la calidad."
Anthropic publica cuatro niveles de modelo con precios muy distintos (valores de input, julio 2026):
| Modelo | Costo input | Para qué |
|---|---|---|
| Haiku 4.5 | $1.00 / MTok | Seguir patrones, tests, docs, CRUD repetitivo |
| Sonnet 5 | $3.00 / MTok | Features nuevas, debugging complejo, integración |
| Opus 5 | $5.00 / MTok | Arquitectura, algoritmos novedosos, decisiones críticas |
| Fable 5 | $10.00 / MTok | Agentes autónomos, razonamiento largo, workflows multi-paso |
La diferencia entre Haiku 4.5 y Fable 5 es de 10×. Entre Haiku 4.5 y Opus 5, 5×. La mayoría de los equipos manda todo a Sonnet sin pensar. Eso equivale a usar un camión de mudanzas para llevar una carta al correo: funciona, pero pagas gasolina de camión por un sobre.
El insight que cambia la ecuación: en tareas de seguir patrones —el 60–70% de lo que hace un equipo de software— Haiku 4.5 es tan bueno como Opus 5. El modelo no importa cuando el patrón está claro.
No todas las tareas tienen la misma complejidad. Esta taxonomía cubre el 99% de los casos:
Pregunta clave: ¿Ya existe un ejemplo claro en el proyecto?
Son las tareas de seguir un patrón establecido: el test número 15 con el mismo estilo que los otros 14, otro endpoint CRUD igual al de Cliente o Producto, un parser más con la misma estructura, documentación con el mismo formato.
"Si estás copiando un patrón, no necesitas el modelo más inteligente. Necesitas el más barato y rápido… con buen contexto."
Pregunta clave: ¿Hay que pensar, inventar o depurar algo nuevo?
Features que no existen aún, bugs raros (race conditions, integraciones), el primer ejemplar de un patrón nuevo, refactors que requieren criterio. Sonnet 5 es el motor del día a día de ingeniería real.
Pregunta clave: ¿Se rompe el sistema si esto sale mal?
Diseño de arquitectura, algoritmos novedosos, decisiones de seguridad crítica, refactors de alto riesgo. Opus 5 es cirugía: preciso, caro, para cuando el diagnóstico lo justifica.
Pregunta clave: ¿Requiere razonamiento sostenido en decenas de pasos, o es un agente autónomo?
Agentes que navegan codebases completos, análisis de arquitectura que correlaciona 50+ archivos, orquestación de workflows sin intervención humana. Fable 5 es el nuevo techo del ecosistema Claude: a $10/MTok, se reserva para cuando el problema realmente lo exige.
El patrón más potente del Pilar Delegación combina dos niveles:
Sonnet 5 construye la primera implementación con todos los edge cases resueltos y los tests en verde.
Haiku 4.5 replica las N−1 instancias restantes siguiendo ese template.
El resultado: misma calidad, fracción del costo.
Imagina un proyecto pedidos-api en Spring Boot 2 que necesita migrar a Spring Boot 3. Doce controladores REST necesitan la misma transformación: namespace javax.* → jakarta.*, anotaciones Swagger 2 (@ApiOperation, @ApiParam) → OpenAPI 3 (@Operation, @Parameter), y tests MockMvc con los nuevos patrones.
El flujo con el patrón template:
Sonnet 5 migra PedidoController — el más complejo — con todos los edge cases resueltos y los tests en verde. Ese archivo es la receta.
Haiku 4.5 migra los 11 controladores restantes siguiendo el mismo patrón.
| Enfoque | Costo estimado |
|---|---|
| Ingenuo — todo Sonnet 5 | $6.00 (12 × $0.50) |
| Patrón template (Sonnet + Haiku) | ~$2.26 (1 × $0.50 + 11 × $0.16) |
| Ingenuo — todo Fable 5 | ~$20.00 (12 × $1.67) |
| Patrón template vs Fable 5 | ~$3.43 (1 × $1.67 + 11 × $0.16) |
→ ~62% de ahorro vs todo Sonnet 5 · ~83% de ahorro vs todo Fable 5
Y esto no es un caso extremo. Cualquier migración masiva tiene este patrón: la lógica de transformación es idéntica en todos los controladores, solo cambian los detalles de cada uno. El primer ejemplar resuelve el problema; los demás son ejecución de receta.
Multiplica eso por 300+ tests, 50+ exporters o una migración de 80 endpoints de API, y el ahorro se compone rápido.
Antes de abrir el chat con Claude, hazte estas preguntas en orden:
¿Es un agente autónomo o requiere razonamiento sostenido en decenas de pasos? → SÍ: Fable 5
¿Es una decisión arquitectónica crítica o un algoritmo novedoso? → SÍ: Opus 5
¿Requiere razonamiento complejo o resolver un problema único? → SÍ: Sonnet 5
¿Está siguiendo un patrón ya establecido en el codebase? → SÍ: Haiku 4.5
¿Ninguna? → Sonnet 5 (es un patrón nuevo que aún no existe en el codebase)
Tres ejemplos rápidos para calibrar:
"Escribe el endpoint CRUD de Factura igual al de Pedido" → Haiku 4.5
"Hay un deadlock intermitente en el checkout" → Sonnet 5
"Diseña cómo vamos a versionar la API pública" → Opus 5
"Construye un agente que audite todo el codebase y proponga refactors" → Fable 5
Haiku 4.5 barato y rápido suena bien. El problema es que sin contexto, Haiku genera código genérico: no sigue tus patrones, usa la arquitectura equivocada, comete errores que Sonnet no cometería.
Con un CLAUDE.md sólido y skills del proyecto, Haiku 4.5 sigue patrones documentados con precisión, usa la arquitectura correcta y evita los anti-patrones conocidos. El contexto convierte a Haiku en un junior fiable. Sin ese contexto, es un junior que adivina.
La cadena de dependencia es directa:
Pilar 1: CLAUDE.md + skills → ADN del codebase
→ Haiku 4.5 tiene el contexto para ser fiable
→ Pilar 2: delegación estratégica funciona
Antes de terminar de leer este artículo, piensa en las últimas 10 cosas que le pediste a Claude:
¿Cuántas eran seguir un patrón existente (Nivel 1)?
¿Cuántas realmente necesitaban razonamiento de Nivel 3 o 4?
¿Qué modelo usaste para cada una?
¿Cuál habría sido el costo con el modelo correcto?
La mayoría de los equipos descubre que entre el 60 y el 70% de sus tareas cae en Nivel 1. El endpoint CRUD número 14. El doc de API número 5. El test que sigue exactamente el mismo patrón que los otros 20. Territorio Haiku 4.5.
Ya sabes qué modelo usar para cada tarea. La pregunta siguiente es: ¿cómo verificas que lo que generó está bien?
Eso es el Pilar 3 — Confía, pero verifica: los patrones de validación que hacen que la delegación sea segura, no un salto de fe.
¿Usas Claude en tu equipo de desarrollo? ¿Qué distribución de modelos tienes hoy? Cuéntame en los comentarios o escríbeme directamente.
Enjoy!
Joe