Cómo ejecutar los subagentes de Claude Code con otro modelo: configuración y mediciones al delegar en Sonnet o Haiku
¿Se puede dejar la sesión principal de Claude Code en Opus 5 y encargar solo trabajos como traducir o revisar en gran cantidad a subagentes con Sonnet o Haiku? Sí. El modelo de un subagente se decide en este orden: el modelo indicado al invocarlo, model en el archivo de definición, la variable de entorno CLAUDE_CODE_SUBAGENT_MODEL y, por último, el modelo de la sesión principal; el esfuerzo (effort) también se puede fijar para cada subagente. A partir de la documentación oficial a 15 de septiembre de 2026, este artículo explica cómo cambia ese orden según la versión, CLAUDE_CODE_SUBAGENT_MODEL_FORCE para fijar todos los subagentes en un único modelo, a qué modelo apuntan los alias según el proveedor y que, desde la v2.1.198, el Explore integrado hereda el modelo de la sesión principal. Después muestra lo que pasó al lanzar subagentes con otros modelos y comprobarlo en los registros de conversación: se ejecutaron con el modelo indicado, cada uno lee decenas de miles de tokens solo por arrancar, la caché de los subagentes caduca a los 5 minutos incluso con suscripción, y la misma traducción encargada a Opus 5, Sonnet 5 y Haiku 4.5, dos veces a cada uno, difirió en tiempo, coste y calidad. Por último, resume cómo afecta al coste y a los límites de uso, y qué criterios seguir para decidir qué trabajo bajar a un modelo más barato.