El patrón router: cada petición a su especialista
prácticaEl que recibe en la puerta
Piensa en la recepción de una clínica. La persona de la entrada no atiende tu problema: escucha dos frases y te manda al consultorio que toca. Eso es un router. En vez de una línea recta como la clase pasada, aquí aparece una bifurcación: alguien mira lo que llegó y escoge camino.
Por qué no un solo agente que lo sepa todo
La tentación es escribir un prompt gigante con todas las instrucciones del negocio adentro. Funciona hasta que crece. Ese prompt se paga entero en cada mensaje, aunque el cliente solo pregunte por un cobro doble. Y entre tanta instrucción, el modelo empieza a confundir reglas de un tema con las de otro. Repartir sale más barato y responde más afinado.
El router entrega una nota de confianza
No devuelve solo un destino. Devuelve el destino, el motivo y un número entre cero y uno que dice qué tan seguro está. "Facturación, 0.99, porque menciona un cobro doble en la tarjeta". Ese número es la pieza importante de todo el patrón, y ahora vas a ver por qué.
# lo que devuelve el router, no el agente{ "departamento": "facturación", "confianza": 0.99, "motivo": "cobro doble en la tarjeta" }Cuando no está seguro, te lo pasa a ti
Tú pones el umbral. Si la confianza no llega a 0,70, el mensaje no va a ningún agente: sale un correo, una notificación, y lo atiende una persona. Esa salida es lo que separa un sistema que puedes poner frente a clientes de uno que te va a dar pena. La IA que sabe cuándo no responder vale más que la que responde siempre.
Tres formas de repartir, de más cara a más barata
La primera: que el router sea otra IA que clasifica. Es la más flexible y cobra tokens en cada mensaje. La segunda: comparar por parecido de significado contra ejemplos que ya guardaste, sin llamar a ningún modelo. La tercera, casi gratis: decidir por dónde entró. Si el mensaje viene del formulario de pagos, ya sabes a dónde va. Muchas veces la tercera basta.
# reparte por IA flexible cobra en cada mensaje# reparte por parecido rápido se calcula una vez# reparte por origen casi gratis solo mira de dónde llegóCada especialista puede correr con su propio modelo
Una vez repartido, cada agente es independiente. El de devoluciones, que sigue un procedimiento fijo, corre con el modelo barato. El técnico, que tiene que entender un problema raro, corre con el caro. Antes esa decisión era una sola para todo el sistema. Con router, la tomas por caso.
Tu turno: el chat que reparte solo
El ejemplo trae tres departamentos y cuatro mensajes de prueba. Lo corres y ves el router clasificando en vivo, con su confianza. El mensaje ambiguo del final es el que importa: ese cae por debajo del umbral y sale por la puerta del humano. Cambia el umbral a 0,95 y mira cuántos empiezan a salir por ahí.
# a Claude Code, tal cual:"corre el router del ejemplo con los cuatro mensajes de prueba"# lo que vesmsg 1 facturación 0.99 -> agente de facturaciónmsg 2 técnico 0.91 -> agente técnicomsg 3 devoluciones 0.88 -> agente de devolucionesmsg 4 sin claridad 0.42 -> a una personaEl router reparte, no responde
Quédate con la división. Una pieza decide y otra ejecuta. Esa separación es la que te deja cambiar un especialista sin tocar el resto, agregar un departamento nuevo sin reescribir nada y saber exactamente dónde falló cuando algo salga mal.