Un cerebro, N clientesUn solo LLM multi-tenant sirve a varios bots a la vez. Cada cliente entra sin re-ingeniería: menos superficie de fallo y un comportamiento que se audita en un solo lugar.
Memoria en Postgres, no en RAMn8n corre en modo cola con varios workers. Con la memoria en el proceso el hilo se perdía; en Postgres es única, aislada por lead y sobrevive a los reinicios.
Sanitización deterministaDespués del LLM, un paso de código limpia el formato y controla el largo. El prompt reduce el desvío del modelo; el código lo cierra.
Control de costos de LLMLímites y medición del disparo real de eventos (no la config declarada). El gasto de API se controla antes de que escale, no después de la factura.
El canal es intercambiableEl mismo cerebro funciona sobre WhatsApp Business, web o Telegram: solo cambian el nodo de entrada y el de salida.