~/questoes/inteligencia-artificial
Escalabilidade horizontal significa aumentar a capacidade do sistema adicionando mais máquinas ou instâncias, em vez de apenas melhorar uma única máquina. No N8N com Ollama, isso permite distribuir a carga de trabalho entre múltiplos servidores, garantindo que sua infraestrutura de automação cresça conforme a demanda aumenta.
O N8N, sendo open-source e auto-hospedável, permite executar várias instâncias simultâneas e distribuir os workflows entre diferentes máquinas. Isso é o verdadeiro conceito de escalabilidade horizontal: ao invés de fazer uma única máquina ficar mais poderosa, você adiciona mais máquinas ao sistema para compartilhar a carga de processamento.
Substituir modelos por versões otimizadas é uma estratégia de otimização de software, não de escalabilidade horizontal. Além disso, o N8N não faz isso automaticamente; você controlaria essas atualizações manualmente.
Esta é a definição exata de escalabilidade horizontal: múltiplas instâncias do N8N rodando em paralelo e distribuindo workflows entre máquinas diferentes, permitindo que o sistema cresça horizontalmente sem depender de uma única máquina.
Cache permanente de respostas é uma técnica de otimização de performance, não de escalabilidade. Além disso, nem toda resposta deve ser reutilizada; contextos diferentes podem precisar de respostas diferentes do Ollama.
Limitar requisições é uma estratégia de proteção contra sobrecarga, mas não é escalabilidade horizontal. Na verdade, escalabilidade permite aumentar capacidade para aceitar mais requisições, não reduzi-las.