Arquitetura

Arquitetura modular, sem lock-in.

O LARI estende Microsoft.Extensions.AI para operar agentes como componentes de aplicação. Cada módulo pode ser adotado conforme a necessidade: rodando standalone dentro da aplicação, como serviço independente ou em uma plataforma SaaS escalável.

Contracts & Domain

Lari.AI.Core com contratos estáveis, entidades de execução, eventos e interfaces provider-agnostic.

Runtime

Lari.AI.Runtime com loop de execução limitado, ferramentas, delegação, políticas de aprovação e orçamento.

Adapters

Providers, persistência, vetores, grafos, documentos e integrações externas (OpenRouter, Z.AI, Google, AWS, MongoDB, Redis, Qdrant, Neo4j).

Hosting

Lari.AI.Api e Lari.AI.Extensions.Web para API ASP.NET Core, SignalR, autenticação e composição de serviços.

Applications

Aplicações finais como webchat/admin e sites comerciais, consumindo apenas os módulos necessários.

Governança transversal

Segurança, observabilidade e políticas de execução cruzando todas as camadas sem acoplamento indevido.

Stack de referência (estado atual)

Para produção, o caminho recomendado segue os adapters e pacotes já ativos no repositório oficial.

  • Runtime.NET 10 LTS em containers Linux
  • APIASP.NET Core + SignalR
  • OrquestraçãoKubernetes (EKS, GKE, AKS) com HPA
  • PersistênciaMongoDB (durável)
  • Coordenação/EventosRedis (event bus, lock, sessão)
  • VetoresQdrant (RAG e memória durável)
  • GrafosNeo4j (padrão para RAG gráfico e memória)
  • ObservabilidadeOpenTelemetry + Jaeger + Prometheus + Grafana
  • SecretsAWS Secrets Manager, GCP Secret Manager ou Vault

Fluxo lógico da plataforma

Client (site/chat/admin)
API & Hosting (ASP.NET Core + SignalR)
Runtime (execução, ferramentas, políticas)
Providers e integrações (LLMs, MCP, APIs)
Stores (MongoDB, Redis, Qdrant, Neo4j)

Cada camada é substituível: trocar provider, vetor ou store não exige reescrever a modelagem principal de agentes.

Modularidade e escala conforme o uso

Escale os módulos, não a complexidade.

O mesmo núcleo pode começar dentro de um processo e evoluir para workers, APIs e serviços independentes. Você escolhe somente os módulos necessários e aumenta a capacidade de cada um sem reescrever os contratos de domínio.

Standalone

Core + Runtime embutidos na aplicação, sem depender de uma plataforma central.

Modular

Providers, stores, API, workers e governança podem ser trocados ou escalados separadamente.

Evolutivo

O caminho vai de self-hosted a SaaS compartilhado ou cloud dedicado sem lock-in arquitetural.

Desenhos de infraestrutura

Três formas de compor o LARI.

As opções abaixo são caminhos de implantação, não produtos diferentes. Os mesmos contratos permitem mudar o desenho conforme volume, isolamento e custo.

Entrada mais rápida

SaaS compartilhado

Control plane, runtime e stores gerenciados em ambiente multi-tenant, com escala automática por demanda.

Edge / API
Runtime compartilhado
Stores gerenciados
LLM providers
  • Menor esforço operacional
  • Ideal para Starter e Pro
  • Escala horizontal por módulo
Mais isolamento

Cloud dedicado

Componentes dedicados em VPC/private network, com capacidade reservada, políticas próprias e observabilidade completa.

Private network
API + workers
DB / vector / queue / graph
Providers privados
  • Isolamento por cliente
  • SLA e residência de dados
  • Escala independente de API, workers e stores
Controle total

Standalone / self-hosted

Core e Runtime embutidos na aplicação, usando os providers e stores escolhidos pelo próprio time.

Sua aplicação
Core + Runtime
Stores próprios (Neo4j)
BYOK / providers
  • Sem control plane obrigatório
  • Docker, Kubernetes ou processo local
  • Ideal para OSS e ambientes regulados