Mavits IT Solutions

Projetos

Nossa Plataforma Privada de IA

Cliente
Mavits IT Solutions
Setor
Infraestrutura de IA
Ano
2026
Serviços
Engenharia de Plataformas de IA e LLMs

O desafio

Qualquer um pode recomendar IA privada. Poucos podem mostrar a sua. Antes de oferecer plataformas privadas de LLM a clientes, nos demos o mesmo briefing que um cliente nos daria: rodar modelos de linguagem capazes em hardware próprio, com disciplina de produção de verdade — não um laboratório que cai quando ninguém está olhando. Se não conseguíssemos operar nossa própria plataforma nesse padrão, não teríamos o direito de construir uma para mais ninguém.

O que construímos

Nossa plataforma é um cluster NVIDIA DGX Spark com 4 nós de GPU rodando Kubernetes (RKE2). Tudo acima do hardware é projetado do mesmo jeito que construímos para clientes:

  • Deploys via GitOps. Toda carga de trabalho é declarada no Git e reconciliada com o cluster automaticamente pelo Argo CD. Não existe “alguém mudou algo em um servidor” — o repositório é o registro, e qualquer desvio se corrige sozinho.
  • Observabilidade. Métricas, logs e dashboards cobrindo nós, GPUs e cargas de trabalho, para que perguntas operacionais sejam respondidas com dados, e não com palpites.
  • Cargas multi-tenant. Ambientes isolados por tenant permitem que experimentos, serviços voltados a clientes e ferramentas internas compartilhem o hardware sem atropelar uns aos outros.

Sobre essa fundação fizemos o trabalho de modelo em si: construímos, quantizamos e hoje servimos nossa própria linhagem Mixture-of-Experts — o Vinicius-35B-A3B-v1 — com vLLM, dentro da nossa própria rede, com controle de acesso no endpoint de serving. Infraestrutura, plataforma e modelo: um só time, de ponta a ponta.

O resultado

O cluster roda cargas de produção todos os dias e funciona também como a arquitetura de referência do que entregamos: a mesma fundação Kubernetes, a mesma disciplina de GitOps, a mesma stack de observabilidade. Quando dimensionamos uma plataforma privada de IA para um cliente, estamos descrevendo hardware e software que já operamos — incluindo a construção e o serving de modelos sob medida. Não vendemos IA privada em slides. Nossa própria plataforma é a nossa prova.

Resultados

cluster de GPUs NVIDIA DGX Spark em produção
4 nós
nosso próprio modelo MoE — construído, quantizado e servido internamente
Vinicius-35B-A3B-v1
todo deploy declarado no Git e reconciliado automaticamente
GitOps

Pronto para falar de um projeto?

Conte o que você quer construir. Respondemos rápido com um próximo passo claro — sem apresentação de vendas.

Agende uma conversa