AiST.Ai
aist.ai-box / on-prem · 152-FZ

Todo o ecossistema de Ai num perímetro fechado, do rack ao cluster.

Dentro do BOX já funcionam os 5 produtos e 10 serviços da AiST — Platform, Agent, Gateway, assistentes, RAG, analítica, vision, voice. Desembalar → ligar → funcionar. Sem internet: os seus dados nunca saem do perímetro.

  • ◉ 100% on-premise
  • ⛨ 152-FZ · FSTEC
  • ⚡ Arranque em 30 dias
  • ∞ Até 1024 GPU
// o que está lá dentro

Dentro do BOX está todo o ecossistema AiST.
Num perímetro fechado.

Não é preciso comprar módulos adicionais, integrar fornecedores nem expor API. Tudo o que vendemos como serviços SaaS independentes já está instalado no BOX e funciona sem ligação.

AIR-GAPPED · O seu centro de dados
// L4 · Produtos
AiST Ai Platform
AiST Agent
AiST Gateway
AiST API
White Label
// L3 · Serviços & assistentes
RAG Search
Code Assistant
Doc Assistant
HR Bot
Sales Bot
Analytics
Voice / ASR
Vision
Translate
Summarizer
// L2 · Núcleo (LLM, Vector, Orchestrator)
LLM Engine · vLLM · TensorRT-LLM
Vector DB · Embeddings · Reranker
Kubernetes · Filas · MLOps
RBAC · Audit · Observability
// L1 · Hardware (GPU · NVMe · Network)
H100 / H200
EPYC · Xeon
NVMe 480 TB+
400 Gb/s · NVLink
serviços externos ✕ desligados
// escala

Desde um piloto para 50 utilizadores
até um centro de dados para desafios de grande escala.

01 · BOX Mini

Piloto

2Ude rack

Para um departamento ou uma empresa média. Executa RAG, chat e até 3 agentes para 200 colaboradores.

  • · até 50 pedidos/seg
  • · LLM até 14B
  • · 200 utilizadores
02 · BOX Pro

Empresa média

8Ude rack

O ambiente produtivo de uma companhia. Os 10 serviços, até 20 agentes em simultâneo, fine-tuning com os seus dados.

  • · até 500 RPS
  • · LLM até 70B
  • · 5 000 utilizadores
03 · BOX Enterprise

Corporação

1rack completo

Holding ou banco. Georreplicação, multi-inquilino, isolamento de departamentos, SLA de 99.99%.

  • · até 5 000 RPS
  • · LLM até 405B
  • · 100 000 utilizadores
04 · BOX DataCenter

Desafios de grande escala

∞racks

O seu próprio centro de dados, os seus próprios modelos, o seu próprio fine-tuning de LLM fundacionais. Uma fábrica industrial de inferência.

  • · até 1024 GPU
  • · treino de raiz
  • · rollout ilimitado
// porquê o BOX

O que o CIO, o CISO e o CFO obtêm no primeiro trimestre.

O BOX resolve ao mesmo tempo as três grandes preocupações do enterprise: segurança, controlo de custos e velocidade de implementação. Sem nuvem. Sem vendor lock. Sem compromissos.

01 · CIO 30 dias

Produção em vez de projeto

Stack pronto, modelos pré-configurados, cenários tipo. Não um R&D de 18 meses, mas uma plataforma operacional em 2 semanas.

02 · CISO 0 bytes

Nada sai para o exterior

Perímetro air-gapped. Sem chamadas à internet, sem tokens em logs alheios. Certificação FSTEC (regulador russo de segurança da informação), KII (infraestrutura de informação crítica) e 152-FZ — incluídas.

03 · CFO ×7.4

ROI num trimestre

Um único CapEx em vez de um OpEx interminável por tokens. O custo total de propriedade é 60% inferior ao das API na nuvem num horizonte de 24 meses.

// autonomia

Independência total de serviços de Ai externos.

O BOX não é um integrador de API alheias. É um stack de Ai autossuficiente que continua a funcionar mesmo com a desconexão total da internet.

⊘

Modo air-gapped

Não faz um único pedido ao exterior. Todos os modelos, embeddings e tokenizadores estão em local.

⌬

Os seus próprios LLM e embeddings

Modelos open-source e nacionais incluídos. Substituem-se numa hora, sem reescrever as aplicações.

⚙

Orquestração autossuficiente

K8s, filas, vector DB, monitorização — tudo lá dentro. Não depende de Azure, AWS, Yandex nem Google.

⛨

Atualizações sem internet

Os deltas chegam num suporte físico ou por um canal dedicado. Cumpre os requisitos de KII (infraestrutura de informação crítica).

// perímetro AiST BOX
✓ Os seus dados · nunca saem do perímetro
✓ Os seus modelos · funcionam sem internet
✓ A sua auditoria · cada pedido fica registado
↓
✕ API externa · desligada
✕ Nuvem do fornecedor · não se utiliza
✕ Logs de terceiros · nenhum
// infraestrutura

Uma arquitetura sobre a qual se pode assinar um SLA.

O BOX é entregue como uma configuração validada: cada componente está testado em compatibilidade e carga. Documentação completa, esquemas, runbook.

// Compute

GPU
H100 / H200 / A100
CPU
EPYC 9654 · Xeon 8480
RAM
até 4 TB / nó
Interconnect
NVLink · InfiniBand
Pps
até 5 000 RPS

// Storage & Net

NVMe
de 96 TB a 4 PB
Vector DB
até 10B vetores
Network
400 Gb/s · low-lat
Backup
compatível com S3
HA
active-active

// Software

OS
Astra · RHEL · Ubuntu
Orchestrator
K8s 1.30 · vLLM
LLM
14B → 405B
API
compatível com OpenAI
SLA
99.99% / 24×7
// implementação

30 dias desde a assinatura até ao primeiro pedido.

01
dia 1–7

Sessão de arquitetura

Definimos o tamanho do BOX, os cenários e os modelos para os seus dados.

02
dia 8–14

Entrega e montagem

Levamos o hardware ao seu centro de dados, montamo-lo, afinamo-lo e executamos o diagnóstico.

03
dia 15–21

Integração

Ligamo-lo ao AD, CRM e gestão documental. Configuramos RBAC e auditoria.

04
dia 22–30

Sign-off

Teste de carga, utilizadores piloto, entrega em produção. SLA ativo.

// desafios de grande escala

O que os nossos clientes computam no BOX.

Banca·BOX Enterprise

Scoring de 4M de processos de crédito em tempo real

RAG + Agent em 16 GPU. Decisão sobre o pedido em 1.8 segundos em vez de 14 minutos.

  • ×60velocidade
  • −42%FTE
Indústria·BOX Pro

Manutenção preditiva com 14 000 sensores

Analytic + Vision em 8 GPU. As falhas são previstas 72 horas antes do evento.

  • −27%paragens
  • +₽340Mpor ano
Petróleo e gás·BOX DataCenter

Análise sísmica em 1024 GPU

Fine-tuning próprio de um modelo fundacional sobre um petabyte de dados de exploração.

  • ×38velocidade
  • +12jazidas
// perguntas frequentes

O que convém saber antes da compra.

Seis respostas às perguntas que todos os CIO, CISO e responsáveis de compras colocam na primeira reunião.

Em que é que o BOX se diferencia das API de Ai na nuvem?

Um perímetro físico no seu centro de dados. Os dados não saem do perímetro, não há vendor lock e o CapEx é fixo em vez de um OpEx crescente por tokens. Num horizonte de 24 meses, o BOX é entre 50 e 70% mais económico do que a nuvem.

E se precisarmos de 10 GPU e mais tarde de 200?

Todos os tamanhos do BOX são compatíveis entre si. Comece com Mini ou Pro e acrescente nós à medida que cresce. As licenças e os cenários mantêm-se; não é preciso reinstalar.

É possível trabalhar em modo air-gapped?

Sim, é o modo de funcionamento padrão. As atualizações chegam por um canal protegido ou num suporte físico. Cumpre os requisitos de KII (infraestrutura de informação crítica) e do regulador russo FSTEC.

Que modelos são compatíveis?

Open-source (Llama, Qwen, Mistral, DeepSeek), nacionais (GigaChat, YandexGPT através de adaptador) e qualquer modelo fine-tuned seu. Mudar de modelo demora uma hora, sem alterar as aplicações.

O que inclui o SLA?

Suporte 24×7, arquiteto dedicado, tempo de resposta a partir de 15 minutos, disponibilidade objetivo de 99.99% (para Enterprise/DataCenter) e atualizações mensais de modelos e serviços.

É possível comprar só o hardware sem os serviços?

Não, o BOX é entregue como uma plataforma completa: hardware + software + modelos + suporte. Caso contrário, perde-se a vantagem principal: o arranque em 14 dias.

// próximo passo

Reserve uma demo: mostramos-lhe o servidor em funcionamento e calculamos a configuração à sua medida.

Conte-nos as suas tarefas e a sua infraestrutura. Um engenheiro fará uma demonstração ao vivo do BOX, selecionará a configuração e enviar-lhe-á uma comparação de TCO com a nuvem.

// ao enviar, o senhor aceita o tratamento dos seus dados pessoais