Cortex On-Premise

Dimensione a sua implementação de IA privada.

Execute a TextCortex em servidores no seu próprio data center. Defina o número de pessoas, o uso e o modelo open-weight e veja os servidores GPU, a carga e o custo de energia necessários.

Estimativas baseadas no uso empresarial medido da TextCortex. Ctrl/⌘ + rolagem para zoom, arraste para mover.

Por que on-premise

Os seus modelos, o seu hardware, a sua rede.

Os dados ficam na sua rede

Prompts, documentos e respostas são processados em servidores próprios, dentro do seu data center.

Modelos open-weight à sua escolha

Compare DeepSeek, GLM, MiMo, Kimi, Gemma, Qwen e Nemotron em qualidade, memória e velocidade antes de comprar hardware.

Custos previsíveis

Veja a classe de servidor, o número de nós e o custo de energia para o seu país antes de pedir um orçamento.

Como funciona o dimensionamento

Dimensionado para a hora de maior movimento, não para um dia médio.

Demanda medida

Os perfis de uso vêm do uso empresarial real da TextCortex, desde chat ocasional até usuários avançados que trabalham com agentes em documentos longos.

Carga de pico

Os servidores são dimensionados para cinco vezes a média da hora de maior movimento e nunca abaixo do pico de um único usuário avançado.

Estimativas claramente identificadas

A taxa de processamento por servidor é medida em benchmarks públicos ou identificada como estimativa. O dimensionamento final é confirmado com um teste de carga.

Perguntas frequentes

Perguntas sobre dimensionamento on-premise

Qual é a precisão do configurador?

Ele fornece uma estimativa de dimensionamento. A demanda vem do uso empresarial medido da TextCortex. A capacidade dos servidores é medida em benchmarks públicos quando indicado e estimada nos demais casos. Peça um orçamento para confirmar o dimensionamento para a sua organização.

Quais modelos estão incluídos?

DeepSeek V4 Flash, DeepSeek V4.1 Flash, GLM-5.3, GLM-5.3-Flash, MiMo-V2.6-Pro, Kimi K3, Gemma 4 31B, Qwen3.8 27B e Nemotron 3 Super. Cada modelo precisa de uma quantidade mínima de memória de GPU, por isso nem todos os modelos cabem em todas as classes de servidor.

O que a estimativa de energia inclui?

Assume-se que os servidores consomem 60% da sua potência máxima de forma contínua (30% para um nó de reserva), mais 40% para refrigeração. O preço é o preço médio da eletricidade para empresas no país selecionado, sem IVA.

É possível adicionar um nó de reserva para alta disponibilidade?

Sim. Ative o nó de reserva no painel de servidores. É adicionado um nó extra, e a estimativa inclui o seu consumo em repouso.

Como obter um orçamento?

Selecione “Pedir orçamento” no configurador. É possível enviar a configuração por e-mail à nossa equipe ou agendar uma chamada.

Planeje a sua implementação de IA privada.

Fale com a nossa equipe sobre hardware, modelos e a implementação na sua organização.