Cortex On-Premise

Dimensione su despliegue de IA privada.

Ejecute TextCortex en servidores de su propio centro de datos. Indique su plantilla, su uso y su modelo open-weight, y vea los servidores GPU, la carga y el coste eléctrico que requiere.

Estimaciones basadas en el uso empresarial medido de TextCortex. Ctrl/⌘ + desplazamiento para hacer zoom, arrastre para mover.

Por qué on-premise

Sus modelos, su hardware, su red.

Los datos permanecen en su red

Los prompts, documentos y respuestas se procesan en servidores de su propiedad, dentro de su propio centro de datos.

Los modelos open-weight que usted elija

Compare DeepSeek, GLM, MiMo, Kimi, Gemma, Qwen y Nemotron en calidad, memoria y velocidad antes de comprar hardware.

Costes que puede planificar

Vea la gama de servidor, el número de nodos y el coste eléctrico para su país antes de solicitar un presupuesto.

Cómo funciona el dimensionamiento

Dimensionado para su hora de mayor actividad, no para un día medio.

Demanda medida

Los perfiles de uso proceden del uso empresarial real de TextCortex, desde el chat ocasional hasta usuarios avanzados que trabajan con agentes sobre documentos largos.

Carga pico

Los servidores se dimensionan para cinco veces la media de la hora de mayor actividad, y nunca por debajo del pico de un solo usuario avanzado.

Estimaciones claramente señaladas

El rendimiento por servidor está medido en benchmarks públicos o señalado como estimación. El dimensionamiento final se confirma con una prueba de carga.

Preguntas frecuentes

Preguntas sobre el dimensionamiento on-premise

¿Qué precisión tiene el configurador?

Ofrece una estimación de dimensionamiento. La demanda se basa en el uso empresarial medido de TextCortex. La capacidad de los servidores está medida en benchmarks públicos donde se indica y estimada en los demás casos. Solicite un presupuesto para confirmar el dimensionamiento para su organización.

¿Qué modelos se incluyen?

DeepSeek V4 Flash, DeepSeek V4.1 Flash, GLM-5.3, GLM-5.3-Flash, MiMo-V2.6-Pro, Kimi K3, Gemma 4 31B, Qwen3.8 27B y Nemotron 3 Super. Cada modelo necesita una cantidad mínima de memoria GPU, por lo que no todos los modelos caben en todas las gamas de servidor.

¿Qué incluye la estimación del coste eléctrico?

Se supone que los servidores consumen el 60 % de su potencia máxima de forma continua (el 30 % en el caso de un nodo de reserva), más un 40 % para refrigeración. El precio es el precio medio de la electricidad para empresas en el país seleccionado, sin IVA.

¿Puedo añadir un nodo de reserva para alta disponibilidad?

Sí. Active el nodo de reserva en el panel de servidores. Añade un nodo adicional, y la estimación incluye su consumo en reposo.

¿Cómo obtengo un presupuesto?

Seleccione «Solicitar presupuesto» en el configurador. Puede enviar la configuración por correo electrónico a nuestro equipo o reservar una llamada.

Planifique su despliegue de IA privada.

Hable con nuestro equipo sobre el hardware, los modelos y la implantación en su organización.