Cortex On-Premise

Dimensionieren Sie Ihre private KI-Umgebung.

Betreiben Sie TextCortex auf Servern in Ihrem eigenen Rechenzentrum. Legen Sie Personenzahl, Nutzung und Open-Weight-Modell fest und sehen Sie, welche GPU-Server, Last und Stromkosten nötig sind.

Schätzungen auf Basis gemessener TextCortex-Enterprise-Nutzung. Strg/⌘ + Scrollen zum Zoomen, Ziehen zum Verschieben.

Warum On-Premise

Ihre Modelle, Ihre Hardware, Ihr Netzwerk.

Daten bleiben in Ihrem Netzwerk

Prompts, Dokumente und Antworten werden auf Ihren eigenen Servern in Ihrem eigenen Rechenzentrum verarbeitet.

Open-Weight-Modelle Ihrer Wahl

Vergleichen Sie DeepSeek, GLM, MiMo, Kimi, Gemma, Qwen und Nemotron nach Qualität, Speicherbedarf und Geschwindigkeit, bevor Sie Hardware kaufen.

Planbare Kosten

Sehen Sie Serverklasse, Anzahl der Nodes und Stromkosten für Ihr Land, bevor Sie ein Angebot anfragen.

So funktioniert die Dimensionierung

Ausgelegt auf Ihre Spitzenstunde, nicht auf einen Durchschnittstag.

Gemessener Bedarf

Die Nutzungsprofile basieren auf realer Enterprise-Nutzung von TextCortex, vom gelegentlichen Chat bis zu Power-Usern, die mit Agenten an langen Dokumenten arbeiten.

Spitzenlast

Server werden auf das Fünffache des Durchschnitts der Spitzenstunde ausgelegt, mindestens aber auf die Lastspitze eines einzelnen Power-Users.

Klar gekennzeichnete Schätzungen

Der Durchsatz pro Server ist entweder in öffentlichen Benchmarks gemessen oder als Schätzung gekennzeichnet. Die endgültige Dimensionierung wird mit einem Lasttest bestätigt.

FAQ

Fragen zur On-Premise-Dimensionierung

Wie genau ist der Konfigurator?

Er liefert eine Dimensionierungsschätzung. Der Bedarf basiert auf gemessener TextCortex-Enterprise-Nutzung. Die Serverkapazität ist, wo gekennzeichnet, in öffentlichen Benchmarks gemessen, ansonsten geschätzt. Fordern Sie ein Angebot an, um die Dimensionierung für Ihre Organisation zu bestätigen.

Welche Modelle sind enthalten?

DeepSeek V4 Flash, DeepSeek V4.1 Flash, GLM-5.3, GLM-5.3-Flash, MiMo-V2.6-Pro, Kimi K3, Gemma 4 31B, Qwen3.8 27B und Nemotron 3 Super. Jedes Modell benötigt eine Mindestmenge an GPU-Speicher, daher passt nicht jedes Modell in jede Serverklasse.

Was umfasst die Stromkostenschätzung?

Angenommen wird, dass Server rund um die Uhr 60 % ihrer maximalen Leistung aufnehmen (30 % bei einem Standby-Node), zuzüglich 40 % für die Kühlung. Der Preis ist der durchschnittliche Strompreis für Unternehmen im gewählten Land, ohne MwSt.

Kann ich einen Standby-Node für Hochverfügbarkeit hinzufügen?

Ja. Aktivieren Sie den Standby-Node im Server-Panel. Er fügt einen zusätzlichen Node hinzu, und die Schätzung berücksichtigt seine Leerlaufleistung.

Wie erhalte ich ein Preisangebot?

Wählen Sie im Konfigurator „Preisangebot anfordern“. Sie können die Konfiguration per E-Mail an unser Team senden oder einen Termin buchen.

Planen Sie Ihre private KI-Umgebung.

Sprechen Sie mit unserem Team über Hardware, Modelle und die Einführung in Ihrer Organisation.