Zum Inhalt springen

TextCortex API-Anleitungen

Vergleichen Sie LLM-APIs nach Kosten pro erfolgreicher Aufgabe

Vergleichen Sie Modell-APIs anhand akzeptierter Ausgaben, Wiederholungsversuche, Token-Nutzung und Latenz. Bewerten Sie Kandidatenmodelle über die TextCortex-API.

Vergleichen Sie LLM-APIs nach Kosten pro erfolgreicher Aufgabe

Das bedeutet das für Ihre Praxis

Bauen Sie auf einer Multi-Modell-API auf.

Die günstigste Anfrage ist nicht immer das günstigste nützliche Ergebnis. Vergleichen Sie den gesamten API-Verbrauch mit Aufgaben, die die Akzeptanzkriterien Ihrer Anwendung erfüllen.

Definieren Sie ein akzeptiertes Ergebnis

Schreiben Sie eine Regel oder Rubrik dafür, ob eine Aufgabe erfolgreich war. Für eine Extraktion können gültige Felder und korrekte Werte erforderlich sein. Eine generierte Änderung kann das Bestehen von Projektprüfungen erfordern.

Halten Sie die Akzeptanzdefinition für alle Modellkandidaten gleich. Andernfalls können Unterschiede in der Bewertung eher auf die Bewertung als auf das Modell zurückzuführen sein.

Beziehen Sie jeden Modellaufruf in die Aufgabe ein

Fügen Sie die Eingabe- und Ausgabenutzung beim ersten Versuch, bei Wiederholungsversuchen und bei allen unterstützenden Modellaufrufen hinzu. Wenden Sie für jedes verwendete Modell den aktuellen Tarif an.

Teilen Sie die gesamten gemessenen API-Kosten durch die Anzahl der akzeptierten Aufgaben. Geben Sie neben dieser Zahl auch die Fehlerquote an, damit ein Modell, das die meisten Anfragen ablehnt, nicht künstlich attraktiv erscheint.

Führen Sie einen kontrollierten Vergleich durch

Verwenden Sie TextCortex, um die Verbindung beim Testen verschiedener Modellfamilien konsistent zu halten.

  • Verwenden Sie denselben repräsentativen Aufgabensatz.
  • Zeichnen Sie Modellkennungen auf und fordern Sie Einstellungen an.
  • Wenden Sie dieselbe Ausgabevalidierung an.
  • Messen Sie die Gesamtnutzung, akzeptierte Ergebnisse und Latenz.
  • Wiederholen Sie diesen Vorgang, wenn sich die Eingabeaufforderung oder die Modellversion ändert.

Route dorthin, wo das Ergebnis es rechtfertigt

Bei schwierigen Anfragen kann sich ein leistungsfähigeres Modell lohnen, auch wenn die Token-Rate höher ist. Für eine einfachere Funktion eignet sich möglicherweise eine kleinere oder schnellere Option.

Verwenden Sie API-Kostenrechner für die Token-Arithmetik und Routenplaner, um die Auswahl des Produktionsmodells explizit zu halten.

Fragen

Ihre nächsten Fragen, beantwortet.

Wie ist der Preis für die API-Nutzung?

Nutzen Sie die Tarife für Ihr ausgewähltes Modell und Konto. Schätzen Sie die Eingabe- und Ausgabe-Tokens separat und berücksichtigen Sie alle anwendbaren Cache-Tokens, Reasoning-Tokens oder andere Gebühren. Der API-Verbrauch unterscheidet sich von einem Workspace-Abonnement.

Wie funktioniert Modellrouting?

Ihre Anwendung wählt in jeder API-Anfrage ein verfügbares Modell aus und TextCortex leitet die Anfrage über seine API weiter. Sie können für unterschiedliche Aufgaben unterschiedliche Modelle wählen. Automatische Auswahl und Fallback-Verhalten sollten nur verwendet werden, wenn dies für Ihre Konfiguration dokumentiert ist.

Ist TextCortex auf Open-Source-Modelle beschränkt?

Nein. Die API bietet Zugriff auf proprietäre Modellfamilien wie GPT, Claude und Gemini sowie auf Familien mit offenem Gewicht wie Kimi, GLM, DeepSeek und MiMo. Verwenden Sie GET /models, um die für Ihr Konto verfügbaren Kennungen aufzulisten.

TextCortex AI

Eine Integration. Ihre Modellauswahl.

Melden Sie sich bei TextCortex an, erstellen Sie einen API-Schlüssel und beginnen Sie mit der Erstellung der Modelle, die Ihre Anwendung benötigt.

Quellen und Dokumentation

Produktdokumentation und Anbieterquellen für diesen Leitfaden. Geprüft am 5. Oktober 2026.