Ga naar de inhoud

TextCortex API-handleidingen

Vergelijk LLM API's op basis van de kosten per succesvolle taak

Vergelijk model-API's met behulp van geaccepteerde uitvoer, nieuwe pogingen, tokengebruik en latentie. Evalueer kandidaat-modellen via de TextCortex API.

Vergelijk LLM API's op basis van de kosten per succesvolle taak

Wat dit in de praktijk betekent

Bouw voort op een API met meerdere modellen.

Het goedkoopste verzoek is niet altijd het goedkoopste bruikbare resultaat. Vergelijk het totale API-verbruik met taken die voldoen aan de acceptatiecriteria van uw applicatie.

Definieer een geaccepteerd resultaat

Schrijf een regel of rubriek die aangeeft of een taak is geslaagd. Voor een extractie kunnen geldige velden en correcte waarden nodig zijn; Voor een gegenereerde wijziging kan het nodig zijn dat er projectcontroles worden doorlopen.

Houd de acceptatiedefinitie voor alle modelkandidaten hetzelfde. Anders kunnen verschillen in de score de evaluatie weerspiegelen in plaats van het model.

Neem elke modelaanroep op in de taak

Voeg invoer- en uitvoergebruik toe vanaf de eerste poging, nieuwe pogingen en eventuele ondersteunende modelaanroepen. Pas het huidige tarief toe voor elk gebruikt model.

Deel de totale gemeten API-kosten door het aantal geaccepteerde taken. Rapporteer het faalpercentage naast dat cijfer, zodat een model dat de meeste verzoeken afwijst er niet kunstmatig aantrekkelijk uit kan zien.

Voer een gecontroleerde vergelijking uit

Gebruik TextCortex om de verbinding consistent te houden tijdens het testen van verschillende modelfamilies.

  • Gebruik dezelfde representatieve takenset.
  • Registreer model-ID's en verzoekinstellingen.
  • Pas dezelfde uitvoervalidatie toe.
  • Meet het totale gebruik, de geaccepteerde resultaten en de latentie.
  • Herhaal dit wanneer de prompt of de modelversie verandert.

Route waar het resultaat dit rechtvaardigt

Een capabeler model kan de moeite waard zijn voor moeilijke verzoeken, zelfs als de tokensnelheid hoger is. Een kleinere of snellere optie kan goed werken voor een eenvoudiger functie.

Gebruik de API-kostencalculator voor tokenberekeningen en de routebeschrijving om de keuzes voor het productiemodel expliciet te houden.

Vragen

Uw volgende vragen beantwoord.

Hoe wordt het API-gebruik geprijsd?

Gebruik de tarieven voor uw geselecteerde model en account. Schat de invoer- en uitvoertokens afzonderlijk en neem eventuele toepasselijke cache-token, redeneringstoken of andere kosten op. API-verbruik verschilt van een werkruimteabonnement.

Hoe werkt modelroutering?

Uw applicatie selecteert een beschikbaar model in elk API-verzoek, en TextCortex stuurt het verzoek via de API. U kunt verschillende modellen kiezen voor verschillende taken. Automatisch selectie- en terugvalgedrag mag alleen worden gebruikt als dit voor uw configuratie is gedocumenteerd.

Is TextCortex beperkt tot open-sourcemodellen?

Nee. De API biedt toegang tot eigen modelfamilies zoals GPT, Claude en Gemini, naast families met open gewichten zoals Kimi, GLM, DeepSeek en MiMo. Gebruik GET /models om de ID's weer te geven die beschikbaar zijn voor uw account.

TextCortex AI

Eén integratie. Uw keuze uit modellen.

Meld u aan voor TextCortex, maak een API-sleutel en begin met het bouwen met de modellen die uw toepassing nodig heeft.

Bronnen en documentatie

Productdocumentatie en bronnen van aanbieders voor deze gids. Gecontroleerd op 5 oktober 2026.