Ga naar de inhoud

TextCortex API-handleidingen

De werkelijke kosten van een LLM API

Bereken de LLM API-kosten voor invoer, uitvoer, nieuwe pogingen en modelselectie. Vergelijk uw werklast via de TextCortex multi-model API.

De werkelijke kosten van een LLM API

Wat dit in de praktijk betekent

Bouw voort op een API met meerdere modellen.

Voorspel API-kosten op basis van gemeten verzoeken. Een gemeenschappelijke API maakt het gemakkelijker om modelkeuzes te vergelijken zonder de integratieverschillen tussen providers te verwarren met de kosten van het model zelf.

Meet het verzoek dat het model bereikt

Invoertokens omvatten het materiaal dat uw applicatie verzendt: instructies, gespreksgeschiedenis, opgehaalde passages en toolresultaten. Een korte gebruikersvraag kan dus een veel grotere input genereren.

Uitvoertokens variëren afhankelijk van de gevraagde antwoord- en modelinstellingen. Meet beide zijden over een representatief monster in plaats van te voorspellen op basis van één enkele aanwijzing.

Tel mislukte pogingen

Een verkeerd opgemaakte extractie, time-out of afgewezen antwoord door uw validator kan leiden tot een nieuw verzoek. Neem deze pogingen mee in uw berekening van de kosten per resultaat.

Stel een beleid voor beperkt opnieuw proberen in. Als u elke fout onmiddellijk opnieuw probeert, kunnen zowel de uitgaven als de belasting toenemen zonder dat het resultaat verbetert, vooral als het probleem een ​​ongeldig verzoek is.

Vergelijk modellen met dezelfde taak

Gebruik de TextCortex API om hetzelfde goedgekeurde verzoek uit te voeren voor kandidaatmodellen.

  • Houd de taak- en succescriteria constant.
  • Registreer de modelversie en generatie-instellingen.
  • Leg het gefactureerde gebruik en de huidige tarieven vast.
  • Tel geldige resultaten, herhaalde pogingen en mislukkingen.
  • Vergelijk de end-to-end-tijd en de kosten.

Stel de maandelijkse prognose op

Vermenigvuldig de gemeten kosten per voltooide taak met het verwachte taakvolume. Houd afzonderlijke schattingen bij voor functies die verschillende modellen gebruiken of vormen aanvragen.

Gebruik de token rekenmachine voor de basisrekenkunde. Voeg kosten toe buiten deze schatting volgens de factureringsregels van het geselecteerde model en bekijk vervolgens de prognose zodra er daadwerkelijk verkeer binnenkomt.

Vragen

Uw volgende vragen beantwoord.

Hoe wordt het API-gebruik geprijsd?

Gebruik de tarieven voor uw geselecteerde model en account. Schat de invoer- en uitvoertokens afzonderlijk en neem eventuele toepasselijke cache-token, redeneringstoken of andere kosten op. API-verbruik verschilt van een werkruimteabonnement.

Hoe werkt modelroutering?

Uw applicatie selecteert een beschikbaar model in elk API-verzoek, en TextCortex stuurt het verzoek via de API. U kunt verschillende modellen kiezen voor verschillende taken. Automatisch selectie- en terugvalgedrag mag alleen worden gebruikt als dit voor uw configuratie is gedocumenteerd.

Is TextCortex beperkt tot open-sourcemodellen?

Nee. De API biedt toegang tot eigen modelfamilies zoals GPT, Claude en Gemini, naast families met open gewichten zoals Kimi, GLM, DeepSeek en MiMo. Gebruik GET /models om de ID's weer te geven die beschikbaar zijn voor uw account.

TextCortex AI

Eén integratie. Uw keuze uit modellen.

Meld u aan voor TextCortex, maak een API-sleutel en begin met het bouwen met de modellen die uw toepassing nodig heeft.

Bronnen en documentatie

Productdocumentatie en bronnen van aanbieders voor deze gids. Gecontroleerd op 5 oktober 2026.