Passer au contenu

Guides API TextCortex

Comparez les API LLM par coût par tâche réussie

Comparez les API de modèles en utilisant les sorties acceptées, les tentatives, l'utilisation des jetons et la latence. Évaluez les modèles candidats via l'API TextCortex.

Comparez les API LLM par coût par tâche réussie

À retenir pour votre équipe

Bâtissez sur une API multimodèle.

La demande la moins chère n’est pas toujours le résultat utile le moins cher. Comparez la consommation totale de l'API aux tâches qui répondent aux critères d'acceptation de votre application.

Définir un résultat accepté

Écrivez une règle ou une rubrique indiquant si une tâche a réussi. Une extraction peut nécessiter des champs valides et des valeurs correctes ; un changement généré peut nécessiter la réussite des contrôles du projet.

Gardez la définition d’acceptation la même pour tous les candidats modèles. Autrement, les différences dans les scores peuvent refléter l’évaluation plutôt que le modèle.

Inclure chaque appel de modèle dans la tâche

Ajoutez l’utilisation des entrées et des sorties dès la première tentative, les nouvelles tentatives et tous les appels de modèle pris en charge. Appliquer le tarif en vigueur pour chaque modèle utilisé.

Divisez le coût total mesuré de l'API par le nombre de tâches acceptées. Indiquez le taux d'échec à côté de ce chiffre afin qu'un modèle qui rejette la plupart des demandes ne puisse pas paraître artificiellement attrayant.

Exécuter une comparaison contrôlée

Utilisez TextCortex pour maintenir la cohérence de la connexion tout en testant différentes familles de modèles.

  • Utilisez le même ensemble de tâches représentatif.
  • Enregistrez les identifiants du modèle et les paramètres de demande.
  • Appliquez la même validation de sortie.
  • Mesurez l’utilisation totale, les résultats acceptés et la latence.
  • Répétez l'opération lorsque l'invite ou la version du modèle change.

Itinéraire où le résultat le justifie

Un modèle plus performant peut être intéressant pour les demandes difficiles, même si son taux de jetons est plus élevé. Une option plus petite ou plus rapide peut bien fonctionner pour une fonctionnalité plus simple.

Utilisez le Calculateur de coût API pour l'arithmétique des jetons et le guide d'itinéraire pour que les choix du modèle de production restent explicites.

Questions

Réponses à vos prochaines questions.

Comment l'utilisation de l'API est-elle tarifée ?

Utilisez les tarifs correspondant au modèle et au compte sélectionnés. Estimez les jetons d’entrée et de sortie séparément et incluez tous les jetons mis en cache, jetons de raisonnement ou autres frais applicables. La consommation d'API est distincte d'un abonnement à un espace de travail.

Comment fonctionne le routage du modèle ?

Votre application sélectionne un modèle disponible dans chaque requête API et TextCortex achemine la requête via son API. Vous pouvez choisir différents modèles pour différentes tâches. La sélection automatique et le comportement de secours ne doivent être utilisés que lorsque cela est documenté pour votre configuration.

Le TextCortex est-il limité aux modèles open source ?

Non. L'API donne accès à des familles de modèles propriétaires telles que GPT, Claude et Gemini, ainsi qu'à des familles à poids ouvert telles que Kimi, GLM, DeepSeek et MiMo. Utilisez GET /models pour lister les identifiants disponibles pour votre compte.

TextCortex AI

Une intégration. Votre choix de modèles.

Inscrivez-vous à TextCortex, créez une clé API et commencez à créer avec les modèles dont votre application a besoin.

Sources et documentation

Documentation produit et sources des fournisseurs utilisées pour ce guide. Vérifiées le 5 octobre 2026.