Vai al contenuto

Guide API TextCortex

Confronta le API LLM in base al costo per attività riuscita

Confronta le API del modello utilizzando output, tentativi, utilizzo di token e latenza accettati. Valuta i modelli candidati tramite l'API TextCortex.

Confronta le API LLM in base al costo per attività riuscita

Cosa significa in pratica

Costruisci su un'API multi-modello.

La richiesta più economica non è sempre il risultato utile più economico. Confronta il consumo totale delle API con le attività che soddisfano i criteri di accettazione della tua applicazione.

Definire un risultato accettato

Scrivi una regola o una rubrica per stabilire se un'attività ha avuto successo. Un'estrazione può richiedere campi validi e valori corretti; una modifica generata può richiedere il superamento dei controlli di progetto.

Mantenere la stessa definizione di accettazione per tutti i candidati modello. Altrimenti le differenze nel punteggio potrebbero riflettere la valutazione piuttosto che il modello.

Includere ogni chiamata del modello nell'attività

Aggiungi l'utilizzo di input e output dal primo tentativo, dai tentativi e da eventuali chiamate al modello di supporto. Applicare la tariffa attuale per ciascun modello utilizzato.

Dividere il costo totale misurato dell'API per il numero di attività accettate. Riporta il tasso di fallimento insieme a quella cifra in modo che un modello che rifiuta la maggior parte delle richieste non possa sembrare artificialmente attraente.

Esegui un confronto controllato

Utilizza TextCortex per mantenere la connessione coerente durante il test di diverse famiglie di modelli.

  • Utilizzare lo stesso insieme di attività rappresentativo.
  • Registra gli identificatori del modello e le impostazioni della richiesta.
  • Applicare la stessa convalida dell'output.
  • Misura l'utilizzo totale, i risultati accettati e la latenza.
  • Ripetere quando cambia la versione del prompt o del modello.

Percorso dove il risultato lo giustifica

Un modello più capace può essere utile per richieste difficili anche se il suo tasso di token è più alto. Un'opzione più piccola o più veloce potrebbe funzionare bene per una funzionalità più semplice.

Utilizzare Calcolatore dei costi API per l'aritmetica dei token e guida al percorso per mantenere esplicite le scelte del modello di produzione.

Domande

Le tue prossime domande hanno una risposta.

Come viene valutato l'utilizzo dell'API?

Utilizza le tariffe per il modello e l'account selezionati. Stimare separatamente i token di input e output e includere eventuali token memorizzati nella cache, token di ragionamento o altri addebiti applicabili. Il consumo dell'API è diverso da un abbonamento all'area di lavoro.

Come funziona il routing del modello?

La tua applicazione seleziona un modello disponibile in ciascuna richiesta API e TextCortex instrada la richiesta tramite la sua API. Puoi scegliere diversi modelli per compiti diversi. La selezione automatica e il comportamento di fallback devono essere utilizzati solo se documentati per la configurazione.

TextCortex è limitato ai modelli open source?

No. L'API fornisce l'accesso a famiglie di modelli proprietari come GPT, Claude e Gemini insieme a famiglie a peso aperto come Kimi, GLM, DeepSeek e MiMo. Utilizza GET /models per elencare gli identificatori disponibili per il tuo account.

TextCortex AI

Una integrazione. La tua scelta di modelli.

Iscriviti a TextCortex, crea una chiave API e inizia a creare con i modelli di cui la tua applicazione ha bisogno.

Fonti e documentazione

Documentazione di prodotto e fonti dei fornitori usate per questa guida. Verificate il 5 ottobre 2026.