Vai al contenuto

API TextCortex · Modelli e routing

Inserisci un numero nel carico di lavoro dell'API.

Stima i costi dei token API TextCortex e confronta i modelli utilizzando il traffico previsto, i token di input e i token di output.

Un’unica API. Tutte le famiglie di modelli.
GPTOpenAI
ClaudeAnthropic
GeminiGoogle
GLM5.3
DeepSeek
KimiK3
MiMo
TextCortex
GPT, Claude, Gemini e modelli a pesi aperti. Instradati tramite TextCortex.

Perché TextCortex

Confronta i modelli effettivamente utilizzati dalla tua applicazione.

Un'API semplifica la valutazione di modelli proprietari e open-weight utilizzando lo stesso carico di lavoro. Inserisci le tariffe per il tuo account, quindi confronta i costi con la qualità dell'output e la latenza.

01

Modelli proprietari e open-weight

Accedi a GPT, Claude, Gemini, Kimi, GLM, DeepSeek, MiMo e altro tramite TextCortex. Scegli i modelli dal catalogo disponibile per il tuo account.

02

Un'API compatibile con OpenAI

Utilizza un client familiare, una chiave API TextCortex e un URL di base comune. Modifica l'identificatore del modello per passare da un modello supportato all'altro.

03

Opzioni del modello ospitato nell'UE

Utilizza percorsi ospitati nell'UE per i requisiti di inferenza europei. L'hosting dipende dal modello e dal percorso selezionati; il catalogo più ampio include anche altre implementazioni.

Calcolatore dei costi

Calcola il costo dei token.

Inserisci i prezzi dei token di input e output del tuo preventivo o del modello scelto. Usa la stessa valuta per entrambi i prezzi.

Costo mensile stimato dei tokenInserisci le tariffe del modello

Una stima basata sui tuoi input, non un preventivo TextCortex. Esclude tasse, sconti cache, nuovi tentativi e ulteriore utilizzo fatturabile. Controlla le tariffe per il modello selezionato.

Ingresso e uscita del prezzo separatamente

Misura il numero di token di input e output che la tua applicazione invia e riceve. Moltiplicare ciascuna quantità per il tasso applicabile, quindi dividere per l'unità di tasso. Non dare per scontato che i prezzi di input e di output di un modello siano identici.

Utilizza il calcolatore con le tariffe attuali per il tuo modello e account. Queste pagine non pubblicano un tariffario fisso né implicano un utilizzo illimitato dell'API tramite un abbonamento a Workspace.

La scelta del modello cambia il conto

Una risposta più lunga, una richiesta complessa o un tentativo ripetuto possono consumare più token rispetto al primo test riuscito. Raccogli l'utilizzo delle richieste rappresentative prima di prevedere la spesa mensile.

Confronta GPT, Claude e Gemini con Kimi, GLM, DeepSeek e MiMo dove ciascuno è adatto al compito. Una richiesta meno costosa fa risparmiare denaro solo se produce un risultato utilizzabile.

Costruisci un budget di routing

Definire un modello e un budget per ciascuna funzionalità dell'applicazione. Ciò rende più facile comprendere una modifica nel traffico o nella scelta del modello.

  • Prevedi le richieste mensili per ciascuna funzionalità.
  • Misura input, output e tentativi ripetuti tipici.
  • Applica le tariffe attuali e le regole di fatturazione del modello selezionato.
  • Tieni traccia della latenza e dei risultati positivi insieme al costo dei token.

Inizia con un carico di lavoro misurato e ridotto

Accedi all’API, seleziona un modello ed esegui un campione controllato. Utilizza i risultati per impostare i limiti di applicazione e decidere dove vale la pena utilizzare un modello diverso.

Leggi guida al costo per attività per un metodo pratico che include risposte e tentativi non validi.

Domande

Le tue prossime domande hanno una risposta.

Come viene valutato l'utilizzo dell'API?

Utilizza le tariffe per il modello e l'account selezionati. Stimare separatamente i token di input e output e includere eventuali token memorizzati nella cache, token di ragionamento o altri addebiti applicabili. Il consumo dell'API è diverso da un abbonamento all'area di lavoro.

TextCortex è limitato ai modelli open source?

No. L'API fornisce l'accesso a famiglie di modelli proprietari come GPT, Claude e Gemini insieme a famiglie a peso aperto come Kimi, GLM, DeepSeek e MiMo. Utilizza GET /models per elencare gli identificatori disponibili per il tuo account.

Come funziona il routing del modello?

La tua applicazione seleziona un modello disponibile in ciascuna richiesta API e TextCortex instrada la richiesta tramite la sua API. Puoi scegliere diversi modelli per compiti diversi. La selezione automatica e il comportamento di fallback devono essere utilizzati solo se documentati per la configurazione.

TextCortex AI

Una integrazione. La tua scelta di modelli.

Iscriviti a TextCortex, crea una chiave API e inizia a creare con i modelli di cui la tua applicazione ha bisogno.

Fonti e documentazione

Documentazione di prodotto e fonti dei fornitori usate per questa guida. Verificate il 5 ottobre 2026.