Vai al contenuto

Guide API TextCortex

Implementa un'API multi-modello in produzione

Implementa l'accesso API TextCortex con liste consentite di modelli, convalida delle richieste, monitoraggio e routing ospitato nell'UE dove richiesto.

Implementa un'API multi-modello in produzione

Cosa significa in pratica

Costruisci su un'API multi-modello.

Inizia con un carico di lavoro API ben definito, rendilo osservabile ed espandi deliberatamente le scelte del modello. Mantieni stabile l'integrazione del client mentre la configurazione del routing si evolve.

Stabilire un limite API lato server

Conserva la chiave TextCortex nell'ambiente server e autentica gli utenti della tua applicazione prima di effettuare richieste di modello. Limita la dimensione dell'input e i parametri che i client possono inviare.

Mantieni gli identificatori del modello approvati e le impostazioni predefinite nella configurazione. Utilizza una configurazione separata per i carichi di lavoro che richiedono l'inferenza ospitata nell'UE.

Convalidare prima di inviare traffico di produzione

Crea un set di richieste che copra input normali, contenuti non corretti, contesto mancante e le funzionalità del modello che utilizzi. Controlla l'analisi dell'output, gli strumenti, lo streaming e la cancellazione.

Esercita il comportamento dell'applicazione in caso di timeout, credenziali non valide, modelli sconosciuti e limiti di velocità. Limita i tentativi ed evita di ripetere azioni esterne.

Introdurre il traffico gradualmente

Inizia con un piccolo carico di lavoro idoneo. Confronta la percentuale di successo, la latenza e l'utilizzo dei token con i criteri di accettazione e la configurazione precedente.

Registra quale modello ha servito ciascuna richiesta. Conserva informazioni sufficienti per diagnosticare le regressioni riducendo al minimo i contenuti sensibili conservati nei log.

Espandersi con un processo di rilascio

L'aggiunta di un modello è una modifica del prodotto quando può alterare le risposte, i costi o il luogo di elaborazione.

  • Valutare il nuovo modello sul set di richieste stabilito.
  • Esaminare le capacità e i requisiti regionali.
  • Promuovere la configurazione con un percorso di rollback esplicito.
  • Monitorare i risultati delle attività dopo il rilascio.

Domande

Le tue prossime domande hanno una risposta.

TextCortex è limitato ai modelli open source?

No. L'API fornisce l'accesso a famiglie di modelli proprietari come GPT, Claude e Gemini insieme a famiglie a peso aperto come Kimi, GLM, DeepSeek e MiMo. Utilizza GET /models per elencare gli identificatori disponibili per il tuo account.

Posso utilizzare un client compatibile con OpenAI?

Sì. Configura il client con l'URL di base TextCortex e la chiave API. Utilizza un identificatore del modello TextCortex e i parametri supportati da quel modello. La scoperta del modello, i completamenti della chat e le risposte sono documentati nel riferimento API.

Come posso iniziare a utilizzare l'API?

Iscriviti a TextCortex, crea una chiave API nelle impostazioni del tuo account e utilizza https://api.textcortex.com/v1 come URL di base. Recupera il catalogo dei modelli, seleziona un identificatore del modello e invia una richiesta di completamento della chat.

TextCortex AI

Una integrazione. La tua scelta di modelli.

Iscriviti a TextCortex, crea una chiave API e inizia a creare con i modelli di cui la tua applicazione ha bisogno.

Fonti e documentazione

Documentazione di prodotto e fonti dei fornitori usate per questa guida. Verificate il 5 ottobre 2026.