Pular para o conteúdo

API TextCortex · Modelos e roteamento

Coloque um número na carga de trabalho da sua API.

Estime os custos do token de API TextCortex e compare modelos usando o tráfego esperado, tokens de entrada e tokens de saída.

Uma API. Todas as famílias de modelos.
GPTOpenAI
ClaudeAnthropic
GeminiGoogle
GLM5.3
DeepSeek
KimiK3
MiMo
TextCortex
GPT, Claude, Gemini e modelos de pesos abertos. Roteados pelo TextCortex.

Por que TextCortex

Compare os modelos que seu aplicativo realmente usa.

Uma API facilita a avaliação de modelos proprietários e de peso aberto usando a mesma carga de trabalho. Insira as taxas da sua conta e compare o custo com a qualidade de saída e a latência.

01

Modelos proprietários e de peso aberto

Acesse GPT, Claude, Gemini, Kimi, GLM, DeepSeek, MiMo e muito mais através de TextCortex. Escolha modelos do catálogo disponível para sua conta.

02

Uma API compatível com OpenAI

Use um cliente familiar, uma chave de API TextCortex e uma URL base comum. Altere o identificador do modelo para alternar entre os modelos suportados.

03

Opções de modelo hospedado na UE

Use rotas hospedadas na UE para requisitos de inferência europeus. A hospedagem depende do modelo e percurso selecionado; o catálogo mais amplo também inclui outras implantações.

Calculadora de custos

Calcule seus custos de tokens.

Informe os preços dos tokens de entrada e saída do seu orçamento ou do modelo escolhido. Use a mesma moeda para os dois preços.

Custo mensal estimado dos tokensInforme as tarifas do modelo

Uma estimativa usando suas informações, não uma cotação de preço TextCortex. Exclui impostos, descontos em cache, novas tentativas e uso faturável adicional. Verifique as taxas para o modelo selecionado.

Preço de entrada e saída separadamente

Meça quantos tokens de entrada e saída seu aplicativo envia e recebe. Multiplique cada quantidade pela taxa aplicável e depois divida pela unidade da taxa. Não presuma que os preços de insumos e produtos de um modelo são idênticos.

Use a calculadora com as taxas atuais para seu modelo e conta. Essas páginas não publicam uma tabela de preços fixos nem implicam no uso ilimitado da API por meio de uma assinatura de espaço de trabalho.

A seleção do modelo muda a conta

Uma resposta mais longa, uma solicitação com muito raciocínio ou uma tentativa repetida podem consumir mais tokens do que seu primeiro teste bem-sucedido. Colete o uso das solicitações dos representantes antes de prever os gastos mensais.

Compare GPT, Claude e Gemini com Kimi, GLM, DeepSeek e MiMo onde cada um é adequado para a tarefa. Uma solicitação menos dispendiosa só economiza dinheiro se produzir um resultado utilizável.

Crie um orçamento de roteamento

Defina um modelo e um orçamento para cada funcionalidade da aplicação. Isso facilita a compreensão de uma mudança no tráfego ou na escolha do modelo.

  • Previsão de solicitações mensais para cada recurso.
  • Meça entradas, saídas típicas e tentativas repetidas.
  • Aplique as taxas e regras de cobrança atuais do modelo selecionado.
  • Acompanhe a latência e os resultados bem-sucedidos juntamente com o custo do token.

Comece com uma pequena carga de trabalho medida

Acessar a API, selecione um modelo e execute uma amostra controlada. Use os resultados para definir limites de aplicação e decidir onde vale a pena usar um modelo diferente.

Leia o guia de custo por tarefa para obter um método prático que inclui respostas e novas tentativas inválidas.

Perguntas

Suas próximas perguntas, respondidas.

Qual é o preço do uso da API?

Use as taxas do modelo e da conta selecionados. Estime os tokens de entrada e saída separadamente e inclua qualquer token em cache, token de raciocínio ou outros encargos aplicáveis. O consumo de API é diferente de uma assinatura de workspace.

O TextCortex está limitado a modelos de código aberto?

Não. A API fornece acesso a famílias de modelos proprietários, como GPT, Claude e Gemini, juntamente com famílias de peso aberto, como Kimi, GLM, DeepSeek e MiMo. Use GET /models para listar os identificadores disponíveis para sua conta.

Como funciona o roteamento de modelo?

Seu aplicativo seleciona um modelo disponível em cada solicitação de API e TextCortex roteia a solicitação por meio de sua API. Você pode escolher diferentes modelos para diferentes tarefas. A seleção automática e o comportamento de fallback só devem ser usados ​​quando documentados para sua configuração.

TextCortex AI

Uma integração. Sua escolha de modelos.

Cadastre-se no TextCortex, crie uma chave de API e comece a construir com os modelos que sua aplicação precisa.

Fontes e documentação

Documentação do produto e fontes dos provedores usadas neste guia. Verificadas em 5 de outubro de 2026.