Pular para o conteúdo

Guias da API TextCortex

Compare APIs LLM por custo por tarefa bem-sucedida

Compare APIs de modelo usando resultados aceitos, novas tentativas, uso de token e latência. Avalie modelos candidatos por meio da API TextCortex.

Compare APIs LLM por custo por tarefa bem-sucedida

O que isso significa na prática

Crie uma API multimodelo.

A solicitação mais barata nem sempre é o resultado útil mais barato. Compare o consumo total da API com tarefas que atendem aos critérios de aceitação do seu aplicativo.

Defina um resultado aceito

Escreva uma regra ou rubrica para saber se uma tarefa foi bem-sucedida. Uma extração pode exigir campos válidos e valores corretos; uma mudança gerada pode exigir a aprovação nas verificações do projeto.

Mantenha a definição de aceitação igual entre os candidatos modelo. Caso contrário, as diferenças na pontuação poderão reflectir a avaliação e não o modelo.

Incluir todas as chamadas de modelo na tarefa

Adicione o uso de entrada e saída desde a primeira tentativa, novas tentativas e quaisquer chamadas de modelo de suporte. Aplique a taxa atual para cada modelo utilizado.

Divida o custo total medido da API pelo número de tarefas aceitas. Relate a taxa de falha junto com esse número para que um modelo que rejeite a maioria das solicitações não possa parecer artificialmente atraente.

Execute uma comparação controlada

Use TextCortex para manter a conexão consistente enquanto testa diferentes famílias de modelos.

  • Use o mesmo conjunto de tarefas representativo.
  • Registre identificadores de modelo e configurações de solicitação.
  • Aplique a mesma validação de saída.
  • Meça o uso total, os resultados aceitos e a latência.
  • Repita quando o prompt ou a versão do modelo mudar.

Rota onde o resultado o justifica

Um modelo mais capaz pode valer a pena para solicitações difíceis, mesmo que sua taxa de token seja maior. Uma opção menor ou mais rápida pode funcionar bem para um recurso mais simples.

Use Calculadora de custos de API para aritmética de token e guia de roteamento para manter explícitas as escolhas do modelo de produção.

Perguntas

Suas próximas perguntas, respondidas.

Qual é o preço do uso da API?

Use as taxas do modelo e da conta selecionados. Estime os tokens de entrada e saída separadamente e inclua qualquer token em cache, token de raciocínio ou outros encargos aplicáveis. O consumo de API é diferente de uma assinatura de workspace.

Como funciona o roteamento de modelo?

Seu aplicativo seleciona um modelo disponível em cada solicitação de API e TextCortex roteia a solicitação por meio de sua API. Você pode escolher diferentes modelos para diferentes tarefas. A seleção automática e o comportamento de fallback só devem ser usados ​​quando documentados para sua configuração.

O TextCortex está limitado a modelos de código aberto?

Não. A API fornece acesso a famílias de modelos proprietários, como GPT, Claude e Gemini, juntamente com famílias de peso aberto, como Kimi, GLM, DeepSeek e MiMo. Use GET /models para listar os identificadores disponíveis para sua conta.

TextCortex AI

Uma integração. Sua escolha de modelos.

Cadastre-se no TextCortex, crie uma chave de API e comece a construir com os modelos que sua aplicação precisa.

Fontes e documentação

Documentação do produto e fontes dos provedores usadas neste guia. Verificadas em 5 de outubro de 2026.