Saltar al contenido

Guías API TextCortex

Compare las API de LLM por costo por tarea exitosa

Compare las API modelo utilizando salidas aceptadas, reintentos, uso de tokens y latencia. Evalúe modelos candidatos a través de la API TextCortex.

Compare las API de LLM por costo por tarea exitosa

La conclusión práctica

Construya sobre una API multimodelo.

La solicitud más barata no siempre es el resultado útil más barato. Compare el consumo total de API con las tareas que cumplen con los criterios de aceptación de su aplicación.

Definir un resultado aceptado

Escribe una regla o rúbrica para determinar si una tarea se realizó correctamente. Una extracción puede requerir campos válidos y valores correctos; un cambio generado puede requerir pasar controles del proyecto.

Mantenga la misma definición de aceptación en todos los modelos candidatos. De lo contrario, las diferencias en la puntuación pueden reflejar la evaluación más que el modelo.

Incluir cada llamada de modelo en la tarea.

Agregue el uso de entrada y salida desde el primer intento, los reintentos y cualquier llamada de modelo de soporte. Aplicar la tarifa vigente para cada modelo utilizado.

Divida el costo total de API medido por la cantidad de tareas aceptadas. Informe la tasa de fracaso junto con esa cifra para que un modelo que rechace la mayoría de las solicitudes no parezca artificialmente atractivo.

Realizar una comparación controlada

Utilice TextCortex para mantener la conexión constante mientras prueba diferentes familias de modelos.

  • Utilice el mismo conjunto de tareas representativo.
  • Registre identificadores de modelo y solicite configuraciones.
  • Aplique la misma validación de salida.
  • Mida el uso total, los resultados aceptados y la latencia.
  • Repita cuando cambie el mensaje o la versión del modelo.

Ruta donde el resultado lo justifica

Un modelo más capaz puede valer la pena para solicitudes difíciles incluso si su tasa de token es mayor. Una opción más pequeña o más rápida puede funcionar bien para una función más sencilla.

Utilice el Calculadora de costos API para aritmética de tokens y el guía de ruta para mantener explícitas las opciones del modelo de producción.

Preguntas

Tus próximas preguntas, respondidas.

¿Cómo se valora el uso de API?

Utilice las tarifas para su modelo y cuenta seleccionados. Calcule los tokens de entrada y salida por separado e incluya cualquier token en caché, token de razonamiento u otros cargos aplicables. El consumo de API es distinto de una suscripción a un espacio de trabajo.

¿Cómo funciona el enrutamiento de modelos?

Su aplicación selecciona un modelo disponible en cada solicitud de API y TextCortex enruta la solicitud a través de su API. Puede elegir diferentes modelos para diferentes tareas. La selección automática y el comportamiento de reserva solo deben usarse cuando esté documentado para su configuración.

¿TextCortex está limitado a modelos de código abierto?

No. La API brinda acceso a familias de modelos patentados como GPT, Claude y Gemini junto con familias de peso abierto como Kimi, GLM, DeepSeek y MiMo. Utilice GET /models para enumerar los identificadores disponibles para su cuenta.

TextCortex AI

Una integración. Tu elección de modelos.

Regístrese en TextCortex, cree una clave API y comience a construir con los modelos que su aplicación necesita.

Fuentes y documentación

Documentación del producto y fuentes de los proveedores utilizadas en esta guía. Revisadas el 5 de octubre de 2026.