Saltar al contenido

API TextCortex · Modelos y enrutamiento

Ponga un número a su carga de trabajo API.

Calcule los costos del token API TextCortex y compare modelos utilizando su tráfico esperado, tokens de entrada y tokens de salida.

Una API. Todas las familias de modelos.
GPTOpenAI
ClaudeAnthropic
GeminiGoogle
GLM5.3
DeepSeek
KimiK3
MiMo
TextCortex
GPT, Claude, Gemini y modelos de pesos abiertos. Enrutados a través de TextCortex.

Por qué TextCortex

Compare los modelos que realmente utiliza su aplicación.

Una API facilita la evaluación de modelos propietarios y abiertos utilizando la misma carga de trabajo. Ingrese las tarifas de su cuenta y luego compare el costo con la calidad de salida y la latencia.

01

Modelos propietarios y de peso abierto.

Acceda a GPT, Claude, Gemini, Kimi, GLM, DeepSeek, MiMo y más a través de TextCortex. Elija modelos del catálogo disponible en su cuenta.

02

Una API compatible con OpenAI

Utilice un cliente familiar, una clave API TextCortex y una URL base común. Cambie el identificador del modelo para cambiar entre los modelos compatibles.

03

Opciones de modelos alojados en la UE

Utilice rutas alojadas en la UE para los requisitos de inferencia europeos. El hospedaje depende del modelo y ruta seleccionados; el catálogo más amplio también incluye otras implementaciones.

calculadora de costos

Calcule sus costes de tokens.

Introduzca los precios de los tokens de entrada y salida de su presupuesto o del modelo elegido. Use la misma moneda para ambos precios.

Coste mensual estimado de tokensIntroduzca las tarifas del modelo

Una estimación utilizando sus datos, no una cotización de precio TextCortex. No incluye impuestos, descuentos en caché, reintentos ni uso facturable adicional. Consulta las tarifas de tu modelo seleccionado.

Entrada y salida de precios por separado

Mida cuántos tokens de entrada y salida envía y recibe su aplicación. Multiplique cada cantidad por la tarifa aplicable, luego divida por la unidad de tarifa. No asuma que los precios de los insumos y los productos de un modelo son idénticos.

Utilice la calculadora con las tarifas vigentes para su modelo y cuenta. Estas páginas no publican una hoja de tarifas fija ni implican el uso ilimitado de API a través de una suscripción al espacio de trabajo.

La selección del modelo cambia la factura.

Una respuesta más larga, una solicitud con mucho razonamiento o un intento repetido pueden consumir más tokens que su primera prueba exitosa. Recopile el uso de las solicitudes de los representantes antes de pronosticar el gasto mensual.

Compare GPT, Claude y Gemini con Kimi, GLM, DeepSeek y MiMo, donde cada uno es adecuado para la tarea. Una solicitud menos costosa sólo ahorra dinero si produce un resultado utilizable.

Construya un presupuesto de enrutamiento

Definir un modelo y un presupuesto para cada característica de la aplicación. Esto hace que un cambio en el tráfico o la elección del modelo sea más fácil de entender.

  • Previsión de solicitudes mensuales para cada función.
  • Mida las entradas y salidas típicas y los intentos repetidos.
  • Aplicar las tarifas y reglas de facturación actuales del modelo seleccionado.
  • Realice un seguimiento de la latencia y los resultados exitosos junto con el costo del token.

Comience con una pequeña carga de trabajo medida

Acceder a la API, seleccione un modelo y ejecute una muestra controlada. Utilice los resultados para establecer límites de aplicación y decidir dónde vale la pena un modelo diferente.

Lea el guía de costo por tarea para conocer un método práctico que incluye respuestas y reintentos no válidos.

Preguntas

Tus próximas preguntas, respondidas.

¿Cómo se valora el uso de API?

Utilice las tarifas para su modelo y cuenta seleccionados. Calcule los tokens de entrada y salida por separado e incluya cualquier token en caché, token de razonamiento u otros cargos aplicables. El consumo de API es distinto de una suscripción a un espacio de trabajo.

¿TextCortex está limitado a modelos de código abierto?

No. La API brinda acceso a familias de modelos patentados como GPT, Claude y Gemini junto con familias de peso abierto como Kimi, GLM, DeepSeek y MiMo. Utilice GET /models para enumerar los identificadores disponibles para su cuenta.

¿Cómo funciona el enrutamiento de modelos?

Su aplicación selecciona un modelo disponible en cada solicitud de API y TextCortex enruta la solicitud a través de su API. Puede elegir diferentes modelos para diferentes tareas. La selección automática y el comportamiento de reserva solo deben usarse cuando esté documentado para su configuración.

TextCortex AI

Una integración. Tu elección de modelos.

Regístrese en TextCortex, cree una clave API y comience a construir con los modelos que su aplicación necesita.

Fuentes y documentación

Documentación del producto y fuentes de los proveedores utilizadas en esta guía. Revisadas el 5 de octubre de 2026.