Después de un sorprendente debut la semana pasada con capacidades cibernéticas tan avanzadas que supuestamente descubrieron una vulnerabilidad no detectada previamente en Cursor, GLM-5.3, el nuevo modelo de lenguaje de código abierto de la startup china z.ai, ahora ha llegado a la interfaz de programación de aplicaciones (API), lo que permite a los desarrolladores construir sobre él y conectarlo a sus agentes y aplicaciones.
Los desarrolladores que ya se han suscrito a un plan de codificación GLM están actualmente limitados al protocolo compatible con OpenAI Chat Completions. Z.ai ha anunciado planes para hacer que los pesos de los modelos estén disponibles abiertamente, pero aún está por verse una fecha específica y una licencia.
En la API, el precio no cambia en comparación con GLM-5.2: 1,40 dólares por millón de tokens de entrada y 4,40 dólares por millón de tokens de salida. El almacenamiento en caché de entrada cuesta 0,26 dólares por millón de tokens, mientras que Z.ai actualmente enumera el almacenamiento en caché de entrada como gratuito por un tiempo limitado.
Esto significa que los desarrolladores pueden actualizar a la próxima generación sin aceptar una tarifa más alta por token publicado de Z.ai, a pesar de que la compañía afirma tener una codificación y un rendimiento del agente a largo plazo significativamente mejores. A estos precios, GLM-5.3 está muy por debajo de varias de las API de frontera más premium.
|
Modelo |
Entrada ($/1 millón) |
Producción ($/1 millón) |
Total ($/1 millón) |
Fuente |
|
Colaborador Muse Spark 1.2 |
$0.10 |
$0.20 |
$0.30 |
Meta |
|
Flash MiMo-V2.5 |
$0.10 |
$0.30 |
$0.40 |
Xiaomi |
|
DeepSeek-V4-Flash: horas de menor actividad |
$0.22 |
$0,66 |
$0,88 |
búsqueda profunda |
|
Luna GPT-5.6 |
$0.20 |
$1.20 |
$1.40 |
AbiertoAI |
|
MiniMax-M3 |
$0.30 |
$1.20 |
$1.50 |
minimax |
|
LongCat-2.0: promoción por tiempo limitado |
$0.30 |
$1.20 |
$1.50 |
gato largo |
|
DeepSeek-V4-Flash: horas pico |
$0.44 |
$1.32 |
$1.76 |
búsqueda profunda |
|
MiMo V2.5 |
$0.40 |
$2.00 |
$2.40 |
Xiaomi |
|
DeepSeek-V4-Pro: horas de menor actividad |
$0,66 |
$1.98 |
$2.64 |
búsqueda profunda |
|
LongCat-2.0 — estándar |
$0,75 |
$2.95 |
$3.70 |
gato largo |
|
MiMo-V2.5 Pro (≤256K) |
$1.00 |
$3.00 |
$4.00 |
Xiaomi |
|
Gemini 3.6 Flash – hasta el 31 de diciembre de 2026 |
$0,75 |
$3.75 |
$4.50 |
|
|
Gemini 3.7 Flash – hasta el 31 de diciembre de 2026 |
$0,75 |
$3.75 |
$4.50 |
|
|
DeepSeek-V4-Pro: horas pico |
$1.32 |
$3.96 |
$5.28 |
búsqueda profunda |
|
Musa Chispa 1.1 / 1.2 |
$1.25 |
$4.25 |
$5.50 |
Meta |
|
GLM-5.3 |
$1.40 |
$4.40 |
$5.80 |
Z.AI |
|
Grok 4.6 — |
$2.00 |
$6.00 |
$8.00 |
xAI |
|
MiMo-V2.5 Pro (>256K) |
$2.00 |
$6.00 |
$8.00 |
Xiaomi |
|
Qwen3.8-Max |
$2.00 |
$6.00 |
$8.00 |
QwenNube |
|
Gemini 3.6 Flash: desde el 1 de enero de 2027 |
$1.50 |
$7.50 |
$9.00 |
|
|
Gemini 3.7 Flash: desde el 1 de enero de 2027 |
$1.50 |
$7.50 |
$9.00 |
|
|
GPT-5.6 Tierra |
$2.00 |
$12.00 |
$14.00 |
AbiertoAI |
|
Grok 4.6 – ≥200.000 tokens rápidos |
$4.00 |
$12.00 |
$16.00 |
xAI |
|
GPT-5.4 |
$2.50 |
$15.00 |
$17.50 |
AbiertoAI |
|
kimi k3 |
$3.00 |
$15.00 |
$18.00 |
IA disparada a la luna |
|
Cerrar trabajo 5 |
$5.00 |
$25.00 |
$30.00 |
antrópico |
|
Sakana Fugu Ultra (≤272K) |
$5.00 |
$30.00 |
$35.00 |
sección de IA |
|
GPT-5.6 Sol — Modo estándar |
$5.00 |
$30.00 |
$35.00 |
AbiertoAI |
|
Fábula de Claude 5 / Mito de Claude 5 |
$10.00 |
$50.00 |
$60.00 |
antrópico |
|
GPT-5.6 Sol — Modo rápido |
$10.00 |
$60.00 |
$70.00 |
AbiertoAI |
Usando la comparación simple de VentureBeat de un millón de tokens de entrada más un millón de tokens de salida, GLM-5.3 cuesta $5.80, en comparación con $8 de Grok 4.6 en su tasa emergente más baja, $18 de Kimi K3, $30 de Claude Opus 5 y $35 de GPT-5.6 Sol.
Esta no es una estimación del costo de la carga de trabajo (las facturas reales dependen en gran medida de la combinación de E/S, el almacenamiento en caché y el consumo de tokens), pero facilita ver el nivel de precio relativo de la API.
El GLM-5.3 no es el modelo más barato disponible. El precio de lanzamiento actual de Google para Gemini 3.7 Flash es de $0,75 por millón de tokens de entrada y $3,75 por millón de tokens de salida hasta el 31 de diciembre de 2026, mientras que GPT-5.6 Luna de OpenAI tiene un precio de $0,20 de entrada y $1,20 de salida.
Aún así, el precio de Z.ai coloca al GLM-5.3 en un rango de costos significativamente más bajo que los modelos de alta gama con los que se lo compara cada vez más.
Esta comparación se ha vuelto más relevante tras los últimos resultados independientes. El análisis artificial otorga al GLM-5.3 una puntuación de 60 en su índice de inteligencia, empatando al Kimi K3 como el modelo de pesos abiertos con mejor rendimiento del mundo y obteniendo siete puntos más que el GLM-5.2. I
El análisis de ts también estima que GLM-5.3 cuesta alrededor de 0,68 dólares por tarea del Índice de Inteligencia, en comparación con alrededor de 0,44 dólares para GLM-5.2, a pesar de los precios idénticos de los tokens API.
La diferencia resalta una advertencia importante sobre el precio general de la API: el análisis artificial encontró que GLM-5.3 es más detallado que su predecesor, por lo que el precio fijo por token no significa necesariamente costos fijos para una carga de trabajo completa.
Para los desarrolladores, sin embargo, el cambio inmediato es simple: GLM-5.3 ahora se puede llamar a través de la API de Z.ai a la misma tasa de token de $1,40/$4,40 por millón de GLM-5.2, brindando a los equipos otra opción relativamente económica para probar codificación de clase frontera y cargas de trabajo de agentes.
Suscríbete y recibe las historias más importantes del día.
Al suscribirte aceptas nuestros términos y condiciones y política de privacidad.












































































