Precios de los LLM para programar en 2026: API, suscripciones y límites de uso

Comparativa de Z.AI, Kimi Code, OpenAI, Anthropic, Gemini, GitHub Copilot y Muse Code. Precios consultados el 16 de agosto de 2026, en USD salvo los precios en EUR de España, que se indican como tales.

Los precios de los modelos de lenguaje cambian con mucha frecuencia. Además, no todos los proveedores venden lo mismo: algunos cobran por tokens mediante una API, mientras que otros ofrecen una suscripción mensual para utilizar un asistente de programación.

Esta diferencia es importante. Una suscripción de 20 dólares al mes no equivale necesariamente a una cantidad fija de tokens, y una ventana de contexto de un millón de tokens no significa que tengamos un millón de tokens gratuitos cada mes.

Todos los precios de este artículo están en dólares (USD) salvo indicación contraria y son precios de lista antes de impuestos: no incluyen el IVA español (21%) ni otros impuestos locales. En España, los proveedores suelen mostrar los precios en euros e impuestos incluidos; comprueba siempre el total del checkout en tu país.

El mercado cibernético

Resumen rápido

  • Para API de bajo coste, Z.AI destaca con sus modelos GLM económicos.
  • GitHub Copilot sigue siendo la entrada más sencilla para quien quiere programar dentro del IDE, aunque el plan básico solo ofrece modelos muy pobres o consumos de tokens muy limitados en los modelos frontera.
  • Claude y ChatGPT ofrecen planes individuales y niveles de uso intensivo, pero sus límites de suscripción son dinámicos.
  • Kimi Code destaca por anunciar hasta un millón de tokens de contexto en Kimi K3.
  • Muse Code es el harness de Meta para Muse-Spark. No tiene suscripción y el modelo contributor no está disponible en España.
  • La caché de prompts puede cambiar mucho el coste de los agentes que reenvían continuamente el mismo contexto.

Cómo interpretar los precios

En las APIs hay tres cifras principales:

  • Input: tokens enviados al modelo.
  • Output: tokens generados por el modelo.
  • Input cacheado: contexto repetido que el proveedor puede facturar con descuento.

En las suscripciones encontramos otras unidades:

  • Mensajes o solicitudes.
  • Créditos de IA.
  • Solicitudes premium.
  • Límites temporales, como cinco horas o una semana.
  • Multiplicadores de uso respecto a otro plan.

Por eso no es correcto convertir automáticamente “5× más uso”, “2.000 créditos” o “50 chats” en una cantidad concreta de tokens.

Tabla 1: precios de API

Precios orientativos por millón de tokens a fecha de hoy.

Proveedor Modelo Input Output Caché/input cacheado Estado
Z.AI GLM-5.2 $1,40 $4,40 $0,26 Verificado en la tabla oficial consultada.[1]
Z.AI GLM-4.7-FlashX $0,07 $0,40 $0,01 Verificado en la tabla oficial consultada.[1]
OpenAI GPT-5.6 sol $5,00 $30,00 $0,50 [4][5]
OpenAI GPT-5.6 Terra $2,00 $12,00 $0,20 Modelo equilibrado para trabajo eficiente y de alto volumen
OpenAI GPT-5.6 Luna $0,20 $1,20 $0,02 Modelo rápido y económico para el trabajo diario
Anthropic Claude Fable 5 $10 $50 $1; escrituras $12,50/5 min o $20/1 h Precio de API documentado.[10]
Anthropic Claude Opus 5 $5 $25 $0,50; escrituras $6,25/5 min o $10/1 h Precio de API documentado.[10]
Anthropic Claude Sonnet 5 $2 $10 $0,20; escrituras $2,50/5 min o $4/1 h Precio estándar, no subirá a $3/$15.[10]
Anthropic Claude Haiku 4.5 $1 $5 $0,10; escrituras $1,25/5 min o $2/1 h Precio de API documentado.[10]
Google Gemini 3.5 Flash $1,50 $9,00 $0,15 Página oficial de precios consultada el 16/08/2026. También disponible Gemini 3.7 Flash a $1,50/$7,50.[8]
Kimi Kimi K3 $3,00 $15,00 $0,30 Verificado el 16/08/2026 en el help center oficial de Kimi; la caché es de lectura, con descuento del 90%.[11]
Meta Muse-Spark $1,25 $4,25 $0,15 Verificado el 16/08/2026 en la documentación oficial de Meta Model API; la caché de lectura se aplica automáticamente.[12]

La columna de caché corresponde a la lectura de tokens cacheados. Anthropic cobra además las escrituras de caché (1,25× para 5 minutos y 2× para una hora) y su Batch API aplica un 50% de descuento: ver la sección de Anthropic.[10]

La fórmula para calcular una tarea es:

coste = (tokens de entrada × precio de entrada
       + tokens cacheados × precio de caché
       + tokens de salida × precio de salida) / 1.000.000

Tabla 2: suscripciones para programar

Proveedor / plan Precio orientativo Límite o unidad de uso Estado
GitHub Copilot Free $0 2.000 completados y 50 solicitudes de chat Publicado por GitHub.[7]
GitHub Copilot Pro $10/mes Uso incluido y créditos premium Verificar condiciones actuales.[7]
GitHub Copilot Pro+ $39/mes Más créditos y modelos premium Verificar condiciones actuales.[7]
Copilot Business $19/usuario/mes Créditos y administración empresarial Publicado por GitHub.[7]
Copilot Enterprise $39/usuario/mes Créditos y funciones empresariales Publicado por GitHub.[7]
ChatGPT Plus €23/mes (IVA incluido, España); referencia US$20 Límites dinámicos; incluye herramientas de programación y agentes Verificado con prensa española y cuentas reales (julio-agosto de 2026); la página oficial muestra EUR con IVA.[4][14]
ChatGPT Pro €229/mes (IVA incluido, España); referencia US$200 Uso 20× el de Plus (también existe un nivel Pro de US$100, con uso 5×) Verificado con prensa española (julio-agosto de 2026); la página oficial muestra EUR con IVA.[4][14]
Z.AI Lite $12,60/mes con facturación anual (-30%); $18/mes de referencia 10.000 créditos semanales; iteración ligera en repositorios pequeños Verificado en z.ai/subscribe el 16/08/2026; la facturación trimestral aplica -20%.[1]
Z.AI Pro $56/mes con facturación anual (-30%); $80/mes de referencia 6× el uso de Lite; repositorios medianos; mayor velocidad Verificado en z.ai/subscribe el 16/08/2026; la facturación trimestral aplica -20%.[1]
Z.AI Max $117,60/mes con facturación anual (-30%); $168/mes de referencia 14× el uso de Lite; repositorios medianos y grandes; recursos dedicados Verificado en z.ai/subscribe el 16/08/2026; la facturación trimestral aplica -20%.[1]
Kimi Moderato $19/mes; $15/mes equivalente anual 1× créditos Agent; Kimi Code disponible Verificado el 16/08/2026 en el help center oficial de Kimi.[2][3][15]
Kimi Allegretto $39/mes; $31/mes equivalente anual 2× créditos Agent; Kimi Code disponible Verificado el 16/08/2026 en el help center oficial de Kimi.[2][3][15]
Kimi Allegro $99/mes; $79/mes equivalente anual 5× créditos Agent; contexto de hasta 1 M de tokens Verificado el 16/08/2026 en el help center oficial de Kimi.[2][3][15]
Kimi Vivace $199/mes; $159/mes equivalente anual 10× créditos Agent; contexto de hasta 1 M de tokens Verificado el 16/08/2026 en el help center oficial de Kimi.[2][3][15]
Claude Pro $20/mes; $16,67/mes con facturación anual ($200 facturados por adelantado) Más uso que el plan gratuito; incluye Claude Code Precio de suscripción publicado; cuota exacta dinámica.[6]
Claude Max 5× / 20× Desde $100/mes Elección de 5× o 20× más uso que Pro; límites de generación más altos Precio de suscripción publicado; el importe no incluye impuestos.[6]
Google AI Pro / Ultra US$19,99/mes (AI Pro, referencia EE. UU.); variable por país Límites y prestaciones de Gemini, CLI y Code Assist Precio en España pendiente de verificar.[8]
Muse Code Sin suscripción; pago por uso Input $1,25/M tokens; input cacheado $0,15/M; output $4,25/M Verificado en la documentación oficial de Meta el 16/08/2026; contributor no disponible en España.[9][12]

El límite de tokens no siempre aparece en la suscripción

Para comparar correctamente hay que separar tres conceptos:

  1. Ventana de contexto: cantidad máxima de tokens que puede recibir una petición.
  2. Cuota de uso: cantidad de trabajo que permite el plan durante una ventana de tiempo.
  3. Precio API: coste por millón de tokens procesados.

Kimi K3 anuncia hasta un millón de tokens de contexto en los planes Allegro y Vivace.[2][3] Eso permite trabajar con repositorios o documentos muy grandes, pero no significa que el plan incluya un millón de tokens mensuales sin coste adicional.

Claude presenta sus planes Max como 5× o 20× más uso que Pro.[6] Es una referencia útil para comparar intensidad de uso, pero no debe interpretarse como cinco o veinte millones de tokens exactos.

GitHub Copilot utiliza una combinación de completados, chats, créditos y uso premium. En el plan gratuito publica 2.000 completados y 50 chats.[7]

ChatGPT, Gemini y Kimi Code no ofrecen en sus páginas públicas una cuota mensual fija y comparable de tokens para sus planes de suscripción. Muse Code no tiene suscripción: se utiliza mediante pago por uso de Muse-Spark. En los planes de suscripción, los límites pueden depender del modelo, la carga del servicio, la ventana temporal y el tipo de tarea.

Simulación: un refactor con contexto cacheado

Supongamos una única tarea de agente —por ejemplo, un refactor amplio de un módulo— con los siguientes consumos. Se trata de una simulación aritmética con supuestos hipotéticos, no de una prueba de rendimiento medida:

  • 500.000 tokens de entrada.
  • 90% de entrada cacheada.
  • 50.000 tokens de entrada normal.
  • 450.000 tokens cacheados.
  • 8.000 tokens de salida.

Con los precios de la Tabla 1, el coste aproximado de esa tarea sería:

Modelo Coste aproximado
OpenAI gpt-5.6-sol $0,72
Claude Opus 5 $0,68
Kimi K3 $0,41
GLM-5.2 $0,22
Muse-Spark $0,16

El coste resultante es por tarea individual, no por mes ni por proyecto completo. La conclusión general sí es válida: la caché puede reducir sustancialmente el coste de los agentes que reutilizan contexto. El ahorro exacto depende de la política de caché de cada proveedor y de la proporción real de tokens repetidos.

Lo más destacable de cada servicio

Z.AI

Z.AI ofrece algunos de los precios API más bajos del grupo. En la tabla oficial consultada, GLM-4.7-FlashX aparece con $0,07 por millón de tokens de entrada y $0,40 de salida, mientras que GLM-5.2 figura a $1,40/$4,40. A fecha de hoy, la página oficial del plan cita la familia GLM-5.3, GLM-5.2 y GLM-5-Turbo.[1]

También ofrece planes específicos para coding, compatibles con clientes como ZCode, Claude Code y otros entornos con agentes. Lite incluye 10.000 créditos semanales; Pro ofrece 6× el uso de Lite y Max 14×.[1]

La página muestra una tarifa con facturación anual un 30% más baja: $12,60 al mes para Lite, $56 para Pro y $117,60 para Max, frente a precios mensuales de referencia de $18, $80 y $168 respectivamente; la facturación trimestral aplica un descuento del 20%. Conviene revisar en el checkout qué modalidad se aplica a cada cuenta.[1]

Los tres planes incluyen acceso continuado a los modelos principales y funciones más recientes. Pro añade acceso prioritario y mayor velocidad; Max incorpora recursos dedicados durante los períodos de mayor demanda.[1] Los suscriptores del plan V2 pueden renovar o actualizar su plan antes de que expire.

Además, su modelo más nuevo y potente GLM-5.3 ya está disponible en los planes de suscripción (todavía no via api).

Kimi Code

Kimi Code incorpora Kimi K3 y está orientado a tareas de programación y agentes. Los planes Moderato, Allegretto, Allegro y Vivace incluyen acceso a Kimi Code.[2][3]

Los precios mensuales actuales son $19, $39, $99 y $199, respectivamente. Con facturación anual, la página muestra equivalentes mensuales de $15, $31, $79 y $159, que corresponden a totales anuales de $180, $372, $948 y $1.908.[2][3]

La cuota de Agent se expresa como multiplicador de créditos: 1× en Moderato, 2× en Allegretto, 5× en Allegro y 10× en Vivace. Allegro y Vivace ofrecen contexto de hasta un millón de tokens para conversaciones extralargas. Kimi Code tiene además un límite de tasa propio de cinco horas y una semana, independiente de la cuota de créditos.[2][3][15]

La página anuncia además un nuevo sistema de suscripción. Las ventajas de Kimi y Kimi Code se venderán por separado, aunque las suscripciones actuales no se verán afectadas. Esta información debe fecharse en el artículo porque puede cambiar cuando se lance el nuevo sistema.[2][3]

OpenAI

ChatGPT Plus y Pro son suscripciones de uso general que también pueden incluir herramientas de programación y agentes. La API de OpenAI se factura separadamente por modelo y tokens.[4][5]

En España, OpenAI muestra los precios en euros e impuestos incluidos: Plus a €23 al mes y Pro a €229 al mes, frente a las referencias de US$20 para Plus y de US$100 o US$200 para los dos niveles de Pro en Estados Unidos.[4][14]

La suscripción no debe confundirse con una bolsa fija de tokens. Los límites de ChatGPT son dinámicos y pueden cambiar según el modelo y la capacidad disponible.

Anthropic

Claude Pro cuesta $20 al mes con facturación mensual o $16,67 al mes con la suscripción anual, que se factura por adelantado a $200. Incluye Claude Code, Claude Cowork, Claude Research y proyectos ilimitados.[6]

Claude Max parte de $100 al mes y permite elegir entre 5× o 20× más uso que Pro. También ofrece límites de generación más altos y prioridad durante períodos de alta demanda, pero no publica una cuota mensual fija de tokens.[6]

Para integraciones propias existe además la API, con precios diferentes de los planes de Claude.

En la API, Claude Fable 5 cuesta $10 por millón de tokens de entrada y $50 de salida. Claude Opus 5 cuesta $5/$25, Claude Sonnet 5 $2/$10 y Claude Haiku 4.5 $1/$5.[10]

Anthropic cobra las escrituras de caché de 5 minutos a 1,25× del precio base y las de una hora a 2×. Las lecturas de caché cuestan 0,1× del precio base de entrada.[10] La Batch API aplica un descuento del 50% a los tokens de entrada y salida.[10]

Los modelos Claude 4.6 y posteriores ofrecen una ventana de contexto de hasta un millón de tokens a precios estándar. Es una ventana de contexto, no una cuota mensual incluida en una suscripción.[10]

Gemini

Google ofrece Gemini mediante suscripciones de Google AI y mediante API. La API tiene niveles gratuitos y de pago según el modelo, mientras que los límites de las aplicaciones y herramientas de programación pueden ser diferentes.[8]

En la API, Gemini 3.5 Flash cuesta $1,50 por millón de tokens de entrada y $9,00 de salida, con entrada cacheada a $0,15; el modelo más reciente, Gemini 3.7 Flash, está a $1,50/$7,50. Las suscripciones de Google AI arrancan en US$19,99 al mes (nivel AI Pro, referencia de EE. UU.).[8]

Conviene comprobar especialmente si una promoción es temporal y si el precio mostrado corresponde a España, a otro país o a una modalidad anual.

GitHub Copilot

Copilot es la opción más integrada para quien ya trabaja con GitHub y un IDE compatible. El plan gratuito publica 2.000 completados y 50 solicitudes de chat, mientras que los planes de pago añaden créditos, modelos premium y funciones de agente.[7]

Para empresas, Business y Enterprise añaden administración y controles organizativos.

Desgraciadamente los consumos de tokens se han limitado infinitamente desde que hicieron el cambio a facturación por uso con unos límites absurdos que, por ejemplo, hacen que la suscripción básica mensual se consuma en una sola sesión de dos horas de claude.

Muse Code y Muse-Spark

Muse Code es el harness de Meta para trabajar con Muse-Spark. No tiene suscripción y se factura por uso: $1,25 por millón de tokens de entrada, $0,15 de entrada cacheada (se aplica automáticamente a cualquier prefijo estable) y $4,25 de salida, precios verificados el 16/08/2026 en la documentación oficial de Meta Model API.[9][12]

El modelo contributor no está disponible en España, por lo que no se incluye en la comparación ni en la simulación de costes.

La instalación oficial se realiza desde el terminal con:

curl -fsSL https://dev.meta.ai/install.sh | bash

Comando confirmado el 16/08/2026 en el anuncio de Meta y en la documentación de dev.meta.ai; Muse Code está en beta desde el 5 de agosto de 2026 y la autenticación se completa en el navegador.[13][12]

¿Qué elegir?

  • Uso ocasional o presupuesto cero: empezar por Copilot Free y comprobar las capas gratuitas de Gemini o Z.AI.
  • Programador individual: comparar Copilot Pro, ChatGPT Plus y Claude Pro según el IDE, el agente y los límites reales.
  • Uso intensivo de agentes: valorar Claude Max, ChatGPT Pro, Copilot Pro+/Max o los planes de coding de Z.AI.
  • Aplicaciones propias: utilizar APIs y medir tokens de entrada, caché y salida.
  • Repositorios muy grandes: prestar atención a la ventana de contexto, pero sin confundirla con la cuota mensual.
  • Datos sensibles: revisar expresamente si el proveedor utiliza las entradas para mejorar o entrenar sus modelos y qué controles ofrece cada plan.

Deja un comentario

Este sitio usa Akismet para reducir el spam. Aprende cómo se procesan los datos de tus comentarios.