Economía de tokens

Cuánto cuesta un millón de tokens, y por qué el techo y el piso se mueven en direcciones opuestas

El precio de un nivel fijo de capacidad cae unas 13 veces al año. El precio del modelo frontera más nuevo tocó fondo en agosto de 2025 y desde entonces sube. Los modelos de pesos abiertos corren en una GPU de gamer por centavos. Esta página le sigue la pista a todo eso desde fuentes primarias, se actualiza cada semana y entrega cada serie en JSON.

Edición 2 · datos al 2026-09-27 · se actualiza semanalmente · /api/token-economics

Lee el ensayo: el techo se mantiene alto, la audiencia se encoge, el piso se va a cero →

Esta edición

2026-09-27

Verification pass run the same day as edition 1's launch; no material change to any series. Checked provider pricing pages, Artificial Analysis, OpenRouter, and METR for anything published since edition 1 and found only confirmations of figures already recorded, so every series is left as-is this edition.

  • OpenAI GPT-6 Astra ($10/$50, launched 2026-09-03), GPT-6 Sol ($2/$10) and GPT-6 Luna ($0.10/$0.50), both launched 2026-09-22, already match the recorded tierLadder (https://developers.openai.com/api/docs/pricing).
  • Anthropic Claude Fable 5.1 ($10/$50, launched 2026-09-01) and Claude Opus 5.5 ($4/$20 flagship tier, launched 2026-09-22) already match the recorded frontier and tierLadder rows (https://platform.claude.com/docs/en/about-claude/pricing).
  • Google Gemini 3.8 Flash intro pricing ($0.75/$3.75 input/output through 2026-12-31, reverting to $1.50/$7.50) already matches the recorded tierLadder note (https://ai.google.dev/gemini-api/docs/pricing).
  • 2026 hyperscaler capex guidance reconfirmed in the same range already on file: Amazon ~$200B, Alphabet $195-205B (one report cites 'as much as $205B'), Meta $130-145B (https://www.globaldatacenterhub.com/p/microsoft-q3-fy2026-the-190b-capex, https://valueaddvc.com/blog/meta-145b-ai-capex-2026-why-zuckerberg-raised-guidance-twice).
  • METR's Time Horizon 1.1 methodology (the source already cited for metrHorizons/metrNotes) remains the latest published update; no new dated model horizon point has been released since edition 1 (https://metr.org/blog/2026-1-29-time-horizon-1-1/).
  • No new open-weight leaderboard score, OpenRouter volume figure, or enterprise usage marker was found beyond what edition 1 already recorded.

Dos velocidades: la frontera frente a una capacidad fija

Precio de salida del modelo frontera más nuevo de OpenAI contra el precio de una capacidad nivel GPT-4 de quien la venda más barata. Los mismos tokens, direcciones opuestas.

Fuentes: epoch.ai, developers.openai.com

Precio del modelo frontera más nuevo por proveedor

El modelo tope (no Pro) más nuevo de cada proveedor, precio de lista por millón de tokens, en escala logarítmica. Los precios cayeron dos años y luego cada proveedor agregó un nivel por encima de su tope anterior.

Fuentes: developers.openai.com, platform.claude.com, ai.google.dev, docs.x.ai, api-docs.deepseek.com, mistral.ai

La escalera de precios hoy

Todos los niveles que vende cada proveedor ahora mismo, por millón de tokens en escala logarítmica. Mira la distancia entre el punto de arriba y el de abajo: esa es la prima por el modelo más nuevo.

Fuentes: developers.openai.com, platform.claude.com, ai.google.dev

Qué tan rápido se abarata una capacidad fija

Caídas medidas en el precio de alcanzar un puntaje dado en un benchmark. Epoch AI pone la tasa compuesta en 47 % por trimestre, unas 13 veces al año.

Fuentes: a16z.com, hai.stanford.edu, epoch.ai, epoch.ai, r40.io, epoch.ai

Quién compra el nivel tope, y cuánto

Los marcadores detrás del argumento de demanda: los agentes corren en el modelo insignia, el nivel ultra premium se adopta despacio y unos cientos de clientes pagan por todo.

Opus share of Claude Code sessions vs chat
54% vs 10%
Jun 2026 · anthropic.com
Fable 5 share of Anthropic tokens / spend on Ramp, one month after launch
6% / 11.4%
Jul 2026 · ramp.com
Top 1% of customers' share of revenue (OpenAI, Anthropic)
80%
2026 · pymnts.com
Open-source share of enterprise LLM usage
19% (2024) → 11% (2025)
2025 · menlovc.com
US labs' share of OpenRouter tokens
~70% (Jun 2025) → ~30% (Jun 2026)
Jun 2026 · pro.stockalarm.io
Cursor Router cost per commit: Balance / Opus 4.8 / Fable 5
$4.63 / $7.34 / $12.69
Jul 2026 · cursor.com
OpenRouter price elasticity
+0.5-0.7% usage per 10% price cut
2025 · openrouter.ai
Enterprise deployments that are true agents
16%
2025 · menlovc.com

Ingresos anualizados de Anthropic, $B

Horizonte de tiempo METR al 50 % de éxito

Qué tan larga es la tarea de software que un modelo completa con 50 % de éxito, en la suite de METR, escala logarítmica. La línea punteada se duplica cada 131 días. Los puntos huecos son estimaciones secundarias. Nada aquí mide una semana de trabajo, y los horizontes al 80 % son unas 5 veces más cortos.

* estimación secundaria

Fuentes: metr.org

Pesos abiertos vs modelos cerrados: precio por puntaje

Índice de inteligencia de Artificial Analysis contra precio combinado por millón de tokens (log). Los modelos abiertos quedan de cinco a quince puntos atrás a una décima o una cincuentava parte del precio.

Fuentes: artificialanalysis.ai

Cuánto cuesta el piso

Precios de modelos abiertos alojados y costos marginales de autoalojar, septiembre de 2026. Una docena de hosts cobra el mismo $0.15/$0.60 por el mismo modelo: así se ve un mercado de commodities.

ConfiguraciónentradasalidaNota
gpt-oss-120b, cheapest hosts (AkashML, CoreWeave, FlexAI)$0.03$0.1724 providers listed
gpt-oss-120b, modal price (Together, Groq, Nebius, Azure, Bedrock, OpenRouter)$0.15$0.6
gpt-oss-120b, Cerebras$0.35$0.75~1,700-3,000 tok/s
Llama 3.1 8B (Groq)$0.05$0.08Apr 2026
Llama 3.3 70B (Groq)$0.59$0.79Apr 2026
DeepSeek V4.1 Flash, official (peak / off-peak)$0.3$1.20off-peak $0.15 / $0.60
DeepSeek V4 Pro, official (peak / off-peak)$1.32$3.96off-peak $0.66 / $1.98
GLM-5.3 Flash (OpenRouter)$0.15$0.5#1 by weekly tokens, Sep 2026
Datacenter TCO, 397B MoE on TPU v7 (SemiAnalysis)$0.181total $/M at 100 tok/s per user; B200 $0.222, B300 $0.276
Owned RTX 4090, Qwen 3.8 27B, batched, 100% utilisation$0.28$1.03 at 20% utilisation
Rented RTX 5090 ($0.76/h), Llama 3.1 8B, batch 32$0.06

Calculadora de autoalojamiento

Costo por millón de tokens de salida en una GPU propia, en función de qué tan ocupada la mantengas. El hardware se amortiza a tres años; la energía se cobra por token. Mueve los controles.

Tu costo por millón de tokens de salida

$0.72/M

Le gana a la API por encima del 12 % de utilización.

RTX 4090 · Qwen 3.8 27B, 16 concurrent requests · 300 W · 3 y

Fuentes: paraloncloud.com

Capex de los hyperscalers

Capex en efectivo por empresa y año, con 2026 como guía. El muro de capital es la verdadera barrera de entrada.

Miles de millones de USD. Microsoft en año fiscal a junio para 2023-2025 y guía calendario para 2026; Oracle en año fiscal a mayo corrido un año; Oracle 2026 no capturado.

Fuentes: insight.factset.com

Volúmenes de tokens

Rendimiento reportado por las empresas, en escala logarítmica. El volumen crece 5-7 veces al año mientras los precios del piso caen: así se ve un commodity.

Google, billones de tokens por mes

OpenRouter, billones de tokens por semana

Fuentes: blog.google, investing.com, teamday.ai

Historial de cambios

  1. Edición 2 · 2026-09-27

    Verification pass run the same day as edition 1's launch; no material change to any series. Checked provider pricing pages, Artificial Analysis, OpenRouter, and METR for anything published since edition 1 and found only confirmations of figures already recorded, so every series is left as-is this edition.

    • OpenAI GPT-6 Astra ($10/$50, launched 2026-09-03), GPT-6 Sol ($2/$10) and GPT-6 Luna ($0.10/$0.50), both launched 2026-09-22, already match the recorded tierLadder (https://developers.openai.com/api/docs/pricing).
    • Anthropic Claude Fable 5.1 ($10/$50, launched 2026-09-01) and Claude Opus 5.5 ($4/$20 flagship tier, launched 2026-09-22) already match the recorded frontier and tierLadder rows (https://platform.claude.com/docs/en/about-claude/pricing).
    • Google Gemini 3.8 Flash intro pricing ($0.75/$3.75 input/output through 2026-12-31, reverting to $1.50/$7.50) already matches the recorded tierLadder note (https://ai.google.dev/gemini-api/docs/pricing).
    • 2026 hyperscaler capex guidance reconfirmed in the same range already on file: Amazon ~$200B, Alphabet $195-205B (one report cites 'as much as $205B'), Meta $130-145B (https://www.globaldatacenterhub.com/p/microsoft-q3-fy2026-the-190b-capex, https://valueaddvc.com/blog/meta-145b-ai-capex-2026-why-zuckerberg-raised-guidance-twice).
    • METR's Time Horizon 1.1 methodology (the source already cited for metrHorizons/metrNotes) remains the latest published update; no new dated model horizon point has been released since edition 1 (https://metr.org/blog/2026-1-29-time-horizon-1-1/).
    • No new open-weight leaderboard score, OpenRouter volume figure, or enterprise usage marker was found beyond what edition 1 already recorded.
  2. Edición 1 · 2026-09-27

    First edition. Six research strands compiled into the dataset: frontier and mid-tier price history, price-to-capability decline, hyperscaler capex, METR horizons, token volumes, open-weight and self-hosted prices, and enterprise usage markers.

    • GPT-6 Astra ($10/$50) and Opus 5.5 ($4/$20) added as the newest frontier prices; Fable 5.1 unchanged at $10/$50.
    • DeepSeek V4 Pro peak pricing ($1.32/$3.96) recorded after the August increase.
    • OpenRouter weekly volume ~134T tokens (17-22 Sep 2026), top ten all at $0.84 input or less.
    • Capex 2026 guidance: Microsoft ~$190B, Alphabet $195-205B, Amazon ~$200B, Meta $130-145B.

Método: los precios son precios de lista por millón de tokens tomados de las páginas de precios y anuncios de lanzamiento de cada proveedor; el capex sale de los reportes de resultados y filings; los horizontes son mediciones de METR time-horizon 1.1; los volúmenes los reportan las propias empresas. Las cifras marcadas como secundarias vienen de prensa o de rastreadores de terceros cuando no se pudo consultar la página primaria. Cada gráfica tiene vista de tabla y cada cifra su fuente.