Economía de tokens
Cuánto cuesta un millón de tokens, y por qué el techo y el piso se mueven en direcciones opuestas
El precio de un nivel fijo de capacidad cae unas 13 veces al año. El precio del modelo frontera más nuevo tocó fondo en agosto de 2025 y desde entonces sube. Los modelos de pesos abiertos corren en una GPU de gamer por centavos. Esta página le sigue la pista a todo eso desde fuentes primarias, se actualiza cada semana y entrega cada serie en JSON.
Edición 2 · datos al 2026-09-27 · se actualiza semanalmente · /api/token-economics
Lee el ensayo: el techo se mantiene alto, la audiencia se encoge, el piso se va a cero →
Esta edición
2026-09-27
Verification pass run the same day as edition 1's launch; no material change to any series. Checked provider pricing pages, Artificial Analysis, OpenRouter, and METR for anything published since edition 1 and found only confirmations of figures already recorded, so every series is left as-is this edition.
- OpenAI GPT-6 Astra ($10/$50, launched 2026-09-03), GPT-6 Sol ($2/$10) and GPT-6 Luna ($0.10/$0.50), both launched 2026-09-22, already match the recorded tierLadder (https://developers.openai.com/api/docs/pricing).
- Anthropic Claude Fable 5.1 ($10/$50, launched 2026-09-01) and Claude Opus 5.5 ($4/$20 flagship tier, launched 2026-09-22) already match the recorded frontier and tierLadder rows (https://platform.claude.com/docs/en/about-claude/pricing).
- Google Gemini 3.8 Flash intro pricing ($0.75/$3.75 input/output through 2026-12-31, reverting to $1.50/$7.50) already matches the recorded tierLadder note (https://ai.google.dev/gemini-api/docs/pricing).
- 2026 hyperscaler capex guidance reconfirmed in the same range already on file: Amazon ~$200B, Alphabet $195-205B (one report cites 'as much as $205B'), Meta $130-145B (https://www.globaldatacenterhub.com/p/microsoft-q3-fy2026-the-190b-capex, https://valueaddvc.com/blog/meta-145b-ai-capex-2026-why-zuckerberg-raised-guidance-twice).
- METR's Time Horizon 1.1 methodology (the source already cited for metrHorizons/metrNotes) remains the latest published update; no new dated model horizon point has been released since edition 1 (https://metr.org/blog/2026-1-29-time-horizon-1-1/).
- No new open-weight leaderboard score, OpenRouter volume figure, or enterprise usage marker was found beyond what edition 1 already recorded.
Dos velocidades: la frontera frente a una capacidad fija
Precio de salida del modelo frontera más nuevo de OpenAI contra el precio de una capacidad nivel GPT-4 de quien la venda más barata. Los mismos tokens, direcciones opuestas.
Precio del modelo frontera más nuevo por proveedor
El modelo tope (no Pro) más nuevo de cada proveedor, precio de lista por millón de tokens, en escala logarítmica. Los precios cayeron dos años y luego cada proveedor agregó un nivel por encima de su tope anterior.
La escalera de precios hoy
Todos los niveles que vende cada proveedor ahora mismo, por millón de tokens en escala logarítmica. Mira la distancia entre el punto de arriba y el de abajo: esa es la prima por el modelo más nuevo.
Qué tan rápido se abarata una capacidad fija
Caídas medidas en el precio de alcanzar un puntaje dado en un benchmark. Epoch AI pone la tasa compuesta en 47 % por trimestre, unas 13 veces al año.
Quién compra el nivel tope, y cuánto
Los marcadores detrás del argumento de demanda: los agentes corren en el modelo insignia, el nivel ultra premium se adopta despacio y unos cientos de clientes pagan por todo.
- Fable 5 share of Anthropic tokens / spend on Ramp, one month after launch
- 6% / 11.4%
- Jul 2026 · ramp.com
- Cursor Router cost per commit: Balance / Opus 4.8 / Fable 5
- $4.63 / $7.34 / $12.69
- Jul 2026 · cursor.com
Ingresos anualizados de Anthropic, $B
Horizonte de tiempo METR al 50 % de éxito
Qué tan larga es la tarea de software que un modelo completa con 50 % de éxito, en la suite de METR, escala logarítmica. La línea punteada se duplica cada 131 días. Los puntos huecos son estimaciones secundarias. Nada aquí mide una semana de trabajo, y los horizontes al 80 % son unas 5 veces más cortos.
* estimación secundaria
Pesos abiertos vs modelos cerrados: precio por puntaje
Índice de inteligencia de Artificial Analysis contra precio combinado por millón de tokens (log). Los modelos abiertos quedan de cinco a quince puntos atrás a una décima o una cincuentava parte del precio.
Cuánto cuesta el piso
Precios de modelos abiertos alojados y costos marginales de autoalojar, septiembre de 2026. Una docena de hosts cobra el mismo $0.15/$0.60 por el mismo modelo: así se ve un mercado de commodities.
| Configuración | entrada | salida | Nota |
|---|---|---|---|
| gpt-oss-120b, cheapest hosts (AkashML, CoreWeave, FlexAI) | $0.03 | $0.17 | 24 providers listed |
| gpt-oss-120b, modal price (Together, Groq, Nebius, Azure, Bedrock, OpenRouter) | $0.15 | $0.6 | |
| gpt-oss-120b, Cerebras | $0.35 | $0.75 | ~1,700-3,000 tok/s |
| Llama 3.1 8B (Groq) | $0.05 | $0.08 | Apr 2026 |
| Llama 3.3 70B (Groq) | $0.59 | $0.79 | Apr 2026 |
| DeepSeek V4.1 Flash, official (peak / off-peak) | $0.3 | $1.20 | off-peak $0.15 / $0.60 |
| DeepSeek V4 Pro, official (peak / off-peak) | $1.32 | $3.96 | off-peak $0.66 / $1.98 |
| GLM-5.3 Flash (OpenRouter) | $0.15 | $0.5 | #1 by weekly tokens, Sep 2026 |
| Datacenter TCO, 397B MoE on TPU v7 (SemiAnalysis) | $0.181 | total $/M at 100 tok/s per user; B200 $0.222, B300 $0.276 | |
| Owned RTX 4090, Qwen 3.8 27B, batched, 100% utilisation | $0.28 | $1.03 at 20% utilisation | |
| Rented RTX 5090 ($0.76/h), Llama 3.1 8B, batch 32 | $0.06 |
Calculadora de autoalojamiento
Costo por millón de tokens de salida en una GPU propia, en función de qué tan ocupada la mantengas. El hardware se amortiza a tres años; la energía se cobra por token. Mueve los controles.
Tu costo por millón de tokens de salida
$0.72/M
Le gana a la API por encima del 12 % de utilización.
RTX 4090 · Qwen 3.8 27B, 16 concurrent requests · 300 W · 3 y
Capex de los hyperscalers
Capex en efectivo por empresa y año, con 2026 como guía. El muro de capital es la verdadera barrera de entrada.
Miles de millones de USD. Microsoft en año fiscal a junio para 2023-2025 y guía calendario para 2026; Oracle en año fiscal a mayo corrido un año; Oracle 2026 no capturado.
Volúmenes de tokens
Rendimiento reportado por las empresas, en escala logarítmica. El volumen crece 5-7 veces al año mientras los precios del piso caen: así se ve un commodity.
Google, billones de tokens por mes
OpenRouter, billones de tokens por semana
Historial de cambios
Edición 2 · 2026-09-27
Verification pass run the same day as edition 1's launch; no material change to any series. Checked provider pricing pages, Artificial Analysis, OpenRouter, and METR for anything published since edition 1 and found only confirmations of figures already recorded, so every series is left as-is this edition.
- OpenAI GPT-6 Astra ($10/$50, launched 2026-09-03), GPT-6 Sol ($2/$10) and GPT-6 Luna ($0.10/$0.50), both launched 2026-09-22, already match the recorded tierLadder (https://developers.openai.com/api/docs/pricing).
- Anthropic Claude Fable 5.1 ($10/$50, launched 2026-09-01) and Claude Opus 5.5 ($4/$20 flagship tier, launched 2026-09-22) already match the recorded frontier and tierLadder rows (https://platform.claude.com/docs/en/about-claude/pricing).
- Google Gemini 3.8 Flash intro pricing ($0.75/$3.75 input/output through 2026-12-31, reverting to $1.50/$7.50) already matches the recorded tierLadder note (https://ai.google.dev/gemini-api/docs/pricing).
- 2026 hyperscaler capex guidance reconfirmed in the same range already on file: Amazon ~$200B, Alphabet $195-205B (one report cites 'as much as $205B'), Meta $130-145B (https://www.globaldatacenterhub.com/p/microsoft-q3-fy2026-the-190b-capex, https://valueaddvc.com/blog/meta-145b-ai-capex-2026-why-zuckerberg-raised-guidance-twice).
- METR's Time Horizon 1.1 methodology (the source already cited for metrHorizons/metrNotes) remains the latest published update; no new dated model horizon point has been released since edition 1 (https://metr.org/blog/2026-1-29-time-horizon-1-1/).
- No new open-weight leaderboard score, OpenRouter volume figure, or enterprise usage marker was found beyond what edition 1 already recorded.
Edición 1 · 2026-09-27
First edition. Six research strands compiled into the dataset: frontier and mid-tier price history, price-to-capability decline, hyperscaler capex, METR horizons, token volumes, open-weight and self-hosted prices, and enterprise usage markers.
- GPT-6 Astra ($10/$50) and Opus 5.5 ($4/$20) added as the newest frontier prices; Fable 5.1 unchanged at $10/$50.
- DeepSeek V4 Pro peak pricing ($1.32/$3.96) recorded after the August increase.
- OpenRouter weekly volume ~134T tokens (17-22 Sep 2026), top ten all at $0.84 input or less.
- Capex 2026 guidance: Microsoft ~$190B, Alphabet $195-205B, Amazon ~$200B, Meta $130-145B.
Método: los precios son precios de lista por millón de tokens tomados de las páginas de precios y anuncios de lanzamiento de cada proveedor; el capex sale de los reportes de resultados y filings; los horizontes son mediciones de METR time-horizon 1.1; los volúmenes los reportan las propias empresas. Las cifras marcadas como secundarias vienen de prensa o de rastreadores de terceros cuando no se pudo consultar la página primaria. Cada gráfica tiene vista de tabla y cada cifra su fuente.