Amazon Bedrock: Inteligencia vs Costo

Artículo

Amazon Bedrock: Inteligencia vs Costo

El catálogo de Amazon Bedrock no para de expandirse: hoy cuenta con más de 115 modelos en us-east-1. Sin embargo, para cualquier equipo de ingeniería o producto la pregunta clave sigue siendo la misma: ¿cuánta inteligencia compras realmente por cada dólar invertido y en qué punto vale la pena pagar más?

Para responder a esto, este análisis combina los precios oficiales on-demand de Bedrock[1] con las métricas públicas del Intelligence Index de Artificial Analysis (v4.3.2)[2]. El estudio abarca 53 modelos activos evaluados en 107 configuraciones (desglosando cada nivel de esfuerzo de razonamiento disponible), con fecha de corte al 20 de septiembre de 2026.

Cómo leer el gráfico

El gráfico enfrenta el costo de entrada frente a la capacidad de cada modelo:

  • Eje X (Costo): Precio por millón de tokens de entrada en escala logarítmica (USD, lista on-demand de Bedrock).
  • Eje Y (Inteligencia): Puntuación en el Intelligence Index.
  • Puntos y variantes: Cada punto representa un modelo. Cuando un modelo ofrece varios niveles de razonamiento (low, medium, high, max), se grafica un punto por cada nivel en la misma coordenada X: en Bedrock el costo por token de entrada no varía según el nivel de razonamiento, por lo que ese incremento vertical representa inteligencia adicional sin sobrecosto en el precio base de entrada.
  • Frontera de Pareto: Al activar el interruptor, se traza la línea de eficiencia óptima. Conecta los modelos para los cuales no existe alternativa en el catálogo que sea simultáneamente más barata y más inteligente.
AnthropicOpenAIAmazonOtros proveedores
Mostrar Pareto

Usa la rueda o pellizca para hacer zoom · arrastra para explorar · doble clic para restablecer

$0.01$0.02$0.05$0.1$0.2$0.5$1$2$5$10$20$50$1000204060Precio de entrada — $/1M tokens (escala log)Intelligence IndexNova MicroNVIDIA Nemotron Nano 9B v2 (reasoning)GLM 4.7 Flash (reasoning)GPT-5.6 Luna (max)Claude Sonnet 5 (max)Grok 4.6 (high)GPT-5.6 Sol (max)Claude Opus 5 (max)Claude Fable 5.1 (max)

Precio: tier estándar (≤272K tokens de input) de las fichas de modelo de Amazon Bedrock (docs.aws.amazon.com/bedrock/latest/userguide/model-cards.html), con la página general de pricing como respaldo cuando la ficha no trae su propia tabla, us-east-1. Índice de inteligencia: Artificial Analysis Intelligence Index v4.3.2 (artificialanalysis.ai). Cuando un modelo publica más de un nivel de esfuerzo de razonamiento, cada nivel es su propio punto — el precio de Bedrock no cambia con el esfuerzo, así que comparten x y se reparten en y. Un punto sobre la frontera no es dominado en precio ni en índice por ningún otro punto del set. Datos con corte al 20 de septiembre de 2026 — los catálogos de precio e índice cambian seguido, así que esto es una foto de ese día, no en vivo.

Top 10 por Intelligence Index

  1. 1Claude Fable 5.1 · max$1053.4
  2. 2Claude Fable 5.1 · xhigh$1053.2
  3. 3GPT-6 Astra · max$1152.7
  4. 4GPT-6 Astra · xhigh$1152.4
  5. 5Claude Fable 5.1 · high$1051.1
  6. 6GPT-6 Astra · high$1150.9
  7. 7Claude Opus 5 · max$550.8
  8. 8Claude Opus 5 · xhigh$549.7
  9. 9Claude Fable 5 · max$1049.6
  10. 10GPT-6 Astra · medium$1149.6
Ver los 107 puntos en tabla
ModeloEsfuerzoProveedor$/1M inputÍndice
Nova MicroAmazon$0.0355.88
NVIDIA Nemotron Nano 9B v2reasoningNVIDIA$0.067.43
NVIDIA Nemotron Nano 9B v2non-reasoningNVIDIA$0.066.84
Nova LiteAmazon$0.066.67
GLM 4.7 FlashreasoningZ.AI$0.0714.87
GLM 4.7 Flashnon-reasoningZ.AI$0.0710.56
gpt-oss-20blowOpenAI$0.079.95
gpt-oss-20bhighOpenAI$0.078.97
gpt-oss-120bhighOpenAI$0.1511.60
Qwen3 Next 80B A3BreasoningQwen$0.1511.20
gpt-oss-120blowOpenAI$0.1510.21
Qwen3-Coder-30B-A3B-InstructQwen$0.159.59
Qwen3 32B (dense)reasoningQwen$0.158.59
Qwen3 32B (dense)non-reasoningQwen$0.157.34
Ministral 3 8BMistral AI$0.155.48
Mistral 7B InstructMistral AI$0.155.03
Llama 4 Scout 17B InstructMeta$0.178.08
GPT-5.6 LunamaxOpenAI$0.2237.32
GPT-5.6 LunaxhighOpenAI$0.2234.56
GPT-5.6 LunahighOpenAI$0.2232.12
GPT-5.6 LunamediumOpenAI$0.2225.04
GPT-5.6 LunalowOpenAI$0.2221.01
GPT-5.6 Lunanon-reasoningOpenAI$0.2215.53
Llama 4 Maverick 17B InstructMeta$0.249.99
MiniMax M2.5MiniMax$0.322.80
MiniMax M2.1MiniMax$0.320.95
MiniMax M2MiniMax$0.318.63
Nova 2 LitehighAmazon$0.313.37
Nova 2 LitemediumAmazon$0.312.48
Nova 2 LitelowAmazon$0.311.80
Nova 2 Litenon-reasoningAmazon$0.38.74
Mixtral 8x7B InstructMistral AI$0.455.12
Mistral Large 3Mistral AI$0.59.27
Qwen3 Coder NextQwen$0.59.24
Qwen3 VL 235B A22BreasoningQwen$0.5313.44
Kimi K2.5reasoningMoonshot AI$0.623.46
GLM 4.7reasoningZ.AI$0.622.24
Kimi K2 ThinkingMoonshot AI$0.622.02
Kimi K2.5non-reasoningMoonshot AI$0.619.43
GLM 4.7non-reasoningZ.AI$0.617.36
DeepSeek V3.2reasoningDeepSeek$0.6221.49
DeepSeek V3.2non-reasoningDeepSeek$0.6216.04
Llama 3.3 70B InstructMeta$0.727.66
Llama 3.1 8B InstructMeta$0.726.93
Llama 3.1 70B InstructMeta$0.726.60
Nova ProAmazon$0.86.96
GLM 5reasoningZ.AI$127.91
GLM 5non-reasoningZ.AI$121.78
Claude Haiku 4.5reasoningAnthropic$116.88
Claude Haiku 4.5non-reasoningAnthropic$115.41
Mistral Small (24.02)Mistral AI$15.85
DeepSeek-R1DeepSeek$1.3511.41
Claude Sonnet 5maxAnthropic$238.16
Claude Sonnet 5xhighAnthropic$234.38
Claude Sonnet 5highAnthropic$231.66
Claude Sonnet 5mediumAnthropic$228.05
Claude Sonnet 5lowAnthropic$224.26
Claude Sonnet 5non-reasoningAnthropic$223.20
Pixtral Large (25.02)Mistral AI$27.15
Grok 4.6highxAI$2.244.31
Grok 4.6xhighxAI$2.244.20
Grok 4.6mediumxAI$2.242.84
GPT-5.6 TerramaxOpenAI$2.242.08
GPT-5.6 TerraxhighOpenAI$2.237.95
Grok 4.6lowxAI$2.235.12
GPT-5.6 TerrahighOpenAI$2.234.24
GPT-5.6 TerramediumOpenAI$2.230.09
GPT-5.6 TerralowOpenAI$2.227.50
GPT-5.6 Terranon-reasoningOpenAI$2.220.78
Llama 3 70B InstructMeta$2.655.45
Llama 3 8B InstructMeta$2.654.83
Claude Sonnet 4.6maxAnthropic$330.06
Claude Sonnet 4.6non-reasoningAnthropic$323.30
Claude Sonnet 4.5reasoningAnthropic$320.67
Claude Sonnet 4.5non-reasoningAnthropic$319.34
Kimi K3maxMoonshot AI$3.343.59
Kimi K3lowMoonshot AI$3.334.46
Mistral Large (24.02)Mistral AI$45.76
GPT-5.6 SolmaxOpenAI$4.446.97
GPT-5.6 SolxhighOpenAI$4.444.01
GPT-5.6 SolhighOpenAI$4.442.35
GPT-5.6 SolmediumOpenAI$4.439.24
GPT-5.6 SollowOpenAI$4.433.47
GPT-5.6 Solnon-reasoningOpenAI$4.428.33
Claude Opus 5maxAnthropic$550.78
Claude Opus 5xhighAnthropic$549.68
Claude Opus 5highAnthropic$548.12
Claude Opus 5mediumAnthropic$544.83
Claude Opus 4.8maxAnthropic$541.79
Claude Opus 4.7maxAnthropic$540.69
Claude Opus 5lowAnthropic$539.35
Claude Opus 4.6maxAnthropic$531.95
Claude Opus 4.7non-reasoningAnthropic$530.93
Claude Opus 4.5reasoningAnthropic$529.10
Claude Opus 4.6non-reasoningAnthropic$526.35
Claude Opus 4.5non-reasoningAnthropic$523.68
Claude Fable 5.1maxAnthropic$1053.35
Claude Fable 5.1xhighAnthropic$1053.20
Claude Fable 5.1highAnthropic$1051.15
Claude Fable 5maxAnthropic$1049.63
Claude Fable 5.1mediumAnthropic$1048.92
Claude Fable 5.1lowAnthropic$1046.82
GPT-6 AstramaxOpenAI$1152.67
GPT-6 AstraxhighOpenAI$1152.39
GPT-6 AstrahighOpenAI$1150.92
GPT-6 AstramediumOpenAI$1149.57
GPT-6 AstralowOpenAI$1145.78

Hallazgos clave en la frontera

De las 107 configuraciones analizadas, solo 9 se sitúan sobre la frontera de Pareto. De este grupo se desprenden tres conclusiones contundentes:

  • El esfuerzo de razonamiento aporta más que migrar de modelo. Configurar GPT-5.6 Luna en esfuerzo max alcanza un índice de 37.3 por $0.22/1M tokens —prácticamente a la par de Claude Sonnet 5 en esfuerzo max (índice 38.2), pero a una novena parte del costo ($2.00/1M). La misma versión de Luna sin razonamiento (non-reasoning) apenas marca 15.5: la ganancia al activar el razonamiento dentro de un mismo modelo supera la brecha que existe entre proveedores completos al mismo rango de precio.
  • Por debajo de $1.00/1M, dominan las opciones abiertas. Amazon Nova Micro, NVIDIA Nemotron Nano 9B v2 y GLM 4.7 Flash dominan el segmento de bajo costo; nadie ofrece más inteligencia por menos dinero en esa franja. A partir de $0.22/1M, la frontera pasa a manos de OpenAI, Anthropic y xAI, casi siempre en sus niveles máximos de razonamiento (high o max).
  • Rendimientos decrecientes en la gama alta. A partir de la barrera de los $2.20/1M (Grok 4.6, GPT-5.6 Terra, Claude Opus 5 y Claude Fable 5.1), multiplicar el precio hasta por 5x ofrece mejoras incrementales relativamente modestas en el índice de inteligencia, delimitando con claridad el punto en que el costo adicional solo se justifica para tareas altamente críticas.

De los benchmarks a producción: ¿por qué modelos empezar?

Ningún benchmark sintético reemplaza las pruebas con tus propios datos y flujos de trabajo. En producción, la métrica definitiva no es el precio por millón de tokens, sino el costo por tarea exitosa:

  • Lo “barato” puede salir caro: Un modelo económico que falla con frecuencia, requiere reintentos constantes o prompts excesivamente largos para no alucinar, termina costando más tiempo y dinero.
  • Lo más potente suele ser innecesario: Usar el modelo más costoso para tareas repetitivas, clasificación o extracción estructurada es pagar de más sin beneficio real.

Cómo usar esta guía: Probar decenas de modelos contra tus propios datos no es viable. Utiliza la frontera de Pareto como tu shortlist de partida: identifica los 2 o 3 modelos que dominan la relación costo-inteligencia para el nivel de complejidad que necesitas y empieza tus pruebas ahí. Si el más eficiente cumple con el estándar de calidad de tu caso de uso, ya encontraste tu ganador; si no, escala al siguiente escalón de la frontera.

Explora los 77 modelos activos

El gráfico superior se limita a modelos con precio e índice reportados. La siguiente tabla interactiva reúne los 77 modelos en estado ACTIVE en Bedrock[3] que cuentan con precio por token o benchmark (excluyendo aquellos con tarifas por imagen, segundo de video o consulta). Puedes filtrar por proveedor, soporte multimodal (imágenes), ventana de contexto y tokens máximos de salida para evaluar la alternativa ideal para tu arquitectura:

ModeloProveedorEsfuerzoContexto$/1M inÍndice
Claude Fable 5.1Anthropicmax1M$1053.4
Claude Fable 5.1Anthropicxhigh1M$1053.2
GPT-6 AstraOpenAImax272K(≤272K)$1152.7
GPT-6 AstraOpenAImax1.1M(>272K)$2252.7
GPT-6 AstraOpenAIxhigh272K(≤272K)$1152.4
GPT-6 AstraOpenAIxhigh1.1M(>272K)$2252.4
Claude Fable 5.1Anthropichigh1M$1051.1
GPT-6 AstraOpenAIhigh272K(≤272K)$1150.9
GPT-6 AstraOpenAIhigh1.1M(>272K)$2250.9
Claude Opus 5Anthropicmax1M$550.8
Claude Opus 5Anthropicxhigh1M$549.7
Claude Fable 5Anthropicmax1M$1049.6
GPT-6 AstraOpenAImedium272K(≤272K)$1149.6
GPT-6 AstraOpenAImedium1.1M(>272K)$2249.6
Claude Fable 5.1Anthropicmedium1M$1048.9
Claude Opus 5Anthropichigh1M$548.1
GPT-5.6 SolOpenAImax272K(≤272K)$4.447.0
GPT-5.6 SolOpenAImax1M(>272K)$8.847.0
Claude Fable 5.1Anthropiclow1M$1046.8
GPT-6 AstraOpenAIlow272K(≤272K)$1145.8
GPT-6 AstraOpenAIlow1.1M(>272K)$2245.8
Claude Opus 5Anthropicmedium1M$544.8
Grok 4.6xAIhigh500K$2.244.3
Grok 4.6xAIxhigh500K$2.244.2
GPT-5.6 SolOpenAIxhigh272K(≤272K)$4.444.0
GPT-5.6 SolOpenAIxhigh1M(>272K)$8.844.0
Kimi K3Moonshot AImax1M$3.343.6
Grok 4.6xAImedium500K$2.242.8
GPT-5.6 SolOpenAIhigh272K(≤272K)$4.442.4
GPT-5.6 SolOpenAIhigh1M(>272K)$8.842.4
GPT-5.6 TerraOpenAImax272K(≤272K)$2.242.1
GPT-5.6 TerraOpenAImax1M(>272K)$4.442.1
Claude Opus 4.8Anthropicmax1M$541.8
Claude Opus 4.7Anthropicmax1M$540.7
Claude Opus 5Anthropiclow1M$539.4
GPT-5.6 SolOpenAImedium272K(≤272K)$4.439.2
GPT-5.6 SolOpenAImedium1M(>272K)$8.839.2
Claude Sonnet 5Anthropicmax1M$238.2
GPT-5.6 TerraOpenAIxhigh272K(≤272K)$2.238.0
GPT-5.6 TerraOpenAIxhigh1M(>272K)$4.438.0
GPT-5.6 LunaOpenAImax272K(≤272K)$0.2237.3
GPT-5.6 LunaOpenAImax1M(>272K)$0.4437.3
Grok 4.6xAIlow500K$2.235.1
GPT-5.6 LunaOpenAIxhigh272K(≤272K)$0.2234.6
GPT-5.6 LunaOpenAIxhigh1M(>272K)$0.4434.6
Kimi K3Moonshot AIlow1M$3.334.5
Claude Sonnet 5Anthropicxhigh1M$234.4
GPT-5.6 TerraOpenAIhigh272K(≤272K)$2.234.2
GPT-5.6 TerraOpenAIhigh1M(>272K)$4.434.2
GPT-5.6 SolOpenAIlow272K(≤272K)$4.433.5
GPT-5.6 SolOpenAIlow1M(>272K)$8.833.5
GPT-5.6 LunaOpenAIhigh272K(≤272K)$0.2232.1
GPT-5.6 LunaOpenAIhigh1M(>272K)$0.4432.1
Claude Opus 4.6Anthropicmax1M$531.9
Claude Sonnet 5Anthropichigh1M$231.7
Claude Opus 4.7Anthropicnon-reasoning1M$530.9
GPT-5.6 TerraOpenAImedium272K(≤272K)$2.230.1
GPT-5.6 TerraOpenAImedium1M(>272K)$4.430.1
Claude Sonnet 4.6Anthropicmax1M$330.1
Claude Opus 4.5Anthropicreasoning200K$529.1
GPT-5.6 SolOpenAInon-reasoning272K(≤272K)$4.428.3
GPT-5.6 SolOpenAInon-reasoning1M(>272K)$8.828.3
Claude Sonnet 5Anthropicmedium1M$228.1
GLM 5Z.AIreasoning200K$127.9
GPT-5.6 TerraOpenAIlow272K(≤272K)$2.227.5
GPT-5.6 TerraOpenAIlow1M(>272K)$4.427.5
Claude Opus 4.6Anthropicnon-reasoning1M$526.4
GPT-5.6 LunaOpenAImedium272K(≤272K)$0.2225.0
GPT-5.6 LunaOpenAImedium1M(>272K)$0.4425.0
Claude Sonnet 5Anthropiclow1M$224.3
Claude Opus 4.5Anthropicnon-reasoning200K$523.7
Kimi K2.5Moonshot AIreasoning256K$0.623.5
Claude Sonnet 4.6Anthropicnon-reasoning1M$323.3
Claude Sonnet 5Anthropicnon-reasoning1M$223.2
MiniMax M2.5MiniMax196K$0.322.8
GLM 4.7Z.AIreasoning203K$0.622.2
Kimi K2 ThinkingMoonshot AI256K$0.622.0
GLM 5Z.AInon-reasoning200K$121.8
DeepSeek V3.2DeepSeekreasoning164K$0.6221.5
GPT-5.6 LunaOpenAIlow272K(≤272K)$0.2221.0
GPT-5.6 LunaOpenAIlow1M(>272K)$0.4421.0
MiniMax M2.1MiniMax196K$0.320.9
GPT-5.6 TerraOpenAInon-reasoning272K(≤272K)$2.220.8
GPT-5.6 TerraOpenAInon-reasoning1M(>272K)$4.420.8
Claude Sonnet 4.5Anthropicreasoning200K$320.7
Kimi K2.5Moonshot AInon-reasoning256K$0.619.4
Claude Sonnet 4.5Anthropicnon-reasoning200K$319.3
MiniMax M2MiniMax1M$0.318.6
GLM 4.7Z.AInon-reasoning203K$0.617.4
Claude Haiku 4.5Anthropicreasoning200K$116.9
DeepSeek V3.2DeepSeeknon-reasoning164K$0.6216.0
GPT-5.6 LunaOpenAInon-reasoning272K(≤272K)$0.2215.5
GPT-5.6 LunaOpenAInon-reasoning1M(>272K)$0.4415.5
Claude Haiku 4.5Anthropicnon-reasoning200K$115.4
GLM 4.7 FlashZ.AIreasoning203K$0.0714.9
Qwen3 VL 235B A22BQwenreasoning256K$0.5313.4
Nova 2 LiteAmazonhigh1M$0.313.4
NVIDIA Nemotron 3 Super 120B A12BNVIDIA256K$0.1512.8
Nova 2 LiteAmazonmedium1M$0.312.5
Nova 2 LiteAmazonlow1M$0.311.8
gpt-oss-120bOpenAIhigh128K$0.1511.6
DeepSeek-R1DeepSeek128K$1.3511.4
Qwen3 Next 80B A3BQwenreasoning256K$0.1511.2
GLM 4.7 FlashZ.AInon-reasoning203K$0.0710.6
gpt-oss-120bOpenAIlow128K$0.1510.2
Llama 4 Maverick 17B InstructMeta1M$0.2410.0
gpt-oss-20bOpenAIlow128K$0.079.9
Qwen3-Coder-30B-A3B-InstructQwen256K$0.159.6
Mistral Large 3Mistral AI256K$0.59.3
Qwen3 Coder NextQwen256K$0.59.2
gpt-oss-20bOpenAIhigh128K$0.079.0
Nova 2 LiteAmazonnon-reasoning1M$0.38.7
Devstral 2 123BMistral AI256K$0.48.6
Magistral Small 2509Mistral AI128K$0.58.6
Qwen3 32B (dense)Qwenreasoning32K$0.158.6
Llama 4 Scout 17B InstructMeta10M$0.178.1
Llama 3.3 70B InstructMeta128K$0.727.7
NVIDIA Nemotron Nano 9B v2NVIDIAreasoning128K$0.067.4
Qwen3 32B (dense)Qwennon-reasoning32K$0.157.3
Pixtral Large (25.02)Mistral AI128K$27.2
Nova ProAmazon300K$0.87.0
Llama 3.1 8B InstructMeta128K$0.726.9
Nemotron Nano 3 30BNVIDIA256K$0.066.8
NVIDIA Nemotron Nano 9B v2NVIDIAnon-reasoning128K$0.066.8
Nova LiteAmazon300K$0.066.7
Llama 3.1 70B InstructMeta128K$0.726.6
Ministral 14B 3.0Mistral AI128K$0.26.0
Nova MicroAmazon128K$0.0355.9
Mistral Small (24.02)Mistral AI32K$15.8
NVIDIA Nemotron Nano 12B v2 VL BF16NVIDIA128K$0.25.8
Mistral Large (24.02)Mistral AI32K$45.8
Ministral 3 8BMistral AI128K$0.155.5
Llama 3 70B InstructMeta8K$2.655.5
Mixtral 8x7B InstructMistral AI32K$0.455.1
Mistral 7B InstructMistral AI32K$0.155.0
Gemma 3 27B PTGoogle128K$0.234.8
Ministral 3BMistral AI128K$0.14.8
Gemma 3 4B ITGoogle128K$0.044.8
Llama 3 8B InstructMeta8K$2.654.8
Gemma 3 12B ITGoogle128K$0.093.8
Nova 2 SonicAmazon1M$3
Titan Text Embeddings v2Amazon8K$0.02
Titan Embeddings G1 - TextAmazon8K$0.1
Titan Text Embeddings V2Amazon8K$0.02
Embed EnglishCohere512$0.1
Embed MultilingualCohere512$0.1
Embed v4Cohere128K$0.12
Voxtral Mini 3B 2507Mistral AI32K$0.04
Voxtral Small 24B 2507Mistral AI32K$0.1
GPT OSS Safeguard 120BOpenAI128K$0.15
GPT OSS Safeguard 20BOpenAI128K$0.07
Writer Palmyra Vision 7BWriter4K$0.15
Palmyra X4Writer128K$2.5
Palmyra X5Writer128K$0.6

154 de 154 filas · un modelo aparece varias veces si tiene distintos niveles de esfuerzo de razonamiento o distintos tiers de precio por context window · clic en un encabezado para ordenar

Referencias

[1]
Amazon Web Services. “Amazon Bedrock Pricing.” AWS, 20 de septiembre de 2026.
[2]
Artificial Analysis. “Intelligence Index (v4.3.2).” Artificial Analysis, 20 de septiembre de 2026.
[3]
Amazon Web Services. “Amazon Bedrock Model Cards.” AWS Documentation, 20 de septiembre de 2026.
© 2026 Daniel Castillo. Todos los derechos reservados.
DC
Daniel Castillo
AI Solutions Engineer @Blend360