Saltar al contenido

Amazon gastó 1.8 millones de dólares en Claude, el proyecto falló y tardó cinco meses en verlo

Un despliegue fallido de Claude Sonnet le costó 1.8 millones a Amazon: 860% sobre presupuesto y cinco meses sin verlo.

por Dilis Salazar
Amazon gastó 1.8 millones de dólares en Claude, el proyecto falló y tardó cinco meses en verlo
Photo by BoliviaInteligente / Unsplash

TL;DR:

  • Ingenieros senior de Amazon expusieron en una reunión interna del martes 28 de julio de 2026 una lista de sobrecostos que describieron como "catastróficamente caros".
  • El caso mayor consumió 1.8 millones de dólares con Claude Sonnet en un cruce de datos que nunca llegó a producción: 860% arriba del presupuesto y cinco meses sin detectarse.
  • La compañía ya construye topes automáticos de gasto para futuros proyectos y sostiene que los ejemplos son aislados.

Ingenieros senior de Amazon presentaron el martes 28 de julio de 2026, en una reunión interna, una lista de sobrecostos provocados por la forma en que la empresa desplegó inteligencia artificial y por la falta de controles de gasto. El caso más grande consumió 1.8 millones de dólares con Claude Sonnet, el modelo de Anthropic, en una tarea rutinaria de catálogo, cruzar datos de autores con los listados de la tienda en línea. El despliegue nunca funcionó. El gasto terminó 860% por encima del presupuesto y tardó cinco meses en detectarse. Lo reportó el Financial Times este jueves 30 de julio con base en varias personas familiarizadas con la presentación. Amazon responde que son ejemplos aislados de unos pocos equipos.

En la escala de Amazon, 1.8 millones de dólares es ruido contable. Lo que la reunión dejó al descubierto fue otra cosa. Durante cinco meses, nadie dentro de la empresa que factura la nube donde corren estos modelos notó que un proyecto muerto seguía comiendo presupuesto. Un empleado senior lo resumió así ante el diario británico:

"Es difícil calcular cuánto cuesta cualquier cosa relacionada con la IA".

Los tres casos que se pusieron sobre la mesa

Los ingenieros no mostraron un accidente aislado, sino varios expedientes seguidos:

  • 1.8 millones de dólares en el cruce de datos de autores con los listados de la tienda, corriendo sobre Claude Sonnet. El despliegue falló, el gasto quedó 860% arriba de lo presupuestado y pasaron cinco meses hasta que alguien lo vio.
  • Alrededor de 541,000 dólares no previstos en el desarrollo de herramientas de auditoría financiera.
  • 134,000 dólares de más en un sistema pensado para recortar los tiempos de entrega de la red logística. Ese se detectó a las dos semanas, según Tom's Hardware.

Los mismos ingenieros contaron que ya trabajan en topes automáticos que limiten cuánto puede gastar un proyecto antes de que alguien mire la factura. Un vocero de Amazon respondió a PYMNTS:

"Como con cualquier tecnología nueva, estamos experimentando, aprendiendo y mejorando cómo la usamos".

La compañía añadió que tomar ejemplos pequeños y aislados, donde los equipos están aprendiendo unos de otros, y presentarlos como la norma no refleja cómo se usa la IA dentro de Amazon.

Por qué un error que antes costaba centavos ahora llega en la factura

El punto técnico vale para cualquier empresa que ya pague por consumo. En un sistema tradicional, un bucle mal escrito o una consulta apuntada al catálogo entero se paga con tiempo de cómputo y se nota rápido, porque el proceso se cae, la alerta suena y alguien lo arregla. Con un modelo de lenguaje no se cae nada. La llamada se ejecuta, devuelve texto y cobra.

Un token es la unidad de facturación de los modelos de lenguaje, un fragmento de texto de pocos caracteres que el modelo lee o escribe, y se cobra por millón. Anthropic vende Claude Sonnet 5 a un precio introductorio de 2 dólares por millón de tokens de entrada y 10 por millón de salida hasta el 31 de agosto de 2026, cuando pasa a la tarifa estándar de 3 y 15 dólares. A ese precio de lista de entrada, 1.8 millones de dólares equivalen del orden de 600,000 millones de tokens. Es solo una referencia de escala: ni el Financial Times ni Amazon precisaron la versión del modelo ni la proporción entre entrada y salida.

Lo que multiplicó el riesgo fue el salto a los agentes. Un asistente que responde una pregunta consume una llamada. Un agente que encadena pasos, relee su propio contexto y reintenta cuando algo falla consume decenas o cientos. Tom's Hardware lo resume con la idea que circuló en la reunión, la de que los errores antes triviales y baratos se volvieron catastróficamente caros justo cuando el gasto en tokens se disparó con los agentes.

Persona frente a una pantalla con líneas de código en un cuarto oscuro
Imagen ilustrativa: en la facturación por tokens, un proceso mal configurado no se cae, solo cobra · Foto de Al Nahian en Pexels

Amazon paga por un modelo del que es el mayor inversionista

Hay una capa que ningún reporte puso al frente. Amazon no es solo cliente de Anthropic, también es su mayor inversionista y su principal socio de infraestructura. Según el anuncio de la propia Anthropic de abril de 2026, Amazon puso 5,000 millones de dólares adicionales con hasta 20,000 millones más a futuro, sobre los 8,000 millones que ya había invertido. En sentido contrario, Anthropic se comprometió a gastar más de 100,000 millones de dólares en tecnología de AWS durante los próximos diez años, y más de 100,000 clientes ya corren Claude sobre Amazon Bedrock.

Ninguna fuente aclaró si el equipo que quemó los 1.8 millones consumió el modelo a través de Bedrock, la plataforma de la propia AWS, o directamente con Anthropic. La diferencia decide a dónde fue realmente ese dinero, y sigue sin respuesta.

Amazon retira modelos Nova por uno de frontera
Amazon deja en soporte mínimo a Nova Premier, Omni, Reel y Canvas y concentra su equipo en un modelo de frontera.

El episodio tampoco cae en el vacío. En mayo de 2026, Amazon dio de baja un marcador interno llamado Kirorank, que ordenaba a los empleados según cuántos tokens consumían en Kiro, su plataforma de desarrollo. El Financial Times reveló entonces que varios trabajadores habían inflado su consumo con tareas innecesarias para subir en la tabla, práctica que la propia plantilla bautizó como tokenmaxxing, y que el vicepresidente senior Dave Treadwell pidió no usar IA solo por usarla. La compañía calificó aquel marcador como un tablero beta que nunca fue una herramienta aprobada. En paralelo, mantiene la meta de que más del 80% de sus desarrolladores use herramientas de IA cada semana.

Amazon tampoco es la única grande descubriendo el costo real de correr con IA sin barandal. Esta misma semana, la consultora PwC tuvo que lidiar con cuatro informes publicados con citas que un modelo se inventó, según el análisis de GPTZero. Ahí el precio se paga en credibilidad. Aquí, en la factura mensual.

Las palancas para no repetirlo ya están publicadas

Para un equipo en México, España o cualquier país de América Latina que empezó a pagar modelos por consumo, la lectura práctica es incómoda pero útil. Amazon es dueña de la nube donde corre el modelo, tiene áreas financieras dedicadas y aun así tardó cinco meses en ver la fuga. Una empresa mediana sin nadie vigilando el gasto de nube tardará más.

Las herramientas para acotarlo no son secretas ni caras. La documentación de Anthropic publica dos descuentos que aplican al mismo trabajo, sin cambiar de proveedor: el almacenamiento en caché del contexto repetido recorta hasta 90% el costo de la entrada, y el procesamiento por lotes, para tareas que no necesitan respuesta inmediata, baja 50%. A eso se suman decisiones de arquitectura que no cuestan un peso: elegir el modelo más pequeño que resuelva la tarea, limitar los reintentos de un agente y fijar un techo de gasto por proyecto con alertas antes de tocarlo.

⚠️
Tres datos siguen sin confirmarse. Ni el Financial Times ni Amazon publicaron el presupuesto original del proyecto, la versión exacta de Claude Sonnet que se utilizó, ni si el consumo pasó por Amazon Bedrock o directamente por Anthropic. Amazon tampoco ha validado públicamente las cifras y sostiene que corresponden a unos pocos equipos.

Preguntas rápidas sobre los sobrecostos de IA en Amazon

¿Cuánto gastó Amazon de más por errores con IA?

El Financial Times documentó tres casos presentados en la reunión del 28 de julio de 2026: 1.8 millones de dólares en un cruce de datos de autores con Claude Sonnet, unos 541,000 dólares en herramientas de auditoría financiera y 134,000 dólares en un sistema de tiempos de entrega. Amazon no ha publicado un total propio.

¿Qué es Claude Sonnet y cómo se cobra?

Es el modelo de gama media de Anthropic, disponible tanto por su plataforma propia como a través de Amazon Bedrock. Se factura por tokens, las unidades de texto que el modelo lee y escribe. Sonnet 5 cuesta 2 y 10 dólares por millón de tokens de entrada y salida hasta el 31 de agosto de 2026, y luego 3 y 15.

¿Amazon confirmó las cifras del reporte?

No. Las cifras provienen de varias personas familiarizadas con la presentación interna, citadas por el Financial Times. Amazon dijo a PYMNTS que está experimentando, aprendiendo y mejorando cómo usa la tecnología, y que tomar ejemplos aislados como si fueran la norma no refleja cómo trabajan sus equipos.

Amazon reporta sus resultados del segundo trimestre este mismo jueves 30 de julio, después del cierre del mercado, y lo que Wall Street va a mirar es el gasto de capital cercano a 200,000 millones de dólares para 2026, no estos 1.8 millones. Puertas adentro, la cifra que cuenta es otra y es más pequeña. Con topes automáticos o sin ellos, lo único que dirá si el problema quedó resuelto es cuánto tarda la siguiente fuga en aparecer en un tablero. La anterior tardó cinco meses.

Fuentes: 1, 2, 3

Dilis Salazar imagen de perfil
por Dilis Salazar

Suscríbete GRATIS

Recibe las noticias más importantes de política, tecnología, negocios, deportes, entretenimiento y cultura directamente en tu correo.

¡Listo! Revisa tu correo

Para completar la suscripción, haz clic en el enlace de confirmación que enviamos a tu correo. Si no llega en 3 minutos, revisa tu carpeta de spam.

Ok, gracias

Leer más de Tecnología y Ciencia