TL;DR:
- Wafer, una startup de agentes que optimizan la inferencia de modelos de IA, anunció el 1 de septiembre de 2026 una Serie A de 40 millones de dólares co-liderada por Marathon y Chemistry.
- Es diez veces su ronda semilla de 4 millones, publicada el 14 de abril de 2026, y lleva a 44 millones el capital que la empresa ha hecho público.
- La valuación superior a 200 millones y las ofertas de adquisición que rechazó no están en el comunicado: las reportó The Information, y el CEO no confirmó la cifra.
Wafer, una empresa fundada en 2025 que construye agentes de IA para correr modelos abiertos más rápido y más barato, anunció el 1 de septiembre de 2026 una Serie A de 40 millones de dólares co-liderada por Marathon y Chemistry. Entraron Wing, AMD Ventures y Outset Capital, y repitieron Fifty Years y Y Combinator. El comunicado lo firma el cofundador y CEO Emilio Andere, y detalla el monto y la lista completa de inversionistas, pero en ningún momento dice cuánto vale la compañía. Esa parte la puso The Information, que reportó una valuación por encima de 200 millones de dólares y ofertas de adquisición que Wafer rechazó, atribuidas a una persona al tanto de la operación. Andere declinó confirmarle la valuación a esa publicación. La ronda llegó cuatro meses y medio después de la semilla de 4 millones que la empresa anunció el 14 de abril.
AMD Ventures ahora es accionista de quien mide sus chips
Entre los nuevos inversionistas, AMD Ventures es el que tiene un interés directo en el argumento de Wafer. La empresa sostiene desde hace meses que la ventaja de Nvidia en inferencia vive en el software acumulado alrededor de CUDA más que en el silicio, y que un agente puede cerrar esa brecha sobre hardware alternativo.
La empresa lleva su propia contabilidad de esa tesis. El 3 de julio de 2026 publicó una prueba en la que sirvió el modelo GLM-5.2 sobre aceleradores AMD MI355X, con capacidad rentada a TensorWave, y midió 2,626 tokens por segundo por nodo de throughput agregado y 213 tokens por segundo en flujo único. En su propio texto reconoce que ese resultado equivale al 80% del rendimiento que midió en una B200 de Nvidia, a menos de la mitad del costo. "El foso de CUDA se está erosionando en tiempo real", escribió Ian Ye, del equipo de Wafer, al cerrar ese reporte.
Las mediciones salieron de la empresa, no de un tercero independiente, y se publicaron dos meses antes de que el brazo de inversión del fabricante entrara al capital. Desde el 1 de septiembre, quien fabrica esos chips tiene una posición accionaria en quien publica los números que favorecen a esos chips.

El producto pasó del kernel a la inferencia completa
Andere y su cofundador Steven Arellano se conocieron como estudiantes de primer año en la Universidad de Chicago. Arellano trabajó en la infraestructura de Bard en Google y en ingeniería de rendimiento en Two Sigma; Andere entrenó modelos meteorológicos en el laboratorio Argonne y publicó investigación de seguridad en machine learning en NeurIPS, según el anuncio de la semilla.
Ese texto de abril planteaba el problema que la empresa quiere resolver: hay unos pocos cientos de personas en el mundo capaces de optimizar a fondo un acelerador, y todos los laboratorios, fabricantes y nubes se los pelean. Wafer arrancó con un agente que escribía y afinaba kernels de GPU, los programas de bajo nivel que deciden qué tanto se aprovecha el hardware.
La compañía ya no vende solo eso. Según su ficha en Y Combinator, hoy ofrece inferencia serverless y dedicada para modelos abiertos, con diez empleados y base en San Francisco. El comunicado de la Serie A describe un sistema que lee los patrones de tráfico y las restricciones de rendimiento de una carga de trabajo antes de elegir el modelo, el motor, los kernels y el hardware, y que sigue ajustando después del despliegue. Ahí está el cambio de negocio: de un encargo de ingeniería que termina cuando el modelo ya corre rápido, a un servicio que se ejecuta y se factura de forma continua.
Los ingresos que Wafer no publicó
RuntimeWire, que sí accedió al reporte de pago, recoge que Andere le dijo a The Information que Wafer alcanzó cerca de 8 millones de dólares de ingreso anualizado en 12 semanas, con márgenes brutos cercanos al 50% por el costo de rentar capacidad de cómputo. Conviene leer esa cifra con cuidado: anualizado significa proyectar doce meses a partir de un periodo corto, no facturación acumulada de un año.
Según ese mismo reporte, Andere identificó a Vercel e Inworld AI como clientes. El dato conecta con la lista de ángeles que Wafer sí hizo pública: entre ellos aparece Guillermo Rauch, CEO de Vercel. Completan el grupo Jeff Dean, Andy Fang de DoorDash, Kyle Vogt, Akshay Kothari de Notion, Matthew Prince de Cloudflare y Scott Stephenson de Deepgram.
Wafer publicó su semilla en abril y su Serie A cuatro meses y medio después con el mismo argumento: que el cuello de botella de la inferencia es software y no silicio. Lo que cambió es quién paga por comprobarlo, y uno de los que ahora paga fabrica los chips.