Adquisiciones
d-Matrix adquiere Wallaroo para orquestar la inferencia en varios chips

d-Matrix ha adquirido Wallaroo.ai, un fabricante de software para desplegar y orquestar la inferencia de inteligencia artificial, en un acuerdo que la empresa de chips de Santa Clara anunciÃģ el 3 de agosto de 2026. La compra lleva la plataforma, la propiedad intelectual y el personal de ingenierÃa de Wallaroo a d-Matrix, y es la segunda adquisiciÃģn de la empresa de chips en cuatro meses.
La razÃģn se debe a cÃģmo d-Matrix vende silicio. Sus aceleradores Corsair estÃĄn diseÃąados para funcionar junto a las GPU en lugar de reemplazarlas, tomando la fase de decodificaciÃģn de una solicitud de modelo de lenguaje, la mitad limitada por la memoria que emite tokens uno a uno, mientras que las GPU manejan el prellenado intensivo en computaciÃģn. Hacer que esa divisiÃģn funcione en un clÚster en vivo es un trabajo de software: algo tiene que decidir quÃĐ chip recibe quÃĐ parte de cada solicitud, entregar el contexto acumulado entre ellos y escalar ambos niveles de forma independiente a medida que cambia el trÃĄfico. Esa capa es lo que d-Matrix acaba de comprar.
QuÃĐ aporta Wallaroo
Wallaroo vende un tiempo de ejecuciÃģn de servicio y un plano de control que empaquetan modelos y los empujan hacia hardware x86, Arm y GPU en la nube, en las instalaciones, en el borde y en entornos completamente aislados, con soporte para tiempos de ejecuciÃģn de LLM comunes, incluyendo vLLM y SGLang. Sus equipos de ingenierÃa, producto y comercializaciÃģn se unen a d-Matrix, que citÃģ su trabajo en arquitectura de software, computaciÃģn de alto rendimiento y operaciones de Kubernetes.
Las dos empresas ya estaban describiendo la misma arquitectura. En una publicaciÃģn de ingenierÃa del 16 de marzo de 2026, el fundador y director ejecutivo de Wallaroo, Vid Jain, y dos colegas presentaron el caso para dividir el prellenado de la decodificaciÃģn en silicio mixto. El trÃĄfico agente, escribieron, llega en tres tamaÃąos: aproximadamente el 84% de solicitudes cortas de unos 2.000 tokens, alrededor del 15% en el rango de 8.000 a 64.000 tokens y menos del 1% con 128.000 tokens o mÃĄs. Esa Última fracciÃģn monopoliza el tiempo de la GPU y bloquea todo lo que estÃĄ en cola detrÃĄs de ella. La routificaciÃģn consciente de la cachÃĐ sola, informaron los autores, redujo el tiempo de primera token en un 75% en el trÃĄfico agente en sus propias pruebas.
Sid Sheth, fundador y director ejecutivo de d-Matrix, dijo que los clientes le habÃan dicho a la empresa que la mayor barrera âno es solo el rendimiento, sino tambiÃĐn la complejidad operativa para llegar allÃâ. Jain dijo que los dos compartÃan la visiÃģn de que la inferencia es tanto un problema de despliegue como de silicio.
Dos acuerdos en cuatro meses
d-Matrix ha estado comprando las partes de un sistema de inferencia que no construyÃģ. En abril de 2026, adquiriÃģ el negocio de centros de datos de GigaIO, recogiendo el sistema SuperNODE y la memoria de tejido PCIe basada en FabreX, junto con un equipo de sistemas a nivel de rack en Carlsbad, California, mientras GigaIO continuaba de forma independiente en la informÃĄtica de borde. Corsair entrÃģ en producciÃģn completa el 9 de junio de 2026, fabricado con Alchip en el nodo N6 de TSMC, utilizando chiplets de computaciÃģn en memoria SRAM en sustratos orgÃĄnicos con memoria LP-DDR5 en lugar de pilas HBM y empaquetado CoWoS, en racks que funcionan con enfriamiento por aire.
Pagar por ello es un financiamiento de serie C de 275 millones de dÃģlares cerrado el 12 de noviembre de 2025 a una valoraciÃģn de 2.000 millones de dÃģlares, copresidido por BullhoundCapital, Triatomic Capital y Temasek. La empresa tambiÃĐn ha estado reuniendo socios alrededor de la plataforma, incluyendo una asociaciÃģn de infraestructura de baja latencia con Infineon.
Comprar la capa de despliegue se estÃĄ convirtiendo en el movimiento estÃĄndar para cualquiera que venda computaciÃģn no Nvidia (NVDA ). Qualcomm cerrÃģ su adquisiciÃģn total de acciones de la empresa de compiladores Modular (QCOM ) en julio de 2026, Nscale comprÃģ Anyscale para moverse hacia arriba en la pila de cÃģmputo de inteligencia artificial el mismo mes, y Nebius acordÃģ adquirir Eigen AI en un acuerdo de 643 millones de dÃģlares destinado a la infraestructura de inferencia. El silicio que necesita una segunda pila de software para ser Útil pierde ante el silicio que se envÃa con una.
DÃģnde se pone a prueba la asociaciÃģn
El punto de prueba comercial hasta ahora es Parasail, una nube de inferencia que el 7 de julio de 2026 dijo que estaba desplegando Corsair junto a su flota de NVIDIA Hopper y Blackwell, enviando el prellenado a las GPU y la decodificaciÃģn a los aceleradores a travÃĐs de una red que se basa en mÃĄs de 40 centros de datos en 15 paÃses. La tecnologÃa de enrutamiento de kernel de Parasail realiza el despacho allÃ, que es precisamente la funciÃģn que d-Matrix ahora posee en casa.
El caso de rendimiento se basa en resultados medidos y modelados publicados por Gimlet Labs el 11 de marzo de 2026. Al ejecutar gpt-oss-120b con un modelo de borrador de 1.600 millones de parÃĄmetros, la empresa moviÃģ el paso de decodificaciÃģn especulativa fuera de la GPU y hacia Corsair, mientras que el prellenado y la verificaciÃģn se quedaron en la GPU, e informÃģ solicitudes de extremo a extremo de 2 a 10 veces mÃĄs rÃĄpidas a una eficiencia de energÃa equivalente. Gimlet atribuye la ganancia a los 2 GB de SRAM en chip y a la banda de memoria de aproximadamente 150 TB/s, que permiten que el modelo de borrador produzca tokens de candidato lo suficientemente rÃĄpido como para que las conjeturas rechazadas cuesten poco. Uno de los coautores de la publicaciÃģn es el director de tecnologÃa de d-Matrix, Sudeep Bhoja.
Corsair ahora se envÃa en volumen a clientes prioritarios, y d-Matrix estÃĄ contratando ingenieros en varias especialidades a medida que las dos organizaciones se combinan. El prÃģximo comprador de un rack de GPU y acelerador mixto juzgarÃĄ segÚn quÃĐ tan rÃĄpido un modelo va desde la evaluaciÃģn hasta el trÃĄfico de servicio, y ese reloj ahora funciona con software que d-Matrix posee.












