Akwizycje
d-Matrix kupuje Wallaroo, aby zorganizowaÄ inferencjÄ na chipach

d-Matrix nabyÅ Wallaroo.ai, producenta oprogramowania do wdroÅženia i organizacji inferencji sztucznej inteligencji, w transakcji, o ktÃģrej Santa Clara chip company ogÅosiÅ 3 sierpnia 2026. Zakup ten wprowadza platformÄ Wallaroo, wÅasnoÅÄ intelektualnÄ i zespÃģÅ inÅžynierÃģw do d-Matrix i jest to druga akwizycja chipmaker w ciÄ gu czterech miesiÄcy.
Uzasadnienie wynika z tego, jak d-Matrix sprzedaje krzem. Ich przyspieszacze Corsair sÄ zaprojektowane do pracy obok GPU, a nie ich zastÄpowania, biorÄ c fazÄ dekodowania ÅžÄ dania modelu jÄzykowego, pamiÄciowo ograniczonÄ poÅowÄ, ktÃģra emituje tokeny jeden po drugim, podczas gdy GPU obsÅugujÄ prefilled. Ustawienie tej separacji w Åžywej grupie to zadanie oprogramowania: coÅ musi zdecydowaÄ, ktÃģry chip otrzyma ktÃģrÄ czÄÅÄ kaÅždego ÅžÄ dania, przekazaÄ nagromadzony kontekst miÄdzy nimi i skalowaÄ oba poziomy niezaleÅžnie, gdy ruch siÄ zmienia. Ta warstwa to to, co d-Matrix wÅaÅnie kupiÅ.
Co Wallaroo wnosi
Wallaroo sprzedaje Årodowisko uruchomieniowe i warstwÄ kontrolnÄ , ktÃģre pakujÄ modele i wypychajÄ je na sprzÄt x86, Arm i GPU w chmurze, na miejscu, na krawÄdzi i w peÅni odizolowanych Årodowiskach, z obsÅugÄ popularnych czasÃģw wykonywania LLM, w tym vLLM i SGLang. Ich zespoÅy inÅžynierskie, produkcyjne i marketingowe doÅÄ czajÄ do d-Matrix, ktÃģry powoÅaÅ siÄ na ich pracÄ w architekturze oprogramowania, wysokowydajnych obliczeniach i operacjach Kubernetes.
Obie firmy opisywaÅy juÅž tÄ samÄ architekturÄ. W marcowym poÅcie inÅžynierskim z 16 marca 2026, zaÅoÅžyciel i dyrektor generalny Wallaroo, Vid Jain, i dwÃģch jego kolegÃģw przedstawiÅ przypadek dla podziaÅu prefilled od dekodowania na mieszanych krzemach. Ruch agenci, napisali, przychodzi w trzech rozmiarach: okoÅo 84% krÃģtkich ÅžÄ daÅ o okoÅo 2 000 tokenÃģw, okoÅo 15% w zakresie 8 000-64 000 tokenÃģw i poniÅžej 1% przy 128 000 tokenÃģw lub wiÄcej. Ten ostatni fragment monopolizuje czas GPU i blokuje wszystko, co jest w kolejce za nim. Trasowanie Åwiadome pamiÄci, jak podali autorzy, skrÃģciÅo czas do pierwszego tokenu o 75% w ich wÅasnych testach.
Sid Sheth, zaÅoÅžyciel i dyrektor generalny d-Matrix, powiedziaÅ, Åže klienci powiedzieli firmie, Åže najwiÄkszÄ barierÄ ânie jest tylko wydajnoÅÄ, ale takÅže operacyjna zÅoÅžonoÅÄ uzyskania tamâ. Jain powiedziaÅ, Åže obie strony dzielÄ poglÄ d, Åže inferencja jest tak samo problemem wdroÅženia, jak i krzemu.
Dwie transakcje w czterech miesiÄ cach
d-Matrix kupuje czÄÅci systemu inferencji, ktÃģrych nie zbudowaÅ. W kwietniu 2026 roku nabyÅ dziaÅ centrÃģw danych GigaIO, kupujÄ c system SuperNODE i pamiÄÄ opartÄ na PCIe FabreX wraz z zespoÅem systemÃģw na poziomie szafy w Carlsbad, Kalifornia, podczas gdy GigaIO kontynuowaÅ dziaÅalnoÅÄ niezaleÅžnÄ w obliczeniach krawÄdziowych. Sam Corsair w peÅni wszedÅ do produkcji 9 czerwca 2026, wyprodukowany z Alchip na wÄÅšle TSMC N6, uÅžywajÄ c chipletÃģw obliczeniowych w pamiÄci SRAM na noÅnikach organicznych z pamiÄciÄ LP-DDR5 zamiast stosÃģw HBM i opakowaÅ CoWoS, w szafach, ktÃģre dziaÅajÄ chÅodzone powietrzem.
PÅacenie za to jest 275 milionÃģw dolarÃģw serii C z 12 listopada 2025 przy wycenie 2 miliardÃģw dolarÃģw, wspÃģÅprowadzonej przez BullhoundCapital, Triatomic Capital i Temasek. Firma rÃģwnieÅž gromadzi partnerÃģw wokÃģÅ platformy, w tym partnerstwo w zakresie infrastruktury niskiej latencji z Infineon.
Kupowanie warstwy wdroÅženiowej staje siÄ standardowym posuniÄciem dla kaÅždego, kto sprzedaje obliczenia nie-Nvidia (NVDA ). Qualcomm zamknÄ Å swojÄ akwizycjÄ startupu kompilatora Modular (QCOM ) w lipcu 2026, Nscale kupiÅ Anyscale, aby awansowaÄ w stosie obliczeÅ AI tego samego miesiÄ ca, a Nebius zgodziÅ siÄ nabyÄ Eigen AI w transakcji o wartoÅci 643 milionÃģw dolarÃģw w celu wzmocnienia infrastruktury inferencji. Krzem, ktÃģry potrzebuje drugiej warstwy oprogramowania, aby byÄ uÅžytecznym, przegrywa z krzemu, ktÃģry jest dostarczany z niÄ .
Gdzie para siÄ testuje
Punktem dowodowym jest Parasail, chmura inferencji, ktÃģra 7 lipca 2026 ogÅosiÅa, Åže wdroÅžy Corsair obok swojej floty NVIDIA Hopper i Blackwell, wysyÅajÄ c prefilled do GPU i dekodowanie do przyspieszaczy przez sieÄ, ktÃģra korzysta z ponad 40 centrÃģw danych w 15 krajach. WÅasna technologia routingu jÄ dra Parasail wykonuje tam dispatching, co jest dokÅadnie funkcjÄ , ktÃģrÄ d-Matrix teraz posiada wewnÄtrznie.
Przypadek wydajnoÅci opiera siÄ na wynikach pomiarowych i modelowych opublikowanych przez Gimlet Labs 11 marca 2026. UruchamiajÄ c gpt-oss-120b z modelem draft o 1,6 miliarda parametrÃģw, firma przeniosÅa krok dekodowania spekulatywnego z GPU na Corsair, podczas gdy prefilled i weryfikacja pozostaÅy na GPU, i zgÅosiÅa 2-10 razy szybsze ÅžÄ dania na koÅcu przy rÃģwnowaÅžnej wydajnoÅci energetycznej. Gimlet przypisuje zysk karcie 2 GB pamiÄci SRAM na chipie i okoÅo 150 TB/s przepustowoÅci pamiÄci, co pozwala modelowi draft wyprodukowaÄ tokeny kandydujÄ ce wystarczajÄ co szybko, aby odrzucone zgadywanie kosztowaÅo niewiele. Jednym z wspÃģÅautorÃģw postu jest dyrektor techniczny d-Matrix, Sudeep Bhoja.
Corsair jest teraz dostarczany w duÅžych iloÅciach do priorytetowych klientÃģw, a d-Matrix rekrutuje inÅžynierÃģw z kilku specjalnoÅci, gdy obie organizacje ÅÄ czÄ siÄ. NastÄpny kupujÄ cy szafy z mieszaniem GPU i przyspieszaczy bÄdzie oceniaÅ go pod kÄ tem tego, jak szybko model przechodzi od oceny do obsÅugi ruchu, a ten zegar teraz dziaÅa na oprogramowaniu, ktÃģre d-Matrix posiada.












