AI-modellen en platforms
Runware Levert Containerized AI-Datacentra voor Goodkopere Inference

Runware heeft op 4 augustus 2026 zijn Sonic Inference Pod gelanceerd, een modulair datacentrum dat maximaal 1.200 GPU’s in een 20-voets container verpakt, terwijl de AI-inferentieprovider overstapt van het doorverkopen van cloudcapaciteit naar het bezitten van speciaal gebouwde hardware die hij zegt dat het traditionele datacentra op kosten onderbiedt. Het in Londen gevestigde bedrijf heeft de lancering aangekondigd in een bericht op zijn eigen blog, en belooft 30-80% lagere inferentieprijzen, met de eerste regio al live in Europa en een Amerikaanse rollout die nu begint.
Elke pod is een zelfstandig inferentiecentrum: maximaal 1.200 dicht opeen gepakte GPU’s die ongeveer 1 MW aan rekenvermogen leveren, rechtstreeks vloeibaar gekoeld door een gesloten circuitsysteem dat ongeveer 1,5 kubieke meter water recirculeert en geen water verbruikt, volgens Runware. Het bedrijf zegt dat een nieuwe eenheid in enkele dagen kan worden geïmplementeerd – een gemiddelde bouwtijd van ongeveer drie weken – tegen de drie- tot vijfjaarlijke tijdlijnen van conventionele datacentrumconstructie. Inferentie wordt op twee manieren verkocht: klanten kunnen hun eigen code uitvoeren op Runware’s vloot, gefactureerd per seconde, of modellen uploaden achter een beheerde API, gefactureerd per uitvoer.
Co-founder en CEO Flaviu Radulescu heeft de inzet geframed als een weddenschap dat de inferentie-economie kleine, gedistribueerde, verplaatsbare faciliteiten begunstigt boven de hyperscale-opbouw die de AI-infrastructuuruitgaven domineert. “De vraag naar inferentie groeit sneller dan faciliteiten kunnen worden gebouwd”, zei Radulescu tegen TechCrunch. “Wat we willen is de wereldwijde intelligentie aandrijven, de ruggengraat zijn waarop elk AI-model draait met capaciteit die de vraag bijhoudt in plaats van deze te beperken.”
Hoe de pods zijn gebouwd
Runware’s pitch rust op het verwijderen van de overhead van algemene doeleindenfaciliteiten. Het bedrijf stelt dat 40-60% van de traditionele datacentrumuitgaven gaat naar infrastructuur die nooit door een inferentiewerklast wordt gebruikt, zoals back-upsystemen, overbodige redundantie, te grote gebouwen, en dat ongeveer een derde van de elektriciteit van een conventionele site naar koeling gaat in plaats van rekenvermogen. De gesloten circuitsystemen van de pod houden de procesortemperatuur binnen 2°C onder duurzame belasting bij een door Runware beschreven 99% energierendement, en de droge koelers betekenen geen waterverbruik, een punt dat wordt gemaakt omdat datacentrumwatergebruik lokale tegenstand trekt in de hele VS.
Omdat elke pod deel uitmaakt van één netwerk, is routing een functie in plaats van een redundantieplan: verzoeken gaan naar de capaciteit die het dichtst bij de gebruiker is, en een pod-fout verschuift het verkeer in plaats van een faciliteit uit te schakelen. Klanten die dedicated hardware willen, kunnen hele pods reserveren. Radulescu zei dat het bedrijf momenteel 10 pods heeft geïmplementeerd in de VS, Europa en Azië-Stille Oceaan, met 160 sites beschikbaar om meer aan te drijven, en telt Higgsfield AI en Wix onder de inferentieklanten die al op het platform zitten.
Het rolloutplan
Runware’s gepubliceerde tijdlijn heeft Europa al verkeer aan het serveren, de Amerikaanse West-kust inzet onderweg, en een eerste golf van capaciteit (10.000 inferentieknooppunten in meerdere regio’s) die in de tweede helft van 2026 online moet komen. Het bedrijf zegt dat het schaalt naar 1 GW aan inferentiecapaciteit in 2027. VS Centraal, VS Oost, Noord- en Zuid-Europa, en Azië-Stille Oceaan worden genoemd als geplande regio’s.
De financiering achter de opbouw
De lancering van de pod breidt een hardwarestrategie uit die Runware heeft gebouwd sinds zijn $50 miljoen Series A, aangekondigd in januari 2026 en geleid door Dawn Capital met deelname van Comcast (CMCSA ) Ventures, Speedinvest, Insight Partners, en a16z speedrun. Die ronde financierde de uitbreiding van het single-API-platform, met het bedrijf dat ook bleef bouwen en implementeren van zijn inferentiepods, infrastructuur die hij zei dat het overal kan worden geplaatst waar stroom goedkoop is, waardoor meerdere jaren aan bouwtijd kan worden vermeden. Opgericht in 2023, zegt Runware dat het meer dan 10 miljard generaties heeft aangedreven voor meer dan 200.000 ontwikkelaars en 300 miljoen eindgebruikers via zijn single-API-platform, dat bijna 300 modelklassen agregereert.
Het bedrijf gaat een kapitaalintensieve race aan van de andere kant van het veld. Terwijl OpenAI, xAI en de hyperscalers honderden miljarden besteden aan vaste mega-kampussen, wedt Runware dat een significante deel van de inferentievraag, workloads die onverschillig zijn waar ze worden uitgevoerd, goedkoper en sneller zal worden bediend door capaciteit die kan worden aangevoerd, aangesloten en verplaatst. Met de eerste pods live en capaciteitsreserveringen open, heeft die weddenschap nu hardware achter zich.












