Модели и платформы ИИ
Runware доставляет контейнерные центры обработки данных ИИ для более дешевой инференции

Runware 4 августа 2026 года запустила свой Sonic Inference Pod, модульный центр обработки данных, который помещает до 1200 GPU в контейнер размером 20 футов, поскольку поставщик инференции ИИ переходит от перепродажи облачной мощности к владению специально построенным оборудованием, которое, по его словам, превосходит традиционные центры обработки данных по стоимости. Лондонская компания объявила о запуске в посте на своем блоге, и обещает снижение цен на инференцию на 30-80%, при этом первый регион уже работает в Европе, а развертывание в США началось.
Каждый модуль представляет собой самостоятельную инференционную установку: до 1200 плотно упакованных GPU, обеспечивающих примерно 1 МВт вычислительной мощности,直接 охлаждаемых через запечатанную закрытую систему, которая рециркулирует около 1,5 кубических метров воды и не потребляет ее, по словам Runware. Компания утверждает, что новый модуль может быть развернут за несколько дней – среднее время строительства составляет около трех недель – против трех-пятилетних сроков строительства традиционных центров обработки данных. Инференция продается двумя способами: клиенты могут запускать свой собственный код на флоте Runware, оплачиваемом по секундам, или загружать модели за управляемым API, оплачиваемым за каждый вывод.
Сооснователь и генеральный директор Флавиу Радулеску сформулировал эту ставку как ставку на то, что экономика инференции предпочитает небольшие, распределенные, передвижные объекты традиционным гигантским строительным проектам, доминирующим в расходах на инфраструктуру ИИ. “Спрос на инференцию растет быстрее, чем объекты могут быть построены”, – сказал Радулеску TechCrunch. “Мы хотим обеспечить работу мирового интеллекта, быть основой, на которой будет работать каждая модель ИИ, с мощностью, которая будет соответствовать спросу, а не ограничивать его”.
Как строятся модули
Аргументация Runware основана на исключении излишеств общих объектов. Компания утверждает, что 40-60% традиционных расходов на центры обработки данных идут на инфраструктуру, которую инференционная нагрузка никогда не использует, например, резервные системы, избыточную надстройку, чрезмерно большие здания, и что примерно треть электроэнергии на традиционном объекте уходит на охлаждение, а не на вычисления. Охлаждение модуля в закрытой системе, напротив, поддерживает температуру процессоров в пределах 2°C при постоянной нагрузке с эффективностью потребления энергии 99%, по словам Runware, а сухие охладители означают отсутствие потребления воды, что является важным заявлением, поскольку использование воды в центрах обработки данных вызывает местные протесты по всей территории США.
Поскольку каждый модуль присоединяется к единой сети, маршрутизация является функцией, а не планом резервирования: запросы направляются туда, где есть свободная мощность ближе всего к пользователю, а сбой модуля перенаправляет трафик, не выводя из строя объект. Клиенты, желающие иметь выделенное оборудование, могут бронировать целые модули. Радулеску сказал, что в настоящее время у компании развернуто 10 модулей по всей территории США, Европы и Азии, и есть 160 объектов, готовых к подключению для обеспечения дополнительной мощности, и среди клиентов инференции на платформе уже есть Higgsfield AI и Wix.
План развертывания
Опубликованный график Runware уже обслуживает трафик в Европе, развертывание на западе США идет полным ходом, и первая волна мощности (10 000 узлов инференции по нескольким регионам) должна быть запущена во второй половине 2026 года. Компания заявляет, что она масштабируется до 1 ГВт мощности инференции к 2027 году. В списке запланированных регионов – США Центральные, США Восточные, Северная и Южная Европа, а также Азия и Тихий океан.
Финансирование застройки
Запуск модуля расширяет стратегию аппаратного обеспечения, которую Runware строила с момента $50 миллионов серии А, объявленной в январе 2026 года и возглавляемой Dawn Capital с участием Comcast (CMCSA ) Ventures, Speedinvest, Insight Partners и a16z speedrun. Этот раунд финансировал расширение единой платформы API, при этом компания также продолжала строить и развертывать свои модули инференции, инфраструктуру, которую, по ее словам, можно разместить в любом месте, где дешева электроэнергия, избегая многолетних строительных проектов. Основанная в 2023 году, Runware утверждает, что она обеспечила более 10 миллиардов генераций для более 200 000 разработчиков и 300 миллионов конечных пользователей через свою платформу единого API, которая объединяет почти 300 классов моделей.
Компания вступает в капиталоемкую гонку с противоположного конца поля. Пока OpenAI, xAI и гиперскалеры тратят сотни миллиардов на фиксированные мега-кампусы, Runware делает ставку на то, что значительная часть спроса на инференцию, рабочие нагрузки, безразличные к месту выполнения, будут обслужены дешевле и быстрее за счет мощности, которую можно привезти на грузовике, подключить и переместить. С первыми модулями, уже работающими, и открытыми бронированиями мощности, эта ставка теперь имеет аппаратную поддержку.












