Modele i platformy AI
Ramp uruchamia bramę modelową Router.com z darmowym routingiem do 2026 roku

Ramp, platforma wydatków korporacyjnych, obsługująca ponad $200 mld zakupów rocznie, uruchomiła Router.com 19 sierpnia 2026: jedną końcówkę API, która kieruje każde żądanie AI do najtańszego modelu spełniającego wymogi jakości dewelopera. Klienci już korzystający z usługi obniżyli średnio koszty inferencji o 40 % według ogłoszenia firmy. Routing jest darmowy do 2026 roku, a użytkownicy płacą cenę katalogową za zużyte tokeny oraz nowi użytkownicy otrzymują $26 w kredytach.
Produkt jest publiczną wersją narzędzi, które Ramp stworzył dla siebie trzy lata temu. Dopasowując każde wewnętrzne zadanie do odpowiedniego modelu, firma twierdzi, że obniżyła własne koszty inferencji o około 30 % przy tym samym wyniku, zachowując ponad 99,9 % niezawodności w ruchu produkcyjnym. Strona Router podaje, że aktualny wolumen produkcyjny wynosi ponad 2,75 biliona tokenów kierowanych miesięcznie.
„AI jest najszybciej rosnącą pozycją w budżetach większości firm i jednocześnie najtrudniej mierzalną,” powiedział Rahul Sengottuvelu, dyrektor techniczny Ramp, w ogłoszeniu. „Router gromadzi każdy token w jednym miejscu i kieruje każde żądanie do modelu, który zapewnia odpowiednią wydajność przy właściwym koszcie.”
Termin pokrywa się z danymi Ramp. Ramp AI Index, który monitoruje wydatki firm na AI wśród klientów platformy, wykazuje, że wydatki na AI wzrosły 20,7‑krotnie od czerwca 2025, podaje ogłoszenie.
Jeden punkt końcowy, 27 modeli i rośnie
Deweloperzy łączą się przez jedną API kompatybilną z OpenAI i Anthropic i mają dostęp do modeli od OpenAI, Anthropic i SpaceXAI, przy czym wsparcie dla Gemini jest w planach. Modele otwarto‑wagowe, w tym Nvidia, Kimi, DeepSeek, GLM i Qwen, są udostępniane przez dostawców takich jak Fireworks AI, a w drodze są Google, AWS, Together AI, Baseten i Crusoe, zgodnie z ogłoszeniem. Wybór modeli na stronie Router firmy Ramp obejmuje obecnie 27 modeli, od Claude Opus 5 i GPT‑5.6 Sol po tańsze warianty takie jak GPT‑5.4 Nano i DeepSeek V4 Flash. Dodanie Grok rozszerza dystrybucję, co spowodowało, że Grok 4.6 stał się dostępny ogólnie w Amazon Bedrock tego samego dnia.
Silnik routingu stosuje ponad 100 optymalizacji w zakresie wyboru modelu, buforowania, kompresji, synchronizacji i obsługi żądań, z automatycznym przełączaniem w razie awarii dostawcy. Zespoły mogą przyjąć domyślną strategię routingu Ramp lub skonfigurować własne priorytety koszt‑wydajność dla każdego typu żądania. Wszystkie modele są hostowane na infrastrukturze w USA, dostępne są opcje braku przechowywania danych.
Benchmark oparty na pracy produkcyjnej
Kluczowym elementem jest Ramp SWE‑Bench, benchmark oparty na rzeczywistych zadaniach inżynieryjnych firmy, a nie na publicznych rankingach. Router nieustannie testuje nowe modele pod kątem tego obciążenia i automatycznie włącza zwycięskie do swoich ustawień domyślnych. Opublikowana tabela wyników pokazuje rozpiętość, którą router wykorzystuje: Claude Opus 5 rozwiązuje zadania przy średnim koszcie $1.84 za uruchomienie, podczas gdy Qwen 3.7 Plus osiąga porównywalny wskaźnik przy $0.15, a GPT‑5.4 Nano obsługuje tańsze zadania przy $0.09.
Tego rodzaju arbitraż na poziomie pojedynczego żądania to kierunek, w którym zmierza ekonomia inferencji, gdy oferta modeli się rozszerza. Koszty obsługi benchmarkowane różnią się teraz o ponad rząd wielkości między modelami przy podobnych wskaźnikach rozwiązania, co odzwierciedla tabela SWE‑Bench Ramp oraz tańsze rozwiązania inferencyjne, takie jak konteneryzowane centra danych Runware.
Co klienci zgłaszają i co mówią warunki
Wczesni użytkownicy wymienieni na stronie produktu zgłaszają oszczędności znacznie przewyższające średnią 40 %. Valentin De Matos z Delphi twierdzi, że jego firma przetwarza miliardy tokenów przez Router i obniżyła koszty modeli o 92 %. Szefowa inżynierii platformy w Anthropic, Katelyn Lesse, powiedziała, że Claude jest dostępny w Router od pierwszego dnia, a SpaceXAI stwierdziło, że włączenie Grok rozszerza możliwości zespołów w integrowaniu jego modeli z aplikacjami.
Drobny druk: darmowy routing obowiązuje do 2026 roku, po czym Ramp nie określił jeszcze cen w ogłoszeniu. Router przechowuje wejścia, wyjścia i metadane modeli i wykorzystuje te dane do ulepszania usługi, choć użytkownicy mogą wyłączyć tę funkcję w ustawieniach i wybrać modele hostowane w USA bez przechowywania danych. Usługa jest początkowo dostępna tylko dla deweloperów i zespołów z USA, a funkcje dla przedsiębiorstw oraz kolejne kraje są w planach. Ramp podkreśla, że nie jest wymagana karta Ramp ani konto firmowe, a przełączenie istniejącej integracji wymaga jedynie jednowierszowej zmiany bazowego URL dla użytkowników SDK OpenAI lub Anthropic.












