Μοντέλα και πλατφόρμες AI

Η Ramp ανοίγει το Router.com Model Gateway με δωρεάν δρομολόγηση μέχρι το 2026

mm
Προσθέστε το Unite.AI στις προτιμώμενες πηγές σας στο Google

Η Ramp, η πλατφόρμα εταιρικών δαπανών που υποστηρίζει περισσότερα από 200 δισεκατομμύρια δολάρια αγορών ετησίως, λανσάρισε το Router.com στις 19 Αυγούστου 2026: ένα μοναδικό σημείο API που στέλνει κάθε αίτημα AI στο χαμηλότερο κόστος μοντέλο που πληροί το όριο ποιότητας του προγραμματιστή. Οι πελάτες που ήδη χρησιμοποιούν την υπηρεσία έχουν μειώσει το κόστος επαγωγής κατά 40 % κατά μέσο όρο, σύμφωνα με την ανακοίνωση της εταιρείας. Η δρομολόγηση είναι δωρεάν μέχρι το 2026, με τους χρήστες να πληρώνουν τη λίστα τιμών για τα tokens που καταναλώνουν και οι νέοι χρήστες να λαμβάνουν 26 $ σε πιστώσεις.

Το προϊόν είναι η δημόσια έκδοση του εργαλείου που η Ramp δημιούργησε για τον εαυτό της πριν τρία χρόνια. Συμμετρώνοντας κάθε εσωτερική εργασία με το κατάλληλο μοντέλο, η εταιρεία λέει ότι μείωσε τα δικά της κόστη επαγωγής περίπου 30 % για το ίδιο αποτέλεσμα, διατηρώντας αξιοπιστία άνω του 99,9 % σε όλη την παραγωγική κίνηση. Ο ιστότοπος Router αναφέρει ότι ο τρέχων όγκος παραγωγής ξεπερνά τα 2,75 τρισεκατομμύρια tokens που δρομολογούνται μηνιαίως.

«Η AI είναι το πιο γρήγορα αναπτυσσόμενο στοιχείο δαπάνης στις περισσότερες εταιρείες, και το πιο δύσκολο να μετρηθεί», δήλωσε ο Rahul Sengottuvelu, CTO της Ramp, στην ανακοίνωση. «Το Router συγκεντρώνει κάθε token σε ένα μέρος και στέλνει κάθε αίτημα στο μοντέλο που παρέχει τη σωστή απόδοση στο σωστό κόστος».

Η χρονική στιγμή ευθυγραμμίζεται με τα δικά της δεδομένα της Ramp. Το Ramp AI Index, που παρακολουθεί τις δαπάνες AI επιχειρήσεων σε όλη τη βάση πελατών της πλατφόρμας, δείχνει ότι οι δαπάνες AI έχουν αυξηθεί 20,7  φορές από τον Ιούνιο 2025, όπως αναφέρει η ανακοίνωση.

Ένα Σημείο Τερματισμού, 27 Μοντέλα και Συνεχής Αύξηση

Οι προγραμματιστές συνδέονται μέσω ενός API συμβατού με OpenAI και Anthropic και έχουν πρόσβαση σε μοντέλα από OpenAI, Anthropic και SpaceXAI, με υποστήριξη του Gemini να ανακοινώνεται σύντομα. Μοντέλα ανοιχτού βάρους, όπως Nvidia, Kimi, DeepSeek, GLM και Qwen, παρέχονται μέσω παρόχων όπως η Fireworks AI, ενώ Google, AWS, Together AI, Baseten και Crusoe βρίσκονται στη σειρά, σύμφωνα με την ανακοίνωση. Ο επιλογέας μοντέλων στη σελίδα Router της Ramp περιλαμβάνει επί του παρόντος 27 μοντέλα, από το Claude Opus 5 και το GPT‑5.6 Sol μέχρι οικονομικές κατηγορίες όπως το GPT‑5.4 Nano και το DeepSeek V4 Flash. Η προσθήκη του Grok επεκτείνει μια κίνηση διανομής που είδε το Grok 4.6 να φτάνει σε γενική διαθεσιμότητα στο Amazon Bedrock την ίδια ημέρα.

Η μηχανή δρομολόγησης εφαρμόζει πάνω από 100 βελτιστοποιήσεις σε επιλογή μοντέλου, caching, συμπίεση, χρονισμό και διαχείριση αιτημάτων, με αυτόματη εναλλαγή όταν ένας πάροχος αποτυγχάνει. Οι ομάδες μπορούν να αποδεχτούν την προεπιλεγμένη στρατηγική δρομολόγησης της Ramp ή να ρυθμίσουν τις δικές τους προτεραιότητες κόστους‑απόδοσης ανά τύπο αιτήματος. Όλα τα μοντέλα φιλοξενούνται σε υποδομή με έδρα τις Η.Π.Α., με επιλογές μη διατήρησης δεδομένων διαθέσιμες.

Benchmark που Δημιουργήθηκε από Παραγωγική Εργασία

Το κρίσιμο στοιχείο είναι το Ramp SWE‑Bench, ένα benchmark που δημιουργήθηκε από τις πραγματικές εργασίες παραγωγικής μηχανικής της εταιρείας αντί για δημόσιους πίνακες κατάταξης. Το Router δοκιμάζει συνεχώς νέα μοντέλα ενάντια σε αυτό το φορτίο εργασίας και ενσωματώνει αυτόματα τα νικητές στις προεπιλογές του. Ο δημοσιευμένος πίνακας αποτελεσμάτων δείχνει το εύρος που εκμεταλλεύεται το router: το Claude Opus 5 λύνει εργασίες με μέσο κόστος 1,84 $ ανά εκτέλεση, ενώ το Qwen3.7 Plus φθάνει σε συγκρίσιμο ρυθμό επίλυσης με 0,15 $, και το GPT‑5.4 Nano χειρίζεται φθηνότερη εργασία με 0,09 $.

Αυτό το είδος arbitrage ανά αίτημα είναι η κατεύθυνση της οικονομίας επαγωγής καθώς το μενού μοντέλων διευρύνεται. Τα κόστη εξυπηρέτησης που μετρήθηκαν τώρα διαφέρουν περισσότερο από μια τάξη μεγέθους μεταξύ μοντέλων για συγκρίσιμους ρυθμούς επίλυσης, ένα εύρος που αντικατοπτρίζεται στον πίνακα SWE‑Bench της Ramp και σε φθηνότερες λύσεις όπως τα containerized data centers της Runware.

Τι Αναφέρουν οι Πελάτες και Τι Λένε οι Όροι

Οι πρώτοι χρήστες που αναφέρονται στη σελίδα του προϊόντος δηλώνουν εξοικονομήσεις πολύ πάνω από το μέσο 40 %. Ο Valentin De Matos της Delphi λέει ότι η εταιρεία του διαχειρίζεται δισεκατομμύρια tokens μέσω του Router και μείωσε το κόστος μοντέλων κατά 92 %. Η επικεφαλής πλατφόρμας μηχανικής της Anthropic, Katelyn Lesse, ανέφερε ότι το Claude είναι διαθέσιμο μέσω Router από την πρώτη μέρα, και η SpaceXAI δήλωσε ότι η προσθήκη του Grok διευρύνει τον τρόπο με τον οποίο οι ομάδες μπορούν να ενσωματώσουν τα μοντέλα της στις εφαρμογές τους.

Οι λεπτομέρειες: η δωρεάν δρομολόγηση ισχύει μέχρι το 2026, μετά την οποία η Ramp δεν έχει ορίσει τιμές στην ανακοίνωση. Το Router αποθηκεύει εισόδους, εξόδους και μεταδεδομένα μοντέλων και χρησιμοποιεί αυτά τα δεδομένα για τη βελτίωση της υπηρεσίας, αν και οι χρήστες μπορούν να το απενεργοποιήσουν στις ρυθμίσεις και να επιλέξουν μοντέλα που φιλοξενούνται στις Η.Π.Α. με μη διατήρηση δεδομένων. Η υπηρεσία περιορίζεται σε προγραμματιστές και ομάδες των Η.Π.Α. κατά την εκκίνηση, με επιχειρηματικά χαρακτηριστικά και περισσότερες χώρες να ανακοινώνονται σύντομα. Η Ramp δηλώνει ότι δεν απαιτείται κάρτα Ramp ή εταιρικός λογαριασμός, και η αλλαγή μιας υπάρχουσας ενσωμάτωσης αποτελεί μια αλλαγή μίας γραμμής στη βάση‑URL για χρήστες SDK OpenAI ή Anthropic.

Ο Theo Nash είναι ένας ειδικός που δημιουργήθηκε από AI στο Unite.AI, που καλύπτει την υποδομή AI, τον υπολογισμό και τα συστήματα υλικού που τροφοδοτούν την σύγχρονη τεχνητή νοημοσύνη. Το έργο του επικεντρώνεται στις τεχνικές βάσεις πίσω από τις μεγάλες εργασίες AI, συμπεριλαμβανομένων των κέντρων δεδομένων, των επιταχυντών, των δικτύων και των στοιχείων λογισμικού που τα συνδέουν.
Με μια αναλυτική και μηχανική προοπτική, ο Theo εξετάζει πώς οι προόδους στις GPU, το εξειδικευμένο σιλικόνιο, τις αρχιτεκτονικές μνήμης και τα κατανεμημένα συστήματα επιτρέπουν новые γενιές μοντέλων AI. Δίνει ιδιαίτερη προσοχή στις ανταλλαγές απόδοσης, την ενεργειακή αποτελεσματικότητα, την κλιμακωσιμότητα και τις πρακτικές περιορισμοί που διαμορφώνουν την ανάπτυξη της υποδομής AI στον πραγματικό κόσμο.
Οι άρθρα που γράφονται από τον Theo Nash δημιουργούνται από AI και αναθεωρούνται από την редакτική ομάδα του Unite.AI για να διασφαλίσουν την τεχνική ακρίβεια, τη σαφήνεια και την υπεύθυνη κάλυψη του ταχέως εξελισσόμενου τοπίου υπολογισμού AI.