एआई मॉडल और प्लेटफ़ॉर्म

Ramp ने Router.com मॉडल गेटवे लॉन्च किया, 2026 तक मुफ्त रूटिंग के साथ

mm
Unite.AI को Google पर अपने पसंदीदा स्रोतों में जोड़ें

Ramp, वह कॉरपोरेट-खर्च प्लेटफ़ॉर्म जो वार्षिक $200 बिलियन से अधिक की खरीदारी को शक्ति देता है, ने 19 अगस्त 2026 को Router.com लॉन्च किया: एकल API एंडपॉइंट जो प्रत्येक AI अनुरोध को सबसे कम लागत वाले मॉडल पर भेजता है जो डेवलपर की गुणवत्ता मानक को पूरा करता है। सेवा का उपयोग करने वाले ग्राहक औसतन अपने इनफ़रेंस खर्च को 40% तक घटा चुके हैं, जैसा कि कंपनी की घोषणा में बताया गया है। रूटिंग 2026 तक मुफ्त है, उपयोगकर्ता उपभोग किए गए टोकन के लिए सूची मूल्य का भुगतान करते हैं और नए उपयोगकर्ताओं को $26 के क्रेडिट मिलते हैं।

यह उत्पाद Ramp द्वारा तीन साल पहले अपने लिए विकसित किए गए टूलिंग का सार्वजनिक संस्करण है। प्रत्येक आंतरिक कार्य को सही मॉडल से मिलाकर, कंपनी कहती है कि उसने समान आउटपुट के लिए अपने स्वयं के इनफ़रेंस खर्च को लगभग 30% तक घटाया है, जबकि उत्पादन ट्रैफ़िक में 99.9% से अधिक विश्वसनीयता बनाए रखी है। Router साइट वर्तमान उत्पादन मात्रा को प्रति माह 2.75 ट्रिलियन से अधिक टोकन रूटेड बताती है।

“AI अधिकांश कंपनियों में सबसे तेज़ी से बढ़ने वाला खर्चा है, और वह जिसे वे सबसे कम माप सकते हैं,” Ramp के मुख्य प्रौद्योगिकी अधिकारी राहुल सेंगोट्टुवेलु ने घोषणा में कहा। “Router प्रत्येक टोकन को एक जगह रखता है और प्रत्येक अनुरोध को उस मॉडल पर भेजता है जो सही प्रदर्शन को सही लागत पर प्रदान करता है।”

समयबद्धता Ramp के अपने डेटा से मेल खाती है। Ramp AI Index, जो प्लेटफ़ॉर्म के ग्राहक आधार में व्यवसायिक AI खर्च को ट्रैक करता है, बताता है कि जून 2025 से AI खर्च 20.7 गुना बढ़ा है, जैसा कि घोषणा में कहा गया है।

एक एन्डपॉइंट, 27 मॉडल और गिनती

डेवलपर एक ही OpenAI- और Anthropic-संगत API के माध्यम से कनेक्ट होते हैं और OpenAI, Anthropic, तथा SpaceXAI के मॉडल तक पहुंचते हैं, जबकि Gemini समर्थन जल्द ही उपलब्ध होगा। Nvidia, Kimi, DeepSeek, GLM, और Qwen जैसे ओपन-वेट मॉडल Fireworks AI जैसे प्रदाताओं के माध्यम से प्रदान किए जाते हैं, और Google, AWS, Together AI, Baseten, और Crusoe भी आने वाले हैं, जैसा कि घोषणा में बताया गया है। Ramp के Router पेज पर मॉडल पिकर वर्तमान में 27 मॉडलों को कवर करता है, Claude Opus 5 और GPT-5.6 Sol से लेकर बजट स्तर जैसे GPT-5.4 Nano और DeepSeek V4 Flash तक। Grok का समावेश एक वितरण पहल को विस्तारित करता है, जिसने Grok 4.6 को उसी दिन Amazon Bedrock पर सामान्य उपलब्धता दिलाई।

रूटिंग इंजन मॉडल चयन, कैशिंग, संपीड़न, टाइमिंग और अनुरोध हैंडलिंग में 100 से अधिक अनुकूलन लागू करता है, और जब कोई प्रदाता विफल हो जाता है तो स्वचालित फॉलबैक करता है। टीमें Ramp की डिफ़ॉल्ट रूटिंग रणनीति को स्वीकार कर सकती हैं या प्रत्येक अनुरोध प्रकार के अनुसार अपनी लागत-प्रदर्शन प्राथमिकताएँ कॉन्फ़िगर कर सकती हैं। सभी मॉडल यू.एस.-आधारित इन्फ्रास्ट्रक्चर पर होस्ट किए गए हैं, और शून्य-डेटा-रिटेंशन विकल्प उपलब्ध हैं।

उत्पादन कार्य से निर्मित बेंचमार्क

मुख्य घटक Ramp SWE-Bench है, एक बेंचमार्क जो कंपनी के वास्तविक उत्पादन इंजीनियरिंग कार्यों से निर्मित है, न कि सार्वजनिक लीडरबोर्ड से। Router लगातार नए मॉडलों को उस कार्यभार के विरुद्ध परीक्षण करता है और विजेताओं को स्वचालित रूप से अपनी डिफ़ॉल्ट सेटिंग्स में शामिल करता है। प्रकाशित परिणाम तालिका दिखाती है कि Router किस तरह का अंतर उपयोग करता है: Claude Opus 5 औसत $1.84 प्रति रन में कार्य हल करता है जबकि Qwen3.7 Plus तुलनीय हल दर $0.15 पर प्राप्त करता है, और GPT-5.4 Nano $0.09 पर सस्ता कार्य संभालता है।

ऐसा प्रति‑अनुरोध आर्बिट्राज वही दिशा है जहाँ इनफ़रेंस अर्थशास्त्र मॉडल मेनू के विस्तारित होने के साथ जा रहा है। बेंचमार्क किए गए सर्विंग लागत अब समान हल दरों के लिए मॉडलों के बीच एक क्रम magnitude से अधिक भिन्न होती हैं, यह अंतर Ramp के SWE-Bench तालिका में और Runware के कंटेनराइज़्ड डेटा सेंटर जैसे सस्ते इनफ़रेंस विकल्पों में परिलक्षित होता है।

ग्राहकों की रिपोर्ट और शर्तों का विवरण

उत्पाद पृष्ठ पर उल्लिखित शुरुआती उपयोगकर्ता 40% औसत से काफी अधिक बचत की रिपोर्ट करते हैं। Delphi के Valentin De Matos कहते हैं कि उनकी कंपनी अरबों टोकन Router के माध्यम से चलाती है और मॉडल लागत में 92% की कमी आई है। Anthropic की प्लेटफ़ॉर्म इंजीनियरिंग प्रमुख, Katelyn Lesse, ने कहा कि Claude दिन-एक से ही Router के माध्यम से उपलब्ध है, और SpaceXAI ने कहा कि Grok का समावेश टीमों को उनके अनुप्रयोगों में मॉडल लाने के तरीके को विस्तारित करता है।

छोटी शर्तें: मुफ्त रूटिंग 2026 तक चलती है, उसके बाद Ramp ने घोषणा में मूल्य निर्धारण नहीं बताया है। Router मॉडल इनपुट, आउटपुट और मेटाडेटा संग्रहीत करता है और सेवा को सुधारने के लिए उस डेटा का उपयोग करता है, हालांकि उपयोगकर्ता सेटिंग्स में इसे बंद कर सकते हैं और शून्य डेटा रिटेंशन वाले यू.एस.-होस्टेड मॉडल चुन सकते हैं। सेवा लॉन्च पर केवल यू.एस. डेवलपर्स और टीमों तक सीमित है, जबकि एंटरप्राइज़ फीचर्स और अधिक देशों को जल्द ही जोड़ा जाएगा। Ramp कहता है कि कोई Ramp कार्ड या कंपनी खाता आवश्यक नहीं है, और मौजूदा इंटेग्रेशन को बदलना OpenAI या Anthropic SDK उपयोगकर्ताओं के लिए एक-लाइन बेस-URL परिवर्तन है।

थियो नैश यूनाइट.एआई में एक एआई-जनरेटेड विशेषज्ञ है, जो एआई इंफ्रास्ट्रक्चर, कंप्यूट, और आधुनिक कृत्रिम बुद्धिमत्ता को शक्ति प्रदान करने वाले हार्डवेयर सिस्टम को कवर करता है। उनका काम बड़े पैमाने पर एआई कार्यभार के पीछे के तकनीकी आधारों पर केंद्रित है, जिसमें डेटा सेंटर, एक्सेलरेटर, नेटवर्किंग, और सॉफ्टवेयर स्टैक शामिल हैं जो उन्हें एक साथ जोड़ते हैं।
एक विश्लेषणात्मक और इंजीनियरिंग-चालित दृष्टिकोण के साथ, थियो जीपीयू, कस्टम सिलिकॉन, मेमोरी आर्किटेक्चर, और वितरित प्रणालियों में प्रगति का अध्ययन करता है कि वे नए पीढ़ी के एआई मॉडल को कैसे सक्षम बनाते हैं। वह प्रदर्शन व्यापार-ऑफ, ऊर्जा दक्षता, स्केलेबिलिटी, और व्यावहारिक प्रतिबंधों पर विशेष ध्यान देता है जो एआई इंफ्रास्ट्रक्चर के वास्तविक दुनिया के तैनाती को आकार देते हैं।
थियो नैश द्वारा लिखित लेख एआई-जनरेटेड हैं और यूनाइट.एआई की संपादकीय टीम द्वारा तकनीकी सटीकता, स्पष्टता, और तेजी से विकसित हो रहे एआई कंप्यूट लैंडस्केप के जिम्मेदार कवरेज को सुनिश्चित करने के लिए समीक्षा की जाती है।