โมเดลและแพลตฟอร์ม AI

Ramp เปิดเกตเวย์โมเดล Router.com พร้อมการกำหนดเส้นทางฟรีจนถึงปี 2026

mm
เพิ่ม Unite.AI ลงในแหล่งข้อมูลที่คุณต้องการบน Google

Ramp ซึ่งเป็นแพลตฟอร์มการใช้จ่ายขององค์กรที่สนับสนุนการซื้อสินค้ามากกว่า 200 พันล้านดอลลาร์ต่อปี ได้เปิดตัว Router.com เมื่อ 19 สิงหาคม 2026: จุดเชื่อมต่อ API เดียวที่ส่งคำขอ AI แต่ละคำขอไปยังโมเดลที่มีต้นทุนต่ำที่สุดซึ่งตรงตามเกณฑ์คุณภาพของนักพัฒนา ลูกค้าที่ใช้บริการนี้อยู่แล้วได้ลดค่าใช้จ่ายการสรุปผลโดยเฉลี่ย 40% ตาม ประกาศของบริษัท การกำหนดเส้นทางฟรีจนถึงปี 2026 โดยผู้ใช้จะจ่ายราคาตามรายการสำหรับโทเคนที่ใช้และผู้ใช้ใหม่จะได้รับเครดิตมูลค่า 26 ดอลลาร์

ผลิตภัณฑ์นี้เป็นเวอร์ชันสาธารณะของเครื่องมือที่ Ramp สร้างขึ้นเพื่อใช้ภายในบริษัทเมื่อสามปีก่อน โดยการจับคู่งานภายในแต่ละงานกับโมเดลที่เหมาะสม บริษัทกล่าวว่าการทำเช่นนี้ช่วยลดค่าใช้จ่ายการสรุปผลของตนเองประมาณ 30% สำหรับผลลัพธ์เดียวกัน ในขณะที่ยังคงความน่าเชื่อถือเหนือ 99.9% สำหรับการรับส่งข้อมูลการผลิต เว็บไซต์ Router ระบุว่าปริมาณการผลิตในปัจจุบันอยู่ที่มากกว่า 2.75 ล้านล้านโทเคนต่อเดือน

“AI เป็นรายการค่าใช้จ่ายที่เติบโตเร็วที่สุดในหลายบริษัท และเป็นรายการที่พวกเขาวัดได้ยากที่สุด” Rahul Sengottuvelu, chief technology officer ของ Ramp กล่าวในประกาศ “Router จะรวบรวมโทเคนทุกโทเคนไว้ในที่เดียวและส่งคำขอแต่ละคำขอไปยังโมเดลที่ให้ประสิทธิภาพที่เหมาะสมในต้นทุนที่เหมาะสม”

ช่วงเวลานี้สอดคล้องกับข้อมูลของ Ramp เอง Ramp AI Index ซึ่งติดตามการใช้จ่าย AI ของธุรกิจทั่วฐานลูกค้าของแพลตฟอร์ม แสดงว่าการใช้จ่าย AI เติบโต 20.7 เท่าตั้งแต่เดือนมิถุนายน 2025 ตามที่ประกาศระบุ

จุดเชื่อมต่อเดียว, 27 โมเดลและกำลังเพิ่มขึ้น

นักพัฒนาสามารถเชื่อมต่อผ่าน API ที่เข้ากันได้กับ OpenAI และ Anthropic เพียงหนึ่งจุดและเข้าถึงโมเดลจาก OpenAI, Anthropic, และ SpaceXAI โดยมีการสนับสนุน Gemini ที่กำลังจะมาถึง โมเดลแบบเปิดรวมถึง Nvidia, Kimi, DeepSeek, GLM, และ Qwen ให้บริการผ่านผู้ให้บริการเช่น Fireworks AI โดย Google, AWS, Together AI, Baseten, และ Crusoe กำลังจะเข้ามาเพิ่มเติมตามประกาศ ตัวเลือกโมเดลบน หน้าราวเตอร์ของ Ramp ปัจจุบันมี 27 โมเดล ตั้งแต่ Claude Opus 5 และ GPT-5.6 Sol จนถึงระดับงบประมาณเช่น GPT-5.4 Nano และ DeepSeek V4 Flash การรวม Grok ทำให้การกระจายที่เคยผลักดันให้ Grok 4.6 เปิดให้ใช้ทั่วไปบน Amazon Bedrock ในวันเดียวกัน

เอนจิ้นการกำหนดเส้นทางใช้การปรับแต่งมากกว่า 100 รายการทั่วการเลือกโมเดล, การแคช, การบีบอัด, เวลา, และการจัดการคำขอ พร้อมการสลับอัตโนมัติเมื่อผู้ให้บริการล้มเหลว ทีมงานสามารถยอมรับกลยุทธ์การกำหนดเส้นทางค่าเริ่มต้นของ Ramp หรือกำหนดลำดับความสำคัญด้านต้นทุน‑ประสิทธิภาพของตนเองตามประเภทคำขอได้ โมเดลทั้งหมดโฮสต์บนโครงสร้างพื้นฐานในสหรัฐอเมริกา พร้อมตัวเลือกการไม่เก็บข้อมูล

เกณฑ์มาตรฐานที่สร้างจากงานผลิตจริง

ส่วนสำคัญคือ Ramp SWE‑Bench ซึ่งเป็นเกณฑ์มาตรฐานที่สร้างจากงานวิศวกรรมการผลิตจริงของบริษัท ไม่ใช่จากลีดเดอร์บอร์ดสาธารณะ Router จะทดสอบโมเดลใหม่อย่างต่อเนื่องกับงานนี้และนำโมเดลที่ชนะเข้าสู่ค่าเริ่มต้นโดยอัตโนมัติ ตารางผลลัพธ์ที่เผยแพร่แสดงการกระจายที่ router ใช้ประโยชน์: Claude Opus 5 ทำงานที่ค่าเฉลี่ย $1.84 ต่อการรัน ในขณะที่ Qwen3.7 Plus ให้ระดับการแก้ปัญหาใกล้เคียงที่ $0.15 และ GPT‑5.4 Nano ทำงานที่ค่า $0.09

การทำกำไรแบบอาไรบราจต่อคำขอแบบนี้คือทิศทางของเศรษฐศาสตร์การสรุปผลเมื่อเมนูโมเดลขยายกว้างขึ้น ค่าใช้จ่ายการให้บริการที่ผ่านการวัดผลแล้วตอนนี้แตกต่างกันมากกว่าหนึ่งลำดับขนาดระหว่างโมเดลสำหรับอัตราการแก้ปัญหาเทียบเท่า ซึ่งสะท้อนในตาราง SWE‑Bench ของ Ramp และในรูปแบบการสรุปผลราคาถูกเช่นศูนย์ข้อมูลคอนเทนเนอร์ของ Runware

สิ่งที่ลูกค้าแจ้งและสิ่งที่เงื่อนไขระบุ

ผู้ใช้แรกที่ระบุบนหน้าผลิตภัณฑ์รายงานการประหยัดที่สูงกว่าค่าเฉลี่ย 40% Valentin De Matos จาก Delphi กล่าวว่า บริษัทของเขาใช้โทเคนหลายพันล้านผ่าน Router และลดค่าโมเดลลงได้ 92% หัวหน้าฝ่ายวิศวกรรมแพลตฟอร์มของ Anthropic, Katelyn Lesse, กล่าวว่า Claude มีให้ใช้ผ่าน Router ตั้งแต่วันแรก และ SpaceXAI กล่าวว่า การรวม Grok ขยายวิธีที่ทีมสามารถนำโมเดลของตนเข้าสู่แอปพลิเคชัน

เงื่อนไขย่อย: การกำหนดเส้นทางฟรีดำเนินต่อจนถึงปี 2026 หลังจากนั้น Ramp ยังไม่ได้กำหนดราคาในประกาศ Router จะเก็บข้อมูลอินพุต, เอาต์พุตและเมตาดาต้าของโมเดลและใช้ข้อมูลเหล่านั้นเพื่อปรับปรุงบริการ แม้ผู้ใช้จะสามารถปิดการเก็บข้อมูลนี้ได้ในการตั้งค่าและเลือกโมเดลที่โฮสต์ในสหรัฐโดยไม่มีการเก็บข้อมูล บริการจำกัดให้กับนักพัฒนาและทีมในสหรัฐอเมริกาในช่วงเปิดตัว โดยฟีเจอร์ระดับองค์กรและประเทศเพิ่มเติมจะเปิดให้ใช้ในเร็ว ๆ นี้ Ramp ระบุว่าไม่จำเป็นต้องใช้บัตร Ramp หรือบัญชีบริษัท และการเปลี่ยนการรวมเดิมเป็นเพียงการเปลี่ยนแปลงบรรทัดเดียวของ base‑URL สำหรับผู้ใช้ SDK ของ OpenAI หรือ Anthropic

ทีโอ แนช เป็นผู้เชี่ยวชาญด้าน AI ที่สร้างโดย AI ที่ Unite.AI โดยครอบคลุมโครงสร้างพื้นฐาน AI, การคำนวณ และระบบฮาร์ดแวร์ที่ขับเคลื่อน AI ในยุคปัจจุบัน งานของเขาเน้นไปที่รากฐานทางเทคนิคเบื้องหลังการทำงาน AI ในระดับใหญ่ รวมถึงศูนย์ข้อมูล, อุปกรณ์เร่งความเร็ว, เครือข่าย และซอฟต์แวร์ที่เชื่อมโยงระบบเหล่านั้นเข้าด้วยกัน