مقابلات

موسى تاناخ، الرئيس التنفيذي والشريك المؤسس لشركة NeuReality – سلسلة المقابلات

mm
أضف Unite.AI إلى مصادرك المفضلة على Google

موسى تاناخ هو الرئيس التنفيذي والشريك المؤسس لشركة NeuReality. قبل تأسيس NeuReality، شغل موسى منصب مدير الهندسة في Marvell و Intel (INTC ) ، حيث قاد تطوير منتجات لاسلكية وشبكات معقدة إلى الإنتاج الضخم. كما شغل منصب نائب الرئيس للاستشارات والبحث والتطوير في DesignArt Networks (التي تم الاستحواذ عليها لاحقًا من قبل Qualcomm (QCOM ))، حيث ساهم في تطوير منتجات محطات قاعدة 4G.

NeuReality تهدف إلى تبسيط اعتماد الذكاء الاصطناعي. من خلال اتخاذ نهج على مستوى النظام للذكاء الاصطناعي، يقدم فريق NeuReality من الخبراء في الصناعة الاستدلال بالذكاء الاصطناعي بشكل شامل، وتحديد نقاط الألم وتقديم حلول استدلال بالذكاء الاصطناعي مصممة خصيصًا، من الصيليكون إلى البرمجيات، مما يجعل الذكاء الاصطناعي ميسورًا ويمكن الوصول إليه.

مع خبرتك الواسعة في قيادة مشاريع الهندسة في Marvell و Intel و DesignArt-Networks، ما الذي ألهمك لتأسيس NeuReality، وكيف أثرت وظائفك السابقة على رؤية الشركة وتوجيهها؟

تم بناء NeuReality من البداية لحل مشاكل التكلفة والتعقيد والمناخ التي سوف تكون حتمية لاستدلال الذكاء الاصطناعي – وهو نشر نماذج وبرامج الذكاء الاصطناعي المدربة إلى مراكز بيانات الإنتاج. حيث يتم إنشاء الذكاء الاصطناعي؛ استدلال الذكاء الاصطناعي هو كيفية استخدامه وتفاعله مع مليارات الأشخاص والأجهزة حول العالم.

نحن فريق من مهندسي الأنظمة، لذلك ننظر إلى جميع الزوايا، جميع الجوانب المتعددة لاستدلال الذكاء الاصطناعي الشامل، بما في ذلك وحدات معالجة الرسومات وجميع فئات معززات الذكاء الاصطناعي المصممة خصيصًا. أصبح واضحًا لنا منذ عام 2015 أن شرائح الذكاء الاصطناعي التي تعتمد على المعالجات المركزية – والتي هي كل وحدات معالجة الرسومات، وحدات معالجة الرسومات التензور، وحدات معالجة الرسومات اللوجيك، ووحدات معالجة الرسومات العصبية، ووحدات معالجة الرسومات المتخصصة، ووحدات معالجة الرسومات القابلة للبرمجة – سوف تصل إلى حائط كبير بحلول عام 2020. القيود النظامية حيث أصبحت معززات الذكاء الاصطناعي أفضل وأسرع من حيث الأداء الخام، ولكن البنية التحتية لم تتواكب.

نتيجة لذلك، قررنا الانفصال عن العمالقة الكبيرة التي تُعرقلها البيروقراطية التي تحمي الأعمال الناجحة، مثل مصنعي المعالجات المركزية ووحدات الشبكة، وكسروا الصناعة مع هندسة الذكاء الاصطناعي الأفضل التي هي مفتوحة ومتجارة ومصممة خصيصًا لاستدلال الذكاء الاصطناعي. واحدة من استنتاجات إعادة تخيل استدلال الذكاء الاصطناعي المثالي هي أننا في تعزيز استخدام وحدات معالجة الرسومات والكفاءة على مستوى النظام، بنيتنا الجديدة لمعالجة الذكاء الاصطناعي والشبكة – مدفوعة برقمنةنا الجديدة NR1 التي تحل محل المعالج المركزي ووحدات الشبكة. كما شريك تجاري ورفيق لأي وحدة معالجة رسومات أو معزز للذكاء الاصطناعي، يمكننا إزالة الحواجز السوقية التي تمنع 65% من المنظمات من الابتكار واعتماد الذكاء الاصطناعي اليوم – وحدات معالجة الرسومات غير المستغلة التي تؤدي إلى شراء أكثر مما هو حقًا مطلوب (لأنها تعمل في حالة غير نشطة أكثر من 50% من الوقت) – مع تقليل استهلاك الطاقة وتحديات مراكز البيانات وتكاليف التشغيل.

هذه هي الفرصة الوحيدة في العمر لتحويل هندسة نظام الذكاء الاصطناعي إلى الأفضل بناءً على كل ما تعلمته ومارسته لمدة 30 عامًا، وفتح الأبواب لابتكاري الذكاء الاصطناعي الجدد عبر الصناعات وإزالة عالقات المعالجات المركزية والتعقيد والبصمات الكربونية.

مهمة NeuReality هي ديمقراطية الذكاء الاصطناعي. يمكنك توضيح ما يعني “الذكاء الاصطناعي للجميع” بالنسبة لك وكيف تخطط NeuReality لتحقيق هذه الرؤية؟

مهمتنا هي ديمقراطية الذكاء الاصطناعي عن طريق جعلها أكثر سهولة ويمكن الوصول إليها لجميع المنظمات الكبيرة والصغيرة – من خلال إطلاق القدرة القصوى لأي وحدة معالجة رسومات أو معزز للذكاء الاصطناعي، بحيث تحصل على المزيد من استثمارك؛ بمعنى آخر، احصل على المزيد من وحدات معالجة الرسومات التي تشتريها، بدلاً من شراء المزيد من وحدات معالجة الرسومات التي تعمل في حالة غير نشطة أكثر من 50% من الوقت. يمكننا تعزيز معززات الذكاء الاصطناعي حتى 100% من القدرة الكاملة، مع تقديم كفاءة طاقة تصل إلى 15 مرة وتخفيض التكاليف النظامية بنسبة تصل إلى 90%. هذه هي تحسينات من حيث الدرجة.

تحقيق الذكاء الاصطناعي للجميع يعني أيضًا جعلها سهلة الاستخدام. في NeuReality، نبسط نشر بنية الذكاء الاصطناعي وإدارتها وتوسيع نطاقها، ونحسن العمليات التجارية والربحية، ونتقدم في قطاعات مثل الصحة العامة والسلامة وإنفاذ القانون والخدمة الزبون. تأثيرنا يمتد إلى قطاعات مثل التصوير الطبي والاختبارات السريرية واكتشاف الاحتيال وإنشاء محتوى الذكاء الاصطناعي وغيرها الكثير.

في الوقت الحالي، توفر أول منتجاتنا التجارية NR1-S مع معززات Qualcomm Cloud AI 100 Ultra وผ่าน Cirrascale، وهو مزود خدمة سحابية.

يُعتبر حل NeuReality NR1 أول بنية نظام مركز بيانات مصممة خصيصًا للعصر الذكاء الاصطناعي، ومصممة خصيصًا لاستدلال الذكاء الاصطناعي. ما هي الابتكارات الرئيسية والكسرات التي أدت إلى تطوير NR1؟

NR1 ™ هو اسم البنية الشاملة للنظام الذي صممناه وقدمناه إلى صناعة الذكاء الاصطناعي – كبنية حوسبة وشبكة مفتوحة ومتوافقة تمامًا مع أي معزز للذكاء الاصطناعي ووحدات معالجة الرسومات. إذا كان عليّ تكسيرها إلى الابتكارات الفريدة والمثيرة التي أدت إلى هذه الحلول الشاملة NR1 وتمييزها، سأقول:

  • رسومات الحوسبة المثالية: صمم الفريق معزز تنفيذ الرسم البياني القابل للبرمجة لتحسين معالجة الرسومات الحاسوبية، التي هي ضرورية للذكاء الاصطناعي وعملاء آخرين مثل معالجة الوسائط والقواعد البيانية. تمثل الرسومات الحاسوبية سلسلة من العمليات ذات الاعتماديات، وتنصب هذه التطبيق الأوسع على وضع NR1 كمنشأة محتملة للذكاء الاصطناعي. يبسط نشر نموذج الذكاء الاصطناعي عن طريق توليد رسومات حاسوبية مُثلى بناءً على بيانات وبرامج الذكاء الاصطناعي المسبقة، مما يؤدي إلى مكاسب أداء كبيرة.
  • NR1 NAPU ™ (وحدة المعالجة القابلة للعنونة الشبكية): يعتمد بنية استدلال الذكاء الاصطناعي على NR1 NAPU ™ – شريحة خادم على الشبكة بحجم 7 نانومتر تتيح الوصول الشبكي المباشر لمعالجة الذكاء الاصطناعي قبل وبعد المعالجة. نحن نقدم 6.5 مرة أكثر من القوة على شريحة NR1 الأصغر من معالج خادم عام.
  • NR1 ™ AI-Hypervisor ™ التكنولوجيا: تحسن تكنولوجيا AI-Hypervisor ™ المعتمدة على الأجهزة من NR1 تنسيق المهام الذكاء الاصطناعي واستخدام الموارد، مما يحسن الكفاءة ويقلل من انسدادات النظام.
  • NR1 ™ AI-over-Fabric ™ محرك الشبكة: يتضمن NR1 محرك شبكة فريد يضمن الاتصال الشبكي السلس والتمكين الفعال لموارد الذكاء الاصطناعي عبر شريحة NR1 متعددة – متوافقة مع أي وحدة معالجة رسومات أو معزز للذكاء الاصطناعي – داخل خادم الاستدلال نفسه أو جهاز استدلال NR1-S.

تسلط بيانات الأداء الأخيرة من NeuReality الضوء على وفورات كبيرة في التكلفة والطاقة. هل يمكنك تقديم المزيد من التفاصيل حول كيفية تحقيق NR1 وفورات تصل إلى 90% في التكلفة و 15 مرة أفضل كفاءة الطاقة مقارنة بالأنظمة التقليدية؟

يقلل NR1 من تكلفة استدلال الذكاء الاصطناعي واستهلاك الطاقة بنسبة تصل إلى 90% و 15 مرة، على التوالي. يتم تحقيق ذلك من خلال:

  • السيليكون المتخصص: بنيت بنيتنا التحتية لاستدلال الذكاء الاصطناعي المصممة خصيصًا على شريحة NR1 NAPU ™، التي تمتص وظيفة المعالج المركزي ووحدة الشبكة في واحدة – وتزيل الحاجة إلى معالجات مركزية في الاستدلال.
  • الهندسة المثالية: من خلال简ification تدفق البيانات الذكاء الاصطناعي وتضمين معالجة الذكاء الاصطناعي قبل وبعد المعالجة مباشرة في NR1 NAPU ™، نزيل ونستبدل المعالج المركزي. يؤدي ذلك إلى انخفاض في التأخير، وتمكين التوسيع الخطي، وتقليل التكلفة لكل استعلام الذكاء الاصطناعي.
  • النشر المرن: يمكنك شراء NR1 بطريقتين رئيسيتين: 1) داخل وحدة NR1-M ™، وهي بطاقة PCIe تحتوي على عدة وحدات معالجة NR1 (عادة 10) مصممة للزوج مع بطاقات معززات الذكاء الاصطناعي الخاصة بك. 2) داخل جهاز NR1-S ™، الذي يزوج وحدات معالجة NR1 مع عدد متساوٍ من معززات الذكاء الاصطناعي (وحدات معالجة الرسومات، وحدات معالجة الرسومات التензور، وحدات معالجة الرسومات المتخصصة، إلخ.) كنظام استدلال الذكاء الاصطناعي جاهز.

في Supercomputing 2024 في نوفمبر، سوف تروننا نقدم جهاز NR1-S مع 4 × شريحة NR1 لكل 16 × معزز Qualcomm Cloud AI 100 Ultra. لقد قمنا بتحديث نفس الشيء مع شرائح استدلال Nvidia (NVDA ). NeuReality تحول استدلال الذكاء الاصطناعي ببنيته المفتوحة والمصممة خصيصًا.

كيف يتطابق جهاز NR1-S لاستدلال الذكاء الاصطناعي مع معززات Qualcomm ® Cloud AI 100 مقارنة بخوادم الاستدلال التقليدية التي تعتمد على المعالجات المركزية مع وحدات معالجة الرسومات Nvidia ® H100 أو L40S في التطبيقات العملية؟

NR1، مع معززات Qualcomm Cloud AI 100 أو Nvidia H100 أو L40S، يوفر تحسنًا كبيرًا في الأداء على خوادم الاستدلال التقليدية التي تعتمد على المعالجات المركزية في تطبيقات الذكاء الاصطناعي الواقعية عبر نماذج اللغة الكبيرة مثل Llama 3، و معالجة اللغة الطبيعية والتعرف على الكلام.

النتيجة؟ عند زوج NR1، يحصل العميل على المزيد من استثمارات وحدات معالجة الرسومات الغالية التي يقوم بها، بدلاً من شراء المزيد من وحدات معالجة الرسومات للوصول إلى الأداء المطلوب.

علاوة على تعزيز استخدام وحدات معالجة الرسومات، يوفر NR1 كفاءة استثنائية، مما يؤدي إلى تحسين الأداء والتكلفة بنسبة 50-90% وتقليل التكلفة بنسبة تصل إلى 13-15 مرة. يترجم هذا إلى وفورات كبيرة في التكلفة وتأثير بيئي مخفض لبنيتك التحتية للذكاء الاصطناعي.

يظهر جهاز NR1-S قابلية للتوسيع الخطي بدون انخفاض في الأداء. هل يمكنك توضيح الجوانب الفنية التي تتيح هذه القابلية للتوسيع السلس؟

جهاز NR1-S، الذي يزوج شريحة NR1 مع معززات الذكاء الاصطناعي من أي نوع أو كمية، يعيد تعريف بنية تحتية للذكاء الاصطناعي. لقد تجاوزنا القيود التقليدية التي تعتمد على المعالجات المركزية لتحقيق مستوى جديد من الأداء والكفاءة.

بدلاً من انسداد التрадиционный من وحدة الشبكة إلى المعالج المركزي إلى معزز، يدمج جهاز NR1-S الوصول الشبكي المباشر ومعالجة الذكاء الاصطناعي قبل وبعد المعالجة داخل وحدات المعالجة القابلة للعنونة الشبكية (NAPUs). مع 10 وحدات معالجة NAPU لكل نظام، يتعامل كل منها مع مهام مثل معالجة الرؤية والصوت ومعالجة الإشارات الرقمية، وorchestrating الحمل العمل من قبل AI-Hypervisor ™، يتم تحقيق تدفق البيانات الذكاء الاصطناعي المُبسطة. يترجم هذا إلى قابلية للتوسيع الخطي: أضف المزيد من المعززات، احصل على أداء متناسب.

النتيجة؟ يتم ملاحظة استخدام معززات الذكاء الاصطناعي بنسبة 100% باستمرار. في حين أن التكلفة والكفاءة الإجمالية تختلف اعتمادًا على معززات الذكاء الاصطناعي المحددة المستخدمة، يتم تقديم استثمار الأجهزة المُحسّن والأداء بانتظام. مع توسيع احتياجات استدلال الذكاء الاصطناعي، يوفر جهاز NR1-S بديلًا مقنعًا للархيتكتур التقليدية.

تهدف NeuReality إلى معالجة الحواجز التي تعترض طريق تبني الذكاء الاصطناعي على نطاق واسع. ما هي التحديات الأكثر أهمية التي تواجهها الشركات عند تبني الذكاء الاصطناعي، وكيف تساعد تكنولوجيا NeuReality على التغلب على هذه التحديات؟

عندما يتم تنفيذها بشكل سيئ، يمكن أن تصبح البرمجيات والحلول الذكاء الاصطناعي مشكلة. لا يمكن للعديد من الشركات أن تتبنى الذكاء الاصطناعي بسبب التكلفة والتعقيد المترتبين على بناء ونشر أنظمة الذكاء الاصطناعي. اليوم، لا يتم تحسين حلول الذكاء الاصطناعي للاستدلال، حيث تكون pods التدريب عادةً غير فعالة، وخوادم الاستدلال لديها انسدادات عالية. لمواجهة هذا التحدي وجعل الذكاء الاصطناعي أكثر سهولة الوصول، قمنا بتطوير أول حل كامل لاستدلال الذكاء الاصطناعي – بنية تحتية حوسبة وشبكة مدفوعة بوحدة معالجة NAPU – مما يجعل معزز الذكاء الاصطناعي المرافق أكثر قيمة، ويقلل من الحواجز السوقية حول التكلفة والاستهلاك الزائد للطاقة.

نهجنا الشامل لاستدلال الذكاء الاصطناعي – بدلاً من محاولة تطوير معزز أفضل للذكاء الاصطناعي حيث هناك بالفعل الكثير من الابتكار والمنافسة – يعني أننا نمتلئ فجوة كبيرة في الصناعة لآلات استدلال الذكاء الاصطناعي و أنظمة مبتكرة. هاجمنا فريقنا نقص استدلال الذكاء الاصطناعي بشكل منهجي وشمولي، من خلال تحديد نقاط الألم والثغرات الهندسية وتنبؤات حمولة العمل – لتقديم أول بنية تحتية مصممة خصيصًا للذكاء الاصطناعي، خالية من المعالجات المركزية، من الصيليكون إلى البرمجيات. ومن خلال تطوير مجموعة برمجيات متكاملة مع معايير مفتوحة من Python و Kubernetes، يتم دمج جميع المكونات في واجهة مستخدمية جيدة.

في سوق الذكاء الاصطناعي التنافسي، ما الذي يميز NeuReality عن مقدمي حلول استدلال الذكاء الاصطناعي الآخرين؟

لنكون简洁ًا، نحن مفتوحون ومتجارة مع معززات الذكاء الاصطناعي. بنيتنا التحتية لاستدلال الذكاء الاصطناعي تزيد من قوة أي معزز للذكاء الاصطناعي – وحدات معالجة الرسومات، وحدات معالجة الرسومات التензور، وحدات معالجة الرسومات المتخصصة، إلخ. – مما يجعل نظامًا شاملاً ومُحسّنًا. تم إدخال معززات الذكاء الاصطناعي في البداية لمساعدة المعالجات المركزية في معالجة متطلبات الشبكات العصبية والتعلم الآلي على نطاق واسع، ولكن الآن أصبحت معززات الذكاء الاصطناعي قوية جدًا، وهي الآن محظورة من قبل المعالجات المركزية التي كان من المفترض أن تساعدها.

حلتنا؟ NR1. إنه بنية استدلال الذكاء الاصطناعي الشاملة المُحسّنة. سلاحنا السري؟ تم تصميم NR1 NAPU ™ كمكون مساعد لتعزيز أداء معزز الذكاء الاصطناعي دون استهلاك طاقة إضافية أو كسر البنك. لقد بنينا نظامًا بيئيًا مفتوحًا، متكاملًا بسلاسة مع أي معزز للذكاء الاصطناعي وأطر برمجية شائعة مثل Kubernetes و Python و TensorFlow وغيرها.

نهج NeuReality المفتوح يعني أننا لا نتنافس مع منظومة الذكاء الاصطناعي؛ نحن هنا لتحسينها من خلال الشراكات الاستراتيجية والتعاون التكنولوجي. نقدم القطعة المفقودة من اللغز: بنية استدلال الذكاء الاصطناعي خالية من المعالجات المركزية، مصممة خصيصًا، التي لا فقط تفتح معززات الذكاء الاصطناعي إلى الأداء المرجعي، ولكنها أيضًا تجعل من السهل على الشركات والحكومات أن تتبنى الذكاء الاصطناعي. تخيل إطلاق القوة الكاملة لوحدات معالجة الرسومات Nvidia H100 أو وحدات معالجة الرسومات التензور من Google (GOOGL ) أو وحدات معالجة الرسومات المتخصصة من AMD – مما يمنحها البنية التحتية التي تستحقها.

تساوي بنية NeuReality المفتوحة والكفيفة الساحة، مما يجعل الذكاء الاصطناعي أكثر سهولة الوصول وميسورًا للجميع. أنا متحمس لرؤية صناعات مختلفة – التكنولوجيا المالية، التكنولوجيا الحيوية، التكنولوجيا الصحية – التي تختبر ميزة NR1 لأول مرة. قارن بين حلول الذكاء الاصطناعي الخاصة بك على أنظمة تقليدية تعتمد على المعالجات المركزية مقابل البنية الحديثة NR1 وشاهد الفرق. اليوم، فقط 35% من الشركات والحكومات تتبنى الذكاء الاصطناعي، وهذا يعتمد على معايير مؤهلة منخفضة جدًا. دعونا نجعل من الممكن لأكثر من 50% من العملاء المؤسسين أن يتبنوا الذكاء الاصطناعي في غضون عام بدون إيذاء الكوكب أو كسر البنك.

إلى الأمام، ما هي رؤية NeuReality الطويلة الأمد لدور الذكاء الاصطناعي في المجتمع، وكيف ترى شركتك تساهم في هذا المستقبل؟

أتخيل مستقبلًا حيث يفيد الذكاء الاصطناعي الجميع، مما يؤدي إلى تحسين الابتكار وتحسين الحياة. نحن لا نبني فقط تكنولوجيا؛ نحن نبني الأساس لمستقبل أفضل.

NR1 هو مفتاح هذه الرؤية. إنه حل استدلال الذكاء الاصطناعي الشامل الذي يبدأ في كسر الحواجز التكلفة والتعقيد التي تعترض طريق تبني الأعمال للذكاء الاصطناعي. لقد أعدنا تخيل البنية التحتية والهندسة، وقدمنا نظامًا ثوريًا يزيد من إنتاجية أي وحدة معالجة رسومات أو معزز للذكاء الاصطناعي، دون زيادة التكاليف التشغيلية أو استهلاك الطاقة.

النموذج التجاري مهم جدًا للتوسع واعطاء العملاء الخيارات الحقيقية على السوق المركزة للذكاء الاصطناعي. لذلك، نحن نبني نظامًا بيئيًا مفتوحًا، حيث تعمل سيليكوننا مع سيليكون آخر، وليس ضده. هذا هو السبب في أننا صممنا NR1 ليتكامل بسلاسة مع جميع معززات الذكاء الاصطناعي والطرازات المفتوحة والبرمجيات. نحن نتعاون مع الشركاء لتحقق تقنياتنا عبر مختلف حمولات العمل وتنفيذ “الاستدلال كخدمة” و “LLM كخدمة” من خلال مزودي الخدمات السحابية والموسعين والشركاء المباشرين مع مصنعي الشريحة. نحن نريد جعل الذكاء الاصطناعي المتقدم ميسورًا وميسورًا للجميع.

تخيل الإمكانيات إذا كنا نستطيع أن نزيد من أداء استدلال الذكاء الاصطناعي والكفاءة والمتانة بنسبة مئوية من حيث الدرجة. تخيل مجتمعًا قويًا مدعومًا بالذكاء الاصطناعي مع المزيد من الأصوات والخيارات التي تصبح حقيقة واقعة. لذلك، يجب علينا جميعًا أن نقوم بالعمل الصعب لتحقيق التأثير التجاري و ROI عند تنفيذ الذكاء الاصطناعي في عمليات يومية لمراكز البيانات. دعونا نركز على تنفيذ الذكاء الاصطناعي الثوري، وليس فقط قدرة نموذج الذكاء الاصطناعي.

هذا هو كيف نساهم في مستقبل حيث يفيد الذكاء الاصطناعي الجميع – فوز للهامش الربحي، الناس، والكوكب.

شكرًا على المقابلة الرائعة، القراء الذين يرغبون في معرفة المزيد يجب أن يزوروا NeuReality.

أنطوان هو قائد رؤيوي وشريك مؤسس في Unite.AI، مدفوعًا برغبة لا تكل في تشكيل وتعزيز مستقبل الذكاء الاصطناعي والروبوتات. وهو رائد أعمال متسلسل، يعتقد أن الذكاء الاصطناعي سيكون مدمرًا للمجتمع مثل الكهرباء، وغالبًا ما يُقبض عليه وهو يثرثر عن إمكانات التكنولوجيا المثيرة للدهشة والذكاء الاصطناعي العام.

كما أنه مستقبلي، فهو مخصص لاستكشاف كيف ستشكل هذه الابتكارات العالم. بالإضافة إلى ذلك، فهو مؤسس Securities.io، وهي منصة تركز على الاستثمار في التكنولوجيا المتقدمة التي تعيد تعريف المستقبل وتعيد تشكيل القطاعات بأكملها.