Συνεντεύξεις

Μοσέ Τανάχ, CEO και Συνιδρυτής της NeuReality – Σειρά Συνεντεύξεων

mm
Προσθέστε το Unite.AI στις προτιμώμενες πηγές σας στο Google

Μοσέ Τανάχ είναι ο CEO και συνιδρυτής της NeuReality. πριν ιδρύσει την NeuReality, ο Μοσέ υπηρέτησε ως Διευθυντής Μηχανικής στην Marvell και Intel (INTC ), όπου ηγήθηκε της ανάπτυξης σύνθετων ασύρματων και δικτυακών προϊόντων σε μαζική παραγωγή. Επίσης, υπηρέτησε ως AVP της R&D στην DesignArt Networks (αργότερα αποκτήθηκε από την Qualcomm (QCOM )), όπου συνεισέφερε στην ανάπτυξη προϊόντων σταθμών βάσης 4G.

NeuReality’s αποστολή είναι να απλοποιήσει την υιοθέτηση του AI. Με την λήψη μιαςシステムικής προσεγγίσης στο AI, η ομάδα της NeuReality παρέχει ολοκληρωμένα AI inference, αναγνωρίζοντας σημεία πόνου και παρέχοντας purpose-κτισμένα, silicon-to-software AI inference λύσεις που κάνουν το AI και οικονομικά προσιτό και προσιτό.

Με την εκτεταμένη σας εμπειρία στην ηγεσία μηχανικών έργων στην Marvell, Intel και DesignArt-Networks, τι σας ενέπνευσε να συνιδρύσετε την NeuReality, και πώς οι προηγούμενες σας θέσεις επηρέασαν την όραση και την κατεύθυνση της εταιρείας;

Η NeuReality χτίστηκε από την αρχή για να λύσει τα μελλοντικά προβλήματα κόστους,复잡ότητας και κλίματος που θα ήταν αναπόφευκτα για την AI inference – η οποία είναι η ανάπτυξη εκπαιδευμένων μοντέλων AI και λογισμικού σε παραγωγή-επίπεδο AI κέντρα δεδομένων. Όπου η εκπαίδευση AI είναι το πώς δημιουργείται το AI; η inference AI είναι το πώς χρησιμοποιείται και το πώς αλληλεπιδρά με δισεκατομμύρια ανθρώπους και συσκευές σε όλο τον κόσμο.

Είμαστε μια ομάδα συστημικών μηχανικών, οπότε κοιτάμε όλες τις γωνίες, όλες τις πολλαπλές πτυχές του AI inference, συμπεριλαμβανομένων των GPU και όλων των κατηγοριών purpose-κτισμένων AI επιταχυντών. Έγινε σαφές σε μας από το 2015 ότι οι CPU-εξαρτώμενοι AI chíπ και συστήματα – τα οποία είναι κάθε GPU, TPU, LPU, NRU, ASIC και FPGA εκεί έξω – θα χτυπήσουν ένα σημαντικό τοίχο μέχρι το 2020. Τα συστημικά τους περιορισμοί όπου ο AI επιταχυντής έχει γίνει καλύτερος και ταχύτερος σε σχέση με την сыρη απόδοση, αλλά η υποκείμενη υποδομή δεν τηρήθηκε.

Ως αποτέλεσμα, αποφασίσαμε να απομακρυνθούμε από τους μεγάλους γίγαντες που είναι γεμάτοι με γραφειοκρατία που προστατεύουν επιτυχημένα επιχειρήματα, όπως οι κατασκευαστές CPU και NIC, και να διαταράξουμε την βιομηχανία με μια καλύτερη AI αρχιτεκτονική που είναι ανοιχτή, αγνωστική και purpose-κτισμένη για AI inference. Ένα από τα συμπεράσματα της ανασχεδιασμού του ιδανικού AI inference είναι ότι με την αύξηση της χρησιμοποίησης GPU και της συστημικής αποτελεσματικότητας, η νέα μας AI υπολογιστική και δικτυακή υποδομή – που τροφοδοτείται από τον νέο μας NR1 server-on-chip που αντικαθιστά τον host CPU και NICs. Jako συστατικό εμπορικό σήμα και σύντροφος σε οποιοδήποτε GPU ή AI επιταχυντή, μπορούμε να αφαιρέσουμε τις αγορές που εμποδίζουν το 65% των οργανισμών από την καινοτομία και την υιοθέτηση του AI σήμερα – υποχρησιμοποιούμενα GPU τα οποία οδηγούν στην αγορά περισσότερων από ό,τι πραγματικά χρειάζονται (επειδή τρέχουν άεργα > 50% του χρόνου) – ενώ μειώνουμε την κατανάλωση ενέργειας, την πρόκληση του AI data center και τους λειτουργικούς κόστους.

Αυτό είναι μια ευκαιρία μια φορά στη ζωή να μεταμορφώσουμε πραγματικά την αρχιτεκτονική του AI συστήματος προς το καλύτερο με βάση όλα όσα έμαθα και εξασκήθηκα για 30 χρόνια, ανοίγοντας τις πόρτες για νέους καινοτόμους του AI σε διάφορους κλάδους και αφαιρώντας CPU瓶頸,複잡ότητα και ανθρακικό αποτύπωμα.

Η αποστολή της NeuReality είναι να δημοκρατικοποιήσει το AI. Μπορείτε να εξηγήσετε τι σημαίνει “AI για Όλους” για σας και πώς η NeuReality σχεδιάζει να επιτύχει αυτή την όραση;

Η αποστολή μας είναι να δημοκρατικοποιήσουμε το AI, κάνοντάς το πιο προσιτό και προσιτό σε όλες τις οργανώσεις, μεγάλες και μικρές – απελευθερώνοντας την μέγιστη ικανότητα οποιουδήποτε GPU ή AI επιταχυντή, έτσι ώστε να πάρετε περισσότερα από την επένδυση σας; με άλλα λόγια, να πάρετε ΠΕΡΙΣΣΟΤΕΡΑ από τα GPU που αγοράζετε, αντί να αγοράζετε περισσότερα GPU που τρέχουν άεργα >50% του χρόνου. Μπορούμε να αυξήσουμε τους AI επιταχυντές μέχρι 100% της πλήρους ικανότητας, ενώ παρέχουμε μέχρι 15X ενεργειακή αποτελεσματικότητα και μειώνουμε τους συστημικούς κόστους μέχρι 90%. Αυτά είναι τάξεις μεγέθους βελτιώσεις. Σχεδιάζουμε να επιτύχουμε αυτή την όραση με την NR1 AI Inference Solution, την πρώτη αρχιτεκτονική συστήματος κέντρου δεδομένων που προορίζεται για την εποχή του AI. Τρέχει υψηλής όγκου, υψηλής ποικιλίας AI pipelines προσιτά και αποτελεσματικά με το πρόσθετο όφελος της μείωσης του ανθρακικού αποτυπώματος.

Η επίτευξη του AI για Όλους σημαίνει επίσης να το κάνουμε εύκολο στη χρήση. Στην NeuReality, απλοποιούμε την ανάπτυξη, τη διαχείριση και την κλιμάκωση της AI υποδομής, βελτιώνουμε τις επιχειρηματικές διαδικασίες και την κερδοφορία, και προωθούμε κλάδους όπως η δημόσια υγεία, η ασφάλεια, η επιβολή του νόμου και η εξυπηρέτηση πελατών. Η επίδρασή μας εκτείνεται σε κλάδους όπως η ιατρική εικόνα, οι κλινικές δοκιμές, η ανίχνευση απάτης, η δημιουργία περιεχομένου AI και πολλά άλλα.

Τώρα, τα πρώτα εμπορικά διαθέσιμα NR1-S AI Inference Appliances είναι διαθέσιμα με Qualcomm Cloud AI 100 Ultra επιταχυντές και μέσω Cirrascale, ενός παρόχου cloud υπηρεσιών.

Η NR1 AI Inference Solution είναι αναφερθεί ως η πρώτη αρχιτεκτονική συστήματος κέντρου δεδομένων που προορίζεται για την εποχή του AI, και purpose-κτισμένη για AI inference. Ποια ήταν τα κλειδιά καινοτομίες και đột pháσεις που οδήγησαν στην ανάπτυξη της NR1;

NR1™ είναι το όνομα του ολόκληρου silicon-to-software συστήματος αρχιτεκτονικής που έχουμε σχεδιάσει και παραδώσει στην βιομηχανία AI – ως ανοιχτή, πλήρως συμβατή AI υπολογιστική και δικτυακή υποδομή που συμπληρώνει πλήρως οποιοδήποτε AI επιταχυντή και GPU. Αν έπρεπε να το分 tích σε τα πιο πάνω καινοτόμα και ενθουσιαστικά καινοτομίες που οδήγησαν σε αυτή την ολοκληρωμένη NR1 Solution και τη διαφοροποιούν, θα έλεγα:

  • Βελτιστοποιημένα AI Compute Graphs: Η ομάδα σχεδίασε einen Programmable Graph Execution Accelerator για να βελτιστοποιήσει την επεξεργασία των Compute Graphs, τα οποία είναι κρίσιμα για το AI και διάφορες άλλες εργασίες όπως η επεξεργασία μέσων, βάσεις δεδομένων και πολλά άλλα. Τα Compute Graphs αντιπροσωπεύουν μια σειρά από εργασίες με εξαρτήσεις, και αυτή η ευρύτερη εφαρμοσιμότητα θέτει την NR1 ως πιθανώς διαταρακτική πέρα από την υπέρ-αύξηση των GPU και άλλων AI επιταχυντών. Απλοποιεί την ανάπτυξη μοντέλων AI με τη γεννήτρια βελτιστοποιημένων Compute Graphs (CGs) με βάση προεπεξεργασμένα AI δεδομένα και λογισμικό APIs, οδηγώντας σε σημαντικές επιδόσεις.
  • NR1 NAPU™ (Network Addressable Processing Unit): Η αρχιτεκτονική AI inference μας είναι τροφοδοτημένη από τον NR1 NAPU™ – einen 7nm server-on-chip που επιτρέπει την άμεση δικτυακή πρόσβαση για AI pre- και post-επεξεργασία. Πακετάρουμε 6.5x περισσότερο punch σε ένα μικρότερο NR1 chip από έναν τυπικό γενικό-σκοπό, host CPU. Παραδοσιακά, οι εργασίες pre-επεξεργασίας (όπως η καθαρισμός δεδομένων, η μορφοποίηση και η εξαγωγή χαρακτηριστικών) και οι εργασίες post-επεξεργασίας (όπως η ερμηνεία αποτελεσμάτων και η μορφοποίηση) χειρίζονται από τον CPU. Με την εκχώρηση αυτών των εργασιών στον NR1 NAPU™, αντικαθιστούμε cả τους CPUs και NIC. Αυτό μειώνει τα瓶頸, επιτρέποντας ταχύτερη συνολική επεξεργασία, αστραπιαία χρόνους απόκρισης και χαμηλότερο κόστος ανά AI ερώτημα. Αυτό μειώνει τα瓶頸 και επιτρέπει ταχύτερη συνολική επεξεργασία.
  • NR1™ AI-Hypervisor™ technology: Ο NR1’s patented hardware-based AI-Hypervisor™ βελτιστοποιεί την ορχήστρα AI εργασιών και την利用ποίηση πόρων, βελτιώνοντας την αποτελεσματικότητα και μειώνοντας τα瓶頸.
  • NR1™ AI-over-Fabric™ Network Engine: Ο NR1 ενσωματώνει einen μοναδικό AI-over-Fabric™ network engine που εξασφαλίζει αδιάκοπη δικτυακή σύνδεση και αποτελεσματική κλιμάκωση AI πόρων σε πολλαπλά NR1 chips – τα οποία είναι ζευγαρωμένα με οποιοδήποτε GPU ή AI επιταχυντή – μέσα στο ίδιο inference server ή NR1-S AI inference appliance.

Τα πρόσφατα δεδομένα απόδοσης της NeuReality υπογραμμίζουν σημαντικά οικονομικά και ενεργειακά αποταμιεύματα. Μπορείτε να παρέχετε περισσότερες λεπτομέρειες σχετικά με τον τρόπο με τον οποίο η NR1 επιτύγχαίνει μέχρι 90% οικονομικά αποταμιεύματα και 15x καλύτερη ενεργειακή αποτελεσματικότητα σε σύγκριση με παραδοσιακά συστήματα;

Η NeuReality’s NR1 μειώνει το κόστος και την κατανάλωση ενέργειας του AI inference μέχρι 90% και 15x, αντίστοιχα. Αυτό επιτυγχάνεται μέσω:

  • Ειδικά Silicon: Η purpose-κτισμένη AI inference υποδομή μας είναι τροφοδοτημένη από τον NR1 NAPU™ server-on-chip, ο οποίος απορροφά την λειτουργικότητα του CPU και NIC σε ένα – και εξαλείφει την ανάγκη για CPUs στην inference. Τελικά, ο NR1 μεγιστοποιεί την έξοδο οποιουδήποτε AI επιταχυντή ή GPU με τον πιο αποτελεσματικό τρόπο.
  • Βελτιστοποιημένη Αρχιτεκτονική: Με την ροή AI δεδομένων και την ενσωμάτωση AI pre- και post-επεξεργασίας直接 μέσα στον NR1 NAPU™, απομακρύνουμε και αντικαθιστούμε τον CPU. Αυτό οδηγεί σε μειωμένη καθυστέρηση, γραμμική κλιμάκωση και χαμηλότερο κόστος ανά AI ερώτημα.
  • Ελαστική Ανάπτυξη: Μπορείτε να αγοράσετε τον NR1 με δύο основные τρόπους: 1) μέσα στο NR1-M™ Module, το οποίο είναι ένα PCIe card που στεγάζει πολλαπλά NR1 NAPUs (συνήθως 10) σχεδιασμένα για να ζευγαρώσουν με τις υπάρχουσες AI επιταχυντές κάρτες. 2) μέσα στο NR1-S™ Appliance, το οποίο ζευγαρώνει NR1 NAPUs με έναν ισότιμο αριθμό AI επιταχυντών (GPU, ASIC, FPGA, κ.λπ.) ως ένα έτοιμο-για-χρήση AI Inference σύστημα.

Στην Supercomputing 2024 τον Νοέμβριο, θα μας δείτε να демонстриζόμαστε ένα NR1-S Appliance με 4x NR1 chips ανά 16x Qualcomm Cloud AI 100 Ultra επιταχυντές. Έχουμε δοκιμάσει το ίδιο με Nvidia (NVDA ) AI inference chips. Η NeuReality επαναφέρνει την AI inference με την ανοιχτή, purpose-κτισμένη αρχιτεκτονική της.

 Πώς αντιστοιχεί το NR1-S AI Inference Appliance με Qualcomm® Cloud AI 100 επιταχυντές σε σύγκριση με παραδοσιακά CPU-κεντρικά inference servers με Nvidia® H100 ή L40S GPUs σε πραγματικές εφαρμογές;

NR1, σε συνδυασμό με Qualcomm Cloud AI 100 ή NVIDIA H100 ή L40S GPUs, παρέχει σημαντική απόδοση σε πραγματικές AI εφαρμογές σε μεγάλες γλωσσικές μοντέλα όπως Llama 3, υπολογιστική όραση, φυσική γλώσσα και αναγνώριση ομιλίας. Με άλλα λόγια, η εκτέλεση του AI inference συστήματος σας με NR1 βελτιστοποιεί την απόδοση, το κόστος συστήματος, την ενεργειακή αποτελεσματικότητα και τους χρόνους απόκρισης σε εικόνες, ήχο, γλώσσα και κείμενο – και ξεχωριστά (μονόπλευρη) ή μαζί (πολυ-πλευρική).

Το τελικό αποτέλεσμα; Όταν ζευγαρωθεί με NR1, ένας πελάτης παίρνει ΠΕΡΙΣΣΟΤΕΡΑ από τις ακριβές επενδύσεις GPU που κάνει, αντί να ΑΓΟΡΑΣΕΙ περισσότερα GPUs για να επιτύχει την επιθυμητή απόδοση.

Πέρα από την μεγιστοποίηση της χρησιμοποίησης GPU, ο NR1 παρέχει εξαιρετική αποτελεσματικότητα, οδηγώντας σε 50-90% καλύτερη τιμή/απόδοση και μέχρι 13-15x μεγαλύτερη ενεργειακή αποτελεσματικότητα. Αυτό μεταφράζεται σε σημαντικά οικονομικά αποταμιεύματα και μειωμένο περιβαλλοντικό αποτύπωμα για την AI υποδομή σας.

Το NR1-S αποδεικνύει γραμμική κλιμάκωση χωρίς πτώση της απόδοσης. Μπορείτε να εξηγήσετε τις τεχνικές πτυχές που επιτρέπουν αυτή τη無шов κλιμάκωση;

Το NR1-S Appliance, ζευγαρώνοντας τους NR1 chips με AI επιταχυντές οποιουδήποτε τύπου ή ποσότητας, ανασχεδιάζει την AI υποδομή. Έχουμε μετακινηθεί πέρα από τις CPU-κεντρικές περιορισμοί για να επιτύχουμε ένα νέο επίπεδο απόδοσης και αποτελεσματικότητας.

Αντί της παραδοσιακής NIC-to-CPU-to-accelerator瓶頸, ο NR1-S ενσωματώνει άμεση δικτυακή πρόσβαση, AI pre-επεξεργασία και post-επεξεργασία μέσα στους Network Addressable Processing Units (NAPUs). Με τυπικά 10 NAPUs ανά σύστημα, το καθένα χειρίζεται εργασίες όπως η όραση, ο ήχος και η DSP επεξεργασία, και ο AI-Hypervisor™ ορχηστρώνει τις εργασίες, η ροή AI δεδομένων είναι απλοποιημένη. Αυτό μεταφράζεται σε γραμμική κλιμάκωση: προσθέστε περισσότερους επιταχυντές, πάρετε αναλογικά περισσότερη απόδοση.

Το αποτέλεσμα; 100% χρησιμοποίηση AI επιταχυντών παρατηρείται συνεχώς. Ενώ το συνολικό κόστος και η ενεργειακή αποτελεσματικότητα ποικίλλουν ανάλογα με τους συγκεκριμένους AI chíπ που χρησιμοποιούνται, η μεγιστοποίηση της επένδυσης υλικού και η βελτίωση της απόδοσης παρέχονται συνεχώς. Όσο οι ανάγκες AI inference κλιμακώνονται, το NR1-S παρέχει μια πειστική εναλλακτική λύση σε παραδοσιακές αρχιτεκτονικές.

Η NeuReality στοχεύει να αντιμετωπίσει τις μπαράζ στην ευρεία υιοθέτηση του AI. Ποια είναι τα πιο σημαντικά προβλήματα που αντιμετωπίζουν οι επιχειρήσεις όταν υιοθετούν το AI, και πώς η τεχνολογία σας βοηθά να υπερβεί αυτά τα προβλήματα;

Όταν εφαρμόζεται κακώς, το AI λογισμικό και οι λύσεις μπορούν να γίνουν προβληματικά. Πολλές επιχειρήσεις δεν μπορούν να υιοθετήσουν το AI λόγω του κόστους και της复잡ότητας της κατασκευής και κλιμάκωσης AI συστημάτων. Σήμερα, οι λύσεις AI δεν είναι βελτιστοποιημένες για inference, με training pods που έχουν κακή αποτελεσματικότητα και inference servers που έχουν υψηλά瓶頸. Για να αντιμετωπίσουμε αυτή την πρόκληση και να κάνουμε το AI πιο προσιτό, έχουμε αναπτύξει την πρώτη ολοκληρωμένη AI inference λύση – μια υπολογιστική και δικτυακή υποδομή που τροφοδοτείται από τον NAPU μας – η οποία κάνει το μέγιστο από οποιοδήποτε AI επιταχυντή και μειώνει τις αγορές που εμποδίζουν το 65% των οργανισμών από την καινοτομία και την υιοθέτηση του AI σήμερα – υποχρησιμοποιούμενα GPU τα οποία οδηγούν στην αγορά περισσότερων από ό,τι πραγματικά χρειάζονται (επειδή τρέχουν άεργα > 50% του χρόνου) – ενώ μειώνουμε την κατανάλωση ενέργειας, την πρόκληση του AI data center και τους λειτουργικούς κόστους.

Η ολοκληρωμένη μας προσεγγίση στο AI inference – αντί να αναπτύξουμε einen καλύτερο GPU ή AI επιταχυντή όπου υπάρχει ήδη πολλή καινοτομία και ανταγωνισμός – σημαίνει ότι γεμίζουμε ένα σημαντικό κενό της βιομηχανίας για δεκάδες AI inference chíπ και συστημικών καινοτόμων. Η ομάδα μας επιτέθηκε στα ελαττώματα του AI Inference συστημικά και ολοκληρωμένα, καθορίζοντας σημεία πόνου, αρχιτεκτονικά κενά και AI workload προβλέψεις — για να παραδώσουμε την πρώτη purpose-κτισμένη, silicon-to-software, CPU-ελεύθερη AI inference αρχιτεκτονική. Και αναπτύσσοντας ένα top-to-bottom AI λογισμικό stack με ανοιχτά πρότυπα από Python και Kubernetes σε συνδυασμό με NeuReality Toolchain, Provisioning, και Inference APIs, το ολοκληρωμένο μας σύνολο λογισμικού εργαλείων συνδυάζει όλα τα συστατικά σε ένα單ο high-quality UI/UX.

Σε ένα ανταγωνιστικό AI αγορά, τι διαφοροποιεί την NeuReality από άλλους παρόχους AI inference λύσεων;

Για να το πω απλά, είμαστε ανοιχτοί και επιταχυντής-αγνωστικοί. Η NR1 inference υποδομή μας supercharges οποιονδήποτε AI επιταχυντή – GPU, TPU, LPU, ASIC, ονομάστε το – δημιουργώντας ένα πραγματικά ολοκληρωμένο σύστημα. Οι AI επιταχυντές αρχικά εισήχθησαν για να βοηθήσουν τους CPUs να χειριστούν τις απαιτήσεις των νευρωνικών δικτύων και του machine learning σε μεγάλη κλίμακα, αλλά τώρα οι AI επιταχυντές έχουν γίνει τόσο ισχυροί, που τώρα εμποδίζονται από τους ίδιους τους CPUs που προορίζονταν να βοηθήσουν.

Η λύση μας; Ο NR1. Είναι μια ολοκληρωμένη, ανασχεδιασμένη AI inference αρχιτεκτονική. Το μυστικό μας όπλο; Ο NR1 NAPU™ σχεδιάστηκε ως συστατικό για να μεγιστοποιήσει την απόδοση του AI επιταχυντή χωρίς να καταναλώνει额πλέον ενέργεια ή να σπάει την τράπεζα. Έχουμε κατασκευάσει ένα ανοιχτό οικοσύστημα, ομαλά ενσωματώνοντας με οποιοδήποτε AI inference chíπ και δημοφιλείς λογισμικούς πλαισίων όπως Kubernetes, Python, TensorFlow, και πολλά άλλα.

Η ανοιχτή μας προσεγγίση σημαίνει ότι δεν ανταγωνιζόμαστε τον AI τοπίο; είμαστε εδώ για να το συμπληρώσουμε μέσω στρατηγικών συνεργασιών και τεχνολογικής συνεργασίας. Παρέχουμε το λείπων κομμάτι του puzzle: μια purpose-κτισμένη, CPU-ελεύθερη inference αρχιτεκτονική που не μόνο απελευθερώνει τους AI επιταχυντές σε benchmark απόδοση, αλλά cũng κάνει πιο εύκολο για τις επιχειρήσεις και τις κυβερνήσεις να υιοθετήσουν το AI. Φανταστείτε να απελευθερώνετε την πλήρη δύναμη των NVIDIA H100s, Google (GOOGL ) TPUs, ή AMD MI300s – δίνοντάς τους την υποδομή που αξίζουν.

Η ανοιχτή μας αρχιτεκτονική ισοπεδώνει το έδαφος, κάνει το AI πιο προσιτό και προσιτό για όλους. Είμαι παθιασμένος να δω διαφορετικούς κλάδους – fintech, biotech, healthtech – να βιώσουν το NR1 πλεονέκτημα πρώτο χέρι. Συγκρίνετε τις λύσεις AI σας σε παραδοσιακά CPU-κεντρικά συστήματα έναντι της σύγχρονης NR1 υποδομής και μαρτυρήστε τη διαφορά. Σήμερα, μόνο το 35% των επιχειρήσεων και κυβερνήσεων έχουν υιοθετήσει το AI και αυτό βασίζεται σε εξαιρετικά χαμηλά κριτήρια. Ας κάνουμε δυνατό για πάνω από 50% των επιχειρηματικών πελατών να υιοθετήσουν το AI μέχρι την επόμενη χρονιά χωρίς να βλάψουν τον πλανήτη ή να σπάσουν την τράπεζα.

Κοιτάζοντας μπροστά, τι είναι η μακροπρόθεσμη όραση της NeuReality για τον ρόλο του AI στην κοινωνία, και πώς βλέπετε την εταιρεία σας να συνεισφέρει σε αυτό το μέλλον;

Ενvisionize ένα μέλλον όπου το AI ωφελεί όλους, προάγοντας την καινοτομία και βελτιώνοντας τις ζωές. Δεν κατασκευάζουμε μόνο τεχνολογία; κατασκευάζουμε τις βάσεις για ένα καλύτερο μέλλον.

Ο NR1 μας είναι το κλειδί σε αυτή την όραση. Είναι μια ολοκληρωμένη AI inference λύση που αρχίζει να σπάει ταμπαράκια κόστους και复잡ότητας που εμποδίζουν την μαζική επιχειρηματική υιοθέτηση του AI. Έχουμε ανασχεδιάσει τόσο την υποδομή όσο και την αρχιτεκτονική, παραδίδοντας μια επαναστατική система που μεγιστοποιεί την έξοδο οποιουδήποτε GPU, οποιουδήποτε AI επιταχυντή, χωρίς να αυξάνει τους λειτουργικούς κόστους ή την κατανάλωση ενέργειας.

Το επιχειρηματικό μοντέλο έχει πραγματική σημασία για να κλιμακωθεί και να δώσει στους τελικούς πελάτες πραγματικές επιλογές πάνω από την AI αυτοκρατορία όπως έχω γράψει πριν. Έτσι, αντί να κατασκευάσουμε ένα κλειστό οικοσύστημα, κατασκευάζουμε ένα ανοιχτό οικοσύστημα όπου το silicon μας δουλεύει με άλλα silicon, όχι ενάντια σε αυτά. Αυτός είναι ο λόγος που σχεδιάσαμε τον NR1 για να ενσωματωθεί ομαλά με όλους τους AI επιταχυντές και με ανοιχτά πρότυπα και λογισμικό, καθιστώντας το τόσο εύκολο όσο είναι δυνατό να εγκαταστήσετε, να διαχειριστείτε και να κλιμακώσετε.

Αλλά δεν σταματάμε εκεί. Συνεργαζόμαστε με συνεργάτες για να επικυρώσουμε την τεχνολογία μας σε διάφορες AI workloads και να παραδώσουμε “inference-as-a-service” και “LLM-as-a-service” μέσω cloud υπηρεσιών, hyper scalers, και trực tiếp με companion chíπ makers. Θέλουμε να κάνουμε το προηγμένο AI προσιτό και προσιτό για όλους.

Φανταστείτε τις δυνατότητες αν μπορούσαμε να αυξήσουμε την απόδοση AI inference, την ενεργειακή αποτελεσματικότητα και την προσιτότητα με διψήφια ποσοστά. Φανταστείτε μια ρομποτική, AI-ενεργοποιημένη κοινωνία με περισσότερες φωνές και επιλογές που γίνονται πραγματικότητα. Έτσι, πρέπει όλοι να κάνουμε το απαιτητικό έργο της απόδειξης επιχειρηματικού αντίκτυπου και ROI όταν το AI εφαρμόζεται σε καθημερινές επιχειρηματικές εργασίες. Ας εστιάσουμε στην επαναστατική εφαρμογή του AI, όχι μόνο στην ικανότητα του AI μοντέλου.

Αυτό είναι το πώς συνεισφέρουμε σε ένα μέλλον όπου το AI ωφελεί όλους – ένα κέρδος για τα κέρδη, τους ανθρώπους και τον πλανήτη.

Ευχαριστώ για τη μεγάλη συνέντευξη, οι αναγνώστες που επιθυμούν να μάθουν περισσότερα πρέπει να επισκεφθούν NeuReality.

Ο Antoine είναι ένας οραματιστής ηγέτης και συνιδρυτής της Unite.AI, οδηγείται από μια αμετάβλητη страсть για το σχήμα και την προώθηση του μέλλοντος της τεχνητής νοημοσύνης και της ρομποτικής. Ένας σειριακός επιχειρηματίας, πιστεύει ότι η τεχνητή νοημοσύνη θα είναι τόσο διαταρακτική για την κοινωνία όσο και η ηλεκτρική ενέργεια, και συχνά πιάνεται να μιλάει για το δυναμικό των διαταρακτικών τεχνολογιών και της AGI.

Ως μελλοντολόγος, είναι αφιερωμένος στο να εξερευνήσει πώς αυτές οι καινοτομίες θα σχήματίσουν τον κόσμο μας. Επιπλέον, είναι ο ιδρυτής του Securities.io, μιας πλατφόρμας που επικεντρώνεται στις επενδύσεις σε ακριβές τεχνολογίες που ανασχεδιάζουν το μέλλον και αναμορφώνουν ολόκληρες βιομηχανίες.