Συνεργασίες
Η Crusoe υπογράφει πολυετή συμφωνία για την ενίσχυση της εκπαίδευσης και της εκτέλεσης του Perplexity

Η Crusoe στις 15 Σεπτεμβρίου 2026, ανακοίνωσε μια πολυετή συνεργασία με την Perplexity στην οποία η Perplexity θα εκτελεί ολόκληρο τον κύκλο ζωής των μοντέλων της στο Crusoe Cloud, εκπαιδεύοντας μοντέλα αιχμής σε αφιερωμένα clusters NVIDIA GB300 NVL72 και παρέχοντάς τα σε παραγωγή μέσω της υπηρεσίας Managed Inference της Crusoe.
Η ανακοίνωση, με ημερομηνία Σαν Φρανσίσκο, δεσμεύει επίσης την Crusoe να υιοθετήσει τα Perplexity Enterprise Pro και Max για τους 1.800 υπαλλήλους της. Σύμφωνα με το δελτίο τύπου, η υλοποίηση αποσκοπεί στην εξοπλισμό του προσωπικού με δυνατότητες αναζήτησης στο web και εσωτερικής γνώσης, πολυβήματη έρευνα, ανάλυση δεδομένων και πρόσβαση σε μοντέλα AI αιχμής.
Το δελτίο περιγράφει τα προϊόντα της Perplexity ως λειτουργούν σε πραγματικό χρόνο για εκατομμύρια χρήστες, ένα περιβάλλον όπου η καθυστέρηση και η διαπερατότητα της εκτέλεσης αποτελούν το προϊόν και όχι θεωρητικά ορόσημα. Crusoe δήλωσε ότι η υπηρεσία Managed Inference έχει σχεδιαστεί για παραγωγική εκτέλεση, υποστηριζόμενη από ιδιόκτητες βελτιστοποιήσεις και σχεδιασμένη για απόδοση και κόστος σε δημοφιλή μοντέλα, και ότι το Crusoe Cloud προσφέρει το λειτουργικό βάθος και την κλίμακα που ταιριάζουν στην ανάπτυξη της Perplexity.
Δηλώσεις Εκτελεστικών
Ο συνιδρυτής και Διευθύνων Σύμβουλος της Crusoe, Chase Lochmiller, δήλωσε ότι οι πιο γρήγορα εξελισσόμενες εταιρείες AI χρειάζονται υποδομή που να συμβαδίζει με όλο τον κύκλο ζωής του μοντέλου και να κλιμακώνεται μαζί τους καθώς μεγαλώνουν. «Η Perplexity χτίζει το μέλλον του τρόπου με τον οποίο οι άνθρωποι βρίσκουν απαντήσεις, και η Crusoe είναι βασικός συνεργάτης για να το καταστήσει δυνατό, από το πρώτο ηλεκτρόνιο μέχρι το τελευταίο token», είπε ο Lochmiller.
Ο συνιδρυτής και Διευθύνων Σύμβουλος της Perplexity, Aravind Srinivas, δήλωσε ότι η λειτουργία AI στην κλίμακα της Perplexity σημαίνει ότι κάθε χιλιοστό του δευτερολέπτου καθυστέρησης αισθάνεται από τους χρήστες. Περιέγραψε την Crusoe ως σχεδιασμένη γύρω από αυτόν τον περιορισμό, χαρακτηρίζοντάς την ως εκτέλεση υψηλής διαπερατότητας και χαμηλής καθυστέρησης, υποστηριζόμενη από υλικό επόμενης γενιάς.
Ο Dion Harris, ανώτερος διευθυντής λύσεων HPC και υποδομών AI στην NVIDIA, δήλωσε ότι η σύγχρονη AI απαιτεί ενοποιημένη αρχιτεκτονική υπολογιστών από την έρευνα μέχρι την υλοποίηση. Με την ενέργεια του NVIDIA GB300 NVL72 και του NVIDIA InfiniBand, είπε ο Harris, το Crusoe Cloud επιτρέπει στην Perplexity να εκπαιδεύει, να βελτιστοποιεί και να παρέχει μοντέλα αιχμής σε παραγωγή με την ταχύτητα και την αποδοτικότητα που απαιτεί η αυτόνομη AI.
Η Πλατφόρμα GB300 NVL72
Τα αφιερωμένα clusters εκπαίδευσης που αναφέρονται στη συμφωνία λειτουργούν στο GB300 NVL72 της NVIDIA, το οποίο NVIDIA περιγράφει ως σύστημα πλήρως ψυγμένο με υγρό, κλιμακούμενο σε ράφι, που ενσωματώνει 72 GPU Blackwell Ultra και 36 CPU Grace βασισμένους σε Arm. Οι δημοσιευμένες προδιαγραφές της NVIDIA αναφέρουν 130 TB/s εύρους ζώνης NVLink, 20 TB μνήμης GPU με έως 576 TB/s εύρος ζώνης, 37 TB γρήγορης μνήμης και 2.592 πυρήνες Arm Neoverse V2. Κάθε GPU στο σύστημα λαμβάνει 800 Gb/s δικτυακή συνδεσιμότητα μέσω μονάδας ConnectX‑8 SuperNIC IO, συνεργαζόμενη είτε με πλατφόρμες InfiniBand Quantum‑X800 είτε με Ethernet Spectrum‑X.
Η NVIDIA ισχυρίζεται ότι τα εργοστάσια AI που βασίζονται στο GB300 NVL72 προσφέρουν έως και 50‑πλασια αύξηση της συνολικής απόδοσης παραγωγής AI σε σύγκριση με πλατφόρμες βασισμένες στο Hopper. Η εταιρεία αποδίδει αυτόν τον αριθμό σε βελτίωση 10‑πλασια της ανταπόκρισης των χρηστών, μετρημένη σε tokens ανά δευτερόλεπτο ανά χρήστη, και σε βελτίωση 5‑πλασια της διαπερατότητας ανά megawatt σε σχέση με το Hopper, και σημειώνει ότι οι αριθμοί είναι προβλεπόμενη απόδοση και ενδέχεται να αλλάξουν.
Υπηρεσία Managed Inference και Ιστορικό
Το στοιχείο παραγωγικής εξυπηρέτησης της συμφωνίας λειτουργεί στο Crusoe Managed Inference, το οποίο η εταιρεία κατέστη γενικά διαθέσιμο στις 20 Νοεμβρίου 2025, για φορτία παραγωγικής εκτέλεσης στο Crusoe Cloud. Η υπηρεσία τροφοδοτείται από τον ιδιόκτητο μηχανισμό εκτέλεσης της Crusoe, βασισμένο στο MemoryAlloy, μια κεντρική κρυφή μνήμη κλειδιού‑τιμής που εξαλείφει διπλότυπες προσυμπληρώσεις επιτρέποντας στα GPU να ανακτούν προεπιλεγμένες κρυφές μνήμες από τοπικούς και απομακρυσμένους κόμβους. Η Crusoe δηλώνει ότι ο μηχανισμός προσφέρει έως και 9,9‑πλασια ταχύτερο χρόνο έως το πρώτο token και 5‑πλασια υψηλότερη διαπερατότητα, συγκριτικά με το vLLM για το μοντέλο Llama‑3.3‑70B σε εγκατάσταση τεσσάρων κόμβων.
Η Crusoe προσφέρει την υπηρεσία σε τρεις επιλογές υλοποίησης, σύμφωνα με τη σελίδα προϊόντος Managed Inference. Η Serverless Inference προσφέρει κατανάλωση βάσει χρήσης ανοιχτών μοντέλων μέσω πλήρως διαχειριζόμενου API, προορισμένη για αρχικά φορτία εργασίας, χαμηλού όγκου κίνηση και γρήγορο πειραματισμό. Οι Self‑Serve Deployments, όπως δηλώνει η σελίδα ότι είναι πλέον γενικά διαθέσιμες, εκτελούν μοντέλα βελτιστοποιημένα για διαπερατότητα ή ανταπόκριση, συμπεριλαμβανομένων μοντέλων προσαρμοσμένων με το Serverless Fine‑Tuning της Crusoe. Οι Tailored Deployments συνδυάζουν πελάτες με την ομάδα της Crusoe για αφιερωμένο, δοκιμασμένο endpoint, επιλογή που η σελίδα προτείνει για ιδιόκτητα μοντέλα.
Οι προγραμματιστές έχουν πρόσβαση στην υπηρεσία μέσω του Crusoe Intelligence Foundry, ενός κέντρου όπου μπορούν να δημιουργήσουν κλειδιά API, να χρησιμοποιήσουν διαχειριζόμενα endpoints προσαρμοσμένα σε κάθε μοντέλο, να παρακολουθούν μετρικές απόδοσης και να ενεργοποιούν προδιαγεγραμμένη διαπερατότητα για υλοποιήσεις κλίμακας παραγωγής. Η πηγή μοντέλων της Crusoe καταγράφει προ‑ρυθμισμένα ανοιχτά μοντέλα από εργαστήρια όπως DeepSeek, Google, Z.ai, OpenAI, Meta, Alibaba και NVIDIA, με αναγραφόμενες μετρήσεις παραμέτρων και μήκη περιεχομένου για κάθε μοντέλο.












