Συνεντεύξεις
Μπόμπι Σαμουέλς, Συνιδρυτής και Διευθύνων Σύμβουλος της Protege – Σειρά Συνεντεύξεων

Μπόμπι Σαμουέλς ηγείται της στρατηγικής και της εκτέλεσης της Protege σε προϊόν, go-to-market και διαμόρφωση κεφαλαίου. Συνίδρυσε την Protege το 2024 και έχει διατελέσει Διευθύνων Σύμβουλος από την έναρξή της. Υπό την ηγεσία του, η Protege έχει συγκεντρώσει 35 εκατομμύρια δολάρια σε χρηματοδότηση και έχει αυξηθεί σε 30 εκατομμύρια δολάρια σε GMV στο πρώτο πλήρες έτος λειτουργίας της. Προηγουμένως, ο Μπόμπι ήταν Γενικός Διευθυντής του Privacy Hub στη Datavant, όπου βοήθησε στην οδήγηση της ανάπτυξης της εταιρείας πριν από τη συγχώνευσή της με την Ciox Health, δημιουργώντας το μεγαλύτερο ουδέτερο περιβάλλον υγείας στην Αμερική. Πριν από αυτό, ηγούνταν των συνεργασιών στη LiveRamp (RAMP ), όπου ανέπτυξε εμπειρογνωσία στη δημιουργία ουδέτερων δικτύων δεδομένων. Ο Μπόμπι κατέχει MBA από το Stanford Graduate School of Business και AB από το Harvard College, όπου ήταν Πρόεδρος του The Harvard Crimson. Φέρνει βαθιά εμπειρογνωσία στη ρυθμιζόμενη ανταλλαγή δεδομένων και τη μετάφραση σύνθετων υποδομών σε αξιόπιστη ενεργοποίηση AI για εταιρικούς συνεργάτες.
Protege είναι μια εταιρεία υποδομής δεδομένων που συνδέει ιδιοκτήτες υψηλής αξίας, ιδιόκτητων συνόλων δεδομένων με dévelopers που κατασκευάζουν μοντέλα AI, προσφέροντας έναν διαχειριζόμενο και προστατευμένο τρόπο για άδεια και πρόσβαση σε δεδομένα εκπαίδευσης σε κλίμακα. Ιδρυθείσα το 2024, η πλατφόρμα επικεντρώνεται στην απελευθέρωση πολλαπλών δεδομένων – όπως ιατρικά αρχεία, εικόνες, βίντεο και ήχο – που παραδοσιακά είναι δύσκολο για τις ομάδες AI να προμηθευτούν, δίνοντας στους παρόχους δεδομένων πλήρη έλεγχο над την ιδιωτικότητα, τη συμμόρφωση και την εμπορευματοποίηση. Για τους κατασκευαστές AI, η Protege διευκολύνει την ανακάλυψη και την απόκτηση μέσω ενός επιλεγμένου καταλόγου και εργαλείων για τον χειρισμό και τη συνδυασμό συνόλων δεδομένων, βοηθώντας στην επιτάχυνση της ανάπτυξης σε τομείς όπως η υγεία, τα μέσα ενημέρωσης και άλλοι. Ουσιαστικά, η εταιρεία στοχεύει να γίνει ο αξιόπιστος υπόβαθρος δεδομένων για την AI, μειώνοντας ένα από τα μεγαλύτερα εμπόδια στις σύγχρονες εξελίξεις μοντέλων.
Τι σας ενέπνευσε να ιδρύσετε την Protege, και πώς οι εμπειρίες σας στην ηγεσία των πρωτοβουλιών δεδομένων, ιδιωτικότητας και μετασχηματισμού οργανισμών στη Datavant — καθώς και στις προηγούμενες θέσεις σας στη LiveRamp — διαμόρφωσαν την όρασή σας για την κατασκευή της;
Η εμπειρία μου στη Datavant μου έδειξε τόσο τη δύναμη όσο και τη σύνθετη φύση της συνδεσμολογίας δεδομένων με υπευθυνότητα σε κλίμακα. Η Datavant κατασκεύασε μια πλατφόρμα που βοήθησε στη σύνδεση ευαίσθητων πληροφοριών υγείας διατηρώντας την ιδιωτικότητα των ασθενών, και έγινε σαφές ότι καλά διαχειριζόμενα δεδομένα μπορούν να οδηγήσουν σε τεράστια κοινωνική πρόοδο. Αλλά όταν δεν είναι, μπορεί να προκαλέσει πραγματική ζημία.
Καθώς η AI επιταχύνθηκε, είδα το ίδιο μοτίβο να επαναλαμβάνεται: εστίαση στην υπολογιστική ισχύ και τις αρχιτεκτονικές AI, αλλά όχι τόσο στα δεδομένα που οδηγούν τα μοντέλα. Η υπόθεσή μας είναι ότι το επόμενο τεράστιο εμπόδιο είναι η πρόσβαση στα σωστά δεδομένα. Ήθελα να κατασκευάσω ένα υπόβαθρο υποδομής δεδομένων που καθιστά τη διαμοιρασία δεδομένων ασφαλή, διαφανή και αμοιβαία επωφελή για τους κατόχους δεδομένων και τους κατασκευαστές AI, ενώ παράλληλα παρέχω AI-ειδικές γνώσεις για την υποστήριξη ερευνητικών προόδων AI. Αυτό οδήγησε στην Protege.
Η Protege περιγράφεται ως η κατασκευή του “σπονδυλικού στήλης της οικονομίας δεδομένων AI”. Πώς ορίζετε αυτό το επίπεδο, και τι είναι η αληθινή υποδομή δεδομένων για την AI στην πράξη;
Η Protege είναι το συνδετικό ιστό που επιτρέπει στους ιδιοκτήτες δεδομένων και τους dévelopers AI να συνεργάζονται ασφαλώς και αποτελεσματικά. Η αληθινή υποδομή δεδομένων για την AI δεν αποθηκεύει ή μεταφέρει μόνο δεδομένα, αλλά επιβεβαιώνει την προέλευση, διαχειρίζεται τις άδειες και εξασφαλίζει ότι κάθε σύνολο δεδομένων χρησιμοποιείται ηθικά και με συναίνεση. Στην πράξη, είναι μια seule πλατφόρμα όπου οι κάτοχοι περιεχομένου μπορούν να αδειοδοτήσουν δεδομένα με εμπιστοσύνη και να αντιμετωπίζονται σωστά, και οι dévelopers AI μπορούν να προσεγγίσουν τα κρίσιμα σύνολα δεδομένων σε βιομηχανίες, τομείς, μορφές και μορφές που χρειάζονται για να εκπαιδεύσουν και να αξιολογήσουν μοντέλα με υπευθυνότητα.
Μια από τις βασικές αποστολές σας είναι η διασφάλιση ότι τα μοντέλα εκπαιδεύονται σε αδειοδοτημένα, αντιπροσωπευτικά και συναίνεση-βασισμένα σύνολα δεδομένων. Πώς η Protege λειτουργεί την ηθική προμήθεια σε κλίμακα;
Λειτουργούμε την ηθική μέσω συστημάτων, όχι συνθημάτων. Με κάθε πηγή δεδομένων και περιεχομένου που συλλέγουμε και παραδίδουμε, εξασφαλίζουμε ότι οι κάτοχοι δικαιωμάτων διατηρούν την ιδιοκτησία με σαφείς όρους αδειοδότησης και προστασίας ιδιωτικότητας.
Η πλατφόρμα μας συνδυάζει την ανθρώπινη, ερευνητική μας εμπειρογνωσία με δεδομένα αγωγούς και συστήματα που κλιμακώνουν για να παραδώσουν τα προστατευμένα δεδομένα. Επίσης, συνεργαζόμαστε με τους πελάτες μας για να εξασφαλίσουμε ότι τα δεδομένα είναι αντιπροσωπευτικά των πραγματικών πληθυσμών και ανακλούν πραγματικές περιπτώσεις χρήσης. Διευθύνοντας και τους παρόχους δεδομένων και τους αγοραστές με σαφήνεια και συνέπεια, μπορούμε να διατηρήσουμε τη συμμόρφωση, την ισότητα και την εμπιστοσύνη.
Η βιομηχανία AI έχει μακρά ιστορία με μια “σκραπ πρώτα, ρωτήστε αργότερα” νοοτροπία. Πώς βλέπετε τη διαφανή αδειοδότηση δεδομένων να επανασχεδιάζει τις σχέσεις μεταξύ παρόχων δεδομένων και dévelopers AI;
Η διαφάνεια μετατρέπει την εξαγωγή σε συνεργασία. Αντί να σκραπάρουν, οι εταιρείες AI έχουν την επιλογή να αδειοδοτήσουν δεδομένα ηθικά από εγκεκριμένους παρόχους δεδομένων, δημιουργώντας καλύτερες ενδείξεις για και τις δύο πλευρές. Οι πάροχοι δεδομένων κερδίζουν έσοδα και έλεγχο, και οι dévelopers AI λαμβάνουν καθαρότερα, υψηλότερης ποιότητας σύνολα δεδομένων χωρίς νομικά και πνευματικά δικαιώματα.
Αυτή η μετατόπιση χτίζει εμπιστοσύνη, η οποία με τη σειρά της ξεκλειδώνει ταχύτητα στην ανάπτυξη AI. Όταν οι οργανισμοί βλέπουν ότι η AI μπορεί να κατασκευαστεί με υπευθυνότητα, με σαφή συναίνεση και αποζημίωση για τους κατόχους δικαιωμάτων, αυτό ξεκλειδώνει περισσότερες περιπτώσεις χρήσης και ανάγκες δεδομένων. Αυτό δημιουργεί περισσότερη ζήτηση για υψηλής ποιότητας σύνολα δεδομένων, ξεκινώντας ένα φυσικό μηχανισμό: οι καλύτερες πηγές δεδομένων ελκύουν αγοραστές, και οι αγοραστές ελκύουν περισσότερες πηγές δεδομένων υψηλής πιστότητας. Όλοι επωφελούνται.
Η συνθετική δεδομένα συχνά θεωρείται ως λύση για προκλήματα ιδιωτικότητας και προκατάληψης. Πού βλέπετε τη σωστή ισορροπία ναлежει μεταξύ συνθετικών και πραγματικών συνόλων δεδομένων, ιδιαίτερα σε υψηλά ρυθμιζόμενους τομείς όπως η υγεία;
Η συνθετική δεδομένα είναι χρήσιμη για δοκιμές και επαύξηση, αλλά δεν μπορεί να αντικαταστήσει πλήρως τη πλήρη νюανς και σύνθεξη των πραγματικών δραστηριοτήτων που παράγουν τα δεδομένα εκπαίδευσης και αξιολόγησης. Αυτό είναι ιδιαίτερα αληθινό στην υγεία, όπου η μακροχρόνια ιστορία φροντίδας ασθενών και τα αποτελέσματα εντός του πλαισίου της φροντίδας έχουν σημασία.
Πιστεύουμε ουσιαστικά ότι η AI που δεν έχει εκπαιδευτεί στα πλήρη δεδομένα του πραγματικού κόσμου δεν μπορεί να παράγει συνθετικά δεδομένα που αντιπροσωπεύουν τον πραγματικό κόσμο. Πιθανότατα, η σωστή ισορροπία θα είναι μια υβριδική προσέγγιση, όπου θα χρειαζόμαστε πολλά περισσότερα χρήσιμα, υψηλής ποιότητας σύνολα δεδομένων που είναι τώρα απομονωμένα και χρειάζονται να απελευθερωθούν, και στη συνέχεια να τα συνδυάσουμε με συνθετικά δεδομένα που παράγονται από AI για συγκεκριμένες περιπτώσεις χρήσης.
Πώς η Protege ermögίζει στους οργανισμούς να μοιράζονται πολύτιμα πραγματικά δεδομένα ασφαλώς, χωρίς να εκθέτουν ιδιόκτητα πληροφορίες, δεδομένα ασθενών ή πνευματικά δικαιώματα;
Ασφάλεια και ιδιωτικότητα είναι ενσωματωμένα σε κάθε βήμα του ταξιδιού. Είτε μέσω των εσωτερικών μας συστημάτων είτε των συνεργατών μας για απο-ταυτοποίηση και προστασία ιδιωτικότητας που επικυρώνουν τις μεταφορές δεδομένων μας, εξασφαλίζουμε ότι τα δεδομένα μας παραμένουν εντός των προβλεπόμενων ορίων.
Στην υγεία, αυτό σημαίνει συμμόρφωση με πλαίσια ιδιωτικότητας και συμμόρφωσης για όλες τις μεταφορές δεδομένων μας. Στα μέσα ενημέρωσης, σημαίνει εξασφάλιση ότι το περιεχόμενο αδειοδοτείται μόνο για τις προβλεπόμενες χρήσεις με προκαθορισμένους όρους αδειοδότησης και διάρκεια.
Καθώς οι θεμελιώδεις μοντέλα συνεχίζουν να εξελίσσονται, τι θα ορίσει την επόμενη γενιά υψηλής ποιότητας αγωγών δεδομένων εκπαίδευσης;
Τρεις αρχές θα οδηγήσουν: προέλευση, ακρίβεια και σκοπός.
Προέλευση σημαίνει πλήρη αναγνώριση της πηγής και των όρων. Ακρίβεια σημαίνει επιμέλεια για συγκεκριμένες μορφές ή περιπτώσεις χρήσης αντί για γενικά σύνολα δεδομένων – ή δεδομένα που δεν αντανακλούν πλήρως τις πραγματικές καταστάσεις. Σκοπός σημαίνει ευθυγράμμιση της επιλογής δεδομένων με πραγματικά, συγκεκριμένα αποτελέσματα, όχι μόνο μετρήσεις vanities.
Μαζί, αυτά δημιουργούν ένα μονοπάτι προς την Nutzung υψηλής ποιότητας δεδομένων για την οδήγηση καλύτερων μοντέλων.
Πώς οι επερχόμενες ρυθμίσεις όπως ο νόμος AI της ΕΕ και τα επικείμενα πλαίσια των ΗΠΑ επηρεάζουν την προσέγγιση της Protege για τη συμμόρφωση και τη διασυνοριακή συνεργασία δεδομένων;
Αυτές οι ρυθμίσεις επικυρώνουν την προσέγγισή μας που βασίσαμε την εταιρεία. Τονίζουν τη διαφάνεια, την προέλευση και τη διαχείριση κινδύνων, τα οποία είναι ενσωματωμένα στα προϊόντα και την πλατφόρμα μας από προεπιλογή.
Πιστεύουμε ότι οι μελλοντικές ευκαιρίες AI πρέπει να προστατεύουν τους κατόχους δικαιωμάτων και να διατηρούν αυστηρικούς ελέγχους ιδιωτικότητας. Με τη θεώρηση αυτών ως μη διαπραγματεύσιμων, βοηθάμε τους παρόχους δεδομένων και τους πελάτες να προχωρήσουν με εμπιστοσύνη και εμπιστοσύνη στο συνεχώς μεταβαλλόμενο τοπίο AI. Ο στόχος μας είναι να κάνουμε την υπεύθυνη ανάπτυξη AI όχι μόνο το σωστό πράγμα να κάνετε, αλλά και το ευκολότερο.
Τι ρόλο βλέπετε τη διαφάνεια και την προέλευση να παίζουν στην ανακατασκευή της δημόσιας εμπιστοσύνης στα συστήματα AI;
Η εμπιστοσύνη αρχίζει με την αναγνώριση. Όταν οι άνθρωποι κατανοούν από πού προέρχονται τα δεδομένα και πώς χρησιμοποιούνται, είναι πιο πιθανό να εμπιστεύονται τα αποτελέσματα AI.
Η διαφάνεια και η προέλευση δημιουργούν ευθύνη από τον κάτοχο δεδομένων στον déveloper μοντέλων έως τον τελικό χρήστη. Μετατρέπουν την AI από ένα μαύρο κουτί σε κάτι πιο κατανοητό και εξηγητό.
Μετά από 20x αύξηση και 25 εκατομμύρια δολάρια στη Σειρά A, πώς ισορροπείτε την ταχεία κλιμάκωση με τη διατήρηση των ηθικών και ασφαλειών της Protege — και τι είναι το επόμενο βήμα σας καθώς συνεχίζετε να διαμορφώνετε τον τρόπο με τον οποίο οι οργανισμοί εκπαιδεύουν μοντέλα AI με υπευθυνότητα;
Η ηθική και η ασφάλεια είναι η βάση που μας επιτρέπει να κλιμακωθούμε. Κάθε νέο proceso, συνεργασία και προϊόν μετράται με βάση την λειτουργία μας ως если όλοι μας παρακολουθούν. Αν όλοι είδαν πώς λειτουργούμε και τις αποφάσεις που λαμβάνουμε, θα ήθελα να είναι υπερήφανοι.
Καθώς κοιτάμε μπροστά στο 2026, επεκτείνουμε την εμβέλεια μας σε νέες περιοχές πέρα από την υγεία και τα μέσα ενημέρωσης, καθώς και δημιουργούμε νέα προϊόντα δεδομένων, όπως δεδομένα αξιολόγησης για αναβάθμιση καθώς οι οργανισμοί AI προσπαθούν να βελτιώσουν την απόδοση AI για πραγματικές περιπτώσεις χρήσης. Ο στόχος μας είναι να γίνουμε η μοναδική αξιόπιστη πλατφόρμα για πραγματικά δεδομένα AI και εμπειρογνωσία, χτισμένη για να ενισχύσει την πρόοδο AI για μακροχρόνια.
Ευχαριστούμε για τη μεγάλη συνέντευξη, οι αναγνώστες που επιθυμούν να μάθουν περισσότερα μπορούν να επισκεφθούν Protege.












