Wywiady

Bobby Samuels, współzałożyciel i CEO Protege – seria wywiadów

mm
Dodaj Unite.AI do preferowanych źródeł w Google

Bobby Samuels kieruje strategią i wykonaniem Protege w zakresie produktu, rynku i pozyskiwania kapitału. Współzałożył Protege w 2024 roku i pełni funkcję CEO od początku. Pod jego kierownictwem Protege pozyskało 35 milionów dolarów finansowania i osiągnęło 30 milionów dolarów przychodu w pierwszym pełnym roku działalności. Wcześniej Bobby był dyrektorem generalnym Privacy Hub w Datavant, gdzie pomógł w rozwoju firmy przed jej połączeniem z Ciox Health w celu utworzenia największej neutralnej sieci danych zdrowotnych w Stanach Zjednoczonych. Wcześniej kierował partnerstwami w LiveRamp (RAMP ), gdzie rozwinął umiejętności w budowaniu neutralnych sieci danych. Bobby posiada tytuł MBA ze Stanford Graduate School of Business i tytuł AB z Harvard College, gdzie był prezesem The Harvard Crimson. Przynosi głęboką wiedzę w zakresie regulowanego obrotu danymi i tłumaczenia złożonej infrastruktury na zaufane umożliwienia AI dla partnerów korporacyjnych.

Protege to firma zajmująca się infrastrukturą danych, która łączy właścicieli cennych, własnościowych zestawów danych z deweloperami budującymi modele AI, oferując zarządzaną i prywatną pierwszą możliwość licencjonowania i dostępu do danych szkoleniowych w skali. Założona w 2024 roku, platforma koncentruje się na odblokowaniu multimodalnych danych, takich jak rekordy medyczne, obrazy, filmy i dźwięk, które tradycyjnie są trudne do pozyskania przez zespoły AI, jednocześnie dając dostawcom danych pełną kontrolę nad prywatnością, zgodnością i monetyzacją. Dla budowniczych AI Protege upraszcza odkrywanie i pozyskiwanie za pomocą katalogu i narzędzi do filtrowania i łączenia zestawów danych, pomagając przyspieszyć rozwój w sektorach opieki zdrowotnej, mediów i innych. W istocie, firma ma na celu stać się zaufaną warstwą danych dla AI, redukując jeden z największych wąskich gardeł w nowoczesnym rozwoju modeli.

Czym skłoniło Cię do założenia Protege, i jak Twoje doświadczenia w kierowaniu danymi, prywatnością i transformacją organizacyjną w Datavant — a także wcześniejsze role w LiveRamp — ukształtowały Twoją wizję budowy tej firmy?

Moje doświadczenie w Datavant pokazało mi zarówno potęgę, jak i złożoność odpowiedzialnego łączenia danych w skali. Datavant zbudował platformę, która pomagała łączyć wrażliwe informacje zdrowotne, zachowując prywatność pacjentów, i stało się dla mnie jasne, że dobrze zarządzane dane mogą napędzać ogromny postęp społeczny. Ale kiedy nie są, mogą wyrządzić prawdziwą szkodę.

Ponieważ AI przyspiesza, widzę ten sam wzorzec powtarzający się: skupienie na obliczeniach i architekturach AI, ale nie tak bardzo na danych napędzających same modele. Nasza hipoteza jest taka, że następna ogromna wąska garść to dostęp do odpowiednich danych. Chciałem zbudować warstwę infrastruktury danych, która sprawia, że udostępnianie danych jest bezpieczne, przejrzyste i wzajemnie korzystne dla posiadaczy danych i budowniczych AI, a także zapewnia specjalistyczną wiedzę w zakresie danych AI, aby wspierać badawcze postępy AI. To doprowadziło do Protege.

Protege opisuje się jako budująca „kręgosłup gospodarki danych AI”. Jak definiujesz tę warstwę, i co wygląda prawdziwa infrastruktura danych dla AI w praktyce?

Protege jest tkanką łączną, która pozwala właścicielom danych i deweloperom AI współpracować bezpiecznie i wydajnie. Prawdziwa infrastruktura danych dla AI robi coś więcej niż przechowuje lub przenosi dane; weryfikuje pochodzenie, zarządza uprawnieniami i zapewnia, że każdy zestaw danych jest używany etycznie i zgodnie z zgodą. W praktyce jest to pojedyncza platforma, na której posiadacze treści mogą licencjonować dane ze zgodą i być odpowiednio wynagradzani, a budowniczy AI mogą uzyskać dostęp do kluczowych zestawów danych w różnych branżach, dziedzinach, modalnościach i formatach, których potrzebują do szkolenia i oceny modeli w sposób odpowiedzialny.

Jedną z Twoich podstawowych misji jest zapewnienie, że modele są szkolone na licencjonowanych, reprezentatywnych i opartych na zgodzie zestawach danych. Jak Protege operacjonalizuje etyczne źródła w skali?

Operacjonalizujemy etykę za pomocą systemów, a nie sloganów. Z każdym źródłem danych i treści, które agregujemy i dostarczamy, zapewniamy, że posiadacze praw utrzymują własność z wyraźnymi warunkami licencjonowania i ochroną prywatności

Nasza platforma łączy naszą ludzką, ukierunkowaną na badania ekspertyzę z potokami danych i systemami, które skalują się, aby dostarczyć chronione prawa zestawy danych. Pracujemy również z naszymi klientami, aby upewnić się, że dane są reprezentatywne dla populacji świata rzeczywistego i odzwierciedlają przypadki użycia świata rzeczywistego. Poprzez rozwiązanie zarówno dostawców, jak i nabywców danych z wyrazistością i spójnością, jesteśmy w stanie utrzymać zgodność, uczciwość i zaufanie.

Branża AI przez długi czas była napędzana przez mentalność „zrób pierwsze, zapytaj później”. Jak widzisz przejrzyste licencjonowanie danych zmieniające relacje między dostawcami danych a deweloperami AI?

Przejrzystość zmienia ekstrakcję w współpracę. Zamiast ekstrakcji, firmy AI mają opcję etycznego licencjonowania danych od zweryfikowanych dostawców danych, co tworzy lepsze zachęty dla obu stron. Dostawcy danych zyskują dochód i kontrolę, a deweloperzy AI otrzymują czystsze, wyższej jakości zestawy danych bez problemów prawnych i własności intelektualnej.

Ten przełom buduje zaufanie, które z kolei odblokowuje prędkość w rozwoju AI. Kiedy organizacje widzą, że AI można budować w sposób odpowiedzialny z wyraźną zgodą i wynagrodzeniem dla posiadaczy praw, odblokowuje to więcej przypadków użycia i potrzeb danych. To tworzy większy popyt na wysokiej jakości zestawy danych, rozpoczynając naturalny efekt kołowy: najlepsze źródła danych przyciągają nabywców, a nabywcy przyciągają więcej wiernych źródeł danych. Każdy zyskuje.

Syntetyczne dane są często postrzegane jako rozwiązanie problemów z prywatnością i stronniczością. Gdzie widzisz odpowiednią równowagę między syntetycznymi a rzeczywistymi zestawami danych, szczególnie w wysoko regulowanych sektorach, takich jak opieka zdrowotna?

Syntetyczne dane są przydatne do testowania i uzupełniania, ale nie mogą całkowicie zastąpić pełnej złożoności i nuansów rzeczywistych działań, które generują dane szkoleniowe i oceniające. Jest to szczególnie prawdziwe w opiece zdrowotnej, gdzie długoterminowa historia opieki pacjenta i wyniki w kontekście podejścia do opieki mają znaczenie.

Fundamentalnie wierzymy, że AI, które nie zostało przeszkolone na pełnej złożoności świata rzeczywistego, nie może nagle być w stanie wyprodukować syntetyczne dane, które są reprezentatywne dla świata rzeczywistego. Prawdopodobnie, odpowiednia równowaga będzie podejściem hybrydowym, gdzie będziemy potrzebować wielu bardziej przydatnych, wysokiej jakości źródeł danych, które są obecnie izolowane i muszą być odblokowane, a następnie połączone z syntetycznymi danymi AI wygenerowanymi dla konkretnych przypadków użycia.

Jak Protege umożliwia organizacjom bezpieczne udostępnianie cennych danych rzeczywistych, bez narażania informacji własnościowych, danych pacjentów lub własności intelektualnej?

Bezpieczeństwo i prywatność są wbudowane w każdy etap podróży. Niezależnie od tego, czy jest to nasze wewnętrzne systemy, czy nasze partnerstwa w zakresie deidentyfikacji i prywatności, które weryfikują nasze transfery danych, zapewniamy, że nasze dane pozostają w ramach zamierzonych granic.

W opiece zdrowotnej oznacza to przestrzeganie ram prywatności i zgodności dla wszystkich naszych transferów danych. W mediach oznacza to zapewnienie, że treści są licencjonowane tylko do zamierzonych przypadków użycia na wcześniej uzgodnionych warunkach licencjonowania i długości.

Jak nowe ramy regulacyjne, takie jak EU AI Act i nadchodzące amerykańskie ramy, wpływają na podejście Protege do zgodności i współpracy transgranicznej?

Te regulacje potwierdzają nasze podejście, na którym oparliśmy firmę. Podkreślają one przejrzystość, pochodzenie i zarządzanie ryzykiem, które są wbudowane w nasze produkty i platformę jako domyślne.

Wierzymy, że przyszłe możliwości AI muszą chronić prawa posiadaczy i utrzymywać ścisłą kontrolę prywatności. Traktując te elementy jako niepodważalne, pomagamy partnerom danych i klientom przystępować do przyszłości z ufnością i zaufaniem w ciągle zmieniającym się krajobrazie AI. Naszym celem jest uczynienie odpowiedzialnego rozwoju AI nie tylko słusznym, ale także łatwiejszym.

Jaką rolę widzisz przejrzystość danych i pochodzenie odgrywające w odbudowaniu zaufania publicznego do systemów AI?

Zaufanie zaczyna się od śledzenia. Kiedy ludzie rozumieją, skąd pochodzą dane i jak są używane, są bardziej skłonni ufać wynikom AI.

Przejrzystość i pochodzenie tworzą odpowiedzialność od posiadacza danych do dewelopera modelu do użytkownika końcowego. Zmieniają AI z czarnej skrzynki w coś bardziej zrozumiałego i wyjaśnialnego.

Po 20-krotnym wzroście i 25-milionowym finansowaniu serii A, jak równoważysz szybkie skalowanie z utrzymaniem zobowiązań etycznych i bezpieczeństwa Protege — i co jest dalej, gdy kontynuujesz kształtowanie odpowiedzialnego szkolenia modeli AI?

Etyka i bezpieczeństwo są fundamentem, który pozwala nam skalować. Każdy nowy proces, partnerstwo i produkt jest mierzony przeciwko działaniu, jak gdyby inni obserwowali. Jeśli wszyscy widzieliby, jak operujemy i jakie decyzje podejmujemy, chciałbym, aby byli dumni.

Patrząc w przyszłość na 2026 rok, rozszerzamy nasz zasięg na nowe obszary poza opieką zdrowotną i mediami, a także tworzymy nowe produkty danych, takie jak dane oceny do benchmarkingu, gdy organizacje AI dążą do lepszego pomiaru wydajności AI w przypadkach użycia świata rzeczywistego. Naszym celem jest być jedną, zaufaną platformą dla danych AI i ekspertyzy, zbudowaną, aby napędzać postępy AI na dłuższą metę. Dziękuję za wspaniały wywiad, czytelnicy, którzy chcą dowiedzieć się więcej, powinni odwiedzić Protege.

Antoine jest wizjonerskim liderem i współzałożycielem Unite.AI, który jest zmotywowany niezachwianą pasją do kształtowania i promowania przyszłości sztucznej inteligencji i robotyki. Jako serialowy przedsiębiorca, wierzy, że sztuczna inteligencja będzie tak samo przełomowa dla społeczeństwa, jak elektryczność, i często jest złapany na tym, że zachwala potencjał przełomowych technologii i AGI.

Jako futurysta, jest poświęcony badaniu, jak te innowacje ukształtują nasz świat. Ponadto, jest założycielem Securities.io, platformy skupiającej się na inwestowaniu w najnowocześniejsze technologie, które zmieniają przyszłość i przebudowują całe sektory.