Röportajlar
Bobby Samuels, Protege’nin Kurucu Ortağı ve CEO’su – Röportaj Serisi

Bobby Samuels Protege’nin ürün, pazara sürme ve sermaye oluşumunu kapsayan stratejisinin ve yürütmesinin liderliğini yapıyor. 2024 yılında Protege’yi kurdu ve kuruluşundan bu yana CEO olarak görev yapıyor. Liderliği altında Protege, 35M$’lık fon topladı ve ilk tam yılında 30M$’lık GMV’ye ulaştı. Önceki olarak, Datavant’ta Gizlilik Merkezi’nin Genel Müdürü olarak görev yaptı ve şirketin 7,0M$’lık Ciox Health ile birleşerek ABD’deki en büyük tarafsız sağlık veri ekosistemini oluşturmasına yardımcı oldu. Daha önce, LiveRamp’ (RAMP ) te işbirlikleri konusunda uzmanlaşarak tarafsız veri ağları oluşturmada uzmanlık kazandı. Bobby, Stanford Graduate School of Business’tan MBA ve Harvard College’dan A.B. derecesine sahiptir ve burada The Harvard Crimson’un Başkanlığını yaptı. Düzenlenmiş veri alışverişi ve karmaşık altyapının şirket ortakları için güvenilir AI ermögansiyonuna dönüştürülmesi konusunda derin uzmanlığa sahiptir.
Protege yüksek değerli, özel veri setlerinin sahiplerini AI modelleri geliştiren geliştiricilerle bağlayan bir veri altyapısı şirketidir ve ölçekte veri lisanslama ve erişim için yönetilen ve gizlilik öncelikli bir yol sunar. 2024 yılında kurulan platform, geleneksel olarak AI ekipleri için zor olan tıbbi kayıtlar, görüntüler, video ve ses gibi çok modlu verilerin kilidini açmaya odaklanıyor ve veri sağlayıcılarına gizlilik, uyum ve para kazanma konusunda tam kontrol sağlıyor. AI geliştiricileri için Protege, bir katalog ve veri setlerini filtreleme ve birleştirme araçları aracılığıyla keşif ve edinimi basitleştiriyor ve sağlık, medya ve diğer sektörlerde geliştirme hızını artırıyor. Aslında, şirket AI için güvenilir veri katmanını oluşturmak istiyor ve modern model geliştirmesindeki en büyük tıkanıklıklardan birini azaltıyor.
Sizi Protege’yi kurmaya iten şey nedir ve Datavant’ta veri, gizlilik ve organizasyonel dönüşüm girişimlerini yönetme deneyiminiz, LiveRamp’teki önceki rolleriniz nasıl bir vizyon oluşturdu?
Datavant’taki deneyimim, verilerin sorumlu bir şekilde bağlanmasının hem gücünü hem de karmaşıklığını gösterdi. Datavant, hasta gizliliği korurken duyarlı sağlık bilgilerini bağlayan bir platform oluşturdu ve iyi yönetilen verilerin büyük toplumsal ilerlemeye yol açabileceğini anladım. Ancak, iyi yönetilmediğinde gerçek zarar verebileceğini de anladım.
AI hızlandıkça, aynı modeli tekrar gördüm: hesaplama ve AI mimarilerine odaklanma, ancak modelleri sürdüren verilere değil. Hipotezimiz, bir sonraki büyük tıkanıklığın doğru verilere erişimi olduğudur. Güvenli, şeffaf ve veri sahipleri ve AI geliştiricileri için karşılıklı olarak faydalı olan bir veri altyapısı katmanını oluşturmak istedim ve bu, Protege’nin oluşmasına yol açtı.
Protege, “AI veri ekonomisinin omurgasını” inşa ediyor diyorsunuz. Bu katmanı nasıl tanımlarsınız ve AI için gerçek veri altyapısı nasıl görünür?
Protege, veri sahipleri ve AI geliştiricilerinin güvenli ve verimli bir şekilde işbirliği yapmasına olanak tanıyan bağlantılı dokudur. AI için gerçek veri altyapısı, yalnızca veri depolama veya taşıma değil, kökeni doğrulama, izinleri yönetme ve her veri setinin etik ve izinli bir şekilde kullanılmasıdır. Uygulamada, içerik sahiplerinin veri lisansını güvenle ve uygun bir şekilde yapabildikleri ve AI geliştiricilerinin endüstri, alan, modeller ve formatlar boyunca kritik veri setlerine erişebildiği tek bir platformdur.
Lisanslı, temsil edilen ve izin verilen veri setleriyle modelleri eğitmek için temel bir misyonunuz var. Protege, büyük ölçekte etik kaynak kullanımını nasıl gerçekleştirir?
Etikliği sistemler aracılığıyla, sloganlar aracılığıyla değil gerçekleştiriyoruz. Birleştirdiğimiz ve teslim ettiğimiz her veri ve içerik kaynağı için, hak sahiplerinin lisans koşulları ve gizlilik koruması ile sahip olduğunu garantiliyoruz.
Platformumuz, insan merkezli, araştırma odaklı uzmanlığımızı veri boru hatları ve sistemlerle birleştirerek hakları korunan verileri ölçeklendirerek teslim ediyor. Ayrıca, veri satın alan müşterilerimizle birlikte verilerin gerçek dünya popülasyonlarını temsil ettiğini ve gerçek dünya kullanım örneklerini yansıttığını garantiliyoruz. Hem veri sağlayıcıları hem de veri alıcıları ile şeffaflık ve tutarlılık yoluyla çalışarak, uyumu, adilliği ve güveni sağlıyoruz.
AI endüstrisi uzun süredir “önce kazı, sonra soru” mantığıyla ilerledi. Şeffaf veri lisansının veri sağlayıcıları ve AI geliştiricileri arasındaki ilişkileri nasıl değiştireceğini düşünüyorsunuz?
Şeffaflık, çıkarmayı işbirliğine dönüştürür. AI şirketleri, artık etik bir şekilde veri sağlayıcılarından veri lisanslayabilir, bu da her iki taraf için daha iyi teşvikler oluşturur. Veri sağlayıcıları gelir ve kontrol kazanırlar, AI geliştiricileri ise daha temiz ve yüksek kaliteli veri setlerine sahip olurlar ve yasal ve IP sorunları olmaz.
Bu değişiklik, AI geliştirmesinde hızlanmaya yol açar. Organizasyonlar, AI’nin sorumlu bir şekilde, açık izin ve veri hakları sahipleri için uygun bir şekilde inşa edilebileceğini gördüklerinde, daha fazla kullanım örneği ve veri ihtiyacı ortaya çıkar. Bu, daha yüksek kaliteli veri setleri için daha fazla talebe yol açar, doğal bir büyüme yaratır: en iyi veri kaynakları alıcıları çeker, alıcılar da daha yüksek kaliteli veri kaynaklarını çeker. Herkes kazanır.
Sentetik veri, gizlilik ve önyargı sorunlarına bir çözüm olarak görülüyor. Sağlık gibi yüksek düzenlenmiş sektörlerde sentetik ve gerçek dünya veri setleri arasındaki doğru denge nerede?
Sentetik veri, test ve artırma için faydalıdır, ancak gerçek dünya faaliyetlerinin tüm nüans ve karmaşıklığını tamamen değiştiremez. Özellikle sağlık sektöründe, uzun süreli hasta bakım tarihi ve sonuçları önemlidir.
Temel olarak, AI’nin gerçek dünya faaliyetlerinin tüm karmaşıklığını temsil eden sentetik veri üretemeyeceğine inanıyoruz. Doğru denge, muhtemelen, daha fazla yüksek kaliteli veri kaynağının kilidini açmak ve bunları AI tarafından üretilen sentetik veri ile belirli kullanım örnekleri için birleştirmek olacaktır.
Protege, organizasyonların değerli gerçek dünya verilerini güvenli bir şekilde, özel bilgileri, hasta verilerini veya fikri mülkiyetini açığa çıkarmadan nasıl paylaşıyor?
Güvenlik ve gizlilik, her adımda inşa edilmiştir. İç sistemlerimiz veya veri transferlerimizi doğrulayan gizlilik ortaklarımız aracılığıyla, verilerin amaçlanan sınırlar içinde kaldığını garantiliyoruz.
Sağlık sektöründe, bu, tüm veri transferlerimiz için gizlilik ve uyum çerçevelerine uymak anlamına gelir. Medya sektöründe, içeriklerin yalnızca amaçlanan kullanımlar için lisanslandığından ve lisans koşulları ve süreleri konusunda anlaşmaya varıldığından emin olmak anlamına gelir.
Vakıf modelleri devam ederken, yüksek kaliteli eğitim veri boru hatlarını tanımlayan nedir?
Üç ilke öne çıkacak: köken, doğruluk ve amaç.
Köken, kaynak ve koşulların tam izlenebilirliğini ifade eder. Doğruluk, özel modeller veya kullanım örnekleri için değil, genel veri korpora veya gerçek dünya durumlarını tam olarak yansıtmayan veri değil, veri setlerinin oluşturulmasını ifade eder. Amaç, veri seçimini gerçek ve somut sonuçlarla uyumlu hale getirmeyi, yalnızca gösterişli benchmark’leri değil, ifade eder.
Bu ilkeler birlikte, daha iyi modelleri sürdürebilmek için yüksek kaliteli verilerin yolunu açar.
Yaklaşan AB AI Yasası ve ABD çerçeveleri gibi ortaya çıkan düzenlemeler, Protege’nin uyum ve çapraz border veri işbirliği yaklaşımını nasıl etkiliyor?
Bu düzenlemeler, şirketin temelini oluşturduğumuz yaklaşımı doğruluyor. Şeffaflık, köken ve risk yönetimini vurguluyorlar ve bu ilkeler ürünlerimizde ve platformumuzda varsayılan olarak gömülüdür.
Gelecek AI fırsatlarının hak sahiplerini korumak ve sıkı gizlilik kontrollerini sürdürmek zorunda olduğuna inanıyoruz. Bu ilkeleri müzakere edilemez olarak ele alarak, veri ortaklarımız ve müşterilerimizle birlikte değişen AI manzarasında güvenle ilerlemelerine yardımcı oluyoruz. Amacımız, sorumlu AI geliştirmeyi yalnızca doğru şey yapmak değil, aynı zamanda daha kolay yapmak.
AI sistemlerine olan kamu güvenini yeniden inşa etmede veri şeffaflığı ve kökeninin rolünü nasıl görüyorsunuz?
Güven, izlenebilirlikten başlar. İnsanlar verilerin nereden geldiğini ve nasıl kullanıldığını anladıklarında, AI sonuçlarına daha fazla güveniyorlar.
Şeffaflık ve köken, veri sahibi, model geliştiricisi ve son kullanıcı arasında hesap verebilirlik oluşturur. AI’yi bir kara kutudan anlaşılabilir ve açıklanabilir bir şeye dönüştürür.
20 kat büyümenin ve 25M$’lık Seri A’nın ardından, Protege’nin etik ve güvenlik taahhütlerini nasıl dengeleyerek hızlı bir şekilde ölçekleniyorsunuz ve AI modellerini sorumlu bir şekilde eğitmeye devam ederken ne olacak?
Etik ve güvenlik, ölçeklenmemizi sağlayan temeldir. Her yeni süreç, ortaklık ve ürün, başkalarının izlediği gibi çalıştığımız şekilde ölçülür. Yeni bir süreç, ortaklık veya ürün geliştirdiğimizde, herkesin bunu gördüğünde gurur duymak isterim.
2026’ya bakarken, sağlık ve medya ötesinde yeni alanlara ulaşmayı ve değerlendirme verisi gibi yeni veri ürünleri oluşturmayı planlıyoruz. Amacımız, gerçek dünya AI verisi ve uzmanlığı için tek güvenilir platform olmak ve uzun vadede AI ilerlemesini güçlendirmek.
Harika röportaj için teşekkür ederiz, daha fazla bilgi edinmek isteyen okuyucular Protege‘yi ziyaret edebilir.












