Interviews
Eric Landau, mede-oprichter en CEO van Encord – Interviewreeks

Eric Landau is de CEO en mede-oprichter van Encord, een actief leerplatform voor computer vision. Eric was de leidende kwantitatieve onderzoeker op een wereldwijd equity delta-one bureau, waar hij duizenden modellen in productie bracht. Voordat hij bij Encord kwam, werkte hij bijna een decennium in high-frequency trading bij DRW. Hij heeft een S.M. in Toegepaste Fysica van de Harvard University, een M.S. in Elektrotechniek en een B.S. in Fysica van de Stanford University.
In zijn vrije tijd houdt Eric van het spelen met ChatGPT en grote taalmodellen en het maken van craftcocktails.
Wat inspireerde je om Encord mede op te richten, en hoe heeft je ervaring in deeltjesfysica en kwantitatieve financiën je benadering van het oplossen van het “dataprobleem” in AI beïnvloed?
Ik begon voor het eerst na te denken over machine learning toen ik in de deeltjesfysica werkte en te maken had met zeer grote datasets tijdens mijn tijd bij het Stanford Linear Accelerator Center (SLAC). Ik gebruikte software die was ontwikkeld door fysici voor fysici, wat betekent dat er veel te wensen overbleef qua gebruikerservaring. Met gemakkelijkere tools had ik analyses veel sneller kunnen uitvoeren.
Later, toen ik in de kwantitatieve financiën werkte bij DRW, was ik verantwoordelijk voor het creëren van duizenden modellen die in productie werden genomen. Net als bij mijn ervaring in de fysica, ontdekte ik dat hoge kwaliteit data essentieel was om accurate modellen te maken en dat het beheer van complexe, grote datasets moeilijk was. Ulrik had een soortgelijke ervaring met het visualiseren van grote beeldatasets voor computer vision.
Toen ik zijn initiële idee voor Encord hoorde, was ik meteen aan boord en begreep ik het belang. Samen zagen Ulrik en ik een enorme kans om een platform te bouwen om het AI-data-ontwikkelingsproces te automatiseren en te stroomlijnen, waardoor het voor teams gemakkelijker wordt om de beste data in modellen te krijgen en betrouwbare AI-systemen te bouwen.
Kunt u meer vertellen over de visie achter Encord en hoe het zich verhoudt tot de vroege dagen van computing of het internet in termen van potentieel en uitdagingen?
De visie van Encord is om het fundamentale platform te zijn waarop bedrijven vertrouwen om hun data om te zetten in functionele AI-modellen. Wij zijn de laag tussen de data van een bedrijf en hun AI.
Op veel manieren weerspiegelt AI eerdere paradigmaverschuivingen zoals persoonlijke computing en het internet, omdat het een integraal onderdeel zal worden van workflows voor elk individu, bedrijf, land en industrie. In tegenstelling tot eerdere technologische revoluties, die grotendeels werden geblokkeerd door Moore’s wet van samengestelde computationele groei van 30x elk decennium, heeft AI-ontwikkeling geprofiteerd van gelijktijdige innovaties. Het beweegt zich dus in een veel sneller tempo. In de woorden van NVIDIA’s (NVDA ) Jensen Huang: “Voor het eerst zien we samengestelde exponentiële groei… We groeien met een factor van een miljoen elk decennium. Niet honderd keer, niet duizend keer, maar een miljoen keer.” Zonder enige overdrijving zijn we getuige van de snelst bewegende technologie in de menselijke geschiedenis.
Het potentieel is enorm: door het beheer van hoge kwaliteit data voor AI te automatiseren en te schalen, lossen we een bottleneck op die een bredere adoptie van AI verhindert. De uitdagingen zijn herinneringen aan vroege obstakels in eerdere technologische tijdperken: silo’s, gebrek aan best practices, beperkingen voor niet-technische gebruikers en een tekort aan goed gedefinieerde abstracties.
Encord Index wordt gepositioneerd als een sleuteltool voor het beheren en cureren van AI-data. Hoe onderscheidt het zich van andere databeheerplatforms die momenteel beschikbaar zijn?
Er zijn een paar manieren waarop Encord Index zich onderscheidt:
Index is schaalbaar: Hiermee kunnen gebruikers miljarden, niet miljoenen, datapunten beheren. Andere tools hebben problemen met schaalbaarheid voor ongestructureerde data en zijn beperkt in het consolideren van alle relevante data in een organisatie.
Index is flexibel: Het integreert rechtstreeks met private data-opslag en cloud-opslagproviders zoals AWS, GCP en Azure. In tegenstelling tot andere tools die beperkt zijn tot één cloud-provider of intern opslagsysteem, is Index onafhankelijk van de locatie van de data. Het laat je toe om data van veel bronnen te beheren met passende governance en toegangscontroles die het mogelijk maken om veilige en compliant AI-toepassingen te ontwikkelen.
Index is multimodaal: Het ondersteunt multimodale AI, waarbij data in de vorm van afbeeldingen, video’s, audio, tekst, documenten en meer wordt beheerd. Index is niet beperkt tot één vorm van data, zoals veel LLM-tools vandaag. De menselijke cognitie is multimodaal, en we geloven dat multimodale AI het hart zal zijn van de volgende golf van AI-vooruitgang, die chatbots en LLM’s zal vervangen.
Op welke manieren verhoogt Encord Index het proces van het selecteren van de juiste data voor AI-modellen, en wat is het effect hiervan op de prestaties van modellen?
Encord Index verhoogt dataselectie door de curatie van grote datasets te automatiseren, waardoor teams alleen de meest relevante data kunnen identificeren en behouden, terwijl oninformatieve of bevooroordeelde data worden verwijderd. Dit proces vermindert niet alleen de grootte van datasets, maar verbetert ook aanzienlijk de kwaliteit van de data die voor het trainen van AI-modellen wordt gebruikt. Onze klanten hebben tot 20% verbetering in hun modellen gezien, terwijl ze een vermindering van 35% in datasetgrootte bereikten en honderdduizenden dollars aan reken- en annotatiekosten bespaarden.
Hoe blijft Encord voorop in de snel evoluerende AI-landschap, met name met de snelle integratie van baanbrekende technologieën zoals Meta’s Segment Anything Model?
We hebben het platform expres zo ontwikkeld dat het snel kan worden aangepast aan nieuwe technologieën. We focussen op het bieden van een schaalbare, software-georiënteerde aanpak die gemakkelijk innovaties zoals SAM incorporeert, waardoor onze gebruikers altijd zijn uitgerust met de laatste tools om concurrerend te blijven.
We plannen om voorop te blijven door ons te focussen op multimodale AI. Het Encord-platform kan al complexe datatypen zoals afbeeldingen, video’s en tekst beheren, dus als er meer vooruitgang wordt geboekt in multimodale AI, zijn we klaar.
Wat zijn de meest voorkomende uitdagingen waar bedrijven mee te maken krijgen bij het beheren van AI-data, en hoe helpt Encord deze uitdagingen aan te pakken?
Er zijn 3 hoofduitdagingen waar bedrijven mee te maken krijgen:
- Slechte dataorganisatie en -controle: Als bedrijven AI-oplossingen willen implementeren, worden ze vaak geconfronteerd met de realiteit van gesiloëerde en ongeorganiseerde data die niet AI-klaar is. Deze data ontbeert vaak sterke governance, waardoor veel ervan niet kan worden gebruikt in AI-systemen.
- Gebrek aan menselijke experts: Naarmate AI-modellen complexere problemen aanpakken, zal er binnenkort een tekort zijn aan menselijke domeinexperts om data voor te bereiden en te valideren. Naarmate de AI-eisen van een bedrijf toenemen, is het schalen van die menselijke workforce een uitdaging en kostbaar.
- Onschaalbare tooling: Prestatiegerichte AI-modellen zijn zeer data-hongerig in termen van data die nodig is voor fine-tuning, validatie, RAG en andere workflows. De vorige generatie tools is niet uitgerust om de hoeveelheid data en de soorten data te beheren die nodig zijn voor productieklare modellen van vandaag.
Encord lost deze problemen op door het proces van het cureren van data op schaal te automatiseren, waardoor het gemakkelijk wordt om impactvolle data van problematische data te onderscheiden en effectieve trainings- en validatiedatasets te creëren. Het gebruikt een software-georiënteerde aanpak die gemakkelijk kan worden geschaald naar boven of beneden als de databeheerbehoeften veranderen. Onze AI-geassisteerde annotatietools empoweren menselijke experts in de workflow om de workflow-efficiëntie te maximaliseren. Dit proces is vooral cruciaal in industrieën zoals financiële dienstverlening en gezondheidszorg, waar AI-trainers duur zijn. We maken het gemakkelijk om alle ongestructureerde data van een organisatie te beheren en te begrijpen, waardoor de behoefte aan handmatige arbeid wordt verminderd.
Hoe tackelt Encord het probleem van data-bias en ondervertegenwoordigde gebieden binnen datasets om eerlijke en evenwichtige AI-modellen te garanderen?
Het aanpakken van data-bias is een kritische focus voor ons bij Encord. Ons platform identificeert en brengt automatisch naar boven gebieden waar data mogelijk bevooroordeeld is, waardoor AI-teams deze kwesties kunnen aanpakken voordat ze de modelprestaties beïnvloeden. We garanderen ook dat ondervertegenwoordigde gebieden binnen datasets goed worden opgenomen, wat helpt bij het ontwikkelen van eerlijkere en meer evenwichtige AI-modellen. Door onze curatietools te gebruiken, kunnen teams erop vertrouwen dat hun modellen zijn getraind op diverse en representatieve data.
Encord heeft onlangs 30 miljoen dollar aan Series B-financiering veiliggesteld. Hoe zal deze financiering uw productroadmap en expansieplannen versnellen?
De 30 miljoen dollar aan Series B-financiering zal worden gebruikt om de omvang van ons product-, engineering- en AI-onderzoeksteam drastisch te vergroten in de komende zes maanden en de ontwikkeling van Encord Index en andere nieuwe functies te versnellen. We breiden ook onze aanwezigheid in San Francisco uit met een nieuw kantoor, en deze financiering zal ons helpen onze operaties te schalen om onze groeiende klantenbasis te ondersteunen.
Als het jongste AI-bedrijf van Y Combinator dat een Series B heeft opgehaald, wat schrijf je de snelle groei en het succes van Encord aan?
Een van de redenen waarom we snel hebben kunnen groeien, is dat we een extreem klantgerichte focus hebben aangenomen in alle gebieden van het bedrijf. We communiceren constant met klanten, luisteren nauwkeurig naar hun problemen en “omhelzen” hen om oplossingen te vinden. Door ons te focussen op klantbehoeften in plaats van hype, hebben we een platform gecreëerd dat resoneert met top AI-teams in verschillende industrieën. Onze klanten zijn instrumenteel geweest in het brengen van ons waar we vandaag zijn. Onze capaciteit om snel te schalen en de complexiteit van AI-data effectief te beheren, heeft ons een aantrekkelijke oplossing gemaakt voor bedrijven.
We zijn ook veel verschuldigd aan onze teamleden, partners en investeerders, die allemaal hard hebben gewerkt om Encord te ondersteunen. Werken met wereldklasse product-, engineering- en go-to-market teams heeft een enorme impact gehad op onze groei.
Hoe zie je de rol van AI-data-platforms zoals Encord evolueren in de komende vijf jaar, gezien de toenemende belangstelling voor data in AI?
Naarmate AI-toepassingen in complexiteit toenemen, zal de behoefte aan efficiënte en schaalbare databeheeroplossingen alleen maar toenemen. Ik geloof dat elk bedrijf uiteindelijk een AI-afdeling zal hebben, net zoals IT-afdelingen vandaag bestaan. Encord zal het enige platform zijn dat ze nodig hebben om de enorme hoeveelheden data te beheren die nodig zijn voor AI en om modellen snel in productie te krijgen.
Bedankt voor het geweldige interview, lezers die meer willen leren, kunnen Encord bezoeken.












