Intervjuer
Lior Hakim, medgrunnlegger og teknisk direktør i Hour One – Intervju-serie

Lior Hakim, medgrunnlegger og teknisk direktør i Hour One, en bransjeleder innen utvikling av virtuelle mennesker for profesjonell video-kommunikasjon. De livlige virtuelle karakterene, modellert eksklusivt etter virkelige mennesker, formidler menneskelige uttrykk gjennom tekst, og muliggjør at bedrifter kan forbedre sin kommunikasjon med ubetinget lettighet og skalerbarhet.
Kan du dele historien bak Hour One?
Opphavet til Hour One kan spores tilbake til min involvering i krypto-domænet. Etter dette prosjektet begynte jeg å tenke på hva som ville være den neste store ting som masse-skytjener kunne gripe og da maskinlæring var på vei til å bli populært i anbefalinger og prediktiv analyse, arbeidet jeg med noen ML-infrastruktur-relaterte prosjekter. Gjennom dette arbeidet ble jeg kjent med tidlige generative arbeider og var spesielt interessert i GANs på den tiden. Jeg brukte all beregningsevne jeg kunne få tak i for å teste disse da nye teknologiene. Når jeg viste mine resultater til en venn som hadde et selskap i bransjen, sa han at jeg måtte møte Oren. Når jeg spurte hvorfor, sa han at kanskje vi begge ville slutte å kaste bort hans tid og i stedet kaste bort hverandres tid. Oren, min medgrunnlegger og administrerende direktør i Hour One, var en tidlig investor i AI på den tiden, og mens vi stod på forskjellige steder, beveget vi oss i samme retning, og etableringen av Hour One for å være hjemmet til det virtuelle mennesket var en uunngåelig reise.
Hva er noen av maskinlæringsalgoritmene som brukes, og hva er Generative AI sin rolle i prosessen?
I videoproduksjonsverden er maskinlæringsalgoritmene avgjørende på hvert stadium. I skriptfasen tilbyr store språkmodeller (LLM) uvurderlig støtte, ved å lage eller forbedre innhold for å sikre overbevisende fortellinger. Når vi går over til lyd, gjør tekst-til-tale-algoritmene (TTS) tekst om til organisk, uttrykksfull stemme. I overgangen til visuell representasjon, tar vår egen multimodale grunnmodell for det virtuelle mennesket sentralplassen. Denne modellen, forbedret med Generative Adversarial Networks (GANs) og Variational Autoencoders (VAEs), er i stand til å formidle kontekstuelle emosjoner, uttale og en artikulert, fengende og autentisk levering. Slike generative tekniker gjør tekst og lydsignaler om til livlige visuelle fremstillinger av virtuelle mennesker, som fører til hyper-realistiske video-utdata. Orkestreringen av LLM, TTS, GANs, VAEs og vår multimodale modell gjør Generative AI til ikke bare en del, men ryggraden i moderne videoproduksjon.
Hvordan skiller Hour One seg fra andre videogenererings-verktøy?
Hour One skiller seg fra andre videogenererings-verktøy ikke på grunn av en besettelse av konkurranse, men på grunn av en dypt rotfestet filosofi som styrer vår tilnærming til kvalitet, produktutforming og markedstrategi. Vår ledende prinsipp er å alltid prioritere det menneskelige elementet, og sikre at våre skaperverk resonerer med autentisitet og emosjon. Vi tar pride i å levere den beste kvaliteten i bransjen uten kompromiss. Ved å bruke avansert 3D-video-rendering, tilbyr vi våre brukere en ekte kinematisk opplevelse. Videre er vår strategi unikt meningsfull; vi begynner med et polert produkt og itererer deretter raskt mot fullkommenhet. Denne tilnærmingen sikrer at våre tilbud alltid er et skritt foran, og setter nye standarder i videogenerering.
Med din omfattende bakgrunn i GPU, kan du dele noen tanker om NVIDIA (NVDA ) Next-Generation GH200 Grace Hopper Superchip Platform?
Grace Hopper-arkitekturen er virkelig en game-changer. Hvis GPU kan arbeide effektivt fra sin verts RAM uten å blokkere beregningen fullstendig, låser det opp nå umulige modell/akselerator-forhold i trening, og som et resultat, ønsket fleksibilitet i treningsjobb-størrelser. Antagelig vil hele lageret av GH200 ikke bli svelget av LLM-trening, håper vi å bruke det til å redusere prototyping-kostnadene for våre multimodale arkitekturer nedover linjen.
Er det andre chips som er på dine radar for øyeblikket?
Vårt hovedmål er å tilby brukerne videoinnhold som er pris-konkurransedyktig. Gitt etterspørselen etter store minne-GPU-er for øyeblikket, optimaliserer og prøver vi ut alle GPU-skytjenester på topp-cloud-tjenesteleverandører. Videre stræber vi etter å være minst delvis plattform-uavhengige på noen av våre arbeidsbelastninger. Derfor ser vi på TPUs og andre ASICs, og følger også nøye med på AMD. Til slutt vil alle hårdvar-ledede optimaliseringsveier som kan resultere i bedre FLOPs/$-forhold bli utforsket.
Hva er din visjon for fremtidige fremskritt i videogenerering?
Om 24 måneder vil vi ikke kunne skille en generert menneske fra et fanget ett. Det vil endre mange ting, og vi er her på forkanten av disse fremskrittene.
For øyeblikket er de fleste genererte videoer for datamaskiner og mobilenheter, hva må endres før vi har foto-realistiske genererte avatarer og verdener for både augmented reality og virtual reality?
For øyeblikket har vi evnen til å generere foto-realistiske avatarer og verdener for både augmented reality (AR) og virtual reality (VR). Det primære hindret er forsinkelse. Mens leveringen av høykvalitets, sanntids-grafikk til kant-enheter som AR- og VR-hoder er viktig, er å oppnå dette sammenhengende avhengig av flere faktorer. Først og fremst er vi avhengige av fremskritt i chip-fabrikasjon for å sikre raskere og mer effektiv prosessering. Samtidig er det viktig å optimalisere strømforbruk for å sikre lengre bruk uten å kompromittere opplevelsen. Til slutt forventer vi programvare-gjennombrudd som kan effektivt lukke gapet mellom generering og sanntids-rendering. Når disse elementene kommer sammen, vil vi se en økning i bruken av foto-realistiske avatarer og miljøer på både AR- og VR-plattformer.
Hva forventer du å være det neste store gjennombruddet i AI?
Når det kommer til det neste betydelige gjennombruddet i AI, er det alltid en luft av spenning og forventning. Mens jeg har antydet noen fremskritt tidligere, kan jeg dele at vi aktivt arbeider med flere banebrytende innovasjoner på dette øyeblikket. Jeg ville gjerne dykke ned i detaljer, men for nå oppmuntrer jeg alle til å holde øye på våre kommende utgivelser. Fremtiden for AI lover mye, og vi er glade for å være på forkanten av disse pioner-innsatsene. Hold øye med oss!
Er det noe annet du ønsker å dele om Hour One?
Du bør absolutt sjekke ut vår Discord-kanal og API, nye tilføyelser til vårt plattform-tilbud på Hour One.












