Haastattelut

Lior Hakim, Hour One:n perustaja ja tekninen johtaja – Haastattelusarja

mm
Lisää Unite.AI suosikkilähteisiisi Google-palvelussa

Lior Hakim, Hour One:n perustaja ja tekninen johtaja, on alan johtaja virtuaalisten ihmisten luomisessa ammattimaisiin videoviestintään. Näiden ihmisenkaltaisten virtuaalihahmojen, jotka on mallinnettu yksinomaan oikeiden ihmisten mukaan, välittävät ihmisenkaltaista ilmeikkyyttä tekstin kautta, mahdollistaen yritysten korottaa viestintäänsä vastaamattomalla helppoudella ja skaalautuvuudella.

Voitko kertoa Hour One:n syntytarinaa?

Hour One:n alkuperä voidaan jäljittää takaisin osallistumiseeni crypto-alalla. Tämän jälkeen aloin pohtia, mikä olisi seuraava suuri asia, johon massapilvi-laskenta voisi tarttua, ja kun koneoppiminen oli saavuttamassa suosiota suosituksissa ja ennustavassa analytiikassa, työskentelin useilla koneoppimiseen liittyvillä infrastruktuurihankkeilla. Tämän työn kautta tutustuin varhaisiin generatiivisiin töihin ja olin erityisen kiinnostunut GAN:eista tuolloin. Käytin kaikkia saatavilla olevia laskentaresursseja testaamaan näitä silloin uusia teknologioita. Kun näytin tuloksiani ystävälleni, jolla oli yritys alan parissa, hän sanoi, että minun pitäisi tavata Oren. Kun kysyin, miksi, hän sanoi, että ehkä molemmat lopetamme haaskaa toistemme aikaa ja haaskamme toistemme aikaa. Oren, Hour One:n toinen perustaja ja toimitusjohtaja, oli varhainen AI-sijoittaja tuolloin, ja vaikka me olimme eri paikoissa, liikkuimme samaan suuntaan, ja Hour One:n perustaminen virtuaalisten ihmisten kodiksi oli väistämätön matka.

Mitkä koneoppimisalgoritmit ovat käytössä, ja mikä osa prosessista on generatiivinen tekoäly?

Videojen luomisessa koneoppimisalgoritmit ovat tärkeitä jokaisessa vaiheessa. Käsikirjoitusvaiheessa suuret kielen mallit (LLM) tarjoavat arvokasta tukea luomalla tai viimeistelemällä sisältöä, jotta voidaan varmistaa viehättävät kertomukset. Siirryttäessä ääneen, teksti-ääneksi (TTS) -algoritmit muuttavat tekstin orgaaniseksi, tunteelliseksi ääneksi. Visuaalisen edustamisen osalta omistautumme monimodaaliseen perusmalliin virtuaalihumalaisuudesta. Tämä malli, jota on parannettu generatiivisilla vastakkainasetteluverkoilla (GAN) ja variational autoencoder (VAE):illa, on taitava välittämään kontekstuaalista tunteita, artikulaatiota ja ymmärrettävää, viehättävää ja aidon näköistä toimitusta. Nämä generatiiviset tekniikat muuttavat tekstin ja äänimerkit elävänkaltaisiksi virtuaalisten ihmisten visuaaliseksi esitykseksi, johtaa hyperrealistisiin videoihin. LLM:ien, TTS:ien, GAN:ien, VAE:ien ja monimodaalisen mallimme orkestraatio tekee generatiivisesta tekoälystä ei vain osan, vaan modernin video-tuotannon selkärangan.

Miten Hour One erottuu kilpailijoistaan videoiden generoimisessa?

Hour One:lla eroamme muista videogeneraattoreista ei kilpailun mukauttamisesta, vaan syvään juurtuneesta filosofiasta, joka ohjaa lähestymistämme laatuun, tuotesuunnitteluun ja markkinointistrategiaan. Ohjaavaksi periaatteeksi on aina priorisoida inhimillinen elementti, varmistaen, että luomuksemme vakuuttavat aidolla ja tunteella. Olemme ylpeitä siitä, että toimimme alan parhaalla laadulla kompromisseja tekemättä. Käyttämällä edistynyttä 3D-videolaitteistoa tarjoamme käyttäjillemme aitoa elokuvallista kokemusta. Lisäksi strategiamme on ainutlaatuinen ja mielipideohjattu; aloitamme viimeistellyllä tuotteella ja iteroidaan nopeasti kohti täydellisyyttä. Tämä lähestymistapa varmistaa, että tarjoamme aina edelläkävijöitä asettavat uusia video-generaattorin mittapuitteita.

Millaisia näkemyksiä sinulla on NVIDIA (NVDA ):n seuraavan sukupolven GH200 Grace Hopper -supertietokonealustasta?

Grace Hopper -arkkitehtuuri on todella pelinmuuttaja. Jos GPU voi toimia isäntänsä RAM:ista ilman, että se täysin pullistaa laskentaa, se avaa nykyisin mahdottomat malli/kiihdyttimen suhteet koulutuksessa, ja seurauksena on toivottu joustavuus koulutustehtävien koissa. Olettaen, että koko GH200:n varasto ei ole nielaista LLM-koulutuksessa, toivomme käyttäväksi sitä vähentämään prototyyppien kustannuksia monimodaalisille arkkitehtuureillemme myöhemmin.

Onko muita prosessoreita, jotka ovat tällä hetkellä radarissasi?

Päämäärämme on tarjota käyttäjille video-sisältöä, joka on hinta-kilpailukykyinen. Ottaen huomioon suuren muistin GPU:iden kysynnän tällä hetkellä, optimoidaan jatkuvasti ja kokeillaan kaikkia GPU-pilvi tarjoajia. Pyrimme myös olemaan osittain alustariippumattomia joissakin työkuormissamme. Tämän vuoksi seuraamme TPUs:ia ja muita ASIC:ejä ja kiinnitämme tarkkaa huomiota myös AMD:hen. Lopulta kaikki laitteiston johtama optimointireitti, joka voi johtaa parempaan FLOPs/$ -suhteeseen, tullaan tutkimaan.

Mitä tulevaisuuden edistymisiä videoiden generoimisessa odotat?

24 kuukauden kuluttua emme voi erottaa generoituja ihmisiä tallennetuista. Se muuttaa monia asioita, ja olemme tämän edistymisen eturintamassa.

Tällä hetkellä useimmat generoidut videot ovat tietokoneille ja mobiililaitteille, mitä pitäisi muuttua, jotta voisimme saada valokuvan realistisia generoituja avatareja ja maailmoja sekä lisätyn että virtuaalitodellisuuden kannalta?

Tällä hetkellä meillä on kyky generoida valokuvan realistisia avatareja ja maailmoja sekä lisätyn että virtuaalitodellisuuden kannalta. Pääasiallinen este on viive. Vaikka korkealaatuisten, reaaliaikaisen grafiikan toimittaminen reunan laitteisiin, kuten AR- ja VR-laitteisiin, on tärkeää, saavuttaminen siitä täysin vaivattomasti riippuu useista tekijöistä. Ensisijaisesti olemme riippuvaisia prosessorinvalmistuksen edistymisistä, jotta voidaan varmistaa nopeampi ja tehokkaampi prosessointi. Yhtä lailla tärkeää on virrankäytön optimointi, jotta voidaan varmistaa pidempi käyttöaika ilman, että kokemus heikkenee. Viimeksi, odotamme ohjelmistokehityksen läpimurtoja, jotka voivat tehokkaasti silittää generaation ja reaaliaikaisen renderöinnin välimatkan. Kun nämä tekijät yhdistyvät, näemme lisääntymisen valokuvan realististen avatareiden ja ympäristöjen käytössä sekä AR- että VR-alustoilla.

Mitä odotat seuraavan suuren läpimurron olevan tekoälyssä?

Kun on kyse seuraavasta merkittävästä läpimurrosta tekoälyssä, on aina ilmassa jännitystä ja odotusta. Vaikka olen maininnut joitakin edistymisiä aiemmin, voin vain sanoa, että työskentelemme aktiivisesti useilla uraauurtavilla innovaatioilla tällä hetkellä. Haluaisin perehtyä yksityiskohtiin, mutta toistaiseksi rohkeasti seuraa tulevia julkaisujamme. Tekoälyn tulevaisuus lupailee paljon, ja olemme innoissamme olla tämän edelläkävijöiden johtavissa ponnistelussa. Pysy kuulolla!

Onko mitään muuta, mitä haluaisit jakaa Hour One:sta?

Pitäisit varmasti tarkistaa Discord-kanavamme ja API: m, uudet lisäykset platform-ratkaisuumme Hour One:lla.

Antoine on visionäärisellä johtajalla ja Unite.AI:n perustajakumppani, joka on intohimoisesti omistautunut tulevaisuuden älyteknologian ja robotiikan muotoiluun ja edistämiseen. Sarjayrittäjänä hän uskoo, että älyteknologia tulee olemaan yhtä mullistava yhteiskunnalle kuin sähkö, ja hän on usein innostunut puhumaan älyteknologian ja AGI:n mahdollisuuksista.

Hän on tulevaisuudentutkija, joka on omistautunut tutkimiseen, miten nämä innovaatiot muotoilevat maailmaamme. Lisäksi hän on Securities.io:n perustaja, joka on keskittynyt sijoittamiseen älykkäisiin teknologioihin, jotka määrittelevät tulevaisuutta ja muokkaavat koko toimialoja.