Interviuri
Lior Hakim, Co-fondator și CTO al Hour One – Seria de interviuri

Lior Hakim, co-fondator și director tehnic al Hour One, un lider în industria de creație a caracterelor virtuale pentru comunicări video profesionale. Caracterele virtuale realiste, modelate exclusiv după oameni reali, transmit expresivitate umană prin text, permițând companiilor să-și îmbunătățească mesajele cu o ușurință și o scalabilitate fără precedent.
Puteți să împărtășiți povestea de origine a Hour One?
Originea Hour One poate fi urmărită până la implicarea mea în domeniul criptomonedelor. După această întreprindere, am început să mă gândesc la ce va fi următoarea mare realizare pe care computarea în nor poate să o atingă și, deoarece machine learning-ul devenea tot mai popular în recomandări și analize predictive, am lucrat la câteva proiecte legate de infrastructura ML. Prin acest lucru, am devenit familiarizat cu lucrările generative timpurii și am fost interesat în special de GAN-uri în acea perioadă. Am folosit toată puterea de calcul pe care o puteam obține pentru a testa aceste tehnologii noi. Când am arătat rezultatele unui prieten care avea o companie în domeniu, el mi-a spus că trebuie să-l întâlnesc pe Oren. Când l-am întrebat de ce, mi-a spus că poate vom înceta să-i pierdem timpul și vom pierde timpul unul altuia. Oren, co-fondatorul și CEO-ul Hour One, era un investitor timpuriu în AI în acea perioadă și, deși ne aflam în locuri diferite, ne mișcam în aceeași direcție, iar fondarea Hour One pentru a deveni Casa Umanului Virtual a fost o călătorie inevitabilă.
Care sunt unele dintre algoritmii de machine learning utilizați și care este partea procesului în care se utilizează Inteligența Artificială Generativă?
În domeniul creației de videoclipuri, algoritmii de machine learning sunt instrumentali la fiecare etapă. În faza de scriere a scenariului, Modelele Lingvistice Mari (LLM) oferă un sprijin inestimabil, creând sau rafinând conținutul pentru a asigura narative captivante. Pe măsură ce trecem la audio, algoritmii Text-to-Speech (TTS) transformă textul în voci organice și emotive. Trecând la reprezentarea vizuală, modelul nostru multimodal fundamental al umanului virtual joacă un rol central. Acest model, îmbunătățit cu Rețele Adversative Generative (GAN) și Autoencoderi Variationale (VAE), este capabil să transmită emoții contextuale, enunțuri și o livrare articulată, captivantă și autentică. Astfel de tehnici generative transformă textul și semnalele audio în imagini realiste ale umanului virtual, conducând la ieșiri video hiper-realiste. Orchestrationul LLM, TTS, GAN, VAE și al modelului nostru multimodal face ca Inteligența Artificială Generativă să nu fie doar o parte, ci coloana vertebrală a producției moderne de videoclipuri.
Cum se diferențiază Hour One de alți generatori de videoclipuri?
La Hour One, diferențierea noastră de alți generatori de videoclipuri nu provine dintr-o preocupare pentru concurență, ci mai degrabă dintr-o filozofie profund înrădăcinată care guvernează abordarea noastră față de calitate, design de produs și strategie de piață. Principiul nostru ghid este să prioritizăm întotdeauna elementul uman, asigurându-ne că creațiile noastre rezonă cu autenticitate și emoție. Ne mândrim cu livrarea celei mai bune calități din industrie fără compromisuri. Prin utilizarea rendering-ului de videoclipuri 3D avansat, oferim utilizatorilor noștri o experiență cinematografică autentică. Mai mult, strategia noastră este unică și opiniată; începem cu un produs lustruit și apoi iterăm rapid spre perfecțiune. Acest abordare asigură că ofertele noastre sunt întotdeauna cu un pas înainte, stabilind noi repere în generarea de videoclipuri.
Cu experiența dvs. extinsă în GPU, puteți să împărtășiți cu noi câteva perspective asupra NVIDIA (NVDA ) Next-Generation GH200 Grace Hopper Superchip Platform?
Arhitectura Grace Hopper este cu adevărat un schimbător de joc. Dacă un GPU poate lucra eficient din memoria RAM a gazdei fără a bloca complet calculele, deblochează raporturi actuale de model/accelerator imposibile în antrenament și, ca rezultat, o flexibilitate mult dorită în dimensiunile locurilor de muncă de antrenament. Presupunând că întreaga stocare GH200 nu va fi absorbită de antrenamentul LLM, sperăm să o utilizăm pentru a reduce semnificativ costurile de prototipare pentru arhitecturile noastre multimodale pe viitor.
Există alte procesoare care sunt în prezent pe radarul dvs.?
Scopul nostru principal este să oferim utilizatorilor conținut video competitiv din punct de vedere al prețului. Având în vedere cererea actuală pentru GPU-uri cu memorie mare, suntem într-o optimizare constantă și încercăm orice ofertă de GPU pe principalele furnizori de servicii cloud. Mai mult, ne străduim să fim cel puțin parțial independenți de platformă pentru unele dintre sarcinile noastre. Prin urmare, suntem atenți la TPU și la alte ASIC-uri și urmărim îndeaproape AMD. În cele din urmă, orice cale de optimizare condusă de hardware care poate duce la un raport mai bun FLOPs/$ va fi explorată.
Care este viziunea dvs. pentru avansările viitoare în generarea de videoclipuri?
În 24 de luni, nu vom putea distinge un om generat de unul capturat. Acest lucru va schimba multe lucruri, iar noi suntem aici, în fruntea acestor avansări.
În prezent, majoritatea videoclipurilor generate sunt pentru calculatoare și dispozitive mobile, ce trebuie să se schimbe înainte de a avea avatare și lumi generate fotorealiste pentru realitatea augmentată și realitatea virtuală?
În prezent, deținem capacitatea de a genera avatare și lumi fotorealiste pentru realitatea augmentată (AR) și realitatea virtuală (VR). Principala barieră este latența. În timp ce livrarea graficelor de înaltă calitate și în timp real către dispozitive de margine, cum ar fi căștile AR și VR, este vitală, realizarea acestui lucru în mod fluent depinde de mai mulți factori. În primul rând, suntem dependenți de progresele în fabricarea de cipuri pentru a asigura procesarea mai rapidă și mai eficientă. Alături de aceasta, optimizarea consumului de energie este crucială pentru a asigura o experiență mai lungă fără a compromite calitatea. Nu în ultimul rând, anticipăm progrese software care pot podi eficient golul dintre generare și rendering în timp real. Pe măsură ce aceste elemente se reunesc, vom asista la o creștere a utilizării avatarilor și a mediilor fotorealiste pe ambele platforme AR și VR.
Ce așteptați să fie următoarea mare descoperire în AI?
Când vine vorba de următoarea descoperire semnificativă în AI, există întotdeauna o atmosferă de entuziasm și așteptare. Deși am făcut aluzie la unele avansări mai devreme, ceea ce pot împărtăși este că lucrăm activ la mai multe inovații revoluționare în acest moment. Aș fi încântat să intru în detalii, dar pentru moment, vă încurajez pe toți să urmăriți următoarele noastre lansări. Viitorul AI promite mult, iar noi suntem încântați să fim în fruntea acestor eforturi pionierat. Rămâneți tune!
Există altceva pe care ați dori să-l împărtășiți despre Hour One?
Trebuie să verificați canalul nostru Discord și API-ul, noi adăugări la oferta noastră de platformă de la Hour One.












