Haastattelut

Ernest Piatrovich, ARTA -tuotepäällikkö – Haastattelusarja

mm
Lisää Unite.AI suosikkilähteisiisi Google-palvelussa

Ernest Piatrovich on AIBY Groupin tuotepäällikkö, joka johtaa yhtiön yhtä huipputason AI-vetoinen sovellus, ARTA – AI-kuvageneraattori iPhoneen ja Androidiin. Hänen strateginen visionsa ja luova ajattelunsa johtivat sovelluksen saavuttamaan #2 sijan Yhdysvaltain App Storen huipputaulukossa pian julkaisun jälkeen, ylittäen 15 miljoonan latauksen maailmanlaajuisesti ja tarjoamalla parhaimmat AI-avataarit ainutlaatuisen sisäisen putken ansiosta, muun muassa.

Olet ollut vastuussa ARTA – AI-taidegeneraattorin hallinnasta ideointivaiheesta lähtien. Voitko jakaa joitain näkemyksiä näistä varhaisista päivistä?

Toki! Nuo olivat dynaamisia aikoja. Onnistuimme julkaisemalla hyvin tehdyn sovelluksen vain viikossa, ja meistä tuli yksi ensimmäisistä kuluttaja-sovelluksen luojista, jotka tarjosivat teksti-kuvaksi -toiminnallisuutta mobiililaitteissa. Tavoitteemme oli luoda massamarkkinoiden tuote, joka antaa ihmisille “taiteilijan” taskussa. Niinpä konseptoinnin ja varhaisen kehitysvaiheen aikana keskityimme käytettävyyteen ja skaalautuvuuteen. Mutta vaikka astuimme markkinoille oikea-aikaisesti, oli haasteellista kasvattaa asennusmääriä riittävään määrään, jopa briljantin median ostamisen tiimimme kanssa. Merkittävä kasvu tapahtui kolme kuukautta sovelluksen julkaisun jälkeen, kun meidän Avatare-ominaisuutemme sai hypeä. Määrä kasvoi nopeasti kohtuulliseksi meidän nischeemme, ja siitä lähtien tehtävämme on ollut ylläpitää ja lisätä sitä.

Mikä oli alkuperäinen teknologiapino, jolla julkaistitte, ja mitkä olivat joitain haasteita taidegeneraation aikana?

Julkaisimme Stable Diffusion 1.3: n avulla, käyttäen virallista API: a Stability.ai: lta. Voin sanoa, että tilanne generoinnin laadun suhteen silloin ja nyt on kuin yö ja päivä. Kun aloimme, laadunvalvontamme johtajat ilmoittivat usein ongelmista, jotka liittyivät kuvien esteettiseen arvoon tai epätarkkuuteen tiettyjen käsitteiden ja ominaisuuksien esittämisessä. Mutta se oli standardi Stable Diffusionille silloin. Nyt generoinnin tuloste on paljon parempi kaikilla osa-alueilla, mukaan lukien tyylillinen reproduktio, koherentti koostus, visuaalinen uskottavuus, yksityiskohtien taso ja muut.

Sovelluksen julkaisun jälkeen aloimme vuokrata palvelimia Amazonilta, ja niiden tukeminen osoittautui melko haasteelliseksi. Vaikka meillä oli riittävästi varoja, ei välttämättä ollut vapaita A100-palvelimia, kun niitä tarvittiin, ja meidän piti odottaa pari päivää. Niinpä meidän piti elää ilman autoskaalautumista ja ohjata kaikki ylimääräinen liikenne kumppaniemme API: iin.

Kaiken tämän ylläpitäminen on edelleen melko hankalaa tänään, ja pieniä ongelmia ilmenee toisinaan jommallakummalla puolella. Esimerkiksi kohtaamme toisinaan tilapäisiä ongelmia generoinnin laadun suhteen, kun palveluntarjoaja päivittää palvelinta, testaa painoja tai toteuttaa muita muutoksia, jotka vaikuttavat generoinnin tulosteeseen. Tällaiset virheet voivat kestää tunnin tai puoli päivää ja ovat arvaamattomia ja hankalia seurata. Yleensä siinä vaiheessa, kun asiakastukitiimimme vastaanottaa käyttäjän ilmoituksen epäselvistä kuvista tai muista ilmenevistä ongelmista, API-palveluntarjoaja on jo korjannut ongelman. Mutta se on vakava huolenaihe meille ja meille. Niinpä rakennamme nyt järjestelmää, joka yhdistää useita palveluntarjoajia ja omia palvelimiamme erityisiin generointeihin, mikä antaa meille enemmän valvontaa asioiden suhteen.

Mitkä strategiset päätökset ovat olleet ratkaisevia ARTA: n johdattamisessa sen huipputasolle pian julkaisun jälkeen?

ARTA: n (silloin Aiby) varhainen nousu johtui ajankohtaisesta päätöksestä toteuttaa virallinen Avatare-ominaisuus, kun se alkoi saada jalansijaa sosiaalisessa mediassa. Tunnistimme nopeasti kasvavan kiinnostuksen tähän toiminnallisuuteen. Koko tiimimme, mukaan lukien tuote, markkinointi ja kehitys, oli samalla aaltopituudella ja näki sen menestyksen. Myös tunnistimme, että lyhyt markkinoille saanti oli ratkaiseva. Niinpä päivästä yhdestä lähtien omistimme kaikki resurssimme tämän ominaisuuden toteuttamiseen ja priorisoimme sen muiden tehtävien yläpuolelle.

Koska deadline oli “mahdollisimman pian”, emmekä halunneet missata hetkeä, jolloin AI-avataarit saavuttavat huipunsa, valitsimme käyttämään kolmannen osapuolen ratkaisua ja mukauttamme sitä sovellukseemme. Vaikka avataarit alkoivat saada jalansijaa mobiililaitteissa, teknologia oli jo olemassa verkossa, jopa API: na. Kiitos tiimimme keskittyneistä ponnisteluista, saimme ensimmäisen toimivan version sovellukauppaan vain viidessä päivässä ja tarjosimme kilpailukykyisen avataarin tulosteen. Se auttoi meitä saavuttamaan #2 sijan amerikkalaisissa huipputaulukoissa ja pysymään toisena latauksissa Yhdysvalloissa viikon ajan.

Voivatko käyttäjät vaikuttaa taiteelliseen prosessiin ARTA: ssa? Jos niin, mitkä työkalut ja vaihtoehdot ovat käyttäjien saatavilla mukauttaa AI-generoituja teoksia?

Käsittelemme kaikki monimutkaiset asiat, jotka liittyvät generointiin, ja pyrimme tarjoamaan käyttäjillemme suoraviivaisen taiteellisen kokemuksen ilman tarpeetonta teknistä kuormitusta. Niinpä käyttäjät voivat vaikuttaa tulosteeseen lähinnä vihjeiden avulla. Näytämme avoimesti tarkan sanamuodon, joka lähetetään mallille generoinnin aikana, ja tarjoamme apua tehokkaiden vihjeiden laatimiseen, jos tarvitsevat.

Valitsemme parhaat oletusarvot kullekin integroidulle mallille, jotta käyttäjien ei tarvitse huolehtia siitä. Yleensä ei ole tarpeen säätää niitä tulosteen maksimoimiseksi, koska ne jo tuottavat optimaalisen generoinnin tulosteen. Kuitenkin, jos käyttäjä haluaa kokeilla, edistynyt tila on vain yhden napin painallus, ja jotkut syvemmät parametrit ovat asetuksissa.

Lisäksi suunnittelemme Siemen-ominaisuuden lisäämistä, joka antaa käyttäjille täydellisen valvonnan generoinnissa, kun he tarvitsevat uudelleenluomista alkusta alkaen. Suunnittelemme myös laajentamaan kuvasuhteen luetteloa. Pohdimme myös useiden controlnetien lisäämistä säännöllisiin generointeihin. Ne ovat jo tuettuina palvelimella, koska käytämme niitä AI-suosituksien ja luonnosten generointiin, mutta niitä ei vielä toimiteta loppukäyttäjille.

Miten näet AI: n kuten ARTA: n vaikuttavan perinteiseen taidemarkkinoihin? Näetkö AI-taidegeneraattorin häirintänä vai parantamisena taiteen alalla?

Näen sen parantamisena. Generatiivinen AI on tuonut uusia ja arvokkaita mahdollisuuksia taiteellisen prosessin parantamiseen ja merkittävästi vähentänyt kääntymisajan. Se auttaa digitaalisia taiteilijoita, suunnittelijoita, kuvittajia ja muita visuaalisten sisältöjen luojia monissa tehtävissä, kuten ideoiden tutkimisessa ja konseptien kehittämisessä, luonnosten luomisessa ja valmiiden kuvien generoimisessa. Lopulta kykyämme hyödyntää sen edistymistä on vain mielikuvituksellamme rajattu.

Esimerkiksi minulla on harrastus luoda PC-pelejä, ja äskettäin käytin ARTA: a luomaan kuvakokoelman taitoja ja esineitä varten. Voisin suunnitella ne itse käyttäen Adobe (ADBE ) Illustratoria, mutta kuvageneraattorin avulla sain, mitä tarvitsin, melkein välittömästi. Vaimoni on puolestaan retusointi-valokuvaaja. Kiitos Photoshopin Generatiivisen Täytön, hän työskentelee nopeammin ja on saanut enemmän vapaa-aikaa (tai enemmän tuloja, jos hän päättää ottaa enemmän retusointitilauksia).

Kun tehdään hyvin, AI-generoitu kuvat voivat näyttää erottamattomilta ammattilaisten teoksilta. Mutta mielestäni AI ei koskaan korvaa aitoa ammattilaista. Riippumatta siitä, kuinka taitavaksi neuroniverkot tulevat, ne ovat koulutettu aineistolla, jonka ihmiset ovat luoneet, mikä tarkoittaa, että kaikki, mitä ne generoivat, on jo olemassa jossakin. Kuten ennen, todella innovatiiviset ideat voivat syntyä vain ihmisillä. Vaikka perinteinen taiteen merkitys liittyy edelleen ihmisten tekemiin teoksiin, AI-taide on kuin odotettu sivutuote, joka kutsuu kaikki, riippumatta taiteellisesta taustastaan, kokeilemaan jännittävää uutta kokemusta.

Missä näet tulevaisuuden AI-kuvageneraation suuntaavan, katsoen vain parantamisen kuvanlaatua?

Kuvanlaadun ohella generoinnin nopeus lisääntyy, mikä johtaa automaattisesti kustannustehokkaampiin tuloksiin.

Luulen, ettei kestä kauan, kunnes on helppo tapa generoida samat hahmot eri ympäristöissä ja asennoissa, joten näemme AI: n nousun sarjakuissa, lastenkirjoissa, peligrafiikassa ja muissa aloissa. Sisustus- ja mainosmateriaalien tuotanto ovat jo aktiivisesti hyödyntäviä generatiivista AI: ta, mutta enemmän on edessä, kun teknologia jatkaa kehittymistään.

Koska kaikki generoinnit vaativat voimakkaita GPU: ia, nämä teknologiat kehittyvät yhdessä AI: n kanssa pitkän aikaa. Olemme vasta matkan alussa. Ehkä uusi Apple (AAPL ) on Nvidia (NVDA ), ja kaikki, tai ainakin IT-alalla olevat, odottavat uusia videokorttien julkaisuja samalla tavalla kuin teimme iPhonien kanssa.

AI-kuvageneraattorit jatkavat tarjoamista viihdyttäviä ja osallistavia kokemuksia, esimerkiksi tuomalla uusia konsepteja, jotka nousevat pop-kulttuurista tai vanhoja ideoita, joita parannetaan paremmalla teknologialla. Esimerkiksi kiinnostus AI-vauvageneraatioihin kasvaa tällä hetkellä. Yksi viimeaikainen teknologia, joka perustuu Stable Diffusioniin, on osoittanut vaikuttavia tuloksia yhdistämällä kahden yksilön ominaisuuksia paljastamaan heidän biologisen lapsensa potentiaalisen ulkonäön. Tulokset ylittävät selvästi sen, mitä oli saatavilla horoskooppisivuilla muutama vuosi sitten, ja ihmiset ovat innostuneita kokeilemaan sitä uudelleen.

Mitkä ovat ennustuksesi siitä, mitä odottaa seuraavaksi Generatiiviselta AI: lta?

Videon generoinnin suosion aalto on horisontissa. Teknologian edetessä riittävään tasoon tulee varmasti yrityksiä kouluttaa neuroniverkkoja ihmisten kasvojen ilmeiden ja eleiden avulla luomaan videoavatareja, mahdollisesti jopa yksilöllisillä käyttäjän äänillä.

AI-ääni on toinen merkittävä läpimurto, joka merkitsee uuden aikakauden alkua musiikkintuotannon alalla. Tämä teknologia on jo tarjonnut upeita mahdollisuuksia sävellysten luomiseen pelkästään tekstisyötteen perusteella, mikä tekee siitä erinomaisen työkalun luomaan mukautettuja, ei-alkuperäisiä soundtrackeja erilaisiin video sisältöihin. Kaiken kaikkiaan on todella hauskaa kuunnella jotain niin arkipäiväistä kuin Käyttöehdot räppäystä tai laulettuna romanttisella sävyllä. Kiitos haastattelusta, lukijat, jotka haluavat oppia lisää tai generoida kuvia, voivat vierailla ARTA: ssa.

Antoine on visionäärisellä johtajalla ja Unite.AI:n perustajakumppani, joka on intohimoisesti omistautunut tulevaisuuden älyteknologian ja robotiikan muotoiluun ja edistämiseen. Sarjayrittäjänä hän uskoo, että älyteknologia tulee olemaan yhtä mullistava yhteiskunnalle kuin sähkö, ja hän on usein innostunut puhumaan älyteknologian ja AGI:n mahdollisuuksista.

Hän on tulevaisuudentutkija, joka on omistautunut tutkimiseen, miten nämä innovaatiot muotoilevat maailmaamme. Lisäksi hän on Securities.io:n perustaja, joka on keskittynyt sijoittamiseen älykkäisiin teknologioihin, jotka määrittelevät tulevaisuutta ja muokkaavat koko toimialoja.