Interviews
Ernest Piatrovich, Product Manager hos ARTA – Interview-serie

Ernest Piatrovich er en Product Manager hos AIBY Group, hvor han leder en af virksomhedens top-tier AI-drevne apps, ARTA – AI-billedegenerator til iPhone og Android. Hans strategiske vision og kreative tænkning resulterede i, at appen opnåede #2-positionen på US App Store-toplister kort efter udgivelsen, overskred 15 millioner downloads verden over og tilbød de bedst performende AI-avatarter baseret på en unik intern pipeline, blandt andre succeser.
De har været ansvarlig for at styre ARTA – AI-kunstgenerator fra ideationsfasen til nu. Kan de dele nogle indsigt i disse tidlige dage?
Selvfølgelig! Det var dynamiske tider. Vi lykkedes at udgive en fint lavet applikation inden for blot en uge og blev en af de første forbrugerapp-udviklere, der tilbød tekst-til-billede-genereringsfunktion på mobile enheder. Vores mål var at bygge et massemarkedprodukt, der giver folk “en kunstner” i lommen. Så fra konceptualisering og tidlige udviklingsfaser har vi fokuseret på brugervenlighed og skalerbarhed. Men på trods af at vi kom på markedet ret tidligt, var det ret udfordrende at øge vores installationsvolumen til en passende omfang, selv med en strålende medieindkøbsgruppe som vores. En betydelig støtte skete tre måneder efter appens udgivelse, da vores avatarfunktion blev hypet. Volumen blev hurtigt moderat højt for vores niche, og siden da har vores opgave været at vedligeholde og øge det.
Hvad var den oprindelige tekniske platform, som de lancerede på, og hvilke udfordringer var der med kunstgenerering under denne periode?
Vi lancerede på basis af Stable Diffusion 1.3 ved hjælp af det officielle API fra Stability.ai. Jeg skal sige, at situationen med kvaliteten af generationer dengang og nu er som nat og dag. Da vi først startede, rapporterede vores QA-chefer ofte problemer relateret til æstetisk værdi af billeder eller uændreligheder i repræsentation af bestemte koncepter og funktioner. Men det var standard for Stable Diffusion på det tidspunkt. Nu er generationsoutput meget bedre på alle punkter, herunder stilistisk reproduktion, kompositionssammenhæng, visuel troværdighed, detaljeniveau og mere.
Kort efter appens udgivelse begyndte vi at leje servere på Amazon (AMZN ), og det viste sig at være ret udfordrende at understøtte dem. Selv med tilstrækkelige midler kan der ikke altid være en ledig A100, når du har brug for det, og du må vente et par dage. Derfor måtte vi leve uden autoskalering og omdirigere al overskydende trafik til vores partnere’s API’er.
At vedligeholde alt dette er stadig ret udfordrende i dag, med mindre problemer, der opstår på den ene eller den anden side hver måned eller så. For eksempel oplever vi lejlighedsvis midlertidige problemer med kvaliteten af generationer, når leverandøren opdaterer serveren, tester vægte eller implementerer andre ændringer, der påvirker generationsoutput. Sådanne fejl kan vare fra en time til en halv dag og er uforudsigelige og svære at spore. Som regel har API-leverandøren allerede løst problemet, når vores supportafdeling modtager en brugerrapport om uklare billeder eller andre forekommende problemer. Men det er en alvorlig bekymring for vores brugere. Derfor bygger vi nu et system, der kombinerer multiple leverandører og vores egne servere til specialgenerationer, så vi kan have mere kontrol på vores side af sagen.
Som produktchef, hvilke strategiske beslutninger har været afgørende for at guide ARTA til dens top-position kort efter udgivelsen?
ARTA’s (på det tidspunkt kaldt Aiby) tidlige opstigning skyldtes den rettidige beslutning om at implementere den virale avatarfunktion, da den lige var begyndt at gå på sociale medier. Vi erkendte hurtigt den voksende interesse for denne funktion. Hele vores team, herunder produkt-, marketing- og udviklingsafdelingen, var på samme bølgelængde og havde en visionær idé om dens succes. Vi erkendte også, at en kort tid til markedet var afgørende. Så fra dag én dedikerede vi alle vores ressourcer til at realisere denne funktion og prioriterede den over andre opgaver.
Da vores deadline var “så hurtigt som muligt”, så vi ikke missede øjeblikket, hvor AI-avatarter når deres hype-top, valgte vi at bruge en tredjeparts-løsning og tilpasse den til vores app. Mens avatarter lige var begyndt at vinde popularitet på mobile enheder, havde teknologien allerede været tilgængelig på webben i nogen tid, selv med en API. Takket være teamets koncentrerede indsats var vores første fungerende version i App Store blot fem dage efter, og den tilbød højkonkurrerende avatar-output. Det hjalp os med at opnå #2-positionen i den amerikanske topchart og forblev den anden mest downloadede app i USA i en uge.
Hvad kan brugerne påvirke i ARTA? Hvis ja, hvilke værktøjer og muligheder er til rådighed for brugerne for at tilpasse AI-genererede kunstværker?
Vi håndterer alle komplekse aspekter relateret til generation, med det formål at give vores brugere en enkel kunstnerisk oplevelse uden unødvendig teknisk overbelastning. Så den primære måde, brugerne påvirker output, er gennem prompts. Vi gør dette proces transparent ved at vise den præcise ordanmodning, der vil blive sendt til modellen til generation, og kun tilbyder assistance med at komponere effektive prompts, hvis nødvendigt.
Vi vælger de bedste standardindstillinger for hver integreret model, så brugerne ikke behøver at bekymre sig om det. Typisk er der ingen grund til at justere dem for at maksimere resultaterne, da de allerede producerer en optimal generationsoutput. Men hvis brugeren ønsker at eksperimentere, er en avanceret tilstand kun et klik væk, og nogle dybere parametre er i indstillingssektionen.
Snart vil vi tilføje en Seed-parameter, der giver brugerne fuld kontrol over generation, når de har brug for at genskabe en identisk billede fra scratch. Desuden planlægger vi at udvide listen over billedforhold. Vi overvejer også at tilføje flere kontrolnet til regulær generation. De er allerede understøttet på serversiden, da vi bruger dem til at generere AI-filtre og skitser, men de er endnu ikke leveret til slutbrugere.
Hvordan ser de på virkningen af AI som ARTA på det traditionelle kunstmarked? Ser de AI-kunstgenerering som en forstyrrelse eller en forbedring af kunstindustrien?
Jeg ser det som en forbedring. Generativ AI har introduceret nye og værdifulde muligheder for at forbedre den kunstneriske proces, samtidig med at den betydeligt reducerer omgangstiden. Den hjælper digitale kunstnere, designere, illustratører og andre visuelle indholdsskabere med en række opgaver, fra at udforske idéer og udvikle koncepter til at generere skitser og færdige billeder. Til sidst er vores evne til at udnytte dens fremskridt kun begrænset af vores imagination.
For eksempel har jeg en hobby i at lave PC-spil, og for nylig brugte jeg ARTA til at generere en samling ikoner til færdigheder og genstande. Jeg kunne have designet dem selv ved hjælp af Adobe Illustrator, men med en billedegenerator fik jeg, hvad jeg havde brug for, næsten med det samme. Min kone, på den anden side, er en retoucher-fotograf. Takket være Photoshop’s Generative Fill arbejder hun meget hurtigere og har mere fritid (eller mere indtægt, hvis hun beslutter sig for at acceptere flere retoucheringsordrer).
Når det er gjort godt, kan AI-genererede billeder se ud som professionelt kunstværk. Men i min mening vil AI aldrig erstatte en sand professionel. Uanset hvor dygtige neurale netværk bliver, er de stadig trænet på data skabt af mennesker, hvilket betyder, at alt, de genererer, allerede eksisterer et sted. Som tidligere og nu kan kun sande innovative idéer kun produceres af mennesker. Mens den traditionelle betydning af kunst stadig er forbundet med menneskeskabte stykker, er AI-kunst som en forventet sidegren, der inviterer alle, uanset kunstnerisk baggrund, til at prøve en spændende ny oplevelse.
Hvad er deres forudsigelser for, hvad vi kan forvente herefter fra generativ AI?
Bølgen af popularitet for video-generering er på horisonten. Med fremskridt i teknologien, der når et tilstrækkeligt niveau, vil der uden tvivl være forsøg på at træne neurale netværk ved hjælp af menneskers ansigtsudtryk og gestus til at skabe video-avatarter, potentielt endda med unikke brugerstemmer.
AI-lyd er endnu en betydelig gennembrud, der indleder en ny æra for musikproduktionsindustrien. Denne teknologi har allerede præsenteret fantastiske muligheder for at komponere sange baseret kun på tekstinput, hvilket gør det til et fremragende værktøj til at skabe brugerdefinerede, ikke-aktiekurs-soundtracks til forskellige typer videoindhold. Overordnet set er det ret sjovt at lytte til noget sådant som “Vilkår for brug” rappet eller sunget med romantisk intonation.
Tak for det gode interview. Læsere, der ønsker at lære mere eller generere nogle billeder, skal besøge ARTA.












