Intervjuer
Ernest Piatrovich, Produktchef på ARTA – Intervju-serie

Ernest Piatrovich är produktchef på AIBY Group, och leder ett av företagets topprankade AI-drivna appar, ARTA – AI-bildgenerator för iPhone och Android. Hans strategiska vision och kreativa tänkande resulterade i att appen uppnådde plats nummer 2 i den amerikanska topplistan strax efter dess lansering, passerade milstolpen på 15 miljoner nedladdningar världen över och erbjöd de bäst presterande AI-avatarna baserade på en unik in-house-pipeline, bland annat.
Du har varit ansvarig för att hantera ARTA – AI-konstgeneratorn från idéfasen till nu. Kan du dela några insikter om dessa tidiga dagar?
Självklart! Det var dynamiska tider. Vi lyckades släppa en välgjord applikation inom bara en vecka och blev en av de första konsumentappskaparna som erbjöd text-till-bildgenereringsfunktionalitet på mobil. Vårt mål var att bygga en massmarknadsprodukt som ger människor “en konstnär” i fickan. Så, sedan konceptualiseringen och de tidiga utvecklingsstadierna, har vi fokuserat på användbarhet och skalbarhet. Men trots att vi gick in på marknaden i rätt tid, var det ganska utmanande att växa vår installationsvolym till en tillräcklig utsträckning, även med ett briljant mediaköpslag som vårt. En betydande boost inträffade tre månader efter appens lansering när vår avatarfunktion blev populär. Volymen blev snabbt måttligt hög för vår nisch, och sedan dess har vår uppgift varit att upprätthålla och öka den.
Vad var den ursprungliga tekniska stacken som ni lanserade med och vad var några av utmaningarna med konstgenerering under denna period?
Vi lanserade baserat på Stable Diffusion 1.3 med den officiella API:en från Stability.ai. Jag skulle säga att situationen med kvaliteten på generationer då och nu är som natt och dag. När vi först började, rapporterade våra QA-chefer ofta problem relaterade till den estetiska värdet av bilder eller fel i att representera specifika koncept och funktioner. Men det var standard för Stable Diffusion vid den tiden. Nu är generationsutdata mycket bättre i alla aspekter, inklusive stilistisk reproduktion, kompositionssammanhang, visuell trohet, detaljnivå och mer.
Strax efter appens lansering började vi hyra servrar på Amazon (AMZN ), och att stödja dem visade sig vara ganska utmanande. Även med tillräckliga medel kan det finnas inga lediga A100 tillgängliga när du behöver dem, och du måste vänta i ett par dagar. Därför var vi tvungna att leva utan autoskalning och omdirigera all överskottstrafik till våra partners API:er.
Som produktchef, vilka strategiska beslut har varit avgörande för att vägleda ARTA till sin topprankade position strax efter lanseringen?
ARTA:s (då kallad Aiby) tidiga uppgång resulterade från det tidiga beslutet att implementera den virala avatarfunktionen när den just började göra sig gällande på sociala medier. Vi erkände den växande intresset för denna funktion. Vår helhetsteam, inklusive produkt, marknadsföring och utveckling, var på samma våglängd och visionära om dess framgång. Vi erkände också att en kort tid till marknaden var avgörande. Så, från dag ett, dedikerade vi alla våra resurser till att förverkliga denna funktion, prioritera den ovanför andra uppgifter.
Din team har nyligen släppt en uppdatering till ARTA:s AI-avatargenereringsfunktion. Kan du dela några detaljer om detta?
AI-modellerna tenderar att lägga till generiska ansiktsdrag under träning, vilket gör att avatarna ser annorlunda ut än de ursprungliga fotona, och ju unikare någons drag är, desto mindre likt AI-tolkningen kan den verka. För att lösa detta problem beslutade vi att skapa vår egen avatar-tjänst. Vi hade använt en tredjeparts-API under en lång tid men såg inte några betydande förbättringar. Med serverbytet kunde vi ställa in mer optimala träningsmetoder för att bättre upprätthålla likheten mellan användarens riktiga ansikte och avatarutdata. Medan jag inte kan avslöja vår unika pipeline i detalj, blev det möjligt tack vare en specifik kombination av SDXL-inställningar, LORAs och ansiktsförbättrare, och vi har ännu inte sett bättre resultat någon annanstans.
Hur uppfattar du påverkan av AI som ARTA på den traditionella konstmarknaden? Ser du AI-konstgenerering som en störning eller en förbättring av konstindustrin?
Jag ser det som en förbättring. Generativ AI har introducerat nya och värdefulla möjligheter att förbättra den konstnärliga processen samtidigt som den betydligt minskar omsättningstiden. Det hjälper digitala artister, designers, illustratörer och andra visuella innehållsskapare med en mängd olika uppgifter, från att utforska idéer och utveckla koncept till att generera skisser och färdiga bilder. Till slut är vår förmåga att utnyttja dess framsteg begränsad endast av vår fantasi.
Var ser du framtiden för AI-bildgenerering gå?
Tillsammans med bildkvaliteten kommer genereringshastigheten att öka, vilket automatiskt leder till mer kostnadseffektiva utdata.
Jag tror att det inte kommer att dröja länge innan det finns ett enkelt sätt att generera samma karaktärer i olika miljöer och positioner, så att vi kommer att se en uppgång för AI i serier, barnböcker, spelgrafik och mer. Inredningsdesign och annonsproduktion är redan områden som aktivt använder generativ AI, men mer är på väg när tekniken fortsätter att utvecklas.
Vad är dina förutsägelser för vad vi kan förvänta oss nästa från generativ AI?
Vågen av popularitet för videogenerering är på horisonten. Med framsteg i tekniken som når en tillräcklig nivå, kommer det utan tvekan att finnas försök att träna neurala nätverk med människors ansiktsuttryck och gester för att skapa videoavatrar, potentiellt till och med med unika användarröster.
Tack för den här intervjun. Läsare som vill lära sig mer eller generera några bilder bör besöka ARTA.












