Интервью
Эрнест Пятрович, менеджер продукта в ARTA – Серия интервью

Эрнест Пятрович – менеджер продукта в компании AIBY Group, где он руководит одним из лучших приложений компании, основанных на искусственном интеллекте, – ARTA – генератор изображений на основе ИИ для iPhone и Android. Благодаря его стратегическому видению и творческому подходу, приложение заняло второе место в чартах App Store в США вскоре после выпуска, превысив отметку в 15 миллионов загрузок по всему миру, и предлагая лучшие аватары на основе ИИ, созданные с помощью уникальной внутренней технологии, среди других успехов.
Вы были ответственны за управление ARTA – генератором искусства на основе ИИ с момента его концепции до настоящего времени. Не могли бы вы поделиться некоторыми идеями о ранних днях?
Конечно! Это были динамичные времена. Мы смогли выпустить хорошо сделанное приложение всего за неделю, став одним из первых создателей потребительских приложений, предлагавших функцию генерации изображений на основе текста на мобильных устройствах. Наша цель была – создать массовый продукт, предоставляющий людям “художника” в кармане. Итак, с момента концепции и ранней разработки мы сосредоточились на удобстве использования и масштабируемости. Но, несмотря на своевременный вход на рынок, было довольно сложно увеличить объем установки до достаточного уровня, даже с нашей блестящей командой медиа-покупок. Значительный толчок произошел через три месяца после выпуска приложения, когда наша функция аватара стала популярной. Объем быстро стал умеренно высоким для нашей ниши, и с тех пор нашей задачей было поддерживать и увеличивать его.
Какой был исходный технологический стек, на котором вы запустили приложение, и какие были некоторые из проблем с генерацией искусства в этот период?
Мы запустили приложение на основе Stable Diffusion 1.3, используя официальный API от Stability.ai. Должен сказать, что ситуация с качеством генерации тогда и сейчас – как день и ночь. Когда мы впервые начали, наши менеджеры по контролю качества часто сообщали о проблемах, связанных с эстетической ценностью изображений или неточностями в представлении определенных концепций и особенностей. Однако это было стандартом для Stable Diffusion в то время. Теперь качество генерации намного лучше во всех аспектах, включая стилистическое воспроизведение, связность композиции, визуальную точность, уровень детализации и многое другое.
Вскоре после выпуска приложения мы начали арендовать серверы на Amazon (AMZN ), и поддержка их оказалась довольно сложной задачей. Даже с достаточными средствами может не быть свободных A100, когда вам это нужно, и вам придется ждать несколько дней. Поэтому нам пришлось обходиться без автоматического масштабирования, перенаправляя все избыточный трафик на API наших партнеров.
Поддержание всего этого остается довольно сложной задачей до сих пор, с небольшими проблемами, возникающими на одном или другом конце каждые месяц или около того. Например, мы иногда сталкиваемся с временными проблемами с качеством генерации, когда провайдер обновляет сервер, тестирует веса или внедряет другие изменения, влияющие на выход генерации. Такие ошибки могут длиться от часа до половины дня и являются непредсказуемыми и трудными для отслеживания. Обычно к тому времени, когда наш отдел поддержки получает сообщение пользователя о размытых изображениях или других возникших проблемах, провайдер API уже исправил проблему. Однако это серьезная проблема для наших пользователей. Поэтому сейчас мы строим систему, которая объединяет несколько провайдеров и наши собственные серверы для специальных генераций, позволяя нам иметь больше контроля над нашей стороны.
Как менеджер продукта, какие стратегические решения были важными для руководства ARTA к его топ-рейтингу вскоре после выпуска?
Ранний подъем ARTA (в то время называвшегося Aiby) был результатом своевременного решения реализовать функцию аватара, когда она только начала набирать популярность в социальных сетях. Мы быстро признали растущий интерес к этой функциональности. Наша вся команда, включая продукт, маркетинг и разработку, была на одной волне и имела видение успеха. Мы также признали, что короткое время до выхода на рынок было крайне важно. Итак, с первого дня мы посвятили все наши ресурсы реализации этой функции, отдали ей приоритет над другими задачами.
Поскольку наш срок был “как можно скорее”, чтобы не пропустить момент, когда аватары ИИ достигнут пика популярности, мы решили использовать решение третьей стороны и адаптировать его для нашего приложения. Хотя аватары только начинали набирать популярность на мобильных устройствах, технология уже была доступна на веб-страницах, даже с API. Благодаря集中енным усилиям команды, наша первая рабочая версия была в App Store всего за пять дней, предлагая очень конкурентоспособный выход аватара. Это помогло нам достичь второго места в американских топ-чартах и остаться вторым по количеству загрузок в США в течение недели.
Могут ли пользователи влиять на художественный процесс в ARTA? Если да, то какие инструменты и варианты доступны пользователям для настройки генерируемого искусства на основе ИИ?
Мы обрабатываем все сложные аспекты, связанные с генерацией, стремясь предоставить нашим пользователям простой художественный опыт без ненужной технической нагрузки. Итак, основным способом, которым пользователи влияют на выход, является через подсказки. Мы сохраняем этот процесс прозрачным, показывая точный текстовый запрос, который будет отправлен модели для генерации, и предлагая помощь в составлении эффективных подсказок, если это необходимо.
Мы выбираем лучшие значения по умолчанию для каждой интегрированной модели, поэтому пользователям не нужно беспокоиться об этом. Обычно нет необходимости регулировать их, чтобы максимизировать результаты, поскольку они уже производят оптимальный выход генерации. Однако, если пользователь хочет экспериментировать, режим “Продвинутый” находится всего в одном клике, и некоторые более глубокие параметры находятся в разделе настроек.
Скоро мы добавим параметр “Сид”, позволяющий пользователям иметь полный контроль над генерацией, когда им нужно воссоздать идентичное изображение с нуля. Кроме того, мы планируем расширить список соотношений сторон. Мы также думаем о добавлении нескольких контрольных сетей к обычным генерациям. Они уже поддерживаются на стороне сервера, поскольку мы используем их для генерации фильтров ИИ и эскизов, но они еще не доступны конечным пользователям.
Как вы воспринимаете влияние ИИ, подобного ARTA, на традиционный рынок искусства? Видите ли вы генерацию искусства на основе ИИ как нарушение или улучшение индустрии искусства?
Я считаю, что это улучшение. Генеративный ИИ представил новые и ценные возможности для улучшения художественного процесса, значительно сокращая время выполнения. Он помогает цифровым художникам, дизайнерам, иллюстраторам и другим создателям визуального контента с разнообразными задачами, от изучения идей и разработки концепций до генерации эскизов и готовых изображений. В конечном итоге, наша способность использовать его достижения ограничена только нашим воображением.
Например, у меня есть хобби – создание игр для ПК, и недавно я использовал ARTA для генерации набора иконок для навыков и предметов. Я мог бы разработать их самостоятельно, используя Adobe Illustrator, но с помощью генератора изображений я получил то, что мне нужно почти сразу. Моя жена, в свою очередь, является ретушером-фотографом. Благодаря функции “Генеративный заполнение” в Photoshop она работает намного быстрее и имеет больше свободного времени (или больше дохода, если она решит принять больше заказов на ретушь).
Когда это сделано хорошо, генерируемые изображения на основе ИИ могут выглядеть неотличимыми от профессиональных произведений искусства. Однако, по моему мнению, ИИ никогда не заменит настоящего профессионала. Как тогда, так и сейчас,真正 инновационные идеи могут быть произведены только людьми. Хотя традиционное значение искусства остается связанным с произведениями, созданными человеком, искусство на основе ИИ – это ожидаемый спин-офф, приглашающий всех, независимо от художественного прошлого, попробовать новый интересный опыт.
Глядя за пределы улучшения качества изображений, куда, по вашему мнению, движется будущее генерации изображений на основе ИИ?
Вместе с качеством изображений скорость генерации увеличится, что автоматически приведет к более экономически эффективным результатам.
Я думаю, что не пройдет много времени, прежде чем появится простой способ генерировать одних и тех же персонажей в разных средах и позициях, и мы увидим рост ИИ в комиксах, детских книгах, графике игр и многом другом. Интерьерный дизайн и производство рекламных материалов уже являются сферами, активно использующими генеративный ИИ, но впереди нас ждет еще больше, поскольку технология продолжает развиваться.
Учитывая, что все генерации требуют мощных GPU, эти технологии будут развиваться вместе с ИИ в течение некоторого времени. Мы только в начале этого пути. Может быть, новый Apple (AAPL ) нашего времени будет Nvidia (NVDA ), и все, или хотя бы те, кто в индустрии IT, будут с нетерпением ждать новых выпусков видеокарт, как мы все ждали новых iPhone.
Генераторы изображений на основе ИИ будут продолжать предоставлять интересный и увлекательный опыт, будь то введение новых концепций, возникающих из поп-культуры, или возрождение старых идей с лучшей технологией. Например, интерес к генерации “ИИ-младенца” в настоящее время растет. Одна из недавних технологий, основанных на Stable Diffusion, продемонстрировала впечатляющие результаты, объединив черты двух людей, чтобы показать потенциальный вид их биологического ребенка. Результаты намного превосходят то, что было доступно на сайтах гороскопов несколько лет назад, и люди с нетерпением ждут, чтобы попробовать еще раз.
Что, по вашему мнению, мы должны ожидать дальше от генеративного ИИ?
Волна популярности генерации видео уже на горизонте. С достижением технологий достаточного уровня обязательно будут попытки обучить нейронные сети с помощью выражений лица и жестов людей, чтобы создать видео-аватары, потенциально даже с уникальными голосами пользователей.
ИИ-аудио – это еще один значительный прорыв, открывающий новую эру для индустрии музыкального производства. Эта технология уже представила удивительные возможности для создания песен на основе только текстового ввода, что делает ее отличным инструментом для создания пользовательских нестандартных саундтреков для различных типов видеоконтента. В целом, это действительно весело слушать что-то такое будничное, как Условия использования, прочитанное или спетое с романтической интонацией.
Спасибо за отличное интервью. Читателям, которые хотят узнать больше или сгенерировать некоторые изображения, мы рекомендуем посетить ARTA.












