Интервью
Картик Ранганатан, сооснователь и со-CEO Yugabyte – Интервью

Картик Ранганатан является сооснователем и со-CEO компании Yugabyte, стоящей за YugabyteDB, открытой, высокопроизводительной распределенной базой данных PostgreSQL. Картик – опытный эксперт в области данных и бывший инженер Facebook (META ), который основал Yugabyte вместе с двумя своими коллегами из Facebook, чтобы революционизировать распределенные базы данных.
Что вдохновило вас на создание Yugabyte, и какие пробелы на рынке вы увидели, что привело к созданию YugabyteDB?
Мои сооснователи, Каннан Мутхуккаруппан, Михаил Баутин и я, основали Yugabyte в 2016 году. Как бывшие инженеры Meta (тогда называвшейся Facebook), мы помогали создавать популярные базы данных, включая Apache Cassandra, HBase и RocksDB, а также запускали некоторые из этих баз данных как управляемые сервисы для внутренних рабочих нагрузок.
Мы создали YugabyteDB, потому что мы увидели пробел на рынке для облачных транзакционных баз данных для бизнес-критических приложений. Мы построили YugabyteDB, чтобы удовлетворить потребности организаций, переходящих от локальных систем к облачным, и объединили сильные стороны нереляционных баз данных с масштабируемостью и устойчивостью облачных архитектур. Пока мы строили Cassandra и HBase в Facebook (что было инструментально в решении масштабных потребностей Facebook), мы увидели рост микросервисов, контейнеризации, высокодоступности, географического распределения и интерфейсов программирования приложений (API). Мы также признали влияние открытых технологий на развитие отрасли.
Люди часто думают, что рынок транзакционных баз данных переполнен. Хотя это традиционно было так, сегодня Postgres стал де-факто стандартом для облачных транзакционных баз данных. Все чаще облачные базы данных выбирают поддержку протокола Postgres, который был вплетен в ткань YugabyteDB, что делает его самой совместимой с Postgres базой данных на рынке. YugabyteDB сохраняет мощность и знакомство PostgreSQL, одновременно эволюционируя в распределенную базу данных класса предприятия, подходящую для современных облачных приложений. YugabyteDB позволяет предприятиям эффективно строить и масштабировать системы, используя знакомые модели SQL.
Как ваш опыт в Facebook повлиял на ваше видение компании?
В 2007 году я рассматривал возможность присоединиться к небольшой, но растущей компании – Facebook. В то время на сайте было около 30-40 миллионов пользователей. Я думал, что оно может удвоиться в размере, но я не мог быть более ошибочным! Во время моих более чем пяти лет в Facebook пользовательская база выросла до 2 миллиардов. То, что привлекло меня в компанию, была культура инноваций и смелости, поощряющая людей “быстро терпеть неудачи”, чтобы катализировать инновации.
Facebook вырос так большим, что технические и интеллектуальные проблемы, которые я искал, больше не были присутствуют. В течение многих лет я стремился создать свою собственную компанию и решить проблемы, с которыми сталкиваются обычные пользователи – это привело меня к созданию Yugabyte.
Наша миссия – упростить облачные приложения, сосредоточившись на трех важных функциях, необходимых для современного развития:
- Во-первых, приложения должны быть постоянно доступны, обеспечивая время безотказной работы, независимо от резервных копий или сбоев, особенно при запуске на коммодитизированном оборудовании в облаке.
- Во-вторых, способность масштабироваться по требованию имеет решающее значение, позволяя разработчикам строить и выпускать быстро, не задерживаясь на заказе оборудования.
- В-третьих, с множеством центров данных, которые теперь легко доступны, репликация данных по регионам становится важной для надежности и производительности.
Эти три элемента наделяют разработчиков гибкостью и свободой, необходимыми для инноваций, не ограничиваясь ограничениями инфраструктуры.
Можете ли вы рассказать о пути Yugabyte с момента его основания в 2016 году до его текущего статуса лидера в распределенных SQL-базах данных? Какие были ключевые вехи?
В Facebook я часто разговаривал с разработчиками, которые нуждались в определенных функциях, таких как вторичные индексы на SQL-базах данных или случайные многонодовые транзакции. К сожалению, ответ был обычно “нет”, потому что существующие системы не были разработаны для этих требований.
Сегодня мы переживаем сдвиг в сторону облачных транзакционных приложений, которые должны решать проблемы масштабирования и доступности. Традиционные базы данных просто не могут удовлетворить эти потребности. Современные предприятия требуют реляционных баз данных, которые работают в облаке и предлагают три важные функции: высокую доступность, масштабируемость и географическое распределение, сохраняя при этом поддержку возможностей SQL. Это те столпы, на которых мы построили YugabyteDB и базовые проблемы, которые мы решаем.
В феврале 2016 года основатели начали разрабатывать YugabyteDB, глобальную распределенную SQL-базу данных, предназначенную для облачных транзакционных приложений. В июле 2019 года мы сделали беспрецедентное объявление и выпустили наши ранее коммерческие функции как открытые. Это подтвердило нашу приверженность принципам открытого исходного кода и официально запустило YugabyteDB как полностью открытую систему управления реляционными базами данных (RDBMS) под лицензией Apache 2.0.
Последняя версия YugabyteDB (представленная в сентябре) включает улучшенную совместимость с Postgres. Она включает адаптивный оптимизатор затрат (CBO), который оптимизирует планы запросов для крупномасштабных, многорегиональных приложений, и умную распределение данных, которое автоматически определяет, следует ли хранить таблицы вместе для более низкой задержки или разделить и распределить данные для большей масштабируемости. Эти улучшения позволяют разработчикам запускать свои приложения PostgreSQL на YugabyteDB эффективно и масштабироваться без необходимости компромиссов или сложных миграций.
YugabyteDB известен своей совместимостью с PostgreSQL и API, вдохновленным Cassandra. Как этот много-API-подход выгоден для разработчиков и предприятий?
Много-API-подход YugabyteDB выгоден для разработчиков и предприятий, объединяя сильные стороны высокопроизводительной SQL-базы данных с гибкостью, необходимой для глобальных, интернет-масштабных приложений.
Он поддерживает масштабируемую СУБД и высокообъемные онлайн-транзакционные рабочие нагрузки (OLTP), сохраняя при этом низкую задержку запросов и исключительную устойчивость. Совместимость с PostgreSQL позволяет обеспечить бесшовную модернизацию существующих приложений Postgres, требуя минимальных изменений.
В последней версии распределенной базы данных, выпущенной в сентябре 2024 года, функции, такие как адаптивный CBO и умное распределение данных, улучшают производительность, оптимизируя планы запросов и автоматически управляя размещением данных. Это позволяет разработчикам достигать низкой задержки и высокой масштабируемости без компромиссов, что делает YugabyteDB идеальным выбором для быстро растущих, облачных приложений, которые требуют надежного управления данными.
Искусственный интеллект все чаще интегрируется в системы баз данных. Как Yugabyte использует ИИ для улучшения производительности, масштабируемости и безопасности своих SQL-систем?
Мы используем ИИ для улучшения нашей распределенной SQL-базы данных, решая проблемы производительности и миграции. Наш будущий Performance Copilot, улучшение нашего Performance Advisor, упростит устранение неполадок, анализируя закономерности запросов, обнаруживая аномалии и предоставляя рекомендации в режиме реального времени для устранения проблем с производительностью базы данных.
Мы также интегрируем ИИ в YugabyteDB Voyager, наш инструмент миграции базы данных, который упрощает миграцию из PostgreSQL, MySQL, Oracle (ORCL ) и других облачных баз данных в YugabyteDB. Мы стремимся упростить переходы от устаревших систем, автоматизируя преобразование схемы, перевод SQL и преобразование данных, с активными проверками совместимости. Эти инновации направлены на то, чтобы сделать YugabyteDB умнее, более эффективной и проще в использовании для современных, распределенных приложений.
Каковы ключевые преимущества использования открытой SQL-системы, такой как YugabyteDB, в облачных приложениях по сравнению с традиционными проприетарными базами данных?
Прозрачность, гибкость и надежная поддержка сообщества являются ключевыми преимуществами при использовании открытой SQL-системы, такой как YugabyteDB, в облачных приложениях. Когда мы запустили YugabyteDB, мы признали скептицизм, окружающий модели открытого исходного кода. Мы взаимодействовали с пользователями, которые выразили сильное предпочтение полностью открытой базе данных, чтобы доверить ей свои критические данные.
Мы изначально работали на модели открытого ядра, но быстро поняли, что это должно быть полностью открытое решение. Разработчики все чаще обращаются к PostgreSQL как к логическому альтернативному варианту Oracle, но PostgreSQL не был разработан для динамических облачных платформ. YugabyteDB заполняет этот пробел, поддерживая глубину функций PostgreSQL для современных облачных инфраструктур. Быть полностью открытым, мы удаляем барьеры для принятия.
Это делает нас очень привлекательными для разработчиков, строящих бизнес-критические приложения, и для инженеров, эксплуатирующих их на облачных платформах. Наша цель – создать базу данных, которая не только открыта, но и проста в использовании и совместима с PostgreSQL, которая остается любимой среди разработчиков благодаря своей зрелой функциональности и мощным расширениям.
Спрос на масштабируемые и адаптируемые SQL-решения растет. Какие тенденции вы наблюдаете на рынке корпоративных баз данных, и как Yugabyte позиционируется для удовлетворения этих потребностей?
Более крупный масштаб в корпоративных базах данных часто приводит к увеличению количества сбоев, особенно когда организации имеют дело с расширенными следами и более высокими объемами данных. Ключевые тенденции, формирующие ландшафт баз данных, включают принятие сервисов баз данных как услуги (DBaaS) и сдвиг от публичного облака к частным облачным средам. Кроме того, интеграция генеративного ИИ создает возможности и проблемы, требуя автоматизации и оптимизации производительности для управления растущей нагрузкой данных.
Организации все чаще обращаются к DBaaS для оптимизации операций, несмотря на первоначальные опасения по поводу контроля и безопасности. Этот подход улучшает эффективность на различных инфраструктурах, в то время как внимание к частным облачным решениям помогает бизнесу сократить затраты и повысить масштабируемость для своих рабочих нагрузок.
YugabyteDB решает эти эволюционирующие потребности, объединяя сильные стороны реляционных баз данных с масштабируемостью облачных архитектур. Функции, такие как умное распределение данных и адаптивный CBO, улучшают производительность и поддерживают большое количество объектов базы данных. Это делает его конкурентоспособным выбором для запуска широкого спектра приложений.
Кроме того, YugabyteDB позволяет предприятиям мигрировать свои приложения PostgreSQL, сохраняя при этом аналогичные уровни производительности, что важно для современных рабочих нагрузок. Наша приверженность разработке с открытым исходным кодом поощряет участие сообщества и обеспечивает гибкость для клиентов, которые хотят избежать зависимости от поставщика.
С ростом крауд-вычислений и Интернета вещей, как YugabyteDB решает проблемы, связанные с этими технологиями, особенно в отношении распределения данных и задержки?
Распределенная SQL-архитектура YugabyteDB предназначена для решения проблем, связанных с ростом крауд-вычислений и Интернета вещей, обеспечивая масштабируемый и устойчивый слой данных, который может работать бесперебойно в облачных и крауд-контекстах. Его способность автоматически шардировать и реплицировать данные обеспечивает эффективное распределение, позволяя быстро получить доступ и обрабатывать данные в режиме реального времени. Это минимизирует задержку, позволяя приложениям быстро реагировать на взаимодействия пользователей и изменения данных.
Предлагая гибкость для адаптации конфигураций на основе конкретных требований приложений, YugabyteDB гарантирует, что предприятия могут эффективно управлять своими потребностями в данных по мере их эволюции в все более децентрализованном ландшафте.
Как со-CEO, как вы балансируете двойные роли лидерства технологических инноваций и управления ростом компании?
Наша компания стремится упростить облачные приложения, заставляя меня оставаться на вершине технологических тенденций, таких как генеративный ИИ и контекстные переключения. Следование инновациям требует любопытства, желания оказать влияние и приверженности непрерывному обучению.
Балансирование технологических инноваций и роста компании фундаментально связано с масштабированием – будь то масштабирование систем или масштабирование влияния. В распределенных базах данных мы фокусируемся на построении технологий, которые масштабируют производительность, обрабатывают огромные рабочие нагрузки и обеспечивают высокую доступность на глобальной инфраструктуре. Аналогично, масштабирование Yugabyte означает рост нашей клиентской базы, улучшение вовлеченности сообщества и расширение нашего экосистемы, сохраняя при этом операционное совершенство.
Все это требует дисциплинированного подхода к производительности и эффективности.
Технически мы оптимизируем выполнение запросов, снижаем задержку и улучяем пропускную способность системы; организационно мы оптимизируем процессы, масштабируем команды и улучшаем межфункциональное сотрудничество. В обоих случаях успех исходит от того, что команды наделяются правильными инструментами, идеями и процессами для принятия умных, обоснованных решений.
Как вы видите эволюцию распределенных SQL-баз данных в течение следующих 5-10 лет, особенно в контексте ИИ и машинного обучения?
В течение следующих нескольких лет распределенные SQL-базы данных будут эволюционировать, чтобы решать сложные задачи анализа данных, позволяя пользователям делать прогнозы и обнаруживать аномалии с минимальными техническими знаниями. Существует огромное количество специализации баз данных в контексте ИИ и машинного обучения, но это неустойчиво. Базы данных должны эволюционировать, чтобы удовлетворить потребности ИИ. Это почему мы итерируем и улучшим возможности на основе pgvector, гарантируя, что разработчики могут использовать Yugabyte для своих потребностей в базе данных ИИ.
Кроме того, мы можем ожидать продолжения приверженности открытому исходному коду в разработке ИИ. Пять лет назад мы сделали YugabyteDB полностью открытым под лицензией Apache 2.0, подтвердив нашу приверженность открытому исходному коду и активно строя нашу сообщество с открытым исходным кодом.
Спасибо за все ваши подробные ответы. Читателям, которые хотят узнать больше, следует посетить YugabyteDB.












