Entretiens
Karthik Ranganathan, Co-Fondateur et Co-PDG de Yugabyte – Série d’entretiens

Karthik Ranganathan est co-fondateur et co-PDG de Yugabyte, l’entreprise derrière YugabyteDB, la base de données PostgreSQL distribuée open-source et haute performance. Karthik est un expert en données chevronné et ancien ingénieur de Facebook (META ) qui a co-fondé Yugabyte avec deux de ses collègues de Facebook pour révolutionner les bases de données distribuées.
Qu’est-ce qui vous a inspiré pour co-fonder Yugabyte, et quels sont les lacunes du marché que vous avez identifiées pour créer YugabyteDB ?
Mes co-fondateurs, Kannan Muthukkaruppan, Mikhail Bautin et moi, avons fondé Yugabyte en 2016. En tant qu’anciens ingénieurs de Meta (alors appelé Facebook), nous avons aidé à développer des bases de données populaires, notamment Apache Cassandra, HBase et RocksDB, ainsi que des services gérés pour les charges de travail internes.
Nous avons créé YugabyteDB parce que nous avons identifié un manque sur le marché pour des bases de données transactionnelles cloud-native pour les applications métier critiques. Nous avons conçu YugabyteDB pour répondre aux besoins des organisations qui passent d’une infrastructure sur site à des opérations cloud-native et avons combiné les forces des bases de données non relationnelles avec la scalabilité et la résilience des architectures cloud-native. Lorsque nous avons développé Cassandra et HBase à Facebook (ce qui a été instrumental pour répondre aux besoins de mise à l’échelle importants de Facebook), nous avons vu l’émergence des microservices, de la conteneurisation, de la haute disponibilité, de la distribution géographique et des interfaces de programmation d’applications (API). Nous avons également reconnu l’impact que les technologies open-source ont sur l’avancement de l’industrie.
Les gens pensent souvent que le marché des bases de données transactionnelles est encombré. Même si cela a traditionnellement été vrai, aujourd’hui Postgres est devenu l’API par défaut pour les bases de données transactionnelles cloud-native. De plus en plus, les bases de données cloud-native choisissent de prendre en charge le protocole Postgres, qui a été intégré dans la structure même de YugabyteDB, ce qui en fait la base de données la plus compatible avec Postgres sur le marché. YugabyteDB conserve la puissance et la familiarité de PostgreSQL tout en l’évoluant vers une base de données distribuée de niveau entreprise adaptée aux applications cloud-native modernes. YugabyteDB permet aux entreprises de construire et de mettre à l’échelle des systèmes en utilisant des modèles SQL familiers.
Comment vos expériences chez Facebook ont-elles influencé votre vision pour l’entreprise ?
En 2007, j’envisageais de rejoindre une petite entreprise en croissance – Facebook. À l’époque, le site comptait environ 30 à 40 millions d’utilisateurs. Je pensais qu’il pourrait doubler de taille, mais je me trompais ! Pendant mes plus de cinq ans chez Facebook, la base d’utilisateurs a augmenté à 2 milliards. Ce qui m’a attiré dans l’entreprise, c’était sa culture d’innovation et d’audace, encourageant les gens à “échouer rapidement” pour catalyser l’innovation.
Facebook est devenu si grand que les défis techniques et intellectuels que je recherchais n’étaient plus présents. Pendant de nombreuses années, j’avais aspiré à créer ma propre entreprise et à résoudre les problèmes auxquels le commun des utilisateurs était confronté – c’est ce qui m’a conduit à co-créer Yugabyte.
Notre mission est de simplifier les applications cloud-native, en nous concentrant sur trois fonctionnalités essentielles cruciales pour le développement moderne :
- Tout d’abord, les applications doivent être continuellement disponibles, en garantissant le temps d’activité sans tenir compte des sauvegardes ou des défaillances, en particulier lorsqu’elles s’exécutent sur du matériel de commodité dans le cloud.
- Deuxièmement, la capacité de mise à l’échelle à la demande est cruciale, permettant aux développeurs de construire et de publier rapidement sans le retard de la commande de matériel.
- Troisièmement, avec de nombreux centres de données facilement accessibles, la réplication des données entre régions devient vitale pour la fiabilité et les performances.
Ces trois éléments donnent aux développeurs la souplesse et la liberté dont ils ont besoin pour innover, sans être contraints par les limitations de l’infrastructure.
Pouvez-vous partager le parcours de Yugabyte depuis sa création en 2016 jusqu’à son statut actuel de leader dans les bases de données SQL distribuées ? Quels ont été les principaux jalons ?
Chez Facebook, j’ai souvent discuté avec des développeurs qui avaient besoin de fonctionnalités spécifiques, comme des index secondaires sur les bases de données SQL ou des transactions multi-nœuds occasionnelles. Malheureusement, la réponse était souvent « non », car les systèmes existants n’étaient pas conçus pour répondre à ces exigences.
Aujourd’hui, nous assistons à un changement vers des applications transactionnelles cloud-native qui doivent répondre à la mise à l’échelle et à la disponibilité. Les bases de données traditionnelles ne peuvent pas répondre à ces besoins. Les entreprises modernes nécessitent des bases de données relationnelles qui fonctionnent dans le cloud et offrent les trois fonctionnalités essentielles : haute disponibilité, scalabilité et distribution géographique, tout en prenant en charge les capacités SQL. Ce sont les piliers sur lesquels nous avons construit YugabyteDB et les défis de base de données que nous nous efforçons de résoudre.
En février 2016, les fondateurs ont commencé à développer YugabyteDB, une base de données SQL distribuée à l’échelle mondiale conçue pour les applications transactionnelles cloud-native. En juillet 2019, nous avons fait une annonce sans précédent et publié nos fonctionnalités commerciales précédentes en open source. Cela a réaffirmé notre engagement en faveur des principes open source et a officiellement lancé YugabyteDB en tant que système de gestion de base de données relationnelle (RDBMS) entièrement open source sous licence Apache 2.0.
La dernière version de YugabyteDB (présentée en septembre) présente une compatibilité améliorée avec Postgres. Elle comprend un optimiseur de coût adaptatif (CBO) qui optimise les plans de requête pour les applications à grande échelle et multi-régions, ainsi que la distribution intelligente des données qui détermine automatiquement s’il faut stocker les tables ensemble pour une latence plus faible, ou les fragmenter et distribuer les données pour une plus grande scalabilité. Ces améliorations permettent aux développeurs d’exécuter leurs applications PostgreSQL sur YugabyteDB de manière efficace et de mettre à l’échelle sans avoir besoin de compromis ou de migrations complexes.
YugabyteDB est connu pour sa compatibilité avec PostgreSQL et son API inspirée de Cassandra. Comment cette approche multi-API bénéficie-t-elle aux développeurs et aux entreprises ?
L’approche multi-API de YugabyteDB bénéficie aux développeurs et aux entreprises en combinant les forces d’une base de données SQL haute performance avec la flexibilité nécessaire pour les applications à l’échelle de l’Internet.
Elle prend en charge la mise à l’échelle de la base de données relationnelle et les charges de travail OLTP (Online Transaction Processing) à haute volume, tout en maintenant une faible latence de requête et une résilience exceptionnelle. La compatibilité avec PostgreSQL permet une modernisation sans effort des applications Postgres existantes, nécessitant des changements minimaux.
Dans la dernière version de la plate-forme de base de données distribuée, publiée en septembre 2024, des fonctionnalités comme le CBO adaptatif et la distribution intelligente des données améliorent les performances en optimisant les plans de requête et en gérant automatiquement le placement des données. Cela permet aux développeurs d’atteindre une faible latence et une grande scalabilité sans compromis, ce qui rend YugabyteDB idéal pour les applications cloud-native en croissance rapide qui nécessitent une gestion de données fiable.
L’intelligence artificielle est de plus en plus intégrée dans les systèmes de base de données. Comment Yugabyte tire-t-elle parti de l’IA pour améliorer les performances, la scalabilité et la sécurité de ses systèmes SQL ?
Nous utilisons l’IA pour améliorer notre base de données SQL distribuée en résolvant les défis de performances et de migration. Notre Performance Copilot, une amélioration de notre Performance Advisor, simplifiera le dépannage en analysant les modèles de requête, en détectant les anomalies et en fournissant des recommandations en temps réel pour résoudre les problèmes de performances de la base de données.
Nous intégrons également l’IA dans YugabyteDB Voyager, notre outil de migration de base de données qui simplifie les migrations de PostgreSQL, MySQL, Oracle (ORCL ) et d’autres bases de données cloud vers YugabyteDB. Nous visons à rationaliser les transitions à partir des systèmes hérités en automatisant la conversion de schéma, la traduction SQL et la transformation de données, avec des vérifications de compatibilité proactives. Ces innovations se concentrent sur le fait de rendre YugabyteDB plus intelligent, plus efficace et plus facile à utiliser pour les applications distribuées modernes.
Quels sont les principaux avantages de l’utilisation d’un système SQL open source comme YugabyteDB dans les applications cloud-native par rapport aux bases de données propriétaires traditionnelles ?
La transparence, la flexibilité et le soutien robuste de la communauté sont les principaux avantages de l’utilisation d’un système SQL open source comme YugabyteDB dans les applications cloud-native. Lorsque nous avons lancé YugabyteDB, nous avons reconnu le scepticisme entourant les modèles open source. Nous nous sommes engagés avec les utilisateurs, qui ont exprimé une forte préférence pour une base de données entièrement open source pour faire confiance à leurs données critiques.
Nous avons initialement fonctionné sur un modèle open-core, mais nous avons rapidement réalisé qu’il devait s’agir d’une solution complètement open source. Les développeurs se tournent de plus en plus vers PostgreSQL comme alternative logique à Oracle, mais PostgreSQL n’a pas été conçu pour les plates-formes cloud dynamiques. YugabyteDB comble cette lacune en prenant en charge la profondeur de fonctionnalité de PostgreSQL pour les infrastructures cloud modernes. En étant 100 % open source, nous supprimons les obstacles à l’adoption.
Cela nous rend très attractifs pour les développeurs qui construisent des applications métier critiques et pour les ingénieurs d’exploitation qui les exécutent sur des plates-formes cloud-native. Notre objectif est de créer une base de données qui n’est pas seulement open source, mais également facile à utiliser et compatible avec PostgreSQL, qui reste un choix de développement préféré en raison de son ensemble de fonctionnalités mature et de ses extensions puissantes.
La demande de solutions SQL évolutives et adaptables augmente. Quels sont les tendances que vous observez sur le marché des bases de données d’entreprise, et comment Yugabyte est-elle positionnée pour répondre à ces demandes ?
Une plus grande échelle dans les bases de données d’entreprise conduit souvent à une augmentation des taux de défaillance, en particulier à mesure que les organisations traitent des empreintes et des volumes de données plus importants. Les tendances clés qui façonnent le paysage des bases de données incluent l’adoption de DBaaS et un déplacement du cloud public vers les environnements de cloud privé. De plus, l’intégration de l’IA générative présente des opportunités et des défis, nécessitant l’automatisation et l’optimisation des performances pour gérer la charge de données croissante.
Les organisations se tournent de plus en plus vers DBaaS pour rationaliser les opérations, malgré les préoccupations initiales concernant le contrôle et la sécurité. Cette approche améliore l’efficacité sur diverses infrastructures, tandis que l’accent mis sur les solutions de cloud privé aide les entreprises à réduire les coûts et à améliorer la scalabilité pour leurs charges de travail.
YugabyteDB répond à ces demandes évolutives en combinant les forces des bases de données relationnelles avec la scalabilité des architectures cloud-native. Des fonctionnalités comme la distribution intelligente des données et le CBO adaptatif améliorent les performances et prennent en charge un grand nombre d’objets de base de données. Cela en fait un choix compétitif pour exécuter une large gamme d’applications.
De plus, YugabyteDB permet aux entreprises de migrer leurs applications PostgreSQL tout en maintenant des niveaux de performance similaires, ce qui est crucial pour les charges de travail modernes. Notre engagement en faveur du développement open source encourage la participation de la communauté et fournit la flexibilité dont les clients ont besoin pour éviter le verrouillage des fournisseurs.
Avec l’émergence du calcul de bord et de l’Internet des objets, comment YugabyteDB répond-elle aux défis posés par ces technologies, en particulier en ce qui concerne la distribution des données et la latence ?
L’architecture SQL distribuée de YugabyteDB est conçue pour répondre aux défis posés par l’émergence du calcul de bord et de l’Internet des objets en fournissant une couche de données évolutives et résilientes qui peut fonctionner sans problème dans les contextes cloud et de bord. Sa capacité à fragmenter et à répliquer automatiquement les données assure une distribution efficace, permettant un accès rapide et un traitement en temps réel. Cela minimise la latence, permettant aux applications de répondre rapidement aux interactions et aux changements de données.
En offrant la flexibilité de personnaliser les configurations en fonction des exigences spécifiques des applications, YugabyteDB garantit que les entreprises peuvent gérer efficacement leurs besoins en données à mesure qu’elles évoluent dans un paysage de plus en plus décentralisé.
En tant que co-PDG, comment équilibrez-vous les rôles de leader de l’innovation technologique et de gestion de la croissance de l’entreprise ?
Notre entreprise vise à simplifier les applications cloud-native, ce qui me pousse à rester à la pointe des tendances technologiques, telles que l’IA générative et les commutations de contexte. Suivre l’innovation nécessite de la curiosité, le désir de faire une différence et un engagement en faveur de l’apprentissage continu.
Équilibrer l’innovation technologique et la croissance de l’entreprise est fondamentalement une question de mise à l’échelle – que ce soit la mise à l’échelle des systèmes ou la mise à l’échelle de l’impact. Dans les bases de données distribuées, nous nous concentrons sur la construction de technologies qui mettent à l’échelle les performances, gèrent des charges de travail massives et garantissent une haute disponibilité sur une infrastructure mondiale. De même, la mise à l’échelle de Yugabyte signifie développer notre base de clients, améliorer l’engagement de la communauté et élargir notre écosystème – tout en maintenant l’excellence opérationnelle.
Tout cela nécessite une approche disciplinée de la performance et de l’efficacité.
Sur le plan technique, nous optimisons l’exécution des requêtes, réduisons la latence et améliorons le débit du système ; sur le plan organisationnel, nous rationalisons les processus, mettons à l’échelle les équipes et améliorons la collaboration interfonctionnelle. Dans les deux cas, le succès vient de l’autonomisation des équipes avec les bons outils, les bonnes informations et les bons processus pour prendre des décisions éclairées et fondées sur les données.
Comment voyez-vous l’évolution du rôle des bases de données SQL distribuées au cours des 5 à 10 prochaines années, en particulier dans le contexte de l’IA et de l’apprentissage automatique ?
Au cours des prochaines années, les bases de données SQL distribuées évolueront pour gérer des analyses de données complexes, permettant aux utilisateurs de faire des prédictions et de détecter des anomalies avec un minimum d’expertise technique. Il y a une spécialisation immense des bases de données dans le contexte de l’IA et de l’apprentissage automatique, mais cela n’est pas durable. Les bases de données devront évoluer pour répondre aux besoins de l’IA. C’est pourquoi nous itérons et améliorons les capacités sur pgvector, garantissant que les développeurs puissent utiliser Yugabyte pour leurs besoins de base de données IA.
En outre, nous pouvons nous attendre à un engagement continu en faveur de l’open source dans le développement de l’IA. Il y a cinq ans, nous avons rendu YugabyteDB entièrement open source sous licence Apache 2.0, renforçant notre détermination en faveur d’un cadre open source et en construisant proactivement notre communauté open source. Merci pour toutes vos réponses détaillées, les lecteurs qui souhaitent en savoir plus devraient visiter YugabyteDB.












