Rozhovory

Karthik Ranganathan, spoluzakladatel a spoluceo Yugabyte – rozhovor

mm
Přidejte Unite.AI mezi své preferované zdroje na Google

Karthik Ranganathan je spoluzakladatel a spoluceo Yugabyte, společnosti za YugabyteDB, open-source, high-performance distribuovaným PostgreSQL databází. Karthik je zkušený odborník na data a bývalý inženýr Facebooku, který založil Yugabyte spolu se dvěma svými kolegy z Facebooku, aby revolucionalizoval distribuované databáze.

Co vás inspirovalo k založení Yugabyte a jaké mezery na trhu jste viděli, které vás vedly k vytvoření YugabyteDB?

Mojí spoluzakladatelé, Kannan Muthukkaruppan, Mikhail Bautin a já, založili Yugabyte v roce 2016. Jako bývalí inženýři ve společnosti Meta (tehdy nazvané Facebook (META )), jsme pomáhali budovat populární databáze, včetně Apache Cassandra, HBase a RocksDB – a také jsme je provozovali jako spravované služby pro interní zatížení.

Vytvořili jsme YugabyteDB, protože jsme viděli mezeru na trhu pro cloud-native transakční databáze pro podnikové kritické aplikace. YugabyteDB jsme vytvořili, aby uspokojil potřeby organizací, které přecházejí z místních na cloud-native operace a kombinoval sílu nerelačních databází se škálovatelností a odolností cloud-native architektur. Zatímco jsme budovali Cassandra a HBase na Facebooku (což bylo důležité pro řešení rozsáhlých potřeb škálování Facebooku), jsme viděli růst mikroslužeb, kontejnerizace, vysoké dostupnosti, geografického rozložení a aplikací programovacích rozhraní (API). Také jsme uznali dopad, který mají open-source technologie na rozvoj odvětví.

Lidé často považují trh transakčních databází za přeplněný. Zatímco to tradičně platí, dnes se Postgres stal výchozím API pro cloud-native transakční databáze. Čím dál více cloud-native databází si vybírá podporu protokolu Postgres, který je hluboce zakořeněn v YugabyteDB, což z něj dělá nejvíce Postgres-kompatibilní databázi na trhu. YugabyteDB uchovává sílu a povědomí PostgreSQL, zatímco ho vyvíjí do podnikové třídy distribuované databáze vhodné pro moderní cloud-native aplikace. YugabyteDB umožňuje podnikům efektivně budovat a škálovat systémy pomocí známých SQL modelů.

Jak vaše zkušenosti na Facebooku ovlivnily váš pohled na společnost?

V roce 2007 jsem zvažoval, zda se připojit k malé, ale rostoucí společnosti – Facebooku. V té době měl web asi 30 až 40 milionů uživatelů. Domníval jsem se, že se možná zdvojnásobí, ale mýlil jsem se! Během mé více než pětileté práce na Facebooku se počet uživatelů zvýšil na 2 miliardy. To, co mě přitáhlo k této společnosti, byla kultura inovace a odvahy, která lidem umožňovala “rychle selhat”, aby katalyzovaly inovace.

Facebook rostl tak rychle, že technické a intelektuální výzvy, které jsem hledal, už nebyly přítomny. Po mnoho let jsem chtěl založit svou vlastní společnost a řešit problémy, kterým čelí běžní uživatelé – to mě vedlo ke spoluzaložení Yugabyte.

Naše mise je zjednodušit cloud-native aplikace, se zaměřením na tři základní funkce, které jsou nezbytné pro moderní vývoj:

  • První, aplikace musí být neustále dostupné, zajišťující dostupnost bez ohledu na zálohy nebo selhání, zejména při běhu na komoditním hardwaru v cloudu.
  • Druhé, schopnost škálovat na vyžádání je zásadní, umožňující vývojářům budovat a vydávat rychle bez zpoždění při objednávání hardwaru.
  • Třetí, s mnoha datovými centry, která jsou nyní snadno dostupná, replikace dat napříč regiony se stává vitální pro spolehlivost a výkon.

Tyto tři prvky umožňují vývojářům získat agilitu a svobodu, které potřebují k inovacím, bez omezení infrastrukturou.

Můžete sdílet cestu od založení Yugabyte v roce 2016 do jeho současného postavení jako lídra v distribuovaných SQL databázích? Jaké byly některé klíčové milníky?

Na Facebooku jsem často mluvil s vývojáři, kteří potřebovali konkrétní funkce, jako jsou sekundární indexy na SQL databázích nebo příležitostné multi-uzlové transakce. Bohužel, odpověď byla obvykle “ne”, protože stávající systémy nebyly navrženy pro tyto požadavky.

Dnes zažíváme posun směrem k cloud-native transakčním aplikacím, které musí řešit škálovatelnost a dostupnost. Tradiční databáze prostě nemohou tyto potřeby splnit. Moderní podniky vyžadují relační databáze, které fungují v cloudu a nabízejí tři základní funkce: vysokou dostupnost, škálovatelnost a geografické rozložení, zatímco stále podporují SQL funkce. Tyto jsou pilíři, na kterých jsme postavili YugabyteDB a databázové výzvy, kterým se snažíme řešit.

V únoru 2016 začali zakladatelé vyvíjet YugabyteDB, globálně škálovatelnou distribuovanou SQL databázi navrženou pro cloud-native transakční aplikace. V červenci 2019 jsme učinili bezprecedentní oznámení a uvolnili naše dříve komerční funkce jako open-source. To potvrdilo náš závazek k open-source principům a oficiálně spustilo YugabyteDB jako plně open-source relační databázový systém (RDBMS) pod licencí Apache 2.0.

Poslední verze YugabyteDB (představená v září) nabízí vylepšenou kompatibilitu s Postgres. Zahrnuje adaptivní Cost-Based Optimizer (CBO), který optimalizuje plány dotazů pro velké, multi-regionální aplikace, a Smart Data Distribution, která automaticky určuje, zda uložit tabulky společně pro nižší latenci, nebo je rozdělit a distribuovat pro větší škálovatelnost. Tyto vylepšení umožňují vývojářům spouštět své PostgreSQL aplikace na YugabyteDB efektivně a škálovat bez potřeby kompromisů nebo složitých migrací.

YugabyteDB je známý svou kompatibilitou s PostgreSQL a Cassandra-inspirovaným API. Jak tato multi-API přístup benefituje vývojářům a podnikům?

YugabyteDBův multi-API přístup benefituje vývojářům a podnikům kombinací sil high-performance SQL databáze s flexibilitou potřebnou pro globální, internetové aplikace.

Podporuje škálovatelné RDBMS a high-volume Online Transaction Processing (OLTP) zatížení, zatímco udržuje nízkou latenci dotazů a výjimečnou odolnost. Kompatibilita s PostgreSQL umožňuje bezproblémovou modernizaci stávajících Postgres aplikací, vyžadující minimální změny.

V poslední verzi distribuované databázové platformy, vydané v září 2024, funkce jako adaptivní CBO a Smart Data Distribution vylepšují výkon optimalizací plánů dotazů a automatickým řízením umístění dat. To umožňuje vývojářům dosáhnout nízké latence a vysoké škálovatelnosti bez kompromisů, dělající z YugabyteDB ideální volbu pro rychle rostoucí, cloud-native aplikace, které vyžadují spolehlivé řízení dat.

Umělá inteligence je stále více integrována do databázových systémů. Jak Yugabyte využívá umělou inteligenci ke zlepšení výkonu, škálovatelnosti a zabezpečení svých SQL systémů?

Vyvíjíme YugabyteDB, aby využil umělou inteligenci řešením problémů výkonu a migrace. Naší budoucí Performance Copilot, vylepšení našeho Performance Advisoru, zjednoduší odstraňování problémů analýzou vzorců dotazů, detekcí anomálií a poskytováním reálných doporučení pro odstraňování problémů s výkonem databáze.

Také integrujeme umělou inteligenci do YugabyteDB Voyager, našeho nástroje pro migraci databází, který zjednodušuje migrace z PostgreSQL, MySQL, Oracle (ORCL ) a dalších cloud databází do YugabyteDB. Naším cílem je streamovat přechody z legacy systémů automatizací konverze schémat, překladů SQL a transformací dat, s proaktivními kontrolami kompatibility. Tyto inovace se zaměřují na to, aby YugabyteDB byl chytřejší, efektivnější a snazší pro moderní, distribuované aplikace.

Jaké jsou hlavní výhody používání open-source SQL systému, jako je YugabyteDB, v cloud-native aplikacích ve srovnání s tradičními proprietárními databázemi?

Průhlednost, flexibilita a robustní komunitní podpora jsou hlavní výhody používání open-source SQL systému, jako je YugabyteDB, v cloud-native aplikacích. Když jsme spustili YugabyteDB, uznali jsme skepsi kolem open-source modelů. Angažovali jsme se s uživateli, kteří vyjádřili silnou preferenci pro plně otevřenou databázi, aby důvěřovali svými kritickými daty.

Původně jsme běželi na open-core modelu, ale rychle jsme si uvědomili, že potřebujeme kompletně otevřené řešení. Vývojáři stále častěji přecházejí k PostgreSQL jako logické alternativě k Oracle, ale PostgreSQL nebyl navržen pro dynamické cloudové platformy. YugabyteDB vyplňuje tuto mezeru podporou hloubky funkcí PostgreSQL pro moderní cloudové infrastruktury. Díky tomu, že je 100% open-source, odstraňujeme bariéry pro přijetí.

To nás činí velmi atraktivními pro vývojáře, kteří budují podnikové kritické aplikace, a pro inženýry, kteří je provozují na cloud-native platformách. Naším cílem je vytvořit databázi, která není pouze otevřená, ale také snadno použitelná a kompatibilní s PostgreSQL, která zůstává oblíbenou mezi vývojáři díky své zavedené sadě funkcí a silným rozšířením.

Jaké trendy pozorujete na trhu podnikových databází a jak je Yugabyte umístěn, aby splnil tyto požadavky?

Větší rozsah v podnikových databázích často vede ke zvýšeným selháním, zejména když se organizace potýkají s rozšířenými stopami a vyššími objemy dat. Klíčové trendy, které formují databázový krajinný pohled, zahrnují přijetí DBaaS a posun zpět z veřejného cloudu do privátních cloudových prostředí. Kromě toho integrace generativní AI přináší příležitosti a výzvy, vyžadující automatizaci a optimalizaci výkonu pro řízení rostoucího zatížení dat.

Organizace stále častěji přecházejí k DBaaS, aby streamovaly operace, navzdory počátečním obavám o kontrolu a zabezpečení. Tento přístup zlepšuje efektivitu napříč různými infrastrukturami, zatímco zaměření na privátní cloudová řešení pomáhá podnikům snižovat náklady a zlepšovat škálovatelnost pro své zatížení.

YugabyteDB řeší tyto měnící se požadavky kombinací sil relačních databází se škálovatelností cloud-native architektur. Funkce, jako je Smart Data Distribution a adaptivní CBO, vylepšují výkon a podporují velký počet databázových objektů. To činí z něj konkurenceschopnou volbu pro běh širokého spektra aplikací.

Kromě toho YugabyteDB umožňuje podnikům migrovat své PostgreSQL aplikace, zatímco udržuje podobné úrovně výkonu, což je zásadní pro moderní zatížení. Naše závazky k open-source vývoji podporují komunitní zapojení a poskytují flexibilitu zákazníkům, kteří chtějí vyhnout se uzamčení dodavatele.

Jak YugabyteDB řeší výzvy, které představuje růst edge computingu a IoT, zejména pokud jde o distribuci dat a latenci?

YugabyteDBova distribuovaná SQL architektura je navržena tak, aby řešila výzvy, které představuje růst edge computingu a IoT, poskytováním škálovatelné a odolné datové vrstvy, která může fungovat bezproblémově v cloudu i na hranici. Jeho schopnost automaticky rozdělit a replikovat data zajišťuje efektivní distribuci, umožňující rychlý přístup a zpracování v reálném čase. To minimalizuje latenci, umožňující aplikacím reagovat rychle na uživatelské interakce a změny dat.

Příležitostně nabízí YugabyteDB flexibilitu přizpůsobit konfigurace na základě specifických požadavků aplikací, zajišťuje, že podniky mohou efektivně řídit své potřeby dat, jak se vyvíjejí v stále více decentralizovaném prostředí.

Jako spoluceo, jak vyvažujete duální role vedení technologických inovací a řízení růstu společnosti?

Naše společnost se snaží zjednodušit cloud-native aplikace, což mě nutí zůstat v obraze technologických trendů, jako je generativní AI a kontextové přepínače. Následování inovací vyžaduje zvědavost, touhu mít dopad a závazek k nepřetržitému učení.

Vyvažování technologických inovací a růstu společnosti je zásadně o škálování – ať už jde o škálování systémů nebo škálování dopadu. V distribuovaných databázích se zaměřujeme na budování technologií, které škálovat výkon, zpracovávají巨ské zatížení a zajišťují vysokou dostupnost napříč globální infrastrukturou. Podobně škálování Yugabyte znamená růst naší zákaznické základny, zlepšování komunitního zapojení a rozšiřování našeho ekosystému – zatímco zachování provozní excelence.

Všechno to vyžaduje disciplinovaný přístup k výkonu a efektivitě.

Technicky optimalizujeme provádění dotazů, snižujeme latenci a zlepšujeme systémový průtok; organizačně streamlinujeme procesy, škálovat týmy a zlepšujeme mezioborovou spolupráci. V obou případech úspěch přichází z empowermentu týmů správnými nástroji, informacemi a procesy, aby mohli činit chytrá, datem řízená rozhodnutí.

Jak vidíte roli distribuovaných SQL databází se vyvíjející v příštích 5-10 letech, zejména v kontextu AI a strojového učení?

V příštích několika letech se distribuované SQL databáze vyvinou, aby zvládly komplexní analýzu dat, umožňující uživatelům dělat předpovědi a detekovat anomálie s minimální technickou odborností. Existuje enormní množství specializace databází v kontextu AI a strojového učení, ale to není udržitelné. Databáze budou muset evolvovat, aby splnily požadavky AI. Proto iterujeme a vylepšujeme schopnosti na základě pgvector, zajišťujeme, aby vývojáři mohli používat Yugabyte pro své potřeby AI databází.

Kromě toho můžeme očekávat pokračující závazek k open-source ve vývoji AI. Před pěti lety jsme učinili YugabyteDB plně open-source pod licencí Apache 2.0, potvrzujícím náš závazek k open-source rámci a proaktivně budujícím naši open-source komunitu.

Děkuji vám za všechny vaše podrobné odpovědi, čtenáři, kteří chtějí se dozvědět více, by měli navštívit YugabyteDB.

Antoine je vizionářský líder a spoluzakladatel Unite.AI, který je poháněn neotřesitelnou vášní pro formování a propagaci budoucnosti umělé inteligence a robotiky. Jako sériový podnikatel věří, že umělá inteligence bude mít na společnost stejně disruptivní vliv jako elektřina, a často se chvála na potenciál disruptivních technologií a AGI.