访谈

卡西克·兰加纳坦,Yugabyte联合创始人兼联合首席执行官 – 采访系列

mm
将 Unite.AI 添加到您在 Google 上的首选来源

卡西克·兰加纳坦 是Yugabyte的联合创始人兼联合首席执行官,Yugabyte是开源、高性能分布式 PostgreSQL 数据库YugabyteDB的公司。卡西克是一位经验丰富的数据专家和前Facebook工程师,他与两位Facebook同事一起创立了Yugabyte,以革新分布式数据库。

是什么启发你联合创立Yugabyte,并且你在市场中看到什么空白导致你创造了YugabyteDB?

我的联合创始人Kannan Muthukkaruppan、Mikhail Bautin和我于2016年创立了Yugabyte。在Facebook担任工程师期间,我们帮助构建了流行的数据库,包括Apache Cassandra、HBase和RocksDB,以及作为内部工作负载的托管服务运行其中一些数据库。

我们创建了 YugabyteDB,因为我们看到了市场上对云原生事务数据库的空白,这些数据库适用于业务关键应用。我们构建了YugabyteDB,以满足从本地到云原生运营的组织的需求,并将非关系数据库的优势与云原生架构的可扩展性和弹性相结合。在Facebook(这对于解决Facebook的重大扩展需求至关重要)构建Cassandra和HBase时,我们看到了微服务、容器化、高可用性、地理分布和应用程序接口(API)的崛起。我们还认识到开源技术在推进行业发展方面的影响。

人们经常认为事务数据库市场已经饱和。虽然传统上这是真的,但今天Postgres已经成为云原生事务数据库的默认API。越来越多的云原生数据库选择支持Postgres协议,这已经成为YugabyteDB的基础,使其成为市场上最兼容Postgres的数据库。YugabyteDB保留了PostgreSQL的强大功能和熟悉度,同时将其演变为适合现代云原生应用的企业级分布式数据库。YugabyteDB允许企业使用熟悉的SQL模型高效地构建和扩展系统。

你在Facebook的经历如何影响了你对公司的愿景?

2007年,我正在考虑是否加入一家小但正在增长的公司——Facebook (META ) 。当时,该网站有大约3000万到4000万用户。我认为它可能会翻倍,但我错了!在我超过五年的Facebook工作期间,用户群增长到了20亿。吸引我加入这家公司的是其创新和大胆的文化,鼓励人们“快速失败”以催生创新。

Facebook变得如此庞大,以至于我渴望的技术和知识挑战不再存在。多年来,我一直想创办自己的公司,解决普通用户面临的问题——这导致我联合创立了Yugabyte。

我们的使命是简化云原生应用,重点关注三个对现代开发至关重要的功能:

  • 首先,应用程序必须始终可用,确保在备份或故障的情况下保持正常运行,特别是在云中使用商品硬件时。
  • 第二,按需扩展的能力至关重要,允许开发人员快速构建和发布,而无需等待硬件交付的延迟。
  • 第三,随着众多数据中心变得容易访问,跨区域复制数据对于可靠性和性能至关重要。

这些三个元素赋予开发人员敏捷性和自由,使他们能够创新,而不会受到基础设施限制的约束。

可以分享一下Yugabyte从2016年成立到现在成为分布式SQL数据库领导者的旅程吗?有什么重要的里程碑?

在Facebook,我经常与需要特定功能的开发人员交谈,例如SQL数据库上的二级索引或偶尔的多节点事务。不幸的是,答案通常是“不”,因为现有的系统不适合这些要求。

今天,我们正在经历一个向云原生事务应用的转变,这些应用需要解决可扩展性和可用性问题。传统数据库无法满足这些需求。现代企业需要在云中运行的关系数据库,它们提供三个基本功能:高可用性、可扩展性和地理分布,同时仍然支持SQL功能。这些是我们构建YugabyteDB和关注解决的数据库挑战的基础。

2016年2月,创始人开始开发YugabyteDB,这是一个面向云原生事务应用的全球范围的分布式SQL数据库。2019年7月,我们做出了前所未有的宣布,并将以前的商业功能作为开源发布。这重新肯定了我们对开源原则的承诺,并正式将YugabyteDB推出为完全开源的关系数据库管理系统(RDBMS),在Apache 2.0许可下。

最新版本的YugabyteDB(于9月份推出)具有增强的Postgres兼容性。它包括一个自适应基于成本的优化器(CBO),该优化器优化了大规模、多区域应用的查询计划,并且具有智能数据分布,可以自动确定是否将表存储在一起以降低延迟,或者将数据分片和分布以获得更大的可扩展性。这些增强功能使开发人员能够高效地在YugabyteDB上运行其PostgreSQL应用,并且无需进行折衷或复杂的迁移即可扩展。

YugabyteDB以其与PostgreSQL的兼容性和受Cassandra启发的API而闻名。这种多API方法如何使开发人员和企业受益?

YugabyteDB的多API方法使开发人员和企业受益,因为它结合了高性能SQL数据库的优势和全球、互联网规模应用所需的灵活性。

它支持扩展的RDBMS和高容量的在线事务处理(OLTP)工作负载,同时保持低查询延迟和异常的恢复能力。与PostgreSQL的兼容性允许现有的Postgres应用无缝升级,需要最少的更改。

在最新版本的分布式数据库平台中,于2024年9月发布,具有自适应CBO和智能数据分布等功能,通过优化查询计划和自动管理数据放置来增强性能。这使开发人员能够在不妥协的情况下实现低延迟和高可扩展性,使YugabyteDB成为快速增长的云原生应用的理想选择,这些应用需要可靠的数据管理。

人工智能越来越多地被集成到数据库系统中。Yugabyte如何利用人工智能来增强其SQL系统的性能、可扩展性和安全性?

我们正在利用人工智能来增强我们的分布式SQL数据库,解决性能和迁移挑战。我们的即将推出的性能协同处理器(Performance Copilot)是性能顾问(Performance Advisor)的增强版,它将通过分析查询模式、检测异常并提供实时建议来简化故障排除数据库性能问题。

我们还将人工智能集成到 YugabyteDB Voyager 中,这是一个数据库迁移工具,简化了从PostgreSQL、MySQL、Oracle (ORCL ) 和其他云数据库到YugabyteDB的迁移。我们旨在通过自动化模式转换、SQL转换和数据转换,并进行主动兼容性检查来简化从传统系统的过渡。这些创新专注于使YugabyteDB更智能、更高效、更容易被现代分布式应用使用。

使用像YugabyteDB这样的开源SQL系统与传统的专有数据库相比,在云原生应用中有什么主要优势?

使用像YugabyteDB这样的开源SQL系统的主要优势是透明度、灵活性和强大的社区支持。当我们推出YugabyteDB时,我们认识到人们对开源模式的怀疑。我们与用户互动,他们表达了对完全开源数据库的强烈偏好,以便将他们的关键数据托管其中。

我们最初使用开源核心模型,但很快意识到需要一个完全开源的解决方案。开发人员越来越多地转向PostgreSQL作为Oracle的替代品,但PostgreSQL并不是为动态云平台设计的。YugabyteDB填补了这一空白,通过支持PostgreSQL的功能深度来满足现代云基础设施的需求。通过成为100%开源,我们消除了采用障碍。

这使我们对开发人员和运营工程师具有吸引力,他们正在构建和在云原生平台上运行业务关键应用。我们的重点是创建一个不仅开源而且易于使用且与PostgreSQL兼容的数据库,PostgreSQL仍然是开发人员的最爱,因为其成熟的功能集和强大的扩展。

可扩展和适应性强的SQL解决方案的需求正在增长。你在企业数据库市场中观察到什么趋势,Yugabyte如何满足这些需求?

企业数据库中更大的规模通常会导致故障率增加,特别是当组织处理更大的足迹和更高的数据量时。影响数据库格局的关键趋势包括DBaaS的采用以及从公有云到私有云环境的转变。此外,生成性人工智能的集成带来了机会和挑战,需要自动化和性能优化来管理不断增长的数据负载。

组织越来越多地转向DBaaS,以简化运营,尽管最初对控制和安全有所担忧。这种方法可以提高跨不同基础设施的效率,同时专注于私有云解决方案可以帮助企业降低成本并增强其工作负载的可扩展性。

YugabyteDB通过将关系数据库的优势与云原生架构的可扩展性相结合来满足这些不断演变的需求。像智能数据分布和自适应CBO这样的功能增强了性能,并支持大量数据库对象。这使得YugabyteDB成为运行广泛应用的有力选择。

此外,YugabyteDB允许企业迁移其PostgreSQL应用,同时保持类似的性能水平,对于现代工作负载至关重要。我们致力于开源开发,鼓励社区参与,并为希望避免供应商锁定的客户提供灵活性。

随着边缘计算和物联网的兴起,YugabyteDB如何解决这些技术带来的挑战,特别是数据分布和延迟问题?

YugabyteDB的分布式SQL架构旨在通过提供可扩展和弹性的数据层来满足边缘计算和物联网带来的挑战,这个数据层可以在云和边缘环境中无缝运行。其自动分片和复制数据的能力确保了高效的数据分布,实现了快速访问和实时处理。这样可以最小化延迟,使应用能够快速响应用户交互和数据更改。

通过提供根据特定应用需求调整配置的灵活性,YugabyteDB确保企业能够有效地管理其数据需求,因为它们在日益去中心化的环境中不断演变。

作为联合首席执行官,你如何平衡技术创新和公司增长的双重角色?

我们的公司致力于简化云原生应用,这使我不得不紧跟技术趋势,例如生成性人工智能和上下文切换。追求创新需要好奇心、渴望产生影响力以及持续学习的承诺。

平衡技术创新和公司增长基本上是关于扩展——无论是扩展系统还是扩展影响力。在分布式数据库中,我们专注于构建能够扩展性能、处理大量工作负载并在全球基础设施上实现高可用的技术。同样,扩展Yugabyte意味着增长我们的客户群、增强社区参与和扩展我们的生态系统,同时保持运营卓越性。

所有这些都需要对性能和效率采取有纪律的方法。

从技术上讲,我们优化查询执行、减少延迟和提高系统吞吐量;在组织方面,我们简化流程、扩展团队并增强跨职能协作。在这两种情况下,成功来自于赋予团队正确的工具、洞察力和流程,使他们能够做出明智的、数据驱动的决策。

你如何看待分布式SQL数据库在未来5-10年内的演变,特别是在人工智能和机器学习的背景下?

在接下来的几年里,分布式SQL数据库将演变以处理复杂的数据分析,使用户能够在没有大量技术专业知识的情况下进行预测和检测异常。人工智能和机器学习的背景下存在大量的数据库专业化,但这种情况是不可持续的。数据库需要演变以满足人工智能的需求。这就是为什么我们正在迭代和增强pgvector的功能,确保开发人员可以将Yugabyte用于其人工智能数据库需求。

此外,我们可以期待人工智能开发中持续致力于开源。五年前,我们将YugabyteDB作为开源发布,采用Apache 2.0许可证,强调了我们对开源框架的承诺,并积极地建立我们的开源社区。感谢所有的详细回复,希望了解更多的读者可以访问YugabyteDB。

安托万是一位具有远见的领导者和Unite.AI的联合创始人,他对塑造和推广人工智能和机器人技术的未来充满热情。作为一位连续创业者,他相信人工智能将对社会产生电力的影响一样的颠覆性影响,并经常对颠覆性技术和通用人工智能的潜力大加赞扬。

作为一位未来学家Securities.io的创始人,这是一个专注于投资尖端技术的平台,这些技术正在重新定义未来并重塑整个行业。