Phỏng vấn
Karthik Ranganathan, Đồng sáng lập và Đồng CEO của Yugabyte – Loạt phỏng vấn

Karthik Ranganathan là đồng sáng lập và đồng CEO của Yugabyte, công ty đứng sau YugabyteDB, cơ sở dữ liệu phân tán PostgreSQL mã nguồn mở, hiệu suất cao. Karthik là một chuyên gia dữ liệu có kinh nghiệm và là cựu kỹ sư của Facebook (META ), người đã đồng sáng lập Yugabyte cùng với hai đồng nghiệp của mình tại Facebook để cách mạng hóa cơ sở dữ liệu phân tán.
Điều gì đã truyền cảm hứng cho bạn để đồng sáng lập Yugabyte, và những khoảng trống trên thị trường mà bạn đã thấy dẫn đến việc tạo ra YugabyteDB?
Người đồng sáng lập của tôi, Kannan Muthukkaruppan, Mikhail Bautin và tôi, đã thành lập Yugabyte vào năm 2016. Là cựu kỹ sư tại Meta (trước đây gọi là Facebook), chúng tôi đã giúp xây dựng các cơ sở dữ liệu phổ biến như Apache Cassandra, HBase và RocksDB – cũng như chạy một số cơ sở dữ liệu này như dịch vụ quản lý cho các khối lượng công việc nội bộ.
Chúng tôi đã tạo ra YugabyteDB vì chúng tôi đã nhận thấy một khoảng trống trên thị trường về cơ sở dữ liệu giao dịch đám mây bản địa cho các ứng dụng quan trọng của doanh nghiệp. Chúng tôi đã xây dựng YugabyteDB để đáp ứng nhu cầu của các tổ chức chuyển đổi từ trên cơ sở đến các hoạt động bản địa đám mây và kết hợp các điểm mạnh của cơ sở dữ liệu không quan hệ với khả năng mở rộng và độ bền của kiến trúc bản địa đám mây. Trong khi xây dựng Cassandra và HBase tại Facebook (điều này rất quan trọng trong việc giải quyết các nhu cầu mở rộng đáng kể của Facebook), chúng tôi đã thấy sự gia tăng của các dịch vụ vi mô, container hóa, khả năng cao, phân phối địa lý và Giao diện lập trình ứng dụng (API). Chúng tôi cũng nhận ra tác động của công nghệ mã nguồn mở trong việc thúc đẩy ngành công nghiệp.
Người ta thường nghĩ rằng thị trường cơ sở dữ liệu giao dịch rất đông đúc. Mặc dù điều này đã đúng trong truyền thống, nhưng ngày nay, Postgres đã trở thành giao diện API mặc định cho các cơ sở dữ liệu giao dịch bản địa đám mây. Ngày càng nhiều, các cơ sở dữ liệu bản địa đám mây đang chọn hỗ trợ giao thức Postgres, điều này đã được tích hợp vào cấu trúc của YugabyteDB, khiến nó trở thành cơ sở dữ liệu tương thích Postgres nhất trên thị trường. YugabyteDB giữ lại sức mạnh và sự quen thuộc của PostgreSQL trong khi phát triển nó thành một cơ sở dữ liệu phân tán cấp doanh nghiệp phù hợp cho các ứng dụng bản địa đám mây hiện đại. YugabyteDB cho phép các doanh nghiệp xây dựng và mở rộng hệ thống một cách hiệu quả bằng cách sử dụng các mô hình SQL quen thuộc.
Làm thế nào kinh nghiệm của bạn tại Facebook ảnh hưởng đến tầm nhìn của bạn cho công ty?
Vào năm 2007, tôi đã xem xét việc tham gia một công ty nhỏ nhưng đang phát triển – Facebook. Tại thời điểm đó, trang web có khoảng 30 đến 40 triệu người dùng. Tôi nghĩ nó có thể tăng gấp đôi về kích thước, nhưng tôi không thể lầm hơn! Trong hơn năm năm tại Facebook, cơ sở người dùng đã tăng lên 2 tỷ. Điều吸引 tôi đến công ty là văn hóa đổi mới và táo bạo, khuyến khích mọi người “thất bại nhanh” để kích thích đổi mới.
Facebook đã phát triển đến mức lớn mà các thách thức kỹ thuật và trí tuệ mà tôi khao khát không còn hiện diện nữa. Trong nhiều năm, tôi đã khát khao thành lập công ty của riêng mình và giải quyết các vấn đề mà người dùng phổ thông phải đối mặt – điều này đã dẫn tôi đến việc đồng sáng lập Yugabyte.
Sứ mệnh của chúng tôi là đơn giản hóa các ứng dụng bản địa đám mây, tập trung vào ba tính năng thiết yếu quan trọng cho phát triển hiện đại:
- Trước hết, các ứng dụng phải luôn khả dụng, đảm bảo thời gian hoạt động bất kể việc sao lưu hoặc thất bại, đặc biệt là khi chạy trên phần cứng hàng hóa trong đám mây.
- Thứ hai, khả năng mở rộng theo nhu cầu là rất quan trọng, cho phép các nhà phát triển xây dựng và phát hành nhanh chóng mà không bị chậm trễ khi đặt hàng phần cứng.
- Thứ ba, với nhiều trung tâm dữ liệu dễ dàng tiếp cận, việc sao chép dữ liệu trên các khu vực trở nên quan trọng cho độ tin cậy và hiệu suất.
Ba yếu tố này trao quyền cho các nhà phát triển bằng cách cung cấp sự linh hoạt và tự do mà họ cần để đổi mới, mà không bị hạn chế bởi các hạn chế về cơ sở hạ tầng.
Có thể bạn chia sẻ hành trình từ khi thành lập Yugabyte vào năm 2016 đến vị trí hiện tại của công ty là một trong những công ty hàng đầu về cơ sở dữ liệu SQL phân tán? Những cột mốc quan trọng nào?
Tại Facebook, tôi thường nói chuyện với các nhà phát triển cần các tính năng cụ thể, như chỉ mục phụ trên cơ sở dữ liệu SQL hoặc giao dịch đa nút偶尔. Thật không may, câu trả lời thường là “không”, vì các hệ thống hiện có không được thiết kế cho các yêu cầu đó.
Ngày nay, chúng tôi đang trải qua một sự thay đổi hướng tới các ứng dụng giao dịch bản địa đám mây cần giải quyết các vấn đề về quy mô và khả năng sẵn sàng. Các cơ sở dữ liệu truyền thống đơn giản không thể đáp ứng các nhu cầu này. Các doanh nghiệp hiện đại yêu cầu cơ sở dữ liệu quan hệ hoạt động trong đám mây và cung cấp ba tính năng thiết yếu: khả năng sẵn sàng cao, khả năng mở rộng và phân phối địa lý, đồng thời hỗ trợ các khả năng SQL. Đây là những cột mốc mà chúng tôi đã xây dựng YugabyteDB và các thách thức cơ sở dữ liệu mà chúng tôi đang tập trung giải quyết.
Vào tháng 2 năm 2016, các sáng lập viên đã bắt đầu phát triển YugabyteDB, một cơ sở dữ liệu SQL phân tán cấp toàn cầu được thiết kế cho các ứng dụng giao dịch bản địa đám mây. Vào tháng 7 năm 2019, chúng tôi đã đưa ra một thông báo chưa từng có và phát hành các tính năng thương mại trước đây của chúng tôi dưới dạng mã nguồn mở. Điều này đã củng cố cam kết của chúng tôi với các nguyên tắc mã nguồn mở và chính thức ra mắt YugabyteDB như một hệ thống quản lý cơ sở dữ liệu quan hệ (RDBMS) mã nguồn mở hoàn toàn dưới giấy phép Apache 2.0.
Phiên bản mới nhất của YugabyteDB (được công bố vào tháng 9) có tính tương thích Postgres được cải tiến. Nó bao gồm một Bộ tối ưu hóa chi phí thích ứng (CBO) tối ưu hóa kế hoạch truy vấn cho các ứng dụng đa vùng và Phân phối dữ liệu thông minh tự động xác định liệu có nên lưu trữ các bảng cùng nhau để giảm độ trễ hay phân mảnh và phân phối dữ liệu để tăng khả năng mở rộng. Những cải tiến này cho phép các nhà phát triển chạy các ứng dụng PostgreSQL của họ trên YugabyteDB một cách hiệu quả và mở rộng mà không cần phải đánh đổi hoặc di chuyển phức tạp.
YugabyteDB được biết đến với khả năng tương thích với PostgreSQL và API lấy cảm hứng từ Cassandra. Làm thế nào cách tiếp cận đa API này mang lại lợi ích cho các nhà phát triển và doanh nghiệp?
Cách tiếp cận đa API của YugabyteDB mang lại lợi ích cho các nhà phát triển và doanh nghiệp bằng cách kết hợp các điểm mạnh của cơ sở dữ liệu SQL hiệu suất cao với sự linh hoạt cần thiết cho các ứng dụng internet quy mô toàn cầu.
Nó hỗ trợ cơ sở dữ liệu RDBMS phân tán và khối lượng công việc OLTP (Xử lý giao dịch trực tuyến) lớn, đồng thời duy trì độ trễ truy vấn thấp và độ bền vượt trội. Tương thích với PostgreSQL cho phép hiện đại hóa liền mạch các ứng dụng Postgres hiện có, chỉ cần thay đổi tối thiểu.
Trong phiên bản mới nhất của nền tảng cơ sở dữ liệu phân tán, được phát hành vào tháng 9 năm 2024, các tính năng như CBO thích ứng và Phân phối dữ liệu thông minh cải thiện hiệu suất bằng cách tối ưu hóa kế hoạch truy vấn và tự động quản lý vị trí dữ liệu. Điều này cho phép các nhà phát triển đạt được độ trễ thấp và khả năng mở rộng cao mà không cần phải đánh đổi, khiến YugabyteDB trở thành lựa chọn lý tưởng cho các ứng dụng bản địa đám mây đang phát triển nhanh chóng, đòi hỏi quản lý dữ liệu đáng tin cậy.
Trí tuệ nhân tạo đang ngày càng được tích hợp vào các hệ thống cơ sở dữ liệu. Yugabyte đang tận dụng trí tuệ nhân tạo như thế nào để cải thiện hiệu suất, khả năng mở rộng và bảo mật của các hệ thống SQL của mình?
Chúng tôi đang tận dụng trí tuệ nhân tạo để cải thiện cơ sở dữ liệu SQL phân tán của mình bằng cách giải quyết các thách thức về hiệu suất và di chuyển. Người đồng hành hiệu suất sắp tới của chúng tôi, một tính năng nâng cao của Người tư vấn hiệu suất của chúng tôi, sẽ đơn giản hóa việc khắc phục sự cố bằng cách phân tích mẫu truy vấn, phát hiện các sự bất thường và cung cấp các khuyến nghị theo thời gian thực để khắc phục các vấn đề về hiệu suất của cơ sở dữ liệu.
Chúng tôi cũng đang tích hợp trí tuệ nhân tạo vào YugabyteDB Voyager, công cụ di chuyển cơ sở dữ liệu của chúng tôi giúp đơn giản hóa việc di chuyển từ PostgreSQL, MySQL, Oracle (ORCL ) và các cơ sở dữ liệu đám mây khác sang YugabyteDB. Chúng tôi nhằm mục đích tự động hóa các chuyển đổi từ các hệ thống cũ bằng cách tự động chuyển đổi lược đồ, dịch SQL và biến đổi dữ liệu, cùng với các kiểm tra tương thích chủ động. Những đổi mới này tập trung vào việc khiến YugabyteDB trở nên thông minh hơn, hiệu quả hơn và dễ sử dụng hơn cho các ứng dụng phân tán hiện đại.
Những lợi thế chính của việc sử dụng hệ thống SQL mã nguồn mở như YugabyteDB trong các ứng dụng bản địa đám mây so với các cơ sở dữ liệu độc quyền truyền thống là gì?
Minh bạch, linh hoạt và hỗ trợ cộng đồng mạnh mẽ là những lợi thế chính khi sử dụng hệ thống SQL mã nguồn mở như YugabyteDB trong các ứng dụng bản địa đám mây. Khi chúng tôi ra mắt YugabyteDB, chúng tôi đã nhận ra sự hoài nghi xung quanh các mô hình mã nguồn mở. Chúng tôi đã tham gia với người dùng, những người đã thể hiện sự ưa thích mạnh mẽ đối với một cơ sở dữ liệu hoàn toàn mở để tin cậy với dữ liệu quan trọng của họ.
Chúng tôi ban đầu chạy trên một mô hình lõi mở, nhưng nhanh chóng nhận ra rằng nó cần phải là một giải pháp hoàn toàn mở. Các nhà phát triển ngày càng chuyển sang PostgreSQL như một giải pháp thay thế logic cho Oracle, nhưng PostgreSQL không được xây dựng cho các nền tảng đám mây động. YugabyteDB lấp đầy khoảng trống này bằng cách hỗ trợ độ sâu tính năng của PostgreSQL cho các cơ sở hạ tầng đám mây hiện đại. Bằng cách là 100% mã nguồn mở, chúng tôi loại bỏ các rào cản đối với việc áp dụng.
Điều này làm cho chúng tôi rất hấp dẫn đối với các nhà phát triển xây dựng các ứng dụng quan trọng của doanh nghiệp và đối với các kỹ sư vận hành đang chạy chúng trên các nền tảng bản địa đám mây. Mục tiêu của chúng tôi là tạo ra một cơ sở dữ liệu không chỉ mở mà còn dễ sử dụng và tương thích với PostgreSQL, vẫn là lựa chọn yêu thích của nhà phát triển do bộ tính năng trưởng thành và các tiện ích mở rộng mạnh mẽ của nó.
Nhu cầu về các giải pháp SQL có thể mở rộng và thích ứng đang tăng. Bạn quan sát thấy những xu hướng nào trong thị trường cơ sở dữ liệu doanh nghiệp và Yugabyte được định vị như thế nào để đáp ứng những nhu cầu này?
Quy mô lớn hơn trong các cơ sở dữ liệu doanh nghiệp thường dẫn đến tăng tỷ lệ thất bại, đặc biệt là khi các tổ chức phải đối mặt với các dấu chân mở rộng và khối lượng dữ liệu lớn hơn. Các xu hướng chính định hình cảnh quan cơ sở dữ liệu bao gồm việc áp dụng DBaaS và sự chuyển dịch từ đám mây công cộng sang các môi trường đám mây riêng. Ngoài ra, việc tích hợp trí tuệ nhân tạo tạo ra cả cơ hội và thách thức, đòi hỏi phải tự động hóa và tối ưu hóa hiệu suất để quản lý khối lượng dữ liệu ngày càng tăng.
Các tổ chức đang ngày càng chuyển sang DBaaS để tối ưu hóa hoạt động, mặc dù ban đầu có những lo ngại về kiểm soát và bảo mật. Cách tiếp cận này cải thiện hiệu quả trên các cơ sở hạ tầng khác nhau, trong khi tập trung vào các giải pháp đám mây riêng giúp các doanh nghiệp giảm chi phí và tăng khả năng mở rộng cho các khối lượng công việc của họ.
YugabyteDB giải quyết những nhu cầu đang phát triển này bằng cách kết hợp các điểm mạnh của cơ sở dữ liệu quan hệ với khả năng mở rộng của kiến trúc bản địa đám mây. Các tính năng như Phân phối dữ liệu thông minh và CBO thích ứng cải thiện hiệu suất và hỗ trợ một số lượng lớn các đối tượng cơ sở dữ liệu. Điều này làm cho nó trở thành một lựa chọn cạnh tranh để chạy một loạt các ứng dụng.
Ngoài ra, YugabyteDB cho phép các doanh nghiệp di chuyển các ứng dụng PostgreSQL của họ trong khi duy trì các mức hiệu suất tương tự, điều quan trọng cho các khối lượng công việc hiện đại. Cam kết của chúng tôi đối với phát triển mã nguồn mở khuyến khích sự tham gia của cộng đồng và cung cấp sự linh hoạt cho khách hàng muốn tránh bị khóa bởi nhà cung cấp.
Với sự gia tăng của tính toán biên và IoT, YugabyteDB giải quyết những thách thức do các công nghệ này đặt ra như thế nào, đặc biệt là về phân phối và độ trễ của dữ liệu?
Cơ sở dữ liệu SQL phân tán của YugabyteDB được thiết kế để đáp ứng những thách thức do sự gia tăng của tính toán biên và IoT bằng cách cung cấp một lớp dữ liệu có thể mở rộng và độ bền có thể hoạt động liền mạch trong cả bối cảnh đám mây và biên. Khả năng tự động phân mảnh và sao chép dữ liệu đảm bảo phân phối hiệu quả, cho phép truy cập nhanh chóng và xử lý thời gian thực. Điều này giảm thiểu độ trễ, cho phép các ứng dụng phản hồi nhanh chóng với các tương tác của người dùng và thay đổi dữ liệu.
Bằng cách cung cấp sự linh hoạt để điều chỉnh cấu hình dựa trên các yêu cầu ứng dụng cụ thể, YugabyteDB đảm bảo rằng các doanh nghiệp có thể quản lý hiệu quả nhu cầu dữ liệu của mình khi chúng phát triển trong một môi trường ngày càng phi tập trung.
Là Đồng CEO, bạn cân bằng vai trò lãnh đạo đổi mới công nghệ và quản lý sự phát triển của công ty như thế nào?
Công ty của chúng tôi nhằm mục đích đơn giản hóa các ứng dụng bản địa đám mây, điều này đòi hỏi tôi phải theo sát các xu hướng công nghệ, chẳng hạn như trí tuệ nhân tạo tạo ra và chuyển đổi ngữ cảnh. Việc theo đuổi đổi mới đòi hỏi sự tò mò, mong muốn tạo ra tác động và cam kết học hỏi liên tục.
Sự cân bằng giữa đổi mới công nghệ và sự phát triển của công ty về cơ bản là về khả năng mở rộng – cho dù đó là mở rộng hệ thống hay mở rộng tác động. Trong các cơ sở dữ liệu phân tán, chúng tôi tập trung vào việc xây dựng các công nghệ có thể mở rộng hiệu suất, xử lý khối lượng công việc lớn và đảm bảo khả năng sẵn sàng cao trên cơ sở hạ tầng toàn cầu. Tương tự, việc mở rộng Yugabyte có nghĩa là mở rộng cơ sở khách hàng của chúng tôi, tăng cường sự tham gia của cộng đồng và mở rộng hệ sinh thái của chúng tôi – đồng thời duy trì sự xuất sắc về hoạt động.
Tất cả điều này đòi hỏi một cách tiếp cận kỷ luật đối với hiệu suất và hiệu quả.
Về mặt kỹ thuật, chúng tôi tối ưu hóa việc thực hiện truy vấn, giảm độ trễ và cải thiện thông lượng hệ thống; về mặt tổ chức, chúng tôi tối ưu hóa quy trình, mở rộng đội ngũ và tăng cường hợp tác liên chức năng. Trong cả hai trường hợp, thành công đến từ việc trao quyền cho các đội với các công cụ, thông tin và quy trình phù hợp để đưa ra các quyết định thông minh và dựa trên dữ liệu.
Bạn nhìn thấy vai trò của các cơ sở dữ liệu SQL phân tán sẽ phát triển như thế nào trong 5-10 năm tới, đặc biệt là trong bối cảnh trí tuệ nhân tạo và học máy?
Trong vài năm tới, các cơ sở dữ liệu SQL phân tán sẽ phát triển để xử lý các phân tích dữ liệu phức tạp, cho phép người dùng dự đoán và phát hiện các sự bất thường với chuyên môn kỹ thuật tối thiểu. Có một lượng chuyên môn hóa cơ sở dữ liệu đáng kể trong bối cảnh trí tuệ nhân tạo và học máy, nhưng điều đó không bền vững. Các cơ sở dữ liệu sẽ cần phải phát triển để đáp ứng nhu cầu của trí tuệ nhân tạo. Đó là lý do tại sao chúng tôi đang lặp lại và nâng cao các khả năng trên pgvector, đảm bảo rằng các nhà phát triển có thể sử dụng Yugabyte cho nhu cầu cơ sở dữ liệu trí tuệ nhân tạo của họ.
Ngoài ra, chúng ta có thể mong đợi một cam kết liên tục đối với mã nguồn mở trong phát triển trí tuệ nhân tạo. Năm năm trước, chúng tôi đã làm cho YugabyteDB trở thành mã nguồn mở hoàn toàn dưới giấy phép Apache 2.0, củng cố cam kết của chúng tôi với khuôn khổ mã nguồn mở và xây dựng chủ động cộng đồng mã nguồn mở của chúng tôi.
Cảm ơn bạn vì những phản hồi chi tiết của bạn, những người đọc muốn tìm hiểu thêm có thể truy cập YugabyteDB.












