Gọi vốn

LiveKit Đạt Giá Trị 1 Tỷ Đô La Khi Cơ Sở Hạ Tầng Trí Tuệ Giọng Nói Đang Phát Triển

mm
Thêm Unite.AI vào các nguồn ưu tiên của bạn trên Google

LiveKit đã huy động được 100 triệu đô la trong vòng Series C, định giá công ty cơ sở hạ tầng trí tuệ giọng nói này ở mức 1 tỷ đô la, công ty đã công bố vào thứ Tư. Vòng tài trợ này đặt LiveKit vào vị trí là một phần quan trọng của cơ sở hạ tầng cho các ứng dụng trí tuệ giọng nói đang phát triển mạnh mẽ trên nhiều ngành công nghiệp, từ chăm sóc sức khỏe đến hỗ trợ khách hàng.

Index Ventures dẫn đầu vòng này, với sự tham gia của Salesforce (CRM ) Ventures, Hanabi Capital và các nhà đầu tư hiện tại Altimeter Capital và Redpoint Ventures. Vòng tài trợ này đưa tổng số tiền LiveKit huy động được lên 183 triệu đô la.

LiveKit cung cấp cơ sở hạ tầng âm thanh và video thời gian thực cho một số sản phẩm trí tuệ nhân tạo hàng đầu trên thị trường. Khách hàng nổi bật nhất của công ty là OpenAI, nơi công nghệ của LiveKit cho phép chế độ giọng nói tiên tiến của ChatGPT – tính năng cho phép 800+ triệu người dùng hàng tuần của ChatGPT có cuộc trò chuyện tự nhiên với trợ lý ảo. Các khách hàng khác bao gồm xAI, Salesforce, Tesla (TSLA ), Meta, Spotify, các nhà điều hành cấp cứu 911 và các nhà cung cấp dịch vụ sức khỏe tâm lý.

Vấn Đề WebRTC LiveKit Đã Giải Quyết

Câu chuyện kỹ thuật về LiveKit giải thích tại sao các công ty trí tuệ giọng nói lại liên tục xuất hiện với tư cách là khách hàng. Việc truyền âm thanh thời gian thực qua internet đòi hỏi WebRTC, một giao thức được thiết kế đặc biệt cho truyền thông thấp độ trễ. Tuy nhiên, việc triển khai WebRTC trực tiếp liên quan đến sự phức tạp và thách thức về khả năng mở rộng mà hầu hết các công ty trí tuệ nhân tạo không muốn tự giải quyết.

LiveKit đã xây dựng cơ sở hạ tầng mã nguồn mở giúp đơn giản hóa việc triển khai WebRTC. Công ty đã mở rộng thành một mạng lưới trung tâm dữ liệu toàn cầu được tối ưu hóa cho việc định tuyến dữ liệu giọng nói và video, xử lý hàng tỷ cuộc gọi mỗi năm giữa các đại lý giọng nói và người dùng trên web, di động và kênh điện thoại.

Khi OpenAI ra mắt API thời gian thực vào tháng 10 năm 2024, công ty đã hợp tác trực tiếp với LiveKit để cung cấp cho các nhà phát triển công cụ để xây dựng ứng dụng sử dụng cùng công nghệ cho tính năng giọng nói của ChatGPT. Sự hợp tác này đã mang lại cho LiveKit sự hiện diện trên toàn cộng đồng nhà phát triển đang xây dựng ứng dụng trí tuệ giọng nói – và đã khiến LiveKit trở thành lựa chọn cơ sở hạ tầng mặc định cho nhiều công ty.

Lạc Quan Trí Tuệ Giọng Nói Đang Phát Triển

Vòng tài trợ này phản ánh một mô hình rộng lớn hơn: khi các ứng dụng trí tuệ nhân tạo trưởng thành, các công ty cơ sở hạ tầng cho phép chúng thu hút vốn đáng kể. Databricks gần đây đã huy động vốn với định giá 134 tỷ đô la dựa trên nền tảng dữ liệu và trí tuệ nhân tạo của mình. Cerebras (CBRS ) đã ký một thỏa thuận 10 tỷ đô la với OpenAI cho tính toán suy luận. Định giá kỳ lân của LiveKit tuân theo cùng một logic – các công cụ và xẻng cho cuộc chạy đua vàng trí tuệ nhân tạo.

Thị trường trí tuệ giọng nói đã mở rộng nhanh chóng vượt ra ngoài các rô-bốt trò chuyện của người tiêu dùng. Các công ty dịch vụ tài chính sử dụng trí tuệ giọng nói cho xác thực khách hàng và dịch vụ tư vấn. Các nhà cung cấp dịch vụ chăm sóc sức khỏe triển khai nó cho việc tiếp nhận và phân loại bệnh nhân. Các nhà bán lẻ xây dựng trợ lý mua sắm có giọng nói. Trong mỗi trường hợp, cơ sở hạ tầng cơ bản cần phải cung cấp âm thanh với độ trễ không thể nhận biết – chính xác những gì LiveKit chuyên về.

Khung Agents của LiveKit, được ra mắt cùng với vòng Series B vào tháng 4 năm 2025, cung cấp một nền tảng để xây dựng và triển khai các đại lý trí tuệ giọng nói. Thời điểm này không phải là trùng hợp: trí tuệ giọng nói vừa chuyển từ một tính năng trong ChatGPT sang hàng nghìn ứng dụng trên nhiều ngành công nghiệp. LiveKit đã dự đoán nhu cầu và xây dựng các công cụ cho nhà phát triển để nắm bắt nó.

Tương Lai Sẽ Đến

Công ty dự định sử dụng vòng tài trợ này để mở rộng dịch vụ tính toán, lưu trữ và mạng trong khi mở rộng cơ sở hạ tầng cho các ứng dụng trí tuệ giọng nói và tầm nhìn máy tính. LiveKit dự đoán rằng năm 2026 sẽ là năm trí tuệ giọng nói đạt được triển khai rộng rãi trên hàng nghìn trường hợp sử dụng trên toàn cầu.

Dự đoán này phù hợp với nơi các phòng thí nghiệm trí tuệ nhân tạo lớn đang hướng tới. OpenAI đã nhấn mạnh giọng nói như một giao diện chính cho tương tác trí tuệ nhân tạo. Google’s Gemini bao gồm khả năng giọng nói trên toàn bộ bộ sản phẩm của mình. Anthropic đã xây dựng các tính năng giọng nói cho Claude. Khi các mô hình này được cải thiện, nhu cầu về cơ sở hạ tầng có thể cung cấp phản hồi của chúng trong thời gian thực sẽ chỉ tăng lên.

Đối với các nhà phát triển xây dựng ứng dụng trí tuệ giọng nói, trạng thái kỳ lân của LiveKit cho thấy rằng lớp cơ sở hạ tầng đang trưởng thành. Công ty bắt đầu như một dự án mã nguồn mở trong thời đại Zoom của đại dịch đã trở thành cơ sở hạ tầng thiết yếu cho kỷ nguyên trí tuệ giọng nói đang mở ra.

Alex McFarland là một nhà báo và nhà văn về trí tuệ nhân tạo, khám phá những phát triển mới nhất trong lĩnh vực trí tuệ nhân tạo. Ông đã hợp tác với nhiều công ty khởi nghiệp và xuất bản về trí tuệ nhân tạo trên toàn thế giới.