Hợp tác

OmniOps và Hamsa Hợp Tác Để Mang Công Nghệ Giọng Nói Ả Rập Tới Ả Rập Xê Út

mm
Thêm Unite.AI vào các nguồn ưu tiên của bạn trên Google

Công ty cơ sở hạ tầng trí tuệ nhân tạo Ả Rập Xê Út OmniOps đã hợp tác với nhà phát triển công nghệ giọng nói Ả Rập Hamsa để mang công nghệ giọng nói và hội thoại trí tuệ nhân tạo được lưu trữ cục bộ tới các tổ chức trên toàn Ả Rập Xê Út.

Vào ngày 16 tháng 7 năm 2026, hợp tác này kết hợp công nghệ Speech-to-Text, Text-to-Speech và AI agent của Hamsa với Bunyan, nền tảng suy luận chủ quyền của OmniOps. Các công ty cho biết các dịch vụ kết quả sẽ được vận hành thông qua cơ sở hạ tầng được quản lý trong Ả Rập Xê Út, mang lại cho các doanh nghiệp sự kiểm soát lớn hơn về cách xử lý bản ghi âm, bản chuyển văn bản và tải trọng công việc trí tuệ nhân tạo.

Kết Hợp Mô Hình Giọng Nói Ả Rập Với Cơ Sở Hạ Tầng Trí Tuệ Nhân Tạo Địa Phương

Theo thỏa thuận hợp tác, OmniOps sẽ trở thành đối tác cơ sở hạ tầng của Hamsa tại Ả Rập Xê Út. Các mô hình của Hamsa sẽ chạy trên Bunyan, mà OmniOps định vị là một môi trường để triển khai tải trọng suy luận, agent trí tuệ nhân tạo và luồng công việc thông minh trên đám mây công cộng, đám mây riêng, trên cơ sở và hệ thống cách ly.

OmniOps cho biết Bunyan sử dụng cùng một mã cơ sở trên các môi trường triển khai này. Nền tảng của nó được thiết kế để cho phép các tổ chức vận hành ứng dụng trí tuệ nhân tạo mà không cần gửi dữ liệu nhạy cảm vào cơ sở hạ tầng được quản lý bên ngoài, đồng thời hỗ trợ triển khai đa thuê bao được lưu trữ cục bộ trong Vương quốc. Nền tảng này cũng hỗ trợ phần cứng từ nhiều nhà cung cấp tính toán trí tuệ nhân tạo, bao gồm NVIDIA (NVDA ), AMD, Groq, Qualcomm (QCOM ) và SambaNova.

Lớp cơ sở hạ tầng này rất quan trọng vì ứng dụng trí tuệ nhân tạo giọng nói có thể xử lý lượng lớn thông tin nhạy cảm. Ví dụ, một đại lý dịch vụ khách hàng có thể gặp phải tên, chi tiết tài khoản, thông tin y tế, yêu cầu thanh toán hoặc hồ sơ chính phủ trong một cuộc trò chuyện thông thường.

Lưu trữ mô hình cục bộ không tự động làm cho ứng dụng trở nên tuân thủ. Các tổ chức vẫn phải thiết lập các kiểm soát truy cập, chính sách lưu giữ, thủ tục đồng ý và biện pháp bảo mật phù hợp. Tuy nhiên, việc giữ suy luận và xử lý dữ liệu trong Ả Rập Xê Út có thể giúp xây dựng hệ thống xung quanh Luật Bảo vệ Dữ liệu Cá nhân của Vương quốc và yêu cầu quản lý dữ liệu quốc gia.

Địa Chỉ Sự Phức Tạp Của Ngôn Ngữ Ả Rập Nói

Hamsa đã phát triển nền tảng của mình dành riêng cho ứng dụng ngôn ngữ Ả Rập chứ không phải là thích nghi một hệ thống chủ yếu là tiếng Anh sau đó.

Công nghệ Speech-to-Text của họ được thiết kế để tự động phát hiện các phương ngữ Ả Rập khác nhau và xử lý chuyển đổi mã, nơi người nói chuyển giữa tiếng Ả Rập và tiếng Anh trong cùng một cuộc trò chuyện. Nó cũng hỗ trợ biểu thức thông tục, dấu câu tự động, dấu thời gian ở mức từ và xác định người nói, giúp xác định các tham gia khác nhau trong bản ghi chứa nhiều người nói.

Các khả năng này có thể đặc biệt hữu ích trong các trung tâm liên lạc, nơi khách hàng có thể sử dụng từ vựng khu vực, chuyển đổi giữa ngôn ngữ hoặc nói ít正式 hơn so với họ sẽ trong giao tiếp viết. Xác định người nói và dấu thời gian cũng có thể giúp doanh nghiệp xem xét lại các cuộc gọi, tạo lưu trữ có thể tìm kiếm và kết nối các tuyên bố cụ thể với người tham gia chính xác.

Mô hình Text-to-Speech của Hamsa bao gồm tiếng Ả Rập Ai Cập, Vùng Vịnh, Levant, Iraq và tiếng Ả Rập Tiêu chuẩn Hiện đại, cùng với tiếng Anh. Hệ thống hỗ trợ văn bản Ả Rập-Англий混合, dấu phụ Ả Rập và nhân bản giọng nói tùy chỉnh, cho phép các tổ chức tạo ra giọng nói tổng hợp vẫn nhất quán trên các dịch vụ khác nhau.

Tài liệu tài liệu của công ty liệt kê các tùy chọn giọng nói chi tiết hơn cho tiếng Ả Rập Saudi, Các Tiểu Vương quốc Ả Rập Thống nhất, Bahrain, Qatar, Kuwait, Oman, Palestine, Jordan, Lebanon, Syria và Iraq. Hamsa cung cấp cả giao diện lập trình ứng dụng không đồng bộ cho xử lý批 và điểm cuối độ trễ thấp cho ứng dụng hội thoại cần tạo hoặc chuyển đổi âm thanh trong thời gian thực.

Chuyển Từ Xử Lý Giọng Nói Sang Trí Tuệ Nhân Tạo

Thỏa thuận hợp tác này không chỉ giới hạn ở chuyển văn bản và giọng nói tổng hợp. Hamsa cũng cung cấp các agent trí tuệ nhân tạo được thiết kế để thực hiện cuộc trò chuyện điện thoại bằng tiếng Ả Rập và tiếng Anh.

Các agent này có thể được cấu hình cho hỗ trợ khách hàng, sắp xếp cuộc hẹn, nhắc nhở, đủ điều kiện dẫn đầu và hệ thống phản hồi giọng nói tự nhiên. Hamsa cung cấp giao diện lập trình ứng dụng cho nhà phát triển, cũng như giao diện web để tạo agent và xử lý phương tiện.

Nền tảng này có thể kết nối với phần mềm quản lý mối quan hệ khách hàng, hệ thống Voice over Internet Protocol, lịch và các công cụ kinh doanh khác. Doanh nghiệp cũng có thể sửa đổi giọng nói, phương ngữ, âm điệu và phản hồi của agent cho một luồng công việc hoặc nhóm khách hàng cụ thể.

Thông qua Bunyan, các agent này có thể được triển khai cùng với dữ liệu và ứng dụng nội bộ của một tổ chức trong khi vẫn nằm trong một môi trường được kiểm soát. Các ứng dụng tiềm năng được xác định bởi các công ty bao gồm trung tâm liên lạc tự động, trợ lý ảo, hỗ trợ khách hàng, xác thực giọng nói và trợ lý kiến thức nội bộ.

“Các tổ chức trên toàn Ả Rập Xê Út đang tìm cách triển khai trí tuệ nhân tạo tiên tiến trong khi vẫn duy trì kiểm soát nơi dữ liệu của họ cư trú và cách tải trọng công việc của họ hoạt động,” Mohammed Altassan, Giám đốc điều hành của OmniOps cho biết. Ông cho biết thỏa thuận hợp tác này sẽ cho phép các doanh nghiệp tập trung vào việc cung cấp dịch vụ trong khi Bunyan cung cấp cơ sở hạ tầng tuân thủ và chủ quyền cơ bản.

Giám đốc điều hành Hamsa Ibrahim Jabareen mô tả tiếng Ả Rập là một ngôn ngữ chính mà đã nhận được ít sự chú ý từ các nhà cung cấp trí tuệ nhân tạo trong lịch sử. Ông cho biết cơ sở hạ tầng được quản lý cục bộ sẽ giúp Hamsa dễ dàng đưa mô hình giọng nói của mình vào môi trường doanh nghiệp Ả Rập Xê Út với quy mô lớn.

Xây Dựng Ngôn Ngữ Trí Tuệ Nhân Tạo Doanh Nghiệp Ả Rập Xê Út

Được thành lập tại Riyadh vào năm 2024, OmniOps tập trung vào tính toán hiệu suất cao, suy luận trí tuệ nhân tạo và cơ sở hạ tầng được quản lý.

Công ty đã huy động được 30 triệu SAR, khoảng 8 triệu USD, vào cuối năm 2024 để mở rộng hoạt động và nghiên cứu và phát triển. Thỏa thuận Hamsa theo sau các nỗ lực khác của OmniOps để định vị Bunyan như một lớp cơ sở hạ tầng cho trí tuệ nhân tạo được kiểm soát cục bộ.

Thỏa thuận hợp tác Hamsa áp dụng một mô hình cơ sở hạ tầng tương tự cho thị trường Ả Rập Xê Út nhưng kết hợp nó với công nghệ giọng nói được phát triển đặc biệt cho người dùng nói tiếng Ả Rập. Sự phân chia trách nhiệm này có thể giảm lượng công việc kỹ thuật mà các doanh nghiệp phải hoàn thành trước khi khởi chạy ứng dụng giọng nói. Hamsa cung cấp mô hình giọng nói và hội thoại, trong khi OmniOps quản lý nơi những mô hình đó chạy và cách chúng kết nối với tài nguyên tính toán cục bộ.

Mặc dù vậy, thông báo không bao gồm khách hàng được đặt tên, giá cả, thời gian triển khai hoặc điểm chuẩn độ chính xác và độ trễ được xác minh độc lập. Những chi tiết này sẽ rất quan trọng cho các tổ chức so sánh nền tảng với dịch vụ giọng nói đám mây đã thành lập hoặc hệ thống được phát triển nội bộ.

Ảnh Hưởng Tương Lai

Trí tuệ nhân tạo giọng nói có khả năng trở thành một giao diện quan trọng ngày càng tăng cho các tổ chức Ả Rập Xê Út phục vụ khách hàng thích giọng nói Ả Rập hơn các trang web, ứng dụng di động hoặc rô-bốt trò chuyện dựa trên văn bản. Cơ hội mở rộng ra ngoài việc thay thế menu cuộc gọi thông thường. Các hệ thống có khả năng hơn có thể chuyển đổi cuộc trò chuyện, xác định ý định, truy xuất thông tin từ hệ thống doanh nghiệp và hoàn thành quá trình thường xuyên trong cùng một tương tác.

Thành công sẽ phụ thuộc vào việc công nghệ hoạt động nhất quán như thế nào trên các phương ngữ Ả Rập Xê Út, kết nối điện thoại ồn ào, cuộc trò chuyện đa ngôn ngữ và thuật ngữ chuyên ngành. Doanh nghiệp cũng sẽ cần các cơ chế chuyển tiếp hiệu quả để yêu cầu phức tạp, nhạy cảm hoặc không chắc chắn có thể được chuyển đến nhân viên người.

Bằng cách kết hợp công nghệ giọng nói Ả Rập đầu tiên của Hamsa với cơ sở hạ tầng Bunyan được vận hành cục bộ của OmniOps, các công ty đang cố gắng giải quyết cả hai mặt của vấn đề triển khai: hiệu suất ngôn ngữ và kiểm soát tổ chức. Thỏa thuận hợp tác này có thể giúp trí tuệ nhân tạo giọng nói Ả Rập trở nên dễ tiếp cận hơn với các doanh nghiệp Ả Rập Xê Út, nhưng tác động lâu dài của nó cuối cùng sẽ được xác định bởi độ tin cậy sản xuất, nỗ lực tích hợp, quản lý quy định và chất lượng của các cuộc trò chuyện mà người dùng trải nghiệm.

Antoine là một nhà lãnh đạo có tầm nhìn và là đối tác sáng lập của Unite.AI, được thúc đẩy bởi niềm đam mê không ngừng nghỉ để định hình và quảng bá tương lai của AI và robot. Là một doanh nhân hàng loạt, ông tin rằng AI sẽ gây ra sự gián đoạn cho xã hội giống như điện, và thường được bắt gặp khi nói về tiềm năng của các công nghệ phá vỡ và AGI.

Là một nhà tương lai học, ông dành để khám phá cách những đổi mới này sẽ định hình thế giới của chúng ta. Ngoài ra, ông là người sáng lập của Securities.io, một nền tảng tập trung vào đầu tư vào các công nghệ tiên tiến đang định nghĩa lại tương lai và thay đổi toàn bộ lĩnh vực.