Mô hình và nền tảng AI

LumenVox Ra Mắt Động Cơ Nhận Dạng Giọng Nói Tự Động Thế Hệ Tiếp Theo

mm
Thêm Unite.AI vào các nguồn ưu tiên của bạn trên Google

Nhà cung cấp hàng đầu về công nghệ giọng nói và tiếng nói LumenVox đã công bố việc ra mắt động cơ nhận dạng giọng nói tự động (ASR) thế hệ tiếp theo với chức năng chuyển văn bản. Được xây dựng với trí tuệ nhân tạo (AI) và học máy sâu, động cơ mới này đã chứng minh khả năng vượt trội so với các động cơ khác và cung cấp trải nghiệm khách hàng được kích hoạt bằng giọng nói với độ chính xác cao.

LumenVox cung cấp phần mềm nhận dạng giọng nói và tiếng nói cấp độ vận chuyển cho các tổ chức trên toàn cầu. Hệ thống của họ được sử dụng bởi hàng triệu người dùng và hàng nghìn doanh nghiệp mỗi ngày.

Tính Năng Của Động Cơ Nhận Dạng Giọng Nói LumenVox

Một trong những tính năng chính của động cơ nhận dạng giọng nói LumenVox mới là kiến trúc mạng nơ-ron sâu (DNN) từ đầu đến cuối, cũng như khả năng xử lý nhận dạng giọng nói. Nó có thể tăng tốc khả năng thêm ngôn ngữ và phương ngữ mới đồng thời cung cấp một bộ công cụ mới để mở rộng mô hình ngôn ngữ, giúp hệ thống mở rộng đến nhiều người dùng hơn.

Dan Miller là nhà phân tích hàng đầu tại Opus Research.

“Động cơ nhận dạng giọng nói mới của LumenVox cung cấp mức độ chính xác và thông minh cao cần thiết để bắt, nhận dạng và phản ứng với ý định của từng khách hàng và xác định những gì có thể cho phần mềm nhận dạng giọng nói và tiếng nói,” Miller nói.

Dịch Vụ Cho Một Bộ Khách Hàng Đa Dạng

Một số khía cạnh chính của LumenVox bao gồm mô hình ngôn ngữ đơn mà cho phép khách hàng thêm ngôn ngữ và giọng nói không bản địa một cách liền mạch. Điều này cho phép hệ thống phục vụ một bộ khách hàng đa dạng và rộng lớn hơn. Khách hàng cũng có thể di chuyển hơn 80% các ngữ pháp và giá trị tin cậy từ các ứng dụng cũ sang động cơ nhận dạng giọng nói LumenVox nhờ công cụ LumenVox Speech Tuner.

Một tính năng ấn tượng khác là khả năng chuyển đổi giọng nói thành văn bản theo thời gian thực của động cơ nhận dạng giọng nói LumenVox, cung cấp bản chuyển văn bản chính xác với độ trễ tối thiểu.

Cuối cùng, hệ thống cực kỳ linh hoạt và cho phép khách hàng triển khai ứng dụng giọng nói trong bất kỳ môi trường nào, chẳng hạn như trên cơ sở, đa đám mây hoặc mô hình kết hợp.

Joe Hagan là giám đốc sản phẩm chính tại LumenVox.

“Động cơ nhận dạng giọng nói LumenVox mới cho phép khách hàng đáp ứng nhu cầu ngày càng tăng về dịch vụ nhận dạng giọng nói thế hệ tiếp theo bằng cách cung cấp ngôn ngữ và phương ngữ mới mà không cần chi phí dịch vụ chuyên nghiệp cao,” Hagan nói.

Alex McFarland là một nhà báo và nhà văn về trí tuệ nhân tạo, khám phá những phát triển mới nhất trong lĩnh vực trí tuệ nhân tạo. Ông đã hợp tác với nhiều công ty khởi nghiệp và xuất bản về trí tuệ nhân tạo trên toàn thế giới.