AIモデルとプラットフォーム

LumenVox、次世代自動音声認識エンジンをリリース

mm
Unite.AI を Google の優先ソースに追加

スピーチおよびボイス技術の主要提供者であるLumenVoxは、トランスクリプションを備えた次世代の自動音声認識(ASR)エンジンをリリースした。人工知能(AI)とディープマシンラーニングで構築されたこの新しいエンジンは、他のエンジンを上回り、高度な精度の音声対応顧客体験を提供する能力を実証している。

LumenVoxは、世界中のさまざまな組織にキャリアグレードのスピーチおよびボイス認識ソフトウェアを提供している。同社のシステムは、毎日数百万のユーザーと数千の企業によって使用されている。

LumenVox ASRエンジンの特徴

新しいLumenVox ASRエンジンの主な特徴の1つは、そのエンドツーエンドのディープニューラルネットワーク(DNN)アーキテクチャと音声認識処理能力である。これにより、新しい言語と方言を追加する能力が高速化され、新しいツールセットで言語モデルを拡張できるため、システムがより多くのユーザーに開放される。

Opus ResearchのリードアナリストであるDan Millerは、「LumenVoxの新しいASRエンジンは、各顧客の意図をキャプチャ、認識、対応するために必要な高い精度と知能を提供する」と述べている。

「LumenVoxの新しいASRエンジンは、スピーチおよびボイス認識ソフトウェアの可能性を定義するために必要な高度な精度と知能を提供する」とMillerは述べている。

多様な顧客層にサービスを提供する

LumenVoxの重要な側面の1つは、シングル言語モデルが顧客に新しい言語と非ネイティブのアクセントをシームレスに追加できることである。これにより、システムがより幅広い顧客層にサービスを提供できる。顧客はまた、LumenVox Speech Tunerを使用して、80%以上のグラマーと信頼値をレガシーアプリケーションからLumenVox ASRに移行できる。

もう1つの印象的な特徴は、LumenVox ASRエンジンのリアルタイムで音声からテキストへの変換能力である。これにより、遅延がほとんどない高精度のトランスクリプションが提供される。

最後に、システムは非常に柔軟で、顧客がオンプレミス、多クラウド、またはハイブリッドモデルのような任意の環境でスピーチアプリケーションを展開できる。

LumenVoxのチーフプロダクトオフィサーのJoe Haganは、「新しいLumenVox ASRエンジンは、顧客がプロフェッショナルサービスへの高額なコストなしで新しい言語と方言を提供することで、次世代のスピーチ認識サービスに対する需要の増加に対応できるようにする」と述べている。

Alex McFarlandは、人工知能の最新の開発を探求するAIジャーナリスト兼ライターです。彼は、世界中の数多くのAIスタートアップや出版物と共同しています。