Amazon Lexが新しい多言語音声認識モデルをリリース
ID 252
GUID 4003fded40e9d0b98054e03aa627c7a056c61271
発表日(JST)
要約生成日時(JST)
タイトル Amazon Lexが新しい多言語音声認識モデルをリリース
詳細リンク https://aws.amazon.com/about-aws/whats-new/2024/12/amazon-lex-multilingual-speech-recognition-models/
カテゴリ
  • amazon-lex
  • amazon-machine-learning
  • artificial-intelligence
要点
  • Amazon Lexが新しい多言語ストリーミング音声認識モデル(ASR-2.0)を一般提供開始
  • ヨーロッパ言語とアジア太平洋言語の2つの専門グループに分かれたモデルを提供
  • 英数字の認識精度が向上し、IVRアプリケーションでの顧客対応が改善
  • 非母語話者や地域なまりに対する認識精度も向上
  • 既存のボットの再構築で新モデルを利用可能
  • Amazon Lex V2をサポートするすべてのリージョンで利用可能
アップデート内容要約

Amazon Lexが新しい多言語ストリーミング音声認識モデル(ASR-2.0)を一般提供開始。ヨーロッパ言語とアジア太平洋言語のグループに分かれた専門モデルにより、認識精度が向上。特に英数字の認識に優れ、IVRアプリケーションでの顧客対応が改善。

アップデート内容全文

Amazon Lexの新しい多言語ストリーミング音声認識モデル(ASR-2.0)の一般提供開始を発表しました。
これらのモデルは、2つの専門グループを通じて認識精度を向上させています:ポルトガル語、カタルーニャ語、フランス語、イタリア語、ドイツ語、スペイン語をサポートするヨーロッパベースのモデルと、中国語、韓国語、日本語をサポートするアジア太平洋ベースのモデルです。
これらのAmazon Lex多言語ストリーミングモデルは、各グループ内の共有言語パターンを活用して、認識精度を向上させています。
特に英数字の音声認識に優れており、対話型音声応答(IVR)アプリケーションで顧客の発話を正確に理解し、発信者の識別やタスクの自動化が容易になります。
例えば、新しいモデルは口座番号、確認番号、シリアル番号、製品コードなどをより正確に認識します。
これらの改善は、サポートされている言語のすべての地域変種(例えば、ヨーロッパフランス語とカナダフランス語の両方)に及びます。
さらに、新しいモデルは非母語話者や様々な地域なまりに対しても認識精度が向上しており、より包括的で信頼性の高い対話を実現します。
これらのモデルは現在、Amazon Lexでサポートされている言語の標準となっており、顧客は既存のボットを再構築するだけでこれらの改善を利用できます。
新しいASR-2.0モデルは、Amazon Lex V2をサポートするすべてのリージョンで利用可能です。

関連サービス
  • Amazon Lex
関連サービスの説明
  • Amazon Lexは、アプリケーションに対話型インターフェイスを構築するためのAWSのサービスです。自然言語理解(NLU)と自動音声認識(ASR)技術を使用して、テキストや音声を理解し、意図を解釈します。これにより、チャットボットやIVRシステムなどの会話型アプリケーションを簡単に作成できます。開発者はプログラミングの専門知識がなくても、高度な深層学習機能を持つ会話型インターフェイスを設計、構築、テスト、デプロイすることができます。
関連URL