AWSが新しい音声対音声モデルAmazon Nova Sonicを発表しました。このモデルは、Amazon Bedrockでリアルタイムの会話AI応用を可能にし、低遅延で高性能な音声生成を実現します。英語の複数のアクセントに対応し、責任あるAI開発を考慮して設計されています。
アップデート内容全文
本日、AmazonはAmazon Nova Sonicを発表しました。
これは音声理解と生成を単一のモデルに統合した新しい基盤モデルで、AI応用において人間のような音声会話を可能にします。
Amazon Nova Sonicにより、開発者はAmazon Bedrockで業界トップクラスの価格性能と低遅延を持つリアルタイムの会話AI応用を構築できます。
このモデルは、さまざまな話し方のスタイルの音声を理解し、アメリカ英語やイギリス英語など、男性的な声と女性的な声の両方を含む表現豊かな音声を生成できます。
Amazon Nova Sonicの革新的なアーキテクチャは、入力された音声の文脈と内容に合わせて、生成される音声応答のイントネーション、韻律、スタイルを適応させることができます。
さらに、Amazon Nova SonicはRAG(Retrieval-Augmented Generation)を使用して、ファンクションコーリングや企業データによる知識強化も可能です。
責任あるAIを念頭に開発されており、コンテンツモデレーションや透かし入れなどの保護機能が組み込まれています。
開発者がAmazon Nova Sonicでリアルタイムアプリケーションを構築できるよう、AWSはAmazon Bedrockに新しい双方向ストリーミングAPIの提供も発表しました。
このAPIは双方向のコンテンツストリーミングを可能にし、人間のユーザーとAIモデル間の低遅延な対話的コミュニケーションに不可欠です。
Amazon Nova Sonicは、事実上あらゆるアプリケーションに音声機能を追加するために使用できます。
コンタクトセンターでの顧客サービスコール自動化、アウトバウンドマーケティング、音声対応のパーソナルアシスタントやエージェント、インタラクティブな教育や語学学習など、幅広い用途で徹底的にテストされています。
Amazon Nova SonicモデルはAWS米国東部(バージニア北部)リージョンのAmazon Bedrockで現在利用可能です。
詳細については、AWSニュースブログ、Amazon Nova Sonic製品ページ、およびAmazon Nova Sonicユーザーガイドをご覧ください。
Amazon BedrockでAmazon Nova Sonicを使い始めるには、Amazon Bedrockコンソールにアクセスしてください。
Amazon Nova Sonicは、Amazon Bedrock上で提供される新しい音声対音声モデルです。このモデルは音声理解と音声生成を単一のシステムに統合し、リアルタイムで自然な音声会話を可能にします。開発者はこのモデルを使用して、音声対応のAIアプリケーションを構築できます。多様な話し方のスタイルを理解し、複数の英語アクセントで表現豊かな音声を生成する能力を持っています。