Amazon Nova 2 Sonicを使用した医療予約エージェントの構築
サマリー
Amazon Nova 2 Sonicを用いて医療予約エージェントを構築する方法を紹介します。音声認証、予約管理、健康情報収集を行い、ノーショー率を減少させることが可能です。サーバーレスでスケーラブルなシステムを実現し、患者との自然な会話を実現します。
本文
クリニックや病院ネットワークを運営している場合、予約のキャンセルによるコストを既にご存知でしょう。アメリカの医療における平均的なノーショー率は、専門分野によって5〜30%の間にあります。空いている時間帯は、失われた収益、無駄な医療提供者の時間、患者ケアの遅延を意味します。患者に一人ずつ電話をかけて確認や再スケジュールを行うという従来の方法は、スケールしません。
この投稿では、Amazon Nova 2 SonicとAmazon Bedrock AgentCoreを使用して、予約リマインダーの会話を処理する音声エージェントを構築する方法を学びます。このエージェントは、音声によって患者を認証し、予約を管理(確認、キャンセル、再スケジュール)、訪問前の健康情報を収集し、必要に応じて人間のスタッフにエスカレーションします。これにより、ルーチンの電話をスケールで処理し、ノーショー率を減少させることができます。このサンプルは、エージェントの側面に焦点を当てています:音声会話とツールのオーケストレーション。テスト用のブラウザベースのインターフェースも含まれています。エージェントを実際の電話回線に接続して発信するには、Amazon Connect Customerなどの電話サービスを統合する必要があります。
このウォークスルーでは、完全な構築プロセスを説明します。Amazon Bedrock上で動作する音声エージェントを取得し、Amazon Nova 2 Sonicの音声から音声への機能を使用して自然な予約会話を行います。さらに、患者認証、スケジューリング、エスカレーションのためにStrands Agents SDKで構築された7つの医療特化ツールも提供されます。サーバーレスのデプロイメントは、Amazon Bedrock AgentCore上で実行され、Amazon Cognitoによる認証、Amazon DynamoDBによる永続性、Amazon Simple Notification Service(Amazon SNS)による通知を利用します。ブラウザベースのReactフロントエンドは、認証されたWebSocket接続を介して双方向の音声をストリーミングします。
予約電話を効果的に自動化するには、複数のステップを単一のインタラクションで処理する会話型AIシステムが必要です:アイデンティティの確認、予約の詳細の提示、変更の処理、健康情報の収集など。従来のアプローチは、別々のサービスを連結します。音声からテキストへのモデルが患者の言葉を文字起こしし、テキストベースの大規模言語モデル(LLM)が応答を生成し、テキストから音声へのモデルがそれを読み上げます。各ハンドオフはレイテンシを導入し、コンテキストが失われます。文字起こしステップでは、トーン、ためらい、緊急性などの音声的な手がかりが失われます。LLMは、患者が何を言ったかだけを聞き、どのように言ったかは聞きません。患者の不安や混乱がエージェントの応答に影響を与えるべき医療の現場では、この損失は重要です。
このエージェントは、2つのAWSサービスを組み合わせることで異なるアプローチを取ります。Amazon Nova 2 Sonicは、Amazon Bedrockで利用可能な音声から音声へのモデルで、双方向ストリーミングを使用したリアルタイムの会話型AIを可能にします。別々の文字起こし、推論、合成サービスを連結するのではなく、Nova 2 Sonicは単一のモデルで音声をネイティブに処理します。これにより、トーンやペースなどの音声的なコンテキストが失われることはありません。Nova 2 Sonicが音声を処理し、音響コンテキストに適応する方法についての詳細は、Amazon Nova Sonicの紹介ブログ記事を参照してください。
このエージェントにとって、Nova 2 Sonicは重要な機能を提供します。ネイティブな音声から音声への処理は、会話の各ターンで音声のニュアンスを保持し、エージェントはためらいや懸念を失うことなく把握します。ツール呼び出しの精度は、医療ワークフローをスムーズに進行させます。このモデルは、認証が必要なとき、スケジュールを照会する必要があるとき、予約を行う必要があるときに知っています。低レイテンシの双方向ストリーミングは、会話を応答的に保ちます。このモデルは、家庭や臨床環境で一般的な背景ノイズやアクセントのある英語にも対応できるように設計されています。最後に、多言語サポートにより、エージェントは会話中に患者の希望する言語に切り替えることができます。サポートされている言語については、Amazon Nova 2 Sonicのドキュメントを参照してください。
この投稿では、Amazon Nova 2 SonicとAmazon Bedrock AgentCoreを使用して、予約リマインダーの会話を処理する音声エージェントを構築する方法を学びます。このエージェントは、音声によって患者を認証し、予約を管理(確認、キャンセル、再スケジュール)、訪問前の健康情報を収集し、必要に応じて人間のスタッフにエスカレーションします。これにより、ルーチンの電話をスケールで処理し、ノーショー率を減少させることができます。このサンプルは、エージェントの側面に焦点を当てています:音声会話とツールのオーケストレーション。テスト用のブラウザベースのインターフェースも含まれています。エージェントを実際の電話回線に接続して発信するには、Amazon Connect Customerなどの電話サービスを統合する必要があります。
このウォークスルーでは、完全な構築プロセスを説明します。Amazon Bedrock上で動作する音声エージェントを取得し、Amazon Nova 2 Sonicの音声から音声への機能を使用して自然な予約会話を行います。さらに、患者認証、スケジューリング、エスカレーションのためにStrands Agents SDKで構築された7つの医療特化ツールも提供されます。サーバーレスのデプロイメントは、Amazon Bedrock AgentCore上で実行され、Amazon Cognitoによる認証、Amazon DynamoDBによる永続性、Amazon Simple Notification Service(Amazon SNS)による通知を利用します。ブラウザベースのReactフロントエンドは、認証されたWebSocket接続を介して双方向の音声をストリーミングします。
予約電話を効果的に自動化するには、複数のステップを単一のインタラクションで処理する会話型AIシステムが必要です:アイデンティティの確認、予約の詳細の提示、変更の処理、健康情報の収集など。従来のアプローチは、別々のサービスを連結します。音声からテキストへのモデルが患者の言葉を文字起こしし、テキストベースの大規模言語モデル(LLM)が応答を生成し、テキストから音声へのモデルがそれを読み上げます。各ハンドオフはレイテンシを導入し、コンテキストが失われます。文字起こしステップでは、トーン、ためらい、緊急性などの音声的な手がかりが失われます。LLMは、患者が何を言ったかだけを聞き、どのように言ったかは聞きません。患者の不安や混乱がエージェントの応答に影響を与えるべき医療の現場では、この損失は重要です。
このエージェントは、2つのAWSサービスを組み合わせることで異なるアプローチを取ります。Amazon Nova 2 Sonicは、Amazon Bedrockで利用可能な音声から音声へのモデルで、双方向ストリーミングを使用したリアルタイムの会話型AIを可能にします。別々の文字起こし、推論、合成サービスを連結するのではなく、Nova 2 Sonicは単一のモデルで音声をネイティブに処理します。これにより、トーンやペースなどの音声的なコンテキストが失われることはありません。Nova 2 Sonicが音声を処理し、音響コンテキストに適応する方法についての詳細は、Amazon Nova Sonicの紹介ブログ記事を参照してください。
このエージェントにとって、Nova 2 Sonicは重要な機能を提供します。ネイティブな音声から音声への処理は、会話の各ターンで音声のニュアンスを保持し、エージェントはためらいや懸念を失うことなく把握します。ツール呼び出しの精度は、医療ワークフローをスムーズに進行させます。このモデルは、認証が必要なとき、スケジュールを照会する必要があるとき、予約を行う必要があるときに知っています。低レイテンシの双方向ストリーミングは、会話を応答的に保ちます。このモデルは、家庭や臨床環境で一般的な背景ノイズやアクセントのある英語にも対応できるように設計されています。最後に、多言語サポートにより、エージェントは会話中に患者の希望する言語に切り替えることができます。サポートされている言語については、Amazon Nova 2 Sonicのドキュメントを参照してください。