Amazon Novaによる選択的忘却の実現: モデルに忘れさせる技術
サマリー
Amazon Novaは、選択的忘却を実現する新技術rDPOを導入しました。この技術により、モデルの過剰な拒否を減少させつつ、品質を保持することが可能です。CCMSを通じて、顧客は安全策を調整し、ビジネスニーズに応じたコンテンツ生成が行えます。
本文
基盤モデル(FM)を展開する組織は、コンテンツモデレーションのために設計されたモデルの安全策が、正当なビジネスクリティカルなユースケースを妨げるという共通の課題に直面しています。例えば、メディア企業が成熟した言語でスクリプトを要約する際や、サイバーセキュリティ企業が現実の脅威をシミュレーションする際、法務チームが機密証拠を処理する際に、デフォルトのコンテンツモデレーションコントロールが必要なコンテンツを拒否することがあります。この問題を解決するために、Amazon Novaのカスタマイズ可能なコンテンツモデレーション設定(CCMS)を通じて、選択的に安全策を調整できる新しい技術「Reverse Direct Preference Optimization(rDPO)」を導入しました。この技術により、モデルの品質を保ちながら過剰な拒否を減少させることが可能になります。CCMSは、危険な活動や敏感なコンテンツ、公平性、セキュリティに関する4つの責任あるAI(RAI)柱に基づいています。rDPOは、モデルのパラメータから学習した行動を選択的に削除する技術であり、顧客が承認したポリシー領域でコンテンツを生成できるカスタムモデルを提供します。