AI モデルの監視 ai-model-observability

このページ: AI ランキングモデルの健全性、トレーニングステータス、パフォーマンスを監視します。これにより、ビジネス成果の向上を確認し、改善が見られない場合はトラブルシューティングできます。

マーケター、データサイエンティスト、決定管理者であっても、パーソナライズされた最適化モデルのパフォーマンスや動作を理解することで、AI を使用して顧客ごとに最適なオファーを選択できます。

これを行うには、Journey Optimizer で AI モデルの健全性、トレーニングステータス、進化を直接監視します。

これにより、モデルが機能しているかどうか、前回にトレーニングした日時、トレーニング中に発生した内容、ビジネス成果(例:コンバージョンや売上高)を推進している仕組みを明確に把握でき、機能していない場合はトラブルシューティングできます

AVAILABILITY
現在、この機能はパーソナライズされた最適化モデルでのみサポートされています。

➡️ ビデオでこの機能を確認する

トレーニングステータスの表示 from-ai-model-list

モデルは、ライブに設定されると、継続的なライフサイクルにエントリします。データが収集され、オファーのランキングを最適化するためにモデルが定期的に再トレーニングされます。パーソナライズされた最適化モデルのトレーニングステータスは、AI モデルリストで確認できます。

  1. 決定戦略設定AI モデル​に移動して、AI モデル在庫を開きます。

  2. 使用可能なすべての AI モデルとそのステータスを表示できます。

  3. パーソナライズされた最適化タイプの各​ライブ AI モデルについて、次の 2 つの列が表示されます。

    • 前回のトレーニングジョブが実行された日時(前回のトレーニング
    • 各モデルが正常にトレーニングされたかどうか(トレーニング結果)。

    これにより、さらなる調査やトラブルシューティングが必要なモデルをすばやく特定できます。

モデルステータスレポートへのアクセス access-ai-model-details

リストからパーソナライズされた最適化 AI モデルをクリックします。 そこから、以下に示す要素を表示できます。

  • 現在デプロイされているモデル - このセクションでは、現在デプロイされているモデル、デプロイされた日時、使用するデータの日付範囲、追加およびパーソナライズされている決定項目(オファー)の数、サブモデル間の現在のトラフィック配分を示します

    この例では、モデルは 5 つの決定項目でトレーニングされ、モデルには 3 つの決定項目についてパーソナライズされた予測を作成するのに十分なトラフィックがあります。残りの 2 つの決定項目はランダムに提供されます。

    また、モデルでは現在、パーソナライズされたニューラルネットワークに対するトラフィックの 40%、コンテキストバンディットに対するトラフィックの 40%、ランダムな探索に対するトラフィックの 20%を割り当てていることも参照できます。

  • 前回のトレーニングジョブ - このセクションでは、前回のトレーニングジョブのステータス、実行日時、エラーメッセージを示します。エラー状態の詳細情報

    この例では、デプロイされるモデルが期待どおりにトレーニングジョブと一致することが確認できます。

  • プロパティ - このセクションでは、使用されるデータセット、最適化指標、パーソナライズされた最適化モデルのトレーニングに使用されるオーディエンスなど、モデルのプロパティを示します。

    プロパティを編集」をクリックして、これらの要素を変更します。 AI モデルを作成画面にリダイレクトされます。詳細情報

  • Model performance - このセクションでは、各サブモデルのトラフィック配分やコンバージョン率など、モデルの各アームのパフォーマンスの推移を示します。過去 7 日間​と​ 過去 30 日間 ​を切り替えることができます。上昇率と統計的有意差は、モデルが実際にマーケティング成果を向上させるかどうかを判断するための重要な指標です。

    この例では、過去 30 日間で、パーソナライズされたサブモデルがコンバージョン率を 60%以上向上させていることがわかります。この向上は統計的に有意です。つまり、この AI モデルがビジネスの影響力を推進していることがわかります。

  • モデルのトラフィック配分の推移 - このセクションでは、モデルの進化の推移を示します。 モデルが最初にデプロイされた場合、オファーデータがまだ収集されていないので、トラフィックの 100%はランダムです。最初の再トレーニングの後、トラフィックは通常、パーソナライズされたアームに移行します。

    この例では、モデルが時間の経過と共に再トレーニングされたので、トラフィック配分が 100%のランダム探索からニューラルネットワークとコンテキストバンディットトラフィックに移行したことがわかります。

トレーニングエラーについて check-for-error-states

前回のトレーニングジョブが失敗した、パーソナライズされた最適化 AI モデルのエラーの詳細を表示するには、次の手順に従います。

  1. リストからモデルをクリックして開きます。モデルのステータスの詳細が表示されます。

    {width="95%"}

    この例では、前回のトレーニングジョブが失敗したので、モデルがデプロイされていないことがわかります。

    note
    NOTE
    モデルがデプロイされていない場合、決定リクエストは均一なランダムトラフィック割り当てを使用して提供されます。
  2. 前回のトレーニングジョブ」セクションでエラーの詳細を確認します。

    {width="70%"}

    通常、このモデルに対して選択したデータセットにフィードバックイベントがない場合、トレーニングジョブは失敗します。つまり、データセットにデータを入力するか、適切なコンバージョンイベントを含む新しいデータセットを選択する必要があります。

  3. モデルの​ プロパティ ​で選択されているデータセットを確認できます。「プロパティを編集」をクリックして、別のデータセットを選択します。詳細情報

    {align="center" width="45%"}

よくある質問 faq

監視できる AI モデルはどれですか?
AI モデル監視は現在、パーソナライズされた最適化モデルでのみサポートされています。その他のランキングモデルタイプでは、モデルステータスレポートがまだ公開されていません。
モデルのトレーニングジョブが失敗したのはなぜですか?
モデルに選択したデータセットにフィードバック(コンバージョン)イベントがないか、ほとんど発生しない場合、トレーニングジョブは失敗することがよくあります。 エラーについて詳しくは、「前回のトレーニングジョブ」セクションをチェックし、モデルの​ プロパティ ​をレビューして、データセットと最適化指標を確認します。データセットに適切なイベントを入力するか、適切なコンバージョンデータを含む別のデータセットを選択します。
AI モデル監視は、キャンペーンレポートとジャーニーレポートとどのように関連していますか?
AI モデル監視は、キャンペーンレポートやジャーニーレポートとは異なります。単一の AI モデルは、複数のキャンペーンまたは複数のジャーニーをまたいで使用でき、キャンペーンやジャーニーのレポートには、特定の配信に使用されたモデルが示されません。 AI モデルのステータスの監視を使用して、モデル自体を把握および監視します。配信レベルの指標には、キャンペーンレポートジャーニーレポートを使用します。
最適化指標は、売上高や注文額などの連続指標で、クリック数やコンバージョン数などのバイナリ指標ではありません。報告されたコンバージョン数とコンバージョン率の値は、どのように解釈すればよいですか?
売上高や注文額などの連続指標を使用する場合、モデルは(コンバージョン率ではなく)特定のオファーの表示に関連する推定値を予測しようとします。報告された「コンバージョン数」の値は、各モデルアームの記録されたオファー表示に関連付けられた合計売上高(または注文額)です。報告された「コンバージョン率」は、コンバージョン数の値を表示値で割った値で、連続指標の場合は 100%を超える場合があります。
上昇率の優位差とは何ですか?
上昇率の有意差とは、報告された上昇率とランダム探索の統計的有意差のことです。有意差は、比率の差に関するカイ二乗検定を使用して計算され、この計算結果は、2 つの母集団の比率の差に関する Z 検定での有意差の計算結果と一致します。
モデルのジニ係数とは何ですか?ジニ係数の「良い」値とは何ですか?
モデルのジニ係数(ジニ指数とも呼ばれる)は、モデルの予測能力をオフラインで測定する指標です。モデルのジニ係数は 0(予測能力なし)から 1(すべての顧客に対するすべてのオファーのコンバージョン数または指標の値を完全に予測)までの範囲です。決定のユースケースが異なればユーザーの行動も異なり、モデルの結果も異なるので、普遍的に「良い」ジニ係数の値というものは存在しません。同じユースケース内では、ジニ係数の値が高いほどモデルの品質が高いことを示します。
ジニ係数はどのように計算されますか?

各モデルアームのジニ係数は、最適化指標がバイナリ値か継続的な値かに応じて計算方法が異なります。

バイナリ最適化指標(例:クリック数、注文数):ジニ係数は、受信者操作特性(ROC)曲線の曲線下面積(AUC)に基づいて計算されます。通常、ROC AUC または単に AUC と呼ばれます。ROC AUC は、0.5(予測力がゼロのランダムモデル)から 1.0(完全な予測力)までの範囲です。ROC AUC は、Gini = 2 x (ROC AUC) - 1 の式を使用してジニ係数に変換されます。

継続的最適化指標(例:売上高、注文額):ジニ係数は、モデルの累積予測陽性数と母集団の累積真陽性数に関連するローレンツ曲線下面積に基づいて計算されます。ローレンツ曲線の下の面積は、0.0(完全な予測力)から 0.5(予測力がゼロのランダムモデル)までの範囲です。ローレンツ AUC は、Gini = 1 - 2 x (ローレンツ AUC) の式を使用してジニ係数に変換されます。

モデルの品質を測るより良い指標は、ジニ係数または上昇率/上昇率の有意差ですか?
一般的に、上昇率や上昇率の有意差などオンライン上のモデル品質指標は、モデル品質を測定するための「ゴールドスタンダード」な方法と見なされています。ジニ係数は、決定モデルを評価する顧客データサイエンスチームに対して追加のデータポイントを提供すると報告されています。

チュートリアルビデオ video

Journey Optimizer で AI ランキングモデルを監視し、トレーニングステータスやパフォーマンスを解釈する方法について説明します。

recommendation-more-help
journey-optimizer-help