Flow Service APIを使用して、Azure HDInsights ベース接続にApache Sparkを作成します

NOTE
Azure HDInsights コネクタのApache Sparkはベータ版です。 ベータ版のラベル付きコネクタの使用について詳しくは、​ ソースの概要を参照してください。

ベース接続は、ソースと Adobe Experience Platform 間の認証済み接続を表します。

このチュートリアルでは、Flow Service APIを使用してAzure HDInsights (以下、「Spark」と呼ぶ)でApache Sparkのベース接続を作成する手順について説明します。

はじめに

このガイドは、Adobe Experience Platform の次のコンポーネントを実際に利用および理解しているユーザーを対象としています。

  • ソース:Experience Platform を使用すると、データを様々なソースから取得しながら、Experience Platform サービスを使用して受信データの構造化、ラベル付け、拡張を行うことができます。
  • サンドボックス:Experience Platform には、単一の Experience Platform インスタンスを別々の仮想環境に分割して、デジタルエクスペリエンスアプリケーションの開発と発展に役立つ仮想サンドボックスが用意されています。

次の節では、Flow Service APIを使用してSparkに正常に接続するために知っておく必要がある追加情報を示します。

必要な資格情報の収集

Flow Service を Spark に接続するには、次の接続プロパティの値を指定する必要があります。

資格情報
説明
host
Spark サーバーのIP アドレスまたはホスト名。
username
Spark サーバーへのアクセスに使用するユーザー名。
password
ユーザーに対応するパスワード。
connectionSpec.id
接続仕様は、ベース接続とソース接続の作成に関連する認証仕様などの、ソースのコネクタプロパティを返します。 Sparkの接続仕様IDは6a8d82bc-1caf-45d1-908d-cadabc9d63a6です

開始の詳細については、このSpark ドキュメント ​を参照してください。

Experience Platform APIの使用

Experience Platform APIの呼び出しを正常に行う方法について詳しくは、Experience Platform APIの概要に関するガイドを参照してください。

ベース接続の作成

ベース接続は、ソースの認証情報、接続の現在の状態、一意のベース接続IDなど、ソースとExperience Platform間の情報を保持します。 ベース接続 ID により、ソース内からファイルを参照および移動し、データタイプやフォーマットに関する情報を含む、取り込みたい特定の項目を識別することができます。

ベース接続 ID を作成するには、/connections エンドポイントに POST リクエストを実行し、Spark 認証資格情報をリクエストパラメーターの一部として使用します。

API 形式

POST /connections

リクエスト

次のリクエストは、Spark のベース接続を作成します。

curl -X POST \
    'https://platform.adobe.io/data/foundation/flowservice/connections' \
    -H 'Authorization: Bearer {ACCESS_TOKEN}' \
    -H 'x-api-key: {API_KEY}' \
    -H 'x-gw-ims-org-id: {ORG_ID}' \
    -H 'x-sandbox-name: {SANDBOX_NAME}' \
    -H 'Content-Type: application/json' \
    -d '{
        "name": "Spark test connection",
        "description": "A Spark test connection",
        "auth": {
            "specName": "HDInsights Basic Authentication",
        "params": {
            "host":  "{HOST}",
            "username": "{USERNAME}",
            "password":"{PASSWORD}"
            }
        },
        "connectionSpec": {
            "id": "6a8d82bc-1caf-45d1-908d-cadabc9d63a6",
            "version": "1.0"
        }
    }'
パラメーター
説明
auth.params.host
Spark サーバーのホスト。
auth.params.username
Spark接続に関連付けられているユーザー名。
auth.params.password
Spark接続に関連付けられているパスワード。
connectionSpec.id
Spark接続仕様ID: 6a8d82bc-1caf-45d1-908d-cadabc9d63a6

応答

リクエストが成功した場合は、一意の ID(id)を含む、新しく作成した接続の詳細が返されます。 このIDは、次のチュートリアルでデータを検索するために必要です。

{
    "id": "a45f2f58-e3a2-46ba-9f2f-58e3a2b6baf2",
    "etag": "\"900009d6-0000-0200-0000-5e8500010000\""
}

次の手順

このチュートリアルでは、Flow Service API を使用して Spark ベース接続を作成しました。 このベース接続 ID は、次のチュートリアルで使用できます。

recommendation-more-help
experience-platform-help-sources