Flow Service APIを使用して、Azure HDInsights ベース接続にApache Sparkを作成します
ベース接続は、ソースと Adobe Experience Platform 間の認証済み接続を表します。
このチュートリアルでは、Flow Service APIを使用してAzure HDInsights (以下、「Spark」と呼ぶ)でApache Sparkのベース接続を作成する手順について説明します。
はじめに
このガイドは、Adobe Experience Platform の次のコンポーネントを実際に利用および理解しているユーザーを対象としています。
次の節では、Flow Service APIを使用してSparkに正常に接続するために知っておく必要がある追加情報を示します。
必要な資格情報の収集
Flow Service を Spark に接続するには、次の接続プロパティの値を指定する必要があります。
hostusernamepasswordconnectionSpec.id6a8d82bc-1caf-45d1-908d-cadabc9d63a6です開始の詳細については、このSpark ドキュメント を参照してください。
Experience Platform APIの使用
Experience Platform APIの呼び出しを正常に行う方法について詳しくは、Experience Platform APIの概要に関するガイドを参照してください。
ベース接続の作成
ベース接続は、ソースの認証情報、接続の現在の状態、一意のベース接続IDなど、ソースとExperience Platform間の情報を保持します。 ベース接続 ID により、ソース内からファイルを参照および移動し、データタイプやフォーマットに関する情報を含む、取り込みたい特定の項目を識別することができます。
ベース接続 ID を作成するには、/connections エンドポイントに POST リクエストを実行し、Spark 認証資格情報をリクエストパラメーターの一部として使用します。
API 形式
POST /connections
リクエスト
次のリクエストは、Spark のベース接続を作成します。
curl -X POST \
'https://platform.adobe.io/data/foundation/flowservice/connections' \
-H 'Authorization: Bearer {ACCESS_TOKEN}' \
-H 'x-api-key: {API_KEY}' \
-H 'x-gw-ims-org-id: {ORG_ID}' \
-H 'x-sandbox-name: {SANDBOX_NAME}' \
-H 'Content-Type: application/json' \
-d '{
"name": "Spark test connection",
"description": "A Spark test connection",
"auth": {
"specName": "HDInsights Basic Authentication",
"params": {
"host": "{HOST}",
"username": "{USERNAME}",
"password":"{PASSWORD}"
}
},
"connectionSpec": {
"id": "6a8d82bc-1caf-45d1-908d-cadabc9d63a6",
"version": "1.0"
}
}'
auth.params.hostauth.params.usernameauth.params.passwordconnectionSpec.id6a8d82bc-1caf-45d1-908d-cadabc9d63a6。応答
リクエストが成功した場合は、一意の ID(id)を含む、新しく作成した接続の詳細が返されます。 このIDは、次のチュートリアルでデータを検索するために必要です。
{
"id": "a45f2f58-e3a2-46ba-9f2f-58e3a2b6baf2",
"etag": "\"900009d6-0000-0200-0000-5e8500010000\""
}
次の手順
このチュートリアルでは、Flow Service API を使用して Spark ベース接続を作成しました。 このベース接続 ID は、次のチュートリアルで使用できます。