使用程式庫集

建立程式庫集之後,您可以在 Spark 應用程式中參照並使用它。 當您在 IBM Analytics Engine 實例中執行 Spark 應用程式時,會從實例起始目錄載入程式庫集,並使其可供 Spark 應用程式使用。

在 Spark 應用程式中使用 Spark 應用程式提交有效負載的 "conf" 區段中的 "ae.spark.librarysets" 參數來參照程式庫集。

若要在提交 Spark 應用程式時參照程式庫集,請執行下列動作:

  1. 取得 IAM 記號。 請參閱 擷取 IAM 存取記號

  2. 發出下列 cURL 指令:

    curl -X POST https://api.us-south.ae.cloud.ibm.com/v3/analytics_engines/<instance_id>/spark_applications --header "Authorization: Bearer <IAM token>" -H "content-type: application/json"  -d @submit-spark-app.json
    

    submit-spark-app.json:

    {
      "application_details": {
      "application": "cos://<bucket-name>.<cos-name>/my_spark_application.py",
      "arguments": ["arg1", "arg2"],
      "conf": {
        "spark.hadoop.fs.cos.<cos-name>.endpoint":"https://s3.us-south.cloud-object-storage.appdomain.cloud",
        "spark.hadoop.fs.cos.<cos-name>.access.key":"<access_key>",
        "spark.hadoop.fs.cos.<cos-name>.secret.key":"<secret_key>",
        "ae.spark.librarysets":"my_library_set"
        }
    }
    }
    

    目前,在 Spark 應用程式提交期間,只能在 "ae.spark.librarysets" 屬性下參照一個程式庫集。

    如果接受應用程式,您會收到類似下列的回應:

    {
      "id": "87e63712-a823-4aa1-9f6e-7291d4e5a113",
      "state": "accepted"
    }
    
  3. 透過呼叫應用程式狀態 REST API 來追蹤應用程式的狀態。 請參閱 取得應用程式的狀態