入门教程

部署 Spark 工作负载时,会将 IBM Analytics Engine Serverless 实例分配给随需应变的计算和内存资源。 当应用程序未处于运行状态时,不会为IBM Analytics Engine实例分配计算资源。 定价基于实例消耗的实际资源量,按每秒计费。

开始使用无服务器 IBM Analytics Engine 实例

IBM Analytics Engine Apache Spark 提供了在几秒内启动 IBM Analytics Engine 无服务器实例,使用您选择的库包对其进行定制以及运行 Spark 工作负载的能力。

目前,只能在美国南部区域中创建 IBM Analytics Engine 无服务器实例。

准备工作

要开始在 IBM Analytics Engine中运行 Spark 应用程序,您需要:

  • IBM Cloud® 帐户。
  • IBM Cloud Object Storage 中从 IBM Analytics Engine 实例引用的实例主存储器。 此存储器用于存储由应用程序和任何定制库集创建的 Spark 历史记录事件,这些事件需要可供 Spark 应用程序使用。
  • IBM Analytics Engine 无服务器实例。

供应实例并创建集群

配置IBM Analytics Engine实例:

  1. 基本了解体系结构和关键概念。 请参阅 无服务器实例体系结构和概念
  2. 供应无服务器实例

运行应用程序

要在无服务器 IBM Analytics Engine 实例中运行 Spark 应用程序:

  1. (可选) 授予用户对已供应实例的访问权以启用协作。 请参阅 管理用户对共享实例的访问权
  2. (可选) 定制实例以满足应用程序的需求。 请参阅 定制实例
  3. 使用 Spark 应用程序 REST API 提交 Spark 应用程序。 请参阅 运行 Spark 批处理应用程序
  4. 使用 Livy 批处理 API 提交 Spark 应用程序。 请参阅 使用 Livy API 运行 Spark 批处理应用程序

使用 Analytics Engine 无服务器 CLI 的端到端方案

为了帮助您快速入门,只需供应 Analytics Engine 实例并提交 Spark 应用程序,您可以使用 Analytics Engine 无服务器 CLI。

要了解从创建所需服务到使用 Analytics Engine CLI 提交和管理 Spark 应用程序所需的步骤的端到端方案,请参阅 创建服务实例并使用 CLI 提交应用程序