メイン コンテンツにスキップ
Google Cloud Documentation
ドキュメント
  • 開始する
  • Google Cloud を使ってみる
  • 商品リスト
  • Cloud カスタマーケア
  • 注目のプロダクト
  • Agent Platform
  • Apigee API 管理
  • BigQuery
  • Compute Engine
  • Cloud CDN
  • Cloud Run
  • Cloud Storage
  • Cloud SQL
  • Gemini Enterprise
  • Google Kubernetes Engine
  • Looker
  • プロダクト横断型のツール
  • アクセスとリソースの管理
  • 費用と使用量の管理
  • Infrastructure as code
  • SDK、言語、フレームワーク、ツール
  • テクノロジー分野
  • AI と ML
  • アプリケーション開発
  • アプリケーションのホスティング
  • コンピューティング
  • データ分析とパイプライン
  • データベース
  • 分散型クラウド、ハイブリッド クラウド、マルチクラウド
  • 業種別ソリューション
  • 移行
  • ネットワーキング
  • オブザーバビリティとモニタリング
  • セキュリティ
  • Storage
/
コンソール
  • English
  • Deutsch
  • Español – América Latina
  • Français
  • Indonesia
  • Italiano
  • Português – Brasil
  • עברית
  • 中文 – 简体
  • 中文 – 繁體
  • 日本語
  • 한국어
ログイン
  • Managed Service for Apache Spark
無料で利用開始
概要 ガイド リファレンス サンプル リソース
Google Cloud Documentation
  • ドキュメント
    • その他
    • 概要
    • ガイド
    • リファレンス
    • サンプル
    • リソース
  • コンソール
  • 概要
  • 主な概念
  • Managed Service for Apache Spark サーバーレス
    • 概要
    • Managed Service for Apache Spark のサーバーレス階層
  • クラスタ上の Managed Service for Apache Spark
  • サーバーレス デプロイとクラスタ デプロイを比較する
  • GKE 上の Managed Service for Apache Spark
  • 使ってみる
  • サーバーレス
    • サーバーレス Spark バッチ ワークロードを作成する
  • クラスタ
    • クラスタを作成する
    • クラスタに Spark ジョブを送信する
    • Spark チュートリアル
      • Gemini を使用して Spark アプリケーションを開発する
      • Spark で一般公開データセットを分析する
      • Spark MLlib を使用した感情分析
  • GKE
    • Kubernetes で Spark ジョブを実行する
  • 開発
  • サーバーレス
    • サーバーレスを構成する
      • カスタム コンテナを使用する
      • GPU を使用する
      • Dynamic Workload Scheduler を使用する
      • ネットワークの構成
      • Spark ランタイム バージョン
        • 概要
        • Spark ランタイム バージョン 3.0
        • Spark ランタイム バージョン 2.3
        • Spark ランタイム バージョン 2.2
        • Spark ランタイム バージョン 1.2
      • サービス アカウント
      • Spark プロパティ
      • ステージング バケット
    • バッチ ワークロードとセッションを作成する
      • サーバーレス Spark バッチ ワークロードを作成する
      • サーバーレス インタラクティブ セッションとセッション テンプレートを作成する
      • サーバーレス Spark Connect クライアントを使用する
      • サーバーレスのバッチ セッションとノートブック セッションで JupyterLab を使用する
      • サーバーレス テンプレートを使用する
        • 概要
        • Cloud Spanner to Cloud Storage
        • Cloud Storage to BigQuery
        • Cloud Storage to Cloud Spanner
        • Cloud Storage から Cloud Storage
        • Cloud Storage から JDBC
        • Hive から BigQuery へ
        • Hive to Cloud Storage
        • JDBC to BigQuery
        • JDBC to Cloud Spanner
        • JDBC to Cloud Storage
        • JDBC から JDBC
        • Pub/Sub から Cloud Storage
    • Lakehouse ランタイム カタログでメタデータを使用して Apache Iceberg テーブルを作成する
    • データを変換して Apache Iceberg に書き込む
    • BigQuery コネクタを Spark と使用する
      • 概要
      • BigQuery テーブルのクエリ
    • BigQuery Studio ノートブックで PySpark コードを実行する
    • 最適化する
      • ワークロード リソースを自動スケーリングする
      • Spark ワークロードを自動チューニングする
      • Lightning Engine を使用する
        • Lightning Engine でバッチ ワークロードとセッションを高速化する
        • ネイティブ クエリ実行の認定ツールを実行する
      • サーバーレス Spark ソリューション アクセラレータ
  • クラスタ
    • データ処理
      • Spark を構成する
        • Spark の依存関係を管理する
        • Spark 環境をカスタマイズする
        • 同時書き込みを有効にする
        • Spark のパフォーマンスを向上させる
        • Spark を調整する
        • Lightning Engine を使用する
      • Spark ジョブを実行する
        • コンソールを使用する
        • コマンドラインを使用する