Docker.ipynbをもとに環境構築をお願いします。
- 「DX(デジタルトランスフォーメーション)のためのビッグデータ活用とデータ活用企画のつくりかたまで」 https://www.udemy.com/course/dx-bigdata/?referralCode=B9C9B09E1333C4C3FA49
- 「データサイエンスのための前処理入門PythonとSparkで学ぶビッグデータエンジニアリング(PySpark) 速習講座」 https://www.udemy.com/course/python-spark-pyspark/?referralCode=E67BF8B61F65866794EB
※コース内では簡易インストール(Dockerを使わないインストール)を用いた解説を行なっていますが、本手順でも大きな差はなく受講可能です。
-
「【PythonとSparkで始めるデータマネジメント入門】 ビッグデータレイクのための統合メタデータ管理入門」 https://www.udemy.com/course/draft/4367192/?referralCode=AB48AD18D10E55DCB0E5
-
「【データサイエンスのためのストリーミング前処理入門 PythonとSparkで始めるビッグデータストリーミング処理入門」 https://www.udemy.com/course/python-spark-streaming/?referralCode=F5E3B429A5C47468BDAD
-
「超速入門!【データサイエンスへの最初の一歩】PythonとSparkで学ぶデータ分析のための前処理と分散処理 一気見講座」 https://www.udemy.com/course/draft/4415660/?referralCode=EF89D5D240FB483AF4A1
変更履歴
- 2024/03/31 : Sparkのバージョン固定
- 2025/04/12 : JDKのDockerリポジトリ変更の対応をしました。