
2026年8月前半、Xで「Hiveで学ぶ分散JOINアルゴリズム」という全6回の連載を投稿しました。Xの記事機能を使った投稿を目にする機会が増え、筆者も試してみようと思ったのがきっかけです。本記事では、全6回へのリンクをまとめます。
連載一覧
この連載では、分散クエリエンジンがSQLのJOINをどのように処理するのかを、Apache Hiveの実装を題材に解説しています。
- Hiveで学ぶ分散JOINアルゴリズム #1: 分散並列処理の基本
- Hiveで学ぶ分散JOINアルゴリズム #2: Shuffle Sort Merge Join
- Hiveで学ぶ分散JOINアルゴリズム #3: Dynamically Partitioned Hash Join
- Hiveで学ぶ分散JOINアルゴリズム #4: Map Join
- Hiveで学ぶ分散JOINアルゴリズム #5: Bucket Map JoinとPartition-Aware Optimization
- Hiveで学ぶ分散JOINアルゴリズム #6: Sort Merge Bucket Join
全体の流れをつかむには、第1回から順に読むのがおすすめです。
今後も、分散システムの実装やOSS開発の裏話などを不定期に投稿する予定です。取り上げてほしい話題があれば、@okuminのDMまたはお問い合わせフォームからお便りください。お待ちしています!






