Community研究&データ分析github.com

Oak-B/bigdata-analysis-skill

Hive/Impala/Spark ETLのためのAIコーディングスキル — HDFS/YARNでのサイレントデータバグを防ぐ10のルール。

bigdata-analysis-skill とは?

Oak-B/bigdata-analysis-skillは、ビッグデータETL開発に特化したAIコーディングスキルであり、特にHive、Impala、Sparkフレームワークを対象としています。このスキルは、HDFSおよびYARN環境でのサイレントデータバグ(silent data bugs)を防ぐために、10の厳選されたルールを提供します。これらのバグは検出が難しく、深刻なデータ品質問題を引き起こす可能性があります。クエリ作成、データパーティション管理、リソース最適化、タスクスケジューリングに至るまで、ベストプラクティスをカバーし、実行可能なコード提案と最適化戦略を提供します。データエンジニア、データアナリスト、AIエージェント開発者など、誰でもこのスキルから恩恵を受けることができ、特に安定した効率的なデータパイプラインを構築する際に役立ちます。Claude Code、Cursor、Codexなどの主要なAIコーディングプラットフォームをサポートしており、ユーザーはシンプルなプロンプトでこれらのルールを有効にし、より堅牢なETLコードをレビューまたは生成できます。これらのルールに従うことで、データの不整合や損失による本番障害を大幅に削減し、データパイプラインの信頼性と保守性を向上させることができます。

対応~Claude Code~Codex CLI~Cursor
npx skills add Oak-B/bigdata-analysis-skill

Installed? Explore more 研究&データ分析 skills: obra/superpowers, affaan-m/quarkus-verification, affaan-m/uspto-database · View all 6 →

お気に入りのAIに質問する

このエージェントスキルを事前に読み込んだ状態で新しいチャットを開きます。

ドキュメント

bigdata-analysis-skill は何をしますか?

AI coding skill for Hive/Impala/Spark ETL — 10 rules to prevent silent data bugs on HDFS/YARN

関連スキル