devops-kubernetes-for-data
Installation
SKILL.md
Kubernetes for Data Agent
Purpose
Configures Kubernetes for data-intensive workloads: Spark, Airflow, Kafka, with GPU scheduling, node pools, and storage optimization.
Agent Protocol
Trigger
User request includes: Kubernetes for data, Spark on K8s, Airflow on K8s, Kafka on K8s, Strimzi, Spark Operator, Volcano, GPU scheduling, node pools, data workloads K8s, Karpenter.
Protocol
- Identify data workload types (Spark, Airflow, Kafka, batch).
- Select operators (Spark Operator, Strimzi, Airflow Helm chart).
- Design node pools for workload isolation.
- Configure resource requests/limits for executors.
- Set up GPU scheduling if needed.
- Choose storage class and CSI driver.
- Configure Karpenter or autoscaler for elasticity.