harvard-art-museums-data-pipeline
Installation
SKILL.md
Harvard Art Museums Data Pipeline
Skill by ara.so — Data Skills collection.
This skill enables you to build production-ready data engineering pipelines using the Harvard Art Museums API. It covers ETL workflows, relational database design, SQL analytics, and interactive Streamlit dashboards for artifact data visualization.
What This Project Does
The Harvard-Artifacts-Collection-Data-Engineering-Analytics-App demonstrates a complete data pipeline:
- Extract: Fetches artifact data from Harvard Art Museums API with pagination and rate limiting
- Transform: Converts nested JSON into normalized relational tables
- Load: Batch inserts data into MySQL/TiDB Cloud databases
- Analyze: Executes analytical SQL queries for insights
- Visualize: Renders interactive dashboards with Plotly and Streamlit
The architecture follows: API → ETL → SQL → Analytics → Visualization