Metadata-Version: 2.4
Name: sales-pipeline
Version: 0.1.5
Summary: Pipeline de traitement Spark Bronze / Silver / Gold
Author: Hugo Boulenger
Requires-Python: >=3.8
Description-Content-Type: text/markdown
Requires-Dist: pyspark
Requires-Dist: pyyaml
Provides-Extra: dev
Requires-Dist: pytest; extra == "dev"
Requires-Dist: build; extra == "dev"
Requires-Dist: wheel; extra == "dev"

# Sales Pipeline - Databricks

## But du projet
Pipeline de traitement des ventes en **3 couches** :
- **Bronze** : ingestion des CSV bruts depuis DBFS.
- **Silver** : nettoyage et harmonisation des données.
- **Gold** : agrégations et calculs pour analyse (CA, classement produits).

## Lancement

### Pipeline complet
Le fichier `main.py` permet de lancer le pipeline entier.

### Tests
Le fichier `launch_tests.ipynb` permet de lancer les tests.
