How to get data ready for NannyML
Step 1: Have a trained model (prerequisite)
import pandas as pd
url = 'https://raw.githubusercontent.com/NannyML/sample_datasets/main/banana_quality/banana_quality.csv'
data = pd.read_csv(url)
train_df, test_df, monitor_df = data.iloc[0:4000], data.iloc[4000:6000], data.iloc[6000:8000]data.head()Identifier
Timestamp
Size
Weight
Sweetness
Softness
HarvestTime
Ripeness
Acidity
Quality
Step 2: Building a reference dataset
Identifier
Timestamp
Size
Weight
Sweetness
Softness
HarvestTime
Ripeness
Acidity
Quality
y_pred_proba
y_pred
Step 3: Setting up the monitored dataset
Identifier
Timestamp
Size
Weight
Sweetness
Softness
HarvestTime
Ripeness
Acidity
Quality
y_pred_proba
y_pred
Regression Model - Required columns
Column
Reference
Monitored
Classification Model - Required Columns
Column
Reference
Monitored