Ravindra Bagale · Data Scienceसर्व coursesया course चे lessonsशोधाEnglish

Data Science · मराठी आवृत्ती

7.2 अनेक keys आणि named aggregation

रवींद्र बागले यांच्या course वर आधारित · सहज मराठीत explanation

City आणि festival अशी दोन keys वापरून प्रत्येक जोडीची summary बनवू. Output columns ना सुरुवातीपासून स्पष्ट नावं देऊ:

summary = (
    df.groupby(["city", "festival"], as_index=False)
      .agg(
          gmv=("amount", "sum"),
          orders=("order_id", "nunique"),
          avg_ticket=("amount", "mean"),
      )
)
summary.sort_values("gmv", ascending=False)

Jupyter मध्ये steps

  1. मागच्या lesson मधला df तयार करा.
  2. groupby("city")["amount"].sum() run करा.
  3. वरची named aggregation वापरून summary बनवा.
  4. summary[summary["festival"] == "Diwali"] वापरून filter करा.

काल्पनिक sample मध्ये Pune चा Diwali GMV हा त्याच्या None group पेक्षा जास्त आहे. Nashik ची Diwali row दिसेल; त्याच city ची None row या sample मध्ये नसल्यामुळे Nashik साठी तुलना करता येत नाही.