Разделить — применить — объединить
Модель, лежащая в основе каждого groupby
«Разделить — применить — объединить» — бесплатный урок Data Science Academy на CoddyKit. Это урок 1 из 4. Ты можешь прочитать весь урок бесплатно ниже — а потом практиковать его прямо в браузере с встроенным редактором кода и ИИ-репетитором 24/7. Это часть пути обучения Data Science Academy, и твой прогресс синхронизируется между веб-версией и приложением CoddyKit. Курс Data Science Academy содержит 4 уроков всего.
Части этого урока еще не переведены и отображаются на английском.
One Idea, Three Steps
Every groupby follows one rhythm: split the rows into groups, apply a calculation to each, then combine the answers back together. 🔁
Split: Cut by a Key
The split step partitions rows by a key column, so all rows sharing the same value land in the same little group.
groups = df.groupby("city")Apply: Do Work Per Group
In the apply step, the same function runs on each group on its own, never mixing one group with another.
df.groupby("city")["sales"].mean()Combine: Stitch Results
The combine step glues each group result into one tidy output, indexed by the group keys you split on.
groupby Is Lazy
Calling groupby alone does almost nothing; it just remembers the plan. The real work waits until you add an aggregation.
g = df.groupby("city") # no math yetThe Group Key Becomes the Index
After aggregating, your group key moves into the result index, so each unique value labels one output row.
Pick a Column to Aggregate
Select a column after grouping to focus the math. Here you ask for the average sales within each city.
df.groupby("city")["sales"].mean()size Counts Rows Per Group
Use size when you just want how many rows fell into each group, including any missing values.
df.groupby("city").size()Iterating Over Groups
You can loop a groupby to inspect it: each turn hands you the group name and the matching sub-table.
for name, part in df.groupby("city"):
print(name, len(part))Why It Beats Manual Loops
Split-apply-combine replaces slow hand-written loops with one fast, readable line that pandas optimizes for you. ⚡
A Tiny End-to-End Example
This single line splits by region, averages each group, and combines the result, all in one readable expression.
df.groupby("region")["revenue"].mean()Quick Check
Which step actually does the calculation?
Recap: The groupby Rhythm
You learned the heartbeat of grouping: split, apply, combine. Master this rhythm and every aggregation later feels natural. 🎯
Часто задаваемые вопросы
Урок «Разделить — применить — объединить» бесплатный?
Да — полный текст урока «Разделить — применить — объединить» бесплатно доступен здесь в веб-версии. Чтобы практиковать его интерактивно (встроенный редактор кода и ИИ-репетитор 24/7) и разблокировать остальной курс Data Science Academy, подпишись на CoddyKit PRO. Курс Data Science Academy содержит 4 уроков всего.
Чему я научусь в уроке «Разделить — применить — объединить»?
Модель, лежащая в основе каждого groupby Ты практикуешь Data Science Academy с помощью реального кода, который запускаешь прямо в браузере, и ИИ-репетитор 24/7 отвечает на твои вопросы во время урока.
Нужен ли мне опыт, чтобы начать Data Science Academy?
Предыдущий опыт не требуется. Data Science Academy на CoddyKit структурирован для всех уровней — от новичков до продвинутых, поэтому ты можешь начать отсюда или с самого начала и учиться в своем темпе. Это урок 1 из 4.
Сколько времени занимает урок «Разделить — применить — объединить»?
Большинство уроков CoddyKit занимают около 5–10 минут. Каждый из них компактный и интерактивный, поэтому ты постоянно делаешь прогресс и продолжаешь с того же места в веб-версии и приложении.
Можно ли писать и запускать код в этом уроке Data Science Academy?
Да. Каждый урок Data Science Academy включает встроенный редактор кода, поэтому ты пишешь и запускаешь реальный код прямо в браузере и получаешь моментальную обратную связь от AI — локальная установка не требуется.
Все уроки этого курса
- Разделить — применить — объединить
- Несколько агрегатных операций с помощью agg
- Группировка по нескольким ключам
- transform для признаков внутри групп