Исходный размер 1750x2480

Waterparks: статистика прослушивания

Концепция

Waterparks — популярная американская поп-панк группа, активная с 2011 года. Их музыкальный стиль сильно менялся со временем, и прямо сейчас они находятся в новой переломной точке для своего творчества. Именно поэтому мне хочется проанализировать количество прослушиваний сквозь всю дискографию группы — мне было бы интересно соотнести получившиеся результаты с их новым релизом, когда он выйдет.

Для анализа я собрала датасет из треков, дат их выпуска, их отношения к альбому или эре, количеству прослушиваний на Spotify и других интересовавших меня параметров. Источники информации: Genius, Spotify, Kworb, страница Waterparks на Band Wiki и AZLyrics. Для форматирования данных я использовала ChatGPT:

Исходный размер 1800x1033

Этапы работы

Для обработки данных я пользовалась ChatGPT. В промптах я указывала, какие данные из таблицы нужно проанализировать, к какому виду их привести и как оформить.

Исходный размер 1800x178

В процессе я корректировала промпты, чтобы уточнять детали графиков, править визуализацию и расширять или сужать выборку информации.

Исходный размер 1800x120

Стилизация

Исходный размер 1800x900

Для стилизации графиков я использовала цвета с обложек альбомов Waterparks, а так же шрифт, вдохновлённый почерком вокалиста Остена Найта, кириллическую версию ( = модификацию найденного в интернете латинского шрифта) которого я сделала сама.

Исходный размер 1800x350

Графики

Первая диаграмма — линейная, чтобы быстро сравнить, какие релизы Waterparks набрали больше прослушиваний.

Исходный размер 1216x542

Этот график сильно меня расстроил, потому что крайний альбом Waterparks — Intellectual Property — на мой взгляд, самый сильный, и поэтому заслуживает намного большего внимания.

Исходный размер 1800x1099
Исходный размер 1800x91

Порядок действий в коде выше (ChatGPT):

  1. Загружаю таблицу из Google Sheets (скачиваю как .xlsx) и читаю лист Tracks через Pandas.
  2. Оставляю нужные строки (только релизы Waterparks) и привожу колонку со стримами к числовому формату.
  3. Группирую данные по релизу (альбом/EP) и считаю сумму стримов по всем трекам внутри каждого релиза.
  4. Сортирую релизы по суммарным стримам (по убыванию), чтобы получить рейтинг.
  5. Создаю горизонтальную столбчатую диаграмму: по оси Y — названия релизов, по оси X — сумма прослушиваний.
  6. Назначаю каждому релизу свой цвет (заранее заданная палитра).
  7. Настраиваю оформление: чёрный фон, белый текст, нужный шрифт, аккуратные вертикальные линии-сетки, убираю рамку.
  8. Добавляю заголовок и подпись оси X («Всего прослушиваний») и показываю график.

В случае Waterparks с помощью этого графика можно отследить и количество прослушиваний с течением времени: название каждого нового их релиза начинается со следующей буквы английского алфавита, поэтому альбомы легко рассортировать по порядку выхода.

Вторая диаграмма — точечный график популярности треков по датам релиза. Несмотря на то, что предыдущий график тоже даёт эту информацию, мне хотелось наглядно это подтвердить.

Исходный размер 1407x637
Исходный размер 1800x675

Третий график — тепловая карта. График показывает, какие по счёту внутри альбома треки набрали наибольшее количество прослушиваний.

Исходный размер 1155x557

Интересно, что сильнее всего здесь выделяются не самые популярные треки, а наименее популярный трек за всю дискографию группы — 7-ой трек в альбоме FANDOM. Песня называется Group Chat и длится всего 14 секунд — в ней участники группы по очереди называют свои имена.

Исходный размер 1723x743

Порядок действий в коде (ChatGPT):

  1. Загружаю таблицу из Google Sheets и читаю лист Tracks через Pandas.
  2. Оставляю только нужные релизы (альбомы) и привожу стримы к числам.
  3. Определяю порядок треков: беру колонку с номером трека, а если её нет — создаю номер по порядку строк внутри каждого альбома.
  4. Строю сводную таблицу (pivot): строки = альбомы, колонки = номер трека, значения = стримы.
  5. Делаю шкалу удобной для сравнения: применяю log10(стримов), чтобы большой разброс не “сломал” цвета.
  6. Рисую heatmap через imshow: каждая ячейка — один трек в альбоме, цвет показывает уровень прослушиваний.
  7. Ставлю кастомную палитру: красный = низкие, жёлтый = средние, зелёный = высокие значения.
  8. Выравниваю сетку: включаю линии по границам ячеек, чтобы квадраты были ровные и аккуратные.
  9. Добавляю подписи осей (“Номер трека”, названия альбомов), цветовую шкалу справа и оформляю стиль (чёрный фон, белый текст, без рамки).

Четвёртый график — круговые диаграммы, показывающие долю топ-треков внутри альбомов.

Waterparks: статистика прослушивания
Проект создан 17.01.2026
Мы используем файлы cookies для улучшения работы сайта НИУ ВШЭ и большего удобства его использования. Более подробную...
Показать больше