Описание концепции
Отправной точкой стало расхожее убеждение, что быстрый танец куда сложнее медленного. Я решила проверить, подтверждается ли это данными. Датасет позволил сопоставить темп и уровень сложности обучения. И оказалось, что никакой связи между ними нет, так как корреляция оказалась совсем мала.
Это и стало концепцией. Инфографика не иллюстрирует известный факт, а опровергает заблуждение.
Исходные данные
Датасет был взят с платформы Kaggle. В исходном виде он содержал 206 строк и 18 колонок, а именно название танца, тип, страна происхождения, эпоха, темп в ударах в минуту, уровень сложности обучения, формация, музыкальный жанр, возрастная группа и несколько текстовых описательных полей.
Для визуализации были отобраны четыре поля — Tempo (BPM), Learning Difficulty, Dance Formation и Dance Type. Текстовые описания, поле Origin и числовой индекс Hardness Ratio исключены как ненадёжные или искажающие картину.
Первичный график был построен в DataWrapper как диаграмма рассеяния, по оси X темп в BPM, по оси Y уровень сложности. Был добавлен вертикальный джиттер (небольшое случайное смещение по оси Y, которое визуально разделяет точки, не искажая данные). После этого точки распределились по полю, цвет был привязан к типу танца, и паттерн стал читаемым.

Инфографика
Постер построен на scatter plot. Каждая точка иллюстрирует один танцевальный стиль, горизонтальная ось — темп в BPM, а вертикальная показывает уровень сложности обучения.
Точки равномерно заполняют всё поле, визуально подтверждая отсутствие закономерности.
Типографика встроена в само облако точек. Текст находится в том же пространстве, что и данные. Заголовок вынесен в низ постера и читается последним, как итог, к которому зритель приходит через весь визуал.
Инфографика на носителях
Инфографика выполнена в формате вертикального постера А2. Большой формат позволяет читать как общую картину издалека, так и отдельные точки и текстовые врезки вблизи.
Процесс создания и ИИ-пайплайн
Работа началась с поиска датасета и оценки его пригодности, и после выбора датасета потребовалась очистка. Часть колонок была исключена, категории нормализованы, добавлена колонка с джиттером для корректного отображения на диаграмме рассеяния.
Затем был построен первичный график в Datawrapper, настроены оси, цвета и подписи к ключевым точкам.
Финальный постер собран в Figma. Был импортирован график, добавлены заголовок и мелкая типографика.




