Вводная часть
Для анализа данных я решила выбрать наборы данных с сайта Kaggle.com. Я заинтересовалась темой одежды и выбрал базу данных, связанную с ассортиментом одежды, выпускаемой компанией Myntra.

Логотип компании Myntra
Myntra — крупная индийская компания электронной коммерции в сфере моды со штаб-квартирой в Бангалоре, штат Карнатака, Индия.] Компания была основана в 2007 году для продажи персонализированных сувениров. В мае 2014 года Myntra.com была приобретена компанией Flipkart.
База данных

Датасет на сайте Kaggle.com
Для визуализации данных я использовала библиотеки Seaborn и Matplotlib, для анализа данных использовались библиотеки Scikit-learn и scipy.stats. Это позволит создавать удобные и красивые графики, чтобы отразить зависимости между данными.
База данных состоит из 12491 строк и 8 колонок, каждая строчка соответствует продукту компании и имеет такие показатели, как — номер, название и бренд продукта, гендер, цену, кол-во картинок, описание и цвет.
Среда разработки
Для выполнения анализа данных будем использовать среду разработки Jupyter Notebook
Jupyter Notebook — это интерактивная веб-приложение, которое позволяет создавать и использовать «ноутбуки» (отсюда и название). В этих ноутбуках можно объединить исполняемый код, текстовые описания, визуализации и другие мультимедийные элементы. Jupyter Notebook поддерживает более 40 языков программирования, включая Python, R и Julia.
Анализ данных
Для начала подключаем библиотеки, вот столько у меня их получилось в конечном итоге
Код № 1
Нам необходимо загрузить датасет и написать код, который описывает основные статистические характеристики данных и предоставляет информацию о типах данных и количестве непустых значений. Это важный шаг для первоначального анализа и понимания структуры данных. Выполнение этих шагов помогает подготовить данные для дальнейшего анализа и визуализации.
Код № 2
Выдача кода № 2
Выдача кода № 2
Выдача кода № 2
Для удобства анализа, мы будем работать только с колонками ProductID, Gender, Price (INR), PrimaryColor.
Код № 3
Код № 4
Выдача кода № 4
Вычислим сколько всего гендеров бывает в базе данных и построим две круговые диаграммы: кол-во продуктов для каждого гендера и средняя цена продуктов для каждого гендера.
Код № 5
Получились две диаграммы, но хотелось бы их стилизовать, используем стиль Pitaya smoothie.
Выдача кода № 5
Pitaya smoothie — профессиональная тема с тщательно подобранными цветами, вдохновленная модным цветом Pantone 2018 года.
Пример светлой темы стиля
Пример темной темы стиля
Код № 6
Теперь цвета на диаграммах выглядят поприятнее, но сами диаграммы не очень информативные, попробуем использовать другой вид диаграмм.




