2025/2026
Автоматизированный сбор больших данных в экономико-социологических исследованиях
Статус:
Маго-лего
Онлайн-часы:
50
Охват аудитории:
для всех кампусов НИУ ВШЭ
Язык:
русский
Контактные часы:
60
Программа дисциплины
Аннотация
Стремительный рост технологий привел к тому, что в данный момент исследователи имеют доступ к данными о самых разных аспектах жизни людей и о происходящих экономических и социальных процессах. Подобные данные отличаются большими объемами, разной степенью структурированности, многомерностью и специфическими формами хранения и доступа, и требуют от исследователя дополнительных навыков по сбору и обработке подобных данных. Курс направлен на знакомство с особенностями сбора и анализа больших данных в экономико-социологических исследованиях. Первая часть курса посвящена основам работы в среде R: элементы синтаксиса, объекты и структуры данных, манипуляции с данными. Вторая часть курса посвящена импорту и препроцессингу данных из разных источников - файловые базы данных разных форматов (в том числе *.sav), удаленные базы данных. Отдельное внимание уделено скрапингу данных веб-страниц, работе с открытыми API, в том числе с API социальных сетей (в частности, Vkontakte). В третьей части курса рассмотрены методы и принципы визуализации данных (статичные и интерактивные графики).