Способы визуального представления данных. Методы визуализации

    Визуализация - ИЗОБРАЖЕНИЙ 24. Визуализация Display Визуальное представление данных Источник: ГОСТ 27459 87: Системы обработки информации. Машинная графика. Термины и определения …

    Способ отображения информации о состоянии технологического оборудования и параметрах технологического процесса на мониторе компьютера или операторской панели в системе автоматического управления в промышленности, предусматривающий также… … Википедия

    В общем смысле метод представления информации в виде оптического изображения (например, в виде рисунков и фотографий, графиков, диаграмм, структурных схем, таблиц, карт и т. д.). Очень эффективно визуализация используется для представления… … Словарь бизнес-терминов

    Египетские иероглифы позволяли интуитивно наглядно описывать понятия … Википедия

    Визуализация типовой формы - 98. Визуализация типовой формы Form flash Визуальное представление типовой формы Источник: ГОСТ 27459 87: Системы обработки информации. Машинная графика. Термины и определения … Словарь-справочник терминов нормативно-технической документации

    Визуализация - (лат. visualis зрительный) 1. формирование зрительного наглядного или мысленного образа (например, можно «воочию» представить себе страницу книги, где находится нужный текст); 2. в психопатологии присоединение к нарушениям мышления зрительных… … Энциклопедический словарь по психологии и педагогике

    ГОСТ 27459-87: Системы обработки информации. Машинная графика. Термины и определения - Терминология ГОСТ 27459 87: Системы обработки информации. Машинная графика. Термины и определения оригинал документа: 5. Абсолютная команда визуализации Absolute command Команда визуализации, в которой используются абсолютные координаты… … Словарь-справочник терминов нормативно-технической документации

    Содержание 1 Как это работает 2 Безопасность 3 Действующие службы передачи дорожной … Википедия

    извлечение информации из данных - разведка данных Технология анализа хранилищ данных, базирующаяся на методах ИИ и инструментах поддержки принятия решений. Процесс обнаружения корреляции, тенденций, шаблонов, связей и категорий. Выполняется путем тщательного исследования данных с … Справочник технического переводчика

    Тип Сист … Википедия

Книги

  • , Кабаков Роберт И.. R -это мощный язык для статистических вычислений и графики, который может справится поистине с любой задачей в области обработки данных. Он работает во всех важных операционных системах и…
  • R в действии. Анализ и визуализация данных на языке R , Роберт И. Кабаков. R– это мощный язык для статистических вычислений и графики, который может справиться поистине с любой задачей в области обработки данных. Он работает во всех важныхоперационных системах и…

Поговорка «лучше один раз увидеть, чем сто раз услышать» отражает суть такого процесса как визуализация.

Визуализация (от лат. visualis , «зрительный») - общее название приёмов представления числовой информации или физического явления в виде, удобном для зрительного наблюдения и анализа (wikipedia).

Что такое визуализация? Само по себе понятие является достаточно многогранным, существует несколько определений в зависимости от того, о каком поле деятельности идет речь. Целью визуализации является передача данных. Визуализация информации - это процесс представления абстрактных данных в виде изображений, которые могут помочь в понимании смысла данных. (FB.ru)

Не только дети, но и многие люди плохо воспринимают информацию на слух, часть ее не распознается и теряется, часть воспринимается неверно, сухой монолог быстро утомляет, может вызывать демотивирование обучающихся. Визуализация подаваемого материала обеспечивает наглядность, четкое восприятие и понимание, возможность многократного обращения к представленной информации, возможность сравнения с предыдущей и последующей информацией.

Выделяют следующие Методы визуализации:

1 Рисунок

Рисунок, видимо, был первой в мире сознательной попыткой визуализации образов для их демонстрации другому человеку.

2 График

Графики предназначены прежде всего для иллюстрирования математических понятий, функциональных зависимостей или связей между объектами.

3 Диаграмма

Диаграммы позволяют иллюстрировать количественные соотношения в определённой области.

4 Фотография

5 Карта (wikipedia).

Включение визуализации в образовательный процесс позволяет активно задействовать мощный зрительный канал получения информации. Помимо более понятной и наглядной формы получения информации, происходит дополнительная активизация нервной системы, обеспечивающая повышенное внимание и концентрацию учащихся на предмете изучения.

Есть еще один важный эффект визуализации. Оформляя результаты самостоятельного обсуждения новой темы, учащиеся подключают к обучению мощнейший потенциал творчества. Поиск оригинальных форм отражения результатов работы команды, реализация в этом процессе всех своих способностей, свободное самовыражение и связанные с этим яркие положительные эмоции обеспечивают эффективное усвоение и надежное закрепление новых знаний и умений!

Для визуализации в образовательном процессе можно использовать привычные цветные мелки, разноцветные карточки, наклейки, вырезки из журналов, акварельные краски, материалы для лепки и другие подходящие для этой цели предметы. Театрализация представления результатов обсуждения также обеспечит яркий визуальный эффект и прочное запоминание материала. На самом деле, варианты представления процесса и результатов обучения безграничны, точнее, определяются задачами каждого раздела урока и ограничиваются исключительно фантазией педагога, обучающихся и ресурсными возможностями.

Активные методы представления информации, различные техники и способы визуализации материала оживляют образовательный процесс, позитивно воспринимаются обучающимися и положительно сказываются на результатах обучения. Не жалейте времени на планирование и осуществление на уроке данного процесса!

Скачать:


Предварительный просмотр:

Визуализация

Поговорка «лучше один раз увидеть, чем сто раз услышать» отражает суть такого процесса как визуализация.

Визуализация (от лат. visualis , «зрительный») - общее название приёмов представления числовой информации или физического явления в виде, удобном для зрительного наблюдения и анализа (wikipedia).

Что такое визуализация? Само по себе понятие является достаточно многогранным, существует несколько определений в зависимости от того, о каком поле деятельности идет речь. Целью визуализации является передача данных. Визуализация информации - это процесс представления абстрактных данных в виде изображений, которые могут помочь в понимании смысла данных. (FB.ru)

Не только дети, но и многие люди плохо воспринимают информацию на слух, часть ее не распознается и теряется, часть воспринимается неверно, сухой монолог быстро утомляет, может вызывать демотивирование обучающихся. Визуализация подаваемого материала обеспечивает наглядность, четкое восприятие и понимание, возможность многократного обращения к представленной информации, возможность сравнения с предыдущей и последующей информацией.

Выделяют следующие Методы визуализации:

1 Рисунок

Рисунок, видимо, был первой в мире сознательной попыткой визуализации образов для их демонстрации другом у человеку.

2 График

Графики предназначены прежде всего для иллюстрирования математических понятий, функциональных зависимостей или связей между объектами.

3 Диаграмма

Диаграммы позволяют иллюстрировать коли чественные соотношения в определённой области.

4 Фотография

5 Карта (wikipedia).

Включение визуализации в образовательный процесс позволяет активно задействовать мощный зрительный канал получения информации. Помимо более понятной и наглядной формы получения информации, происходит дополнительная активизация нервной системы, обеспечивающая повышенное внимание и концентрацию учащихся на предмете изучения.

Есть еще один важный эффект визуализации. Оформляя результаты самостоятельного обсуждения новой темы, учащиеся подключают к обучению мощнейший потенциал творчества. Поиск оригинальных форм отражения результатов работы команды, реализация в этом процессе всех своих способностей, свободное самовыражение и связанные с этим яркие положительные эмоции обеспечивают эффективное усвоение и надежное закрепление новых знаний и умений!

Для визуализации в образовательном процессе можно использовать привычные цветные мелки, разноцветные карточки, наклейки, вырезки из журналов, акварельные краски, материалы для лепки и другие подходящие для этой цели предметы. Театрализация представления результатов обсуждения также обеспечит яркий визуальный эффект и прочное запоминание материала. На самом деле, варианты представления процесса и результатов обучения безграничны, точнее, определяются задачами каждого раздела урока и ограничиваются исключительно фантазией педагога, обучающихся и ресурсными возможностями.

Активные методы представления информации, различные техники и способы визуализации материала оживляют образовательный процесс, позитивно воспринимаются обучающимися и положительно сказываются на результатах обучения. Не жалейте времени на планирование и осуществление на уроке данного процесса!


В последние десятилетия в области передачи визуальной информации произошли почти революционные изменения:

колоссально возросли объем и количество передаваемой информации;

сложились новые виды визуальной информации и способы ее передачи.

Технический прогресс и формирование новой визуальной культуры неминуемо накладывает свой отпечаток на свод требований, предъявляемых к деятельности педагогов.

Одним из средств улучшения профессиональной подготовки будущих учителей, способных к педагогическим инновациям, к разработке технологий проектирования эффективной учебной деятельности школьника в условиях доминирования визуальной среды, считается формирование у них особых умений визуализации учебной информации. Термин «визуализация» происходит от латинского visualis - воспринимаемый зрительно, наглядный. Визуализация информации представление числовой и текстовой информации в виде графиков, диаграмм, структурных схем, таблиц, карт и т.д. Однако такое понимание визуализации как процесса наблюдения предполагает минимальную мыслительную и познавательную активность обучающихся, а визуальные дидактические средства выполняют лишь иллюстративную функцию. Иное определение визуализации дается в известных педагогических концепциях (теории схем - Р.С. Андерсон, Ф. Бартлетт; теории фреймов - Ч. Фолкер, М. Минский и др.), в которых этот феномен истолковывается как вынесение в процессе познавательной деятельности из внутреннего плана во внешний план мыслеобразов, форма которых стихийно определяется механизмом ассоциативной проекции .

Аналогичным образом понятие визуализации понимает Вербицкий А.А.: «Процесс визуализации - это свертывание мыслительных содержаний в наглядный образ; будучи воспринятым, образ может быть развернут и служить опорой адекватных мыслительных и практических действий» . Данное определение позволяет развести понятия «визуальный», «визуальные средства» от понятий «наглядный», «наглядные средства». В педагогическом значении понятия «наглядный» всегда основано на демонстрации конкретных предметов, процессов, явлений, представление готового образа, заданного извне, а не рождаемого и выносимого из внутреннего плана деятельности человека. Процесс разворачивания мыслеобраза и «вынесение» его из внутреннего плана во внешний план представляет собой проекцию психического образа. Проекция встроена в процессы взаимодействия субъекта и объектов материального мира, она опирается на механизмы мышления, охватывает различные уровни отражения и отображения, проявляется в различных формах учебной деятельности .

Если целенаправленно рассматривать продуктивную познавательную деятельность как процесс взаимодействия внешнего и внутреннего планов, как вынесение будущих продуктов деятельности из внутреннего плана во внешний, как корректировку и реализацию во внешнем плане замыслов, то визуализация выступает в качестве главного механизма, обеспечивающего диалог внешнего и внутреннего планов деятельности. Следовательно, в зависимости от свойств дидактических визуальных средств зависит уровень активизации мыслительной и познавательной деятельности обучающихся.

В связи с этим возрастает роль визуальных моделей представления учебной информации, позволяющие преодолеть затруднения, связанные с обучением, опирающимся на абстрактно-логическое мышление. В зависимости от вида и содержания учебной информации используются приемы ее уплотнения или пошагового развертывания с применением разнообразных визуальных средств. В настоящее время в образовании перспективной представляется применение когнитивной визуализации дидактических объектов . Под это определение фактически подпадают все возможные виды визуализации педагогических объектов, функционирующие на принципах концентрации знаний, генерализации знаний, расширения ориентировочно-презентационных функций наглядных дидактических средств, алгоритмизации учебно-познавательных действий, реализуемая в визуальных средств.

На практике, используются более сотни методов визуального структурирования - от традиционных диаграмм и графов до «стратегических» карт (roadmaps), лучевых схем-пауков (spiders) и каузальных цепей (causal chains). Такое многообразие обусловлено существенными различиями в природе, особенностях и свойствах знаний различных предметных областей. Наибольшей информационной емкостью, на наш взгляд, универсальностью и интегративностью обладают структурно-логические схемы. Такой способ систематизации и визуального отображения учебной информации основывается на выявлении существенных связей между элементами знания и аналитико-синтетической деятельности при переводе вербальной информации в невербальную (образную), синтезирование целостной системы элементов знаний. Освоение перечисленных видов по конкретизации смыслов, разворачиванию логической цепочки размышлений, описанию образов и их признаков мыслительной деятельности, а также операций с помощью вербальных средств обмена информацией формирует продуктивные способы мышления, столь необходимые специалистам при современных темпах развития науки, техники и технологий. Согласно достижениям нейропсихологии «обучение эффективно тогда, когда потенциал мозга человека развивается через преодоление интеллектуальных трудностей в условиях поиска смысла через установление закономерностей» .

Структурно-логические схемы создают особую наглядность, располагая элементы содержания в нелинейном виде и выделяя логические и преемственные связи между ними. Такая наглядность опирается на структуру и ассоциативные связи, характерные для долговременной памяти человека. В некотором роде структурно-логические схемы выступают в роли промежуточного звена между внешним линейным содержанием (текст учебника) и внутренним нелинейным содержанием (в сознании). В качестве одного из достоинств структурно-логических схем А.В. Петров выделяет то, что «она выполняет функцию объединения понятий в определенные системы» . Сами по себе понятия ничего не могут сказать о содержании предмета обучения, но будучи связанными определенной системой, они раскрывают структуру предмета, его задачи и пути развития. Понимание и осмысление новой ситуации возникает тогда, когда мозг находит опору в прежних знаниях и представлениях.

Отсюда вытекает важность постоянной актуализации прежнего опыта для овладения новыми знаниями. Процесс изучения нового материала можно представить как восприятие и обработку новой информации путем ее соотнесения с понятиями и способами действий, известными обучающемуся, посредством использования освоенных им интеллектуальных операций. Поступающая в мозг по различным каналам информация концептуализируется и структурируется, образуя в сознании концептуальные сети. Новая информация встраивается в существующие когнитивные схемы, преобразует их и формирует новые когнитивные схемы и интеллектуальные операции. При этом устанавливаются связи между известными понятиями и способами действий и новыми знаниями, возникает структура нового знания .

По данным психологов новая информация усваивается и запоминает лучше тогда, когда знания и умения «запечатлеваются» в системе визуально-пространственной памяти , следовательно представление учебного материала в структурированном виде позволяет быстрее и качественнее усваивать новые системы понятий, способы действий. В качестве примера можно привести визуальную схему: «Цветовая модель RGB» (см. рис. 2).



Рис. 2.

Визуализация учебного материала открывает возможность не только собрать воедино все теоретические выкладки, что позволит быстро воспроизвести материал, но и применять схемы для оценивания степени усвоения изучаемой темы. В практике также широко используется метод анализа конкретной схемы или таблицы, в котором вырабатывают навыки сбора и обработки информации. Метод позволяет включить обучаемых в активную работу по применению теоретической информации в практической работе. Особое место уделяется совместному обсуждению, в процессе которого есть возможность получать оперативную обратную связь, понимать лучше себя и других людей. Обобщая сказанное, заметим, что в зависимости от места и назначения визуальных дидактических материалов в процессе формирования понятия (изучении теории, явления) к выбору определенной структурной модели и наглядному отображению содержания обучения должны быть предъявлены различные психолого-педагогические требования.

При визуализации учебного материала следует учитывать, что наглядные образы сокращают цепи словесных рассуждений и могут синтезировать схематичный образ большей «емкости», уплотняя тем самым информацию. В процессе разработки учебно-методических материалов необходимо контролировать степень обобщения содержания обучения, дублировать вербальную информацию образной и наоборот, чтобы при необходимости звенья логической цепи были полностью восстановлены обучающимися.

Другим важным аспектом использования визуальных учебных материалов является определение оптимального соотношения наглядных образов и словесной, символьной информации. Понятийное и визуальное мышление на практике находятся в постоянном взаимодействии. Они, дополняя друг друга, раскрывают различные стороны изучаемого понятия, процесса или явления. Словесно-логическое мышление дает нам более точное и обобщенное отражение действительности, но это отражение абстрактно. В свою очередь, визуальное мышление помогает организовать образы, делает их целостными, обобщенными, полными.

Визуализация учебной информации позволяет решить целый ряд педагогических задач:

обеспечение интенсификации обучения;

активизации учебной и познавательной деятельности;

формирование и развитие критического и визуального мышления;

зрительного восприятия;

образного представления знаний и учебных действий;

передачи знаний и распознавания образов;

повышения визуальной грамотности и визуальной культуры.

С возрастанием количества накапливаемых данных, даже при использовании сколь угодно мощных и разносторонних алгоритмов Data Mining, становится все сложнее "переваривать" и интерпретировать полученные результаты. А, как известно, одно из положений Data Mining - поиск практически полезных закономерностей. Закономерность может стать практически полезной, только если ее можно осмыслить и понять.

В 1987 году по инициативе ACM SIGGRAPH IEEE Computer Society Technical Committee of Computer Graphics, в связи с необходимостью использования новых методов, средств и технологий данных, были сформулированы соответствующие задачи направления визуализации. К способам визуального или графического представления данных относят графики, диаграммы, таблицы, отчеты, списки, структурные схемы, карты и т.д. Визуализация традиционно рассматривалась как вспомогательное средство при анализе данных, однако сейчас все больше исследований говорит о ее самостоятельной роли.

Традиционные методы визуализации могут находить следующее применение:

Ø представлять пользователю информацию в наглядном виде;

Ø компактно описывать закономерности, присущие исходному набору данных;

Ø снижать размерность или сжимать информацию;

Ø восстанавливать пробелы в наборе данных;

Ø находить шумы и выбросы в наборе данных.

Визуализация инструментов Data Mining

Каждый из алгоритмов Data Mining использует определенный подход к визуализации. В ходе использования каждого из методов, рассмотренных выше, а точнее, их программных реализаций, мы получали некие визуализаторы, при помощи которых удавалось интерпретировать результаты, полученные в результате работы соответствующих методов и алгоритмов.

Ø Для деревьев решений это визуализатор дерева решений, список правил, таблица сопряженности.

Ø Для карт Кохонена: карты входов, выходов, другие специфические карты.

Ø Для линейной регрессии в качестве визуализатора выступает линия регрессии.

Ø Для кластеризации: дендрограммы, диаграммы рассеивания.

Диаграммы и графики рассеивания часто используются для оценки качества работы того или иного метода.

Все эти способы визуального представления или отображения данных могут выполнять одну из функций:

Ø являются иллюстрацией построения модели (например, представление структуры (графа) нейронной сети);

Ø помогают интерпретировать полученный результат;

Ø являются средством оценки качества построенной модели;

Ø сочетают перечисленные выше функции (дерево решений, дендрограмма).

Визуализация Data Mining моделей



Первая функция (иллюстрация построения модели), по сути, является визуализацией Data Mining модели. Существует много различных способов представления моделей, но графическое ее представление дает пользователю максимальную "ценность". Пользователь, в большинстве случаев, не является специалистом в моделировании, чаще всего он эксперт в своей предметной области. Поэтому модель Data Mining должна быть представлена на наиболее естественном для него языке или, хотя бы, содержать минимальное количество различных математических и технических элементов.

Таким образом, доступность является одной из основных характеристик модели Data Mining. Несмотря на это, существует и такой распространенный и наиболее простой способ представления модели, как "черный ящик". В этом случае пользователь не понимает поведения той модели, которой пользуется. Однако, несмотря на непонимание, он получает результат - выявленные закономерности. Классическим примером такой модели является модель нейронной сети.

Другой способ представления модели - представление ее в интуитивном, понятном виде. В этом случае пользователь действительно может понимать то, что происходит "внутри" модели. Таким образом, можно обеспечить его непосредственное участие в процессе. Такие модели обеспечивают пользователю возможность обсуждать ее логику с коллегами, клиентами и другими пользователями, или объяснять ее.

Понимание модели ведет к пониманию ее содержания. В результате понимания возрастает доверие к модели. Классическим примером является дерево решений. Построенное дерево решений действительно улучшает понимание модели, т.е. используемого инструмента Data Mining.

Кроме понимания, такие модели обеспечивают пользователя возможностью взаимодействовать с моделью, задавать ей вопросы и получать ответы. Примером такого взаимодействия является средство "что, если". При помощи диалога "система-пользователь" пользователь может получить понимание модели.

Примерами средств визуализации, при помощи которых можно оценить качество модели, являются диаграмма рассеивания, таблица сопряженности, график изменения величины ошибки:

Ø Диаграмма рассеивания представляет собой график отклонения значений, прогнозируемых при помощи модели, от реальных. Эти диаграммы используют для непрерывных величин. Визуальная оценка качества построенной модели возможна только по окончанию процесса построения модели.

Ø Таблица сопряженности используется для оценки результатов классификации. Такие таблицы применяются для различных методов классификации. Оценка качества построенной модели возможно только по окончанию процесса построения модели.

Ø График изменения величины ошибки. График демонстрирует изменение величины ошибки в процессе работы модели. Например, в процессе работы нейронных сетей пользователь может наблюдать за изменением ошибки на обучающем и тестовом множествах и остановить обучение для недопущения "переобучения" сети. Здесь оценка качества модели и его изменения может оцениваться непосредственно в процессе построения модели.

Примерами средств визуализации, которые помогают интерпретировать результат, являются: линия тренда в линейной регрессии, карты Кохонена, диаграмма рассеивания в кластерном анализе.

Методы визуализации

Методы визуализации, в зависимости от количества используемых измерений, принято классифицировать на две группы:

1. Представление данных в одном, двух и трех измерениях

К этой группе методов относятся хорошо известные способы отображения информации, которые доступны для восприятия человеческим воображением. Практически любой современный инструмент Data Mining включает способы визуального представления из этой группы.

В соответствии с количеством измерений представления это могут быть следующие способы:

Ø одномерное измерение, или 1-D;

Ø двумерное измерение, или 2-D;

Ø трехмерное или проекционное измерение, или 3-D.

Следует заметить, что наиболее естественно человеческий глаз воспринимает двухмерные представления информации.

При использовании двух- и трехмерного представления информации пользователь имеет возможность увидеть закономерности набора данных:

Ø его кластерную структуру и распределение объектов на классы (например, на диаграмме рассеивания);

Ø топологические особенности;

Ø наличие трендов;

Ø информацию о взаимном расположении данных;

Ø существование других зависимостей, присущих исследуемому набору данных.

Если набор данных имеет более трех измерений, то возможны такие варианты:

ü использование многомерных методов представления информации (они рассмотрены ниже);

ü снижение размерности до одно-, двух- или трехмерного представления. Существуют различные способы снижения размерности. Для снижения размерности и одновременного визуального представления информации на двумерной карте используются самоорганизующиеся карты Кохонена.

2. Представление данных в 4 + измерениях

Представления информации в четырехмерном и более измерениях недоступны для человеческого восприятия. Однако разработаны специальные методы для возможности отображения и восприятия человеком такой информации.

Данная статья написана представителем компании DevExpress и опубликована в блоге на ХабраХабре.

Медицинские исследователи установили, что если в инструкции к лекарству находится только текст, человек усваивает из нее лишь 70% информации. Если же в инструкцию добавить картинки, человек усвоит уже 95%.

Очевидно, что человек предрасположен обрабатывать именно визуальную информацию. Помимо прекрасной обработки нашим мозгом, визуализация данных имеет несколько преимуществ:

  • Акцентирование внимания на разных аспектах данных


С помощью графиков можно легко обратить внимание читателя на красные показатели.

  • Анализ большого набора данных со сложной структурой
  • Уменьшение информационной перегрузки человека и удерживание его внимания
  • Однозначность и ясность выводимых данных
  • Выделение взаимосвязей и отношений, содержащихся в информации


На графике легко можно заметить важные данные.

Эстетическая привлекательность


Эстетически привлекательные графики делают подачу данных эффектной и запоминающейся.

Эдвард Тафти, автор одних из лучших книг по визуализации, описывает ее как инструмент для показа данных; побуждения зрителя задуматься о сути, а не методологии; избежания искажения того, что должны сказать данные; отображения многих чисел на небольшом пространстве; показа большого набора данных связным и единым целым; побуждения зрителя сравнивать фрагменты данных; служения достаточно четким целям: описанию, исследованию, упорядочиванию или украшению ().

Как правильно использовать визуализацию данных?

Успех визуализации напрямую зависит от правильности ее применения, а именно от выбора типа графика, его верного использования и оформления.


60% успеха визуализации зависит от выбора типа графика, 30% - от его правильного использования и 10% - от его верного оформления.

Правильный тип графика

График позволяет выразить идею, которую несут данные, наиболее полно и точно, поэтому очень важно выбрать подходящий тип диаграммы. Выбор можно осуществить по алгоритму:

Цели визуализации - это реализация основной идеи информации, это то, ради чего нужно показать выбранные данные, какого эффекта нужно добиться - выявления отношений в информации, показа распределения данных, композиции или сравнения данных.


В первом ряду показаны графики с целями показа отношений на данных и распределения данных, а во втором ряду целями являются показ композиции и сравнения данных.

Отношения в данных - это то, как они зависят друг от друга, связь между ними. С помощью отношений можно выявить наличие или отсутствие зависимостей между переменными. Если основная идея информации содержит фразы «относится к», «снижается/повышается при», то нужно стремиться показать именно отношения в данных.
Распределение данных - то, как они располагаются относительно чего-либо, сколько объектов попадает в определенные последовательные области числовых значений. Основная идея при этом будет содержать фразы «в диапазоне от x до y», «концентрация», «частотность», «распределение».

Композиция данных - объединение данных с целью анализа общей картины в целом, сравнения компонентов, составляющих процент от некоего целого. Ключевыми фразами для композиции являются «составило x%», «доля», «процент от целого».

Сравнение данных - объединение данных, с целью сравнения некоторых показателей, выявление того, как объекты соотносятся друг с другом. Также это сравнение компонентов, изменяющихся с течением времени. Ключевые фразы для идеи при сравнении - «больше/меньше чем», «равно», «изменяется», «повышается/понижается».

После определения цели визуализации требуется определить тип данных. Они могут по своему типу и структуре быть очень разнородными, но в самом простом случае выделяют непрерывные числовые и временные данные, дискретные данные, географические и логические данные. Непрерывные числовые данные содержат в себе информацию зависимости одной числовой величины от другой, например графики функций, такой как y=2x. Непрерывные временные содержат в себе данные о событиях, происходящих на каком-либо промежутке времени, как график температуры, измеряемой каждый день. Дискретные данные могут содержать в себе зависимости категорийных величин, например график количества продаж товаров в разных магазинах. Географические данные содержат в себе различную информацию, связанную с местоположением, геологией и другими географическими показателями, яркий пример - это обычная географическая карта. Логические данные показывают логическое расположение компонентов относительно друг друга, например генеалогическое древо семьи.


Графики непрерывных числовых и временных данных, дискретных данных, географических и логических данных.

В зависимости от цели и данных можно выбрать наиболее подходящий им график. Лучше всего избегать разнообразия ради разнообразия и выбирать по принципу «чем проще, тем лучше». Только для специфичных данных использовать специфичные типы диаграмм, в остальных же случаях хорошо подойдут самые распространенные графики:

  • линейный (line)
  • с областями (area)
  • колонки и гистограммы (bar)
  • круговая диаграмма (pie, doughnut)
  • полярный график (radar)
  • точечный график (scatter, bubble)
  • карты (map)
  • деревья (tree, mental map, tree map)
  • временные диаграммы (time line, gantt, waterfall).

Линейные диаграммы, графики с областями и гистограммы могут содержать в одном аргументе для одной категории несколько значений, которые могут быть как абсолютными (тогда к таким видам графикам прибавляется приставка stacked), так и относительными (full stacked).


График со stacked значениями и с full stacked

При выборе подходящего графика можно руководствоваться следующей таблицей, составленной на основе этой диаграммы и :


Правильное использование графика

Важно не только верно выбрать тип графика, но и правильно его использовать:

  • Не нужно нагружать график большим количеством информации. Оптимальное количество разных типов данных, категорий - это не более 4-5, иначе же целесообразнее разделить такую диаграмму на несколько штук.


Такой график можно сравнить со спагетти и лучше разделить на несколько диаграмм.

Верно выбрать шкалу и ее масштаб для графика. Для гистограмм и графиков с областями предпочтительнее начинать шкалу значений с нуля. Постараться не использовать инвертированные шкалы - это очень часто вводит зрителя в заблуждение относительно данных.


Неверная шкала отрицательно влияет на восприятие данных. В первом случае некорректно выбран масштаб, во втором шкала инвертирована.

  • Для круговых диаграмм и графиков, где показан процент от общей доли, сумма значений всегда должна составлять 100%.
  • Для лучшего восприятия данных информацию на оси лучше упорядочить - либо по значениям, либо по алфавиту, либо по логическому смыслу.

Правильное оформление графика

Ничто так не радует глаз, как правильно оформленные графики, и ничто так не портит диаграммы, как наличие графического «мусора». Основные принципы оформления:

  • использовать палитры похожих, не ярких цветов, и постараться ограничиться набором из шести штук
  • вспомогательные и второстепенные линии должны быть простыми и не бросающимися в глаза


Вспомогательные линии на графике не должны отвлекать внимание от основной идеи данных.

  • там, где возможно, использовать только горизонтальные надписи на осях;
  • для графиков с областями предпочтительнее использовать цвет с прозрачностью;
  • для каждой категории на графике использовать свой цвет.

Выводы

Визуализация - мощный инструмент донесения мыслей и идей до конечного потребителя, помощник для восприятия и анализа данных. Но как и все инструменты, ее нужно применять в свое время и в своем месте. В противном случае информация может восприниматься медленно, а то и некорректно.


На графиках изображены одни и те же данные, слева показаны основные ошибки визуализации, а справа они исправлены.

При умелом применении визуализация данных позволяет сделать материал впечатляющим, нескучным и запоминающимся.