Что «большие данные» говорят о разнообразии видов
Для изучения биоразнообразия и понимания распределения видов и функционирования экосистем необходимы большие данные и масштабный анализ. Информация может поступать из музеев, научной литературы и локальных баз данных. Исследователи Гёттингенского университета изучили, как лучше всего интегрировать эти знания для их перевода в цифровую эпоху и использования в науке. Результаты опубликованы в журнале PLOS Biology.
Данные о биоразнообразии описывают разные аспекты жизни: географическое распространение организмов, их происхождение, экологические характеристики или взаимодействие со средой. Каждый аспект может быть представлен разными типами данных. Например, ареал вида можно описать отдельными находками, систематическими подсчётами или региональными списками видов. Эти типы данных различаются по доступности и могут существенно влиять на научные результаты и выводы. Авторы призывают использовать в исследованиях как можно больше параллельных источников данных для лучшего понимания сложных взаимодействий в природе, особенно в условиях растущей угрозы видам и экосистемам.
«Разрешение данных критически важно для точности и надёжности исследований биоразнообразия», — говорит первый автор работы д-р Кристиан Кёниг. Основной компромисс заключается в том, что чем детальнее данные, тем ниже их доступность и репрезентативность в глобальном масштабе. Часто пробелы в данных особенно велики там, где разнообразие видов наиболее высоко. Исследователи демонстрируют эту взаимосвязь на двух примерах, моделируя глобальные закономерности в габитусе и размере семян растений с использованием разных типов данных.
«Наши модели биоразнообразия улучшатся, если мы свяжем все доступные данные и оптимально их используем, но до сих пор не хватало концептуального понимания их основных характеристик и общих синергий», — добавляет профессор Хольгер Крефт.
