16 мая 2022 г.
LEfSe (LDA Effect Size) - это инструмент для многомерного анализа биомаркеров для выявления геномных особенностей (таких как гены, пути и таксономии), которые значительно характеризуют две или более группы в данных микробиома.
Применение линейного дискриминантного анализа размера эффекта может решить проблему нахождения хороших биомаркеров со статистическими различиями между биологическими группами. Линейный дискриминантный анализ размера эффекта обеспечивает удобный метод идентификации геномных биомаркеров для характеристики статистических различий между биологическими группами. Обязательно соблюдайте осторожность с каждым этапом процедуры, потому что результат каждого предыдущего шага может повлиять на следующий шаг.
После создания входного файла размера эффекта линейного дискриминантного анализа выполните указанные команды, чтобы исключить возможность конфликта зависимостей и создать среду conda для линейного дискриминантного анализа размера эффекта. Используйте команды, как указано, чтобы активировать созданную среду и установить линейный дискриминантный анализ эффекта размера с каналом bioBakery. Чтобы отформатировать данные для размера эффекта линейного дискриминантного анализа, выполните команду для форматирования исходного файла в формате размера внутреннего линейного дискриминантного анализа.
Чтобы вычислить размер эффекта линейного дискриминантного анализа, выполните команду для выполнения линейного дискриминантного анализа и создания результирующего файла данных. После анализа используйте указанные команды для отображения размера эффекта биомаркеров в PDF-файле и рисования дерева видов для отображения биомаркеров в кладограмме. Чтобы построить график различий одного биомаркера между различными группами, используйте команду, как указано.
При желании все объекты также можно нарисовать с помощью команды. Для онлайн-анализа LEfSe с использованием сервера Galaxy перейдите на сервер. Чтобы загрузить соответствующие файлы, щелкните вверх и выберите локальный файл, чтобы выбрать файлы.
Затем выберите табличный формат и нажмите кнопку Пуск. Чтобы отформатировать данные для размера эффекта линейного дискриминантного анализа, щелкните LEfSe и Форматировать данные для LEfSe, выберите определенные строки для класса и нажмите кнопку Выполнить. Чтобы рассчитать размер эффекта линейного дискриминантного анализа, щелкните LEfSe и Размер эффекта LDA.
Выберите значения параметров в соответствии с требованиями анализа и нажмите кнопку Выполнить. Чтобы отобразить результаты размера эффекта линейного дискриминантного анализа, щелкните LEfSe и Наметить результаты LEfSe и нажмите кнопку Выполнить. Чтобы построить кладограмму, выберите соответствующие значения параметров и нажмите кнопку Построить кладограмму и Выполнить.
Чтобы отобразить один объект, выберите соответствующие значения параметров и нажмите кнопку «Построить один объект и выполнить». Чтобы отобразить дифференциальные объекты, выберите соответствующие значения параметров и нажмите кнопку «Построить дифференциальные объекты и выполнить». Здесь показан линейный анализ дискриминации оценок микробных сообществ со значительными различиями в каждой группе, определяемый путем анализа 16 последовательностей генов S-рибосомальной РНК трех образцов.
На этом рисунке можно наблюдать биомаркеры со значительными различиями в видовых деревьях между различными уровнями классификации. Круги, излучающие изнутри наружу, представляют уровни классификации от типа к роду, причем диаметр каждого видового круга представляет уровень численности каждой классификации. Виды без существенных различий появляются в желтом цвете, а значительно отличающиеся видовые биомаркеры окрашены в соответствующие группы.
Соответствующие видовые названия биомаркеров, показанных на участке, перечислены здесь. Здесь показан репрезентативный график бара изобилия для одного биомаркера, который показывает различия между различными группами в соответствии с результатами линейного дискриминантного анализа размера эффекта. Сплошная линия представляет среднюю относительную численность, пунктирная линия представляет среднюю относительную численность, а каждый столбец представляет относительное изобилие каждой выборки в разных группах.
Также может быть выполнен анализ главных компонентов, так как образование размерности напрямую связано с измерением данных, а проектируемая система координат ортогональна. Поскольку спрос на анализ многомерных данных увеличивается, этот метод поможет в исследовании особенностей биомаркеров, представляющих интерес.
Просмотрите полный транскрипт и получите доступ к тысячам научных видео
LEfSe (LDA Effect Size) — мощный инструмент, предназначенный для поиска биомаркеров в многомерных данных. Он идентифицирует геномически характерные особенности, которые значимо характеризуют различные группы в данных о микробиоме.
LEfSe enables biopharma teams to systematically identify statistically robust microbial biomarkers that distinguish biological groups in high-dimensional microbiome datasets. This capability supports early discovery, target validation, and translational research by providing quantitative evidence for group-specific features. Integrating LEfSe into discovery pipelines enhances predictive confidence and informs risk-adjusted portfolio decisions.
LEfSe fits within the discovery-to-preclinical continuum by enabling robust biomarker identification, statistical validation, and visualization of group differences in microbiome data.