Исследовательская статья

Прогнозирование характеристик планировки жилых помещений на основе глубокого обучения для оценки жилья для пожилых людей

DOI:

10.3791/72157

31 июля 2026 г.

В этой статье

Краткое содержание

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

Этот протокол описывает мета-ансамблевой рабочий процесс глубокого обучения для автоматизированного анализа изображений планировок жилых помещений. Процедура включает предварительную обработку наборов данных, прогнозирование архитектурных атрибутов с использованием множества сверточных нейронных сетей, ансамблевое обучение на основе стекинга, классификацию жилых домов на основе правил и анализ объяснимости с использованием SHapley Additive exPlanations для поддержки оценки планировки жилых домов.

Аннотация

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

Растущий спрос на умные жилищные решения для пожилого населения увеличил потребность в автоматизированных методах анализа планировки жилых домов. Традиционные методы архитектурной оценки часто являются ручными, трудоёмкими и трудномасштабными, что подчёркивает необходимость методов искусственного интеллекта, способных интерпретировать пространственные планировки и поддерживать оценку жилого проектирования. Этот протокол описывает мета-ансамблевый фреймворк глубокого обучения для автоматизированного анализа изображений планов жилых помещений. Предлагаемая структура CARE-MIRV-Net объединяет четыре дополняющие сверточные нейронные сети — MobileNetV2, InceptionV3, ResNet101 и VGG16 — для прогнозирования архитектурных характеристик, включая площадь площади, количество спален, ванных комнат и гаражей. Прогнозы из базовых моделей объединяются через мета-ансамбльную модель на основе стекинга и затем используются в слое принятия решений на основе правил для классификации жилых планировок как уход за пожилыми, медицинский уход или общежитие. Экспериментальная оценка показала устойчивую предиктивную эффективность по нескольким целевых переменным. Предлагаемая модель достигла средней абсолютной ошибки (MAE) 432,48 и коэффициента определения (R2) 0,7053 для прогнозирования площади квадратных метров. Для прогноза ванной комнаты система достигла R2 равного 0,7605, а прогноз гаража — самый низкий MAE 0,1697 и максимальныйR 2 — 0,6958. Качественный анализ дополнительно продемонстрировал способность фреймворка генерировать прогнозы архитектурных характеристик и поддерживать прикладную оценку планировки жилых домов. Для повышения прозрачности и интерпретируемости были внедрены SHapley Additive exPlanations для количественной оценки вклада каждой базовой модели в окончательные прогнозы. Предлагаемая структура обеспечивает интерпретируемый и масштабируемый подход к анализу жилых этажей и поддержки принятия решений.

Введение

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

Быстрое развитие технологий умных городов и умных жилых сред создало растущий спрос на автоматизированные и основанные на данных решения в проектировании жилых домов. В частности, рост старения населения и спрос на жильё, ориентированное на здравоохранение, повысили важность проектирования жилых помещений, которые одновременно функциональны и адаптированы к потребностям конкретных групп пользователей 1,2. Традиционные методы анализа архитектурного плана этажей часто ручные, трудоёмкие и зависят от экспертной интерпретации; поэтому они неэффективны и трудно масштабируемы. Это создало острую потребность в интеллектуальных системах, способных автоматически анализировать планировку жилых домов и поддерживать обоснованное принятиерешений. 3.

Недавние достижения в области искусственного интеллекта (ИИ), особенно в области глубокого обучения (DL) и компьютерного зрения, значительно улучшили анализ данных на основе изображений. Сверточные нейронные сети (CNN) доказали высокую эффективность для извлечения пространственных признаков и изучения сложных визуальных паттернов, что делает их подходящими для анализа изображений на планах этажей 4,5,6. Эти модели могут изучать неявные представления структур помещений, организации планировки и пространственных отношений, которые необходимы для прогнозирования архитектурныхатрибутов 7,8. Однако опора на одну модель DL может ограничивать обобщение, поскольку разные архитектуры могут сосредотачиваться на различных пространственных особенностях и проявлять смещения, возникающие из-за архитектурнойизменчивости 9. Несмотря на эти достижения, существующие подходы часто не имеют интегрированной структуры, объединяющей несколько моделей, поддерживающей многорезультатное предсказание и обеспечивающую интерпретируемость на уровне приложений. Кроме того, оценка и объяснимость проживания, ориентированные на здравоохранение, получили относительно ограниченное внимание в системах анализа планировок этажей. Отсутствие таких комплексных рамок ограничивает практическую применимость и интерпретацию, особенно в сферах, где прозрачность и поддержка принятия решенийважны 10, 11 и 12.

ИИ также внес значительный вклад в автоматизированный анализ и создание архитектурных планов этажей. Одно исследование изучало использование машинного обучения (ML) для преобразования двухмерных изображений планировок в трёхмерныемодели 13. Авторы подчеркнули ограничения традиционных методов на основе компьютерного проектирования (CAD) и подчеркнули важность масштабируемых конвейеров на базе ИИ для пространственного понимания. Их результаты показали, что DL может эффективно извлекать структурную информацию из планов этажей, хотя проблемы с обобщением и вариабельностью данных остаются. Другое исследование предложило многоагентную систему глубокого подкрепления для автоматизированного поколения14 этажа. Хотя этот подход предлагает значительную гибкость и индивидуализацию архитектурного проектирования, он в первую очередь сосредоточен на генерации проекта, а не на предиктивном анализе существующих планировок этажей.

Комплексное обследование планировки этажа изучало семантические, пространственные, формовые и текстурные особенности для понимания планаэтажа 15. Опрос подчеркнул важность моделей DL, включая CNN и архитектуры на основе трансформаторов, для обучения осмысленным представлениям. Однако также были выявлены проблемы, связанные с шумом, искажениями и дискриминацией признаков в сложных компоновках. Аналогично, подход, основанный на машинном обучении, включал топологические и визуальные связи для распознавания планировокэтажей 8. Исследование показало, что визуальная доступность и пространственная связность важны для понимания архитектурных планировок, но не рассматривало стратегии многорезультатного прогнозирования или ансамблевого обучения. Генеративный ИИ также исследовался в архитектурных приложениях. Обзор генеративного ИИ в архитектуре рассматривал использование генеративных состязательных сетей (GAN), вариационных автоэнкодеров (VAE) и диффузионных моделей для автоматизациипроектирования 16. Авторы подчеркнули растущее внедрение инструментов ИИ в практические архитектурные рабочие процессы. Однако основное внимание этой работы было сосредоточено на генерации дизайна, а не на предиктивном моделировании или приложениях поддержки принятия решений. Объяснимый ИИ становится всё более важным для интерпретации моделей DL. В исследовании была предложена структура на базе SHapley Additive exPlanations (SHAP) для интерпретации DL-моделей в городских моделях17. Результаты показали, что SHAP может выявлять влиятельные признаки и улучшать интерпретируемость как на глобальном, так и на локальном уровне. Хотя исследование подтверждает ценность SHAP в пространственных приложениях, оно не изучало его интеграцию с фреймворками ансамблевого обучения. Недавние достижения в архитектурах DL дополнительно повысили производительность в задачах на основе изображений. Исследование представило всесторонний обзор современных моделей DL, включая архитектуры на основе CNN итрансформаторов 18. Исследование подчеркнуло важность выбора модели и гибридных архитектур для повышения эффективности обобщения. Однако он не рассматривал конкретные приложения анализа планировки этажей. Крупномасштабные наборы данных также способствовали развитию архитектурного анализа. Например, в одном исследовании был представлен эталонный набор данных, содержащий тысячи сложных плановэтажей 19. Исследование показало, что существующие модели продолжают сталкиваться с трудностями при анализе крупных и многоквартирных планировок, что подчёркивает необходимость более надёжных и обобщённых подходов.

DL также был широко изучен в ансамблевом обучении. Недавнее исследование методов глубокого ансамбля показало, что комбинирование нескольких моделей может значительно повысить точность и устойчивость предсказания за счёт снижения смещения идисперсии 20. Несмотря на их эффективность, эти методы не были широко применены в архитектурном планировании этажей, особенно в задачах многовыходной регрессии. Кроме того, недавние исследования в области автоматизированного анализа планировок этажей подчеркнули важность интегрированных фреймворков, сочетающих прогнозирование, классификацию и интерпретируемость 21,22,23. Существующие исследования обычно сосредоточены на отдельных функциях, таких как выделение признаков, генерация макетов или классификация. В результате остаётся явный исследовательский пробел в разработке единой структуры, интегрирующей многомодельное обучение, оценку планировки жилых домов и объяснимый ИИ. Хотя в области архитектурного анализа и DL достигнуты значительные успехи, остаются некоторые исследовательские пробелы. Большинство существующих исследований сосредоточены на распознавании планировки этажей, выделении признаков или генерации планировки, не предоставляя единой структуры, поддерживающей как многорезультатное прогнозирование, так и принятие решений на уровне применения. Кроме того, многие подходы опираются на одну модель DL, что может ограничивать их способность захватывать различные пространственные характеристики и вводить специфические для модели смещения. Ансамблевое обучение для анализа планировки этажей остаётся относительно недоизученным, особенно в вопросах интеграции гетерогенных моделей для повышения устойчивости. Кроме того, мало внимания уделяется классификации жилых домов с акцентом на жилье, ориентированное на пожилых людей и их интерпретацию. Поскольку многие модели DL работают как чёрные ящики, понимание основ их предсказаний остаётся сложным. Эти ограничения подчёркивают необходимость комплексной структуры, интегрирующей многомодельное обучение, точное прогнозирование, прикладную классификацию жилых домов и объяснимый ИИ.

В данном исследовании представлена автоматизированная основа для анализа изображений планировок жилых помещений с акцентом на пространственное восприятие и оценку планировки жилых домов, чтобы решить эти проблемы. Предлагаемая структура вводит мета-ансамбльную модель DL CARE-MIRV-Net, которая интегрирует четыре дополняющих CNN — MobileNetV2, InceptionV3, ResNet101 и VGG16 — в архитектуре на основестекинга 24,25,26,27. Каждая модель независимо предсказывает ключевые архитектурные характеристики, включая площадь площади, количество спален, ванных комнат и гаражей. Эти предсказания затем объединяются мета-обучающимся для генерации уточнённых предсказаний. Кроме того, для классификации жилых планировок используется слой принятия решений на основе правил как уход за пожилыми, медицинский уход или общежитие на основе прогнозируемых характеристик.

Вклад этой работы следующий. Во-первых, предлагается мета-ансамблевая DL-структура для многовыходного прогнозирования архитектурных характеристик на основе изображений планировок жилых домов. Во-вторых, модель CARE-MIRV-Net интегрирует четыре архитектуры CNN для повышения точности прогнозирования и обобщения. В-третьих, для поддержки категоризации жилой планировки на основе прогнозируемых архитектурных характеристик интегрируется на основе правил, основанный на правилах. В-четвёртых, объяснимый ИИ на базе SHAP интегрирован для повышения прозрачности и интерпретируемости моделей. Наконец, проводятся обширные эксперименты для оценки предлагаемой структуры с использованием средней абсолютной ошибки (MAE) и коэффициента определения (R2) в качестве метрик производительности.

Протокол

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

В этом исследовании использовался общедоступный набор данных с платформы Kaggle (Изображения планировок этажей и их детали, доступны по адресу: https://www.kaggle.com/datasets/adilmohammed/floor-plan-images-and-their-details; дата обращения: 16 апреля 2026 года). В ней не были задействованы человеческие участники, животные или лично идентифицируемые данные; поэтому этическое одобрение и информированное согласие не требовались.

Этот протокол представляет собой рамки на базе искусственного интеллекта для автоматизированного анализа изображений планов жилых домов с акцентом на пространственную и ориентированную на здравоохранение проектирование. Полный экспериментальный рабочий процесс представлен на рисунке 1. Протокол разработан для преодоления разрыва между низкоуровневым прогнозированием архитектурных особенностей и высокоуровневым прикладным принятием решений. Он интегрирует DL, ансамблевое моделирование и объяснимый ИИ, обеспечивая точное, надёжное и интерпретируемое решение для анализа планировок жилых домов. Фреймворк состоит из нескольких этапов: начинается с сбора и предварительной обработки данных, затем обучение признакам с использованием глубоких CNN, мета-ансамблевое предсказание и, наконец, классификация на уровне приложения. Изначально изображения планировки этажей и соответствующие им архитектурные характеристики предварительно обрабатываются через изменение размера, нормализацию и дополнение данных для обеспечения согласованности и улучшения обобщения. Все изображения на плане этажей были изменены до 224 × 224 пикселей и нормализованы до диапазона [0, 1]. Дополнение данных применялось во время обучения с использованием случайного горизонтального переворота, вращения, масштабирования и смещения ширины/высоты для улучшения обобщения модели и снижения перенагона. Вертикальное переворот не применялось. Полные параметры дополнения и детали реализации приведены в дополнительном файле 1. Обработанные данные затем использовались для обучения нескольких моделей DL для извлечения и прогнозирования признаков. Все базовые модели и мета-обучающийся CARE-MIRV-Net были обучены с использованием согласованной конфигурации, включая дополнение данных, раннюю остановку и адаптивное планирование по скорости обучения. Раннее прекращение контролировало потерю валидации (val_loss) с показателем терпения 5 эпох, а лучшие веса модели восстанавливались автоматически после тренировки. Адаптивное планирование по скорости обучения было реализовано с помощью callback ReduceLROnPlateau, который отслеживал потерю валидации и снижал скорость обучения в 0,3 раза после двух эпох без улучшения, при минимальной скорости обучения 1 × 10⁻7. Полные детали реализации и настройки параметров приведены в Дополнительном файле 1. Набор данных был случайным образом разделён на обучающие и тестовые наборы с использованием соотношения 80:20. Для обеспечения воспроизводимости использовалась фиксированная случайная семя (42). Полная информация о реализации приведена в Дополнительном файле 1.

figure-protocol-1
Рисунок 1. Рабочий процесс фреймворка CARE-MIRV-Net для анализа планировки жилых домов . Схематический обзор предлагаемого протокола. Рабочий процесс включает (1) сбор и предобработку наборов данных, (2) обучение и прогнозирование функций с использованием MobileNetV2, InceptionV3, ResNet101 и VGG16, (3) мета-ансамблевое прогнозирование на основе стекинга с использованием CARE-MIRV-Net, (4) классификацию расположения жилых домов на основе правил, (5) анализ интерпретируемости на основе SHapley Additive exPlanations (SHAP) и (6) оценку производительности. Пожалуйста, нажмите здесь, чтобы увидеть увеличенную версию этой фигуры.

На втором этапе используются четыре предварительно обученных CNN — MobileNetV2, InceptionV3, ResNet101 и VGG16 — в качестве базовых учащихся. Каждая модель тонко настраивается с помощью трансферного обучения для прогнозирования ключевых архитектурных характеристик, включая площадь, количество спален, ванных комнат и гаражей. Для каждой модели трансферного обучения нижние предварительно обученные слои оставались замороженными, а верхние слои и кастомная регрессионная головка были тонко настраиваны во время обучения. Подробные конфигурации тонкой настройки, специфичные для моделей, приведены в Дополнительном файле 1. Эти модели отражают различные аспекты пространственной информации: MobileNetV2 обеспечивает эффективное извлечение признаков, InceptionV3 фиксирует многомасштабные пространственные паттерны, ResNet101 изучает глубокие иерархические представления, а VGG16 обеспечивает стабильное и последовательное обучение признакам. Разнообразие этих моделей повышает общую репрезентационную способность фреймворка.

Для дальнейшего повышения точности и надёжности прогнозирования предлагается мета-ансамблевая модель на основе стекинга, обозначенная как CARE-MIRV-Net. На этом этапе предсказания всех базовых моделей объединяются для создания пространства признаков с более высокой размерностью, которое входит мета-обучающемуся. Прогнозы базовой модели сначала генерируются независимо с использованием обученных моделей MobileNetV2, InceptionV3, ResNet101 и VGG16. Эти предсказания затем объединяются в мета-вектор признаков, используемый мета-обучающимся. Чтобы предотвратить утечку данных, наборы данных для обучения и тестирования строго разделены, и мета-обучающийся обучается только на основе прогнозов, полученных на основе обучающих данных. Мета-модель, являющаяся полностью связанной нейронной сетью, обучена изучать оптимальное сочетание выходов базовой модели для получения уточнённых предсказаний. Метамодель состоит из двух полностью связанных слоёв с 512 и 256 нейронами с активацией ReLU, за которыми следуют слои dropout (0,4 и 0,3) и линейный выходной слой. Модель обучается с использованием оптимизатора Адама (скорость обучения = 0,0001), размер партии 32 и до 15 эпох. Ранняя остановка осуществлялась с помощью мониторинга потери валидации (val_loss) с терпением 5 эпох. Минимальный критерий улучшения (min_delta) был установлен на 0 по умолчанию в TensorFlow, а лучшие веса модели восстанавливались автоматически после обучения. Адаптивное планирование по скорости обучения было реализовано с использованием callback ReduceLROnPlateau, который отслеживал потерю валидации и снижал скорость обучения в 0,3 раза после двух последовательных эпох без улучшения. Минимальная скорость обучения была установлена на 1 × 10⁻7, а параметр перезарядки использовал стандартное значение TensorFlow 0. Этот ансамблевой метод снижает искажения отдельных моделей и улучшает обобщение за счёт взаимодополняющих сильных сторон нескольких архитектур. Подробная информация о реализации приведена в Дополнительном файле 1.

После прогнозирования добавляется слой интерпретации для преобразования числовых выходов в решения на уровне применения. Планировки жилых домов можно разделить на три класса на основе прогнозов архитектурных особенностей: для пожилых, интегрированное с медицинским обслуживанием (медицинское обслуживание) и общее жилое использование. Эта классификация проводится с использованием заранее определённых пороговых правил принятия решений, основанных на прогнозируемой площади, числе спален и количества ванных комнат. Категория с наивысшим баллом присваивается в качестве финальной классификации, тогда как ничьи решаются выбором категории, удовлетворяющей большему числу критериев решения. Полные правила подсчёта очков и пороги классификации приведены в Дополнительном файле 2 (Алгоритм 1). Это действие позволяет структуре предоставлять практическую информацию для проектирования жилого жилья.

Фреймворк использует объяснимый ИИ с SHAP для обеспечения прозрачности и интерпретируемости. Этот компонент анализирует вклад предсказаний из каждой базовой модели в результат мета-модели. Анализ SHAP проводился с использованием SHAP KernelExplainer (SHAP версии 0.51.0) с 100 случайно выбранными обучающими выборками в качестве фонового набора данных и 50 тестовыми образцами для генерации объяснений. Полная конфигурация SHAP, включая выбор фонового образца и настройки реализации, представлена в дополнительном файле 1. Слой объяснимости помогает понять процесс принятия решений, измеряя важность признаков и отображая закономерности вклада, тем самым повышая прозрачность и надёжность моделей. Предлагаемая структура оценивается с использованием MAE иR 2 по всем целевых переменным. Для многорезультатного прогнозирования MAE вычислялась как средняя абсолютная разница между фактическими и предсказанными значениями по всем целевой переменной, тогда какR 2 рассчитывалась путём сравнения объяснённой дисперсии предсказаний с соответствующими значениями правдивости для каждого выхода. Количественные и качественные анализы показывают, что предлагаемый CARE-MIRV-Net повышает точность прогнозирования и поддерживает классификацию жилых домов на основе правил. Надёжность классификации оценивалась на основе точности базовых регрессионных прогнозов и согласованности слоя принятия решений на основе правил. Эта структура является подходящим и масштабируемым решением для интеллектуального анализа планировки этажей и может применяться к умному жилью, планированию ухода за пожилыми людьми и ориентированному на здравоохранение жилых домов. Полный список наборов данных, программных пакетов, библиотек, аппаратных ресурсов и вычислительных инструментов, использованных в данном исследовании, приведён в Таблице материалов. Исходный код, информация о конфигурации среды, спецификации программных зависимости и скрипты реализации, необходимые для воспроизведения отчетного рабочего процесса, приведены в Дополнительном файле 1.

Алгоритм протокола

Предлагаемая структура использует многоступенчатый подход к обработке планов этажей жилых домов на основе изображений и получения прогнозных и результатов на уровне принятия решений, как показано в Алгоритме 1 в Дополнительном файле 2. Этот процесс начинается с предварительной обработки данных, при которой входные изображения изменяются до стандартного разрешения и нормализуются для обеспечения равномерности по всему набору данных. Все изображения на плане этажей были изменены до 224 × 224 пикселей и нормализованы до диапазона [0, 1]. Этот этап оптимизирует изображения для обучения с помощью глубоких нейронных сетей и улучшает общую сходимость моделей. Второй этап включает использование нескольких моделей DL в качестве базовых обучающихся, включая MobileNetV2, InceptionV3, ResNet101 и VGG16. Каждая модель отдельно берет входные изображения и оценивает важные архитектурные особенности, такие как площадь и количество спален, ванных комнат и гаражей. Набор данных был случайным образом разделён на обучающие и тестовые наборы с использованием соотношения 80:20, при этом использовался фиксированный случайный сид для обеспечения воспроизводимости. Эти модели отражают различные пространственные свойства планировок и предоставляют дополняющие прогнозы. Представление признаков затем строится путём сложения выходов каждой базовой модели для создания единого представления признаков. Этот совместный выход впоследствии подаётся в мета-ансамблевую модель CARE-MIRV-Net, которая обучается объединять предсказания всех базовых моделей. Прогнозы базовой модели генерировались независимо и объединялись для формирования мета-вектора. Утечка данных была предотвращена за счёт строгого разделения наборов данных для обучения и тестирования. Метамодель уточняет эти прогнозы и формирует итоговые прогнозы архитектурных атрибутов. Метамодель состояла из полностью связанных слоёв с 512 и 256 нейронами, функций активации ReLU, частот выбывания 0,4 и 0,3, оптимизатора Адама (скорость обучения = 0,0001), размера партии 32 и до 15 эпох обучения с ранней остановкой. После прогнозирования используется слой принятия решений для контекстуализации результатов. Согласно оценочным значениям, каждая жилая планировка классифицируется как уход за пожилыми, медицинский уход или общее жилое использование. Жилые категории присваивались с использованием заранее заданных пороговых правил оценки оценок, основанных на прогнозируемых характеристиках планировки этажей. Категория с наивысшим баллом была выбрана в качестве финальной классификации. Полные пороги классификации и правила принятия решений приведены в Алгоритме 1 (Дополнительный файл 2). Наконец, фреймворк включает компонент объяснимости на основе SHAP для оценки влияния каждой базовой модели на итоговое предсказание. Анализ SHAP был проведён как описано ранее и в дополнительном файле 1. Этот компонент повышает прозрачность и помогает понять процесс принятия решений. Эффективность и жизнеспособность предлагаемого подхода оценивались с помощью стандартных показателей регрессионной эффективности. Производительность оценивалась с помощью одного экспериментального запуска с фиксированным случайным заседом.

Модели оценки

В этом разделе представлены модели DL, использованные в исследовании, включая как отдельные базовые модели, так и предлагаемую CARE-MIRV-Net. Эталонные модели были выбраны для представления разнообразных и широко применяемых архитектур DL. MobileNetV2 была включена как лёгкая и вычислительная эффективная сеть, а InceptionV3 была выбрана за способность захватывать многомасштабные пространственные особенности. ResNet101 был выбран благодаря глубокой возможности остаточного обучения для иерархического извлечения признаков, а VGG16 был включён как хорошо зарекомендовавшая себя сверточная архитектура. Все эталонные модели были обучены с использованием идентичных процедур предварительной обработки, настроек дополнения данных, разделов наборов данных, параметров оптимизации, размера пакета и конфигурации обучения для обеспечения справедливой сравнительной оценки.

MobileNetV2:

MobileNetV2 — это небольшая и компактная CNN-система, спроектированная для быстрой, высокопроизводительной работы и меньшей вычислительной сложности. В ней представлены некоторые из основных инноваций, таких как инвертированные остаточные соединения и линейные узкие места, которые обеспечивают эффективное извлечение признаков и при этом обладают высокой репрезентационной силой. MobileNetV2 может использовать глубинно разделяемые свёртки для значительного минимизации общего количества параметров и вычислительных затрат традиционных сверточных сетей, что хорошо адаптируется для больших задач обучения на основе изображений.

MobileNetV2 используется в предлагаемой структуре как одна из базовых моделей DL для прогнозирования архитектурных характеристик изображений планировок жилых домов. Модель способна эффективно изучать пространственные закономерности, такие как распределение помещений, плотность планировки и структурная организация, встречающиеся в планировках этажей. Такие приобретённые представления играют важную роль в точной оценке таких важных объектов, как площадь квадратных метров, количество спален, ванных комнат и гаражей. MobileNetV2 — это лёгкая модель, которая хорошо подходит для включения в предлагаемый фреймворк мета-ансамбля. Он добавляет некоторые дополняющие представления признаков к другим моделям DL и повышает общую надёжность и обобщение системы. Это обучение моделей очень важно для повышения точности прогнозов и для помощи в классификации жилых проектов на основе здравоохранения.

Модель MobileNetV2 обучается с использованием стратегии трансферного обучения с предварительно обученными весами из набора данных ImageNet. Входные изображения масштабируются до фиксированного размера 224 × 224 × 3, что совместимо с архитектурой. Изображения были изменены до 224 × 224 пикселей, нормализованы до диапазона [0, 1] и дополнены с помощью случайного переворота, вращения, масштабирования и смещения. Во время обучения использовалась партия из 32 экземпляров. Начальная головка классификации MobileNetV2 была удалена и заменена регрессионной головкой. Регрессионная головка состояла из слоя глобального среднего пулирования, за которым следовали полностью связанные слои с 512 и 256 нейронами, пакетная нормализация, слои выпадения (0,4 и 0,3) и линейный выходной слой из четырёх нейронов. Для облегчения адаптации доменов нижние предварительно обученные слои были заморожены, тогда как верхние слои, начинающиеся с block_13_expand, и кастомная регрессионная головка были тонко настроены. Такой подход к селективному обучению позволяет модели сохранять общие визуальные особенности, одновременно изучая специфические пространственные атрибуты изображений планировки этажей. Извлеченные карты признаков обрабатываются через слой глобального среднего пула и полностью связанные слои с нейронами 512 и 256 с помощью активации ReLU. Для улучшения обобщения и снижения перенагонки используются слои пакетной нормализации и выпадения (0.4 и 0.3). Последний выходной слой содержит четыре нейрона с линейной активацией, соответствующей предсказанным архитектурным атрибутам. Оптимизатор Адама использовался с скоростью обучения 0,0001 и стандартными параметрами TensorFlow/Keras (β₁ = 0,9, β₂ = 0,999, ε = 1 × 10⁻7, amsgrad = ложь). Для многорезультатного прогнозирования MAE иR2 вычислялись путём сравнения предсказанных и фактических значений для каждой целевой переменной и усреднения результатов по всем выходным данным. Ранняя остановка применялась на основе потери валидации, а адаптивное снижение скорости обучения применялось для улучшения сходимости. Обучение проводилось до 15 эпох.

InceptionV3:

InceptionV3 — это глубокая архитектура CNN, способная фиксировать многомасштабные характеристики с помощью параллельных сверточных операций. Он основан на модуле Inception, который использует различные размеры фильтров в одном слое для одновременного извлечения как мелкозернистых, так и грубых элементов. Такой тип архитектурного проектирования позволяет сети изучать сложные пространственные иерархии и быть вычислительно эффективной. Кроме того, InceptionV3 использует факторизированные свёртки и уменьшение размерности, которые повышают производительность и минимизируют вычислительные затраты.

InceptionV3 применяется в предлагаемой структуре как эффективный экстрактор признаков для анализа изображений планировок жилых домов. Планировки этажей состоят из различных пространственных паттернов, таких как размеры помещений, структурные планы и связность, что требует многомасштабного обучения признакам. Архитектура Inception особенно лучше подходит для этой задачи, поскольку способна одновременно представлять локальные особенности (например, небольшие комнаты) и глобальные структуры (например, организацию общей планировки). InceptionV3 предоставляет дополняющие представления к другим моделям, таким как MobileNetV2, в контексте мета-ансамблевой структуры. Разнообразие прогнозов увеличивается благодаря способности моделировать сложные пространственные связи, что важно для повышения эффективности ансамбля. Это в конечном итоге помогает лучше прогнозировать архитектурные особенности и укрепляет дальнейшую классификацию жилищного дизайна, ориентированного на пожилых людей и интегрированного с медицинским страхованием.

Модель InceptionV3 обучается с использованием подхода трансферного обучения с предобученными весами из набора данных ImageNet. Входные изображения масштабируются до 224 × 224 × 3 для обеспечения совместимости с сетевой архитектурой и согласованности всех моделей внутри фреймворка. Изображения были изменены до 224 × 224 пикселей, нормализованы до диапазона [0, 1] и дополнены с помощью случайного переворота, вращения, масштабирования и смещения. Во время обучения использовалась партия из 32 экземпляров.

Исходные слои классификации InceptionV3 удалены, а также добавлена собственная регрессионная головка для многовыходного прогнозирования. Кастомная регрессионная головка состояла из слоя глобального среднего пулирования, за которым следовали полностью связанные слои с 512 и 256 нейронами, пакетная нормализация, слои выпадения (0,4 и 0,3) и линейный выходной слой из четырёх нейронов. Сверточная основа частично тонко настроена: нижние предварительно обученные слои заморожены, а верхние слои вместе с кастомной регрессионной головкой — тонко настроены для изучения специфических элементов планировки, сохраняя общие визуальные представления, полученные во время предварительного обучения. После сверточной основы слой глобального среднего пула преобразует карты признаков в компактное представление признаков. За ним следуют полностью связанные слои, содержащие 512 и 256 нейронов с функциями активации ReLU. Для минимизации переподгонки и улучшения обобщения применяются частоты выбывания 0,4 и 0,3. Последний выходной слой состоит из четырёх нейронов с линейной активацией, соответствующей прогнозированию площади квадратных метров, количества спален, количества ванных комнат и количества гаражей. Модель обучена с использованием оптимизатора Адама с скоростью обучения 0,0001, размером партии 32 и до 15 эпох обучения с ранним остановкой и адаптивным снижением скорости обучения для обеспечения стабильной сходимости.

ResNet101:

ResNet101 — это глубокая структура CNN, построенная на принципе остаточного обучения, которая позволяет обучать чрезвычайно глубокие сети, преодолевая задачу нулевого градиента. Он добавляет остаточные соединения, или так называемые пропускные соединения, которые позволяют сети изучать идентификационные отображения и сохранять информацию на разных уровнях. Эта архитектура значительно повышает стабильность обучения и позволяет модели изучать сложные иерархические характеристики. ResNet101 обладает глубоким репрезентативным потенциалом в 101 слой и, следовательно, очень эффективен в задачах, требующих дополнительных пространственных признаков.

ResNet101 будет использоваться в предлагаемой структуре как экстрактор с высокой ёмкостью, который будет анализировать изображения планировок жилых домов. Модель может использоваться для представления сложных пространственных отношений, включая связность помещений, сложность планировки и структурные вариации, благодаря глубокой архитектуре. Эти особенности критически важны для точного прогнозирования архитектурных объектов, таких как площадь квадратных метров, спальни, ванные комнаты и гаражи. В мета-ансамблевом дизайне ResNet101 является важным компонентом и предоставляет глубокие и абстрактные представления признаков. ResNet101 больше ориентирован на детализированные структурные особенности и, следовательно, более разнообразен среди базовых обучающихся по сравнению с легкими моделями, такими как MobileNetV2. Эта гетерогенность играет важную роль в улучшении эффективности ансамбля и надёжных прогнозов, особенно при медицинской классификации жилых домов.

ResNet101 обучается с использованием метода трансферного обучения с предобученными весами из набора данных ImageNet. Входные изображения масштабируются до 224 × 224 × 3, что обеспечивает архитектурную совместимость и согласованность между всеми моделями внутри фреймворка. Изображения были изменены до 224 × 224 пикселей, нормализованы до диапазона [0, 1] и дополнены с помощью случайного переворота, вращения, масштабирования и смещения. Во время обучения использовалась партия из 32 экземпляров. Исходная головка классификации ResNet101 удалена (include_top=Ложь), а также добавлена собственная регрессионная головка для многовыходного прогнозирования. Регрессионная головка состояла из слоя глобального среднего пулирования, за которым следовали полностью связанные слои с 512 и 256 нейронами, пакетная нормализация, слои выпадения (0,4 и 0,3) и линейный выходной слой из четырёх нейронов. Для баланса между повторным использованием функций и адаптацией домена нижние предварительно обученные слои были заморажены, тогда как более глубокие слои, начинающиеся с conv4_block1_1_conv и кастомная регрессионная головка были тонко настроены. Такая селективная стратегия обучения позволяет модели сохранять общие визуальные черты, адаптируя более высокоуровневые изображения к изображениям планировок. Выход сверточной базы проходит через слой глобального среднего пула для генерации компактного представления признаков. За этим следуют полностью связанные слои с нейронами 512 и 256 с использованием функций активации ReLU. Пакетная нормализация применяется для стабилизации обучения, а также добавлены слои dropout с частотами 0,4 и 0,3 для снижения перенагона и улучшения обобщения. Последний выходной слой содержит четыре нейрона с линейной активацией, соответствующей площади квадратных футов, количеству спален, ванных комнат и гаражей. Оптимизатор Адама использовался с скоростью обучения 0,0001, как описано в обучающей конфигурации. Дополнение данных включало случайное переворачивание, вращение, масштабирование и сдвиг для улучшения обобщения моделей. Обучение проводилось до 15 эпох с ранней остановкой на основе потери валидации и снижения адаптивной скорости обучения.

VGG16:

VGG16 — это простая архитектура нейронных сетей глубокого сверточного типа, эффективная и простая в задачах визуального распознавания. Он состоит из 16 слоёв с регулярной или однородной конструкцией, включающей небольшие 3 × 3 сверточных фильтра, которые облегчают изучение иерархических представлений признаков сетью. Архитектура ориентирована на глубину и упрощённа, что позволяет фиксировать низкоуровневые детали, такие как края, текстуры и семантические структуры высокого уровня. VGG16, благодаря своему обычному дизайну и хорошей производительности, сейчас является популярным выбором основной основы при выполнении трансферного обучения в задачах, связанных с изображением.

В предлагаемой модели VGG16 используется как базовая модель DL для получения пространственных признаков изображений планировок жилых домов. Сам факт его организации позволяет ему быть очень полезным для запечатления тонких деталей схем планировки, таких как границы помещений, структурные выравнивания и пространственная организация. Эти особенности критически важны для эффективного прогнозирования архитектурных особенностей, таких как квадратные футы, спальни, ванные комнаты и гаражи. В системе метаансамбля VGG16 обеспечивает стабильные и хорошо обобщённые представления признаков. VGG16 предлагает более сбалансированный подход к извлечению признаков по сравнению с более глубокими архитектурами, такими как ResNet101, и мультимасштабными архитектурами, такими как InceptionV3, что увеличивает разнообразие базовых обучающихся. Эта гетерогенность критически важна для повышения эффективности ансамбля и надежных прогнозов по ориентированной на здравоохранение жилых домов.

Модель VGG16 обучается с использованием подхода трансферного обучения с предобученными весами из набора данных ImageNet. Входные изображения масштабируются до 224 × 224 × 3 для обеспечения совместимости с архитектурой и согласованности между всеми моделями внутри фреймворка. Изображения были изменены до 224 × 224 пикселей, нормализованы до диапазона [0, 1] и дополнены с помощью случайного переворота, вращения, масштабирования и смещения. Во время обучения использовалась партия из 32 экземпляров. Исходные слои классификации удалены (include_top=Ложно), а также добавлена собственная регрессионная головка для адаптации модели для многовыходного прогнозирования. Регрессионная головка состояла из слоя глобального среднего пулирования, за которым следовали полностью связанные слои с 512 и 256 нейронами, пакетная нормализация, слои выпадения (0,4 и 0,3) и линейный выходной слой из четырёх нейронов. Нижние предварительно обученные слои были заморожены, тогда как слои, начинающиеся с block4_conv1, и кастомная регрессионная головка были тонко настроены. Эта стратегия позволяет модели сохранять общие визуальные характеристики, одновременно изучая предметно-специфические представления, релевантные для анализа планировки этажей. Выходные признаки сверточной базы проходят через слой глобального среднего пула для генерации компактного вектора признаков. За этим следуют полностью связанные слои с нейронами 512 и 256 с использованием функций активации ReLU. Пакетные нормировки и слои выпадения с частотами 0,4 и 0,3 включены для стабилизации тренировок, снижения перенагонки и улучшения обобщения. Последний выходной слой содержит четыре нейрона с линейной активацией, соответствующей квадратным метрам, числу спален, ванных комнат и прогнозам гаража. Оптимизатор Адама использовался с скоростью обучения 0,0001, как описано в обучающей конфигурации. Дополнение данных включало случайное переворачивание, вращение, масштабирование и сдвиг для улучшения обобщения моделей. Обучение проводилось до 15 эпох с ранней остановкой на основе потери валидации и снижения адаптивной скорости обучения.

CARE-MIRV-Net (предлагаемая мета-ансамблевая модель DL):

Рекомендуемый CARE-MIRV-Net (Context-Aware Residential Ensemble, использующий MobileNetV2, InceptionV3, ResNet101 и VGG16 Network) — это мета-ансамбль DL-фреймворк на основе стека, направленный на улучшение оценки архитектурных особенностей на основе фотографий планировки жилых помещений. Архитектура объединяет различные гетерогенные CNN, используя их синергетические преимущества при извлечении признаков. Предлагаемая модель основана на сочетании лёгкой, глубокой и многомасштабной архитектуры, что повышает предсказательные характеристики и обеспечивает надёжность в широком спектре жилых планировок. В отличие от традиционных методов на основе одной модели, CARE-MIRV-Net использует иерархический подход к обучению, при котором базовые модели предоставляют начальные прогнозы, которые затем улучшаются мета-учеником.

Когда речь идёт о пространственном и заботящемся о здоровье жилых проектах, правильная интерпретация планировок этажей имеет первостепенное значение. Одиночные модели DL, как правило, недостаточны для обобщения различных архитектурных паттернов. Предлагаемый фреймворк преодолеет этот недостаток, используя четыре различных архитектуры: MobileNetV2, InceptionV3, ResNet101 и VGG16, которые открывают свои собственные возможности представления. MobileNetV2 можно использовать для эффективного извлечения функций и является лёгким; InceptionV3 изучает пространственные паттерны на нескольких уровнях; ResNet101 изучает глубокие иерархические представления; а VGG16 стабильно и надёжно осваивает функции. Сочетание этих моделей позволяет создать структуру для включения как локальных, так и глобальных пространственных характеристик, что повышает точность и надёжность прогнозируемых объектов, таких как площадь квадратных метров, количество спален, ванных комнат и гаражей. Приведённые выше прогнозы также могут быть использованы для дальнейшей классификации жилых районов, включая ориентированные на пожилых, интегрированные с медицинским обслуживанием и общие жилые помещения.

CARE-MIRV-Net реализуется с использованием двухступенчатой стратегии ансамбля на основе стекирования. На первом этапе четыре базовые модели независимо генерируют прогнозы для целевых переменных. Входные данные мета-обучающегося генерировались путём объединения прогнозных результатов, полученных обученными базовыми моделями, с обучающими данными. Эти конкатенированные предсказания образовывали 16-мерные векторы метапризнаков, используемые для обучения метамоделей. Утечка информации предотвращалась строгим разделением наборов данных для обучения и тестирования, и при обучении базовой модели и метамодели не использовались тестовые образцы. Те же наборы данных для обучения и валидации, что использовались для базовых моделей, были использованы в процессе стекирования. В процессе обучения и вывода 16-мерный вектор метапризнаков был построен путём объединения четырёх прогнозных выходов, генерируемых MobileNetV2, InceptionV3, ResNet101 и VGG16. Поскольку каждая модель генерирует четырёхмерный выходной вектор, конкатенированное представление генерирует 16-мерный вход для мета-обучающегося. Это преобразование объединяет предсказания всех базовых моделей и служит входным элементом для второго этапа фреймворка. Второй этап включает создание полностью связанного нейронного сетевого мета-обучающегося для изучения оптимальной комбинации предсказаний базовой модели. Мета-обучающийся состоял из полностью связанных слоёв с 512 и 256 нейронами, активации ReLU, пакетной нормализации, частоты выбывания 0,4 и 0,3, а также линейного выходного слоя из четырёх нейронов. После плотных слоёв наносились слои дропаута с частотами 0,4 и 0,3 для снижения перенасадки и улучшения обобщения. Метамодель была обучена с использованием оптимизатора Адама с скоростью обучения 0,0001, размером партии 32 и до 15 эпох с ранней остановкой и адаптивным снижением скорости обучения. Данные валидации использовались для мониторинга производительности модели во время обучения и выбора самой эффективной модели. После обучения мета-ансамблевая модель генерировала окончательные прогнозы путём объединения результатов всех базовых учащихся. MAE иR 2 использовались для оценки эффективности CARE-MIRV-Net. Для многорезультатного прогнозирования MAE иR2 вычислялись путём сравнения предсказанных и фактических значений для каждой целевой переменной и усреднения результатов по всем выходным данным. Результаты были получены в результате одного экспериментального запуска с фиксированным случайным началом. Предлагаемая структура улучшает предсказательные способности за счёт объединения нескольких структур DL с помощью механизма накладки и предоставления интерпретируемого анализа планировок жилых помещений. Это делает CARE-MIRV-Net применимым в контексте жилого проектирования, ориентированного на гериатрию и здравоохранение. Исходный код, информация о конфигурации среды, спецификации программных зависимостей и документация по реализации приведены в дополнительном файле 1.

Оценка эффективности

Проводится анализ производительности предлагаемой структуры для определения её прогностической способности, прочности и обобщающих характеристик по различным архитектурным характеристикам. Проводятся количественные и качественные анализы для подтверждения полезности предлагаемой модели. Процедура оценки включает как стандартные регрессионные показатели, так и контролируемые экспериментальные среды для справедливого сравнения с базовыми моделями. Эксперименты проводились с использованием одного экспериментального запуска с фиксированным случайным началом для обеспечения воспроизводимости и согласованности во всех эталонных и предлагаемых моделях.

Параметры производительности:

Для оценки эффективности предлагаемой структуры используются два хорошо известных регрессионных показателя — MAE иR2. MAE измеряет среднюю величину ошибок предсказания и предоставляет чёткое представление о близости между предсказанными и фактическими значениями. Напротив, значение R2 используется для оценки доли дисперсии в целевых переменных, объясняемых моделью, отражая её общую прогностическую силу. Сочетание этих метрик обеспечивает всестороннюю оценку точности и обобщения всех предсказанных архитектурных элементов. Для многорезультатного прогнозирования MAE иR2 вычислялись путём сравнения предсказанных и фактических значений для каждой целевой переменной и усреднения результатов по всем выходным данным.

Экспериментальная установка:

Эксперименты проводились в облачной среде с использованием Python (версия 3.12.12). Предлагаемый протокол был реализован с использованием TensorFlow (версия 2.19.0), Keras (версия 3.13.2), NumPy (версия 2.4.6), Pandas (версия 2.3.3), Scikit-learn (версия 1.6.1), Matplotlib (версия 3.9) и SHAP (версия 0.51.0). Вычислительная среда использовала процессор Intel Xeon, работающий на частоте 2,20 ГГц и примерно 31 ГБ системной памяти. Эксперименты проводились на операционной системе Ubuntu 22.04 LTS с использованием NVIDIA Tesla T4 × 2 GPU. Набор данных содержит 2640 изображений планировок жилых домов, которые были предварительно обработаны и разделены на учебные и тестовые наборы данных. Набор данных был разделен с использованием соотношения 80:20, в результате чего получилось 2 112 обучающих и 528 тестовых образцов. MobileNetV2, InceptionV3, ResNet101 и VGG16 — четыре модели DL, обученные с использованием тонкой настройки с использованием трансферного обучения. Затем была построена мета-ансамблевая модель на основе стекинга CARE-MIRV-Net для объединения предсказаний из этих базовых моделей. Каждая модель тренировалась в одинаковых условиях, включая изменение размера изображения до 224 × 224 пикселей, увеличение данных и раннюю остановку для снижения перенагона. Дополнение данных включало случайное переворачивание, вращение, масштабирование и перемещение. Использовался размер партии 32 и максимум 15 эпох обучения, с ранним прекращением работы на основе потери валидации и снижения адаптивной скорости обучения. Окончательный анализ проводился на скрытом тестовом наборе для обеспечения объективной и надёжной оценки производительности. Скрытый тестовый набор генерировался во время первоначального разделения данных и оставался полностью изолированным на протяжении всего обучения и разработки модели, чтобы обеспечить беспривзятую оценку производительности.

Описание набора данных:

Набор данных, использованный для поддержки результатов этого исследования, общедоступен на платформе Kaggle под названием «Изображения планировок этажей и их детали»28. Набор данных доступен по адресу: https://www.kaggle.com/datasets/adilmohammed/floor-plan-images-and-their-details (дата обращения: 16 апреля 2026 года). Данные состоят из 2 640 изображений планировок жилых помещений и организованных архитектурных метаданных. Каждый образец представляет собой уникальный жилой план, который предлагает широкий спектр жилых планировок с разными размерами, конфигурациями и пространственными планировками. Размер набора данных достаточно для обучения на основе DL и содержит разнообразные архитектурные паттерны. Набор данных состоит из двухмерного изображения планировки этажа и связанных числовых характеристик, описывающих структурные характеристики жилого дома. К этим характеристикам относятся общая площадь, количество спален, количество ванных комнат и количество гаражей. Кроме того, каждая запись содержит путь изображения, который позволяет напрямую сопоставлять визуальные входы на метки. Переменные набора данных включают изображение плана этажа, путь изображения, площадь площади, количество спален, количество ванных комнат и количество гаражей. Изображение плана этажа служит входной функцией, а архитектурные атрибуты — как цели прогнозирования. Таким образом, набор данных подходит для контролируемого обучения: изображения служат входными элементами, а архитектурные атрибуты — регрессионными целями.

Набор данных содержит широкий спектр жилых планировок — от компактных с меньшим количеством комнат до больших многокомнатных планировок. Эта вариабельность позволяет изучать значимые пространственные представления, включая распределение помещений, плотность планировки и структурную сложность. Это разнообразие особенно важно для предлагаемой структуры, поскольку она поддерживает классификацию планировок этажей на ориентированные на пожилые, интегрированные с медицинским обслуживанием и общие жилые планировки. Перед обучением модели набор данных обрабатывается через последовательность процедур предварительной обработки для обеспечения согласованности и совместимости с моделями DL. Все изображения были изменены до 224 × 224 пикселей и нормализованы до диапазона [0, 1] перед обучением. Затем набор данных организуется путём сопоставления путей изображений с соответствующими метаданными, после чего он делится на учебные и тестовые подмножества для облегчения анализа производительности. Набор данных был случайным образом разделён на обучающие и тестовые наборы с использованием соотношения 80:20. В анализ включались записи, содержащие полную информацию о изображениях и метаданных, тогда как неполные или некорректные записи исключались. Фиксированный случайный seed использовался при разбиении набора данных для обеспечения воспроизводимости. Набор данных предоставляет подробную основу для анализа планировок жилых домов на основе ИИ. Сочетание 2 640 аннотированных изображений и разнообразных архитектурных характеристик поддерживает многовыходное регрессионное моделирование и позволяет интегрировать пространственный интеллект с принятием решений в области жилого проектирования, ориентированного на здравоохранение.

Результаты

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

Был проведён набор экспериментов для оценки предлагаемой структуры с использованием четырёх моделей DL: MobileNetV2, InceptionV3, ResNet101 и VGG16, а также предлагаемой мета-ансамблевой модели CARE-MIRV-Net.

Результаты сбора и предварительной обработки наборов данных

Фаза предварительной обработки была разработана для подготовки необработанных изображений планировок и связанных с ними метаданных для обучения и оценки с использованием моделей DL. Набор данных был получен из репозитория Kaggle и содержал 2640 образцов. Каждый образец состоял из изображения плана этажа и соответствующих архитектурных характеристик. Для дальнейшего анализа были сохранены только соответствующие колонки, включая путь изображения, площадь, спальни, ванные комнаты и гаражи, а неполные или пустые записи были удалены для поддержания согласованности и качества данных. Для облегчения обучения и оценки модели набор данных был разделён на учебные и тестовые подмножества в соотношении 80:20, в результате чего получилось 2 112 обучающих образцов и 528 тестовых образцов. Фиксированный случайный seed использовался при разбиении набора данных для обеспечения воспроизводимости. Это подразделение обеспечивало обучение моделей на достаточно большом наборе данных, сохраняя при этом независимый набор тестов для объективной оценки эффективности. Пути изображений стандартизировались путём сопоставления каждой записи с соответствующим местоположением в каталоге набора данных. Четыре архитектурных атрибута (квадратные футы, спальни, ванные комнаты и гаражи) служили целевой переменной для задачи регрессии с множеством выходов. Хотя спальни, ванные комнаты и гаражи являются дискретными переменными, они были смоделированы с использованием многовыходной регрессионной структуры, позволяющей одновременно предсказывать все архитектурные характеристики в единой архитектуре обучения. Этот подход позволяет модели фиксировать общие связи между целевой переменной и использовать корреляции между непрерывными и дискретными архитектурными характеристиками. Прогнозируемые значения для дискретных атрибутов преобразовывались в ближайшее действительное целое число во время постобработки перед интерпретацией и последующей классификацией по размещению жилых домов.

Таблица 1 описывает архитектурные особенности, предсказанные предлагаемой моделью, отражая ключевые пространственные и функциональные характеристики жилых планировок. Был проведен исследовательский анализ данных для лучшего понимания распределения целевых переменных с помощью гистограмм и визуализаций на основе счёта. Распределение квадратных метров непрерывно с разной плотностью, тогда как распределение спален, ванных комнат и гаражей подчёркивает частоту различных жилых конфигураций. Эти распределения показаны на рисунке 2. Распределение квадратных метров показано на рисунке 2A, тогда как распределение спален, ванных комнат и гаражей показано соответственно на рисунках 2B–2D. Вместе эти графики иллюстрируют изменчивость и распределение целевых переменных в наборе данных.

Название объектаОписание
Квадратные футыОбщая застроенная площадь жилого помещения
ГрядкиКоличество спален в планировке
БаниКоличество ванных комнат в планировке
ГаражиКоличество доступных гаражных мест

Таблица 1: Архитектурные атрибуты, используемые в качестве целей предсказания. Определения архитектурных атрибутов, извлечённых из набора датасета планировки этажей и используемых в качестве целевых переменных для обучения и оценки модели. К характеристикам относятся общая площадь, количество спален, количество ванных комнат и количество гаражных площадей, связанных с планом каждого жилого этажа.

figure-results-1
Рисунок 2. Распределение архитектурных признаков в наборе данных по планировке жилых этажей. Гистограммы, показывающие распределения (A) квадратных метров, (B) количества спален, (C) количества ванных комнат и (D) количества гаражей по всему набору данных, используемым для разработки и оценки моделей. Пожалуйста, нажмите здесь, чтобы увидеть увеличенную версию этой фигуры.

Этап предварительной обработки изображений преобразовал все изображения планировок в стандартизированный формат, подходящий для моделей DL. Все изображения загружались, конвертировались в RGB-цветовое пространство, изменялись до 224 × 224 пикселей и нормализовались до диапазона [0, 1]. Этот процесс обеспечивал единообразные размеры входных данных и улучшил сходимость моделей во время обучения. Предварительно обработанные изображения случайным образом отбирались, а метки верифицировались для правильной предварительной обработки и выравнивания меток. После предварительной обработки каждое изображение преобразовывалось в массив NumPy и объединялось с соответствующими целями для создания набора данных ввода-вывода. Полученные наборы данных подтвердили успешную подготовку данных: обучающие изображения имели размеры (2112, 224, 224, 3), а тестовые изображения — (528, 224, 224, 3). Соответствующие матрицы меток имели размеры (2112, 4) и (528, 4) соответственно. Целевые переменные были преобразованы в значения с плавающей запятой для поддержки регрессионного обучения.

Для дальнейшего улучшения обобщения моделей и снижения перенагона были применены методы дополнения данных с использованием генератора изображений. Эти методы включали случайное горизонтальное переворот, вращение, масштабирование и смещение ширины/высоты для увеличения вариабельности обучающих данных и улучшения обобщения моделей. Эти преобразования увеличили вариабельность обучающих данных и позволили моделям изучать более устойчивые и инвариантные пространственные признаки. Конвейер предварительной обработки обеспечивал чистые, стандартизированные и хорошо структурированные изображения и табличные данные, что стало подходящей основой для обучения предлагаемой мета-ансамблевой фреймворк глубокого обучения.

Результаты базовых моделей и предлагаемой модели

Предварительно обработанный набор данных (2 640 изображений планов этажей) использовался для обучения всех моделей с помощью обучающих и тестовых разделов. Набор данных был разделен с использованием соотношения 80:20, в результате чего получилось 2 112 обучающих и 528 тестовых образцов. Для обеспечения воспроизводимости использовалась фиксированная случайная семя. Предварительно обученные веса использовались для трансферного обучения и тонкой настройки с целью адаптации моделей к архитектурному анализу планировок. Методы дополнения данных применялись во время обучения для улучшения обобщения, а ранняя остановка применялась для снижения перенагонов путём мониторинга эффективности валидации. Модели тренировались с партией 32 экземпляра на протяжении до 15 эпох, с применением ранней остановки для предотвращения перегонки и обеспечения эффективной конвергенции. Раннее прекращение контролировало потерю валидации и прекращало обучение, когда дальнейших улучшений не наблюдалось, в то время как адаптивное снижение скорости обучения применялось для улучшения сходимости. Для мониторинга процесса обучения и оценки поведения и стабильности при конвергенции использовались как потеря, так и MAE. Все модели тренировались в одинаковых экспериментальных условиях для обеспечения справедливого сравнения. На рисунках 3–7 показаны потери обучения и валидации, а также кривые MAE для всех моделей, что даёт представление об их динамике обучения и поведении при обобщении.

figure-results-2
Рисунок 3. Производительность обучения MobileNetV2. (A) Потеря обучения и валидации в разных эпохах обучения. (B) Обучение и валидация означают абсолютную ошибку (MAE) в разных эпохах обучения. Пожалуйста, нажмите здесь, чтобы увидеть увеличенную версию этой фигуры.

figure-results-3
Рисунок 4. Тренировочная производительность InceptionV3. (A) Потеря обучения и валидации в разных эпохах обучения. (B) Обучение и валидация означают абсолютную ошибку (MAE) в разных эпохах обучения. Пожалуйста, нажмите здесь, чтобы увидеть увеличенную версию этой фигуры.

figure-results-4
Рисунок 5. Тренировочные результаты ResNet101. (A) Потеря обучения и валидации в разных эпохах обучения. (B) Обучение и валидация означают абсолютную ошибку (MAE) в разных эпохах обучения. Пожалуйста, нажмите здесь, чтобы увидеть увеличенную версию этой фигуры.

figure-results-5
Рисунок 6. Тренировочные характеристики VGG16. (A) Потеря обучения и валидации в разных эпохах обучения. (B) Обучение и валидация означают абсолютную ошибку (MAE) в разных эпохах обучения. Пожалуйста, нажмите здесь, чтобы увидеть увеличенную версию этой фигуры.

figure-results-6
Рисунок 7. Тренировочные результаты CARE-MIRV-Net. (A) Потеря обучения и валидации в разных эпохах обучения. (B) Обучение и валидация означают абсолютную ошибку (MAE) в разных эпохах обучения. Пожалуйста, нажмите здесь, чтобы увидеть увеличенную версию этой фигуры.

Обучающая производительность MobileNetV2 показана на рисунке 3. Кривые потерь при обучении и валидации показаны на рисунке 3A, тогда как кривые MAE для обучения и валидации показаны на рисунке 3B. Потери в тренировках и МАЭ постепенно снижались с каждым возрастом, что свидетельствует о стабильном обучающем поведении. Кривые валидации демонстрировали большую вариативность и оставались относительно выше, чем обучающие кривые, что указывает на снижение эффективности обобщения. Эта тенденция согласуется с количественными результатами, в которых MobileNetV2 показал сравнительно низкую прогнозную эффективность, особенно при прогнозировании площади квадратных метров. Тренировочные показатели InceptionV3 показаны на рисунке 4. Кривые потерь обучения и валидации показаны на рисунке 4A, тогда как кривые обучения и валидации MAE показаны на рисунке 4B. Модель демонстрировала устойчивое снижение потерь как в обучении, так и в валидации, а также в MAE, при этом разница между кривыми была лишь небольшой. Такое поведение свидетельствует об эффективном обучении и относительно хорошем обобщении. Стабильные кривые валидации показывают, что модель эффективно фиксировала многомасштабные пространственные особенности, что способствовало улучшению производительности по сравнению с MobileNetV2. Поведение ResNet101 при обучении показано на рисунке 5. Кривые потерь при обучении и валидации показаны на рисунке 5A, тогда как кривые обучения и валидации MAE показаны на рисунке 5B. Модель показала постепенное снижение потерь в обучении и MAE, тогда как кривые валидации следовали аналогичной тенденции с незначительными колебаниями. Хотя наблюдались некоторые колебания, общая сходимость оставалась стабильной. Эти наблюдения соответствуют способности модели изучать иерархические пространственные представления через остаточное обучение. Тренировочные характеристики VGG16 показаны на рисунке 6. Кривые потерь обучения и валидации показаны на рисунке 6A, тогда как кривые обучения и валидации MAE показаны на рисунке 6B.

Кривые обучения VGG16 показывали постоянное снижение на протяжении всего обучения, что свидетельствует об эффективном обучении. Валидационные кривые демонстрировали колебания и небольшое отклонение от тренировочных кривых, что указывает на лёгкое переподгонку. Тем не менее, модель оставалась конкурентоспособной, особенно по площади и прогнозированию гаража, что свидетельствует о эффективности и стабильности её изученных характеристик.

Обучающая эффективность CARE-MIRV-Net показана на рисунке 7. Кривые потерь при обучении и валидации показаны на рисунке 7A, тогда как кривые обучения и валидации MAE показаны на рисунке 7B. Потеря тренировок и валидации, а также кривые MAE уменьшались плавно и стабильно, с лишь небольшой разницей между ними. Такое поведение указывает на сильную сходимость и хорошее обобщение. По сравнению с отдельными моделями, мета-ансамблевая структура обеспечивала более стабильное обучение и снижала изменчивость. В целом, сравнение обучающих кривых показывает, что, хотя отдельные модели демонстрировали разные характеристики сходимости и обобщения, CARE-MIRV-Net демонстрировал наиболее стабильное поведение в обучении среди оценённых моделей.

Подробное сравнение предиктивной производительности MobileNetV2, InceptionV3, ResNet101, VGG16 и предлагаемой модели CARE-MIRV-Net приведено в таблице 2. Производительность оценивалась с помощью MAE и R2 по четырём целевой переменным: площадь, количество спален, количество ванных комнат и количество гаражей. Эти метрики обеспечивают дополняющие меры точности прогнозирования и объяснительной эффективности.

МодельКвадратные футыГрядкиБаниГаражи
MAEMAEMAEMAE
MobileNetV2881.6530.13270.68730.31540.65520.34570.39770.1133
InceptionV3464.640.66150.43530.67080.36270.74590.230.6351
ResNet101611.9190.58720.42870.65460.38380.7250.22980.6489
VGG16504.4350.72560.6980.33550.49950.64360.1970.6757
CARE-MIRV-Net (предложено)432.4880.70530.43430.68370.36890.76050.16970.6958

Таблица 2: Сравнение производительности базовых моделей и CARE-MIRV-Net. Сравнение прогнозируемой производительности для MobileNetV2, InceptionV3, ResNet101, VGG16 и предлагаемой модели CARE-MIRV-Net по четырём архитектурным параметрам: площади, числу спален, ванных комнатам и числу гаражей. Результаты отражаются с использованием средней абсолютной ошибки (MAE) и коэффициента определения (R 2). Более низкие значения MAE указывают на более низкую ошибку прогноза, тогда как более высокие значенияR2 указывают на более сильное согласование предсказанных и фактических значений.

Отдельные модели демонстрировали разные уровни производительности по целевой переменной. MobileNetV2 показал самую низкую производительность в целом, особенно по прогнозированию площади — MAE 881.6530 и значение R2 0.1327. Производительность ванных комнат и гаражей также была сравнительно ниже, что указывает на ограничения в захвате сложных пространственных отношений при использовании в качестве отдельной модели.

InceptionV3 продемонстрировала высокую эффективность по большинству целевых переменных, особенно в ванных и спальнях, с значениями R2 0,7459 и 0,6708 соответственно. Эти результаты свидетельствуют об эффективном захвате многомасштабных пространственных характеристик. ResNet101 также продемонстрировала конкурентоспособность благодаря глубокой остаточной архитектуре, которая способствовала изучению иерархических пространственных представлений. Однако его производительность оставалась немного ниже, чем у InceptionV3 по некоторым переменным, включая прогнозирование площади площади. VGG16 обеспечивал относительно сбалансированную производительность по всем целевых переменным и достиг наибольшего значения R2 по площади (0,7256) среди отдельных моделей.

Предлагаемая структура CARE-MIRV-Net превзойдёт отдельные модели в большинстве оцениваемых задач. CARE-MIRV-Net достигла самого низкого квадратного метра MAE (432,488), сохранив при этом значение R2 0,7053. Для прогнозирования комнаты модель достигла значения R2 0,6837. Для прогнозирования туалетов CARE-MIRV-Net достиг наивысшего значенияR2 (0,7605) среди всех оценённых моделей. Аналогично, для гаражного прогнозирования модель достигла наименьшего значения MAE (0,1697) и максимального значения R2 (0,6958). Эти результаты показывают, что мета-ансамблевая структура эффективно сочетала дополняющие сильные стороны отдельных архитектур. Результаты также свидетельствуют о том, что интеграция прогнозов из нескольких моделей снижала ограничения, специфичные для моделей, и улучшала общую прогнозную эффективность. Результаты показывают, что CARE-MIRV-Net обеспечивал сбалансированную прогнозную эффективность по всем оценённым целевых переменным. Медицинская ориентированная оценка проживания, представленная в данном исследовании, следует интерпретировать как прикладно-ориентированную категоризацию, основанную на правилах и доступных характеристиках плана этажей, а не как клинически валидированную медицинскую оценку.

Для дальнейшей оценки прогнозной эффективности был проведён анализ остаточных ошибок для всех целевых переменных, включая площадь, спальни, ванные комнаты и гаражи. Остаточные графики дают представление о распределении ошибок предсказания, показывая различия между предсказанными и наблюдаемыми значениями. В идеале остатки должны быть случайно распределены вокруг нуля, что указывает на ограниченное систематическое смещение и хорошую обобщённость.

Рисунок 8 показывает остаточный график для прогнозирования площади квадратных метров. Большинство остатков были сгруппированы вокруг нуля, что свидетельствует о относительно точных прогнозах для большинства выборок. Однако была обнаружена большая дисперсия и несколько выбросов при больших прогнозируемых значениях квадратных метров. Эти наблюдения свидетельствуют о том, что вариабельность предсказания увеличивалась для больших жилых планировок.

figure-results-7
Рисунок 8. Остаточный анализ для прогнозирования площади квадратных метров. Диаграмма рассеяния, показывающая остаточные ошибки в зависимости от прогнозируемых значений квадратных метров. Горизонтальная линия показывает нулевой остаточной ошибки. Пожалуйста, нажмите здесь, чтобы увидеть увеличенную версию этой фигуры.

Распределение остатков для прогнозирования спальни показано на рисунке 9. Остаточные значения обычно были сосредоточены вокруг нуля, при этом диагональный рисунок отражал дискретную природу переменной спальни. Относительно узкий остаточный диапазон указывает на стабильную прогнозную эффективность без явного систематического смещения. Рисунок 10 показывает остаточный график для прогнозирования туалета. Остатки оставались сосредоточенными около нуля, но демонстрировали немного большую дисперсию, чем те, что наблюдались при прогнозировании спальни. Видимый узор полос соответствует дискретной природе целевой переменной. Также присутствовали несколько выбросов при более высоких прогнозируемых значениях.

figure-results-8
Рисунок 9. Остаточный анализ для прогнозирования спальни. Диаграмма рассеяния, показывающая остаточные ошибки в зависимости от предсказанных значений спальни. Горизонтальная линия показывает нулевой остаточной ошибки. Пожалуйста, нажмите здесь, чтобы увидеть увеличенную версию этой фигуры.

figure-results-9
Рисунок 10. Остаточный анализ для прогнозирования туалета. Диаграмма рассеяния, показывающая остаточные ошибки в зависимости от прогнозируемых значений в ванной. Горизонтальная линия показывает нулевой остаточной ошибки. Пожалуйста, нажмите здесь, чтобы увидеть увеличенную версию этой фигуры.

Остаточный анализ для прогнозирования гаража показан на рисунке 11. Остаточные значения оставались сосредоточенными около нуля и демонстрировали относительно низкую дисперсию по сравнению с другими целевой переменной. Дискретный и ограниченный диапазон значений гаража создавал чёткие линейные узоры на графике. Узкое остаточное распределение свидетельствует о относительно стабильной предсказательной эффективности для этой переменной.

figure-results-10
Рисунок 11. Остаточный анализ для прогнозирования гаража. Диаграмма рассеяния, показывающая остаточные ошибки в зависимости от прогнозируемых значений гаража. Горизонтальная линия показывает нулевой остаточной ошибки. Пожалуйста, нажмите здесь, чтобы увидеть увеличенную версию этой фигуры.

В целом, остаточные анализы показывают, что CARE-MIRV-Net генерировал прогнозы, которые обычно были сосредоточены вокруг нуля по всем целевой переменным. Хотя наблюдалась некоторая вариабельность и исключения, особенно при прогнозировании площади квадратных метров, общие остаточные распределения подтверждают согласованность предсказательной эффективности модели по всему оцениваемому набору данных.

Результаты объяснимого анализа ИИ с использованием SHAP

Для улучшения интерпретации предлагаемой структуры CARE-MIRV-Net был внедрён объяснимый подход ИИ с использованием SHAP. SHAP — это игровой теоретический метод, который объясняет предсказания моделей, присваивая значения важности признаков на основе значений Шепли. При применении к предлагаемой мета-ансамблевой модели SHAP применялся для анализа вклада каждой базовой модели в конечный результат мета-обучающегося. Вход в метамодель состоял из конкатенированных предсказаний из четырёх базовых моделей — InceptionV3, MobileNetV2, ResNet101 и VGG16 — что привело к 16-мерному пространству признаков. Каждая особенность представляла собой предсказанный архитектурный атрибут (квадратные метри, спальни, ванные комнаты или гаражи), генерируемый определённой базовой моделью. Интерпретация этих признаков осуществлялась путём выбора случайно выбранного подмножества мета-обучающих данных в качестве фонового распределения и меньшего подмножества тестовых выборок для генерации объяснения с целью повышения вычислительной эффективности.

Были созданы версии метамодели с одним выходом для независимого выделения и анализа вклада признаков каждой целевой переменной. SHAP KernelExplainer применялся, как описано ранее, и в дополнительном файле 1 для оценки вклада признаков и интерпретации прогнозов предлагаемой структуры. Эти значения использовались для количественной оценки того, насколько каждое предсказание базовой модели положительно или отрицательно вносит вклад в итоговый результат. Согласно анализу SHAP, CARE-MIRV-Net не опирался исключительно на одного базового обучающегося, а присваивал разные уровни важности разным моделям в зависимости от целевой переменной и входных характеристик. Эти наблюдения свидетельствуют о том, что подход ансамбля на основе стекинга использовал дополняющую информацию из нескольких базовых моделей.

Рисунки 12–15 показывают сводные графики SHAP для четырёх целевых переменных: площадь, спальни, ванные комнаты и гаражи. Эти графики дают представление о том, как мета-модель CARE-MIRV-Net использовала прогнозы отдельных базовых учащихся. В каждом графике горизонтальная ось представляет значения SHAP (вклад признаков), а цветовая шкала — величину признаков от низких до высоких.

figure-results-11
Рисунок 12. Краткий график SHAP для прогнозирования площади квадратных метров. Сводной график SHAP, показывающий вклад прогнозов базовой модели в оценку площади мета-обучающим CARE-MIRV-Net. Характеристики ранжируются по важности. Цвет точки указывает значение признака, а горизонтальное положение — вклад SHAP в прогноз. ШАП, Шапли Аддитивные объяснения. Пожалуйста, нажмите здесь, чтобы увидеть увеличенную версию этой фигуры.

figure-results-12
Рисунок 13. Краткий график SHAP для прогноза спальни. Сводный график SHAP, показывающий вклад прогнозов базовой модели в оценку спальни мета-обучающимся CARE-MIRV-Net. Характеристики ранжируются по важности. Цвет точки указывает значение признака, а горизонтальное положение — вклад SHAP в прогноз. ШАП, Шапли Аддитивные объяснения. Пожалуйста, нажмите здесь, чтобы увидеть увеличенную версию этой фигуры.

figure-results-13
Рисунок 14. Краткий график SHAP для прогнозирования туалета. Сводный график SHAP, показывающий вклад прогнозов базовой модели в оценку туалета мета-обучающимся CARE-MIRV-Net. Характеристики ранжируются по важности. Цвет точки указывает значение признака, а горизонтальное положение — вклад SHAP в прогноз. ШАП, Шапли Аддитивные объяснения. Пожалуйста, нажмите здесь, чтобы увидеть увеличенную версию этой фигуры.

figure-results-14
Рисунок 15. Краткий график SHAP для прогноза гаража. Сводной график SHAP, показывающий вклад прогнозов базовой модели в оценку гаража мета-обучающимся CARE-MIRV-Net. Характеристики ранжируются по важности. Цвет точки указывает значение признака, а горизонтальное положение — вклад SHAP в прогноз. ШАП, Шапли Аддитивные объяснения. Пожалуйста, нажмите здесь, чтобы увидеть увеличенную версию этой фигуры.

Рисунок 12 показывает сводку SHAP для прогнозирования площади. Такие объекты, как Mob_SF, Res_SF и Inc_SF, демонстрировали сравнительно больший вклад в SHAP, чем другие, что указывает на то, что прогнозы, созданные MobileNetV2, ResNet101 и InceptionV3, существенно способствовали оценке площади. Более высокие значения признаков (красный) обычно были связаны с увеличением прогнозируемой площади, тогда как более низкие значения объектов (синий) — с более низкими прогнозами. Особенности, связанные с спальней и ванной, демонстрировали сравнительно меньший вклад, что указывает на то, что прогнозирование площади в первую очередь определялось прогнозами, связанными с площадью, полученными базовыми моделями.

Рисунок 13 представляет анализ SHAP для прогнозирования спальни. Такие объекты, как Res_Beds, VGG_Beds и Inc_Beds, показали сравнительно больший вклад, чем другие, что указывает на то, что прогнозы ResNet101, VGG16 и InceptionV3 оказали влияние на окончательное предсказание спальни. Значения SHAP были распределены примерно нуля, что говорит о том, что метамодель интегрировала информацию из нескольких источников, а не опиралась на один доминирующий предиктор. Элементы, связанные с гаражами и площадью, показали сравнительно меньший вклад.

Рисунок 14 показывает сводку SHAP для прогнозирования туалета. Такие характеристики, как VGG_Baths, Inc_Baths и Mob_Baths, показали сравнительно высокий вклад, что указывает на значительный вклад прогнозов VGG16, InceptionV3 и MobileNetV2 в оценку туалетов. Распределение значений SHAP свидетельствует о том, что увеличение прогнозов из этих базовых моделей было связано с большим влиянием на итоговое предсказание. Вклад оказался более распределённым по моделям, чем для некоторых других целевых переменных.

Рисунок 15 представляет анализ SHAP для прогнозирования гаража. Такие характеристики, как Mob_Garages, Inc_Garages и VGG_Garages, проявили относительно сильный вклад в итоговое предсказание. График демонстрирует, что прогнозы, связанные с гаражами, из нескольких базовых моделей, внесли вклад в итоговый результат, с чётким разделением между вкладом в характеристики с более низким и высоким значением. Более широкое распространение значений SHAP свидетельствует о повышенной чувствительности метамодели к признакам предсказания, связанных с гаражом.

В целом, анализ SHAP показал, что предлагаемая структура CARE-MIRV-Net интегрирует вклад нескольких базовых обучающихся при формировании окончательных прогнозов. Результаты дают интерпретируемое представление о относительном влиянии прогнозов отдельных моделей на четыре архитектурных целевых переменных и поддерживают понимание процесса принятия решений по метаансамблю.

Результаты классификации планировки жилых помещений

Примеры результатов классификации жилой планировки показаны на рисунках 16–18. Эти примеры иллюстрируют применение слоя принятия решений на основе правил к архитектурным атрибутам, предсказанным фреймворком CARE-MIRV-Net. На рисунке 16 представлен пример, классифицированный как планировка медицинского обслуживания, на рисунке 17 представлен пример, классифицируемый как общая жилая планировка, а на рисунке 18 представлен пример, классифицируемый как планировка для пожилых. Примеры демонстрируют, как предсказанные архитектурные атрибуты преобразуются в категории жилых домов на уровне приложений с помощью заранее определённых правил принятия решений, описанных в разделе «Протокол». Эти примеры следует интерпретировать как иллюстративные результаты классификационной системы на основе правил, основанной на предсказанных характеристиках плана этажей и заранее определённых критериев принятия решений, а не как независимо валидированные клинические или медицинские классификации.

figure-results-15
Рисунок 16. Репрезентативный пример классифицируется как планировка медицинского проживания. Пример изображения плана жилого помещения, оценённого по предлагаемой структуре и отнесённого к категории медицинской помощи на основе прогнозируемых архитектурных характеристик и критериев классификации на основе правил. Пожалуйста, нажмите здесь, чтобы увидеть увеличенную версию этой фигуры.

figure-results-16
Рисунок 17. Представительный пример классифицируется как общая жилая планировка. Пример изображения плана жилых помещений, оценённый по предлагаемой структуре и отнесённый к общей категории жилых помещений на основе прогнозируемых архитектурных характеристик и критериев классификации на основе правил. Пожалуйста, нажмите здесь, чтобы увидеть увеличенную версию этой фигуры.

figure-results-17
Рисунок 18. Представительный пример классифицируется как жилой комплекс для ухода за пожилыми. Пример изображения планировки жилого помещения, оценённого по предлагаемой структуре и отнесённого к категории ухода за пожилыми на основе прогнозируемых архитектурных характеристик и критериев классификации на основе правил. Пожалуйста, нажмите здесь, чтобы увидеть увеличенную версию этой фигуры.

Репрезентативный пример, показанный на рисунке 16 , демонстрирует, что модель предсказывала площадь площади 2233,16 по сравнению с фактическим значением 2268,00, что указывает на относительно небольшую ошибку прогноза. Аналогично, прогнозируемые значения для спален (3,23 против 3), ванных комнат (2,65 против 2) и гаражей (1,11 против 1) были близки к соответствующим значениям на земле. На основе этих предсказанных характеристик слой принятия решений на основе правил классифицировал структуру как медицинскую помощь. Этот пример иллюстрирует, как фреймворк применяет предсказанные архитектурные атрибуты для генерации классификаций жилых домов на уровне приложений.

Второй пример, показанный на рисунке 17 , демонстрирует планировку, классифицированную как общежилое использование. Прогнозируемая площадь (1692,76) была ниже фактического значения (1879,00), тогда как прогнозируемое количество спален, ванных комнат и гаражей оставалось близким к соответствующим значениям по правде на земле. Основываясь на прогнозируемых архитектурных характеристиках, слой решения присваивал планировку общей категории жилых объектов. Этот пример демонстрирует применение классификационной системы к среднеразмерной планировке жилого дома, несмотря на незначительные отклонения в отдельных прогнозах.

Рисунок 18 показывает компактную жилую планировку с фактической площадью 981,00 и прогнозируемой площадью 1076,17. Прогнозируемые значения для спален (1,99 против 2), ванных комнат (1,75 против 2) и гаражей (0,98 против 1) также были близки к соответствующим значениям правды на земле. Исходя из этих прогнозируемых характеристик, уровень принятия решения классифицировал планировку как уход за пожилыми. Этот пример иллюстрирует применение заранее определённых правил классификации к планировкам, характеризующимся меньшими площадями этажей и меньшим количеством помещений.

В целом, репрезентативные примеры демонстрируют интеграцию прогнозирования архитектурных атрибутов и категоризации жилых домов на основе правил в рамках CARE-MIRV-Net. На всех примерах, показанных на рисунках 16–18, прогнозируемые архитектурные характеристики в целом соответствовали соответствующим значениям ground-truth, что подтверждает использование предлагаемой структуры для автоматизированного анализа планировок жилых помещений и классификации на уровне применения.

Доступность данных:

Набор данных, использованный в этом исследовании, доступен публично через репозиторийKaggle 28 под названием «Изображения планировок этажей и их детали» и доступен по адресу: https://www.kaggle.com/datasets/adilmohammed/floor-plan-images-and-their-details. Все анализы, представленные в этом исследовании, были проведены на основе данных, полученных из этого общедоступного источника. Исходный код, документация по реализации и информация о конфигурации среды, необходимые для воспроизведения опубликованных результатов, приведены в дополнительном файле 1.

Дополнительный файл 1. Пакет реализации CARE-MIRV-Net. Этот файл содержит исходный код, документацию README, спецификации зависимостей программного обеспечения, информацию о среде и скрипты реализации, необходимые для воспроизведения рабочего процесса CARE-MIRV-Net. Пожалуйста, нажмите здесь, чтобы скачать этот файл.

Дополнительный файл 2. Алгоритм анализа планировки жилых помещений CARE-MIRV-Net. Этот файл содержит Алгоритм 1, включая предобработку данных, прогнозирование базовой модели, конкатенацию мета-признаков, прогнозирование мета-ансамбля, классификацию уровней принятия решений, объяснимость на основе SHAP и рабочий процесс с метрикой оценки, используемый в исследовании. Пожалуйста, нажмите здесь, чтобы скачать этот файл.

Обсуждение

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

В данном исследовании представлен CARE-MIRV-Net — мета-ансамблевой DL-фреймворк на основе стекинга для автоматизированного анализа изображений планировок жилых помещений. Фреймворк объединяет четыре дополняющие архитектуры CNN — MobileNetV2, InceptionV3, ResNet101 и VGG16 — для прогнозирования ключевых архитектурных характеристик, включая площадь площади, количество спален, ванных комнат и гаражей. Эти прогнозы затем объединяются через мета-обучающийся и используются в слое принятия решений на основе правил для классификации жилых домов на категории для ухода за пожилыми, медицинского обслуживания или общего жилого проживания. Интеграция предиктивного моделирования, ансамблевого обучения и объяснимого ИИ создаёт единую основу для анализа планировки жилыхпомещений 3,7,17,20.

Репрезентативные результаты показывают, что CARE-MIRV-Net достигла улучшения прогнозных показателей по сравнению с отдельными базовыми моделями по нескольким архитектурным характеристикам. Ансамблевая структура в целом снизила ошибки прогнозирования и улучшилаR2, что свидетельствует о том, что сочетание гетерогенных архитектур CNN может повысить прогностическуюустойчивость 12,20. Кроме того, внедрение SHAP позволило интерпретировать относительный вклад отдельных базовых моделей в окончательные прогнозы, тем самым повысив прозрачностьмодели на 11,17. Таким образом, эта структура может предоставить полезный подход для исследований, требующих как предсказательной эффективности, так и интерпретируемости моделей.

Предлагаемая структура может способствовать развитию исследований, связанных с автоматизированным архитектурным анализом, оценкой жилого проектирования и системами поддержки принятия решений на основе данных. Интегрируя многовыходное предсказание с категоризацией на уровне применения, структура выходит за рамки традиционных методов распознавания планировок этажей или выделения признаков. Методология может быть применима в исследованиях, связанных с жилым планированием, умными жилыми средами и пространственной оценкойпланировки 1,2,8,22. Однако следует учитывать несколько ограничений. Во-первых, фреймворк был разработан и оценён с использованием единого общедоступного набора данных, и внешняя валидация независимых наборов данных не проводилась. В настоящем исследовании не проводилась внешняя валидация, а оценка модели проводилась с использованием назначенного подмножества тестов, полученного из общедоступного набора данных. Во-вторых, категории проживания, генерируемые этой структурой, основаны на заранее определённых правилах, а не на независимо проверенных метках для дизайна здравоохранения. Категории ухода за пожилыми, медицинская помощь и общие жилые условия, формируемые в рамках системы, основаны на заранее определённых правилах и не должны интерпретироваться как клинически валидированные оценки проектирования медицинского обслуживания. В-третьих, структура в основном опирается на архитектурные характеристики, полученные из изображений планировок этажей, и не включает специфические стандарты проектирования, критерии доступности или показатели, ориентированные на проживание. Для определения правил классификации не использовались формальные стандарты доступности, проектирования здравоохранения или жилого проектирования. Вместо этого была разработана структура категоризации с использованием доступных характеристик планировки этажей и критериев принятия решений, ориентированных на применение. Будущая работа может включать внешнюю валидацию независимых наборов данных, внедрение формальных стандартов доступности и проектирования здравоохранения, а также оценку с использованием дополнительных мер, ориентированных на проживание, для дальнейшего повышения применимости и обобщения структуры.

Для изучения той же гипотезы также могут использоваться альтернативные подходы. Например, модели зрения на основе трансформеров, графовые пространственные представления или гибридные архитектуры DL могут использоваться для захвата пространственных отношений в жилыхпланировках 13, 15, 19. Аналогично, классификационные рамки, основанные на экспертных наборах данных или стандартах проектирования здравоохранения, могут предоставлять альтернативные методы оценки планировкижилых домов 8,22. Хотя эти методы могут иметь дополнительные преимущества, предлагаемая структура CARE-MIRV-Net демонстрирует возможность объединения нескольких архитектур CNN в ансамблевой структуре на основе стекинга для многорезультатного прогнозирования и категоризации расположения жилых домов.

Будущие работы могут быть сосредоточены на расширении этой структуры для поддержки более продвинутого, пространственного мышления и более широкой практической применимости. Возможные направления включают внедрение графовых представлений планов этажей для моделирования связности помещений, оценку архитектур на основе визуальных трансформеров (ViT) для извлечения признаков и разработку многоклассовых или многометочных стратегий классификации13, 15, 18. Кроме того, будущие исследования могут включать специфические для здоровья атрибуты проектирования, стандарты доступности и независимые наборы данных валидации для дальнейшей оценки применимости этой системы в ориентированных на здравоохранение жилых сред 8,22. Структура также может быть адаптирована для интеграции в платформы умных городов и системы поддержки принятия решений для жилогопланирования 1,2.

Раскрытие информации

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

Конфликты интересов:

Авторы не заявляют о конфликтах интересов.

Вклад автора:

Нин Чжан предлагал идеи для исследований, разрабатывал экспериментальные планы и координировал исследовательский процесс. Ю Би проводила эксперименты, собирала данные, участвовала в анализе данных и работе по редактированию статей.

Благодарности

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

Авторы искренне признают финансовую поддержку, оказанную Научно-исследовательским проектом Департамента образования провинции Цзилинь.

ФИНАНСИРОВАНИЕ:

Эти исследования были финансово поддержаны Научно-исследовательским проектом Департамента образования провинции Цзилинь (Грант No JJKH20240801KJ).

Материалы

Список материалов, использованных в этой статье
ИмяКомпанияКаталожный номерКомментарии
Пакет для реализации CARE-MIRV-NetДополнительный файл 1Версия 1.0Н/Д
Скрипты для повторного создания рисунков и таблицДополнительный файл 1Версия 1.0Н/Д
Изображения планов этажей и их набор данных с подробной информациейKaggleОткрытый набор данныхН/Д
GPUNVIDIA CorporationTesla T4 × 2Н/Д
Процессор Intel XeonIntel Corporation2.20 ГГцН/Д
KerasKeras TeamВерсия 3.13.2Н/Д
MatplotlibMatplotlib Development TeamВерсия 3.9RRID:SCR_008624
NumPyNumPy DevelopersВерсия 2.4.6RRID:SCR_008633
Операционная системаLinuxUbuntu 22.04 LTSН/Д
PandasPandas Development TeamВерсия 2.3.3RRID:SCR_018214
PythonPython Software FoundationВерсия 3.12.12RRID:SCR_008394
Scikit-learnScikit-learn DevelopersВерсия 1.6.1RRID:SCR_002577
SHAPSHAP Development TeamВерсия 0.51.0Н/Д
Оперативная память (RAM)Облачное вычислительное окружение31 ГБН/Д
TensorFlowGoogleВерсия 2.19.0RRID:SCR_016345
Конфигурационный файл для среды обученияДополнительный файл 1Версия 1.0Н/Д

Перепечатки и разрешения

Запросить разрешение на повторное использование текста или иллюстраций этой статьи JoVE

Запросить разрешение

Теги

EngineeringMeta ensemble learningfloor plan analysisresidential designelderly care housinghealthcare integrated designXAI
Видео скоро будет доступно

Похожие статьи