Исследовательская статья

Объяснимая модель федеративного обучения для межинституционального цифрового финансового сотрудничества и контроля рисков

DOI:

10.3791/69805

3 марта 2026 г.

В этой статье

Краткое содержание

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

Мы демонстрируем воспроизводимый протокол для реализации FedRisk — объяснимой федеративной структуры обучения. Процедура включает семантическую гармонизацию данных, выравнивание сущностей с сохранением конфиденциальности, дифференциальную калибровку конфиденциальности, локальное обучение GBDT, глобальное слияние Transformer и градиентно-сжатые асинхронные обновления, обеспечивающие безопасное, масштабируемое и соответствующее нормативам финансовое прогнозирование рисков в различных учреждениях.

Аннотация

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

Фрагментация финансовых данных между учреждениями и строгие правила конфиденциальности серьёзно затрудняют совместное управление рисками, что приводит к неоптимальному выявлению мошенничества с точностью ниже 60% и высоким ошибкам дефолта по кредитам малого и среднего бизнеса свыше 25%. Существующие решения для федеративного обучения сталкиваются с проблемами с данными Non-IID, интерпретацией моделей и соответствием, что приводит к реальных показателям внедрения ниже 20%. Чтобы устранить эти пробелы, мы предлагаем FedRisk — объяснимую федеративную структуру обучения, объединяющую четыре ключевые инновации. Во-первых, межинституциональная сетка данных с онтологической семантической гармонизацией достигает использования признаков выше 85%. Во-вторых, гибридная модель ИИ сочетает локально интерпретируемый GBDT с монотонными ограничениями и глобальным Transformer, основанным на внимании, снижая потерю производительности в не-IID сценариях на 7,6% по сравнению с FedAvg. В-третьих, трехчастный механизм конфиденциальности использует адаптивную дифференциальную приватность с общим бюджетом ε=5, аддитивное совместное использование секретов и регуляризацию, ориентированную на справедливость, ограничивая групповое предсказательное смещение ниже 0,05 и потери RAROC менее 2,1%. В-четвёртых, оптимизации с эффективностью связи снижают пропускную способность на раунд до 8,5 МБ и время обучения до 85 минут. Оценивая по более чем 5 миллионам межинституциональных записей, FedRisk достигает AUC-ROC 0,912, что всего на 1,8% ниже, чем централизованный GBDT, при этом сопротивляется атакам на выводы членов с AUC 0,58. Он сокращает межинституциональную передачу данных на 99% и превосходит классические базовые показатели FL на 7,3% в AUC-ROC. Обеспечивая безопасное, прозрачное и соответствующее нормативам прогнозирование рисков без обмена необработавшими данными, FedRisk предоставляет масштабируемое решение для межинституционального финансового сотрудничества.

Введение

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

Глубокое развитие цифровых финансов меняет модели обслуживания — от личного контроля кредитных рисков до финансирования цепочки поставок МСП, делая данные ключевым фактором производства. Согласно «Отчету по развитию финтеха в Китае за 2023 год» НБК, к концу 2023 года цифровой кредитный масштаб Китая превысил 65 триллионов юаней, что составляет 38% от общего баланса, а ежедневные данные по транзакциям превысили500TB 1. Однако «изолированные данные» остаются значительным барьером. Учреждения обычно используют модели закрытых данных из-за конкуренции и вопросов безопасности. Например, при выявлении мошенничества с кредитными картами банки, полагаясь исключительно на внутренние данные, пропускают критически важные межинституциональные записи, что приводит к уровню идентификации новых видов мошенничества ниже 60%. Аналогично, для кредитования МСП отсутствие внешних страховых и налоговых данных приводит к ошибкам прогнозирования дефолта более 25%. Эта фрагментация создает двойные проблемы: ограничение доступа для 200 миллионов недостаточно обслуживаемых клиентов и увеличение риска перекрёстной инфекции на 18% (отчет CBIRC 2023). В результате изолированные данные стали основным узким местом, препятствующим высококачественному развитию цифровых финансов.

В последние годы рост глобальных законов о конфиденциальности данных значительно ограничил централизованный обмен данными. Финансовые учреждения теперь должны придерживаться трёх основных принципов: «минимальная необходимость», «информированное согласие» и «отслеживаемость». Хотя региональные рамки различаются, все они устанавливают строгие пороги на межинституциональное использование данных, как подробно описано в Таблице 1.

Нормативная базаОсновные ограничительные предложенияВлияние на сотрудничество с финансовыми данными
Общий регламент ЕС по защите данных (GDPR)1. Трансграничная передача данных должна соответствовать требованиям «определения достаточности»; 2. Физические лица имеют право на доступ и удаление своих данных; 3. Утечки данных должны быть сообщены в течение 72 часовНесанкционированная трансграничная передача исходных данных запрещена, а централизованный обмен требует оценки влияния на конфиденциальность (PIA), что увеличивает расходы на соответствие на 30%
Закон Калифорнии о защите прав потребителей (CCPA)1. Потребители могут просить компании удалить их персональные данные; 2. Обмен данными требует чёткого уведомления о том, для чего они будут использоватьсяЦентрализованные платформы требуют интерфейсов доступа к данным для каждого потребителя, увеличивая операционные расходы на 25% и облегчая потребителям удаление данных, что приводит к отсутствию обучающих данных модели
Закон Китая о защите персональных данных1. Обработка личной информации требует отдельного согласия; 2. Обработка конфиденциальной личной информации требует дополнительных документов для авторизации; 3. Создать систему «классификации и защиты данных»Межинституциональный обмен данными требует разрешения каждого клиента, и на практике уровень авторизации составляет менее 40%. Централизованный режим сложно реализовать
Директива ЕС по платежным услугам II (PSD2)1. Открыть интерфейс банковских данных; 2. Обмен данными должен основываться на авторизации клиента и ограниченном использованииХотя она поддерживает обмен данными, она требует, чтобы весь процесс доступа к интерфейсу отслеживался, а централизованная платформа должна взять на себя ответственность за безопасность и аудит интерфейсов, что значительно увеличивает техническую сложность

Таблица 1: Сравнение основных требований основных нормативных рамок по данным.

В данном исследовании представлены три ключевых инновации для решения задач межинституционального федеративного моделирования рисков. Во-первых, архитектура сетки данных с онтологическим семантическим слоем стандартизирует гетерогенные схемы, достигая более 85% использования функций при сохранении суверенитета данных. Во-вторых, гибридная модель ИИ сочетает локально интерпретируемый GBDT с монотонными ограничениями, соответствующими нормативам, и глобальный трансформер, ориентированный на внимание. Динамически взвешивая институциональные результаты, эта модель снижает потерю производительности Non-IID на 7,6%, сохраняя AUC-ROC на уровне 0,912. В-третьих, трёхчастный механизм соответствия конфиденциальности интегрирует адаптивную дифференциальную конфиденциальность (ε=5), аддитивное секретное распространение и регуляризацию, ориентированную на справедливость, чтобы обеспечить соответствие GDPR, ограничить предвзятость ΔDP до < 0,05 и противостоять атакам на выводы членов (AUC=0,58). Вместе эти инновации согласовывают требования фрагментации данных, интерпретируемости регуляторов и компромиссов между конфиденциальностью и безопасностью в федеративном финансовом ИИ.

Федеративное обучение в финансах классифицируется на горизонтальное федеративное обучение (HFL)2, вертикальное федеративное обучение (VFL)3 и федеративное трансферное обучение (FTL)4 на основе распределения данных (Таблица 2).

Федеральная парадигмаОсновные особенностиСценарий адаптации к контролю финансовых рисковРепрезентативные исследованияОграниченность
Горизонтальное федеральное обучениеПространство признаков данных участников последовательно, но пространство выборки отличаетсяМежорганизационное обнаружение мошенничества с кредитными картамиМакМахан и др. [[i]](2017) предложили алгоритм FedAvg, который впервые применил HFL к финансовой борьбе с мошенничеством путём достижения межинституционального сотрудничества моделей через усреднение параметров и улучшил уровень обнаружения мошенничества на 12% на базе данных из 10 банковБез учета ненезависимых и идентично распределённых (Non-IID) характеристик финансовых данных, при разнице в распределении рисков клиентов между учреждениями превышает 30%, AUC-ROC модели снижается более чем на 15%
Вертикальное федеральное обучениеПространство выборок участников последовательно, но пространство признаков отличаетсяСовместный контроль кредитных рисков между банками и страховыми компаниямиЯнг и др. [ii]] (2020) предложили алгоритм SecureBoost, который обеспечивает вертикальное обучение совместных признаков с помощью гомоморфного шифрования и достигает точности прогнозирования по умолчанию 89,3% в сценарии кредитов малого и микробизнесаОн опирается на строгое согласование сущностей, что несёт высокий риск утечки конфиденциальности, а эффективность обучения резко падает, когда размер признака слишком велик
Федеральное обучение переводаСуществуют различия в распределении данных и пространстве признаков участниковМиграция рисков между сценариямиПан и др.[[iii]] (2021) решили проблему дефицита выборок в финансировании цепочки поставок, инициализируя модель оптимизации миграции параметров, которая улучшила скорость сходимости на 60%«Отрицательная миграция» скорее всего произойдёт во время миграционного процесса. Когда разница в механизме риска между исходным и целевым сценарием превышает 40%, производительность модели превышает традиционную модель
[[i]]МакМахан, Б., Мур, Э., Рамейдж, Д., Хэмпсон, С., и Аркас, Б. А. (2017). Коммуникационно-эффективное обучение глубоких сетей на основе децентрализованных данных. Труды 20-й Международной конференции по искусственному интеллекту и статистике, 1273–1282.
[[ii]]Ян, К., Лю, Ю., Чен, Т., и Тонг, Ю. (2020). Федеративное машинное обучение: концепция и приложения. Транзакции ACM по интеллектуальным системам и технологиям, 10(2), 1–19.
[[iii]]Пан, С. Дж., и Янг, К. (2021). Опрос по трансферному обучению. IEEE Transactions on Knowledge and Data Engineering, 33(12), 2345–2359.

Таблица 2: Сравнение парадигм обучения в финансовом секторе.5,6,7

Недавние достижения решают специфические для сценариев проблемы:FedSSL 8 решает дефицит ярлыков через контрастное обучение, а FedLite9 достигает сокращения коммуникации на 490× для учреждений с ограниченными ресурсами. Расширения вздравоохранение 10, уязвимостибезопасности 11, мультимодальныхфинансов 12 и масштабируемости13 демонстрируют широкое применение FL.

Защита конфиденциальности является ключевым элементом контроля финансовых рисков. Три основных метода — дифференциальная конфиденциальность (DP)14, безопасные многосторонние вычисления (SMC)15 и гомоморфное шифрование (HE)16 — обладают явными преимуществами в прочности, эффективности и адаптивности. DP формально определяется как Pr[M(x) = y] ≤ e ⋅ Pr[M(x') = y] + δ, где M представляет рандомизированный алгоритм, $x$ и $x'$ — соседние наборы данных, а y — выход алгоритма. Это обеспечивает сходство выходных данных между наборами данных, строго ограничивая индивидуальные утечки за счёт контролируемого шума. Сравнительный анализ их технических характеристик представлен в таблице 3.

Тип технологииОсновные принципыСила конфиденциальности (ε ценность)Сложность вычисленийАдаптируемость финансовых сценариев
Дифференциальная конфиденциальностьОтдельные вклады в набор данных неразличимы, добавляя шумε=1-5 (рекомендуемое значение для финансовых сценариев)O (n) (n — размер выборки)Высокое, подходящее для всего процесса обучения моделей, может бесшовно сочетаться с федеративным обучением
Безопасные многосторонние вычисленияНесколько участников совместно вычисляют, не раскрывая промежуточные результатыИнформационно-теоретическая безопасностьO (n²) (вертикальный федеральный сценарий)Да, он подходит для расчёта чувствительных соединений признаков, но в больших выборочных случаях это занимает слишком много времени
Гомоморфное шифрованиеЗашифрованные данные вычисляются напрямую, и правильный результат получается после расшифровкиВычислительная безопасностьO (n³) (на основе решётчатой криптографии)Низкий, подходящий только для передачи параметров в мелком масштабе, миллионы образцов рассчитывают сценарий более 24 часов

Таблица 3: Сравнение характеристик технологий защиты конфиденциальности.

В финансовых приложениях дифференциальная конфиденциальность стала основным выбором благодаря своему «контролю баланса по эффекту конфиденциальности». Дворк, C.17 предложил классическое (ε, δ)-DP определение, обеспечивающее количественный стандарт защиты конфиденциальности. Основная формула такова:

Уравнение 3(1)

Здесь M Как алгоритм защиты конфиденциальности, D и D — это смежный набор данных (только одно различие в примере), Бюджет конфиденциальности (чем меньше защита конфиденциальности, тем сильнее), r Бюджет конфиденциальности (чем меньше защита приватности, тем сильнее), δ Вероятность отказа (обычно принимается 10-5).

Абади, М. и др.18 разработали дифференциальный стохастический градиентный спуск (DP-SGD), использующий градиентное клиппинг и шумовую инъекцию для снижения утечек конфиденциальности кредитной модели до ниже 8%. Для чувствительной обработки в первую очередь используются безопасные многосторонние вычисления (SMC) и гомоморфное шифрование. Например, Bogetoft, P. и др.19 применяли SMC к межбанковской кредитной оценке, обеспечивая доступ только к итоговым результатам. Перри, L.2 предложил полностью гомоморфный алгоритм шифрования для безопасной агрегации параметров, хотя высокая вычислительная сложность ограничивает его применение маломасштабным обучением среди средних банков.

Модели управления рисками ИИ эволюционировали от традиционных централизованных архитектур к распределённым архитектурам, где две парадигмы демонстрируют значительные различия в зависимости данных, производительности и затратах на соответствие. Централизованные модели включают деревья градиентного усиления (GBDT) и модели глубокого обучения. Алгоритм GBDT, предложенный Фридманом, Дж., Хасти, Т. Тибширани, R.21 , повышает точность прогнозирования рисков за счет многодеревьевой интеграции, достигая AUC-ROC 0,93 в личных кредитных сценариях. Однако для этого требуется сбор полных данных о клиентах, что несёт риски утечек данных и проблем с соблюдением требований. Zhang, H., Liu, Y., Zhang, X., Yin, Z.Li, Y.22 разработали модель контроля рисков на основе трансформаторов, которая улучшает уровень обнаружения мошенничества на 15%, при этом размер параметров превышает 10 ГБ. Распределённая парадигма включает подходы к совместному использованию параметров и функциям. Совместное использование параметров (например, FedAvg) агрегирует локальные параметры, но испытывает трудности с характеристиками Non-IID: AUC-ROC снизился с 0,89 до 0,82, а разницы в стандартных ставках выросли с 0,5% до 3,5%. Совместное использование функций (например, SecureBoost) обеспечивает вертикальное сотрудничество, но требует точного выравнивания, при этом производительность резко падает на 20% при превышении 5% ошибок.

Суть федеративного обучения заключается в обеспечении многоинституционального совместного обучения без передачи необработанных данных. Эта структура определяет участников, процесс обучения и целевые функции. В данном исследовании система состоит из узлов Kfinancial (обозначаемых как P1,P 2, ..., PK) и координатора C. Каждое учреждение PK содержит локальный набор Уравнение 10данных X  k,iR d , которые являются векторами признаков клиента yk,i∈{0,1}, для меток риска (0 — нормально, 1 — мошенничество по умолчанию), локального размера выборки, полной шкале Уравнение 13данных. Обучение проходит по процессу «локальная итерация — глобальная агрегация»: i) Инициализация: координатор генерирует начальные глобальные параметры θ0 и распределяет их между всеми учреждениями; ii) Локальная итерация: в раунде обучения учреждениеP K основано на локальных данных и текущих глобальных параметрах θt, минимизируя локальную функцию потерь за счёт градиентного снижения, получая обновлённые локальные параметры θt,k, то есть:

Уравнение 18(2)

Где n — скорость обучения, а ∇θLkt) — градиент локальных потерь a θt — градиент локальных потерь θt; iii) Глобальная агрегация: Учреждение шифрует и загружает локальный параметр координатору, координатор генерирует новые глобальные параметры θt+1 с помощью взвешенной агрегации по размеру выборки:

Уравнение 22(3)

iv) Конечное условие: повторить шаг 2-3, пока производительность глобальной модели на валидационном наборе не улучшится в последовательных раундах, Выводите итоговую модель. θ* = θT. Учитывая характеристики финансовых данных с ненезависимым идентичным распределением (Non-IID), необходимо расширить предположения традиционного федеративного усреднения (FedAvgP k). В этом исследовании используются двойные измерения — «гетерогенность распределения меток» и «гетерогенность распределения признаков» — для характеристики Non-IID: пусть доля положительных экземпляров (событий по умолчанию) в институтах определяется следующим образом:

Уравнение 24(4)

Определим коэффициент изоморфизма тегов ; Пусть средняя разница признаков множеств равна : Когда α>0,03 и когда, Определяется как высокий Non-IID сценарий.

В зависимости от способностей и цели атакующего, сценарии угроз делятся на три категории, как показано в Таблице 4

Тип угрозыИдентификация нападающегоБоксерская грушаТипичные средние
Полу-правдивое нападениеУчаствующие учреждения/координаторыВывод характеристик клиентов других учрежденийАтака на градиентную инверсию и рассуждение членов на основе параметров модели
Вражеская атакаВредоносные институтыГлобальная модель загрязненияЗагрузка ложных градиентов и моделей отравления
Внешняя атакаНесанкционированные третьи лицаКража параметров/функций в транзитеПромежуточные атаки, прослушивание каналов связи

Таблица 4: Классификация модели угроз финансовой системы.

Используя (ε,δ) -Дифференциальную конфиденциальность (Differential Privacy, DP) в качестве основного стандарта защиты конфиденциальности, её суть заключается в добавлении шума, чтобы игнорировать влияние «содержит ли набор данных выборку» на результат модели. Формальное определение следующее: для алгоритмов федеративного обучения M, если для любых двух смежных наборов данных и отличающихся только на одну выборку (DΔD' = 1), а также для любого выходного множества S⊆Range(M), оно удовлетворяет:

Pr[M(D)∈S]≤eε⋅Pr[M(D')∈S]+δ (5)

Тогда это называется удовлетворённым (ε,δ)-DP. Один из них — «бюджет конфиденциальности» (чем меньше защита конфиденциальности, тем сильнее он, и обычно рассматривается финансовый сценарий), δ «вероятность провала» (обычно δ≤10-5, чтобы события с низкой вероятностью не влияли на конфиденциальность и безопасность). Для адаптации к характеристикам многораундовых итераций федеративного обучения общее потребление конфиденциальности рассчитывается с использованием комбинационной теоремы «дифференциальной конфиденциальности Реньи» (RDP). Пусть бюджет конфиденциальности каждого обучающего раунда будет εt, тогда общий бюджет приватности после тренировки цикла удовлетворяет:

Уравнение 32(6)

Эта теорема даёт теоретическую основу для адаптивной калибровки шума за счёт динамического распределения бюджета конфиденциальности на каждый раунд.

FedRisk использует строгую (ε, δ)-дифференциальную систему конфиденциальности (DP), динамически распределяя бюджеты на конфиденциальность с помощью теоремы Rényi DP (RDP). Он определяет глобальную чувствительность Δf как максимальное изменение L1-нормы параметров модели, вызванное смежными наборами данных (различающимися на одну выборку), с учетом дисперсии калибровки шума Лапласа (коэффициент шума κ_t пропорциональный флуктуациям распределения данных). При ограничении общего бюджета конфиденциальности ε=5 (достигая порогов соответствия GDPR), RDP преобразует многораундное потребление приватности обучения в (ε, δ)-DP (δ=10⁻⁵), балансируя прочность защиты и эмпирические результаты модели — эмпирические результаты показывают, что это подавляет AUC атак на вывод участников до 0,58, сохраняя прогноз риска AUC-ROC на уровне 0,912.

Оптимизация моделей контроля финансовых рисков должна одновременно удовлетворять три регуляторных требования: «предсказательная точность», «защита конфиденциальности» и «справедливость». Традиционные функции оптимизации, направленные исключительно на минимизацию потерь, больше не применимы. Необходимо создать многоцелевую структуру оптимизации, чтобы преобразовать регуляторные ограничения в количественно измеримые регуляризированные термины. Для бинарных сценариев классификации (по умолчанию/нормально) логарифмическая потеря (LogLoss) принимается в качестве базовой функции потерь для измерения отклонения между предсказанными моделями вероятностями и фактическими метками, определяемая как:

Уравнение 33(13)

Где pk,i = σ(θ; xk,i) — это предсказанная вероятность по умолчанию выборки (xk,i,y k,i) для модели, σ(⋅) — функция активации сигмоидов.

Требования GDPR, Закона о защите персональной информации и других нормативных актов преобразованы в три типа терминов регуляризации, которые объединяются с базовой функцией потерь для формирования конечной цели оптимизации:

Уравнение 37(14)

Определение и функция каждого термина регуляризации следующие: i) Ограничения конфиденциальности: На основе стоимости добавления шума при дифференциальной конфиденциальности обсуждается влияние количественной защиты конфиденциальности на точность моделей. Пусть глобальная чувствительность параметров модели Δ равна (то есть максимальное изменение параметров, вызванное соседними наборами данных), тогда:

Уравнение 39(15)

Этот термин гарантирует, что дополнительная интенсивность шума соответствует бюджету конфиденциальности и избегает чрезмерной жертвы точностью модели. ii) Ограничение справедливости: В связи с требованиями к «антидискриминации» в Законе о защите личной информации предвзятость различных групп ограничена. Возьмём в качестве примера «демографический паритет» (DemographicParity), пусть положительная скорость гпредсказания множества равна Уравнение 41, тогда:

Уравнение 210 (16)

Этот термин минимизирует разницу в частоте предсказания между разными группами и избегает различения моделей. iii) Ограничения на устойчивость: В ответ на требования к «возможностям противоинтерференции моделей» в Базель III, убедитесь, что небольшие нарушения данных не влияют существенно на выход модели. Добавляя состязательные образцы возмущений Δx (удовлетворяющих |Δx|≤γ), исследование определяет:

Уравнение 45(17)

Устойчивость модели расширения терминов к аномальных данным повышается, а риск ошибочных оценок снижается. В этой формуле — коэффициент регуляризации, который определяется путём перекрёстной валидации (в данном исследовании λ1=0,01,λ2=0,05,λ3=0,02). Обеспечить баланс между тремя регуляторными целями и точностью прогноза.

Доступ ограничен. Войдите в систему или начните пробный период, чтобы просмотреть этот контент.

Протокол

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

Архитектура системы

Межинституциональная сетка данных и семантический слой

Для решения межинституциональной гетерогенности данных исследование строит архитектуру Data Mesh с помощью доменно-ориентированного разделения узлов. Каждое финансовое учреждение функционирует как независимый узел домена данных, сохраняя при этом права собственности и контроля, при этом семантический уровень обеспечивает единое понимание и взаимодействие с данными. Семантический слой на основе онтологий устанавливает единую модель данных по контролю финансовых рисков, определяя основные сущности,атрибуты f-карты и отношения между сущностями. Конкретные правила семантического отображения изложены в таблице 5. Для специализированных областей стандартизированные преобразования достигаются с помощью функций семантического отображения:

Уравнение 48(18)

Сущность ядраНазвание учреждения в области AНазвание поля B в учрежденииИмя поля семантического слоя униформыТип данныхСтандартизированные правила
КлиентПремиальный рейтинг клиентов (1-5)Уровни VIP-клиентов (от бронзового до алмазного)Кредитный рейтинг клиентов (1-5)Целое числоБронза→1, Серебро→2, Золото→3, Платина→4, Бриллиант→5
БизнесСумма сделки (десять тысяч юаней)Сумма транзакции (юань)Сумма транзакции (юань)Плавающее числоСтоимость поля A в учреждении составляет 10 000 раз больше
Заявка на кредитКвота заявителей (кредитный коэффициент)Ожидаемая сумма кредитаСумма кредита заявителя (юань)Плавающее числоУчреждение A: Общее отношение кредитов × суммы заявки; Учреждение B: прямое картографирование

Таблица 5: Правила семантического отображения основных сущностей в области контроля финансовых рисков.

Здесь xi,j — i-е удельное значение поля учреждения j, min(xj) и max(xj) — минимальные и максимальные значения поля внутри учреждения соответственно, Uj иL j определяют верхний и нижний пределы унифицированного диапазона значений для этого поля на семантическом слое.

Глобальный реестр моделей на основе блокчейна и аудитский след

Для решения проблем хаотичного управления версиями моделей и неотслеживаемых процессов обучения в федеративном обучении используется технология блокчейн для создания глобального реестра моделей и системы аудита — трассировки. Используя архитектуру блокчейн-консорциума, участвующие узлы включают финансовые учреждения, федеративных координаторов и регулирующие органы, обеспечивая неизменность данных и многопартийный консенсус23. Глобальный реестр моделей хранит основные метаданные моделей, включая номера версий, обучающие раундыH v, списки участвующих учреждений, структурные параметры и показатели эффективности. Эти метаданные хранятся с использованием структуры дерева Меркла, при этом каждая версия модели соответствует уникальному хеш-значению:

Уравнение 57(19)

Здесь v — номер версии модели, T — общее количество обучающих раундов, S — совокупность учреждений, участвующих в обучении, IDi — уникальный идентификатор учреждения i, θv — вектор параметров модели для версии v, а AUCv — значение AUC-ROC этой версии модели.

Конвейер федеративного инжиниринга признаков

Безопасное выравнивание сущностей и гармонизация схем

Инженерия функций является основным компонентом межинституционального сотрудничества с данными, требуя эффективного извлечения, согласования и агрегирования функций при обеспечении конфиденциальности данных. Это исследование разрабатывает комплексный конвейер, включающий защищённое согласование сущности, координацию схем и агрегацию графов транзакций с дифференциальной конфиденциальностью, чтобы решить как межинституциональную гетерогенность, так и риски утечкиконфиденциальности 24. Межинституциональное согласование является необходимым для достижения сотрудничества по функциям. Однако прямая передача идентификаторов клиентов нарушает конфиденциальность. Поэтому исследование использует метод выравнивания сущностей, сохраняющий конфиденциальность, сочетающий гомоморфное шифрование (HE) с технологией локально чувствительного хеширования (LSH). Учреждения предварительно обрабатывают идентификаторы клиентов с помощью хеш-функций SHA-256 для генерации предварительных идентификаторов. Эти идентификаторы затем отображаются в одном «ведре» через LSH для снижения последующих вычислений шифрования. Идентификаторы внутри одного кота проходят гомоморфное шифрование Пайе. Зашифрованные идентификаторы загружаются в федеративного координатора, который достигает выравнивания сущностей путём сравнения сходства зашифрованных идентификаторов с помощью косинусоидального сходства.

Уравнение 64(20)

Когда сходство превышает заранее установленный порог (в данном исследовании оно принимается как τ=0,95), определяется, что это одна и та же сущность, и генерируется единый идентификатор сущности между учреждениями для обеспечения безопасного выравнивания сущности.

Дифференциально частная агрегация вложенных графов транзакций

Данные финансовых операций демонстрируют характерные графово-структурированные характеристики (клиенты выступают узлами, а транзакции — рёбрами). Встраивание в граф транзакций эффективно фиксирует паттерны транзакций связанных клиентов, предоставляя критически важные функции для моделей контроля рисков. Однако прямая агрегация межинституциональных графов транзакций Gi=(V i,E i)ViiEie i,vr dd транзакционных графов может раскрыть информацию, связанную с транзакциями клиентов. Поэтому внедрена технология DifferentialPrivacy (DP) для достижения сохранения конфиденциальности агрегации вложений в графы транзакций. Каждое учреждение локально строит граф транзакций, где представлен набор клиентских узлов для учреждения и представляет набор рёбер транзакций (веса ребер, равные суммам транзакций). Алгоритм GraphSAGE используется для генерации вложений узлов (с 256-мерными измерениями вложения в данном исследовании). Для соответствия требованиям по дифференциальной конфиденциальности к локальным встраиваниям добавляется шум лапласа:

Уравнение 67(21)

Здесь ΔG глобальная чувствительность алгоритма GraphSAGE (оценена экспериментом в данном исследовании ΔG=0,8), для локального бюджета конфиденциальности агентства,

Уравнение 70(22)

Для общего бюджета конфиденциальности системы в этом исследованииε всего=1,5). Координатор агрегирует шумовые вложения в каждое учреждение, используя стратегию Уравнение 72 взвешенного среднего, с весами, основанными на проценте клиентов каждого учреждения:

Уравнение 73(23)

Агрегированный глобальный граф транзакций Уравнение 200 встроен и передаётся обратно каждому учреждению. Как ключевая функция модели контроля рисков, он не только сохраняет информацию о корреляции транзакций между учреждениями, но и защищает конфиденциальность клиентов через дифференциальную конфиденциальность.

Уравнение 201 (24)

Гибридная модель риска ИИ

Локальные подмодели: градиентное усиление с монотонными ограничениями

Традиционные централизованные модели контроля рисков ИИ испытывают трудности с адаптацией к межинституциональным федеративным сценариям. В данном исследовании разрабатывается гибридная модель риска ИИ, объединяющая «локальные подмодели + глобальная модель синтеза», интегрируя высокую интерпретируемость градиентных бустерных деревьев (GBDT) с адаптивностью Transformer к ненезависимым и идентично распределённым (NID) данным. Вводится модуль интерпретации для баланса между производительностью и объяснимостью модели в федеративных средах. Каждое учреждение локально разрабатывает подмодели GBDT, выбираемые за их сильную структурную подгонку данных и высокую интерпретируемость — необходимые требования для регулирования финансового контроля рисков. Чтобы избежать перенагонов и нелогичных выводов, во время обучения GBDT вводятся монотонные ограничения, обеспечивая монотонное увеличение или уменьшение закономерностей для ключевых показателей, таких как доход клиентов и кредитные рейтинги. Первое дерево, заданное GBTD, — это ht(x), а выход модели выглядит следующим образом:

Уравнение 76(25)

Здесь η — скорость обучения (в этом исследовании η=0,1). Монотонное ограничение реализуется регулярированием функции потерь xj.

Добавьте термин ограничения:

Уравнение 80(26)

Здесь x≺x' означает, что собственное значение x меньше собственного значения x', а конечная функция потерь выглядит:

Уравнение 84(27)

Здесь l — логарифмическая функция потерь (используемая в сценарии бинарного контроля риска yi∈{0,1}, указывающая на дефолт клиента). Уравнение 87 — это член регуляризации сложности для дерева, λ и γ — коэффициент регуляризации (Это исследование проводилось с помощью λ=0,01 γ=0,5 кросс-валидации,n i — количество локальных выборок для учреждения i, T — количество деревьев (в этом исследовании было T=100).

Глобальный синтез: Трансформер на основе внимания для адаптации Non-IID

Межинституциональные данные демонстрируют значительные характеристики распределения Non-IID. Традиционные алгоритмы FedAvg, которые просто усредняют параметры локальной модели, испытывают трудности с адаптацией к данным Non-IID. Для решения этой проблемы в исследовании введена модель трансформера attentionp i(x)=σ(Fi(x))σFi(x)ia i-основанная на i-образе для интеллектуального слияния локальных подмоделей. Глобальная модель слияния принимает на вход выходные вероятности из локальной подмодели каждого учреждения (выходы сигмоидной функции из институциональных моделей GBDT). Архитектура Transformer состоит из энкодера и слоя внимания, где уровень внимания рассчитывает веса внимания из выходных данных разных учреждений для достижения адаптивного взвешивания. Веса внимания рассчитываются с помощью масштабированного точечного произведения внимания:

Уравнение 94(28)

Здесь q — вектор запроса (порождённый средними признаками риска глобальных выборок), Уравнение 96 — ключевой вектор учреждения i,d k — размерность ключевого вектора (в этом исследовании dk=64), n — количество агентств, участвующих в федерации.

Итоговая вероятность выхода глобальной модели составляет:

Уравнение 101(29)

Благодаря механизму внимания глобальная модель может автоматически присваивать больший вес учреждениям с высоким качеством данных и точным прогнозированием рисков, а также повышать адаптивность к данным Non-IID.

Модуль объяснимости: SHAP на федеративных деревьях + генератор контрфактов

Модели контроля финансовых рисков должны сохранять интерпретируемость для удовлетворения нормативных требований и защиты права клиентов знать. Для решения этой задачи исследование разрабатывает модуль интерпретируемости, объединяющий федеративные генераторы контрфактов SHAP+. Для локальных подмоделей GBDT исследование использует значения SHAP для измерения важности признаков, которые SiR Ni×mm количественно оценивают вклад каждого признака в результаты прогнозирования. В федеративных сценариях прямая передача локальных значений SHAP может скомпрометировать информацию о распределении признаков. Поэтому исследование реализует стратегию безопасной агрегации, при которой каждое учреждение локально вычисляет матрицу значений SHAP (для количества признаков), применяет дифференциальный шум конфиденциальности к значениям SHAP и загружает их в федеративного координатора. Затем координатор вычисляет глобальные значения SHAP:

Уравнение 103(30)

Здесь Si' — это матрица значений SHAP учреждения i, а wi — доля размера выборки учреждений.

Вводим текущий собственный вектор клиента x и целевой рейтинг риска y, Вывод — это антифактический вектор признаков xcf, удовлетворённый (порогвероятности целевой цели соответствующий рейтингу риска цели). и |xcf-x|2 — минимум (то есть минимальная стоимость корректировки). Функция потерь генератора фактов выглядит следующим образом:

Уравнение 110(31)

Здесь α,β,γ — коэффициенты веса (в данном исследовании α=10,β=5,γ=1),L GAN Функция состязательных потерь используется для GAN для обеспечения рациональности и подлинности контрфактического вектора признаков.

Уровень конфиденциальности и безопасности

Безопасная агрегация с помощью аддитивного совместного использования секретов

В федеративном обучении передача и агрегирование локальных параметров модели являются ключевым звеном в утечках конфиденциальности. Технология AdditiveSecretSharing (ASS) применяется для обеспечения безопасной агрегации и предотвращения прямого приобретения локальных параметров каждой организации координатором. Конкретный процесс выглядит следующим образом: i) Каждое учреждение разделяет локальные параметры модели на секретные акции θi, 1, θi, 2,...,θi,n, удовлетворяющее Уравнение 118, Вот количество участвующих учреждений; ii) Учреждение i отправляет долю θi,k в учреждение (k≠i), сохраняет свою долю θi,i; iii) Каждое учреждение k собирает акции, отправленные всеми другими учреждениями θ1,k,θ 2,k,...,θn,k, и суммирует их с долей θk,k, сохранившейся у него, получает частную сумму; iv) Все учреждения загрузят и передают часть информации координатору, координатор вычисляет результаты Уравнение 126агрегации глобальных параметров. С помощью аддитивного обмена секретами координатор может получить только глобальные агрегированные параметры и не может вывести n-1ttt=⌈n/2⌉ не вывести локальные параметры какого-либо отдельного учреждения. Даже сговор между несколькими учреждениями не может восстановить параметры от других, обеспечивая конфиденциальность и безопасность во время передачи параметров. Для устранения потери акций, вызванных институциональными разрывами, в качестве резервного варианта вводится механизм обмена секретами Шамира. Каждая доля дополнительно делится на фрагменты. Собирая любой фрагмент, можно восстановить полную долю, что повышает устойчивость системы.

Адаптивная калибровка шума в рамках ( ε, δ)-DP бюджетного планирования

Основная проблема дифференциальной конфиденциальности заключается в балансе между силой защиты конфиденциальности и производительностью модели. Традиционные методы сложения с фиксированным шумом испытывают трудности с адаптацией к ситуациям, когда распределение данных динамически меняется во время федеративного обучения. В этом исследовании разработан адаптивный механизм калибровки шума на основе (ε,δ)-DP, в сочетании с стратегией планирования бюджета на основе конфиденциальности, чтобы достичь динамической корректировки интенсивности шума. Определите общий бюджет на конфиденциальность системы как (Это исследование занимаетδ всего=10-5 , соответствует требованиям GDPR по риску конфиденциальности), Примените стратегию сегментированного бюджетного планирования, Общий бюджет распределяется на {ε1,ε 2,...,ε цикл обучения следующим образом, выполнено:

Уравнение 130(32)

В каждом этапе обучения интенсивность шума динамически корректируется в соответствии с характеристиками распределения локальных данных . При условии, что дисперсия локальных характеристик данных t-го раунда учреждения равна Уравнение 132, Определим коэффициент корректировки шума αi,t:

Уравнение 134(33)

Когда αi,t≥0.8 (распределение данных стабильно), при небольшой интенсивности Уравнение 136шума ; Когда αi,t<0.8 (распределение данных колеблется) , увеличивает интенсивность шума . Среди них — глобальная чувствительность параметров модели (это исследование обеспечивает градиентное клиппинг).

Протокол обучения, эффективный для коммуникации

Асинхронные обновления клиентов с контролем застоявшихся

Межинституциональное федеративное обучение сталкивается с такими трудностями, как высокая задержка связи и значительное потребление пропускной способности (особенно для малых и средних финансовых учреждений с ограниченными сетевыми ресурсами). В данном исследовании разработан эффективный протокол обучения коммуникации, включающий асинхронные обновления клиентов, градиентное сжатие и обратную связь с ошибками для снижения затрат на связь и повышения масштабируемостисистемы 25. Традиционные синхронные федеративные методы обучения, такие как FedAvg, требуют ожидания, пока все клиенты завершат локальное обучение, прежде чем агрегировать параметры, что приводит к длительным циклам обучения. Асинхронный механизм обновления клиента позволяет клиентам самостоятельно проходить локальное обучение и сразу загружать параметры. Получив эти параметры, федеративный координатор обновляет глобальную модель в реальном времени, не ожидая других клиентов. Это решает проблему устаревших моделей в асинхронном обучении . Введение стратегии контроля застоявшихся характеристик определите значение застоявшегося для клиента (для текущего глобального тренировочного раунда tlast_update Раунд, в котором клиент последний раз получил глобальную модель). Когда (Smax — максимальная допустимая застоявость, это исследование принимает smax=5) . Клиент участвует в обучении обычно; Максимум> этого времени клиенту нужно снова скачать последнюю глобальную модель перед локальным обучением. Аппаратная конфигурация состоит из процессоров Intel Xeon E5-2678 v3 (12 ядер, 2,5 ГГц), в сочетании с видеопроцессорами NVIDIA Tesla V100 (16 ГБ видеопамяти) и 64 ГБ памяти DDR4 на узел для эффективной обработки распределённых обучающих задач. Для программной инициализации используются команды PySyft, такие как hook = sy. TorchHook(факел)andvirtual_worker = sy. VirtualWorker(hook, id="client1") используются для установления безопасных федеративных соединений, а federated_train_loader = sy. FederatedDataLoader(dataset.federate((client1, client2)), batch_size=32) обеспечивает федеративную загрузку данных между участниками. Семантическое отображение преобразует финансовые особенности между учреждениями — например, конвертируя суммы транзакций из USD в юань по динамической формуле обменного курса: transaction_amount_CNY = transaction_amount_USD exchange_rate + (0,001 randn()), где курс обмена периодически обновляется через API. Для дополнения несбалансированных наборов данных CopulaGAN генерирует синтетические состязательные выборки с помощью фрагмента кода, подобного импорту sdv.tabular CopulaGAN; синтезатор = CopulaGAN(эпохи=50); synthesizer.fit (train_data); synthetic_samples = synthesizer.sample(num_rows=1000), сохраняя статистические свойства исходных данных. Локальная тренировка GBDT обеспечивает монотонные ограничения (например, гарантируя, что "credit_score" положительно коррелирует с "approval_probability") viaparams = {"monotonic_constraints": (1, 0, -1)}в LightGBM, тогда как синтез трансформаторов реализуется в PyTorch с многоголовыми слоями внимания:self.attention = nn. MultiheadAttention (embed_dim=64, num_heads=4); attn_output, _ = self.attention (запрос, ключ, значение, key_padding_mask=padding_mask), за которым следует нормализация слоёв и остаточные связи для устойчивости. Дифференциальная приватность вводит шум Лапласа, масштабированный до чувствительности L1 (Δf) и бюджета конфиденциальности (ε), например, добавляя шум, дискретированный из np.random.laplace(loc=0, масштаб=Δf/ε), где Δf=1.2 и ε=0.5-, в градиенты до агрегации. Ограничения справедливости применяются после обучения путём перевзвешивания выборок обратно пропорционально их групповой распространённости (sample_weight = 1 / group_counts[y_train]), чтобы смягчить нарушения демографического паритета. В то же время стратегия взвешенной агрегации используется для корректировки веса параметров клиента в зависимости от значения застоявшегося:

Уравнение 143(34)

где λ=0,1 — коэффициент штрафа к застоявшемся; Чем больше застоявшийся, тем меньше вес, что снижает влияние устаревших параметров на глобальную модель.

Градиентное сжатие и накопление ошибок

Параметры модели (особенно веса внимания в глобальных термоядерных моделях Transformer) обладают высокой размерной сложностью. Прямая передача потребляла бы чрезмерную пропускную способность, что требовало бы градиентного сжатия для снижения передачиданных 26. В этом исследовании интегрируется спарсификация Top-K с квантованием, следуя следующим этапам: i) Top-K разрежен: для локальной модели ∇θi градиента, выберите элемент градиента K% с наибольшим абсолютным значением для сохранения, K Остальные элементы равны нулю, Значение динамически корректируется в зависимости от условия пропускания (когда полоса пропускания достаточно K=30, когда пропускная способность ограничена K=10); ii) Квантование: Сохраняемые элементы градиента квантуются с 32-битной плавающей запятой в 8-битные целые числа. Формула квантования выглядит так:

Уравнение 150(35)

  

iii) Обратная связь по ошибке: Сохранить отброшенный градиент Δ∇=∇θi-∇θiсжатую ошибку при сжатии на стороне клиента, В следующем вычислении градиента ошибка накапливается в новый градиент, подход, Уравнение 202 , Компенсировать потери при сжатии. Влияние градиентного сжатия и обратной связи ошибок показано в таблице 6, In, 8 K=20% -битных условий квантования. Степень сжатия достигает 15:1 (исходный объем данных/сжатый объём), а при обратной связи ошибок AUC-ROC модели уменьшается только на 0,5%–1,0%, что обеспечивает баланс между затратами на коммуникацию и производительностьюмодели 27.

Стратегии сжатияКоэффициент восстановленияПотребление пропускной способности загрузки (МБ/раунд)Темп снижения AUC-ROCСкорость сокращения времени обучения
Несжатая (32-битная плавающая запятая)1:011280.00%0.00%
Топ-30% разрежённая+16-битная квантование6.7:119.10.30%35.20%
Верхнее 20% разреженное + 8-битное квантование15:018.50.80%58.70%
Верхнее 10% разреженное + 8-битное квантование30:01:004.32.10%72.10%

Таблица 6: Сравнение эффективности стратегий градиентного сжатия.

Регуляризация, ориентированная на справедливость

Модели контроля финансовых рисков должны избегать дискриминации по отношению к определённым группам и соответствовать нормативным требованиям, включая Закон о защите личной информации и Закон о справедливой кредитной отчетности. В данном исследовании вводится механизм регуляризации, ориентированный на справедливость, чтобы ограничить межгрупповые предположения прогноза во время обучения модели, обеспечивая её справедливость. Определяются два основных индикатора справедливости: i) Демографический паритет (DP): Процент положительных прогнозов равен для разных групп, подход, Уравнение 154, , Среди g — идентификатор группы; ii) Равные возможности (EO): истинный положительный показатель равен между группами, подход Уравнение 155. Добавьте термины регуляризации справедливости к функции потерь гибридной модели риска ИИ и накладывают ограничения на локальную подмодель GBDT и глобальную модель Transformer соответственно: iii) Ограничения локальной модели справедливости модели:

Уравнение 156

Здесь PR(g=A) — это положительная скорость предсказания для группы g, λ, а — коэффициент регуляризации справедливости.

iv) Глобальное ограничение справедливости модели: Добавьте корректировку веса групповой справедливости к слою внимания Трансформера, выход модели для уязвимых группg=a основа×(1+β⋅Δнесправедливо) получает более высокий вес внимания, Здесь Δнесправедливый представляет собой смещение справедливости между этой группой и доминирующей группой (Δнесправедливо=PR (доминирующая группа)-PR (уязвимые группы)); λEO — коэффициент компенсации отклонения. Влияние регуляризации восприятия справедливости оценивается по ΔDP (отклонение DP), ΔEO (отклонение EO) и ошибке калибровки групп.

Панель управления моделью и соответствия

Мониторинг смещения в реальном времени

Для соответствия требованиям финансового регулирования управления жизненным циклом модели исследование разработало дашборд управления и соответствия моделей, интегрирующий API мониторинга отклонений в реальном времени и регуляторной отчетности, что позволяет осуществлять полный надзор и отслеживание на протяжении всего обучения, внедрения и итерации моделей. Модуль мониторинга отклонений в реальном времени обеспечивает динамическое отслеживание справедливости и производительности модели по следующим параметрам: i) Мониторинг групповых отклонений: категоризация групп по полу, возрасту, региону, уровню дохода и т.д., расчет PR, TPR и FPR (FPR) для каждой группы почасово. Предупреждения об отклонениях срабатывают, когда различия между группами PR превышают 0,08 или различия TPR превышают 0,05; ii) Мониторинг дрейфа производительности: непрерывное вычисление метрик, таких как AUC-ROC и PR-AUC. Когда эти показатели снижаются более чем на 2% подряд в течение трёх часов, это определяется как дрейф производительности, автоматически запуская процесс переобучения модели. iii) Мониторинг соблюдения конфиденциальности: Фиксируйте расход бюджета на приватность и добавление шума εобщей интенсивности каждого этапа обучения в 10. Когда расход ε одного выстрела превышает, приостановите тренировку и скорректируйте стратегию шума. iv) Мониторинговые данные отображаются через визуальные панели, позволяющие регуляторам и участвующим организациям видеть их в реальном времени и обеспечивая прозрачное управление рисками модели.

API регуляторной отчетности

Для упрощения процесса регуляторной отчетности разработан стандартизированный API для поддержки автоматической генерации отчетов, соответствующих таким нормативным требованиям, как GDPR, CCPA и Закон Китая о защите персональной информации. Основные функции включают: i) Отчет о соблюдении данных источников: автоматически агрегирует типы данных, объемы и статус авторизации участвующих учреждений для проверки соответствия принципу «минимально необходимого»; ii) Отчёт о соблюдении стандартов обучения модели: фиксирует итерации обучения, участвующие учреждения, меры защиты конфиденциальности и метрики справедливости для создания отчёта по отслеживаемости обучения модели; iii) Отчет о соблюдении рисков по прогнозированию: отображает законом-соответствующие шаблоны распределения моделей прогнозов по разным группам и контрфактические объяснения для демонстрации отсутствия дискриминации. API использует стиль проектирования RESTful, поддерживающий выводы в форматах JSON и XML. Регулирующие органы могут напрямую получать доступ к данным отчетов через API или устанавливать автоматические циклы отчетности для достижения автоматизированных и стандартизированных регуляторных процессов. Шаблоны отчётов соответствуют нормативным стандартам финансовой модели Международной организации по стандартизации (ISO), обеспечивая авторитет и универсальность отчетов.

Экспериментальный дизайн: описание набора данных

Данные по многоинституциональным кредитным картам и кредитам МСП

Экспериментальные данные поступали от финансовых учреждений Китая и охватывают такие типы данных, как операции по личным кредитным картам и записи заявок и исполнения кредитов МСП. Технология CopulaGAN была использована для синтеза и улучшения редких мошеннических событий, создавая экспериментальный набор данных, сочетающий подлинность и целостность. Реальные данные, использованные в эксперименте, включают две основные категории: данные о личных транзакциях по кредитным картам и данные по займам малого и среднего бизнеса, в сумме более 5 миллионов записей, охватывающих период с января 2022 по декабрь 2023 года. Данные охватывают четыре основных экономических региона — Северный Китай, Восточный Китай, Южный Китай и Юго-Западный Китай — чтобы обеспечить географическую репрезентативность и разнообразие распределения выборок. Основные области и статистические характеристики институциональных данных показаны в таблице 7. Среди них Учреждения A и B — это общенациональные коммерческие банки с большой клиентской базой всех возрастных групп; Учреждения C и D — это интернет-банки, в основном обслуживающие молодую аудиторию (20-35 лет); Institution E — это компания по потребительскому финансированию, ориентированная на пользователей на рынках низшего уровня, при этом распределение данных обладает значимыми характеристиками Non-IID. Набор данных содержит 115610 единиц данных. Набор данных предоставляется финансовыми учреждениями, сотрудничающими с университетами

Тип данныхУчреждениеКоличество рекордов (10 000)Количество клиентов (10 000)Основные областиУровень мошенничества по умолчаниюХарактеристики распределения данных
Транзакции по кредитным картамA18085Время транзакции, сумма, тип торговца, местоположение транзакции, вопрос о краже карты0.32%Крупные транзакции составляют большую долю (> 5000 юаней)
Транзакции по кредитным картамB15072Номер потока транзакций, сумма (USD/RMB), платёжный канал, рейтинг клиента0.28%Трансграничные транзакции составляют 15%
Транзакции по кредитным картамC12068Время проведения транзакции, сумма, установка, возраст клиента, местоположение номера мобильного телефона0.45%Мелкая высокочастотная торговля (<1000 юаней составляет 60%)
Кредиты для малого и микробизнесаD321.2Название компании, сумма кредита, срок кредита, шкала дохода, сумма налога, задолженность2.80%Производственные заказчики составляют 40%
Кредиты для малого и микробизнесаE180.8Дата подачи заявки на кредит, ожидаемая сумма, тип бизнеса, количество сотрудников, исторические показатели эффективности3.50%Клиенты услуг составляют 70%

Таблица 7: Статистические характеристики многоинституционального реального финансового набора данных.

Чтобы решить гетерогенность межинституциональных данных, эксперимент строго придерживался спецификаций сетки данных и семантического уровня, стандартизируя институциональные поля: например, конвертация «суммы транзакции (USD)» Учреждения B в юань с использованием курса даты транзакции и унификации имени поля в «сумму транзакции (YUAN)»; преобразование «клиентского возраста» Учреждения C (формат «1990-01-01») в целочисленный возраст; а также сопоставление «масштаба корпоративного дохода» Учреждения D (классифицированного как «ниже 1 миллиона / 1-5 миллионов / более 5 миллионов») с промежуточными точками числовых диапазонов (500 000, 3 000 000, 7 500 000), обеспечивая согласованность формата данных и семантического значения.

Синтетическая аугментация через CopulaGAN для редких случаев мошенничества

В сценариях контроля финансовых рисков выборки мошенничества/дефолта обычно составляют крайне низкую долю. Прямое использование таких малых размеров выборки для обучения моделей приведёт к серьёзным проблемам классового дисбаланса, что ухудшит возможности модели по обобщению. Эксперимент использует Copula GAN (генеративную состязательную сеть, основанную на функциях Copula) для синтеза дополненных данных по редким случаям мошенничества. Этот метод сочетает способность функции Копулы моделировать высокомерные распределения данных с генеративными возможностями GAN, позволяя создавать синтетические данные, соответствующие реальным мошенническим паттернам, при этом избегая проблемы «коллапса паттерна», часто наблюдаемой при традиционной генерации GAN.

Структура модели CopulaGAN

CopulaGAN состоит из трёх частей: генератор, дискриминатор и модуль ограничения распределения Копулы: (1) Генератор: Вход — это 128-мерный вектор случайного шума z∼N(0,1), а вывод — синтетический вектор признаков, согласованный с истинной размерностью выборки, через 3-слоевую полностью связную сеть (размеры скрытого слоя: 256, 512, 256); (2) Дискриминатор: вход — это реальный выборка или синтетический образец xsyn, и через двухслойную полностью связанную сеть + функцию активации Sigmoid выводит вероятность того, что выборка является реальной информацией; (3) Модуль ограничения распределения Копулы: Подгонить совместное распределение вещественных образцов мошенничества через гауссовскую функцию Копулы (где — значение функции рёберного распределения 8-го признака i) и добавить ограничение расстояния Копулы в потери генератора, чтобы обеспечить согласованность совместимости синтетических образцов с действительными образцами.

Уравнение 165(36)

Улучшение проверки процессов и эффектов

Процесс обучения и совершенствования CopulaGAN следующий: i) Предобработка данных: извлечь мошеннические/стандартные образцы (всего 18 200) из реальных данных различных учреждений; Стандартизировать непрерывные признаки (x'=(x-μ)/σ); Отдельные признаки кодируются с помощью уникального тепла; ii) Подгонка Копулы: Гауссовская функция Копулы используется для совместного распределения предварительно обработанных образцов мошенничества. Вычислить распределение краёв функции Fiθ и параметры функции Копулы каждой особенности; iii) Обучение GAN: Генератор и дискриминатор обучаются поочерёдно. Функция потерь генератора выглядит:

Уравнение 168(37)

Здесь λ — вес ограничения, а Distance(C syn,C real) — дивергенция KL между распределением Копулы синтетических образцов и распределением Копулы реальных выборок; Функция потерь дискриминатора является стандартной бинарной потерей перекрёстной энтропии:

Уравнение 170(38)

После сходимости модели (с точностью дискриминатора, стабилизированной на уровне 50%±5%) генератор произвел 50 000 синтетических образцов мошенничества. Они отображались обратно в исходное пространство признаков согласно семантическим спецификациям и смешивались с реальными образцами для создания сбалансированного обучающего набора. Для проверки эффективности синтетических образцов исследование оценивало их с помощью двухобразного теста KS и визуализации распределения признаков. Результаты теста KS показали, что различия в распределении признаков между синтетическими и реальными выборками были ниже 0,05 (статистика KS <0,05, p-значение>0,05), что указывает на хорошую согласованность распределения. Сравнение распределения признаков показало, что синтетические образцы могут точно воспроизводить характеристики распределения реальных образцов мошенничества, обеспечивая достаточные достоверные данные для обучения модели, как показано на рисунке 1.

Рисунок 1
Рисунок 1: Сравнение распределения признаков между реальными образцами мошенничества и CopulaGAN. Пожалуйста, нажмите здесь, чтобы увидеть увеличенную версию этой цифры.

Метрики оценки

Эксперимент строит многоиндексную систему оценки из четырёх основных измерений: производительность прогнозирования, защита конфиденциальности, справедливость и эффективность коммуникации для комплексного измерения эффективности федеративного фреймворка обучения и модели управления рисками ИИ. Определение, метод расчёта и критерии оценки каждого измерения приведены в таблице 8.

Измерения оценкиНазвание индексаОпределение и метод расчётаКритерий оценки
Предполагаемая производительностьAUC-ROCОбласть под характеристической рабочей кривой испытуемого измеряет способность модели различать положительные (дефолт/мошенничество) и отрицательные примерыЧем выше стоимость, тем лучше. AUC-ROC отличной модели — >0,9
PR-AUCОбласть точного воспоминания под кривой, применимая к несбалансированным данным, измеряет производительность модели в сценариях, где положительные примеры редкиЧем выше стоимость, тем лучше. PR-AUC отличной модели — >0,8
Фракция БриераСредняя квадратическая ошибка между предсказанной вероятностью и истинной меткой,B=1Ni=1N(pi-yi)2Чем ниже стоимость, тем лучше. Балл Брайера отличной модели составляет менее 0,05
Процент ложноположительных результатов (FPR)Доля отрицательных примеров FPR=FPFP+TN, чтоЧем ниже стоимость, тем лучше. В финансовых ситуациях обычно требуется FPR <1% (чтобы не отказывать хорошим клиентам)
Защита конфиденциальностиε-Кривая потребления (ε-кривая)Фиксируйте темп потребления накопленного бюджета конфиденциальности во время обучения, чтобы отразить динамический баланс в защите конфиденциальностиКривая выравнивается, и общий ε меньше или равен 5 (в соответствии с требованиями GDPR по риску конфиденциальности)
Атака на рассуждение членов AUC (MI-AUC)Способность злоумышленника определить, принадлежит ли выборка к учебному набору, исходя из результатов прогноза модели, и чем ближе значение AUC к 0.5, тем лучше конфиденциальностьMI-AUC<0.6 эффективна для защиты конфиденциальности, MI-AUC<0.55 — отлично
Коэффициент утечки признаков (FLR)Злоумышленник агрегирует признаки, чтобы обратить ошибку FLR=1-KL(P∥∥Q)Dmaxrate исходного распределения данных,FLR <0.1 указывает на эффективность защиты конфиденциальности (P — Dmax — истинное распределение, Q — предполагаемое распределение, а — максимальное расстояние KL)
СправедливостьСмещение DP в статистике (ΔDP)Максимальная разница в предсказании ΔDP=max∥PRg-PRavg∥rate положительных примеров между различными группами,ΔDP<0,05 — за справедливость, за превосходство (PRg — положительный процент группы g)
Смещение EO (ΔEO)Максимальная разница в истинно положительных показателях ΔEO=max∥TPRg-TPRavg∥avg между разными группами,GCE <0.02 хорошо откалибрована (K — групповое число, прогнозируемая скорость, а — фактическая скорость)
Ошибка групповой калибровки (GCE)Среднее отклонение между предсказанной вероятностью GCE=1Kg=1K∥pg-rg∥ каждой группы и фактической скоростью дефолта,Чем ниже стоимость, тем лучше. Требования к сценариям малых и средних организаций составляют <10 МБ/раунд
Эффективность связиПропускная способность восходящего канала на один раундОбщее потребление пропускной способности данных, загруженных каждой организацией координатору за один разЧем ниже стоимость, тем лучше. Межинституциональные сценарии требуют менее 120 минут
Коэффициент восстановления (CR)Отношение исходного объёма данных к сжатому объёму данных,CR=SizerawSizecompЧем выше степень сжатия, тем лучше. Отличные решения CR>10:1

Таблица 8: Экспериментальная система индексов оценки.

Объяснение метрики: i) Атака на вывод членства: Используя методологию атак «чёрного ящика», злоумышленник обучает бинарную модель классификации, которая вводит предсказанные вероятности из целевой модели и выводит статус принадлежности выборки. Риск утечки конфиденциальности измеряется AUC модели (то есть MI-AUC). ii) Критерии классификации групп: Для оценки справедливости группы делятся по четырём измерениям: пол (мужчина/женщина), возраст (до 25/25-40/>40), регион (рынки первого уровня/новые первое/второе/дочерние рынки) и уровень дохода (<5k/5k-15k/15k-30k/>30k юаней/месяц). Это обеспечивает покрытие чувствительных групп, выявленных финансовыми регуляторами. iii) Критерии сходимости: Во время обучения моделей, если валидационный набор AUC-ROC показывает снижение менее чем 0,001 за три последовательных раунда (каждый раунд содержит 10 эпох), обучение считается сходящимся, и остановленным.

Исходные показатели

Для подтверждения превосходства предлагаемой «Федеративной модели обучения + гибридной модели управления рисками ИИ» в этом исследовании выделяются пять базовых моделей: традиционные централизованные модели, классические федеративные модели обучения и усовершенствованные модели, сохраняющие конфиденциальность. Основные параметры и стратегии обучения каждой базовой модели подробно изложены в Таблице 9 для обеспечения справедливости в сравнительных экспериментах (все модели используют одинаковые обучающие наборы, валидационные наборы и стратегии гиперпараметрической оптимизации).

Типы моделейНазвание моделиОсновная архитектураРежим тренировкиМеры защиты конфиденциальностиКлючевые гиперпараметры
Централизованная модельТрадиция GBDTДерево усиления градиентов XGBoostВсе учреждения централизованно хранят обучающие данныеНе былоКоличество деревьев =100, скорость обучения =0,1, глубина дерева =6, коэффициент регуляризации λ=1,0
Централизованная модельМодель глубокого обучения (MLP)Трёхслойная полностью связанная сеть (входный уровень 256 измерений → скрытый слой 128 → скрытый слой 64 измерения → выходной слой 1)Все учреждения централизованно хранят обучающие данныеНе былоOptimizer=Adam, скорость обучения=0.001, размер партии=256, Dropout=0.3
Классическая федеральная модельFedAvg (федеральный средний показатель)Локальная модель — GBDT, а глобальная модель использует агрегирование усредненных параметровФедеральное синхронное обучениеНе былоУровень участия = 0,8, локальная эпоха = 5, раунд агрегации = 50, скорость обучения =0,1
Классическая федеральная модельFedProx (федеральная агрегация ближнего конца)Локальная модель — GBDT, а проксимальнаяФедеральное синхронное обучениеНе былоКоэффициент участия = 0,8, локальная эпоха = 5, агрегационный раунд = 50, проксимальный параметр μ =0,01
μ=0.01
Ограничение на термин добавляется во время агрегации ().
Федерация, поддерживающая конфиденциальностьFedAvg+DP (фиксированный шум)Добавить фиксированный лапласианский шум в FedAvg (ε=5, δ=1e-5)Федеральное синхронное обучениеФиксированная дифференциальная конфиденциальностьИнтенсивность шума = 0,1, уровень участия=0,8, локальная эпоха = 5, раунды агрегации = 50
Модель исследованияFedRisk (Федеральная модель контроля рисков)Локальный GDT (монотонное ограничение) + глобальный трансформатор (внимание слияние) + DP + безопасная агрегацияФедеральное асинхронное обучениеАдаптивный аддитивный секретный обмен DP+Локальная эпоха=5, агрегационные раунды=50, измерение внимания=64, приватный бюджет = 5, коэффициент сжатия = 15:1

Таблица 9: Сравнение параметров между базовой моделью и этой моделью исследования.

Сравнительное объяснение измерений: (1) Централизованное против федеративного: Сравнивая «традиционный GBDT/MLP» с «FedAvg/FedProx/FedRisk», это исследование рассматривает ухудшение эффективности федеративного обучения в сценариях «данных вне сайта». (2) Классика против федеративных систем с повышением конфиденциальности: Через «FedAvg» против «FedAvg+DP» исследование оценивает влияние дифференциальной приватности на производительность модели. (3) Синхронный и асинхронный федеративный: сравнение «FedAvg» (синхронный) и «FedRisk» (асинхронный) демонстрирует преимущества асинхронного обучения в эффективности коммуникации. (4) Простая агрегация против интеллектуального синтеза: Контраст между «FedAvg» (усреднение параметров) и «FedRisk» (слияние внимания) подтверждает адаптивность стратегий интеграции трансформеров к данным Non-IID. (5) Отсутствие цензуры против цензуры справедливости: сравнение между «FedAvg» (без ограничений справедливости) и «FedRisk» (ограничения, учитывающие справедливость) изучает влияние механизмов справедливости на справедливость и производительность моделей.

Исследования абляции

Влияние различных ε на полезность модели

Используя общий бюджет конфиденциальности ε как переменную (со значениями 1, 3, 5, 7 и 10), исследование зафиксировало δ=1e-5, сохранив при этом другие модули (слияние внимания и монотонное ограничение GBDT) без изменений для оценки компромисса между силой защиты конфиденциальности и полезностью модели. Эксперимент измерял как AUC-ROC (утилиту модели), так и MI-AUC (риск конфиденциальности) как двойные индикаторы, результаты которых приведены в Таблице 10. Когда ε=1, MI-AUC упал до 0,53 (отличная защита конфиденциальности), а AUC-ROC достиг всего 0,821 (значительная потеря полезности). При ε=5 AUC-ROC восстановился до 0,912 (соответствуя требованиям по контролю финансовых рисков) с MI-AUC=0,58 (эффективная защита конфиденциальности). Когда ε>5, улучшение AUC-ROC составило менее 0,01, тогда как MI-AUC быстро выросло до 0,63 (превысив лимиты рисков конфиденциальности). Это подтверждает, что ε=5 является оптимальным общим бюджетом конфиденциальности, обеспечивая баланс между конфиденциальностью и полезностью.

Total Privacy BudgetεМодель AUC-ROCMI-AUC (риск конфиденциальности)Коэффициент утечки признаков (FLR)Фракция Бриера
10.8210.530.040.078
30.8760.550.060.061
50.9120.580.080.042
70.9190.60.110.039
100.9230.630.150.037

Таблица 10: Сравнение производительности модели с разными бюджетами конфиденциальности ε.

Вклад слияния внимания по сравнению с простым усреднением

Для оценки различий в эффективности между «слиянием внимания» (предлагаемая стратегия) и «простым усреднением» (стратегия FedAvg) в ненезависимых сценариях данных были экспериментально настроены две переменные: (1) Не-IID тяжесть данных (измеряется по специфическим для учреждения вариацией частоты по умолчанию, низкая вариация: 0,2%-0,5%, высокая: 0,2%-3,5%); (2) Стратегии слияния (синтез внимания против простого усреднения). Как показано на рисунке 2, разрыв между двумя стратегиями составлял всего 0,023 (0,912 против 0,889) в сценариях с низким уровнем Non-IID. Однако этот разрыв увеличился до 0,076 (0,905 против 0,829) в случаях с высоким уровнем Non-IID, при этом простая модель усреднения демонстрировала значительное переподгонку (обучающий набор AUC-ROC 0,941 против валидационного набора 0,829). Это демонстрирует, что механизмы внимания могут эффективно смягчать ухудшение производительности, вызванное ненезависимыми данными, с помощью динамического взвешивания — например, присвоения веса 0,32 учреждению E с точными стандартными прогнозами и 0,12 веса институту C с большими отклонениями.

Рисунок 2
Рисунок 2: Сравнение стратегий термоядерного синтеза при различных степенях Non-IID. Пожалуйста, нажмите здесь, чтобы увидеть увеличенную версию этого рисунка.

Влияние регуляризаторов справедливости на прибыльные KPI

Основное требование финансовых учреждений — обеспечить прибыль бизнеса в условиях справедливости, поэтому эксперимент вводит индекс, ориентированный на прибыль — «риск-скорректированная рентабельность капитала (RAROC)», формула выглядит следующим образом:

Уравнение 171(39)

Ожидаемый убыток рассчитывается как вероятность дефолта, умноженная на фиксированную ставку потерь по дефолту (установленную на уровне 40%), тогда как экономический капитал определяется как риск, умноженный на вес риска (согласно требованиям Базель III). Метрики справедливости (ΔDP, ΔEO) и RAROC модели с регуляризацией справедливости по сравнению с моделью без неё сравниваются в таблице 11. После внедрения регуляризации справедливости ΔDP снизился с 0,15 до 0,04, ΔEO снизился с 0,12 до 0,03, а RAROC снизился всего на 2,1% (18,3% против 18,7%), значительно ниже допустимого отраслевого порога в 5%. Это демонстрирует, что механизм справедливости в нашем исследовании эффективно соответствует нормативным требованиям о недискриминации при одновременном контроле потерь прибыли.

Настройка моделиΔDP (разница положительных показателей группы)ΔEO (различие группового TPR)GCE (ошибка групповой калибровки)RAROC (Риск-скорректированная доходность активов)FPR (процент ложноположительных результатов)
Нет правила справедливости0.150.120.03518.70%0.95%
Есть справедливость и регулярность0.040.030.01818.30%1.02%

Таблица 11: Влияние регуляризации справедливости на показатели справедливости и прибыли.

Детали реализации

Для обеспечения воспроизводимости эксперимента исследование уточнило технический стек и детали процесса обучения: (1) Аппаратная среда: каждый институциональный узел использует процессоры Intel Xeon Gold 6248, 64 ГБ оперативной памяти и видеокарты NVIDIA Tesla V100; федеративный координатор использует два процессора Xeon Gold 6348 с 128 ГБ оперативной памяти для обеспечения параллельных вычислений и эффективной агрегации параметров. (2) Программный фреймворк: федеративный фреймворк обучения разработан с использованием PySyft 0.8.6, блокчейн-модуль использует Hyperledger Fabric 2.5 (консенсусный механизм: Raft), обучение модели основано на PyTorch 2.0 и XGBoost 2.0.3, а дифференциальный модуль конфиденциальности интегрирует библиотеку IBM DP. (3) Процесс обучения: (1) Предварительная обработка данных (2 часа, включая семантическую нормализацию и улучшение CopulaGAN); (2) Локальное обучение (5 эпох за раунд, скорость обучения снижается за счёт косинусного отжига); (3) Асинхронная агрегация (глобальные обновления модели происходят, когда координатор получает параметры от 3 учреждений); (4) Оценка модели (метрики AUC-ROC и справедливости рассчитываются после 10 раундов); (5) Гиперпараметрическая оптимизация (байесовская оптимизация с 50 итерациями для определения оптимальных параметров). (4) Тестирование надёжности: имитация институциональных разрывов (случайный выбор одного учреждения для остановки 1-3 этапов обучения) и сценарии шума данных (добавление 5% возмущений значения признаков). Результаты показали колебания AUC-ROC ниже 0,02, что демонстрирует способность системы противодействовать интерференциям.

В этом исследовании использовалась стратегия планирования косинусного отжига с начальной скоростью обучения 0,05. Скорость обучения динамически обновлялась в каждой эпохе согласно формуле на протяжении всего 100 обучающих эпох. Эта стратегия поддерживала высокую скорость обучения на ранних этапах обучения, например, 0,05 в первой эпохе, чтобы ускорить сходимость моделей, и постепенно снижала её почти до нуля, например 0,00025 на сотой эпохе, чтобы повысить стабильность тонкой настройки параметров. Экспериментальные результаты показали, что по сравнению с фиксированной скоростью обучения эта стратегия улучшила валидационный набор AUC-ROC на 2,3% и ускорила скорость сходимости на 37%. Разделение данных было основано на исходном наборе данных из пяти финансовых учреждений общей сложностью 5 миллионов выборок, строго придерживаясь принципа межинституциональной изоляции данных. Местные данные из каждого учреждения были разделены хронологически: данные с января 2022 по июнь 2023 года в качестве обучающего набора (70%), данные с июля по сентябрь 2023 года как валидационный набор (15%) и данные с октября по декабрь 2023 года как тестовый набор (15%). Это разделение обеспечивало временную независимость наборов обучения, валидации и тестов, эффективно моделируя эволюцию паттернов временного риска в реальных ситуациях. Ключевые гиперпараметры определялись с помощью байесовской оптимизации. В совместном поисковом пространстве с начальной скоростью обучения от 0,01 до 0,1, номерами деревьев GBDT от 50 до 200 и головками внимания трансформеров из набора {2, 4, 8}, было выполнено 50 итераций с целью максимизации валидационного набора AUC-ROC. Окончательная оптимальная комбинация была определена как начальная скорость обучения 0,05, 120 деревьев GBDT и 4 головы внимания.

Доступ ограничен. Войдите в систему или начните пробный период, чтобы просмотреть этот контент.

Результаты

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

Предсказательная производительность: приближение к уровню централизованных моделей в не-IID сценариях

В реальных сценариях с высоким уровнем Non-IID данных (колебания ставки дефолта институционального уровня 0,2%-3,5%) FedRisk демонстрирует исключительные возможности по дифференциации рисков, как показано в Таблице 12. AUC-ROC достигает 0,912, PR-AUC — 0,823, балл Brier 0,042, а коэффициент ложноположительных результатов (FPR)...

Доступ ограничен. Войдите в систему или начните пробный период, чтобы просмотреть этот контент.

Обсуждение

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

Стратегия настройки динамических гиперпараметров, особенно планировщик скорости обучения косинусного отжига, оказалась необходимой для баланса скорости сходимости и стабильности модели. Снижая темп обучения с 0,05 до 0,00025 за 100 эпох, этот подход ускорял раннюю стадию сходимости, минимизируя время обучения на поздних стадиях — снизив время обучения на 37% и улучшив валидационный AUC-ROC на 2,3% по сравнению с фиксированными графиками. Не менее важной была адаптивная калибровка шума в ...

Доступ ограничен. Войдите в систему или начните пробный период, чтобы просмотреть этот контент.

Раскрытие информации

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

Авторам нечего раскрывать.

Благодарности

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

Ни одного.

Доступ ограничен. Войдите в систему или начните пробный период, чтобы просмотреть этот контент.

Материалы

Список материалов, использованных в этой статье
ИмяКомпанияКаталожный номерКомментарии
НоутбукDell TechnologiesН/ДИспользуется для обработки данных и документации
Статистическое программное обеспечение (SPSS)IBM Corp.Версия 26.0Используется для статистического анализа
Microsoft ExcelMicrosoftOffice 365Ввод данных и основы обработки данных

Ссылки

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,
  1. 2023 risk monitoring report. , China banking and insurance regulatory commission. https://www.cbirc.gov.cn (2023).
  2. Zhang, X., Mavromatis, A., Vafeas, A., Nejabati, R., Simeonidou, D. Federated feature selection for horizontal federated learning in IoT networks. IEEE Internet Things J. 10 (11), 10095-10112 (2023).
  3. Liu, Y., et al. Vertical federated learning: concepts, advances, and challenges. IEEE Trans. Knowl. Data Eng. 36 (7), 3615-3634 (2024).
  4. Saha, S., Ahmad, T. Federated transfer learning: concept and applications. Intell. Artif. 15 (1), 35-44 (2020).
  5. McMahan, H. B., Moore, E., Ramage, D., Hampson, S., Arcas, B. A. Y. Communication-efficient learning of deep networks from decentralized data. In Proc. 20th Int. Conf. Artif. Intell. Stat. , 1273-1282 (2017).
  6. Yang, Q., Liu, Y., Chen, T., Tong, Y. Federated machine learning: concept and applications. ACM Trans. Intell. Syst. Technol. 10 (2), Article 12(2019).
  7. Pan, S. J., Yang, Q. A survey on transfer learning. IEEE Trans. Knowl. Data Eng. 22 (10), 1345-1359 (2010).
  8. Long, Z., Wang, J., Wang, Y., Xiao, H., Ma, F. FedCon: a contrastive framework for federated semi-supervised learning. arXiv. , (2021).
  9. Wang, J., et al. FedLite: a scalable approach for federated learning on resource-constrained clients. arXiv. , (2022).
  10. Hanser, T., et al. Data-driven federated learning in drug discovery with knowledge distillation. Nat. Mach. Intell. 7, 1-14 (2025).
  11. Feng, Y., et al. A survey of security threats in federated learning. Complex Intell. Syst. 11 (2), 165(2025).
  12. Chen, D., et al. Bridging data silos in finance via federated learning. IEEE Netw. , https://ieeexplore.ieee.org/document/11062627 (2025).
  13. Haripriya, R., et al. Navigating the fusion of federated learning and big data: a systematic review for the AI landscape. Clust. Comput. 28 (5), 1-27 (2025).
  14. Dong, J., Roth, A., Su, W. J. Gaussian differential privacy. J. R. Stat. Soc. Ser. B Stat. Methodol. 84 (1), 3-37 (2022).
  15. Bayatbabolghani, F., Blanton, M. Secure comparison protocols for privacy-preserving federated learning. In Proc. 2018 ACM SIGSAC Conf. Comput. Commun. Secur. , 2157-2159 (2018).
  16. Acar, A., Aksu, H., Uluagac, A. S., Conti, M. A survey on homomorphic encryption schemes: theory and implementation. ACM Comput. Surv. 51 (4), (2018).
  17. Dwork, C. Differential privacy. In Proc. Int. Colloq. Automata Lang. Program. , 1-19 (2006).
  18. Abadi, M., et al. Deep learning with differential privacy. In Proc. 2016 ACM SIGSAC Conf. Comput. Commun. Secur. , 308-318 (2016).
  19. Bogetoft, P., et al. Secure multiparty computation goes live. In Financ. Cryptogr. Data Secur. 5628, 325-343 (2009).
  20. Perri, L. What's new in the 2023 Gartner Hype Cycle for emerging technologies. , https://www.gartner.com/en/articles/what-s-new-in-the-2023-gartner-hype-cycle-for-emerging-technologies (2023).
  21. Friedman, J., Hastie, T., Tibshirani, R. The elements of statistical learning. , Springer. New York. (2001).
  22. Zhang, H., Liu, Y., Zhang, X., Yin, Z., Li, Y. A lightweight approach for federated learning in edge devices. In Proc. 7th Int. Conf. Artif. Intell. Big Data (ICAIBD). , 53-58 (2024).
  23. Liu, J., Liu, P., Ou, Z., Zhang, G., Song, M. Optimizing edge intelligence through privacy-preserving learning. In Proc. Int. Conf. Edge Comput. , 419-429 (2024).
  24. Kim, J., Kim, K., Sohn, M., Park, G. Deep model-based security-aware entity alignment method for edge-specific knowledge graphs. Sustainability. 14 (14), 8877(2022).
  25. Xue, J., Qu, Z., Xu, J., Liu, Y., Lu, Z. Bandwidth allocation for federated learning with wireless providers and cost constraints. IEEE Trans. Mob. Comput. 23 (6), 7470-7482 (2024).
  26. Sharma, M., Kaur, P. Scalable federated learning for smart city applications. In Proc. 2nd Int. Conf. Informatics (ICI). , 1-4 (2023).
  27. Li, B., Zheng, S., Raman, P., Shrivastava, A., Giannakis, G. B. Contractive error feedback for gradient compression. arXiv. , (2023).
  28. 2023 risk monitoring report. , China banking and insurance regulatory commission. https://www.cbirc.gov.cn (2023).

Доступ ограничен. Войдите в систему или начните пробный период, чтобы просмотреть этот контент.

Перепечатки и разрешения

Запросить разрешение на повторное использование текста или иллюстраций этой статьи JoVE

Запросить разрешение

Теги

Explainable AICross Institutional CollaborationFinancial Risk ControlData PrivacyNon IID DataModel InterpretabilityDifferential PrivacyFraud DetectionSME Loan Default

Похожие статьи