Artigo de revisão

Uma Revisão Abrangente dos Métodos de Aprendizado de Máquina e Deep Learning para o Diagnóstico e Análise de Transtornos do Espectro Autista

DOI:

10.3791/71972

17 de julho de 2026

Neste artigo

Resumo

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

Esta revisão avalia 50 estudos recentes que aplicam aprendizado de máquina e aprendizado profundo ao diagnóstico de transtorno do espectro autista (TEA). Abordagens multimodais que integram neuroimagem, dados comportamentais e biológicos demonstraram desempenho melhorado. Os principais desafios incluem interpretabilidade, escalabilidade e heterogeneidade dos dados. Os esforços futuros devem focar em sistemas de IA explicáveis, que preservem a privacidade e que possam ser traduzidos clinicamente.

Resumo

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

O transtorno do espectro autista (TEA) é uma condição neurodesenvolvimental heterogênea caracterizada por diversos perfis comportamentais, cognitivos, sensoriais e de comunicação, tornando o diagnóstico precoce e a intervenção personalizada desafiadores. Avanços recentes em aprendizado de máquina (ML) e aprendizado profundo (DL) permitiram o desenvolvimento de ferramentas computacionais para triagem, classificação, avaliação de gravidade e monitoramento de intervenções de TEA. Esta revisão sintetiza os achados de 50 estudos recentes que aplicaram técnicas de ML e DL a conjuntos de dados relacionados ao TEA, incluindo eletroencefalografia (EEG), rastreamento ocular, vídeo comportamental, microbioma, acústica de voz, dados demográficos e multimodais. A revisão aborda três questões-chave: (i) quais modalidades de dados e abordagens computacionais são mais frequentemente utilizadas, (ii) como o desempenho diagnóstico é avaliado em diferentes desenhos de estudos, e (iii) quais desafios metodológicos limitam a tradução clínica. A literatura é organizada de acordo com a modalidade dos dados, abordagem algorítmica e prontidão clínica. Abordagens analisadas incluem métodos convencionais de ML, redes neurais convolucionais, redes neurais de grafos, arquiteturas híbridas de deep learning, aprendizado federado, inteligência artificial explicável, análise topológica de dados e fusão multimodal. Os achados sugerem que abordagens multimodais e baseadas em grafos fornecem uma representação mais abrangente dos fenótipos do TEA do que os métodos monomodales. Explicabilidade e aprendizagem que preserva a privacidade também surgiram como considerações importantes para a implantação clínica. No entanto, muitos modelos de alto desempenho relatados são baseados em tamanhos de amostra pequenos, uso repetido do conjunto de dados ABIDE, desequilíbrio de classes, validação em um único local ou testes externos limitados, levantando preocupações quanto à generalizabilidade. Além da precisão diagnóstica, esta revisão avalia a interpretabilidade, calibração, escalabilidade, rigor da validação e aplicabilidade clínica. No geral, a análise destaca a necessidade de parâmetros padronizados, conjuntos de dados multimodais validados externamente, métricas de avaliação clinicamente relevantes e sistemas de apoio à decisão que complementem, em vez de substituir, a avaliação clínica especializada no diagnóstico e manejo do TEA.

Introdução

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

O transtorno do espectro autista (TEA) é uma condição neurodesenvolvidora complexa caracterizada por limitações na comunicação social, interesses restritos e comportamentos repetitivos. A natureza heterogênea do TEA e sua sobreposição com outros transtornos do neurodesenvolvimento tornam o diagnóstico e a avaliação clínica particularmente desafiadores. Abordagens diagnósticas tradicionais baseiam-se principalmente em observações comportamentais e avaliações clínicas, o que pode contribuir para o diagnóstico atrasado e variabilidade nos desfechos clínicos. A identificação precoce e precisa do TEA é essencial porque a intervenção oportuna demonstrou melhorar significativamente o funcionamento cognitivo, social e adaptativo. Avanços recentes em inteligência artificial (IA), especialmente aprendizado de máquina (ML) e aprendizado profundo (DL), ampliaram as oportunidades para desenvolver abordagens objetivas e baseadas em dados para diagnóstico e análise deTEA 1,2,3.

Técnicas de ML e DL possibilitam a análise de conjuntos de dados de alta dimensão derivados de ressonância magnética funcional (fMRI), eletroencefalografia (EEG), rastreamento ocular, avaliações comportamentais, sinais de fala e outros marcadores biológicos. Essas abordagens demonstraram considerável potencial para triagem, classificação, previsão de gravidade e monitoramento de intervenções para TEA. Estudos recentes relataram resultados animadores usando modelos baseados em neuroimagem, análises comportamentais, frameworks de aprendizagem multimodal e arquiteturas que preservam a privacidade para detecção e avaliação deTEA 4,5,6. No entanto, o corpo de literatura em rápida expansão permanece altamente fragmentado porque muitos estudos focam em modalidades de dados individuais, algoritmos específicos ou objetivos clínicos isolados, tornando difícil a comparação direta de metodologias e resultados.

Apesar do progresso substancial, vários desafios continuam limitando a tradução clínica dos sistemas diagnósticos de TEA baseados em IA. Muitos modelos publicados são desenvolvidos usando conjuntos de dados relativamente pequenos, coortes de local único ou procedimentos de validação limitados, levantando preocupações sobre a generalização e aplicabilidade no mundo real. Além disso, questões relacionadas à interpretabilidade, eficiência computacional, escalabilidade, justiça e privacidade de dados continuam sendo barreiras importantes para a adoção clínica. As revisões existentes geralmente focaram em metodologias específicas ou fontes de dados individuais, frequentemente negligenciando as relações mais amplas entre modalidade dos dados, desenho algorítmico, rigor na validação e prontidão clínica.

Para suprir essas lacunas, esta revisão de escopo sintetiza evidências de 50 estudos recentes que aplicaram técnicas de aprendizado de máquina (ML) e deep learning (DL) ao diagnóstico e análise do transtorno do espectro autista (TEA). A literatura revisada abrange um amplo espectro de abordagens computacionais e modalidades de dados, incluindo métodos baseados em neuroimagem usando ressonância magnética funcional e estrutural (fMRI/sMRI), eletroencefalografia (EEG), análise comportamental e do olhar, processamento fisiológico de sinais, avaliação acústica da fala e voz, biomarcadores baseados em microbioma e frameworks de aprendizagem multimodais. Estudos recentes exploraram abordagens convencionais de aprendizado de máquina, como máquinas vetoriais de suporte e florestas aleatórias, bem como arquiteturas avançadas de deep learning, incluindo redes neurais convolucionais, redes neurais de grafos, aprendizado por transferência, modelos baseados em atenção, frameworks de aprendizagem federada, inteligência artificial explicável e abordagens de análise topológicade dados 1,2,3,4,5,6 ,7,8,9,10,11,12,13,14,15,16.

Os estudos revisados demonstram ainda a crescente diversidade de fontes de dados e objetivos analíticos relacionados ao TEA. As investigações examinaram heterogeneidade neuroanatômica, padrões de conectividade funcional, avaliação comportamental, triagem baseada em realidade virtual, monitoramento fisiológico, análise de EEG, classificação baseada em eletroretinograma, perfil de microbioma, metabolômica, acústica da fala e fusão multimodal de dados para diagnóstico, predição de gravidade, monitoramento de intervenções e identificação de subtipos 17,18,19,20, 21,22,23,24,25,26,27,28,29,30,31,32,33,34,35 . Esses desenvolvimentos refletem uma mudança dos modelos diagnósticos monomodales para estruturas integrativas capazes de capturar as manifestações clínicas heterogêneas do TEA.

Além de resumir o desempenho diagnóstico, esta revisão avalia a relação entre modalidade dos dados, design algorítmico, rigor de validação, interpretabilidade, escalabilidade e aplicabilidade clínica. Atenção especial é dada a abordagens emergentes como aprendizado federado, modelagem baseada em grafos, fusão multimodal, inteligência artificial explicável, estruturas de aprendizagem que preservam a privacidade, tecnologias de realidade estendida e diagnósticos de precisão baseados embiomarcadores 36,37,38,39,40,41,42,43,44, 45,46,47,48,49,50. Ao integrar evidências entre modalidades, algoritmos e estratégias de validação, esta revisão fornece um benchmark estruturado das tecnologias diagnósticas atuais de TEA, ao mesmo tempo em que destaca pontos fortes metodológicos, limitações e considerações sobre a qualidade das evidências. A análise vai além da precisão relatada para incluir interpretabilidade, validação externa, prontidão clínica e viabilidade de implantação, oferecendo assim uma estrutura para avaliar o potencial translacional dos sistemas de diagnóstico de TEA impulsionados por IA. Em última análise, esta revisão visa identificar tendências atuais de pesquisa, destacar lacunas existentes e delinear direções futuras para o desenvolvimento de soluções de IA escaláveis, interpretáveis e clinicamente tradutíveis para avaliação e manejo de TEA.

Metodologia de revisão

Este estudo foi realizado como uma revisão de escopo para fornecer uma visão abrangente das abordagens recentes de aprendizado de máquina (ML) e deep learning (DL) aplicadas ao diagnóstico e análise do transtorno do espectro autista (TEA). Foi selecionada uma metodologia de revisão por escopo porque a literatura disponível é altamente heterogênea entre modalidades de dados, objetivos clínicos, estruturas algorítmicas, conjuntos de dados, estratégias de validação e medidas de resultado relatadas.

Os estudos revisados abrangeram uma ampla variedade de fontes de dados, incluindo neuroimagem, eletroencefalografia (EEG), rastreamento ocular, avaliações comportamentais, sinais de fala, perfis de microbioma e conjuntos de dados multimodais. Como existiam diferenças substanciais entre populações de estudo, padrões de referência, métricas de desempenho e desenhos experimentais, uma meta-análise quantitativa foi considerada inadequada. Em vez disso, o objetivo desta revisão foi mapear o cenário atual de pesquisa, identificar tendências metodológicas, comparar abordagens computacionais, avaliar a qualidade das evidências e avaliar a prontidão clínica dos sistemas de ML e DL para diagnóstico e monitoramento de TEA.

Os estudos incluídos foram analisados de acordo com modalidade de dados, metodologia de aprendizado de máquina, estratégia de validação, desempenho diagnóstico, interpretabilidade, escalabilidade e potencial para tradução clínica. Atenção especial foi dada a áreas emergentes como aprendizagem multimodal, inteligência artificial explicável, aprendizado federado, modelagem baseada em grafos e estruturas diagnósticas que preservam a privacidade.

Perguntas de pesquisa

Esta revisão de escopo foi guiada por três questões principais. Primeiro, examinou quais modalidades de dados relacionadas ao TEA e abordagens de aprendizado de máquina/aprendizado profundo (ML/DL) têm sido mais frequentemente empregadas para triagem, diagnóstico, predição de gravidade e monitoramento de intervenções. Segundo, avaliou como o desempenho do modelo, estratégias de validação, interpretabilidade e escalabilidade foram relatados em estudos recentes de inteligência artificial com TEA. Terceiro, investigou as limitações metodológicas, preocupações com a qualidade das evidências e barreiras à tradução clínica que continuam a afetar a adoção de sistemas baseados em ML/DL para diagnóstico e manejo do TEA. Coletivamente, essas questões fornecem uma estrutura para sintetizar as tendências atuais de pesquisa, avaliar os pontos fortes e fracos das abordagens existentes e identificar prioridades para o desenvolvimento futuro de soluções de IA clinicamente aplicáveis para TEA.

Estratégia de busca e fontes de informação

Foi realizada uma busca bibliográfica no IEEE Xplore, PubMed/MEDLINE, Scopus, Web of Science, ScienceDirect, SpringerLink e Google Scholar. A busca focou em estudos publicados entre 2022 e 2025 para capturar avanços recentes em aprendizado de máquina (ML), aprendizado profundo (DL), aprendizado federado, redes neurais de grafos, fusão multimodal e inteligência artificial explicável (XAI) para diagnóstico e análise do transtorno do espectro autista (TEA).

A estratégia de busca combinou termos relacionados ao TEA, metodologias de inteligência artificial, objetivos diagnósticos e modalidades de dados. A consulta principal incluía os termos: ("transtorno do espectro do autismo" OU TEA OU autismo) E ("aprendizado de máquina" OU "deep learning" OU "inteligência artificial" OU CNN OU GNN OU SVM ou "floresta aleatória" OU "aprendizagem federada" OU "IA explicável") E (diagnóstico OU triagem OU classificação ou previsão OU gravidade OU intervenção) E (fMRI ou ressonância magnética ou EEG ou "rastreamento ocular" OU vídeo OU microbioma OU voz OU multimodal). A sintaxe de busca foi adaptada conforme necessário para bancos de dados individuais.

Para melhorar a cobertura dos estudos e reduzir o risco de publicações relevantes perdidas, as listas de referências de artigos de revisão elegíveis e estudos de pesquisa primária foram manualmente avaliadas para registros adicionais. O conjunto final de estudos foi selecionado com base nos critérios de elegibilidade pré-definidos descritos abaixo.

Critérios de elegibilidade

Os estudos foram selecionados de acordo com critérios pré-definidos de inclusão e exclusão para garantir relevância para aplicações focadas em aprendizado de máquina e deep learning focadas em TEA, qualidade metodológica e aplicabilidade clínica. Os critérios de elegibilidade usados para a seleção de estudos estão resumidos na Tabela 1.

Procedimento de triagem

Os títulos e resumos dos registros recuperados foram inicialmente analisados para avaliar sua relevância para o transtorno do espectro autista (TEA), metodologias de inteligência artificial e objetivos diagnósticos ou analíticos. Os artigos em texto integral foram posteriormente revisados para confirmar a elegibilidade e extrair informações sobre populações de estudos, fontes de dados, abordagens computacionais, estratégias de validação e medidas de desfecho relatadas. Registros duplicados e estudos com conteúdo sobreposto foram excluídos antes da síntese final. Quando múltiplos estudos utilizaram o mesmo conjunto de dados (por exemplo, ABIDE), apenas estudos com arquiteturas de modelo distintas, representações de características, estruturas de validação ou objetivos clínicos foram mantidos para evitar redundância e garantir uma avaliação abrangente da diversidade metodológica.

Extração e síntese de dados

Os dados foram extraídos de cada estudo incluído usando uma abordagem estruturada. As informações extraídas incluíam autor e ano de publicação, modalidade dos dados, conjunto de dados ou fonte, tamanho da amostra quando disponível, população-alvo ou faixa etária, tarefa relacionada ao TEA, algoritmo ou tipo de modelo, método de extração de características, estratégia de validação, métricas de desempenho reportadas, abordagem de interpretabilidade, status de validação externa, limitações declaradas e aplicabilidade clínica. Os estudos foram então sintetizados de acordo com a modalidade dos dados, categoria algorítmica, propósito clínico, desenho de validação e qualidade das evidências, em vez de serem classificados apenas pelo desempenho relatado.

Avaliação de qualidade e avaliação de risco de viés

Foi realizada uma avaliação metodológica para analisar possíveis vieses, qualidade das evidências e prontidão clínica. Cada estudo foi avaliado com base na adequação do tamanho da amostra, equilíbrio de classes, dependência de conjuntos de dados repetidos de benchmark como ABIDE, risco de vazamento de dados entre as etapas de pré-processamento e validação, tipo de validação cruzada ou externa, relatórios de calibração, justiça demográfica por idade e gênero, interpretabilidade, reprodutibilidade e viabilidade de implantação. Estudos com alta precisão foram interpretados com cautela, a menos que fossem apoiados por tamanho adequado da amostra, testes independentes, procedimentos de controle de vazamento e métodos transparentes de validação.

Relatório de métricas de desempenho

A comparação revisada incluiu apenas métricas que foram explicitamente reportadas nos estudos originais. Quando uma métrica não estava disponível, ela era marcada como NR, indicando "não reportada", em vez de ser estimada ou aproximada. As comparações entre estudos foram interpretadas qualitativamente porque os estudos incluídos diferiram substancialmente no tamanho do conjunto de dados, objetivo clínico, estratégia de validação, metodologia, faixa etária e padrão de referência. Portanto, os valores de precisão relatados não foram tratados como indicadores diretamente comparáveis de superioridade do modelo. As tabelas atualizadas distinguem desempenho preditivo da qualidade das evidências ao incluir população-alvo, tamanho do conjunto de dados, método de validação, status de validação externa e limitações principais.

Acesso restrito. Inicie sessão ou comece um teste para visualizar este conteúdo.

Revisão e perspetiva

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

O transtorno do espectro autista (TEA) é uma condição neurodesenvolvimental heterogênea caracterizada por deficiências na comunicação social e padrões de comportamento restritos ourepetitivos 1. Avanços recentes em aprendizado de máquina (ML) e aprendizado profundo (DL) permitiram a análise de diversas modalidades de dados relacionadas ao TEA, incluindo neuroimagem, avaliações comportamentais, sinais fisiológicos e marcadores biológicos. As seções seguintes sintetizam desenvolvimentos-chave na pesquisa baseada em TEA baseada em ML/DL de acordo com modalidade de dados, abordagem metodológica e aplicaçãoclínica 1.

Abordagens baseadas em neuroimagem

A ressonância magnética funcional (fMRI) e a eletroencefalografia (EEG) estão entre as modalidades mais amplamente utilizadas para classificação de TEA, utilizando abordagens de aprendizado de máquina (ML) e deep learning (DL). Gupta et al.1 desenvolveram um modelo quantizado de rede neural convolucional (Q-CNN) para classificar dados de fMRI do conjunto de dados ABIDE-1, alcançando uma precisão de 98%. O estudo utilizou embutimento de espaço tangente para extração de características e aprendizado federado integrado (FL) para preservar a privacidade dos dados, demonstrando o potencial de frameworks diagnósticos leves e que preservam a privacidade para aplicações do mundo real. De forma semelhante, Zhao et al.4introduziram uma estrutura de rede de conectividade funcional de alta ordem (Ho-FCN) baseada em clusters que capturou interações dinâmicas entre múltiplas regiões cerebrais e alcançou uma precisão de 86,2%.

A explicabilidade surgiu como uma consideração importante para a adoção clínica de modelos diagnósticos baseados em neuroimagem. Jung et al.10 apresentaram uma estrutura de seleção por região de interesse (ROI) guiada por explicabilidade que identificou associações funcionais de alta ordem entre regiões cerebrais e superou modelos convencionais de conectividade funcional de baixa ordem. Além disso, Han et al.9investigaram uma estrutura multimodal que combinava dados de EEG e rastreamento ocular (ET) usando autoencoders empilhados de denoição. Ao integrar informações neurofisiológicas e comportamentais complementares, a abordagem proposta alcançou melhor desempenho diagnóstico em comparação com métodos monomodales.

Análise comportamental e do olhar

Dados comportamentais, especialmente padrões de movimentos oculares e expressões faciais, têm sido amplamente investigados como indicadores objetivos de traços relacionados ao TEA. Artiran et al.3 desenvolveram um sistema de avaliação baseado em realidade virtual (VR) para analisar o comportamento do olhar durante entrevistas de emprego simuladas. Utilizando técnicas avançadas de processamento de sinais e agrupamento, o estudo forneceu insights sobre a modulação social do olhar entre indivíduos neurotípicos e neurodivergentes. De forma semelhante, Zhang et al.5 empregaram dinâmica facial e técnicas de aprendizado em poucos tiros para classificar traços de TEA em vídeos de entrevista do Autism Diagnostic Observation Schedule (ADOS), alcançando uma precisão de 91,72%.

Abordagens precoces de triagem também demonstraram considerável potencial para identificação de TEA. Liu et al.7 validaram um protocolo de Resposta às Instruções (RTI) baseado em visão para crianças pequenas e relataram concordância de 95% com os diagnósticos clínicos. Coletivamente, esses estudos destacam o potencial da análise comportamental baseada em aprendizado de máquina para melhorar a escalabilidade, objetividade e automação da triagem e avaliação de TEA.

Métodos multimodais e híbridos

A integração de modalidades de dados heterogêneas aumenta a robustez e a generalização dos modelos de classificação de TEA. Han et al.9 desenvolveram uma estrutura multimodal que combinava dados de EEG e rastreamento ocular (TE), demonstrando melhora no desempenho diagnóstico ao aproveitar informações neurofisiológicas e comportamentais complementares. De forma semelhante, Xiao et al.14 utilizaram a ressonância magnética estrutural (MRI) para extrair características de fluxo multinível relacionadas ao TEA. Sua estrutura de aprendizagem de representação mista com margem e margem enfrentou desafios associados à heterogeneidade dos dados e aos espaços de características de alta dimensão, alcançando uma área sob a curva (AUC) de 0,907.

Abordagens híbridas que integram informações biológicas e ambientais também surgiram como estratégias promissoras para o diagnóstico do TEA. Peralta-Marzal et al.24 analisaram perfis do microbioma intestinal usando seleção recursiva de características em conjunto (REFS), identificando táxons bacterianos associados ao TEA e alcançando um AUC de 0,816. Coletivamente, esses estudos destacam o potencial de estruturas multimodais e híbridas para melhorar a precisão diagnóstica ao integrar fontes complementares de informação além dos dados convencionais de neuroimagem.

Inovações computacionais

Vários estudos focaram em melhorar a eficiência computacional, escalabilidade e robustez dos modelos diagnósticos de TEA. Sravani e Kuppusamy12 desenvolveram uma rede neural convolucional profunda (DCNN) otimizada integrada ao algoritmo Dipper-Throated Particle Swarm Optimization (DTPSO), alcançando uma precisão de 95,9%. O framework proposto melhorou a otimização de características e o desempenho da classificação, demonstrando o potencial das técnicas híbridas de otimização para a detecção de TEA.

Esforços também foram direcionados para o desenvolvimento de sistemas diagnósticos que preservem a privacidade e sejam eficientes em recursos. Farooq et al.20 aplicaram a aprendizagem federada (FL) para a detecção de TEA, relatando precisões de 98% para crianças e 81% para adultos. Ao permitir o treinamento descentralizado de modelos sem compartilhamento direto de dados, a abordagem demonstrou a viabilidade de implantar sistemas de diagnóstico de TEA baseados em IA em ambientes com recursos limitados e sensíveis à privacidade.

Tecnologias emergentes

Tecnologias emergentes, incluindo dispositivos vestíveis, sistemas assistivos e ambientes virtuais imersivos, ampliaram o escopo da avaliação e intervenção em TEA. Jayanthi et al.23propuseram um sistema de monitoramento baseado em aprendizado de máquina que utilizava dados de sensores fisiológicos para avaliar os níveis de estresse em indivíduos com TEA, destacando o potencial das tecnologias vestíveis para apoiar o monitoramento da saúde mental e o cuidado personalizado. De forma semelhante, Robles et al.6 desenvolveram uma plataforma baseada em realidade virtual (VR) para triagem e classificação de TEA, demonstrando o valor de ambientes imersivos para avaliação comportamental e suporte diagnóstico.

Apesar desses avanços, vários desafios continuam a limitar a ampla adoção clínica de sistemas diagnósticos de TEA baseados em IA. Como resumido na Tabela 2, questões relacionadas à heterogeneidade dos dados, generalização do modelo e interpretabilidade continuam sendo preocupações significativas. Para abordar essas limitações, Kunda et al.11 enfatizaram a importância de grandes conjuntos de dados multi-site, enquanto Fu et al.17propuseram abordagens de subtipagem específicas por idade para melhor capturar a heterogeneidade do desenvolvimento do TEA. Além disso, a tradução bem-sucedida de ferramentas de diagnóstico baseadas em ML para a prática clínica exigirá protocolos padronizados de validação, estruturas de relatórios transparentes e uma consideração cuidadosa dos requisitos éticos, de privacidade e regulatórios.

Análise comportamental e fisiológica de sinais

Análises comportamentais e fisiológicas de sinais surgiram como abordagens promissoras para diagnóstico e rastreamento de TEA. Jin et al.27 realizaram uma meta-análise de técnicas de aprendizado de máquina baseadas em vídeo doméstico e relataram valores de sensibilidade e especificidade agrupados de 0,90 e 0,87, respectivamente, destacando o potencial de abordagens escaláveis e acessíveis para a detecção precoce de TEA. Em outro estudo, Manjur et al.29 utilizaram sinais de eletroretinograma para diferenciar entre TEA, transtorno de déficit de atenção/hiperatividade (TDAH) e indivíduos em desenvolvimento típico, demonstrando a utilidade dos biomarcadores fisiológicos para a classificação de transtornos do neurodesenvolvimento.

Abordagens diagnósticas baseadas em EEG também mostraram resultados animadores. Singh eKakkar 38 propuseram o modelo de Otimização Cronológica de Treinamento de Costura – Rede Residual Profunda (CSTO-DRN) para detecção de TEA usando sinais de EEG, alcançando uma precisão de 88,6% enquanto abordava desafios relacionados à redução de ruído e otimização de características. De forma semelhante, Radhakrishnan et al.41 desenvolveram uma estrutura de rede de atenção em grafos que incorporou redes neurais de grafos e mecanismos de atenção para classificação de TEA baseada em EEG, reportando uma precisão de 96,2%. Coletivamente, esses estudos demonstram o potencial crescente da análise comportamental e fisiológica de sinais para o desenvolvimento de ferramentas diagnósticas objetivas, não invasivas e escaláveis para TEA.

Métodos multimodais e integrativos

As técnicas de fusão multimodal avançaram significativamente a análise de TEA ao integrar fontes heterogêneas de informação. Wang et al.40desenvolveram a estrutura Federated Hypergraph Neural Network (FedHNN) para diagnóstico de TEA usando dados multimodais de conjuntos de dados médicos distribuídos. O framework proposto preservou a privacidade dos dados enquanto superava os modelos locais em precisão diagnóstica, demonstrando a viabilidade de sistemas de diagnóstico colaborativos e que preservem a privacidade.

A análise do microbioma intestinal também se tornou uma modalidade promissora para pesquisas sobre TEA. Olaguez-Gonzalez et al.49 aplicaram técnicas de aprendizado de máquina aos dados de composição do microbioma e alcançaram uma precisão de 94,7% usando um número limitado de cepas bacterianas. Ampliando essa linha de pesquisa, Su et al.42 incorporaram dados de microbiota multirreinos e relataram uma área abaixo da curva (AUC) de 0,91, identificando biomarcadores funcionais associados ao TEA, incluindo vias de biossíntese do ubiquinol-7.

Além das abordagens baseadas em microbioma, biomarcadores derivados da acústica da fala e da voz foram investigados como ferramentas diagnósticas não invasivas. Briend et al.48 analisaram características acústicas extraídas de amostras de fala de crianças e alcançaram 91% de precisão na classificação ao distinguir indivíduos com TEA de controles em desenvolvimento típico. Esses achados destacam o potencial dos biomarcadores baseados na voz para complementar avaliações diagnósticas tradicionais e apoiar estratégias de rastreamento para TEA mais acessíveis.

Avanços em métodos computacionais

Como resumido na Tabela 3, avanços recentes em metodologias computacionais melhoraram substancialmente o diagnóstico e a classificação do TEA. Vidyadhari et al.46 desenvolveram uma rede neural quantizada profunda (DQNN) otimizada usando o algoritmo Fractional Social Driving Training-Based Optimization (FSDTBO) e reportaram uma precisão de 90%. A estrutura proposta demonstrou o potencial de modelos de aprendizado profundo aprimorados por otimização para melhorar o desempenho diagnóstico.

De forma semelhante, Zhang et al.32 empregaram uma abordagem de análise topológica de dados (TDA) para extrair características de medidas de homogeneidade regional e alcançaram uma precisão de 96,5%, superando várias metodologias convencionais. O estudo destacou o valor de técnicas avançadas de representação de características para capturar padrões neurobiológicos complexos associados ao TEA.

Frameworks híbridos de aprendizado de máquina também foram explorados para melhorar a seleção de modelos e o desempenho da classificação. Alqaysi et al.39 avaliaram 72 modelos híbridos de aprendizado de máquina dentro de uma estrutura de tomada de decisão multicritério difusa que integrava estratégias de seleção e classificação de características. Seus achados indicaram que abordagens baseadas em boosting de árvores de decisão e gradiente estavam entre os classificadores mais estáveis, enquanto a seleção eficaz de características desempenhou um papel fundamental na otimização do desempenho geral do modelo.

Significado clínico dos frameworks multimodais de TEA

A aprendizagem multimodal emergiu como uma estratégia importante para melhorar tanto o desempenho diagnóstico quanto a relevância clínica dos sistemas de classificação de TEA. Como o TEA se manifesta heterogeneamente entre indivíduos por meio de diferenças na comunicação social, processamento sensorial, funcionamento cognitivo, regulação comportamental e características biológicas, modelos treinados com uma única modalidade de dados podem capturar apenas uma parte limitada da complexidade do transtorno. Ao integrar informações de neuroimagem, eletroencefalografia (EEG), rastreamento ocular, vídeo comportamental, perfis de microbioma, acústica de voz e dados demográficos, os frameworks multimodais fornecem uma representação mais abrangente das características relacionadas ao TEA.

Além de melhorar a precisão da classificação, os sistemas multimodais apoiam uma abordagem mais informada pelo fenótipo para o diagnóstico, identificando evidências convergentes em múltiplas fontes de dados, preservando diferenças clinicamente significativas entre os indivíduos. Os achados relatados por Han et al.9, Wang et al.40, Su et al.42, Briend et al.48, e Olaguez-Gonzalez et al.49 demonstram coletivamente o valor de integrar modalidades complementares para aumentar a robustez diagnóstica, a interpretabilidade e a aplicabilidade clínica. Consequentemente, os frameworks multimodais de TEA devem ser vistos não apenas como ferramentas para melhorar o desempenho preditivo, mas também como abordagens que facilitam decisões diagnósticas mais personalizadas e clinicamente relevantes.

Tecnologias emergentes e aplicações

Tecnologias emergentes ampliaram o escopo do diagnóstico, intervenção e monitoramento do paciente com TEA. Zhao et al.45 revisaram a aplicação de tecnologias de realidade estendida (XR) para intervenções de TEA e destacaram seu potencial para apoiar o desenvolvimento de habilidades cognitivas, comportamentais e sociais por meio de ambientes imersivos e interativos. De forma semelhante, Nogay eAdeli, 47 anos, investigaram a influência da idade e do gênero na classificação dos TEA e demonstraram que incorporar informações demográficas poderia melhorar o desempenho dos modelos de aprendizado profundo.

Apesar do progresso substancial, vários desafios continuam limitando a ampla adoção clínica de sistemas diagnósticos de TEA baseados em IA. Heterogeneidade dos dados, tamanhos limitados de amostra, validação externa insuficiente e preocupações sobre a generalização do modelo continuam sendo limitações comuns em muitos estudos. Para enfrentar esses desafios, Quillet et al.34 exploraram biomarcadores metabolômicos associados ao TEA, enquanto Thapa et al.50 utilizaram dados clínicos retrospectivos para melhorar a classificação diagnóstica e a robustez dos modelos. Esses estudos ilustram a importância de expandir a diversidade de dados e incorporar novos biomarcadores para aumentar a confiabilidade dos modelos e a relevância clínica.

De modo geral, a literatura revisada demonstra o potencial transformador do aprendizado de máquina e do aprendizado profundo para o diagnóstico e análise de TEA em múltiplas modalidades de dados. Avanços em neuroimagem, avaliação comportamental, aprendizado multimodal, análise fisiológica de sinais, pesquisa em microbioma e biomarcadores baseados em voz melhoraram substancialmente a precisão diagnóstica, escalabilidade e interpretabilidade. Pesquisas futuras devem focar na validação em larga escala e múltiplas coortes, estruturas padronizadas de avaliação, aprimoramento da interpretabilidade e integração de diversas modalidades de dados para apoiar o desenvolvimento de sistemas diagnósticos robustos, clinicamente traduíveis e personalizados para TEA.

Análise de resultados comparativa revisada

A análise comparativa foi revisada para enfatizar a qualidade das evidências, o rigor da validação e a aplicabilidade clínica, em vez da precisão diagnóstica sozinha. Como os estudos revisados diferiram substancialmente em conjuntos de dados, faixas etárias, populações-alvo, estratégias de validação e objetivos metodológicos, a comparação numérica direta das métricas de desempenho relatadas foi interpretada com cautela. Em vez disso, a síntese revisada integra desempenho preditivo com maturidade de validação, testes externos, interpretabilidade, viabilidade de implantação e prontidão clínica.

A Figura 1 resume as métricas de desempenho diagnóstico explicitamente relatadas extraídas dos estudos revisados, incluindo precisão, sensibilidade e especificidade. Embora muitos estudos tenham relatado alto desempenho diagnóstico, foi observada uma variabilidade substancial entre modalidades e desenhos de estudos. Várias investigações alcançaram precisões superiores a 95%, mas os valores de sensibilidade e especificidade foram frequentemente relatados de forma menos consistente, destacando a importância de avaliar o desempenho diagnóstico usando múltiplas métricas complementares, em vez de apenas a precisão.

A relação entre precisão relatada e sensibilidade é ainda ilustrada na Figura 2. Uma associação positiva pode ser observada entre os estudos; no entanto, a figura também demonstra que alta precisão nem sempre corresponde a uma sensibilidade proporcionalmente maior. Esse achado é clinicamente importante porque as aplicações de triagem de TEA exigem a identificação do maior número possível de casos verdadeiros de TEA, tornando a sensibilidade um critério crítico de avaliação junto com a precisão geral da classificação.

Para avaliar a confiabilidade dos achados relatados, a Figura 3 apresenta a distribuição dos sinais de maturidade de validação e risco de viés entre os principais grupos de modalidades. Estudos baseados em neuroimagem, especialmente aqueles que utilizavam conjuntos de dados de fMRI e sMRI, constituíram o maior grupo de evidências, mas frequentemente dependiam de conjuntos de dados repetidos de benchmark e frameworks de validação cruzada. Abordagens federadas e multimodais demonstraram maturidade de validação comparativamente mais forte porque incorporaram fontes de dados multi-site e estratégias de validação mais diversas. Em contraste, plataformas de intervenção baseadas em XR e várias abordagens comportamentais apresentaram validação externa limitada, restringindo as evidências atuais para adoção clínica em larga escala.

A Figura 4 estende a análise além do desempenho preditivo ao resumir a prontidão clínica em nível de modalidade. A síntese incorpora seis dimensões: maturidade do conjunto de dados, maturidade de validação, validação externa, interpretabilidade, viabilidade de implantação e prontidão clínica geral. Abordagens de IA federada e multimodal alcançaram as maiores pontuações gerais de prontidão porque demonstraram práticas de validação mais fortes e escalabilidade aprimorada. Métodos comportamentais de vídeo e baseado no olhar também mostraram prontidão promissora devido à sua interpretabilidade relativamente alta e potencial de implantação prática. Por outro lado, modalidades como avaliação baseada em voz e plataformas XR apresentaram menor prontidão devido à evidência limitada de validação e populações menores de estudos.

A relação entre prontidão clínica e desempenho diagnóstico relatado é visualizada na Figura 5. A figura demonstra que valores de precisão muito altos não necessariamente se traduzem em forte prontidão clínica. Vários estudos com precisões acima de 95% permaneceram posicionados em níveis moderados de prontidão porque dependiam de pequenos conjuntos de dados, coortes de local único ou careciam de validação externa independente. Em contraste, estudos com desempenho diagnóstico ligeiramente menor frequentemente demonstraram maior potencial translacional quando acompanhados por melhor interpretabilidade, validação mais ampla e caminhos de implantação mais claros.

As limitações metodológicas identificadas entre grupos de modalidades são resumidas na Figura 6. Preocupações comuns incluíam tamanhos de amostra pequenos, dependência de conjuntos de dados de um único local como o ABIDE, validação externa insuficiente, potencial vazamento de dados, análise limitada de calibração e incerteza quanto à viabilidade da implantação. O mapa de evidências destaca que o rigor metodológico e a qualidade da validação continuam sendo grandes barreiras para a tradução clínica, apesar de incentivar o desempenho diagnóstico. Consequentemente, a credibilidade das evidências deve ser considerada junto com a precisão relatada ao avaliar sistemas diagnósticos de TEA.

Análise de resultados estendida

Uma síntese mais ampla foi realizada para comparar a influência das modalidades de dados, estratégias algorítmicas, características de conjuntos de dados, estruturas de interpretabilidade, eficiência computacional e tecnologias emergentes no desempenho diagnóstico de TEA e na tradução clínica.

A Figura 7 oferece uma visão geral integrada dos fatores associados ao desempenho diagnóstico do TEA. A comparação de modalidades indica que as abordagens multimodais alcançaram o maior desempenho geral, seguidas pelos métodos baseados em neuroimagem. Comparações em nível de algoritmo sugerem que arquiteturas avançadas, incluindo redes neurais de grafos e frameworks de aprendizagem federada, demonstraram consistentemente forte desempenho enquanto simultaneamente enfrentavam desafios relacionados à heterogeneidade dos dados e preservação da privacidade. Análises relacionadas a conjuntos de dados indicam que conjuntos de dados maiores e multi-locais geralmente produziram resultados mais estáveis e generalizáveis do que coortes menores. Além disso, métodos que incorporam mecanismos de explicabilidade alcançaram maior aceitação clínica porque proporcionaram maior transparência na tomada de decisão dos modelos.

As matrizes de evidência e qualidade apresentadas nas Tabelas 4 e 5 reforçam essas observações. Estudos apoiados por conjuntos de dados maiores, procedimentos de validação mais rigorosos e testes externos geralmente demonstraram desempenho mais confiável do que estudos que dependem exclusivamente da validação interna. Em ambas as tabelas, a qualidade das evidências aumentou quando os estudos incorporaram coortes multi-locais, populações de teste independentes ou estruturas de validação federadas. Esses achados sugerem que futuros sistemas diagnósticos de TEA devem priorizar validação, rigor e reprodutibilidade, além da precisão preditiva.

A Tabela 6 resume a importância relativa dos critérios de avaliação para sistemas de IA diagnóstica para TEA. Sensibilidade, especificidade, validação externa, interpretabilidade, avaliação de justiça e viabilidade de implantação emergiram como fatores críticos para a tradução clínica. Embora a precisão diagnóstica continue importante, a análise demonstra que nenhuma métrica única é suficiente para estabelecer a utilidade clínica. Em vez disso, é necessária uma combinação de desempenho, confiabilidade, transparência e validação de evidências para uma adoção significativa em ambientes de saúde.

A síntese em nível de modalidade apresentada na Tabela 7 ilustra ainda mais diferenças na maturidade das evidências entre abordagens diagnósticas de TEA. Métodos baseados em neuroimagem demonstraram forte desempenho diagnóstico, mas frequentemente apresentaram limitações relacionadas à dependência do conjunto de dados e validação externa. Abordagens comportamentais e baseadas no olhar ofereceram melhor interpretabilidade e viabilidade de implantação, enquanto os frameworks de aprendizagem multimodal e federada mostraram o maior equilíbrio geral entre desempenho, maturidade de validação e prontidão clínica. Abordagens emergentes envolvendo análise de microbioma, biomarcadores acústicos de voz e sistemas baseados em XR continuam promissoras, mas exigem estudos de validação maiores antes da implementação clínica em larga escala.

Coletivamente, esses achados demonstram que o futuro da IA diagnóstica de TEA provavelmente dependerá de frameworks multimodais, validados externamente, interpretáveis e que preservem a privacidade, em vez da otimização de desempenho sozinha. A síntese enfatiza que a prontidão clínica é determinada não apenas pela precisão preditiva, mas também pela qualidade da validação, transparência, escalabilidade e aplicabilidade no mundo real.

Acesso restrito. Inicie sessão ou comece um teste para visualizar este conteúdo.

Conclusões

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

Esta revisão demonstra o papel crescente do aprendizado de máquina (ML) e do aprendizado profundo (DL) no diagnóstico e análise do transtorno do espectro autista (TEA). Nos estudos revisados, abordagens computacionais foram aplicadas a diversas modalidades de dados, incluindo ressonância magnética funcional (fMRI), eletroencefalografia (EEG), vídeo comportamental, perfis do microbioma intestinal e sinais acústicos de voz. Classificadores tradicionais de ML, especialmente máquinas vetoria...

Acesso restrito. Inicie sessão ou comece um teste para visualizar este conteúdo.

Divulgações

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

Os autores declaram que não têm conflitos de interesse relacionados a esta obra.

Agradecimentos

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

Os autores gostariam de agradecer à Universidade VIT-AP por fornecer o ambiente acadêmico e os recursos que apoiaram esse trabalho. Os autores também valorizam as valiosas contribuições dos pesquisadores cujos estudos foram incluídos nesta revisão. Essa pesquisa não recebeu financiamento externo.

Acesso restrito. Inicie sessão ou comece um teste para visualizar este conteúdo.

Reimpressões e permissões

Solicitar permissão para reutilizar o texto ou as figuras deste artigo JoVE

Solicitar permissão

Etiquetas

EngenhariaEdi o 233Edi o 233Valor VazioEdi oDados MultimodaisAn lise de Neuroimagem

Artigos relacionados