本研究では、甲状腺機能低下症の積極的診断において、K近傍法(KNN)、サポートベクターマシン(SVM)、極端勾配ブースティング法(XGBoost)、ソフトボーティングアンサンブル分類器の4つの機械学習アルゴリズムを調査します。これらのアルゴリズムは批判的な文献レビューに基づき最終候補に選ばれ、サウジアラビアで現地で収集されたデータセットを用いて採用されました。
このコンテンツを表示するには、JoVEへの購読が必要です。 または、無料トライアルをお申し込みください。
本研究では、甲状腺機能低下症の積極的診断において、K近傍法(KNN)、サポートベクターマシン(SVM)、極端勾配ブースティング法(XGBoost)、ソフトボーティングアンサンブル分類器の4つの機械学習アルゴリズムを調査します。これらのアルゴリズムは批判的な文献レビューに基づき最終候補に選ばれ、サウジアラビアで現地で収集されたデータセットを用いて採用されました。
甲状腺機能低下症は、サウジアラビアで最も一般的でありながら過小診断されている医療状態の一つです。高齢者や妊婦、糖尿病や睡眠時無呼吸症候群の患者に多く見られます。甲状腺機能低下症は、甲状腺が甲状腺ホルモンを不十分に分泌しないことが特徴で、放置すると他の慢性疾患を引き起こす可能性があります。このため、本研究はサウジアラビアの簡易な臨床データセットを用いて、この病気を事前に診断するための機械学習技術を提案します。データ量を考慮すると、この研究は概念実証として機能します。KNN、SVM、グラデーションブースティング、ソフトボイティングアンサンブル分類器などのアルゴリズムは、文献上の他のアルゴリズムと比較して甲状腺機能低下症および関連疾患の積極的診断において有望な性能を示しているとして選ばれました。最も性能を上げたモデルはソフトボーティングアンサンブル分類器で、94.7%の精度を達成しました。SVM、KNN、XGBoostはそれぞれ94%、93.42%、92.1%の精度を記録しました。これらの結果は、10折の交差検証と順順特徴選択を用いて得られました。
甲状腺機能障害(TD)は最も一般的な慢性内分泌疾患の一つであり、人口によって有病率は異なります。最も一般的な甲状腺疾患は甲状腺機能低下症と甲状腺機能亢進症の2つです。甲状腺機能低下症は、甲状腺ホルモンの産生不足によって引き起こされる一般的な状態です。一般的には治療で管理可能ですが、重症の場合は対処しなければ命に関わることもあります。成人の甲状腺機能低下症の最も一般的な症状には、疲労、便秘、倦怠感、体重増加、乾燥肌、声の変化が含まれます。ただし、臨床症状は年齢、性別、その他の要因によって異なる場合があります。この病気は一般人口の5%に影響を及ぼし、さらに5%が未診断のままであり、そのうち99%が原発性甲状腺機能低下症に苦しんでいます。アラビア湾岸諸国で広く分布していますが、しばしば過小診断されています。先天性甲状腺機能低下症は、サウジアラビアの約3,450人の赤ちゃんに1人に影響を及ぼしています。女性のみに焦点を当てた他の横断研究では、13%から35%の有病率が報告されています5。さらに、メスがオスよりも感受性が高いことを証明しています。甲状腺機能低下症は治療せずに放置すると、脂質異常、認知障害、高血圧、不妊、神経筋機能障害を引き起こす可能性があります。したがって、本研究はサウジアラビア・ダンマームのキング・ファハド専門病院(KFUH)のデータセットを用いて、機械学習手法を用いて甲状腺機能低下症を積極的に診断することを目指しています。
甲状腺機能低下症は、症状が他の病気と混同されることが多いため、診断が難しいことがあります。さらに、甲状腺機能低下症の遅れて診断されることは、患者の知的能力に悪影響を及ぼす可能性があります。甲状腺刺激ホルモン(TSH)検査は甲状腺機能低下症の検出で最もよく使われる診断方法です。しかし、人工知能や機械学習の手法、戦略、ツールの登場により、さまざまな医療分野での診断や予後の問題が解決されました。MLは、病気の進行予測、アウトカム研究のための医学的知識の抽出、治療計画とサポート、そして全体的な患者ケアなど、臨床要因とその組み合わせの予後における重要性を評価するために用いられます。大量の医療データが利用可能になることで、医療従事者は機械学習を通じて新しく潜在的に価値ある知識を発見するための貴重なリソースを手に入れました。
サウジアラビアのデータセットからシンプルな臨床データセットを用いて、本研究は国内の医療従事者が甲状腺機能低下症を早期に診断し、限られたコンピュータ資源や機器を持つ病院でこの予測システムを導入することを目的としています。さらに、この分野の以前の研究ではサウジのデータセットは利用されていませんでした。これにより、サウジのデータセットを以前の研究と組み合わせて取り入れる機会が生まれます。これらの研究は、それぞれサウジのデータセットを用いて腎臓病、糖尿病、甲状腺疾患、アルツハイマー病を予測し、高い精度13、14、15を記録しました。この経験が、これらの手法をサウジアラビアの他の病気に応用する動機となっています。これらの研究は、医療分野における機械学習と人工知能の最新の研究の一つです(16、17、18、19)。
本研究では、甲状腺機能低下症の単純な臨床データセットに機械学習技術を適用し、症状が完全に現れる前に病気の存在を予測する方法を論じています。目的は、甲状腺機能低下症の発生を早期に警告する機械学習ベースのシステムを構築することです。また、設備が限られている地域の病院でもこの診断システムの利用が容易になります。本研究はサウジのデータセットを用いてこの病気を初めて調査し、症状が出る前段階に焦点を当てています。このデータセットは、地元のサウジ病院患者の幅広い年齢層を対象としており、陽性・陰性の甲状腺機能低下症の混合が含まれています。
本研究では、サポートベクターマシン(SVM)、K近傍解析(KNN)、エクストリーム勾配ブースティング(XGBoost)、そしてSVMとKNNからなるソフトボーティングアンサンブル分類器の4つの機械学習アルゴリズムが利用されました。これら4つのアルゴリズムそれぞれが医療分野でその能力を証明しています。KNNアルゴリズムは、そのシンプルさと糖尿病(DM)の予防的診断において77.5%の検査精度を達成したことから選ばれました20。同時に、SVMはその堅牢性を理由に選ばれました21、最近ではCOVID-19患者の死亡リスク予測にも利用されています。さらに、XGBoostは高血圧の結果で94%の正確な予測スコアを達成し、高いパフォーマンスのアルゴリズムの結果を強化するためにスタッキングが採用された。 さらに、投票アンサンブル分類器が用いられ、甲状腺疾患を100%の精度で特定しています。
本研究の主な目的は、独自の臨床データと最先端の機械学習アルゴリズムを用いて、サウジアラビアの集団における甲状腺機能低下症の早期診断です。本研究で用いられた4つの技術は、Pythonプログラミング言語を用いてJupyterプラットフォーム上で実装され、甲状腺機能低下症データセットを用いました。パフォーマンス向上のためにハイパーパラメータチューニングを用いた10分割クロスバリデーションが用いられました。その後、順次選択技術を用いた逐次特徴選択が実装され、投票アンサンブル分類器は最高94.7%の精度を達成しました。それぞれSVM、KNN、XGBoostが続きました。リコールに関しては、ソフトボーティングアンサンブル分類器が95.5%で最高得点を獲得しました。全体として、予防的甲状腺機能低下症診断の最適モデルはソフト投票アンサンブル分類器であり、本研究で評価されたすべてのパフォーマンス指標で最高得点を獲得しました。
一般的な甲状腺疾患の診断や、特に機械学習をコンピュータ支援ソリューションとして導入するためのいくつかの研究が行われています。LSTM-CNN、AlexNet、調整済みGoogLeNet、IndRNN–CNN、および調整済みResNet深層学習モデルが、ラマン分光法を用いて32名の甲状腺機能低下症患者、38名の甲状腺機能亢進症患者、29名の対照群から血清サンプルを識別するために展開されました。彼らのモデルはそれぞれ84%、91%、75%、82%、71%の精度を獲得しました。
SVM、KNN、ロジスティック回帰、ランダムフォレストなどの機械学習アルゴリズムが、鼻咽頭がん患者における放射線誘発性甲状腺機能低下症の発生率予測に利用されています。彼らのモデルはAUC値0.7を記録しました。さらに、著者らは様々な機械学習アルゴリズムを用いて、LT4治療を受ける甲状腺機能低下症患者の治療傾向を予測しました。10の分類器の中で、ツリー外分類器は84%の最高精度を記録しました。
別の研究では、著者らは即時の医療治療が有益な甲状腺機能亢進症および甲状腺機能低下症の人々を特定するための機械学習戦略を作成し検証しました27。彼らは勾配ブースティング決定木(GBDT)、SVM、ANN、ロジスティック回帰アルゴリズムを展開しました。彼らのモデルは甲状腺機能亢進症でそれぞれ93.8%と90.9%のAUROCを得ました。別の研究では、著者らは機械学習を用いて甲状腺機能低下症と甲状腺機能亢進症を含む甲状腺疾患を検出しました。彼らのモデルにはSVM、ANN、KNN、ロジスティック回帰、意思決定木が含まれ、ロジスティック回帰28では96.92%の最高精度を達成しました。最近、研究者グループがSVM、意思決定ツリー、ナイーブベイズ、アンサンブルなど多様な手法を用いて甲状腺機能低下症の予測と検出を行いました。決定木は97.6%と最も高い精度を達成しました。別の研究では、ハイブリッド差別進化カーネルベースのナイーブベイズアルゴリズムを用いて、甲状腺機能亢進症および甲状腺機能低下症の甲状腺データセットの属性を21から10に減らしました。その後、特徴サブセットにカーネルベースのナイーブベイズ分類器を適用し、97.97%の精度30を達成しました。同様に、別の研究では、カリフォルニア大学の病気-安酔性甲状腺データセット上で複数の機械学習アルゴリズムを用いて甲状腺疾患のリスクを予測しました。彼らの実験は、ANNが他のすべての手法を上回り、95%の精度を達成していることを示しました。31。さらに、Jhaらはディープニューラルネットワークに基づく特徴増強技術を用いて甲状腺疾患を予測し、99.95%という卓越した精度を達成しました。
先行文献によると、複数属性選択を備えた均質投票アンサンブルが用いられ、ランダムフォレスト、勾配ブースティング、決定木、ロジスティック回帰のアルゴリズムを用いて甲状腺疾患を特定し、100%の精度を達成しました。さらに、著者らは極限学習機械モデルをKaggleの甲状腺機能低下症オープンアクセスデータセットに適用し、92%の精度を達成しました。データセットには3772件のサンプルが含まれており、そのうち3481件が甲状腺機能低下症、残りは陰性33件でした。最近の研究では、著者らはバッグ入りCARTを用いて甲状腺機能低下症を分類しました。彼らの提案したモデルは99.9%という驚異的な精度を達成しました。さらに、T4U、TSH、TBGが甲状腺機能低下症に関連する最も重要な要因として特定されました34。別の研究では、著者らは異なる機械学習モデルと深層学習モデルを提案・比較し、決定木とランダムフォレストがそれぞれ99.5%と99.3%の精度を達成しました。彼らは30の属性と3772サンプルを含むWekaデータセットを使用しました。
この簡単な文献レビューは、ほとんどの方法が非常に良好または優れた結果を得ている一方で、サウジアラビアの簡単な臨床データセットを活用したものはないことを示しています。また、検討対象の多くの論文が画像データセットを使用しており、データ収集の作業が増え、非技術者が作成した非常に複雑なモデルの適用難しさが高まっていることも指摘されました。さらに、これらの研究の多くは一般的な甲状腺疾患に関するもので、甲状腺機能低下症を強調する論文は非常に少ないです。この状況は、サウジのデータセットからシンプルな臨床データセットを用いた基本的な機械学習モデルを調査し、限られたコンピュータ化された機器を持つ地元病院が病気を予防的に診断するのを支援する機会を提供します。
本研究で調査対象となったアルゴリズムの簡単な紹介は補足ファイル1に記載されています。4つのアルゴリズムは、K-Nearest Neighbor(KNN)36,37,38,39,40、サポートベクターマシン(SVM)41,42,43,44,45、Extreme Gradius Boosting(XGBoost)46、47、48、投票アンサンブル49,50です。
アクセスが制限されています。このコンテンツを表示するにはログインするか、トライアルを開始してください。
1. 方法論
注: Table of Materialsで説明されているように、本研究の実験はJupyter Notebook上のPythonで行われ、甲状腺機能低下症の予防診断のための機械学習モデルの開発に利用されました。Microsoft ExcelとPython Scikit-Learnライブラリは前処理段階で使用されました。K近傍(KNN)、サポートベクターマシン(SVM)、極端勾配ブースティング(XGBoost)、およびKNNとSVMからなるソフト投票アンサンブル分類器を用いてデータセットを訓練し、GridSearchCVと10分割のクロスバリデーションを用いて最適なハイパーパラメータを得ました。さらに、各分類器の特徴重要度は置換重要度を用いてプロットされました。

図1:実験的枠組み。 これが本研究の実験的枠組みです。この図の拡大版はこちらをクリックしてご覧ください。
注:甲状腺機能低下症に関するサウジのデータセットは、サウジアラビア・ダンマームのキング・ファハド専門病院(KFSH)から入手されました。この病院はイマーム・アブドゥルラフマン・ビン・ファイサル大学(旧ダムマーム大学)に所属する公立病院です。ダンマームは東部の州にあり、患者の多くは同じ地域に属しています。機関審査委員会(IRB)の承認を得て、データセットは病院での標準的なトリアージ手順および試験中に収集され、2020年から2021年にかけて患者健康記録(PHR)として病院管理システムに登録されました。データセットには、11歳から92歳までの152名(女性100名、男性52名)の標準臨床検査が含まれており、そのうち89人が甲状腺機能低下症と診断されました。対照的に、残りの63人は甲状腺機能低下症はないものの、アルツハイマー病など他の疾患と診断されました。データセットには483の属性があり、欠損値を30%を超える属性を除去したことで、前処理で18にまで減らされました。 表1は 本研究で用いられた特徴を示しています。
| 特徴 | 概要 |
| 年代 | 年齢を年数で示す。 |
| セックス | 男性でも女性でも。 |
| 白血球(WBC) | 白血球数。 |
| 温度 | 体温は摂氏(°C)で表示されます。 |
| 赤血球(RBC) | 赤血球数。 |
| 血小板 | 血小板数。 |
| MPV | 平均血小板体積 |
| パルスオックス | 血中酸素(酸素飽和度)の測定。 |
| MCH | 平均的な小球ヘモグロビン。 |
| RDW | 赤血球分布幅。 |
| MCV | 平均微粒子体積。 |
| MCHC | 平均小血球ヘモグロビン濃度 |
| パルス | 心拍数。 |
| ヘマトクリット | 赤血球の体積。 |
| 血圧 – 収縮期 | 血圧が最も高いです。 |
| ヘモグロビン | 血液中のヘモグロビン値。 |
| 血圧 – 拡張期 | 最も低い圧力です。 |
| 呼吸数 | 呼吸数/分。 |
表1:データセットの説明。この表は記述データセットを示しています。
2. 統計解析
注:データセットの統計解析は、データの前処理やモデリングをより良くするために、データセットのパターンを可視化・理解するのに役立ちます。 表2は 甲状腺機能低下症データセットの統計解析を示し、HT群と非HT群の結果を比較しています。
| 可変 | 甲状腺機能低下症(n = 89) | 非甲状腺機能低下症(n = 63) | t / U 値 | P値 |
| 年代 | 43.00 (33.00, 54.00) | 76.00 (70.00, 80.50) | 5.388 | < 0.001 |
| 呼吸数 | 20.00 (20.00, 20.00) | 20.00 (20.00, 21.50) | 2.561 | 0.004 |
| 血圧 – 収縮期 | 117.72 ± 16.46 | 127.85 ± 17.77 | 3.302 | 0.001 |
| 血圧 – 拡張期 | 73.00 (68.00, 79.00) | 72.95 (65.00, 80.25) | 2.076 | 0.892 |
| パルス | 79.09 ± 12.19 | 82.35 ± 12.72 | 1.47 | 0.145 |
| 温度 | 36.60 (36.50, 36.80) | 36.70 (36.60, 36.90) | 2.576 | 0.029 |
| パルスオックス | 99.00 (99.00, 100.00) | 99.00 (98.00, 99.00) | 1.088 | 0.005 |
| ヘマトクリット | 38.20 (35.88, 40.23) | 37.30 (31.30, 41.30) | 1.471 | 0.318 |
| 赤血球 | 4.52 (4.26, 4.81) | 4.37 (3.81, 4.89) | 1.36 | 0.104 |
| ヘモグロビン | 12.70 (11.70, 13.53) | 12.30 (10.00, 13.85) | 1.481 | 0.345 |
| RDW | 13.80 (13.38, 14.93) | 14.90 (13.80, 16.45) | 2.212 | 0.002 |
| MCV | 83.54 ± 6.85 | 85.05 ± 8.53 | 1.042 | 0.3 |
| 血小板 | 261.23 ± 63.97 | 223.62 ± 68.88 | −2.945 | 0.004 |
| MCHC | 33.60 (32.80, 34.02) | 33.20 (32.30, 34.00) | 1.314 | 0.06 |
| MCH | 28.00 (26.55, 29.57) | 28.10 (26.55, 30.20) | 1.78 | 0.468 |
| MPV | 8.81 ± 0.87 | 8.79 ± 1.38 | −0.074 | 0.941 |
| 白血球 | 6.10 (4.80, 7.43) | 7.20 (5.70, 8.90) | 2.075 | 0.017 |
表2:特徴の統計的分析。 この表は、HT群および非HT群の両方の特徴の統計的分析を示しています。略語;HT = 甲状腺機能低下症。
注: 表2では、HT群と非HT群は年齢、呼吸数、血圧収縮期、体温、パルスオキシメーター、RDW、血小板、白血球の各点で有意に異なります。したがって、生理的特徴を用いて両グループを区別することができる。
3. データ前処理
4. モデル構築と評価
注:クロスバリデーションのためのデータ分割:異なるフォールドを用いた様々な実験の結果、10フォールドクロスバリデーションが最適であることが判明し、その後採用されました。
(1)
(2)
(3)
(4)
(5)| アルゴリズム | ハイパーパラメータ名 | ハイパーパラメータ範囲 | ベストバリュー | 最良値を用いた精度 |
| K-NN | メートル法 | 『ミンコフスキー』『マンハッタン』『ユークリッド』 | ミンコフスキー | 84.21% |
| N_neighbors | 3, 5, 7, 9, 11, 13 | 5 | ||
| SVM | カーネル | 「リニア」「ポリ」「RBF」「シグモイド」 | 線形 | 92.76% |
| コスト(C) | 1, 2, 3, 4, 5, 6, 7, 8, 9, 10, 100 | 9 | ||
| ガンマ | 1, 0.1, 0.01, 0.001, 0.0001 | 1 | ||
| XGBoost | N_estimators | 5,01,00,15,02,00,250 | 200 | 89.47% |
表3:最適なハイパーパラメータ。これは各モデルの最適ハイパーパラメータを示します。
図2–4は 、KNN、SVM、XGBoost技術におけるハイパーパラメータ探索のためのグリッドサーチ手法と、それらがすべての特徴を用いてどのように実装されたかを示しています。

図2:KNNパフォーマンス。 これは異なる指標や隣接数におけるKNNのパフォーマンスです。略語;KNN = Kの最近傍。 この図の拡大版はこちらをクリックしてご覧ください。

図3:SVMパフォーマンス。これはカーネルおよびコスト関数値を用いたSVMのパフォーマンスです。この図の拡大版はこちらをクリックしてください。

図4:XGBoostパフォーマンス。 これは異なるブースター値とN_estimator値を用いたXGBoostのパフォーマンスです。略語;XGBoost = 極端な勾配ブースティング。 この図の拡大版はこちらをクリックしてご覧ください。
| アルゴリズム | 分類器 | ハイパーパラメータ | 精度 | |
| ソフト投票分類器 | K-NN | メートル法 | ミンコフスキー | |
| N_neighbors | 5 | |||
| SVM1 | カーネル | 線形 | ||
| コスト(C) | 9 | 88.81% | ||
| ガンマ | 1 | |||
| SVM2 | カーネル | RBF | ||
| コスト(C) | 9 | |||
| ガンマ | 1 | |||
表4:投票分類器のハイパーパラメータ。これは投票分類器の組み合わせとハイパーパラメータを示しています。
アクセスが制限されています。このコンテンツを表示するにはログインするか、トライアルを開始してください。
モデルの性能
本研究で作成された4つのモデルのパフォーマンスは、その精度、記憶力、テストに関して比較・分析されました。GridsearchCVアルゴリズムを用いて、すべての特徴量を用いた各モデルの最適なハイパーパラメータを特定しました。各モデルの性能は、層別化された10折のクロスバリデーションで評価されました。 表5は 各モデルのパフォーマンス結果を示しています。
| 分類器 | 精度 | リコール | 精密さ | F1スコア |
アクセスが制限されています。このコンテンツを表示するにはログインするか、トライアルを開始してください。
本研究では、サウジの臨床データセットを用いた機械学習アルゴリズムを調査し、甲状腺機能低下症の予防診断モデルを開発しています。4つのモデルが作られました:KNN、SVM、XGBoost、そしてSoft Voting Ensemble Classifierです。4つのモデルはいずれも、年齢と呼吸数が病気の予防診断において重要な指標であると認識しました。4つのモデルの中で、投票分類器は本研究で用いられたすべての指標で優れた性能を示しました。わずか5つの特徴を用い、94.73%の精度、呼び戻し、正確度、F1スコア値がそれぞれ95.50%を記録しました。それに続いてSVMが続き、6つの特徴で0.66%の精度低下でした。SVMとKNNはどちらも94.38%のリコールスコアを記録しており、投票分類者より1.12%低い数値です。KNNは甲状腺機能低下症の予防診断で93.42%の正確率で第3位にランクされました。XGBoostは精度と精度で最も性能が低いモデルでしたが、投票分類器のリコールスコアと一致していました。まとめると、本研究の発見は、特にソフト投票分類器を用いたアンサンブル学習ア...
アクセスが制限されています。このコンテンツを表示するにはログインするか、トライアルを開始してください。
このデータセットは病院からIRB-2020-09-429のもとで入手されました。著者らには本研究に関して利益相反の報告はありません。
著者らは、研究結果の検証に対して医療専門家のご支援に感謝申し上げます。
アクセスが制限されています。このコンテンツを表示するにはログインするか、トライアルを開始してください。
| 名前 | 会社 | カタログ番号 | コメント |
|---|---|---|---|
| ノートパソコン/マシン | デル | XPS9320 | RAM 16GB、第12世代Intel(R)コア(TM)i7-1260P |
| Excel 365 | マイクロソフト | Excel 365 | 生データをcsv形式で保存するために使用 |
| Python 3.12.12 | Google colab Notebook | Python 3.12.12 | モデル作成のトレーニングに使用およびnbsp; |
| Numpy 2.0.2 | Google colab Notebook | Numpy 2.0.2 | モデル作成のトレーニングに使用およびnbsp; |
| パンダス 2.2.2 | Google colab Notebook | パンダス 2.2.2 | モデル作成のトレーニングに使用およびnbsp; |
| Sklearn 1.6.1 | Google colab Notebook | Sklearn 1.6.1 | モデル作成のトレーニングに使用およびnbsp; |
| Mlxtend 0.23.4 | Google colab Notebook | Mlxtend 0.23.4 | モデル作成のトレーニングに使用およびnbsp; |
| XGbbost 3.1.2 | Google colab Notebook | XGbbost 3.1.2 | モデル作成のトレーニングに使用およびnbsp; |
| SPSS | IBM、アメリカ | Sklearn 1.6.1 | 統計解析に使用 |
アクセスが制限されています。このコンテンツを表示するにはログインするか、トライアルを開始してください。