تستخدم هذه الدراسة إطارا مسيطرا مضبوطا لتقييم خطوط معالجة ما قبل المعالجة والمحسينات ضمن بنية ثابتة، بهدف تحديد كيف تؤثر المعالجة المسبقة الكلاسيكية على المحسنين والشبكات العصبية الالتفافية (CNNs) في تصنيف أورام الدماغ.
Research Article
تستخدم هذه الدراسة إطارا مسيطرا مضبوطا لتقييم خطوط معالجة ما قبل المعالجة والمحسينات ضمن بنية ثابتة، بهدف تحديد كيف تؤثر المعالجة المسبقة الكلاسيكية على المحسنين والشبكات العصبية الالتفافية (CNNs) في تصنيف أورام الدماغ.
تصنيف أورام الدماغ باستخدام التصوير بالرنين المغناطيسي (MRI) يمثل تحديات بسبب الاختلافات في حجم الورم وشكله وملمسه. على الرغم من أن طرق معالجة الصور التقليدية تستخدم عادة لتحسين جودة الإدخال، إلا أن تأثيرها على سلوك المحسن وأداء CNN لم يتم التحقيق فيه بعد بشكل شامل. تفحص هذه الأبحاث تأثير المعالجة المسبقة على التقارب، والتعميم، ودقة التصنيف عبر مختلف المحسينات. نستخدم مجموعة بيانات كاجل المتاحة للجمهور لإنشاء خطي معالجة مسبقة: خط أنابيب أساسي يغير حجم الصور فقط، وخط أنابيب تقليدي يحول الصور إلى درجات رمادية، ويطمسه، ويطبق التصفية الشكلية (مورفولوجي). ثم نختبر كيف تؤثر هذه الخطوط على ثلاثة محسنات: آدم، انتشار الجذر المتوسط التربيعي (RMSProp)، والنزول التدرج العشوائي (SGD). لفصل متغيرات البروتوكول، يتم استخدام بنية CNN ثابتة في جميع الأنحاء. يتم تقييم الأداء باستخدام الدقة والدقة والاسترجاع ودرجة F1، ويتم التحقق من ذلك من خلال التحقق المتقاطع الخماسي. تظهر النتائج أن المعالجة المسبقة الأساسية تعطي دقة أعلى وتقارب أكثر استقرارا عبر جميع المحسنين، حيث حقق RMSProp وSGD أعلى متوسط دقة بنسبة 99.53٪ تحت التحقق المتقاطع الخماسي. تتناول النتائج التأثير غير المدرس للمعالجة المسبقة على أداء المحسن، مع التأكيد على الحاجة إلى استراتيجيات تدريب واعية بالمعالجة المسبقة لتحسين المتانة وقابلية التفسير في تحليل الصور الطبية.
تصنيف أورام الدماغ باستخدام التصوير بالرنين المغناطيسي (MRI) هو مهمة حاسمة في علم الأورام العصبية، حيث يؤثر التشخيص المبكر والدقيق بشكل مباشر على تخطيط العلاج ونتائج المرضى1. أصبحت شبكات CNN النهج السائد لأتمتة هذه العملية بسبب قدرتها على تعلم الميزات المكانية والنسيجية الهرمية مباشرة من بيانات الصور الخام2. ومع ذلك، تظل جودة بيانات الإدخال عاملا رئيسيا في تحديد أداء النموذج. تستخدم تقنيات المعالجة المسبقة الكلاسيكية - مثل التحويل الرمادي، والتمويه الغاوسي، وتحديد العتبة، والعمليات الشكلية - بشكل روتيني لتقليل الضوضاء والتركيز على الحدود الهيكلية3،4،5. أجرى جانغاداران وآخرون تحليلا مقارنا لنماذج التعلم العميق للتنبؤ بأورام الدماغ، مسلطين الضوء على التباين في الأداء عبر البنى وأهمية خصائص مجموعة البيانات في تشكيل النتائج6. اقترح قريشي وآخرون شبكة CNN فائقة الوزن لاكتشاف الأورام متعددة الفئات، مع التركيز على الكفاءة الحسابية والتطبيق في الوقت الحقيقي دون المساس بدقة التشخيص7. وبما هو أبعد من التصوير البنيوي، استكشف قريشي وآخرون تصنيف الجينوم الإشعاعي باستخدام ميزات متعددة الأوميكس المدمجة من فحوصات الرنين المغناطيسي متعددة المعلمات للتنبؤ بحالة مثيلة الميثيلغوانين-DNA الترانسفيراز (MGMT)، مما أظهر إمكانية وسائل البيانات المتكاملة لتحليل الورم غير الجراحي8. على الرغم من انتشارها، لا يزال تأثير هذه التحولات لاحقا على ديناميكيات تدريب CNN، وسلوك المحسنين، وقابلية التفسير غير مستكشف.
ركزت التطورات الحديثة في تصنيف أورام الدماغ على تعقيد المعماري، والهجينة بين التقسيم والتصنيف، والتعلم المنقول. على سبيل المثال، يستخدم MultiFeNet دمج الميزات متعدد المقاييس لتعزيز التمثيل المكاني9، بينما تقدم نماذج المجموعات وشبكات CNN ثلاثية الأبعاد دقة عالية مقابل زيادة التكاليف الحاسوبية10,11. الدراسات الحديثة حول الطرق الهجينة، مثل تحويل المويجات باستخدام آلة المتجه الداعمة (SVM) واكتشاف الحواف المعتمد على الآلات الخلوية، عادة ما تتطلب ميزات يدوية أو معالجة متعددة المراحل12,13. أبرزت الأبحاث المقارنة على مجموعات البيانات غير المتوازنة التحديات في تحقيق التعميم حسب الفئة14. أظهرت طرق التعلم التحويلي باستخدام شبكات مدربة مسبقا مثل VGG وResNet واعدا في تصنيف التصوير بالرنين المغناطيسي15، 16، 17؛ ومع ذلك، غالبا ما يعاملون المعالجة المسبقة كخطوة ثابتة في المراحل الصاعدة. نادرا ما تعزل هذه النماذج كيف تؤثر تحويلات الإدخال على تقارب المحسن أو الاحتفاظ الدلالي.
بدأت الدراسات الواعية للمعالجة المسبقة تبرز هذه الفجوة. أظهر إيفانيسكو وآخرون أن الترشيح المفرط يمكن أن يقلل من حساسية CNN لأنماط الأورام الدقيقة3. أظهر فو وآخرون أن تحويل وتغيير الحجم بالتدرج الرمادي يمكن أن يتجاهل المعلومات السياقية، مما يؤثر على دقة التشخيص4. كشف هوبر وآخرون أن الترشيح المقطعي المحوسب (CT) للأعلى يسبب تباين في الأداء، مما يبرز هشاشة CNNs تجاه تحولات المجال5. اقترح كوندو وآخرون تحولات شدة قائمة على غاوسي لتحسين التقسيم18؛ ومع ذلك، لم يقيموا حساسية المحسن. وفي الوقت نفسه، قام أسيري وآخرون وعامر وآخرون بتحسين معايير CNN الفائقة للكشف عن أورام الدماغ16,17، مشيرين إلى الأداء المتفوق لآدم دون تحليل كيفية استجابته لتغيرات المعالجة المسبقة. لقد طورت أدوات التفسير مثل رسم خرائط تنشيط الفئات المرجحة بالتدرج (Grad-CAM) وتفسيرات شابلي الإضافية (SHAP) في فهمنا لاتخاذ القرار في CNN من خلال تصور المناطق التمييزيةللفئة 19,20. تعد هذه الطرق ضرورية للتحقق مما إذا كانت المعالجة المسبقة تحسن أو تشوه الاحتفاظ الدلالي.
ومع ذلك، لم تدرس الدراسات بشكل منهجي كيف تؤثر المعالجة المسبقة على تقارب المحسن والتعميم والتفسير تحت بنية ثابتة - وهي أمور ذات أهمية سريرية وحسابية. سريريا، يمكن أن تؤدي التليين المفرط أو تحويلات الشدة إلى تخفيف التدرجات المكانية والنسيج ذات الصلة بالتشخيص، مما يقلل من دقة تحديد الموقع وثقة الطبيب. حسابيا، يتفاعل المحسنون بشكل مختلف مع التغيرات في مقياس الخصائص وتباين التدرج؛ يمكن أن تؤدي الاختلافات بين تعقيد الإدخال وديناميكيات المحسن إلى تقارب غير مستقر أو تعميم أضعف.
لمعالجة ذلك، نقدم إطار عمل مزدوج المسار يقارن بشكل منهجي بين خطوط معالجة المعالجة المسبقة الأساسية (التي تعتمد فقط على إعادة الحجم) وخطوط معالجة ما قبل التقليدية عبر ثلاثة محسنين — Adam وRMSProp وSGD — باستخدام بنية CNN متسقة ومجموعة بيانات BR35H Kaggleرقم 21. نقوم بتقييم أداء التصنيف، وسرعة التقارب، وقابلية التفسير باستخدام Grad-CAM، وتم التحقق من صحتها من خلال التحقق المتقاطع الخماسي. على عكس الأعمال السابقة التي تخلط بين التغيرات المعمارية والمعالجة المسبقة، يعزل هذا البروتوكول المعالجة المسبقة كمتغير مستقل، كاشفا أن التصفية العدوانية يمكن أن تعيق أداء المحسن والانتباه المكاني.
يقدم الإطار المعروض هنا عدة مزايا مقارنة بالنماذج الحالية. أولا، يقيم بشكل صريح التفاعلات بين استراتيجيات المعالجة المسبقة والمحسينات، وهو بعد غالبا ما يغفل في دراسات التعلم الجماعي والنقل 15,16,17. ثانيا، يحافظ على بنية CNN ثابتة، مما يحاكي قيود النشر في العالم الحقيقي حيث يكون إعادة التكوين عادة غير عملي22. ثالثا، يدمج طرق النسبة البصرية لتقييم الاحتفاظ الدلالي، مكملا للأعمال السابقة على دراسات السمات الإشعاعية والمصممة يدويا23. وأخيرا، يقدم الإطار رؤى قابلة للتكرار حول استراتيجيات التدريب الواعية للمعالجة المسبقة، مما يعزز كل من المتانة وقابلية التفسير.
من خلال تلخيص رؤى من طرق المعالجة المسبقة 3,4,5، ودراسات المحسن16,17، وأدوات التفسير19,20، يقدم هذا العمل خط عمل عملي وقابل للتفسير لتصنيف أورام الدماغ يوازن بين الدقة والاستقرار والأهمية السريرية.
Access restricted. Please log in or start a trial to view this content.
يوضح الشكل 1 نظرة عامة على سير عمل البروتوكول. تفحص هذه الدراسة تأثير المعالجة المسبقة للصور الكلاسيكية على أداء شبكات CNN وسلوك المحسينات في تصنيف أورام الدماغ باستخدام الرنين المغناطيسي. يشمل البروتوكول إعداد مجموعات البيانات، وخطوط معالجة مسبقة ذات مسارين، وبنية النموذج، وتكوين المحسن، وتقييم الأداء، والتحقق من قابلية التفسير. تم تنفيذ جميع التجارب في بايثون 3.10.12 باستخدام نسخة كيراس 2.13.1 مع خلفية TensorFlow، وإصدار OpenCV 4.8.0، وإصدار Matplotlib 3.8.0.
إعداد مجموعة البيانات
تم استخدام مجموعة بيانات الرنين المغناطيسي لأورام الدماغ BR35H من كاجل21، والتي تتكون من 3000 صورة مقسمة بالتساوي إلى فئتين موجودة في الورم ("نعم") وغياب الورم ("لا"), في هذه الدراسة. تم تغيير حجم جميع الصور إلى 128 × 128 بكسل باستخدام وظيفة cv2.resize من OpenCV لتوحيد أبعاد الإدخال عبر التجارب. ضمان الأخذ الطبقي باستخدام train_test_split Scikit-learn تمثيلا متوازنا عبر مجموعة التدريب (80٪) ومجموعة التحقق (20٪)، مما حافظ على اتساق توزيع الفئات عبر كل طبقة.
بالإضافة إلى مجموعة بيانات BR35H العامة، قمنا بالتحقق من صحة هذا البروتوكول باستخدام مجموعة بيانات مستقلة جمعت من مجموعة بيانات Ultralytics Brain Tumor (https://docs.ultralytics.com/datasets/detect/brain-tumor/). تتكون هذه المجموعة من مجموعة تدريب صالحة مكونة من 878 صورة ومجموعة اختبار مكونة من 223 صورة، مع فئتين محددتين بوضوح: السلبية (صور بدون أورام دماغية) والإيجابية (صور تحتوي على أورام دماغية). سمح لنا تضمين هذه المجموعة المستقلة بتقييم قابلية التعميم والمتانة للإطار بما يتجاوز البيانات المصدرية الأصلية.
خطوط المعالجة المسبقة
تم تنفيذ خطي معالجة مسبقة مميزين لتقييم تأثير المعالجة المسبقة للصور الكلاسيكية. كان خط أنابيب المعالجة المسبقة الأساسي (BP) ببساطة يعيد حجم الصور إلى 128 × 128 بكسل دون أي تحويلات إضافية، مما يحافظ على كثافة البكسل الخام والميزات الهيكلية كشرط تحكم. طبق خط أنابيب المعالجة المسبقة التقليدية (TP) سلسلة من خطوات معالجة الصور الكلاسيكية باستخدام وظائف OpenCV: تحويل التدرج الرمادي (cv2.cvtColor) لتقليل أبعاد القناة، والتمويه الغاوسي (cv2). GaussianBlur) لقمع الضوضاء وتعزيز التباين24، والعتبة (cv2.threshold) لتقسيم البنى عالية الشدة25، والعمليات الشكلية (cv2.erode, cv2.dilate) لتحسين الحواف وتقليل التشويشات الأثرية26، وكشف الكونتور (cv2.findContours) لتحديد المناطق ذات الاهتمام. عزز هذا الأنبوب التباين وقلل من الفوضى البصرية، رغم أنه كان يخاطر بقمع النسيج التشخيصي المناسب.
بنية النماذج
تم تنفيذ شبكة CNN مخصصة والحفاظ عليها ثابتة عبر جميع التجارب لعزل تأثيرات المعالجة المسبقة واختيار المحسن. تكونت البنية من طبقة إدخال (128 × 128 × 1)، وثلاث طبقات التفافية (الأولى تحتوي على 32 مرشحا والثانية ب 64 مرشحا، جميعها تستخدم نواتين × 2 وتفعيل وحدة خطية مصحمة (ReLU)، تليها كل منها 2 × 2 تجمع كحد أقصى. تم تسطيح المخرج وتمريره عبر طبقة كثيفة مكونة من 128 وحدة مع تفعيل ReLU، تليها طبقة انقطاع (معدل = 0.5)، وأخيرا وحدة سيجمويد واحدة لتصنيف الثنائي. يحقق هذا التصميم توازنا بين قابلية التفسير والكفاءة الحاسوبية، مما يجعله مناسبا للأجهزة السريرية ذات الموارد المحدودة.
تكوين المحسن
تم تقييم ثلاثة محسينات بمعايير فائقة ثابتة: آدم (معدل التعلم = 0.001، β1 = 0.9، β2 = 0.999، إبسيلون = 1e−07)، RMSProp (معدل التعلم = 0.001، rho = 0.9، إبسيلون = 1e−07)، وSGD (معدل التعلم = 0.005، الزخم = 0.9، معطل نيستيروف). تم الحفاظ على معايير التدريب ثابتة عبر التجارب، مع حجم دفعة 32، 50 عصرا، وإيقاف مبكر (الصبر = 10) تم تنفيذه عبر استدعاءات كيراس لمنع الإفراط في التركيب.
تقييم الأداء
تم تقييم الأداء باستخدام الدقة والدقة والاسترجاع ودرجة F1، المحسوبة باستخدام classification_report Scikit-learn. تم رسم منحنيات فقدان التدريب والتحقق باستخدام Matplotlib لتقييم سرعة التقارب واكتشاف الإفراط في التوافق. تم جدولة النتائج وتصويرها لمقارنة حساسية المحسن تحت ظروف معالجة مسبقة مختلفة.
التحقق من صحة التفسير
تم التحقق من قابلية التفسير باستخدام تصورات Grad-CAM التي تم توليدها من الطبقة الالتفافية النهائية. تم إنشاء خرائط الحرارة باستخدام دوال Keras وTensorFlow ثم تم تراكبها على صور الرنين المغناطيسي الأصلية باستخدام Matplotlib. ضمنت هذه الخطوة أن يتماشى انتباه CNN المكاني مع المناطق الورمية ذات الصلة سريريا، مما دعم الشفافية والثقة التشخيصية.
Access restricted. Please log in or start a trial to view this content.
محسن آدم - المعالجة المسبقة الأساسية:
يوضح الشكل 2 أداء نموذج تصنيف أورام الدماغ باستخدام محسن آدم مع معالجة مسبقة على الأساس (Baseline). تظهر مصفوفة الالتباس فصلا شبه مثالي بين الحالات الورمية وغير الورمية، مع 8 تصنيفات خاطئة فقط من أصل 600 عينة. يؤكد تقرير التصنيف المرافق ذلك بدقة، واستدعاء، ودرجات F1 جميعها عند 0.98 أو أعلى لكلا الفئتين.
محسن آدم مع المعالجة المسبقة التقليدية:
يوضح
Access restricted. Please log in or start a trial to view this content.
كان نجاح تصنيف أورام الدماغ المعتمد على CNN في هذه الدراسة مدفوعا بشكل أساسي بمكونين بروتوكولي: تصميم المعالجة المسبقة واختيار المحسن. حافظت المعالجة المسبقة الأساسية — التي تتكون فقط من تغيير حجم الصورة — على كثافة البكسلات الأصلية والبنية المكانية، مما مكن النموذج من تعلم الميزات ذات الصلة سريريا. على النقيض من ذلك، أدخلت طرق المعالجة المسبقة التقليدية (مثل تحويل التدرج الرمادي، والضباب الغاوسي، وتحديد العتبة، والعمليات الشكلية الشكلية) تجريد الميزات، الذي غالبا ما كان يقمع الإشارات ال...
Access restricted. Please log in or start a trial to view this content.
المؤلفون ليس لديهم ما يكشفون عنه.
يعبر المؤلفون عن تقديرهم وشكرهم العميق لجامعة GITAM وفريق القيادة والعميد ورئيس قسم علوم وهندسة الحاسوب في حرم فيساكاباتنام، على دعمهم المستمر وتشجيعهم للبحث والتطوير.
Access restricted. Please log in or start a trial to view this content.
| Name | Company | Catalog Number | Comments |
|---|---|---|---|
| غلاف API | كيراس | 2.13.1 (RRID:SCR_016345) | واجهة برمجة تطبيقات عالية المستوى لبنية وتدريب CNN |
| أداة النسبة | تنفيذ GRAD-CAM | المخصص (عبر كيراس) | التفسير البصري لانتباه CNN |
| مجموعة بيانات تصوير بالرنين المغناطيسي لأورام الدماغ BR35H | كاجل | https://www.kaggle.com/ahmedhamada0/brain-tumor-detection | مصدر صور الرنين المغناطيسي الموسومة للتصنيف |
| مجموعة بيانات أورام الدماغ | التحليل الفائق | https://docs.ultralytics.com/datasets/detect/brain-tumor/ | |
| مكتبة التعلم العميق | تنسور فلو | 2.15.0 (RRID:SCR_018345) | الواجهة الخلفية لتنفيذ نموذج CNN |
| معالجة الصور | OpenCV | 4.8.0 (RRID:SCR_015526) | المعالجة المسبقة: الرمادي، الضباب، العتبة، الشكل |
| لغة البرمجة | بايثون | 3.10.12 (RRID:SCR_008394) | بيئة التنفيذ لجميع التجارب |
| التصور | ماتبلوتليب | 3.8.0 (RRID:SCR_008624) | رسم منحنيات الفقدان وطبقات التدرجات التكميلية |
Access restricted. Please log in or start a trial to view this content.
Request permission to reuse the text or figures of this JoVE article
Request Permission