تقدم هذه الدراسة إطار عمل لتوأم رقمي مدرك للتحكم من أجل مراقبة وتحسين أنظمة النفط والغاز باستخدام تعلم الآلة والنماذج المستنيرة بالفيزياء، وقد تم تقييمه بناءً على مجموعات بيانات محاكاة ومرجعية.
مقالة بحثية
تقدم هذه الدراسة إطار عمل لتوأم رقمي مدرك للتحكم من أجل مراقبة وتحسين أنظمة النفط والغاز باستخدام تعلم الآلة والنماذج المستنيرة بالفيزياء، وقد تم تقييمه بناءً على مجموعات بيانات محاكاة ومرجعية.
تُقترح في هذه الورقة إطارات عمل للتوأم الرقمي المدرك للتحكم من أجل تتبع وتحسين أنظمة إنتاج النفط والغاز. تدمج هذه الطريقة بين الشبكات العصبية الرسومية المكانية الزمانية، واستيعاب البيانات بنظام neural 4D-Var، والتحكم القائم على التعلم المعزز، والمؤثرات العصبية المستنيرة بالفيزياء (FNO ونموذج Neural operator). وقد استُخدمت مجموعات بيانات لأنظمة سيبرانية فيزيائية مرجعية (SWaT و WADI) ومجموعة بيانات محاكاة للنفط والغاز لتقييم إطار العمل. تُظهر النتائج، التي تم تأكيدها من خلال عدة تشغيلات مستقلة باستخدام مقاييس متوسطة، أداءً مُحسناً في تقدير الحالة، وكشف الشذوذ، وتحسين التحكم. ومع ذلك، يقتصر التقييم على مجموعات البيانات المرجعية والمحاكاة؛ مما يتطلب مزيداً من التحقق باستخدام بيانات صناعية فعلية للتأكد من إمكانية التطبيق العملي.
زادت الحاجة إلى شبكات نقل آمنة وفعالة للنفط والغاز نتيجة تزايد الطلب العالمي على الطاقة. ومع ذلك، فإن الحفاظ على موثوقية خطوط الأنابيب يواجه عوائق شديدة بسبب تدهور البنية التحتية وتزايد تعقيد الأنظمة. وفي هذا الصدد، جذبت تكنولوجيا التوأم الرقمي (DT) الاهتمام كاستراتيجية لإدارة دورة الحياة قائمة على البيانات، تتيح تقييم المخاطر، والصيانة التنبؤية، وتحسين الأنظمة في البيئات الصناعية1,2,3,4,5. وقد أدى التحول الرقمي في الأنظمة الصناعية، بانتقاله من الصيانة التفاعلية إلى اتخاذ القرارات الذكية القائمة على البيانات، إلى تعزيز الكشف عن الشذوذ والتنبؤ بالأعطال وموثوقية النظام6,7,8. وكانت تطبيقات التوأم الرقمي في تحسين العمليات، والصيانة التنبؤية، والتصنيع الذكي موضوعاً للعديد من الأبحاث؛ فعلى سبيل المثال، اقتُرحت نماذج قائمة على التوأم الرقمي للتحليل التنبؤي للأعطال10 وتقييم الأداء البيئي11، وتحسين الإنتاج القائم على التعلم العميق. كما استُخدمت التوائم الرقمية في صناعة النفط والغاز لتحسين المراقبة وتحديد الشذوذ من خلال نمذجة النظام، وتقييم الأداء، وتكامل بيانات المستشعرات المتعددة12,13,14,15.
على الرغم من هذه التطورات، تركز غالبية تقنيات التوأم الرقمي (DT) الحالية على ميزات منفصلة مثل المراقبة أو النمذجة أو الكشف عن الشذوذ، مع تكامل محدود للمزامنة والتحكم في الوقت الفعلي. تفتقر العديد من الأنظمة إلى التفاعل ثنائي الاتجاه وقدرات التعلم التكيفي، حيث تعمل كظلال رقمية ذات تدفق بيانات أحادي الاتجاه. ويكتسب هذا القصور أهمية خاصة في أنظمة النفط والغاز، حيث تتطلب الظروف الديناميكية وأنماط الأعطال المعقدة تعلماً وتحكماً مستمرين. علاوة على ذلك، فإن تقنيات الأنظمة السيبرانية الفيزيائية الحالية، والتي تقتصر في الغالب على التحليل غير المتصل بالإنترنت16، لا تدعم التحكم في الحلقة المغلقة في الوقت الفعلي في العمليات الصناعية المعقدة. وبالإضافة إلى ذلك، تعتمد النهج الحالية في وصف تفاعلات المستشعرات الموزعة بشكل أساسي على تقنيات التعلم الآلي والترشيح التقليدية، مع استخدام ضئيل للنماذج المتقدمة مثل الشبكات العصبية الرسومية المكانية والزمانية. كما يوجد نقص في الأبحاث المتعلقة باستخدام تقنيات تعلم المشغل (operator learning) لالتقاط الديناميكيات الفيزيائية غير الخطية، لا سيما في أنظمة إنتاج النفط والغاز17. ونتيجة لذلك، تعجز أنظمة التوأم الرقمي الموجودة عن دمج استيعاب البيانات في الوقت الفعلي والتحكم التكيفي أثناء نمذجة الارتباطات المكانية والزمانية المعقدة.
نظراً لأنها تحاكي إعدادات التحكم الصناعية، تُستخدم مجموعات البيانات المرجعية مثل SWaT وWADI بشكل متكرر للتحقق من صحة التقنيات القائمة على التوأمة الرقمية (DT) في الأنظمة السيبرانية الفيزيائية18. بالإضافة إلى ذلك، توفر التوائم الرقمية فوائد أكثر عمومية، مثل زيادة الإنتاجية، وتبادل أفضل للمعرفة، ونقل آمن للبيانات طوال العمليات الصناعية19,20. ويتم الاعتراف بشكل متزايد بإمكانياتها في إدارة السلامة، والمراقبة في الوقت الفعلي، والأتمتة الصناعية، لا سيما في الصناعات عالية المخاطر مثل النفط والغاز21,22,23. ومع ذلك، لا تزال هناك حاجة إلى حلول أكثر اكتمالاً وتكاملاً تدمج قدرات النمذجة والمراقبة والتحكم من أجل النشر العملي. وقد أرست دراسات التقييم، مثل تلك المذكورة في24,25، الأساس من خلال توضيح استخدامات وفوائد التوائم الرقمية في تحسين كفاءة العمليات وطريقة اتخاذ القرارات. يوضح الجدول 1 مقارنة بين الطرق الحالية المتعلقة بتصنيع النفط والغاز وإدارة التحكم26,27,28,29. ونظراً للمخاطر التشغيلية العالية والديناميكيات المعقدة لأنظمة إنتاج النفط والغاز، غالباً ما تكون طرق الصيانة التقليدية غير كافية لتحديد الشذوذ والاستجابة له بشكل سريع30,31,32,33. وعلى الرغم من تحسن إدارة السلامة والمراقبة عن بُعد في الآونة الأخيرة، لا تزال هناك حاجة إلى أنظمة ذكية يمكنها الاستشعار والتعلم والتحكم بشكل مستمر في الوقت الفعلي.
تقترح هذه الورقة بنية توأم رقمي مدركة للتحكم تجمع بين الشبكات العصبية الرسومية المكانية والزمانية، وتمثيل البيانات Neural 4D-Var، والمؤثرات العصبية المستنيرة بالفيزياء، والتحكم القائم على التعلم التعزيزي للتغلب على هذه الصعوبات. يؤسس النظام المقترح مسار عمل موحد لجمع البيانات، وتقدير الحالة، وكشف الشذوذ، وتحسين التحكم. وبينما تقوم الشبكات العصبية الرسومية المكانية والزمانية بتسجيل التفاعلات بين المستشعرات الموزعة، تُستخدم المؤثرات العصبية المستنيرة بالفيزياء، مثل Fourier Neural Operator وDeep Operator Network (Neural operator model)، لتمثيل ديناميكيات النظام غير الخطية والمعقدة. ويتيح التعلم التعزيزي تحكماً تكيفياً مغلق الحلقة، بينما يعمل تمثيل البيانات العصبي على تحسين دقة تقدير الحالة. وقد تم إثبات قابلية تعميم الطريقة المقترحة عبر البيئات الصناعية من خلال تقييمها باستخدام مجموعات بيانات أنظمة سيبرانية فيزيائية مرجعية (SWaT وWADI) وبيانات محاكاة للنفط والغاز. يتغلب هذا العمل على أوجه القصور الرئيسية في أنظمة التوأم الرقمي الحالية ويقدم حلاً قابلاً للتوسع والتكيف للمراقبة والتحسين في الوقت الفعلي في أنظمة إنتاج النفط والغاز من خلال دمج النمذجة والتعلم والتحكم في إطار عمل موحد.
لا تتضمن هذه الدراسة أي مشاركين من البشر أو حيوانات تجارب. إن مجموعات البيانات المستخدمة (SWaT و WADI) هي مجموعات بيانات مرجعية متاحة للعموم، ولا تتضمن أي بيانات حساسة أو شخصية.
يؤسس النهج المقترح توأماً رقمياً واعياً بالتحكم، مما يتيح دمج خوارزميات التعلم العميق المتطورة، واستيعاب البيانات، والتقييم والتحسين المستمر لأنظمة واستراتيجيات التحكم في استخراج النفط والغاز. أولاً، يتم جمع بيانات المستشعرات متعددة الأنماط في الوقت الفعلي من البنية التحتية للإنتاج الموزعة جغرافياً، ونمذجتها باستخدام هيكل رسومي (graph structure) يحدد الاتصال والتفاعلات بين مكونات الإنتاج. بعد ذلك، يتم الاستفادة من المؤثرات العصبية المستنيرة بالفيزياء (physics-informed neural operators) لبناء تقريبات على مستوى المؤثر للمعادلات الحاكمة للتدفق غير الخطي متعدد الأطوار، مما يسهل إجراء محاكاة قابلة للتوسع ضمن التوأم الرقمي. وقد استُخدم مصطلح "Neural operator model" في هذا البحث للإشارة إلى شبكة المؤثرات العميقة (Deep Operator Network). ومن أجل دمج التبعيات المكانية والزمانية بين أصول الإنتاج الموزعة جغرافياً، يتم تدريب شبكات عصبية رسومية زمانية-مكانية ضمن التمثيلات المستنيرة بالفيزياء. ويُطبق نهج قابل للتفاضل لاستيعاب البيانات يعتمد على neural 4DVAR للحفاظ على اتساق وتزامن تنبؤات محاكاة التوأم الرقمي مع بيانات المراقبة في الوقت الفعلي، حتى في ظل وجود قياسات مشوشة وغير منتظمة مكانياً. وفوق التوأم الرقمي المتزامن في الوقت الفعلي، يتم تدريب أداة تحسين مدفوعة بالتعلم التعزيزي لاستخدامها في التحكم اللحظي. وأخيراً، يظل التوأم الرقمي مجهزاً للتحديث المستمر للنماذج وتكييف القابلية للتوسع على مدى فترة زمنية طويلة بناءً على التحديثات المستمرة من القياسات الجديدة المتاحة.
تعزز بنية التوأم الرقمي المقترحة بنية التوأم الرقمي التقليدية من خلال إضافة الذكاء والقابلية للتكيف والوعي بالتحكم إليها. يتكون المسار الكامل من أربع وحدات: (1) الحصول على البيانات/بناء المخطط، (2) تقدير الحالة عن طريق المشغلات العصبية وST-GNN، (3) اكتشاف الشذوذ عن طريق التحليل القائم على المتبقيات، و(4) التحكم القائم على التعلم التعزيزي.

الشكل 1: بنية التوأم الرقمي الشاملة المدركة للتحكم. يدمج نموذج التوأم الرقمي المدرك للتحكم المقترح كلاً من اكتشاف الشذوذ، والشبكات العصبية الرسومية المكانية الزمانية، والمزامنة العصبية 4D-Var، والمؤثرات العصبية المستنيرة بالفيزياء، والتحكم في الحلقة المغلقة القائم على التعلم التعزيزي لأنظمة إنتاج النفط والغاز. يرجى النقر هنا لعرض نسخة أكبر من هذا الشكل.
الشكل 1 يمثل العملية الوظيفية لتوأم رقمي مدرك للتحكم في إنتاج النفط والغاز كنظام سيبراني-فيزيائي مغلق الحلقة. تبدأ العملية الوظيفية على مستوى نظام إنتاج النفط والغاز، حيث تقوم مستشعرات مختلفة موزعة على الآبار وخطوط الأنابيب والصمامات ووحدات المعالجة بالتقاط بيانات عن الضغط ومعدل التدفق ودرجة الحرارة وعناصر التحكم في لحظة زمنية معينة. تلتقط المستشعرات المختلفة البيانات بتنسيقات متنوعة، ثم تُرسل هذه البيانات إلى التوأم الرقمي، وهو ما يشكل أساس الوعي التنظيمي في تلك اللحظة.
تتضمن المنهجية المقترحة الخطوات التالية:
جمع البيانات
يتم الحصول على معلومات في الوقت الفعلي من أجهزة الاستشعار المتعلقة بالضغط، ومعدل التدفق، ودرجة الحرارة، ومدخلات التحكم من بيئات إنتاج النفط والغاز. كما تُستخدم مجموعات بيانات مرجعية أخرى متاحة مثل SWAT وWADI لضمان قدرات المتانة والتعميم. ولضمان إمكانية إعادة التكرار، تم تحديد كل خطوة من المنهجية المقترحة باستخدام تفاصيل تقنية.
[يرجى الرجوع إلى الملف التكميلي (S1) للاطلاع على توليد مجموعة البيانات والمحاكاة.]
تُستخدم مجموعتا بيانات مرجعيتان عامتان لأنظمة التحكم الصناعية من المجال البحثي لأنظمة التحكم الصناعية لإثبات قدرة التوأم الرقمي المفاهيمي فيما يتعلق بالبيانات السلاسل الزمنية المعقدة وعالية الأبعاد، وكذلك الأحداث غير العادية، وهما: مجموعة بيانات معالجة المياه الآمنة (SWaT)، ومجموعة بيانات توزيع المياه (WADI) المرجعية34. وقد اشتُقت كلتا المجموعتين من منصات اختبار سيبرانية فيزيائية واقعية، وتتضمنان بيانات تشغيل متعددة المتغيرات للمستشعرات والمشغلات لكل من السيناريوهات الطبيعية وسيناريوهات الشذوذ/الهجوم التي تم تحفيزها في هذه الأنظمة. ومن خلال استخدام مجموعتي بيانات SWaT وWADI، يمكن إجراء اختبارات عابرة للمجالات وإثبات إمكانية التعميم بما يتجاوز منصات الاختبار السيبرانية الفيزيائية ليشمل أنظمة صناعية موزعة أوسع ذات تبعيات مرتبطة بالموقع والزمن. ويظهر وصف مجموعة البيانات في الجدول 2.
يستخدم البحث المقترح ثلاث مجموعات بيانات مختلفة للتقييم الشامل لمنهجية التوأم الرقمي المطورة والموضحة في الجدول 2. تتكون مجموعة البيانات الأساسية من بيانات محاكات تتعلق بالتنظيم الإنتاجي في تصنيع النفط والغاز، وتهدف إلى إعادة إنتاج قياسات تشغيلية حقيقية يتم استشعارها بواسطة النظام، بالإضافة إلى ظروف التحكم و/أو ظروف الأعطال. علاوة على ذلك، تم تقديم مجموعة بيانات معالجة المياه الآمنة (SWaT) كمثال لنظام مادي مصغر، حيث تضم قياسات من 51 مستشعراً ومحركاً على مدار حوالي 11 يوماً، بما في ذلك الشذوذات والهجمات الطبيعية والمصطنعة. وتعتبر مجموعة البيانات هذه على نطاق واسع كمعيار قياسي للبحث. أما المجموعة الأخرى فهي مجموعة بيانات توزيع المياه (WADI)، التي ترصد قياساتها سلوك نظام توزيع مياه مصغر يضم حوالي 123 متغيراً على مدار 16 يوماً، بما في ذلك هجمات مختلفة وظروف تشغيل طبيعية. تحتوي مجموعة البيانات هذه على ما مجموعه 15 هجوماً مختلفاً. وتتمحور مجموعتا البيانات المذكورتان أعلاه بشكل أساسي حول السلاسل عالية الأبعاد بمرور الوقت والعلاقات المكانية كما هو الحال في أنظمة التحكم الصناعية.
المعالجة المسبقة للبيانات
قبل تدريب النموذج، تخضع جميع مجموعات البيانات لإجراء معالجة مسبقة شاملة لضمان جودة البيانات واتساقها وقابليتها للتكرار. وتشمل إجراءات المعالجة المسبقة إدارة القيم المفقودة، وتصفية الضوضاء، والتطبيع، وتغيير مقياس الميزات. تم وصف مسار المعالجة المسبقة المفصل في الملف التكميلي (S2).
بناء مخطط النظام
في المنهجية المقترحة، يتم تمثيل نظام الإنتاج المادي للنفط والغاز في شكل مخطط بياني (Graph)، والذي يعمل كبنية رياضية لوصف الارتباطات المكانية بين الأصول، جنباً إلى جنب مع ديناميكيات حالة النظام بمرور الوقت (يرجى الرجوع إلى الـ الملف التكميلي (S3) لصياغات بناء مخطط النظام.
تعلم الفيزياء باستخدام المؤثرات العصبية
من أجل التمثيل الصحيح للخصائص غير الخطية ومتعددة الأبعاد لأنظمة التدفق متعدد الأطوار، يستخدم النهج المقترح مؤثرات قائمة على الفيزياء في شكل مؤثرات فوريه العصبية (FNO) ونموذج المؤثر العصبي. وعلى عكس الطريقة التقليدية في تمثيل الشبكات العصبية كتعيينات نقطية، يسمح مفهوم المؤثرات بالتعميم فيما يتعلق بظروف حدودية مختلفة. تجعل هذه الميزة هذه الطريقة أكثر ملاءمة لأنظمة التدفق متعدد الأطوار المستخدمة في إنتاج النفط والغاز بما أن الظواهر الفيزيائية تحدث بشكل مستمر. يرجى الرجوع إلى الملف التكميلي (S4) للاطلاع على المعادلات الرياضية للمؤثرات العصبية.
للمزيد من التقييم لصلاحية المشغلات العصبية المستنيرة بالفيزياء، أُجريت تجارب إضافية لتقييم قدرتها على تقريب تعيينات المشغل غير الخطية في ظل حالات تدفق ومدخلات تحكم مختلفة. وتظهر النتائج أن هذه المشغلات يمكنها تقريب تعيين المشغل غير الخطي بدقة، مما يؤكد قدرة المشغلات على نمذجة ديناميكيات النظام بدقة، خاصة في حالات الأبعاد العالية، وبتكلفة حوسبية أقل من الحلّالات الأخرى. كما تم إجراء تقييم كمي لدقة تعلم المشغل باستخدام متوسط مربع الخطأ بين حالات النظام المتوقعة والمحاكاة، مما أظهر أداء تقريب متسق عبر ظروف التدفق المختلفة.

الشكل 2: مخطط سير عمل إطار عمل المشغل العصبي المستنير بالفيزياء. يوضح مثال على سير عمل المشغل العصبي المستنير بالفيزياء كيفية استخدام مدخلات التحكم، وبيانات المستشعرات، والشروط الحدية لتعلم ديناميكيات التدفق متعدد الأطوار غير الخطي وإنتاج تنبؤات نظام سريعة على مستوى المشغل. يرجى الضغط هنا لعرض نسخة أكبر من هذا الشكل.
في عملية عمل PINO الموضحة في الشكل 2، تتم عملية تعلم التدفقات متعددة الأطوار غير الخطية والمعقدة فيزيائياً في عمليات النفط والغاز بطريقة مستمرة. تبدأ هذه العملية عند طبقة الإدخال حيث يتلقى النموذج بيانات غير متجانسة حول النظام الذي يتطور فيزيائياً. يتخذ هذا الإدخال شكل شروط حدية، تتراوح بين الضغط ودرجة الحرارة والسرعة، بالإضافة إلى بيانات فورية من مستشعرات موزعة داخل نظام النفط والغاز، وكذلك متغيرات التحكم مثل فتح الصمامات، أو سرعة المضخات، أو فتح الخوانق. تحدد كل هذه المدخلات آلية تشغيل النظام الذي يتطور فيزيائياً.
المكون الرئيسي ضمن سير العمل هو PINO، والذي يتم تحقيقه من خلال FNO ونموذج المشغل العصبي (Neural operator model). تختلف الطريقة المقترحة وتتميز في كونها تستخدم المشغلات العصبية لتعلم المشغلات بين فضاءات الدوال، على عكس الشبكات العصبية التقليدية التي تميل إلى التركيز على التعيين النقطي بين المدخلات والمخرجات. وعلى هذا المستوى، يستطيع FNO التقاط العلاقات المكانية العالمية باستخدام نطاق فوريه (Fourier domain)، بينما يستطيع نموذج المشغل العصبي تعلم تمثيلات المشغل باستخدام كل من شبكات الفرع والجذع (branch and trunk networks). ويتم توجيه النموذج المتعلم بواسطة قيود فيزيائية لضمان أن الديناميكيات المتوقعة تسلك السلوك المتوقع في التدفق متعدد الأطوار. وتأخذ مخرجات المشغل العصبي شكل حل المجال المستمر للمتغيرات الفيزيائية الهامة مثل الضغط، ومعدلات التدفق، وتوزيع الأطوار لشبكة الإنتاج بأكملها. علاوة على ذلك، تكون قيم المخرجات دقيقة للمجال بأكمله، بما في ذلك الآبار وخطوط الأنابيب والوحدات المتصلة الأخرى، بدلاً من قياسها في نقاط محددة مثل المستشعرات. وبهذه الطريقة، توفر مخرجات المشغل العصبي القدرة على إنتاج محاكاة دقيقة للغاية وبسرعة عالية يمكنها تقريب حل المعادلات التفاضلية الجزئية دون الحاجة بالضرورة إلى حلها. ويعمل هذا الحل بمثابة الحل السريع في التوأم الرقمي.
تعتمد عملية تعلم المشغل العصبي على ميزات على مستوى الدالة ومستوى النظام، وهي مستخرجات من عمليات إنتاج النفط والغاز. تتكون هذه الميزات بشكل أساسي من متغيرات الحالة الفيزيائية لإنتاج النفط والغاز، وهي حقول مستمرة تشمل درجة الحرارة، ومعدل التدفق، والضغط، والكسور الطورية للنفط والغاز والماء. كما تشمل الميزات الشروط الحدّية، والتي تتضمن ضغوط المداخل، ومعدلات التدفق، ومواقع الصمامات. ويؤخذ في الاعتبار أيضاً مدخلات التحكم، التي تشمل مواقع صمامات الخنق وسرعة المضخة، للتنبؤ بالاستجابات في ظل سيناريوهات تشغيلية مختلفة. يستقبل نموذج المشغل العصبي الميزات الفيزيائية ومعلمات التحكم، والتي يتم معالجتها بواسطة شبكات الجذع والفرع. توفر هذه الميزات معلومات كافية للمشغلات العصبية للتنبؤ بعلاقات تشغيلية دقيقة تعتمد على كل من العمليات الفيزيائية والعوامل التشغيلية لإجراء عمليات محاكاة سريعة للتوأم الرقمي.
المؤثر العصبي لفورييه (FNO)
في هذا البحث، يُستخدم مُشغل فورييه العصبي (FNO)36 لتقدير تعيينات المُشغل التي تصف ديناميكيات التدفق متعدد الأطوار غير الخطي لأنظمة إنتاج النفط والغاز بشكل فعال. وعلى عكس الشبكات العصبية التقليدية، التي تقرب تعيينات المدخلات والمخرجات لمجموعة محددة من النقاط، فإن FNO المقترح يقرب التعيينات بين فضاءات الدوال، مما يتيح التعميم عبر مقاييس وتكوينات مختلفة للنظام. وفي هذه الحالة، يعمل FNO عن طريق نقل تمثيلات حالة النظام من الفضاء الأصلي إلى نطاق فورييه، حيث يمكن تطبيق الالتفافات الطيفية بفعالية بغرض التقاط الاعتمادات المكانية العالمية الموجودة داخل الأنظمة. وفي هذه الحالة، يتم إسقاط تمثيل حالة المدخلات في فضاء كامن أعلى أبعادًا، وتُطبق التحويلات والتنشيطات بشكل تكراري باستخدام تحويلات فورييه، والنوى الطيفية، والتنشيطات. يرجى الرجوع إلى الملف التكميلي (S4.1) للاطلاع على التقييمات الرياضية لمُشغل فورييه العصبي.
نموذج المؤثر العصبي
يعمل نموذج المشغل العصبي37 كنهج بديل ضمن عملية المشغل العصبي لتقريب مشغل فيزيائي غير خطي يحدد ديناميكيات إنتاج النفط والغاز. تم توضيح الوصف التفصيلي لنموذج المشغل العصبي في الملف التكميلي (S4.2) (راجع الملف التكميلي S10 بخصوص الخوارزمية 1: تعلم الفيزياء باستخدام المشغلات العصبية لخوارزمية التوأم الرقمي).
وبناءً على ذلك، يبدأ النهج المقترح لاستخدام المؤثرات العصبية بجمع أمثلة مقترنة من المدخلات والمخرجات، حيث تكون المدخلات عبارة عن أمثلة لظروف النظام في شكل قيم حدودية للنظام، أو متغيرات تحكم، أو خصائص فيزيائية. ويتم تدريب المؤثر العصبي في مرحلة تكرارية تتضمن التنبؤ بالاستجابات لدالة مدخلات، مع تحسين الانحرافات اللاحقة بين التنبؤات والاستجابات الفعلية باستخدام دالة متوسط مربع الخطأ. ويؤدي هذا النهج إلى تحسين قائم على التدرجات، حيث يكتشف المؤثر العصبي مؤثرات فيزيائية نظامية تحدد سلوك النظام. وبذلك، يمكن للنظام المدرب التنبؤ بكفاءة باستجابات النظام لظروف المدخلات المختلفة.
نمذجة الأنظمة المكانية والزمانية
في بنية التوأم الرقمي المقترحة38، تم تمثيل عملية إنتاج النفط والغاز بواسطة رسم بياني مكاني-زماني. وقد تم القيام بذلك لتصور الاتصالية بالإضافة إلى عملية التطور الزمني لموارد الإنتاج الموزعة.
تتميز عملية إنتاج النفط والغاز بطبيعتها بوجود بنية موزعة من حيث الآبار، والبنية التحتية لخطوط الأنابيب، والمستشعرات. ومن أجل التقاط العلاقات المكانية/الزمانية بكفاءة في مثل هذه العملية، يعتمد نهج التوأم الرقمي المطور في هذه الورقة البحثية على الشبكات العصبية الرسومية المكانية-الزمانية (ST-GNN). وفي هذا النهج، يتم تمثيل كيانات النظام في شكل عقد رسومية، بينما يُشار إلى العلاقات المكانية/الوظيفية للنظام بواسطة حواف رسومية. ويتم التعبير عن العلاقات الزمانية من خلال دوال النوافذ الزمنية من أجل التنبؤ بكفاءة بانتقالات حالة النظام والظواهر الشاذة. يرجى الرجوع إلى الملف التكميلي (S5) للحصول على وصف تفصيلي للشبكة العصبية الرسومية المكانية-الزمانية (ST-GNN).
مزامنة التوأم الرقمي باستخدام Neural 4D VAR
يمكن تعريف مزامنة التوأم الرقمي بأنها المزامنة المستمرة للتوأم الافتراضي مع بيئة إنتاج النفط والغاز الفيزيائية المتغيرة باستمرار بناءً على قراءات المستشعرات في الوقت الفعلي. ومن الناحية العملية، تقوم التوائم الرقمية بالتنبؤ بحالات النظام، مثل الضغط ومعدل التدفق ودرجة الحرارة، بناءً على فهم لديناميكيات النظام الفيزيائي. ومع ذلك، وبسبب حالات عدم اليقين وضوضاء المستشعرات، ينشأ تباين حتمي بين التنبؤات والقياسات. ولهذا السبب، ومن أجل مزامنة التنبؤات مع القياسات الفعلية، تم تقديم طريقة أخرى في هذا العمل تُعرف باسم "تمثيل البيانات" (data assimilation) لجعل التنبؤات متسقة ذاتياً مع القياسات الفيزيائية. ولضمان مزامنة العملية الفيزيائية والتوأم الرقمي أثناء ملاحظات المستشعرات المشوشة والمنخفضة الكثافة، تم دمج طريقة تمثيل بيانات neural 4D-Var. يهدف المكون المضاف إلى تقليل الفجوة بين قياسات المستشعرات وتنبؤات النموذج ضمن نافذة تمثيل محددة. ومن خلال الاستفادة من القابلية للتفاضل، توفر طريقة neural 4D-Var تعلماً شاملاً (end-to-end learning) وتسمح بتصحيح حالة التوأم الرقمي عبر الإنترنت (راجع الملف التكميلي (S6) لمعرفة المزيد عن تمثيل بيانات Neural 4D-Var، والملف التكميلي (S10) للخوارزمية 2: مزامنة التوأم الرقمي باستخدام Neural 4D-Var، وراجع الملف التكميلي (S11) للحصول على المعلمات الفائقة وتفاصيل التدريب).
كشف الشذوذ وتشخيصه
في مجموعة بيانات النفط والغاز المحاكاة، تم حقن الشذوذات عن طريق إدخال اضطرابات محكومة مثل انخفاضات الضغط التي تتجاوز 15%، والزيادات غير الطبيعية في التدفق، وأعطال الصمامات. تُحدد نقاط البيانات التي تتجاوز قيمة عتبة محددة أو تنحرف عن توزيع إحصائي مرجعي على أنها شذوذات. وللاطلاع على الصياغة الرياضية لإطار عمل كشف الشذوذ (الملف التكميلي، S7).
التحسين والتحكم بنظام الحلقة المغلقة
في النظام المقترح، يمكن تحقيق التحكم في الحلقة المغلقة من خلال دمج التوأم الرقمي (DT) المتناغم مع وحدة التعلم التعزيزي لتحقيق الأمثلة. وفيما يتعلق بالتوائم الرقمية، يتوقع التوأم الرقمي السلوك المستقبلي لعملية إنتاج النفط والغاز تحت ظروف مختلفة، مثل وضعيات الصمامات المختلفة، أو معدلات الضخ، أو التحكم في التدفق. وهذا يسمح بتطوير منطقة أمان حيث يمكن لوكيل التحكم تقييم نتيجة الإجراءات المطلوبة دون الحاجة إلى تنفيذها مادياً في العملية الواقعية. وهكذا، ومن خلال الاستفادة من التوقعات التي يوفرها التوأم الرقمي، تستطيع وحدة التعلم التعزيزي تحسين أهداف التشغيل، بما في ذلك كفاءة العملية، واستهلاك الطاقة، واستقرار العملية، دون أن تكون مقيدة بقيود العملية. يرجى الرجوع إلى الملف التكميلي (S8) للحصول على الوصف الرياضي لتحسين والتحكم في الحلقة المغلقة.
التعلم والتكيف المستمران
تواجه الأنظمة الصناعية بيئات غير مستقرة تتميز بتقادم المعدات، وظروف تشغيل متغيرة بمرور الوقت، واضطرابات غير متوقعة. ولتصميم نهج للتعامل مع ذلك، يتضمن نموذج التوأم الرقمي المقترح مكوناً للتعلم المستمر يعمل على تحديث المشغلات العصبية، والنماذج الرسومية، والسياسات بناءً على التعلم التزايدي. وعند ملاحظة تغيرات جوهرية وأنماط غير محددة، يتم تسهيل عملية التعلم من خلال دمج بيانات جديدة وتعديل المعاملات المرتبطة بنموذج التوأم الرقمي.
يؤدي التعلم المستمر أيضًا إلى تحسين متانة كل من سياسات التحكم واكتشاف الشذوذ، حيث يساعد النظام على تحديد أنماط سلوكية جديدة أو غير مسبوقة. ويتم تطبيق التغذية الراجعة الناتجة عن حالات الشذوذ في نتائج التحكم لتعديل النماذج وتحسين سياسة التعلم التعزيزي، مما يضمن فعالية عمليات صنع القرار مع استمرار النظام في التغير والتطور. وتحول عملية التعلم التكيفية هذه التوأم الرقمي من مجرد مراقب سلبي إلى نظام ذكي يمكنه دعم عمليات التحسين في الوقت الفعلي لأنظمة إنتاج النفط والغاز المعقدة على مدى فترة زمنية ممتدة، وذلك باستخدام بيئة بنية تحتية تكنولوجية صارمة وفعالة. ويوضح الجدول 3 بنية النموذج والمعلمات الفائقة.
يرجى الرجوع إلى الملف التكميلي (S9) للاطلاع على الصيغة الرياضية لتكيف التعلم المستمر.
تتولى وحدة المعالجة المسبقة للبيانات مسؤولية تحويل بيانات المستشعرات الخام إلى مدخلات منظمة ومعيارية مناسبة لوحدات التعلم اللاحقة. وبشكل أكثر تحديداً، تقوم هذه الوحدة بتجميع قياسات المستشعرات التاريخية، وإزالة الضوضاء، وتوحيد السمات لضمان اتساق جودة البيانات. ثم تُقدم البيانات المعالجة، جنباً إلى جنب مع الشروط الحدية ومدخلات التحكم، كمدخلات لوحدة المؤثر العصبي المستنير بالفيزياء (نموذج FNO/Neural operator)، والذي يعمل على تعلم العلاقات الفيزيائية غير الخطية الكامنة وتوليد تقدير مستمر لحالة النظام. ويتم لاحقاً استخدام حالة النظام المقدرة هذه من قبل وحدة تحسين التحكم لتحديث استراتيجيات التحكم بطريقة ديناميكية. ثم تُمرر مخرجات التحكم المحسنة إلى وحدة اتخاذ القرار، التي تقوم بتفسير النتائج وتوليد قرارات قابلة للتنفيذ لتشغيل النظام. كما تم دمج آلية تغذية راجعة لتحديث النظام باستمرار بناءً على البيانات المرصودة حديثاً، مما يؤدي إلى تحسين القدرة على التكيف والأداء بمرور الوقت. ولتعزيز الوضوح وقابلية التكرار، يتم عرض بنية على مستوى النظام لتوضيح التفاعل بين الوحدات. يتكون النظام المقترح من أربعة مكونات رئيسية، وهي: المعالجة المسبقة للبيانات، ونمذجة المؤثر العصبي المستنير بالفيزياء، وتحسين التحكم، واتخاذ القرار. وترتبط هذه الوحدات عبر واجهات إدخال-إخراج محددة بدقة، مما يضمن تدفقاً سلساً للبيانات، وتعلمًا تكرارياً، وتشغيلاً منسقاً عبر نظام التوأم الرقمي بأكمله.

الشكل 3: مخطط تدفق بنية تحسين التحكم الشامل على مستوى النظام. يوضح المخطط البنية العامة للنظام في العمل المقترح. يرجى النقر هنا لعرض نسخة أكبر من هذا الشكل.
توضح بنية النظام صورة كاملة للنموذج الذي يمكن استخدامه لنمذجة وتحسين الديناميكيات الفيزيائية غير الخطية والمعقدة في أنظمة إنتاج النفط والغاز. يبدأ ذلك ببيانات الإدخال، والتي تتضمن المعلمات المستخدمة في المحاكاة والشروط الحدية المستخدمة لتمثيل البيئة الفيزيائية. تمر هذه البيانات أولاً عبر وحدة المعالجة المسبقة للبيانات، حيث يتم إجراء التسوية واستخراج الميزات. وهذا يجهز البيانات للوحدة التالية، حيث يتم استخدام المؤثر العصبي، FNO، ونموذج المؤثر العصبي. تُستخدم هذه النماذج للتنبؤ بحالات النظام، وتُستخدم هذه المعلومات لتحسين معلمات النظام باستخدام وحدة التحسين. ثم تُستخدم النتائج المُحسَّنة لاتخاذ القرارات باستخدام وحدة صنع القرار، وتساعد هذه الوحدة في تحديد كفاءة النظام. يتضمن إطار العمل أيضاً نتائج المخرجات، حيث تظهر نتائج عملية التحسين في الشكل 3. بالإضافة إلى ذلك، تم إدراج حلقة تغذية راجعة، حيث تمر البيانات عبر وحدة المعالجة المسبقة بعد نتائج المخرجات.
من أجل اختبار مدى صلاحية المشغلات العصبية المستنيرة بالفيزياء، أُجريت اختبارات أداء إضافية لمقارنة أداء كل من مشغل فوريه العصبي (FNO) ونموذج المشغل العصبي في نمذجة ديناميكيات نظام التدفق متعدد الأطوار غير الخطي. وأظهرت النتائج أن FNO يتميز بأداء أفضل من حيث الاتساق المكاني العالمي، بينما يتفوق نموذج المشغل العصبي في القدرة على التكيف مع المدخلات غير المتجانسة.
لضمان التدريب والتقييم الفعال لإطار عمل التوأم الرقمي المقترح، أُجريت جميع التجارب في بيئة حوسبة عالية الأداء. استُخدمت لغة Python كلغة برمجة أساسية للتنفيذ. كما استُخدم إطار عمل شائع للتعلم العميق مع تفعيل تسريع وحدة معالجة الرسومات بواسطة CUDA، ومكتبة محسّنة للشبكات العصبية العميقة لإنشاء نماذج التعلم العميق، مثل المؤثرات العصبية المستنيرة بالفيزياء، والشبكات العصبية الرسومية المكانية والزمانية، ووحدات التعلم التعزيزي. ومن أجل تسهيل معالجة البيانات السلاسل الزمنية متعددة المتغيرات واسعة النطاق وتدريب النماذج، أُجريت الاختبارات على محطة عمل مزودة بوحدة معالجة مركزية متعددة النواة، ووحدة معالجة رسومات (GPU) عالية الأداء ذات ذاكرة مخصصة، وذاكرة نظام لا تقل عن 64 GB. ولضمان التوافق مع منظومة التعلم العميق، تم بناء بيئة نظام التشغيل على توزيعة Linux.
تم استخدام تحسين التدرج على دفعات صغيرة (Mini-batch gradient-based optimization) لتدريب النماذج، وأُجريت العديد من التجارب المستقلة لضمان الموثوقية الإحصائية. ويمكن تكرار المنهجية المقترحة في بيئات حوسبة عالية الأداء مماثلة بفضل إعدادات الحوسبة التي تم توفيرها.
لضمان صحة النتائج من خلال التجارب المتكررة، أُعيد تنفيذ جميع التجارب عبر عدة دورات مستقلة بقيم تهيئة عشوائية مختلفة. وفي حالة التجارب التي استخدمت بيانات محاكاة، تم تشغيل النموذج لـ (N) من التجارب المستقلة، وجرى تسجيل القيم مع متوسط الأداء والانحراف المعياري. أما في حالة التجارب التي استخدمت بيانات القياس المرجعية، SWAT وWADI، فقد تم حساب مقاييس التقييم MAE وRMSE وF1 Score وAUROC على بيانات الاختبار وحساب متوسطها عبر التجارب المتكررة لجعل النتائج قوية إحصائياً. وقد تم القيام بذلك للحصول على تقدير موثوق لأداء النموذج وللتأكد من أن تحسينات الأداء ليست ناتجة عن تجربة واحدة فقط.
ومع ذلك، فقد أثبتت النتائج أن دمج التعلم المستنير بالفيزياء، والنمذجة المكانية الزمانية، وتقنيات استيعاب البيانات في نظام توأم رقمي متكامل يؤدي باستمرار إلى تحسين أداء المراقبة في ظل الظروف التي تم تقييمها، وتسريع التقارب، واتخاذ قرارات مثالية في الوقت الفعلي مقارنة بالطرق التقليدية. يوضح الجدول 4 بيئة المحاكاة للعمل المقترح.
تمت نمذجة بيئة المحاكاة لتمثيل التشغيل في الوقت الفعلي داخل الصناعة بدقة. وتُؤخذ البيانات من المستشعرات على فواصل زمنية قصيرة لتمثيل بيئة تدفق البيانات، مع إضافة كميات محكومة من الضوضاء لاختبار المتانة. كما يتم محاكاة حالات مختلفة من الأعطال والاضطرابات لاختبار قدرات الكشف عن الشذوذ والتحكم. ويُستخدم نهج النافذة المنزلقة للتقييم لتمثيل التشغيل في الوقت الفعلي بطريقة مستمرة مناسبة للتحديثات الديناميكية بواسطة التوأم الرقمي المقترح لإجراء التنبؤات ومزامنة الحالة وإصدار إجراءات التحكم.
في تصميم نموذج التوأم الرقمي المدرك للتحكم، يجب مراعاة عدة معايير تقييم لإجراء تقييم متزامن. أولاً، لتقييم قدرة بنية التوأم الرقمي على المراقبة والتنبؤ بالحالة، تُستخدم معايير الانحدار مثل متوسط الخطأ المطلق (MAE)، وجذر متوسط مربع الخطأ (RMSE)، ومتوسط الخطأ المئوي المطلق (MAPE). يقوم كل من MAE وMAPE بحساب دقة المؤثرات العصبية ونماذج الرسوم البيانية المكانية والزمانية بالنسبة لمعلمات النظام الرئيسية مثل الضغط، ومعدل التدفق، ودرجة الحرارة، وهي معايير صالحة للبيانات متعددة المتغيرات المستمرة المستمدة من المستشعرات المستخدمة في عملية إنتاج النفط والغاز.
ثانيًا، يتم تقييم عملية المزامنة للتوأم الرقمي نفسه، فيما يتعلق بخطأ تقدير الحالة وإزالة انحراف التنبؤ. يقيس خطأ تقدير الحالة درجة الخطأ بين حالة المخطط الفعلية وحالة التوأم الرقمي المتزامنة، وهو مؤشر على مدى فعالية وحدة neural 4D-Var المطورة في استخدام ملاحظات حالة النظام الفعلية لتحسين تنبؤات ديناميكيات النظام. وأخيرًا، يشير تقليل انحراف التنبؤ إلى المكاسب في أداء النهج المقترح مقابل نظام التوأم الرقمي غير المتزامن، وذلك بفضل قدرة هذا النهج على تحمل ملاحظات النظام المشوشة أو الشحيحة.
ثالثاً، عندما يتعلق الأمر بالكشف عن الشذوذ وتشخيص الأعطال، يتم استخدام معاملات تقييم موجهة نحو التصنيف مثل الدقة (Precision)، والاستدعاء (Recall)، ومقياس F1، والمساحة تحت منحنى خصائص تشغيل المستقبِل (AUC). بينما يشير الاستدعاء إلى القدرة على تشخيص الأخطاء الحقيقية بدقة دون إغفال أي منها، يمكن اعتبار الدقة مقياساً لصلاحية الشذوذ الذي تم التعرف عليه. ويمكن قياس الأداء بشكل مناسب باستخدام مقياس F1. تُعتمد معاملات التقييم هذه بشكل عام في نظامي SWAT وWADI.
يُستخدم الجدول 5 لتقييم فعالية وحدة المزامنة العصبية 4D-Var المقترحة في تقليل انزياح التنبؤ بين النماذج الفيزيائية والسيبرانية لثلاث مجموعات من البيانات. يمثل خطأ الحالة الأولي الخطأ بين النماذج بدون مزامنة، بينما يمثل خطأ الحالة النهائي خطأ النموذج بعد تطبيق المزامنة. ويمكن ملاحظة وجود تحسن ملحوظ في خطأ الحالة لجميع مجموعات البيانات الثلاث، حيث حدث أعلى تحسن (72.2%) في نموذج نظام النفط والغاز المحاكى نظراً لبساطته النسبية مقارنة بنموذجي SWAT (63.6%) وWADI (57.7%). وتتسق هذه القراءات مع مستويات التعقيد ومستويات "الضجيج" الخاصة بكل منها. ويمكن تفسير زيادة معدل تقليل الانزياح في مجموعة بيانات النفط والغاز المحاكة بحقيقة أن البيئة المحاكاة تتضمن عموماً مستوى منخفضاً من الضجيج، واضطرابات عشوائية أقل، وسلوك نظام محدد بدقة عند مقارنتها بأنظمة سيبرانية-فيزيائية واقعية أخرى مثل SWAT وWADI. ومع ذلك، يجب التعامل مع هذا الاستنتاج كفرضية وليس كحقيقة مثبتة كمياً بناءً على نتائج هذا العمل. وفي الأعمال المستقبلية، يمكن استخدام مقاييس التعقيد مثل الإنتروبيا، وتباين الضجيج، وأبعاد النظام للتحقق من صحة هذا الطرح.

الشكل 4: مراقبة الأداء عبر مجموعات بيانات مختلفة (النفط والغاز المحاكية، وSWAT، وWADI) التي تم تقييمها باستخدام مقاييس الخطأ MAE وRMSE وMAPE (%). تمثل الأعمدة القيم المتوسطة التي تم الحصول عليها من عدة تشغيلات مستقلة (n = 5). وتشير أشرطة الخطأ إلى الانحراف المعياري (SD)، بينما تمثل أشرطة الخطأ المتراكبة الأكثر نحافة الـ الخطأ المعياري للمتوسط (SEM = SD/√ن). تظهر قيم الانحراف المعياري (SD) والخطأ المعياري للمتوسط (SEM) لكل مقياس بوضوح في مفتاح الشكل. ويتم تقييم الدلالة الإحصائية باستخدام اختبارات t المستقلة بالنسبة لمجموعة البيانات المرجعية (النفط والغاز المحاكى)، و... المقابلة pتظهر قيم p فوق الأعمدة. يرجى النقر هنا لعرض نسخة أكبر من هذا الشكل.
تم تمثيل تحليل أداء عملية المراقبة التي أجراها نموذج التوأم الرقمي المقترح على مجموعات بيانات مثل Simulated Oil and Gas وSWAT وWADI، مع مراعاة معايير التقييم MAE وRMSE وMAPE، في الشكل 4. سجلت مجموعة بيانات Simulated Oil and Gas أدنى مقياس خطأ لجميع المعايير، مما يظهر بوضوح دقة مراقبة حالة النظام في بيئة محاكاة حيث يتم نمذجة معاملات النظام بدقة. وتظهر مجموعتا بيانات SWAT وWADI أخطاءً في مراقبة النظام تتزايد تدريجياً بسبب تعقيدات الأنظمة الحقيقية جنباً إلى جنب مع الضوضاء واللاخطية المتأصلة فيها، والتي لا توجد في الأنظمة المحاكات. ومع ذلك، فإن الارتفاع الطفيف في مقاييس الخطأ MAE وRMSE يؤكد استقرار أداء النظام لنموذج التوأم الرقمي في مثل هذه الظروف.

الشكل 5: أداء الكشف عن الشذوذ عبر مجموعات البيانات (النفط والغاز المحاكات، وSWAT، وWADI) والتي تم تقييمها باستخدام مقياس F1-score وAUC. تمثل الأعمدة القيم المتوسطة التي تم الحصول عليها من تشغيلات مستقلة متعددة (n = 5). تشير أشرطة الخطأ إلى SD، بينما تمثل أشرطة الخطأ المتراكبة والأكثر نحافة SEM = SD/√n. يرجى النقر هنا لعرض نسخة أكبر من هذا الشكل.
يوضح الشكل 5 تحليل التقييم للنظام المقترح لاكتشاف الشذوذ استناداً إلى مقياس F1-score وAUC لمجموعات البيانات الثلاث. حققت مجموعة بيانات النفط والغاز، وهي مجموعة البيانات المحاكية، الأداء الأفضل حيث سجلت أعلى قيمة لـ F1-score وAUC. وعلى الرغم من وجود انخفاض تدريجي في الأداء، إلا أنها حققت أداء AUC مرتفعاً عبر مجموعات البيانات، مع وجود اختلافات طفيفة تعتمد على تعقيد مجموعة البيانات. ويظهر توافق منحنيات F1-score وAUC لمجموعات البيانات الثلاث نقطة توازن مثالية، مما يكشف عن مقايضة جيدة ويجعل النظام المقترح نظاماً موثوقاً للكشف المبكر عن الأعطال والاختراقات. كما يؤدي النظام المقترح أداءً متميزاً في التعرف على الشذوذ لمجموعات البيانات الثلاث.
تظهر قيم الدقة (Precision)، والاسترجاع (Recall)، ومقاييس F1-Scores لنموذج التوأم الرقمي المقترح في اكتشاف الشذوذ عبر مجموعات بيانات مختلفة في الجدول 6 أدناه. وبينما تشير قيم الدقة المرتفعة إلى أن معظم نقاط الاهتمام المحددة هي بالفعل نقاط اهتمام حقيقية، فإن القيم المرتفعة للاسترجاع تشير إلى أن معظم نقاط الاهتمام الفعلية قد تم تحديدها بشكل صحيح دون إغفال النقاط المهمة. وقد سجلت بيئة العرض في مجال النفط والغاز أعلى قيمة لـ F1-score بلغت 0.94، بينما يمكن إرجاع النتائج الأقل قليلاً في SWAT وWADI إلى المستويات الأعلى من الضوضاء والاعتمادات المتبادلة بين المستشعرات وأنماط الهجمات. ومع ذلك، فإن قيم F1-scores المرتفعة تؤكد تحقيق نمذجة ومزامنة قوية للرسوم البيانية المكانية والزمانية للكشف عن الشذوذ.

الشكل 6: منحنيات خصائص تشغيل المستقبل (ROC) للكشف عن الشذوذ عبر مجموعات بيانات Simulated Oil and Gas و SWAT و WADI. يتم تقييم الأداء باستخدام المساحة تحت المنحنى (AUC). يتضمن مفتاح الشكل لكل مجموعة بيانات الانحراف المعياري (SD) والخطأ المعياري للمتوسط (SEM = SD/√n, n = 5) لقيم AUC. يمثل الخط المتقطع القطري أداء التصنيف العشوائي. يرجى النقر هنا لعرض نسخة أكبر من هذا الشكل.
يوضح الشكل 6 منحنيات خصائص تشغيل المستقبل (ROC)، إلى جانب مقاييس AUROC المرتبطة بها لمجموعات البيانات الثلاث المختلفة، لتقييم دقة كشف الشذوذ بشكل مستقل عن اختيار العتبة. في منحنى ROC لمجموعة بيانات النفط والغاز المحاكات، تقترب المنطقة بشكل ملحوظ من نقطة الأصل، مما يحقق قيمة AUROC تبلغ 0.99، وهو ما يؤكد قدرة تصنيف خالية من العيوب تقريباً. وفي حالة مجموعتي بيانات SWAT وWADI، بلغت قيم AUROC نحو 0.97 و0.95 على التوالي، مما يثبت قدرة تصنيف جيدة رغم وجود مستويات أعلى من عدم اليقين. وبما أن منحنيات ROC بعيدة كل البعد عن الخطوط التي تمثل التصنيف العشوائي، فإن ذلك يضمن أن نموذج التوأم الرقمي المطور يعمل بشكل أفضل بكثير من مستوى الصدفة في الكشف الدقيق عن الشذوذ. تظهر منحنيات خصائص تشغيل المستقبل (ROC) في الشكل 6 أداء نموذج التوأم الرقمي المقترح في كشف الشذوذ عبر مجموعات البيانات الثلاث. وبلغت درجات AUROC نحو 0.99 لمجموعة بيانات النفط والغاز المحاكاة، و0.97 لمجموعة بيانات SWAT، و0.95 لمجموعة بيانات WADI، مما يشير إلى قدرة النموذج على التمييز في كل من أنظمة التحكم الصناعية المحاكاة والمرجعية.
يقدم الجدول 7 وصفاً موجزاً للمكافآت التراكمية وانتهاكات القيود لوحدة التعلم التعزيزي المستخدمة في التحكم في الحلقة المغلقة والمتكاملة مع التوأم الرقمي. تمثل المكافأة التراكمية التي تم الحصول عليها الأداء العام للتحكم بناءً على الأهداف التشغيلية، بينما تمثل انتهاكات القيود العدد الإجمالي للانتهاكات أثناء التشغيل. وتعتبر المكافآت التراكمية مع صفر من انتهاكات القيود هي الأعلى (96.5) لبيئة نموذج النفط والغاز الخاصة بنا، مما يؤكد تحقيق التحكم والأداء التشغيلي الأمثل.
على الرغم من أن مجموعتي بيانات SWaT وWADI تُظهران مكافآت تراكمية أقل قليلاً وبعض الانتهاكات للقيود، إلا أن التحسن العام في توفير التكاليف التشغيلية يثبت أن إطار العمل المقترح للتوأم الرقمي يظل فعالاً للتحكم الآمن والأمثل في البيئات الديناميكية.
تم تقييم الجدوى في الوقت الفعلي لنظام التحكم المقترح القائم على التعلم التعزيزي (RL) من خلال تحليل زمن انتقال الاستدلال الشامل لجميع الوحدات الحسابية المستخدمة في النظام المقترح. وتظهر الملاحظات التجريبية في الجدول 8 أن وحدة المؤثر العصبي، نموذج FNO/Neural operator، ووحدة الشبكة العصبية الرسومية المكانية والزمانية (ST-GNN) لديها أعباء حسابية متوسطة بسبب الميزات الزمانية المستخدمة خلال العملية. ومن ناحية أخرى، فإن وحدة اتخاذ قرار سياسة التعلم التعزيزي لديها عبء حسابي خفيف للغاية. ويقع زمن استدلال الاستدلال الشامل التراكمي لجميع الوحدات المستخدمة في النظام المقترح ضمن نطاق دورات التحكم الصناعية النموذجية. وتحديداً، لوحظ أن متوسط زمن انتقال الاستدلال الشامل يتراوح بين 50–150 ميلي ثانية لكل دورة تحكم، وهو ما يتوافق مع متطلبات التحكم الصناعي القياسية. وهذا يوضح أن النظام المقترح يمكن استخدامه في التطبيقات التي تعمل في الوقت الفعلي أو القريبة من الوقت الفعلي. ومع ذلك، تجدر الإشارة إلى أن زمن الاستدلال الشامل قد يختلف بناءً على الأجهزة المستخدمة. وفي هذا الصدد، يمكن استخدام النظام المقترح في تطبيقات الوقت الفعلي.
يتم إجراء مقارنة كمية بين نموذج FNO ونموذج Neural operator والنهج المرجعية، مثل الحلول العددية التقليدية وتقنيات تعلم المؤثرات الحالية، لترسيخ فعالية المؤثرات العصبية المستنيرة بالفيزياء بشكل أكبر. ويركز التقييم الوارد في الجدول 9 على مدى قدرة كل نموذج على التقاط الديناميكيات الديناميكية وغير الخطية للنظام. وتُستخدم مقاييس قياسية تشمل متوسط مربع الخطأ (MSE)، ومتوسط الخطأ المطلق (MAE)، والخطأ النسبي بين حالات النظام المتوقعة والحقيقية لتقييم الأداء. ووفقاً للنتائج التجريبية، يتفوق كل من FNO ونموذج Neural operator على النهج المرجعية في نمذجة الديناميكيات المعقدة متعددة الأطوار من خلال تحقيق قيم خطأ منخفضة. وتحديداً، ينجح نموذج Neural operator في التقاط تعيينات المؤثرات غير الخطية تحت ظروف إدخال مختلفة، بينما يؤدي FNO أداءً جيداً في تعلم الاعتمادات المكانية العالمية.
تظهر فعالية نماذج المشغل العصبي المقترحة من خلال النتائج المقارنة الكمية الموضحة في الجدول 9. وعند مقارنتها بالمحللات العددية المرجعية وتقنيات تعلم المشغلات الحالية، يحقق كل من FNO ونموذج المشغل العصبي مقاييس خطأ أقل بشكل ملحوظ. وبوجه خاص، سجل FNO أدنى خطأ نسبي وأدنى متوسط مربع خطأ، مما يثبت قدرته الفائقة على رصد ديناميكيات الأنظمة غير الخطية المعقدة. بالإضافة إلى ذلك، يظهر نموذج المشغل العصبي مكاسب كبيرة، لا سيما فيما يتعلق بتعلم تخطيطات المشغل غير الخطية في ظل ظروف مختلفة. وقد استُخدمت اختبارات t المستقلة لتقييم الدلالة الإحصائية؛ حيث تشير قيم p التي تقل عن 0.05 إلى تحسن جوهري مقارنة بالمحلل العددي المرجعي. وكانت قيم p التي حصل عليها كلا النموذجين المقترحين أقل من 0.001، مما يشير إلى أن التحسينات الملحوظة في الأداء ذات دلالة إحصائية وليست ناتجة عن الصدفة. علاوة على ذلك، تظهر التقنيات المقترحة أوقات استنتاج أقصر بكثير، مما يثبت قابليتها للتطبيق في تطبيقات التوأم الرقمي في الوقت الفعلي.
لزيادة وضوح التقييم التجريبي لنموذج التوأم الرقمي المقترح الواعي بالتحكم، تم تقديم مقارنة كمية شاملة بين النهج المقترح والطرق الأخرى في شكل جدولي متكامل. ستتيح هذه المقارنة لمختلف معايير الأداء، مثل متوسط الخطأ المطلق (MAE)، وجذر متوسط مربع الخطأ (RMSE)، ومقياس F1-score، والمساحة تحت المنحنى (AUC)، وتقليل انزياح التنبؤ، والمكافأة التراكمية، إجراء تقييم متكامل لدقة المراقبة، والقدرة على اكتشاف الشذوذ، وكفاءة المزامنة، وأداء التحكم للطرق المذكورة في الجدول 10. بالإضافة إلى ذلك، تم ذكر مختلف معايير إجراء التدريب صراحة، مثل حجم الدفعة (batch size)، ومعدل التعلم، وعدد العصور (epochs)، وتكوين التدريب الخاص بكل وحدة، لتعزيز شفافية التقييم التجريبي في الجدول 11. علاوة على ذلك، تم تقييم القابلية للتوسع والكفاءة الحسابية من حيث زمن انتقال الاستدلال، واستخدام وحدة معالجة الرسوميات (GPU)، وجدوى التنفيذ في الوقت الفعلي للنهج المقترح في الجدول 12.
يمكن مقارنة التوأم الرقمي المقترح بشكل شامل مع طرق أخرى مثل طريقة المزامنة القائمة على الفيزياء، ونموذج LSTM ونموذج GNN من حيث دقة المراقبة، وقدرة المزامنة، وكشف الشذوذ، وأداء التحكم، كما هو موضح في الجدول 13. وتعتبر التوائم الرقمية الفيزيائية أقل تكيفاً ولديها هامش خطأ أعلى بناءً على النهج الساكنة. أما النهج العصبية، مثل LSTM وGNN، فهي أفضل ولكنها لا تدمج الفيزياء والمزامنة والتحكم بشكل فعال. وقد حقق التوأم الرقمي المقترح أفضل قيمة بلغت 0.20 في RMSE، و72.2% في تقليل الانجراف، و0.94 في AUROC، و0.92 في F1-Score، و95.5 في المكافأة التراكمية. وتشير النتائج المذكورة أعلاه بوضوح إلى أن الدمج الفعال بين المشغلات العصبية المستنيرة بالفيزياء، والنمذجة الرسومية للمكان والزمان، واستيعاب البيانات العصبي، والتعلم المعزز يمكن أن يحسن بشكل كبير من دقة ومتانة نظام التوأم الرقمي المدرك للتحكم.

الشكل 7: تكلفة التدريب واستهلاك الموارد لمكونات مختلفة من النظام المقترح، بما في ذلك FNO، ونموذج Neural operator، وGNN، ووحدة RL، والإطار العام الكلي. تشمل المقاييس وقت التدريب (ساعات) واستخدام ذاكرة GPU (GB). تمثل القيم متوسط النتائج عبر عدة عمليات تشغيل مستقلة (n = 5). تشير أشرطة الخطأ إلى SD، بينما تمثل أشرطة الخطأ المتداخلة الأقل سمكاً SEM = SD/√n، مما يعكس التباين عبر عمليات التشغيل. يرجى الضغط هنا لعرض نسخة أكبر من هذا الشكل.
في الشكل 7، يتم عرض تكلفة التدريب واستهلاك الموارد للنهج المقترح موزعة حسب مكوناتها الرئيسية. ويمكن ملاحظة أن نماذج المؤثرات العصبية، مثل FNO ونموذج Neural operator، تتطلب تكاليف تدريب واستهلاكاً لذاكرة GPU بشكل ملحوظ مقارنة بالنظام ككل. وتعود تكلفة التدريب العالية إلى قدرة المؤثرات على التعلم عالي الأبعاد. وقد وُجد أن وحدات الشبكة العصبية الرسومية والتعلم التعزيزي لها تكلفة تدريب أقل، إلا أنها ضرورية لتعلم التبعيات المكانية والتحكم التكيفي. ورغم أن النظام المقترح يتسم بتكاليف تدريب أعلى، إلا أن وقت الاستنتاج وُجد أنه فعال. ومقارنة بالطرق المرجعية مثل نماذج LSTM أو GNN المستقلة، يتكبد النظام المقترح تكلفة تدريب أعلى بسبب تكامل الوحدات المتعددة، ولكنه يحقق دقة ومتانة محسنتين، كما هو موضح في الجدول 13.
بشكل عام، يجمع هيكل التوأم الرقمي المقترح عدة عناصر، يعالج كل منها مشكلة متميزة في نمذجة والتحكم في الأنظمة الصناعية المعقدة. وبخلاف الحلول العددية التقليدية، التي غالباً ما تكون مكلفة حاسوبياً وأقل ملاءمة للتطبيقات في الوقت الفعلي، تُستخدم المؤثرات العصبية المستنيرة بالفيزياء، مثل Fourier Neural Operator و Deep Operator Network، لالتقاط ديناميكيات النظام غير الخطية وعالية الأبعاد بشكل أكثر فعالية. ويمكن توظيف نماذج تعلم آلي أبسط، مثل الشبكات العصبية ذات التغذية الأمامية أو الشبكات العصبية المتكررة، إلا أنها عادةً لا تتعلم المؤثرات الفيزيائية الأساسية ولا يمكنها التعميم عبر تكوينات النظام المختلفة. أما الاعتمادات المتبادلة بين المستشعرات الموزعة، والمرتبطة جوهرياً في أنظمة إنتاج النفط والغاز، فيتم نمذجتها باستخدام الشبكة العصبية الرسومية المكانية الزمانية. وقد تؤدي الطرق التقليدية، مثل نماذج السلاسل الزمنية المستقلة أو البنيات المتكررة البسيطة، إلى دقة أقل في تقدير الحالة وكشف الشذوذ لأنها لا تعكس الروابط المكانية بشكل صريح. ويسمح التحكم التكيفي، الذي يستفيد من وحدة التعلم التعزيزي، للنظام بتحقيق أقصى استفادة من الخيارات التشغيلية في البيئات الديناميكية وغير المؤكدة. وفي المقابل، تتسم استراتيجيات التحكم القائمة على القواعد أو التحكم الساكن بالجمود وعدم القدرة على التكيف مع ظروف النظام المتغيرة أو الاضطرابات غير المتوقعة. وبينما توجد بدائل أقل تعقيداً، إلا أنها عادةً ما تتعامل فقط مع أجزاء معينة من المشكلة وغير كافية لتحقيق حل متكامل يجمع بين النمذجة الدقيقة، والمراقبة في الوقت الفعلي، والتحكم التكيفي. ومن خلال ضمان مساهمة كل جزء في الأداء العام للنظام، يعزز التصميم النموذجي المقترح الدقة، وقابلية التوسع، والمتانة في البيئات الصناعية الصعبة.
| دراسة / عمل | التقنيات المستخدمة | النتائج | المحددات |
| المعامل العصبي العميق للتوأم الرقمي26 | المعامل العصبي DeepONet كنموذج بديل | التنبؤ في الوقت الفعلي؛ أسرع بعدة رتب مقدارية من محاكيات الفيزياء | يتطلب وضع المستشعرات دقة وعناية؛ كما تحتاج طرق التقييم إلى تحسين. |
| توأم رقمي مدعوم بالاستشعار الافتراضي باستخدام DeepONet27 | المستشعرات الافتراضية لشبكة DeepONet في التوأم الرقمي | تنبؤات سريعة؛ استدلال في الوقت الفعلي؛ تقدير شامل للحالة | يؤثر الانحياز الطيفي على الظواهر عالية التردد؛ مما يستدعي استخدام النمذجة الهجينة |
| التوأم الرقمي باستخدام التعلم التعزيزي العميق (DRL) والتحكم التنبئي بالنموذج غير الخطي (NMPC) في التحكم28 | التعلم التعزيزي العميق & تكامل التحكم التنبئي بالنماذج غير الخطي (Nonlinear MPC) | تحسين أداء التحكم؛ تقليل خطأ التتبع وتحديثات تكيفية للتوأم الرقمي | يقتصر التطبيق على الأوعية؛ وثمة حاجة لمزيد من التطبيق على أنظمة الإنتاج |
| التوأم الرقمي الموجه بالذكاء الاصطناعي في الأتمتة الصناعية29 | تعلم الآلة الخاضع للإشراف/غير الخاضع للإشراف (LSTM، CNN، RF، إلخ) | دقة عالية في التنبؤ بالأعطال & المراقبة | تعتمد بشكل أساسي على تعلم الآلة التقليدي؛ وتفتقر إلى النماذج العميقة المكانية-الزمانية المتقدمة |
| زيت &؛ مراجعة التوأم الرقمي للغاز16 | مختلف تقنيات الذكاء الاصطناعي وتعلم الآلة & النمذجة الآلية | تصنيف شامل لاستراتيجيات النمذجة | مفاهيمي في الغالب؛ مع تطبيقات عملية محدودة باستخدام التعلم العميق المتقدم |
الجدول 1: تحليل مقارن لإنتاج النفط والغاز وإدارة التحكم مع الطرق الحالية. نظرة عامة على استراتيجيات التوأم الرقمي والتحكم ذات الصلة، مع التركيز على الطرق المستخدمة، والنتائج التي تم تحقيقها، والعيوب الجوهرية.
| اسم مجموعة البيانات | المجال / النظام | عدد الميزات | المدة & الحجم | خصائص البيانات |
| زيت محاكى & بيانات إنتاج الغاز | زيت & نظام إنتاج الغاز (محاكاة) | متعدد المتغيرات (الضغط، والتدفق، ودرجة الحرارة، إلخ) | صُمم لهذا البحث | مستشعر محاكاة في الوقت الحقيقي &؛ إشارات التحكم، طبيعية &؛ حالات الخطأ |
| SWaT | نظام التحكم الفيزيائي السيبراني لتأمين معالجة المياه | ~51 مستشعراً ومشغلاً ميكانيكياً | ~11 أيام (~450 ألف+ عينة) | طبيعي &الشذوذ رقم 38 (36 سيناريو هجوم) |
| وادي | النظام الفيزيائي السيبراني لتوزيع المياه | ~123 مستشعراً + مشغلاً ميكانيكياً | ~١٦ يوماً (~١ مليون+ عينة) | طبيعي &الشذوذ رقم 38 (15 هجوماً) |
الجدول 2: وصف مجموعة البيانات.
وصف مجموعة البيانات. ملخص لمجموعات بيانات الدراسة، بما في ذلك المجال، وعدد الميزات، والمدة، وسمات البيانات.
| المكوّن | المعلمة الفائقة | القيمة |
| ST-GNN | عدد الطبقات | 3 |
| ST-GNN | البُعد الخفي | 64 |
| ST-GNN | طول النافذة الزمنية | 12 |
| Neural Operator (FNO) | عدد أنماط فوريه | 16 |
| Neural Operator (FNO) | عدد الطبقات | 4 |
| DeepONet | حجم شبكة الفرع | [128, 128] |
| DeepONet | حجم شبكة الجذع | [128, 128] |
| استيعاب البيانات | نافذة الاستيعاب | 10 time steps |
| المُحسِّن | Adam | |
| معدل التعلم | 0.001 | |
| حجم الدفعة | 64 | |
| وحدة تحكم RL | عامل الخصم (γ) | 0.99 |
| وحدة تحكم RL | طبقات شبكة السياسة | [128, 64] |
الجدول 3: بنية النموذج والمعلمات الفائقة. تكوينات البنية الهامة وإعدادات المعلمات الفائقة للمؤثرات العصبية، وتمثيل البيانات، والتعلم التعزيزي، ومكونات الشبكة العصبية الرسومية المكانية الزمانية.
| المعلمة | الوصف |
| منصة المحاكاة | Python (v3.10) مع PyTorch (v2.1) |
| المكتبات الداعمة | NumPy (v1.24), SciPy (v1.10), Pandas (v1.5) |
| الأجهزة | NVIDIA RTX series GPU (على سبيل المثال RTX 3090, 24 GB VRAM), Intel Core i7/i9 CPU, 32–128 GB RAM |
| تسريع وحدة معالجة الرسومات (GPU) | CUDA Toolkit (v11.8), cuDNN (v8.x) |
| نظام التشغيل | Linux (Ubuntu 20.04) / Windows 10 |
| بيئة التطوير | Jupyter Notebook / VS Code |
| فاصل أخذ العينات | 1–10 ثوانٍ (قابل للتكوين للمحاكاة في الوقت الفعلي) |
| نمذجة ضجيج المستشعر | ضجيج غاوسي (σ = 0.01–0.05) |
| سيناريوهات الأعطال | أعطال المستشعرات، واضطرابات التدفق، وشذوذ التحكم |
| وضع التقييم | محاكاة في الوقت الفعلي تعتمد على النافذة المنزلقة |
| توفر الكود | سيتم توفير رابط المستودع عند الطلب / النشر لضمان إمكانية إعادة الإنتاج |
الجدول 4: بيئة المحاكاة. معلومات حول تكوين الأجهزة، ومنصة البرمجيات، وفترة أخذ العينات، ونمذجة الضوضاء، وسيناريوهات الأعطال في الإعداد التجريبي.
| مجموعة البيانات | خطأ الحالة الأولية | خطأ الحالة النهائية | نسبة خفض الانجراف (%) |
| زيت محاكٍ & الغاز | 0.9 | 0.25 | 72.2 |
| فريق العمليات الخاصة (SWAT) | 1.1 | 0.4 | 63.6 |
| وادي | 1.3 | 0.55 | 57.7 |
الجدول 5: النتيجة التجريبية لمزامنة التوأم الرقمي. تقييم كمي لأداء المزامنة يوضح خفض انزياح التنبؤ عبر مجموعات البيانات وأخطاء تقدير الحالة الأولية والنهائية.
| مجموعة البيانات | الدقة | الاستدعاء | مقياس F1 (F1-Score) |
| زيت محاكى & الغاز | 0.95 | 0.93 | 0.94 ± 0.01 |
| فريق العمليات الخاصة والتكتيكات (SWAT) | 0.9 | 0.88 | 0.92 ± 0.02 |
| وادي | 0.87 | 0.85 | 0.90 ± 0.02 |
الجدول 6: أداء اكتشاف الشذوذ. نتائج اكتشاف الشذوذ في مجموعات بيانات النفط والغاز المحاكات، وSWAT، وWADI، بما في ذلك الدقة (precision)، والاستدعاء (recall)، ومقياس F1-score.
| مجموعة البيانات | المكافأة التراكمية ↑ | انتهاكات القيود ↓ | نسبة خفض التكلفة (%) ↑ |
| زيت محاكى & الغاز | 96.5 ± 0.8 | 0 | 18.7 |
| فريق العمليات الخاصة (SWAT) | 92.1 ± 1.2 | 1 | 14.3 |
| وادي | 89.7 ± 1.5 | 2 | 11.6 |
الجدول 7: النتائج التجريبية للتحكم في الحلقة المغلقة والتحسين. تُستخدم المكافأة التراكمية، وانتهاكات القيود، وخفض التكاليف التشغيلية لتقييم أداء التحكم في الحلقة المغلقة.
| الوحدة | متوسط زمن الاستجابة (ms) | الوصف |
| Neural Operator (FNO/DeepONet) | 18-25 ms | تعلم المؤثر والتنبؤ بحالة النظام |
| ST-GNN | 22–35 ms | نمذجة التبعية المكانية الزمانية |
| RL Policy Network | 5–10 ms | توليد قرارات التحكم |
| المعالجة المسبقة للبيانات | 8–12 ms | تطبيع المدخلات وإعداد الميزات |
| إجمالي زمن استجابة حلقة التحكم | 55–82 ms | وقت تنفيذ إجراء التحكم من الطرف إلى الطرف |
الجدول 8: تقييم أداء التحكم في الوقت الفعلي. تمثل قيم زمن الاستجابة متوسط أوقات الاستدلال المقاسة لكل خطوة تحكم تحت تكوين أجهزة قياسي.
| نموذج | متوسط مربع الخطأ ↓ | متوسط الخطأ المطلق ↓ | الخطأ النسبي (%) ↓ | وقت الاستدلال (ملي ثانية) ↓ | القيمة الاحتمالية (مقابل خط الأساس) |
| المحلل العددي (المرجعي) | 0.0125 ± 0.0012 | 0.089 ± 0.006 | 8.75 ± 0.54 | 120.5 ± 5.2 | — |
| نموذج تعلم آلي تقليدي | 0.0098 ± 0.0009 | 0.072 ± 0.005 | 6.42 ± 0.48 | 85.3 ± 4.7 | 0.021 |
| تعلم المؤثرات الحالي | 0.0076 ± 0.0007 | 0.061 ± 0.004 | 5.18 ± 0.41 | 42.8 ± 3.1 | 0.008 |
| الشبكة العصبية العميقة للمؤثرات DeepONet (المقترحة) | 0.0052 ± 0.0005 | 0.044 ± 0.003 | 3.67 ± 0.32 | 18.6 ± 2.4 | < 0.001 |
| الشبكة العصبية فورير (مقترح) | 0.0047 ± 0.0004 | 0.039 ± 0.002 | 3.21 ± 0.28 | 15.2 ± 2.1 | < 0.001 |
الجدول 9: مقارنة بين النماذج المرجعية والمقترحة من حيث دقة التنبؤ (MSE، MAE، والخطأ النسبي) والكفاءة الحسابية (وقت الاستنتاج). يتم تسجيل القيم كمتوسط ± الانحراف المعياري عبر جولات تشغيل متعددة. تشير القيم الأقل إلى أداء أفضل. وتدل قيم p على الدلالة الإحصائية مقارنة بالمحلل العددي المرجعي.
| الطريقة | MAE ↓ | RMSE ↓ | F1-Score ↑ | AUC ↑ | تقليل الانزياح (%) ↑ | المكافأة التراكمية ↑ |
| Physics-based DT | 0.45 | 0.62 | 0.78 | 0.82 | 35.4 | 65.2 |
| LSTM | 0.32 | 0.48 | 0.85 | 0.88 | 48.7 | 74.5 |
| GNN | 0.28 | 0.41 | 0.88 | 0.91 | 55.3 | 81.3 |
| الإطار المقترح | 0.2 | 0.3 | 0.94 | 0.97 | 72.2 | 95.5 |
الجدول 10: مقارنة شاملة للأداء. مقارنة شاملة للأداء بين نموذج التوأم الرقمي المقترح والواعي بالتحكم وبين مناهج أساسية أخرى في عمليات المراقبة، والكشف عن الشذوذ، والمزامنة، والتحكم. وبالنسبة لدقة التنبؤ، يفضل الحصول على قيم أقل لـ MAE وRMSE. أما بالنسبة لأداء الكشف عن الشذوذ والمزامنة، فيفضل الحصول على قيم أعلى لـ F1-score، وAUC، وتقليل الانحراف (drift reduction)، والمكافأة (reward).
| المكون | المَعلَمة | القيمة/الإعداد |
| المشغلات العصبية (FNO/DeepONet) | عدد الحقبات (Epochs) | 100–200 |
| حجم الدفعة (Batch Size) | 32–64 | |
| معدل التعلم | 0.001 | |
| ST-GNN | الطبقات | 3 |
| الوحدات المخفية | 64 | |
| النافذة الزمنية | 10–20 timesteps | |
| Neural 4D-Var | نافذة الاستيعاب | ثابتة (نافذة منزلقة) |
| التحسين | النزول الاشتقاقي (Gradient Descent) | |
| التعلم التعزيزي | عامل الخصم (γ) | 0.95 |
| أوزان المكافأة (α,β,γ) | 0.6, 0.25, 0.15 | |
| التدريب العام | المحسن | Adam |
| الأجهزة | NVIDIA RTX GPU |
الجدول 11: تكوين التدريب ومعلمات التنفيذ المستخدمة للمكونات المختلفة لإطار التوأم الرقمي المقترح. يقدم الجدول نظرة عامة على المعلمات الفائقة المختلفة ومعلمات التدريب المستخدمة لضمان إمكانية إعادة إنتاج النظام المقترح لمختلف المكونات.
| المكوّن | وقت التدريب (ساعة) | زمن انتقال الاستدلال (ملي ثانية) | نسبة استهلاك وحدة معالجة الرسومات (%) | القابلية للتوسع |
| المؤثرات العصبية | 6–8 | 25–40 | 80–90 | عالي |
| الشبكة العصبية الرسومية المكانية الزمانية (ST-GNN) | 3–4 | 15–25 | 60–70 | مرتفع |
| الاستيعاب البيانات رباعي الأبعاد العصبي (Neural 4D-Var) | 2–3 | 20–30 | 65–75 | متوسط |
| وحدة تحكم بالتعلم التعزيزي | 1–2 | 10–20 | 50–60 | مرتفع |
| النظام العام | 12–16 | <١٠٠ مللي ثانية | 70–85 | قابل للتوسع |
الجدول 12: تحليل الأداء الحوسبي وقابلية التوسع لنموذج التوأم الرقمي المقترح لمختلف المكونات. يُستخدم زمن الاستجابة لتمثيل أداء الاستدلال في الوقت الفعلي، وتُستخدم وحدة معالجة الرسوميات (GPU) لتمثيل الأداء الحوسبي، بينما تمثل قابلية التوسع قدرة النموذج المقترح على الاستخدام في التطبيقات ذات النطاق الصناعي.
| الطريقة | جذر متوسط مربع خطأ المراقبة | تقليل انزياح المزامنة (%) | AUROC | F1-Score | المكافأة التراكمية |
| التوأم الرقمي القائم على الفيزياء | 0.45 | 28.6 | 0.78 | 0.74 | 42.3 |
| النموذج القائم على LSTM | 0.31 | 41.2 | 0.86 | 0.83 | 61.7 |
| النموذج القائم على GNN | 0.26 | 53.4 | 0.91 | 0.88 | 74.5 |
| التوأم الرقمي المقترح | 0.2 | 72.2 | 0.94 | 0.92 | 95.5 |
الجدول 13: تقييم مقارن للعمل المقترح مع الطرق الحالية. تتم مقارنة أداء نموذج التوأم الرقمي المقترح من حيث مقاييس المراقبة، والمزامنة، وكشف الشذوذ، والتحكم مقابل الأساليب المرجعية والأساليب القائمة على التعلم.
| تكوين النموذج | خطأ المراقبة (RMSE) | كشف الشذوذ (F1) | أداء التحكم (المكافأة) |
| النموذج الكامل (جميع الوحدات) | 0.2 | 0.92 | 95.5 |
| – بدون استيعاب البيانات | 0.29 | 0.88 | 89.2 |
| – بدون ST-GNN | 0.27 | 0.85 | 87.1 |
| – بدون التعلم التعزيزي | 0.21 | 0.9 | 78.4 |
| – بدون التعلم المستمر | 0.23 | 0.91 | 92.3 |
الجدول 14: النتائج التجريبية ودراسة الاستئصال. دراسة استئصال تبحث في كيفية مساهمة كل جزء من نموذج التوأم الرقمي المقترح في الأداء العام للنظام.
| السيناريو | توفر البيانات | RMSE | الدقة | التعامل مع فجوات الرصد |
| طبيعي | 100% | منخفض | عالية | مستقر |
| فقدان جزئي | 50–70% | متوسط | عالية | استكمال داخلي قوي |
| فقدان شديد | 20–30% | متزايد | متوسطة | تدهور تدريجي |
| فشل المستشعر | 0% حسب المنطقة | أعلى | متوسطة | تعميم مكاني |
الجدول 15: تحليل المتانة في ظل ندرة البيانات. يوضح الجدول التالي أداء إطار عمل neural 4D-Var المقترح في حالات مختلفة من توفر البيانات. ويشير الجدول إلى متانة النموذج من خلال توضيح كيفية تغير الأخطاء في حالات الفقدان الجزئي، والندرة العالية، والفقدان الكلي لبيانات المستشعرات.
تُظهر نتائج هذا البحث فعالية التوأم الرقمي المطور والواعي بالتحكم من حيث قدرته على تحسين المراقبة في الوقت الفعلي، والكشف، وتحسين التحكم لمجموعة واسعة من الأنظمة الفيزيائية السيبرانية (CPS). وبالمقارنة مع النماذج التقليدية للمراقبة، فإن الجمع بين PINO والشبكات العصبية الرسومية (graph neural networks) أكثر فعالية من حيث دقة تقدير الحالة، حتى في الأنظمة التي تعاني من الضوضاء. وتعود هذه النتيجة إلى أن نموذج تعلم الآلة المتقدم في التوأم الرقمي يكون أكثر فعالية من حيث التنبؤ والكشف في النظام39.
بالمقارنة مع الحلول الحالية للكشف عن الشذوذ، مثل كاشفات شذوذ التوأم الرقمي التي تعتمد على التعلم المنهجي أو نماذج التمثيل السببية، يمكن ملاحظة أن الطريقة المقترحة يمكنها تحقيق أداء تنافسي عند مقارنة النتائج التي تم الحصول عليها في الأدبيات العلمية. فعلى سبيل المثال، مكنت كاشفات الشذوذ القائمة على التوأم الرقمي والتي تستخدم التعلم المنهجي من تحقيق تحسين متوسط في مقياس F1-score لمنصات اختبار الأنظمة الفيزيائية السيبرانية (CPS)، مما يشير إلى أن نماذج التعلم يمكن أن تؤثر على كفاءة عمليات الكشف40. وفي الوقت ذاته، تركز نماذج التوأم الرقمي الشائعة حالياً بشكل قوي على الاستنتاج الفعال والحد من الإيجابيات الكاذبة عبر الاستدلال السببي، ولكن ذلك يكون على حساب زيادة تعقيد النموذج في النموذج السببي. وفي هذا الصدد، يوفر نهج التعلم التعزيزي المتزامن المقترح كلاً من تحسين التشغيل الفعال والكشف السليم عن الشذوذ ضمن إطار عمل واحد. ومع ذلك، تجدر الإشارة إلى أن مقارنة الطريقة المقترحة مع النهج الأخرى لا تستند إلى نتائج تجارب مقارنة مباشرة، بل تعتمد فقط على النتائج التي أبلغ عنها باحثون آخرون؛ لذا يجب إجراء هذه المقارنة مع أخذ هذا الاعتبار في الحسبان.
علاوة على ذلك، فإن إضافة الكشف عن الشذوذ وتحسين إجراءات التحكم ضمن التوأم الرقمي المقترح يوضح الأهمية المتزايدة لقدرات دعم القرار والتشغيل التي توفرها التوائم الرقمية، وهو اتجاه حالي لأنشطة البحث والتطوير المرتبطة بأنظمة الفيزيائية السيبرانية (CPS). وتظهر الأوراق البحثية41 المتعلقة بمعايرة التوأم الرقمي باستخدام التعلم التعزيزي، مثل النهج التكيفية لتوجيه المستشعرات، أن استخدام وكلاء التعلم يمكن أن يوفر فوائد إضافية، لا سيما فيما يتعلق بالدقة والقابلية للتكيف، خاصة في الأنظمة الديناميكية. وهذا يؤكد النتائج المتعلقة بتعزيز فعالية التحسين في الحلقة المغلقة، مما يعزز الفرضية القائلة بأن التكامل الذكي يمكن أن يزيد من متانة وكفاءة أنظمة CPS. وقد صُمم هذا النهج، كما ذكر سابقاً، ليعمل في صناعة النفط والغاز، إلا أن تقييم النهج يعتمد على محاكاة لصناعة النفط والغاز، بالإضافة إلى مجموعات البيانات المرجعية لأنظمة CPS، وهي SWaT و WADI. ومع ذلك، تجدر الإشارة إلى أن التحقق الحالي لا يتضمن بيانات تشغيلية واقعية من قطاع النفط والغاز، وبالتالي يجب تفسير إمكانية التطبيق على سيناريوهات النشر الواقعية بحذر. وفي المستقبل، سيتم إجراء تقييم مقارن بين طريقة تعلم المناهج المقترحة وطريقة التوأم الرقمي القائمة على الاستدلال السببي ضمن إطار تجريبي موحد لمقارنة النهجين بطريقة منضبطة. وبالرغم من أن دمج هذه الوحدات، بما في ذلك المؤثرات العصبية والشبكات الرسومية والتعلم التعزيزي، يزيد من التكلفة الحسابية، إلا أن لكل وحدة وظيفة محددة تؤديها. كما تثبت دراسة الاستئصال أداء النهج المقترح، حيث يتدهور الأداء في حال إزالة أي من هذه الوحدات.
من الناحية النظرية، تقدم هذه الدراسة مساهمات كبيرة في إضافة الأساليب القائمة على النماذج والأساليب الموجهة بالبيانات ضمن بنية التوأم الرقمي. ويوفر دمج المشغلات العصبية المستنيرة بالفيزياء وتقنيات استيعاب البيانات العصبية في عملية تقدير الحالة نهج نمذجة هجين للأنظمة الفيزيائية السيبرانية (CPS)، مما يسد فجوة كبيرة في أدبيات أبحاث التوأم الرقمي، التي اعتمدت إما على عمليات محاكاة قائمة على الفيزياء البحتة أو نماذج الصندوق الأسود لمحاكاة الأنظمة الفيزيائية السيبرانية، ولكن ليس كليهما. ونظرياً، يتماشى هذا البحث مع تطور أبحاث التوأم الرقمي لنماذج الأنظمة الفيزيائية السيبرانية ذاتية القيادة التي يمكنها التعلم والتكيف باستمرار، وهو الأمر الذي تم التأكيد عليه في الأدبيات الحديثة.
من حيث إمكانية التطبيق، يمكن للمنهج المقترح أن يحسن بشكل كبير من عمل الأنظمة الفيزيائية السيبرانية (CPS) في البيئة الصناعية، حيث يتيح الموثوقية في الوقت الفعلي، والتحديد السريع والدقيق للشذوذ، واستراتيجيات حلقة التحكم المثلى، نتيجة للتعزيز المباشر للسلامة والكفاءة في تشغيل هذه الأنظمة. فعلى سبيل المثال، في البيئة الصناعية التي يرجح أن يصاحبها ضجيج في المستشعرات ونموذج نظام غير خطي، يضمن نهج الكشف المتزامن التحديد السريع للاختلالات مع الحد من حدوث الإنذارات الكاذبة. وبخلاف الحلول الحالية لأنظمة CPS القائمة على التوأم الرقمي والمتعلقة بالكشف عن التسلل، والتي تهدف بشكل أساسي إلى مقاييس التصنيف، يتيح المنهج المقترح أساليب التحديد والتصحيح معاً، مما يساهم في قدرة مشغلي النظام على تغيير بيئة تشغيل الـ CPS بشكل استباقي قبل حدوث فترة التوقف عن العمل. بالإضافة إلى ذلك، فإن قدرة المنهج المقترح على التطبيق الشامل في بيئات متباينة، كما ظهر من أدائه على مجموعة البيانات المرجعية، تشير إلى إمكانية التطبيق العامة لهذا المنهج في مختلف بيئات الـ CPS مثل التصنيع الذكي، ومجال الطاقة، وأنظمة إدارة شبكات البنية التحتية الحيوية.
يتم تقييم قابلية التوسع لإطار عمل التوأم الرقمي المقترح من حيث قدرته على إدارة الحجم المتزايد للنظام والتعقيد الزمني. ومن خلال تمثيل تفاعلات المستشعرات باستخدام هياكل الرسوم البيانية المتناثرة، تتوسع الشبكة العصبية الرسومية المكانية والزمانية بكفاءة مع زيادة عدد المستشعرات والمكونات المراقبة، مما يمنع النمو الأسي في التعقيد الحسابي. كما يعزز تطبيق المشغلات العصبية المستنيرة بالفيزياء من قابلية التوسع من خلال تعلم تعيينات المشغل بغض النظر عن دقة التجزئة، مما يتيح نمذجة فعالة للأنظمة واسعة النطاق دون زيادات ملحوظة في التكلفة الحسابية. ويستخدم إطار العمل طرق النافذة المنزلقة والتعلم القائم على التسلسل لإدارة التبعيات الزمنية عبر آفاق زمنية أكبر دون التضحية بجدوى الحوسبة. بالإضافة إلى ذلك، تقلل تقنيات التعلم التزايدي من الأعباء الإضافية في عمليات النشر واسعة النطاق من خلال تمكين التحديثات المستمرة دون الحاجة إلى إعادة تدريب كاملة. علاوة على ذلك، أصبح من الممكن المعالجة الفعالة في الوقت الفعلي لتدفقات البيانات عالية الأبعاد من خلال الاستفادة من الحوسبة المتوازية القائمة على GPU. وتعد البنية المقترحة مناسبة للتطبيقات الصناعية واسعة النطاق مثل أنظمة إنتاج النفط والغاز التي تحتوي على شبكات مستشعرات موزعة ومتطلبات مراقبة مستمرة، حيث صُممت لتتوسع مع كل من عدد المستشعرات ووقت التشغيل.
ستساعد دراسة الاستئصال في فهم المساهمة الفردية لكل وحدة، وهي: المؤثرات العصبية، وشبكة ST-GNN، وتمثيل البيانات، والتعلم التعزيزي. وقد أُجريت دراسة استئصال لقياس مستويات المساهمة للعديد من الوحدات الرئيسية الفردية في بنية التوأم الرقمي المقترحة. وتشمل هذه الوحدات الفردية تمثيل البيانات، ونمذجة الرسوم البيانية مكانياً وزمانياً، والتعلم التعزيزي، والتعلم المستمر. كما تم فحص آثار إزالة هذه الوحدات الفردية من حيث مستويات التأثير التي تسببها في دقة المراقبة، وكشف الشذوذ، والتحكم. وتؤكد النتائج النهائية بوضوح أن استخدام البنية الشاملة هو الأفضل دائماً، وبالتالي فإن إزالة الوحدات الفردية تؤدي إلى مستويات متفاوتة من تدهور الأداء، مما يشير إلى أن المكونات المختلفة تساهم بشكل متفاوت في الأداء العام للنظام. ويظهر مستوى تأثير إزالة وحدة تمثيل البيانات بوضوح زيادة في خطأ التنبؤ ويؤثر على الموثوقية بمستوى مماثل فيما يتعلق بكشف الشذوذ. كما يظهر مستوى تأثير إزالة التعلم التعزيزي بوضوح أن التحكم قد تأثر بشكل كبير، خاصة عند النظر في المراقبة وحدها.
تظهر نتائج الاستئصال في الجدول 14 أن الوحدات المختلفة لها مساهمات متفاوتة في أداء النظام. وتُسهم وحدة استيعاب البيانات بأكبر قدر في دقة أداء المراقبة، تليها وحدة ST-GNN. أما وحدة التعلم المستمر فلها مساهمة متوسطة في دقة أداء المراقبة، بينما تمتلك وحدة التعلم التعزيزي أصغر مساهمة في دقة أداء المراقبة، على الرغم من أنها تقدم أكبر مساهمة في أداء التحكم من حيث انخفاض قيمة المكافأة من 95.5 إلى 78.4.
للتحقق من متانة إطار عمل neural 4D-Var المقترح، أُجريت تجارب في ظل ظروف رصد متدهورة بشكل متزايد. وتحديداً، شملت التجارب السيناريوهات التالية: (i) فشل جزئي في المستشعرات، حيث تراوحت نسبة البيانات المفقودة من 30% إلى 70%؛ (ii) سقوط كامل للمستشعرات في مناطق محددة؛ و(iii) تأخر في الاتصالات أدى إلى ملاحظات متباعدة زمنياً. وتُظهر النتائج التجريبية أن النموذج المقترح يتمتع بأداء قوي في ظل فقدان البيانات المتوسط، ويتدهور أداؤه تدريجياً وبشكل طفيف في حالات فقدان البيانات الشديد، مما يوضح مستواه العالي من القدرة على التكيف. ويوضح الجدول 15 نتيجة تحليل المتانة.
تتمثل إحدى محدوديات هذه الدراسة في نطاق التحقق من صحة النموذج المقترح. وتجدر الإشارة إلى أنه على الرغم من أن النموذج مخصص لأنظمة إنتاج النفط والغاز، إلا أن تقييم النموذج المقترح استند إلى قيم محاكاة للنفط والغاز ومشكلات مرجعية سيبرانية-فيزيائية مثل SWaT وWADI. ومن المهم أيضًا ملاحظة أنه على الرغم من ارتباط المشكلات المرجعية بعمليات النفط والغاز، فإن المشكلات في هذه الحالة مرتبطة بمعالجة المياه وتوزيعها.
ومع ذلك، وعلى الرغم من هذا الأداء الأمثل، إلا أن هناك بعض القيود. فعلى سبيل المثال، يتسم النظام بتعقيد حسابي أعلى مقارنة ببعض تطبيقات التوأم الرقمي، لا سيما مع دمج المشغلات العصبية، والشبكات الرسومية، والتعلم التعزيزي. وقد يشكل ذلك عائقاً رئيسياً أمام اعتماد هذه الأنظمة في المنصات ذات القدرات الحسابية المحدودة. وعلاوة على ذلك، ورغم التركيز فقط على المحاكاة ومجموعات القياس المرجعية، إلا أنها لم تتمكن من شمل مستوى التنوع الذي يتواجد في الأنظمة الفيزيائية السيبرانية (CPS) التشغيلية. ويمكن ملاحظة ذلك في مجموعات المحاكاة، مثل SWAT وWADI، المعتمدة عموماً في تقييمات الأنظمة الفيزيائية السيبرانية، حيث قد تفتقر هذه المجموعات إلى مستوى التنوع الذي يتم مواجهته في بيئات الأنظمة الفيزيائية السيبرانية في العالم الحقيقي. كما يفترض النظام توفر إمداد مناسب من بيانات المستشعرات، وهو أمر قد لا يكون ممكناً دائماً في الأنظمة الفيزيائية السيبرانية القديمة. ويتمثل القيد الرئيسي للنظام في نقص بيانات صناعة النفط والغاز من العالم الحقيقي لتقييم النظام، حيث يستند التقييم إلى محاكاة لصناعة النفط والغاز، بالإضافة إلى مجموعات البيانات المرجعية للأنظمة الفيزيائية السيبرانية، أي SWaT وWADI، والتي قد لا تعكس بدقة التعقيدات الواقعية لصناعة النفط والغاز. وقد أظهر النظام المقترح أداءً واعداً في القدرات التنبؤية، إلا أنه يتطلب تكاليف حسابية أعلى خلال عملية التدريب. وفي المستقبل، يمكن النظر في بدائل خفيفة الوزن للنظام المقترح، بما في ذلك المشغلات العصبية ذات الرتبة المختزلة، وتقليم النماذج، ونماذج الفيزياء والتعلم الآلي الهجينة.
يجب دراسة قابلية التوسع والنشر في بيئة واقعية، وتكامل هذا النظام مع البنى التحتية الحالية للأنظمة الفيزيائية السيبرانية (CPS) حيث يمكن أن تتباين كثافة أجهزة الاستشعار وجودة المعلومات المستشعرة بشكل كبير، وذلك في الأعمال البحثية المستقبلية حول تقنيات ضغط النماذج. علاوة على ذلك، قد يكون توسيع هذا النظام ليشمل القابلية للتفسير وحلقات التغذية الراجعة للمشغلين مفيداً في تحسين الشفافية وبناء الثقة في عملية اتخاذ القرار الذاتي. بالإضافة إلى ذلك، فإن دمج طرق الاستدلال السببي ضمن عمليات اكتشاف الشذوذ الحالية، على غرار تلك المستخدمة في التوائم الرقمية السببية، قد يساهم في تحسين تحليل الأسباب الجذرية وتقليل الإنذارات الكاذبة. وأخيراً، ومن أجل تحقيق المتانة، سيتطلب هذا الإطار التحققي التحقق من صحته باستخدام بيانات ميدانية فعلية.
أثبت هذا البحث فكرة نموذج توأم رقمي ذكي ومدرك للتحكم، يهدف إلى تحسين قدرات مراقبة النظام في الوقت الفعلي، وكشف الشذوذ، واتخاذ القرار في الأنظمة السيبرانية الفيزيائية المعقدة. وبخلاف التوائم الرقمية التقليدية التي تعمل أساساً كمراقب سلبي وتُستخدم للمراقبة في الوقت الفعلي، يهدف هذا البحث إلى دمج المشغلات العصبية المستنيرة بالفيزياء، والشبكات العصبية الرسومية المكانية الزمانية، واستيعاب البيانات العصبي، والتحكم القائم على التعلم التعزيزي، وخوارزميات التعلم ضمن نموذج واحد لنظام التوأم الرقمي. يتم أولاً مراقبة النظام في الوقت الفعلي بواسطة نظام توأم رقمي يعتمد على نموذج تعلم مستنير بالفيزياء لنظام من المعادلات غير الخطية. ثانياً، يتم تطبيق نظام neural 4DVar لإجراء عملية استيعاب للبيانات تعمل على مزامنة النظامين الفيزيائي والافتراضي لتقليل انحراف تنبؤات النظام الناتج عن الضوضاء وتغيرات النظام. ويتم تنفيذ كشف الشذوذ بناءً على نموذج مكاني زماني إما للعلاقات المكانية أو لتطور النظام بمرور الوقت. وأخيراً، يقوم وكيل تعلم تعزيزي بإنشاء إجراءات تحكم في النظام انطلاقاً من حالة نظام متزامنة وتكون صالحة من منظور قيود سلامة النظام مع مراعاة قيود التحكم. وقد أظهرت التجارب المكثفة التي أجريت على عملية محاكاة للنفط والغاز، وسيناريوهات CPS المرجعية SWAT و WADI، الفعالية المحتملة للمنهج المقترح في ظل ظروف المحاكاة والظروف المرجعية. وقد أدى النموذج المقترح إلى تقليل أخطاء المراقبة (MAE و RMSE)، وتحقيق نتائج ممتازة في كشف الشذوذ، وسلوك متسق للتحكم في الحلقة المغلقة. وأكدت هذه النتائج أن مزامنة كشف الشذوذ والتحكم داخل التوأم الرقمي تعد عاملاً مهماً فيما يتعلق بالحفاظ على موثوقيته وكفاءة عملياته. ومن المجالات الأخرى للتطوير المحتمل لتقنية التوأم الرقمي توسيعها باستخدام الذكاء الاصطناعي والسببية. وسيتم تقييم هذا الإطار من خلال التحقق من صحته باستخدام بيانات واقعية من صناعة النفط والغاز.
من المهم التأكيد على أن الاستنتاجات المستخلصة في هذه الدراسة تستند إلى مجموعات بيانات محاكاة وبيانات مرجعية، وبالتالي يجب تفسير مدى قابليتها للتطبيق على أنظمة النفط والغاز في العالم الحقيقي بحذر.
توفّر البيانات:
تتوفر مجموعتا بيانات SWaT وWADI المستخدمتان في هذه الدراسة للعامة كبيانات لأنظمة تحكم صناعية، ويمكن الوصول إليهما عبر مستودع بيانات مختبر iTrust: https://itrust.sutd.edu.sg/itrust-labs_datasets/dataset_info/.
ليس لدى المؤلفين أي تضارب في المصالح.
يقر المؤلفون بالدعم الفني والمؤسسي المقدم من شركة البيانات وقسم قيادة الإنتاج في شركة حقل شينجيانغ النفطية، CNPC، في كاراماي، الصين، أثناء إتمام هذا البحث. لم يتم تلقي أي تمويل خارجي لهذه الدراسة.
| الاسم | الشركة | رقم فهرسي | التعليقات |
|---|---|---|---|
| وحدة المعالجة المركزية CPU (Intel Xeon / AMD Ryzen) | Intel / AMD | سلسلة Xeon / Ryzen | تُستخدم لمحاكاة النظام، والمعالجة المسبقة للبيانات، والحسابات العامة |
| إطار عمل التعلم العميق (PyTorch 2.0) | Meta AI (PyTorch) | https://pytorch.org RRID:SCR_018536 | يُستخدم لتنفيذ الشبكات العصبية، والتحسين، ومسارات التدريب |
| مكتبة الشبكات العصبية العميقة (cuDNN 8.x) | NVIDIA cuDNN | cuDNN 8.x | توفر بدائيات محسنة لعمليات التعلم العميق على وحدة معالجة الرسوميات GPU |
| DeepONet | غير قابل للتطبيق | https://arxiv.org/abs/1910.03193 | يُشار إليه في البرمجية باسم "neural operator model" |
| وحدة معالجة الرسوميات GPU (NVIDIA RTX 4090) | NVIDIA | RTX 4090 | تُستخدم لتدريب نماذج التعلم العميق بما في ذلك المؤثرات العصبية، وST-GNN، ومكونات التعلم التعزيزي |
| تسريع وحدة معالجة الرسوميات (CUDA 11.8) | NVIDIA CUDA | CUDA 11.8 RRID:SCR_018131 | يتيح الحوسبة المتوازية القائمة على GPU لتدريب النماذج عالية الأداء |
| توزيعة Linux (الإصدار 22.04 LTS) | Canonical (Ubuntu) | https://ubuntu.com/download; RRID:SCR_018127 | نظام التشغيل المستخدم لتنفيذ التجارب ونشر النماذج |
| نظام التشغيل (Ubuntu 22.04 LTS) | Canonical (Ubuntu) | https://ubuntu.com/download RRID:SCR_018127 | يوفر بيئة التنفيذ لجميع التجارب ونشر النماذج |
| خوارزمية التحسين (Adam Optimizer) | غير قابل للتطبيق | https://arxiv.org/abs/1412.6980 | تُستخدم لتدريب النماذج باستخدام تحسين معدل التعلم التكيفي |
| مكتبة الشبكات العصبية العميقة المحسنة (الإصدار 8.x) | NVIDIA cuDNN | https://developer.nvidia.com/cudnn RRID:SCR_018131 | توفر بدائيات محسنة ومسرعة بواسطة GPU لعمليات الشبكات العصبية العميقة |
| لغة البرمجة (Python 3.10) | Python Software Foundation | https://www.python.org/downloads RRID:SCR_008394 | لغة البرمجة الأساسية المستخدمة في التنفيذ والتجريب |
| ذاكرة النظام (≥ 64 GB RAM) | Corsair / Kingston / Crucial | https://www.corsair.com / https://www.kingston.com / https://www.crucial.com | تدعم التعامل مع البيانات الزمنية متعددة المتغيرات عالية الأبعاد وتدريب النماذج الكبيرة |
طلب إذن لإعادة استخدام النص أو الأشكال في مقالة JoVE هذه
طلب إذن