يؤسس هذا البروتوكول إجراء نموذجي موحد للتحكم السريع لتقييم التحكم في تتبع الرجوع المضبوط من تحسين سرب الجسيمات ضمن بيئة محاكاة ثابتة في الوقت الحقيقي.
مقالة منهجية
يؤسس هذا البروتوكول إجراء نموذجي موحد للتحكم السريع لتقييم التحكم في تتبع الرجوع المضبوط من تحسين سرب الجسيمات ضمن بيئة محاكاة ثابتة في الوقت الحقيقي.
الهدف الأساسي من هذا البروتوكول هو توفير إطار محاكاة ثابت قابل لإعادة الإنتاج لتقييم ضبط الكسب القائم على تحسين سرب الجسيمات (PSO) في أنظمة التحكم غير الخطية. يبدأ التنفيذ بصياغة نموذج بندول من نوع فوروتا، يليه دمج وحدة تحكم للرجوع إلى الوراء ضمن بيئة تنفيذ ثابتة بخطوات مدتها مللي ثانية. تتضمن المنهجية عملية منهجية من أربع مراحل: توصيف قيود التنفيذ غير المثالية، وتعريف فضاء بحث متعدد الأهداف لتحسين سرب الجسيمات، وتنفيذ الضبط التلقائي غير المتصل بالإنترنت، وتقييم المعلمات الناتجة من خلال مجموعة موحدة من سيناريوهات تتبع المسار ورفض الاضطرابات. يدعم هذا الإعداد، الذي يستخدم محطات عمل صناعية عالية الأداء وواجهات إشارة موحدة، مقارنات متكررة متسقة ضمن نفس بنية التحكم. يقارن التصميم وحدة تحكم الرجوع اليدوية المضبوطة يدويا مع نسخة محسنة ل PSO تشترك في نفس هيكل التحكم بالضبط، مما يعزل تأثير اختيار الكسب. يتم تقييم أداء وحدة التحكم عبر ثلاثة سيناريوهات تشغيلية مميزة: تتبع مسار الخطوات، تتبع الجيوب الجيبية متعدد التردد، ورفض الاضطراب. أظهر التحليل الإحصائي لعشر تجارب متكررة أن تحسين نظام PSO خفض RMSE تتبع الخطوات من 0.065 إلى 0.050 رادياد وخفض نزهات البندول الذروة بنسبة 33.1٪. وقد تم تحقيق هذه التحسينات جنبا إلى جنب مع تقليل جهود التحكم في RMS بنسبة 22.1٪، مما يشير إلى أن المعايير المحسنة سهلت توزيعا أكثر كفاءة للطاقة ضمن إطار العمل القائم على ليابونوف. في النهاية، توفر هذه المنهجية إطار محاكاة منظم لتقييم استراتيجيات التحكم غير الخطية قبل أي تنفيذ مادي لاحق.
يمثل بندول البندول الدوار المقلوب من نوع فوروتا معيارا أساسيا للتحقق من الخوارزميات غير الخطية للتحكم بسبب عدم استقراره في الحلقة المفتوحة وديناميكياته المعقدة غير الفعالة 1,2,3. قبل النظر في التقييم الموجه نحو التنفيذ، تتطلب هذه التصاميم النظرية اختبارات وسيطة صارمة قائمة على المحاكاة. لذلك، يؤسس هذا البروتوكول إطار عمل موحد وسريع لمحاكاة النماذج الأولية للتحكم لتقييم التغيرات المنهجية في الأداء الناتجة عن تحسين سرب الجسيمات (PSO) على وحدات التحكم في تتبع الرجوع في بيئة محاكاة ثابتة الخطوة.
في الأدبيات الأوسع، استكشفت العديد من الدراسات تعديلات هيكلية وضبط المعلمات لتحسين التحكم في البندولات المقلوبة الدوارة. تنتشر التصاميم القائمة على التحسين المستخدمة؛ على سبيل المثال، تم استخدام PSO لاختيار معلمات وحدة التحكم وتم دمجه في بنى التحكم المختلطة الضبابية 4,5. مقارنة بغيرها من الميتاهيوريستيكيات المستوحاة من الأحياء، تم اختيار PSO خصيصا لهذا الإطار بسبب تقاربه السريع في فضاءات البحث المستمر منخفضة الأبعاد ومتطلبات ضبط المعاملات الفائقة الحد الأدنى. تسلط الأدبيات الحديثة الضوء بشكل متزايد على ضرورة خوارزميات التحسين الذكي في سيناريوهات التحكم المتنوعة والمعقدة. على سبيل المثال، تم دمج تقنيات التحسين المتقدمة بشكل فعال مع أطر التحكم التكيفي المرجعي للنموذج (MRAC) وأطر الترتيب الكسري لتعزيز دقة تتبع محطات السيرفو غير الخطية 6,7. علاوة على ذلك، أثبت الضبط القائم على التحسين فائدته الكبيرة في إدارة الديناميكيات المترابطة والقيود الجوهرية للأنظمة الكهروميكانيكية المعقدة 8,9.
تؤكد الدراسات الحديثة أن PSO ومتغيراته الهجينة تحسن بشكل كبير فعالية تتبع نقاط الطاقة القصوى في المصفوفات الكهروضوئية، مما يثبت تحديد متين للمعلمات تحت ظروف التظليل الجزئي10. في الروبوتات، تم استخدام PSO بنجاح لتحسين تصاميم التحكم الخطية المعززة وغير الخطية المشتقة النسبية للمناورات المتوازية، مما يقلل من أخطاء تتبع المسار11. بالإضافة إلى ذلك، ثبت دمج PSO مع التحكم التكيفي في وضع الانزلاق للخلف حاسما لقمع الاهتزازات في الكتل المعلقة العضلية الاصطناعية الهوائية12. بعيدا عن اختيار المعلمات الأساسية، يعد دمج معالجة الإشارات الحديثة واستراتيجيات التحسين المتينة أمرا بالغ الأهمية للحفاظ على استقرار الحلقة المغلقة تحت ظروف فيزيائية واقعية وصاخبة13,14.
ركزت الجهود الحديثة أيضا على تتبع زاوية المفاصل المتزامنة وتثبيت البندول تحت ظروف غير مؤكدة باستخدام الانعكاس الديناميكيالمعمم 15 القوي، بالإضافة إلى التقدير العصبي التكيفي16. علاوة على ذلك، تم تطوير هياكل التحكم في الرجوع إلى الخلف بشكل واسع للتعامل مع الاضطرابات المعقدة عبر أنظمة ميكانيكية مختلفة، مثل دمج تصاميم وضع الانزلاق لقمع الاهتزازات المبنى، واستخدام مراقبات شبه منزلقة لصمامات الخانق الإلكترونية، ودمج مراقبي الاضطراب غير الخطي لتنظيم سرعة محرك التيار المستمر عالي الدقة17، 18، 19. تؤكد هذه التطبيقات المتنوعة على مرونة تصاميم الرجوع إلى الوراء عند دمجها مع استراتيجيات تقدير أو تحسين قوية.
نقطة ضعف حاسمة سائدة في الأدبيات المعاصرة هي الخلط بين تعديلات وحدات التحكم الهيكلية وفوائد ضبط المعايير. العديد من الدراسات المقارنة تقارن بين بنى التحكم المختلفة تماما، مما يجعل من المستحيل التمييز بين ما إذا كانت المكاسب في الأداء ناتجة عن الخوارزمية الأساسية أم فقط من اختيار الكسب المتفوق20,21. علاوة على ذلك، غالبا ما تفترض دراسات المحاكاة الحالية ظروف تشغيل مثالية وتركز فقط على التثبيت الأساسي. غالبا ما تفشل في معالجة تدهور الأداء الناتج عن قيود التنفيذ الواقعية. تعالج هذه المنهجية هذه الفجوات بشكل مباشر. من خلال إدخال تأخيرات العينات المحاكاة، وضوضاء المستشعرات، وعدم تطابق التخميد ضمن نموذج تتبع المسار الديناميكي، يقوم البروتوكول المقترح بتقييم تأثير تحسين PSO على هيكل تحكم ثابت.
على عكس التكامل العددي التقليدي، يميز هذا البروتوكول نفسه من خلال فصل فعالية ضبط المعلمات عن تغيرات وحدات التحكم الهيكلية مع فرض قيود توقيت الخطوات الثابتة. بدلا من إدخال بنية تحكم جديدة، تقوم هذه الطريقة بتقييم وحدة تحكم تتبع خطوة واحدة للرجوع ضمن بيئة محاكاة ثابتة في الوقت الحقيقي. من خلال مقارنة خط أساس مضبوط يدويا مع نسخة محسنة ل PSO من نفس وحدة التحكم بالضبط، تم تصميم البروتوكول لينسب الفروق الملحوظة في تتبع الخطوات، والتتبع الجويبي، ورفض الاضطراب إلى عملية تحسين الكسب. المساهمة الأساسية لهذه الدراسة هي تطوير بروتوكول محاكاة في الوقت الحقيقي موجه للمعايير يعزل تأثير اختيار الكسب القائم على PSO عن تغيرات وحدات التحكم الهيكلية.
تحديدا، هذا العمل: (1) ينشئ بيئة تنفيذ ثابتة بخطوات مدتها مللي ثانية لمحاكاة قيود التنفيذ؛ (2) يدمج مجموعة تقييم متعددة الجوانب تشمل سيناريوهات اضطراب التوتر الجيبي متعدد التردد، واضطراب نبضة العزم؛ و(3) يوفر معيارا كميا لمقارنة تأثيرات ضبط الكسب تحت ظروف غير مثالية محاكاة موحدة. تم تصميم هذه المنهجية خصيصا للباحثين في التحكم ومهندسي الأنظمة الذين يحتاجون إلى مرحلة تقييم محاكاة وسيطة لقوانين التحكم غير الخطية تحت قيود التوقيت الثابت، وضوضاء القياس، والتأخير، وعدم تطابق التخميد، وقيود التشبع. ينطبق بشكل خاص على الأنظمة الكهروميكانيكية التي تعمل بشكل غير دقيق، حيث يجب موازنة دقة التتبع وثبات الحالة الداخلية تحت تأخيرات ضوضاء واتصالات واقعية.
هذا البروتوكول لا يشمل الأشخاص البشريين أو اختبارات الحيوانات أو العينات السريرية. تنفذ الإجراءات بالكامل ضمن بيئة محاكاة ثابتة تمثل نظام تحكم كهروميكانيكي غير خطي. لم تجرى أي تجربة بندول دوار معكوس فيزيائي، أو التحقق من الأجهزة الفيزيائية داخل الحلقة، أو اختبار نشر فيزيائي في هذه الدراسة.
1. بناء المصانع وتأسيس مؤتمرات الإشارة
2. الشرط الأولي للحالة وترتيب الوضع
3. تنفيذ وحدة التحكم الأساسية للخطوة العكسية
4. تحسين كسب الرجوع إلى الوراء عبر تحسين سرب الجسيمات (PSO)
5. تكوين منصة التنفيذ في الوقت الحقيقي
6. تنفيذ اختبار تتبع الخطوات
7. تنفيذ اختبار تتبع الجيوب الجنوبية
8. تنفيذ اختبار رفض الاضطراب
9. تصدير البيانات والتلخيص الإحصائي
أظهرت خوارزمية تحسين سرب الجسيمات (PSO) انخفاضا أوليا سريعا في دالة الهدف المركب، تلاها فترة من التقارب التدريجي. تحديدا، انخفضت قيمة الملاءمة المثلى إلى 1.8757 خلال الدورة الحسابية الأولى، بينما انخفضت ملاءمة السرب المتوسطة من 2.0573 إلى 1.2518 بحلول التكرار الخامس والثلاثين. حدث معظم هذا التقارب خلال التكرارات ال 15 إلى 20 النسخة الأولى. بعد هذه المرحلة، تقاربت مسار الحل العالمي الأفضل، مما يشير إلى أن السرب وصل إلى منطقة مستقرة داخل فضاء البحث المحدد مسبقا بدلا من التجول عشوائيا. حافظت مجموعة الكسب النهائية المشتقة من PSO على السلامة الهيكلية لقانون التراجع الأساسي لكنها أعادت توزيع الوزن النسبي بين مصطلحات التثبيت (الجدول 2). كما هو موضح في الشكل 1، سهلت خوارزمية التحسين تدهورا سريعا لدالة الملاءمة، حيث انتقلت من مرحلة استكشاف أولية إلى حل عالمي مستقر ضمن 35 تكرارا. مقارنة بخط الأساس المضبوط يدويا، اعتمدت وحدة التحكم المحسنة قيما أكبر ل k1 و k2، وانحدار سطح خطأ أقل λ، وطبقة حدود أوسع φ.
أداء تتبع الخطوات
يكشف التحليل المقارن عن فروق أداء واضحة بين المتحكمين خلال تجربة تتبع الخطوات، مما يوضح النتائج الإيجابية وغير المثالية المتوقعة لهذا البروتوكول. يمثل التحكم في التراجع في الخط الأساسي نتيجة غير مثالية نموذجية؛ بينما حافظ على الاستقرار العام بعد أمر 0.50 راديو عند 2.0 ثانية، أظهر معدل ارتفاع أولي سريع انحرف مبكرا عن مسار الهدف، مما أدى إلى تذبذبات متبقية مستمرة ويتطلب وقتا أطول للتقارب. وعلى العكس، تظهر وحدة التحكم المحسنة ل PSO نتيجة إيجابية تمثيلية، تتميز باقتراب سريع ومخمد إلى نقطة الضبط دون تفعيل تشبع الأوامر. على مدى عشر تجارب متتالية، خفض المتحكم المحسن نظام تتبع الخطوات RMSE من 0.065 ± 0.002 رادياد إلى 0.050 ± 0.002 رادياد (اختبار ويلش t، ص < 0.001، الجدول 4). كما تحسنت مؤشرات الانتقال الزائلة: انخفض التجاوز من 4.644 ± 0.604٪ إلى 3.627 ± 0.620٪ (جامعة مان–ويتني، p = 0.009)، وتم تقصير وقت الارتفاع من 0.788 ± 0.025 ثانية إلى 0.548 ± 0.025 ثانية (جامعة مان–ويتني، الصفحة < 0.001). تظهر هذه الفروقات في الأداء في الشكل 2 والشكل 3، حيث تظهر الاستجابة المحسنة تخميدا محسنا وتقارب نقاط ضبط أسرع. تم تحقيق هذه الدقة المحسنة إلى جانب تقليل بنسبة 22.1٪ في جهد التحكم المتوسط المربع الجذري (من 0.669 ± 0.004 فولت إلى 0.521 ± 0.003 فولت). في الوقت نفسه، تم تخفيف الحد الأقصى لتأرجح البندول بنسبة 33.1٪، وانخفض من 5.812° إلى 3.889° (الجدول 4). علاوة على ذلك، رغم عدم تحقيق أي تجارب أساسية معيار التسوية 1.0 ثانية ضمن نافذة 10.0 ثوان، حقق المتحكم المحسب نجاحا في الاستقرار في 70٪ من التجارب، مسجلا متوسط وقت استقرار 1.057 ± 0.348 ثانية.
أداء تتبع الجيوب الجينية
حافظت كلتا استراتيجيتي التحكم على تتبع محدود تحت المرجع الجيبي متعدد التردد طوال فترة الاختبار التي استمرت 20 ثانية. على الرغم من أن فجوة الأداء كانت أقل وضوحا بصريا مقارنة باختبارات الاستجابة الخطوية، إلا أن النتائج الإحصائية عبر التجارب المتكررة أشارت إلى تحسن الأداء مع النهج الأمثل. أظهرت إشارة التحكم الأساسية نطاق أوسع لخطأ التتبع وتأخرت بشكل ملحوظ عن شكل الموجة المستهدفة. على النقيض من ذلك، تتبع وحدة التحكم المحسنة نقطة الضبط بشكل أوثق خلال التغيرات منخفضة وعالية التردد، مما أدى إلى توزيع أكثر إحكاما لأخطاء الذروة على طول المسار المرجعي. وبالتالي، تم تقليل RMSE التجريبي الكامل من 0.061 ± 0.003 رادياتور إلى 0.040 ± 0.003 رادياتور بعد التحسين. كما هو موضح في الجدول 5، ساعد المتحكم المحسن أيضا في تقليل جهد RMS للتحكم (من 0.557 ± 0.002 فولت إلى 0.402 ± 0.002 فولت) وقيد أقصى إزاحة بندول من 2.156 ± 0.079° إلى 1.464 ± 0.061°، مما يشير إلى تحسين تزامن الطور وكفاءة الطاقة (p < 0.001، الجدول 5؛ الشكل 4).
رفض الاضطراب والمتانة عبر السيناريوهات
حقن نبضات عزم الدوران الإضافي عند 6.0 ثانية و12.2 ثانية تسبب في انحرافات أكبر في زاوية الذراع وحركات أوسع في استجابة وحدة التحكم الأساسية. بينما كانت وحدة التحكم المحسنة تسجل الاضطرابات فورا، كانت رحلاتها بعد الاضطراب أقل. أظهرت عملية التعافي نحو التوازن الصفري المرجعي اتجاها نوعيا أسرع (من 0.014 ثانية إلى 0.000 ثانية)؛ ومع ذلك، لم يصل هذا المقياس المحدد إلى دلالة إحصائية (p = 0.078)، ويرجع ذلك أساسا إلى أن دقة تسجيل البيانات التي تبلغ 20 مللي ثانية سببت تأثير أرضية قابل للقياس. على مدى التجارب المتكررة، قلل التمثيل الأمثل من الخطأ الذروة بعد الاضطراب. تم تقليل تكامل الخطأ المطلق (IAE) المحسوب على مدى 20 ثانية من 0.377 ± 0.012 إلى 0.248 ± 0.015، إلى جانب انخفاض متناظر في جهد RMS التحكم من 0.656 ± 0.003 فولت إلى 0.508 ± 0.005 فولت. تم تخفيف السعة القصوى لتذبذب البندول بالمثل من 11.456 ± 0.117° إلى 7.561 ± 0.063° (الجدول 6). ظل تصنيف وحدات التحكم ثابتا عبر جميع ملفات الاختبار الثلاثة. أسفرت استراتيجية التراجع المحسنة من قبل PSO عن أخطاء عابرة أقل، وقلل من الأخطاء في الحالة المستقرة، وقللت من الرحلات السلبية للبندول (p < 0.001، الجدول 6؛ الشكل 5) دون الحاجة إلى زيادة الجهد العام للمشغل. يتم تلخيص توزيعات مؤشرات الأداء الأولية عبر التجارب في الشكل 6.
توفر البيانات:
تم إيداع مجموعة البيانات الداعمة المستخدمة لإنشاء الأشكال والجداول، بما في ذلك البيانات التمثيلية، ومقاييس المستوى التجريبي، والبذور العشوائية المحددة مسبقا، وسجلات ضبط PSO، في Zenodo وهي متاحة للجمهور بموجب DOI 10.5281/zenodo.20395966.

الشكل 1: تقارب تحسين سرب الجسيمات في ضبط وحدة التحكم. (أ) أفضل قيم اللياقة للسرب على مدى 35 تكرارا؛ (ب) متوسط قيم اللياقة لكل نقطة زمنية. تحلل الهدف المركب بسرعة في مرحلة الاستكشاف الأولية لكنه تباطأ تدريجيا مع تقارب إلى منطقة مستقرة ضمن قانون التحكم في التراجع المحسن من PSO. يرجى الضغط هنا لعرض نسخة أكبر من هذا الشكل.

الشكل 2: استجابات تتبع الخطوات التمثيلية لوحدة التحكم الأساسية والمحسنة ل PSO. (أ) مرجع زاوية الذراع المحدد واستجابة زاوية الذراع المقاسة لتسلسل كامل من 20 ثانية؛ (ب) عرض موسع للاستجابة مباشرة بعد تطبيق خطوة رادياد 0.50 عند 2.0 ثانية؛ (ج) عرض موحد للاستجابة بعد الجزء الثاني من أوامر الراديو 0.20 يبدأ عند 10.0 ثانية. بعد التحسين، أظهرت وحدة التحكم المحسنة ل PSO وقت ارتفاع أسرع، وخطأ ذروة أقل، وتخميد أفضل مقارنة بوحدة التحكم الأساسية. يرجى الضغط هنا لعرض نسخة أكبر من هذا الشكل.

الشكل 3: خطأ تتبع زاوية الذراع وسلوك التحكم تحت المراقبتين. (أ) خطأ تتبع زاوية الذراع أثناء اختبار تتبع الخطوات الكامل؛ (ب) إشارة الجهد للتحكم لنفس التجربة؛ (ج) زاوية انحراف البندول أثناء استجابة الخطوة. أظهر المتحكم المحسن، انحرافات أخطاء أصغر، ونطاق اهتزاز أضيق، وحركة أكثر سلاسة نسبيا تحت مستوى أوامر RMS أقل. يرجى الضغط هنا لعرض نسخة أكبر من هذا الشكل.

الشكل 4: أداء تتبع جيبي تمثيلي تحت مرجع تردد مختلط. (أ) تم إصدار استجابات مرجعية جيبية وزاوية ذراع قياسية خلال تجربة تتبع لمدة 20 ثانية؛ (ب) خطأ تتبع خلال نفس النطاق الزمني؛ (ج) زاوية انحراف البندول أثناء عملية تتبع الجيوب الجيبية. كانت وحدة التحكم المحسنة ل PSO تتبع الأمر المركب بشكل أوثق من وحدة التحكم الأساسية، مما أظهر تقليل تأخر الطور ونطاق الأخطاء في الدورات المتتالية. يرجى الضغط هنا لعرض نسخة أكبر من هذا الشكل.

الشكل 5: استجابات الرفض التمثيلية للاضطراب تحت تنظيم المرجع الصفري. (أ) خطأ تتبع زاوية الذراع أثناء اختبار رفض الاضطراب، بما في ذلك اضطرابات عزم الدوران عند 6.0 ثانية و12.2 ثانية؛ (ب) زاوية انحراف البندول خلال نفس التجربة؛ (ج) التحكم في إشارة الجهد أثناء رفض الاضطراب. مقارنة بوحدة التحكم الأساسية، أظهر التحكم المحسن ل PSO انحرافا أقصى بعد الاضطراب واستعادة أسرع نحو نقطة الإعداد. يرجى الضغط هنا لعرض نسخة أكبر من هذا الشكل.

الشكل 6: توزيع مؤشرات الأداء الأساسية عبر التجارب في جميع حالات الاختبار الثلاث. (أ) تتبع الخطوات RMSE؛ (ب) زمن ارتفاع تتبع الخطوات؛ (ج) تتبع الجيوب الجيبية RMSE؛ (د) تأخر الطور الجيبي؛ (ه) خطأ تتبع ذروة بعد الاضطراب؛ (و) أقصى إزاحة للبندول تحت شرط الاضطراب-الرفض. تظهر كل لوحة توزيع 10 تجارب صالحة تحت كل شرط متحكم. يتم مقارنة الميل المركزي والتشتت لأنظمة التحكم في التراجع المحسنة من قبل PSO بشكل مباشر. يرجى الضغط هنا لعرض نسخة أكبر من هذا الشكل.
| المعلمة | الرمز | القيمة | الوحدة |
| طول الذراع الدوار | Lr | 0.215 | m |
| طول مركز الكتلة للبندول | لب | 0.168 | m |
| كتلة الذراع الدوارة | م.ر | 0.254 | ك.ج. |
| كتلة البندول | مبي | 0.097 | ك.ج. |
| تخميد الذراع اللزج | بر ر | 0.0031 | N·m·s/rad |
| تخميد لزجة البندول | بب | 0.0018 | N·m·s/rad |
| ثابت عزم المحرك | كت | 0.053 | N·m/A |
| دقة المشفر | Nenc | 4096 | الكونتس/القس |
| فترة تحديث وحدة التحكم | تيإس | 0.002 | s |
الجدول 1: معلمات النظام الاسمية لنموذج البندول الدوار غير الخطي المقلوب. القائمة الاسمية للمعلمات الهندسية، القصور الذاتي، التخميد، التشغيل، والمستشعر لنموذج المصنع غير الخطي في الوقت الحقيقي وتطوير نظام التحكم. عدم تطابق التخميد الذي أضيف وقت تطبيق الاختبار الرسمي مستقل ومستثني من هذه الأرقام الاسمية.
| المتحكم | الربح | القيمة | الوصف |
| خطوة الخلف على خط الأساس | ك1 | 3.6 | كسب تثبيت أولي يدوي |
| خطوة الخلف على خط الأساس | ك2 | 1.95 | كسب التحكم الافتراضي المضبوط يدويا |
| خطوة الخلف على خط الأساس | λ | 2.1 | ميل سطح الخطأ |
| خطوة الخلف على خط الأساس | φ | 0.12 | عرض طبقة الحدود |
| خطوة الرجوع المحسنة ل PSO | ك1 | 4.19 | أفضل جسيم عالمي بعد 35 تكرارا |
| خطوة الرجوع المحسنة ل PSO | ك2 | 2.44 | أفضل جسيم عالمي بعد 35 تكرارا |
| خطوة الرجوع المحسنة ل PSO | λ | 1.83 | أفضل جسيم عالمي بعد 35 تكرارا |
| خطوة الرجوع المحسنة ل PSO | φ | 0.92 | أفضل جسيم عالمي بعد 35 تكرارا |
الجدول 2: مكاسب وحدة التحكم في الرجوع للخطوة الأساسية ومعدلات التحكم في الرجوع المحسنة ل PSO. يعرض الجدول تركيبات الكسب لحالات تشغيل كلا المتحكمين. كانت القيم الأساسية ثابتة أثناء الضبط اليدوي؛ تشير المكاسب المحسنة ل PSO إلى الجسيم النهائي العالمي الأفضل الذي يتم الاحتفاظ به بعد 35 تكرارا تحسينيا.
| العنصر | المواصفات |
| حاسوب الهدف في الوقت الحقيقي | كمبيوتر صناعي، معالج Intel i7، ذاكرة RAM بسعة 16 جيجابايت |
| وضع التنفيذ | محاكاة الوقت الحقيقي بخطوة ثابتة |
| فترة تحديث وحدة التحكم | 2 مللي ثانية |
| فترة تصدير الإشارة | 20 مللي ثانية |
| واجهة الإشارة | مدخل ومخرج المشفر التناظري، ±10 فولت |
| تكوين المصنع | نموذج البندول الدوار المقلوب غير الخطي من نوع فوروتا |
| التأثيرات غير المثالية المحقونة | ضوضاء القياس، تأخير قناة البندول، وعدم تطابق التخميد |
| ضوضاء القياس | 0.003 رادياتور على زاوية الذراع؛ 0.004 رادياد على زاوية البندول |
| تأخير قناة البندول | 4 مللي ثانية |
| عدم تطابق تخميد النبات | +8٪ مقارنة بنموذج وحدة التحكم الاسمية |
| تشبع الأوامر | ±10 فولت |
| معايير إيقاف السلامة | |θ| > 0.70 راديادات، |α| > 0.35 رادياتور، أو التشبع > 100 مللي ثانية |
| قبول التموضع المسبق | |α| ≤ راديو 0.05 لمدة لا تقل عن 1.0 ثانية قبل بدء التجربة |
| ملف المرجع للخطوة | 0 راديو (0.0-2.0 ثانية)، 0.50 راديو (2.0-10.0 ثانية)، 0.20 راديو (10.0-20.0 ثانية) |
| الملف المرجعي الجيبي | 0.26 SIN (2π·0.20T) + 0.12 SIN (2π·0.30t + 0.40) راديو |
| بروتوكول الاضطراب | نبضتان إضافيتان لعزم الدوران عند 6.0 ثانية و12.2 ثانية |
| سعة وعرض الاضطراب | 0.030 نيوتن متر، 0.12 ثانية |
| تجارب صالحة لكل وحدة تحكم وسيناريو | 10 |
الجدول 3: بيئة المحاكاة في الوقت الحقيقي، إعدادات الإشارة، وقواعد التأهيل للتجربة. ملخص منصة التنفيذ، معدل تحديث وحدة التحكم، فترات تصدير الإشارة، حقن التأثيرات غير المثالية، شروط توقف الأمان، مسارات المرجع، إعدادات الاضطراب، ومعايير التجربة الصحيحة.
| القياس | خطوة الخلف في خط الأساس n=10 | خطوة إلى الوراء المحسنة ل PSO n=10 | قيمة p | الاختبار الإحصائي |
| تتبع RMSE (رادياتور) | 0.065 ± 0.002 | 0.050 ± 0.002 | <0.001 | اختبار t ويلش |
| خطأ الحالة المستقرة، 9.0–10.0 ثانية (رادياتور) | -0.007 ± 0.001 | -0.004 ± 0.001 | <0.001 | جامعة مان–ويتني |
| تجاوز الكرة (٪) | 4.644 ± 0.604 | 3.627 ± 0.620 | 0.009 | جامعة مان–ويتني |
| وقت الصعود | 0.788 ± 0.025 | 0.548 ± 0.025 | <0.001 | جامعة مان–ويتني |
| وقت الاستقرار | لا توجد محاكمات تسوية صحيحة (0/10) | 1.057 ± 0.348 (7 من 10 محاكمات تسوية صحيحة) | NA | ليس بالمقارنة |
| آر إم إس التحكم (V) | 0.669 ± 0.004 | 0.521 ± 0.003 | <0.001 | اختبار t ويلش |
| أقصى انحراف بندول (deg) | 5.812 ± 0.156 | 3.889 ± 0.109 | <0.001 | اختبار t ويلش |
الجدول 4: مقاييس الأداء لتتبع الخطوات عبر 10 تجارب صالحة لكل وحدة تحكم متحكمة. يعرض هذا الجدول إحصائيات ملخص التجارب المتكررة لتجربة تتبع الخطوات، والتي تشمل تتبع RMSE، وخطأ الحالة المستقرة، والتجاوز، ووقت الارتفاع، وسرعة تقارب نقاط الإعداد، والتحكم في جهد RMS، وأقصى انحراف للبندول. يتم الإبلاغ عن القيم كمتوسطات ± الانحرافات المعيارية ما لم يذكر خلاف ذلك.
| خطوة إلى الوراء المحسنة ل PSO n=10 | قيمة p | الاختبار الإحصائي |
| 0.040 ± 0.003 | <0.001 | اختبار t ويلش |
| 0.088 ± 0.006 | <0.001 | اختبار t ويلش |
| 0.232 ± 0.019 | <0.001 | اختبار t ويلش |
| 0.402 ± 0.002 | <0.001 | اختبار t ويلش |
| 1.464 ± 0.061 | <0.001 | اختبار t ويلش |
الجدول 5: مقاييس أداء تتبع الجيوب الجينية عبر 10 تجارب صحيحة لكل متحكم. يعرض هذا الجدول ملخصات التجارب المتكررة لاختبار تتبع الجيب، والتي تشمل الخطأ المتوسط التربيعي الجذري الكامل (RMSE)، وأقصى خطأ مطلق في التتبع، وتأخر الطور، وجهد RMS للتحكم. كما يتم توفير أكبر انحراف في البندول. يشير تأخر الطور الموجب إلى أن الناتج المقاس يلاحق نقطة الضبط.
| قيمة p | الاختبار الإحصائي |
| <0.001 | اختبار t ويلش |
| 0.078 | جامعة مان–ويتني |
| <0.001 | اختبار t ويلش |
| <0.001 | اختبار t ويلش |
| <0.001 | اختبار t ويلش |
الجدول 6: مقاييس أداء رفض الاضطراب عبر 10 تجارب صالحة لكل متحكم. تشمل بيانات التجارب المتكررة من تجارب رفض الاضطراب الخطأ في التتبع بعد الاضطراب، وقت الاستعادة، تكامل الخطأ المطلق (IAE)، جهد RMS للتحكم، وأقصى انحراف في البندول. كما تملي عليه إعدادات تصدير الإشارة، فإن وقت الاسترداد القابل للقياس محدود بفترة تسجيل 20 مللي ثانية.
الهدف الأساسي من هذه الدراسة ليس فقط إعلان تفوق وحدة تحكم على أخرى في ظروف معزولة، بل لإثبات أن إطار عمل تحسين الكسب القائم على PSO الذي تم تقييمه هنا يمكن أن يحسن أداء وحدة تحكم التراجع عبر سيناريوهات غير مثالية ومحاكاة محددة. يعد البندول المقلوب الدوار معيارا ممتازا لهذا التقييم بسبب خصائصه اللاخطية العالية وغير الدنيا في الطور ونقص التفعيل26. بعيدا عن مقاييس الأداء، تعتمد السلامة التقنية لهذا البروتوكول على التوصيف المتعمد لبيئة المحاكاة في الوقت الحقيقي. تتضمن خطوة تنفيذ حاسمة حقن تصحيح عدم تطابق التخميد بنسبة 8٪ وتأخير المستشعر 4 مللي ثانية، حيث تسمح هذه التأثيرات غير المثالية المحددة لخوارزمية PSO بتحسين المكاسب تحت نفس الاضطرابات المستخدمة في التقييم الرسمي بدلا من الظروف المثالية فقط.
من خلال اختبار استراتيجيات التحكم من خلال بروتوكولات تتبع الخطوات، والتتبع الجيبي، ورفض الاضطرابات تحت إعداد تنفيذ موحد بالخطوات الثابتة، أظهرت نتائج المحاكاة اتجاها ثابتا في الأداء. ومن الجدير بالذكر أن التحسينات التي لوحظت في كل من الاستجابات التدرجية والجيبية — وتحديدا تقليل أخطاء التتبع، تقليل التجاوز الزائد، وتخفيف تأخر الطور — تم تحقيقها جنبا إلى جنب مع انخفاض قابل للقياس في جهد التحكم في RMS. يشير هذا إلى أن عملية التحسين لم تحسن دقة التتبع فقط عن طريق تشبع وحدة الدفع؛ بل أعاد توزيع جهود التحكم ضمن إطار العمل التراجع القائم على ليابونوف. يتأثر اتساق إعادة توزيع المعلمات هذا بشكل كبير بمعايير قبول الترتيب المسبق المعرفة في الخطوة 2.4 من البروتوكول. التأكد الصارم من بقاء البندول ضمن نافذة التوازن المحددة لفترة طويلة أمر ضروري؛ وإلا، قد تؤدي الانتقالات الأولية غير المنتظمة إلى ركود مبكر بسبب دالة التكلفة أو سلوك سرب غير متقارب خلال مرحلة الضبط غير المتصلة اللاحقة. بالنسبة للأنظمة الميكانيكية غير النشطة، فإن إعادة التوزيع مهمة لأنها تحكم كيفية تخصيص جهد التحكم لإدارة الاقتران بين الإحداثي النشط (الذراع الدوار) والإحداثي السلبي (البندول)27.
علاوة على ذلك، يبرز التقليل المتزامن في كل من خطأ تتبع زاوية الذراع والخروج الداخلي للبندول ميزة لبروتوكول الضبط المقترح. في التحكم في الأنظمة غير المؤثرة، يعتبر تحقيق تتبع إحداثيات دقيق على حساب الحالات الداخلية المتقلبة تصميما أقل مثالية أو حتى فاشلا. خفض قانون التحكم المحسن سعة تفاعل البندول غير المفعل بنسبة 33.1٪ مع تحسين دقة التتبع في الوقت نفسه. يشير هذا التحسن المشترك إلى أن خوارزمية PSO حددت تركيبة كسب توازن بشكل أفضل بين الإحداثيات النشطة والسلبية، بدلا من الاعتماد على تغذية راجعة عالية الكسب يمكنها تضخيم التذبذبات الطفيلية. هذا الأداء المتوازن هو مؤشر أكثر إفادة على فعالية التحكم من التتبع النقي للمسار فقط، حيث يشير إلى أن ديناميكيات الحالة الداخلية كانت محدودة بشكل كاف خلال عمليات تحويل الطاقة28. وبالمثل، تدعم نتائج رفض الاضطراب المتانة العملية للمكاسب المحسنة ضمن ظروف الاختبار المحاكاة. بينما تسبب فترة تسجيل 20 مللي ثانية تأثير أرضية أخفى أوقات استرداد دقيقة تحت العينة، تشير التخفيضات المتزامنة في ذروة خطأ ما بعد الاضطراب، والخطأ المطلق التراكمي، وإزاحة البندول القصوى إلى أن المعايير المحسنة حدت من مدى انتشار حقن النبضات الخارجية عبر ديناميكياتالنظام 29.
يتطلب التنفيذ الناجح لهذا البروتوكول معالجة عنق الزجاجة الشائعة في التنفيذ. على سبيل المثال، إذا فشل مسار السرب في الاستقرار خلال 35 تكرارا، يجب على الباحثين أولا التحقق مما إذا كانت حدود البحث المنصوص عليها في الخطوة 4.2 البروتوكول تشمل بشكل كاف منطقة ليابونوف المستقرة. علاوة على ذلك، إذا كانت آلة الهدف في الوقت الحقيقي تفعل توقفات أمان متكررة خلال مرحلة رفض الاضطراب، فإن تقليل فترة تحديث وحدة التحكم إذا دعمتها المنصة، أو تحسين تردد قطع مرشح الفرق العكسي، قد يساعد في الحفاظ على سلامة الحلقة المغلقة دون المساس بمنطق التحسين.
على الرغم من هذه النتائج الواعدة، تظل المنهجية محدودة بالتجريدات الكامنة في بيئات المحاكاة. البروتوكول المطبق أخذ في الاعتبار تأخيرات أخذ العينات، تشبع الأوامر، عدم تطابق التخميد، وضوضاء القياس—وهي عوامل غالبا ما يتم تجاهلها في التكامل الرقمي غير المتصلة بالإنترنت. ومع ذلك، لم تتضمن الدراسة الحالية تجارب البندول المقلوب الدوار الفيزيائي، أو التحقق من الأجهزة الفيزيائية داخل الحلقة، أو اختبار النشر الفيزيائي. لذلك، يجب تفسير النتائج كدليل قائم على المحاكاة على تأثير الأداء لضبط الكسب القائم على PSO تحت ظروف المحاكاة الثابتة وغير المثالية. قد توسع الأعمال المستقبلية مجموعة عدم اليقين النمذجة من خلال دمج تأثيرات إضافية للاحتكاك، والمشغل، والامتثال، والتكميم ضمن المحاكاة قبل اعتبار أي دراسة منفصلة موجهة للعتاد 30,31,32.
تؤسس هذه الدراسة بروتوكول محاكاة للنمذجة الأولية للتحكم السريع لتقييم تحسين الكسب القائم على PSO للتحكم في الرجوع إلى الوراء. تظهر النتائج الكمية من 10 تجارب متكررة أن وحدة التحكم المحسنة تقلل RMSE تتبع الخطوات من 0.065 إلى 0.050 rad وتحقق انخفاضا بنسبة 22.1٪ في جهد التحكم في RMS مقارنة بالخط الأساسي اليدوي. يشير التوهين بنسبة 33.1٪ في رحلات البندول إلى تحسين استقرار الحالة الداخلية تحت الظروف غير المثالية المحاكاة. بينما تدمج بيئة المحاكاة هذه الضوضاء، التأخير، عدم تطابق التخميد، والتشبع، إلا أنها لا تحاكي بالكامل الاحتكاك الكولومبي المعقد، أو نطاقات المحرك الميتة، أو الامتثال الهيكلي، أو كمية المستشعرات الموجودة في الأنظمة الفيزيائية. سيركز العمل المستقبلي على توسيع نموذج المحاكاة ليشمل تأثيرات غير مثالية إضافية واختبار ما إذا كان نمط التصنيف نفسه لا يزال مستقرا عبر ظروف عدم اليقين المحاكاة الأوسع.
يعلن المؤلفون عدم وجود تضارب مصالح.
يشكر المؤلفون كلية هندسة الطاقة في جامعة الهندسة البحرية على توفير مرافق البحث ومنصة المحاكاة الفورية اللازمة لإجراء المحاكاة المقدمة في هذا البروتوكول. كما يشكر المؤلفون الطاقم الفني للمختبر على دعمهم في الحفاظ على الموارد الحاسوبية وبيئة المحاكاة المستخدمة لتقييمات أداء التحكم.
| الاسم | الشركة | رقم فهرسي | التعليقات |
|---|---|---|---|
| High-performance Workstation (Windows 11 Pro) | Various / Custom Build | N/A | الجهاز المضيف لمحاكاة الوقت الحقيقي خطوة ثابتة والمعالجة اللاحقة. |
| MATLAB (الإصدار R2024a) | MathWorks | https://www.mathworks.com/products/matlab.html | نمذجة المصنع غير الخطي، ترميز وحدة التحكم، تصدير البيانات، وإدارة المعلمات. |
| Simulink (الإصدار R2024a) | MathWorks | https://www.mathworks.com/products/simulink.html | إنشاء نموذج مخطط الصندوق لبندول من نوع Furuta وتنفيذ وحدة التحكم. |
| Simulink Desktop Real-Time (الإصدار R2024a) | MathWorks | https://www.mathworks.com/products/simulink-desktop-real-time.html | نواة وقت حقيقي خطوة ثابتة لتنفيذ نموذج التحكم على سطح المكتب. |
| Python (الإصدار 3.11) | Python Software Foundation | https://www.python.org/ | المعالجة الثانوية للبيانات، المناولة الإحصائية، وإعداد الأشكال البيانية. |
| NumPy (الإصدار 1.26) | مطورو NumPy | https://numpy.org/ | عمليات المصفوفات الرقمية للبيانات التجريبية المصدرة. |
| pandas (الإصدار 2.2) | مطورو pandas | https://pandas.pydata.org/ | تنظيم بيانات التجارب المتكررة وإنشاء جداول ملخص. |
| SciPy (الإصدار 1.13) | مطورو SciPy | https://scipy.org/ | الاختبار الإحصائي وأدوات تحليل الإشارة. |
| Matplotlib (الإصدار 3.8) | مطورو Matplotlib | https://matplotlib.org/ | إنشاء المخططات للتلاؤم والتتبع والتوزيع. |
طلب إذن لإعادة استخدام النص أو الأشكال في مقالة JoVE هذه
طلب إذن