تقدم هذه المقالة بروتوكولا للتعرف على الكيانات المسماة في الطب الحيوي باستخدام BioBERT، والتعلم القائم على الطلبات، ونماذج اللغة الكبيرة للسيناريوهات منخفضة الموارد.
مقالة بحثية
تقدم هذه المقالة بروتوكولا للتعرف على الكيانات المسماة في الطب الحيوي باستخدام BioBERT، والتعلم القائم على الطلبات، ونماذج اللغة الكبيرة للسيناريوهات منخفضة الموارد.
يلعب الاعتراف بالكيان الطبي الحيوي المسمى (NER) دورا حيويا في استخراج معلومات قيمة من النصوص السريرية والأدبيات الطبية الحيوية. أظهرت نماذج التعلم العميق التقليدية، بما في ذلك BioBERT وClinicalBERT وRoBERTa، تحسنا كبيرا في مهام التعلم العميق العميق؛ ومع ذلك، لا تزال تواجه صعوبة في مصطلحات طبية حيوية منخفضة الموارد، وتحديات تكيف المجالات، وتعميم الكيانات غير المرئية. لمعالجة هذه القيود، تقدم هذه الدراسة إطارا هجينا يجمع بين BioBERT، والتعلم القائم على التوجيه، ونماذج اللغة الكبيرة (LLMs) لتعزيز قدرات التعلم بقليل الطلقات والتعلم الصفري في الطب الحيوي العصبي المغناطيسي. يستفيد النموذج المقترح بفعالية من المعرفة السياقية من المحولات المدربة مسبقا، مما يقلل الاعتماد على مجموعات البيانات الموسومة الواسعة مع الحفاظ على دقة عالية. بعد تقييم تجريبي واسع النطاق عبر مجموعات بيانات مرجعية طبية حيوية متعددة، يظهر النهج المقترح أداء قويا باستمرار. على وجه التحديد، تحقق دقة 89.8٪، ودقة 88.7٪، واسترجاع بنسبة 90.5٪، ودرجة F1 تبلغ 0.895، متفوقا على الطرق الأساسية وتظهر فعاليتها في مهام التنقيب عن النصوص الطبية الحيوية. مقارنة بالطرق الأخرى، تساعد هندسة التوجيه النموذج على التكيف بشكل أفضل مع اللغة الفريدة للنصوص الطبية الحيوية. بالإضافة إلى ذلك، فإن التعزيز باستخدام نموذج لغوي كبير (LLM) يمنح أداء NER دفعة كبيرة من خلال التقاط تفاصيل دلالية ونحوية معقدة. تظهر هذه النتائج فعالية التعلم بنظام الطلقات القليلة والتعلم الصفري في التنقيب النصي الطبي الحيوي، مما يمهد الطريق لتحليل البيانات السريرية الآلي الأفضل وأنظمة دعم اتخاذ القرار الأكثر ذكاء.
إن انفجار الأدبيات الطبية الحيوية، والسجلات الصحية الإلكترونية (EHRs)، وبيانات التجارب السريرية يحتاج حقا إلى أنظمة ذكية وقوية للتعرف على الكيانات الطبية الحيوية المسماة (BioNER). BioNER هي مهمة متخصصة في معالجة اللغة الطبيعية (NLP) تهدف إلى تحديد كيانات مثل الأمراض والجينات والبروتينات والأدوية والمواد الكيميائية في نص طبي حيوي غير منظم1. القدرة على تحديد هذه الكيانات بدقة أمر بالغ الأهمية لاستخدامات أخرى كثيرة، مثل استخراج المعرفة الطبية الحيوية، واكتشاف أدوية جديدة، ودعم الأطباء في اتخاذ القرارات السريرية، أو حتى فرز أكوام الأوراق البحثية تلقائيا2.
على الرغم من تحقيق تقدم كبير في نماذج التعلم العميق مثل BioBERT وClinicalBERT وBlueBERT - إلا أن معظم الأساليب الطبية المراقبة الحالية للتعرف على الكيانات المسماة (BioNER) لا تزال تعتمد بشكل كبير على مجموعات البيانات المشروحة واسعة النطاق. هذا الاعتماد القوي على البيانات الموسومة الواسعة يحد من قدرتها على التعميم عند تطبيقها على النصوص الطبية الحيوية الجديدة أو غير المرئية سابقا3. نماذج BioNER الكلاسيكية تحتاج إلى الكثير من البيانات المشروحة فقط لتحسينها، وهذا يصبح صداعا حقيقيا في المجالات التي لا تتوفر فيها بيانات كافية، مثل الأمراض النادرة، علم الجينوميات الدوائية، أو الأبحاث الطبية الحيوية المنشورة بلغاتغير الإنجليزية. وفوق ذلك، وضع العلامات يدويا على كل هذا النص الطبي الحيوي بطيء ومكلف، وعادة ما يحتاج إلى خبراء حقيقيينفي المجال. لهذا السبب فإن تطوير نماذج BioNER قليلة الطلقات وصفر الطلقات أمر مهم جدا: فقد يقلل بشكل كبير من الحاجة إلى بيانات معنونة مع ضمان عمل النماذج بشكل جيد عبر نطاق واسع من المحتوى الطبي الحيوي.
يتيح التعلم القليل-الطلق (FSL) النماذج تحقيق أداء تنافسي في التعرف على الكيانات باستخدام جزء صغير فقط من البيانات المعنونة، عادة بين 1٪ و10٪ من مجموعة بيانات التدريب الكاملة، مما يجعله ذا قيمة خاصة في مجالات الطب الحيوي منخفضة الموارد7. التعلم ذو الطلقة الصفرية (ZSL) يذهب أبعد من ذلك، حيث يسمح للنموذج بالتعرف على كيانات لم يرها من قبل، فقط عن طريق الاستفادة من قوة نماذج اللغة الكبيرة والمدربة مسبقا (LLMs)، دون الحاجة إلى بيانات تدريب إضافية8. مؤخرا، أظهرت التطورات في نماذج اللغة الكبيرة مثل GPT-4 وLLaMA وFalcon أداء قويا في الطلقات الصفرية عبر مهام NER العامة، لكن استخدامها في النصوص الطبية الحيوية الفعلية لا يزال إلى حد كبير غير مستكشف. ذلك لأن اللغة في الأمور الطبية الحيوية متخصصة ومعقدةجدا.
يهدف هذا البحث إلى سد هذه الفجوة من خلال جمع الضبط الدقيق لBioBERT، والتعلم بقليل من الفرص، واستنتاج نماذج اللغة الكبيرة ذات الطلقات الصفرية، والتعلم القائم على السرعة، وكل ذلك بهدف رفع مستوى BioNER في البيئات الطبية الحيوية منخفضة الموارد.
لإعطاء فكرة عما هو موجود بالفعل: (1) BioBERT هو نسخة من BERT تم إعادة تدريبها على ملخصات PubMed والمقالات النصية الكاملة، لذا فهي الأنسب للمحتوى الطبي الحيوي10. (2) ClinicalBERT هو نوع من BERT مدرب على السجلات الصحية الإلكترونية، لذا فهو مضبوط خصيصا لفهم الملاحظات السريرية وتقارير الأطباء11. (3) BlueBERT هو نموذج معالجة لغوية طبية حيوية آخر، مدرب على مجموعات بيانات PubMed وMIMIC-III، وهو محسن للتعرف على الأمور الطبية في النص12. (4) PubMedBERT هو نموذج محول مدرب فقط على بيانات PubMed، مما يساعده على التقاط تلك الأنماط والمصطلحات الفريدة الموجودة في الكتابة الطبية الحيوية13.
بينما تحقق هذه النماذج أداء متقدما في معايير BioNER، فإن اعتمادها على مجموعات بيانات كبيرة ومعنونة وضبط دقيق تحت إشراف يحد من قدرتها على التكيف مع مجالات الطب الحيوي الجديدة14. علاوة على ذلك، فإن التحولات في المجال بين الأدبيات الطبية الحيوية العلمية (مثل ملخصات PubMed) والملاحظات السريرية (مثل مجموعة بيانات i2b2 2010) تؤثر بشكل أكبر على أداء أنظمة BioNER الخاضعة للإشراف15.
تشمل القيود الأساسية في أبحاث BioNER الحالية: الاعتماد على البيانات المشروحة: تتطلب النماذج القائمة على المحولات مجموعات بيانات موسومة واسعة، وهي نادرة في المجالات الطبية الحيوية المتخصصة16. عدم التعميم على الكيانات غير المرئية: تواجه النماذج الحالية صعوبة في التعرف على مصطلحات طبية حيوية نادرة أو جديدة غير موجودة في بيانات التدريب17. الاستكشاف المحدود للتعلم بقليل الطلقات والتعلم الصفري: تركز معظم الأبحاث على التعلم المراقب بالكامل، مع تحقيق محدود في نماذج البيانات المنخفضة لمشروع BioNER18. التكيف غير الفعال لنماذج اللغة الكبيرة: على الرغم من أن نماذج اللغة الكبيرة مثل GPT-4 وLLaMA تظهر أداء قويا في الطلقات الصفرية في معالجة اللغة الطبيعية بشكل عام، إلا أن تطبيقها على النماذج الطبيعية العلمية الطبية الحيوية لا يزال غير مستكشف بشكل كاف بسبب تعقيد المصطلحات وغياب المحفزات الخاصة بالمجالات19.
لمعالجة هذه الفجوات، تستكشف هذه الدراسة الأسئلة البحثية الرئيسية التالية: كيف يمكن للتعلم بقليل من الجرعات تحسين أداء BioBERT في التحليل النووي الطبي الحيوي مع بيانات معنونة قليلة؟ هل يمكن للاستدلال الصفري باستخدام نماذج اللغة الكبيرة التعرف بدقة على الكيانات الطبية الحيوية دون الحاجة إلى ضبط خاص بالمجال؟ كيف يمكن للتعلم القائم على التوجيه تعزيز الأداء الصفري في مهام NER الطبية الحيوية؟ ما هو النهج الهجين الأمثل الذي يجمع بين BioBERT والعلامات الزائفة المولدة بواسطة LLM لتحسين BioNER في البيئات ذات الموارد المنخفضة؟ كيف يؤثر التدريب العدائي على متانة نماذج BioNER قليلة الطلقات ونماذج BioNER ذات الطلقات الصفرية؟
الغرض من هذا البحث هو تطوير إطار عمل جديد ومتكيف للبيانات العلمية الحيوية الطبية يستفيد من التعلم المحدود والصفر لمعالجة التحديات التي تفرضها ندرة البيانات الموسومة. تهدف الدراسة إلى تعزيز قدرات التعميم في BioBERT ونماذج اللغة الكبيرة من خلال استكشاف تقنيات الهندسة الفورية، والتعلم التبايني، والتدريب الخصمي.
يركز البحث على الأهداف التالية: (1) تطوير خط أنابيب تعلم بضع خطوات لعلم العلوم الطبيعية الحيوي الطبي من خلال ضبط BioBERT على بيانات مشروحة محدودة. (2) تقييم نماذج اللغة الكبيرة ذات الطلقات الصفرية (مثل GPT-4، LLaMA، فالكون) للعلم الطبيعي الطبي الحيوي باستخدام هندسة التوجيه الخاصة بالمجال. (3) إنشاء نهج هجين يدمج الضبط الدقيق ل BioBERT مع التسميات الزائفة المولدة من قبل نماذج اللغة الكبيرة لتحسين التعرف على الكيانات في مجموعات البيانات الطبية الحيوية منخفضة الموارد. (4) إجراء تحليل مقارن بين الطلقات القليلة مقابل الطلقات القليلة التعلم ذو الطلقات الصفرية باستخدام المعايير الطبية الحيوية القياسية (MedMentions، BC5CDR، i2b2 2010، PharmaCoNER، BioASQ). (5) تنفيذ التدريب التنافسي (FGSM، PGD) لتعزيز متانة النموذج ضد التغيرات الصاخبة في النصوص الطبية الحيوية.
تساهم هذه الدراسة في مجال معالجة اللغة الطبيعية الحيوية الطبية والتعرف على الكيانات من خلال تقديم استراتيجيات BioNER ذات الطلقات القليلة والصفرية لمعالجة ندرة الملصقات في مجموعات البيانات الطبية الحيوية وتوضيح كيف يمكن الاستفادة من نماذج اللغة الكبيرة في NER الطبي الحيوي بدون حقن من خلال هندسة الفور المحسنة. اقتراح إطار عمل هجين يجمع بين ضبط BioBERT الدقيق والتعليقات الاصطناعية المولدة بواسطة نماذج اللغة الكبيرة لتعميم أفضل. تقييم تأثير التدريب الخصمي على نماذج BioNER لتحسين المتانة ضد تحولات المجالات. يوفر معيارا مقارنة لأداء BioNER عبر نماذج خاضعة للإشراف، ونماذج الطلقات القليلة، ونماذج الطلقات الصفرية.
مسح الأدبيات
طور سيفاراجكومار ووانغ20 برنامج HealthPrompt، وهو إطار عمل للتعلم بنظام الحقن الصفري (ZSL) لمعالجة معالجة اللغة الطبيعية السريرية التي تعالج نقص مجموعات البيانات السريرية المشروحة. بدلا من ضبط نموذج لغوي مدرب مسبقا (PLM)، استخدموا التعلم القائم على التوجيه، حيث يتم ضبط تعريفات المهام باستخدام قوالب منظمة. أظهر تقييمهم لستة نماذج PLM، بما في ذلك BioBERT وClinicalBERT، على مجموعة بيانات MIMIC-III أن ClinicalBERT حقق أفضل دقة (85٪) وأفضل درجة F1 (86٪) لتصنيف النصوص السريرية. تظهر هذه الدراسة أن التعلم الصفري القائم على الأوامر (ZSL) يمكنه مواكبة النماذج الخاضعة للإشراف في معالجة اللغة الطبيعية السريرية (NLP)، دون الحاجة إلى أي بيانات تدريبية.
طور كيمينغ لو والفريق21 تقنية BIODLM، وهي نهج جديد لضبط نماذج اللغة التمييزية (DLMs) للمجال الطبي الحيوي من خلال التدريب المسبق المستمر القائم على الطلبات. كان هدفهم الرئيسي تحسين الأداء في المهام القليلة والصفر في الطب الحيوي من خلال الاستفادة من ضبط الأوامر الذكية وطريقة اكتشاف الرموز المستبدل (RTD). لجعل الأمر ينجح، يلعبون بالمفردات، ويخلطون مصطلحات خاصة بالمجال عمدا، ويستخدمون PubMedBERT كمولد أثناء التدريب المسبق. النتائج متينة: فقد تفوق BIODLM فعليا على الضبط الدقيق المعتاد المعتمد على CLS، حيث حقق دقة متوسطة متوسطة بلغت 50.2٪ مع الإشراف الكامل و43.4٪ في وضع الطلقة الصفرية.
اتبع زونغهاي ياو وزملاؤه22 نهجا مختلفا، يركزون على توليد المحفزات التي تأخذ في الاعتبار تباين السياق. كان هدفهم تقليل التحيزات الغريبة التي قد تنشأ أثناء الفحص القائم على الطلبات وجعل تقييم BioLAMA أكثر شفافية وقابلية للتفسير. بعبارة أخرى، يحاولون التأكد من أن هذه النماذج اللغوية تعطينا إجابات منطقية وليست مجرد استدعاء لمحفزات ذكية الصياغة الدقيقة.
قدموا مقياس تقييم قائم على تغيير الرتبة (UCM: فهم-ارتباك-سوء فهم) بدلا من دقة Top-k التقليدية لتقييم PLMs بناء على التعرف على الكيانات الطبية الحيوية. أظهرت التجارب على 12 وحدة PLM، بما في ذلك نماذج BioBERT وClinicalBERT وRoBERTa، تحسنا في أداء BioLAMA للعلاقات الكبيرة بين N-M والكيانات الطبية الحيوية النادرة. حقق BioBERT Accuracy@1 بنسبة 40.7٪ وقابلية فهم UCM بنسبة 32.8٪، متفوقا على مقاييس Top-k التقليدية.
درس ييه وآخرون 23 التحفيز لاستخراج العلاقات الطبية الحيوية باستخدام مجموعة بيانات ChemProt لتعزيز ضبط البيانات الدقيقة والكاملة في المجالات المحددة. صمموا قوالب قائمة على الموجه تدمج مقاييس تقييم مثل التكرار، والتحديدية، والتشابه لتحسين اختيار كلمات التسمية. باستخدام قاعدة BioMed-RoBERTa، حققت طريقتهم درجة F1 بلغت 90.09، متفوقة على SciFive-Large بفارق 1.14 F1 وتجاوزت الضبط الدقيق العادي بمقدار 14.21 F1. هذا يؤكد أن التعلم القائم على التوجيه يحسن أداء NER الطبي الحيوي مع تقليل أمثلة التدريب.
درس سوسانتي وهولسمويل 24 التحقق القائم على معالجة اللغة الطبيعية للرسوم السببية، وقارنوا نماذج اللغة المضبوطة بدقة ونماذج اللغة الطويلة المعتمدة على الطلبات. دربوا نماذج BioBERT وGPT على تصنيف العلاقات السببية تحت الإشراف وقيموا نماذج اللغة الكبيرة المعتمدة على الأوامر ذات الطلقات الصفرية والقليلة الطلقات. كشفت النتائج على مجموعات البيانات الطبية الحيوية والبيانات مفتوحة المجال أن النماذج المضبوطة بدقة تفوقت على طلبات نماذج اللغة الكبيرة، محققة درجات F1 أعلى تصل إلى 20.5٪. تسلط الدراسة الضوء على الحاجة إلى التوجيه المتقدم والضبط الخاص بمجموعة البيانات لتحسين دقة استخراج العلاقات السببية.
اقترح تشين وآخرون 25 إطار عمل لتوليد الحالات والتعلم التبايني الفوري الموجه بالمعرفة لتقنية BioNER القليلة الطلقات. يستفيد نهجهم من الرسوم البيانية للمعرفة في المجال لتوليد كيانات طبية حيوية متنوعة ويستخدم التعلم التبايني القائم على أسئلة وأسئلة موجه لتعزيز التعرف على الكيانات من خلال قياس المعلومات المتبادلة بين أزواج الاستعلام والإجابة. تم تقييمهم على مجموعات بيانات fbenchmark (NCBI، BC5CDR-Disease، BioNLP11EPI، BioNLP13GE)، وحقق نموذجهم تحسنا بنسبة تصل إلى 7.1٪ في درجات F1 مقارنة بالنماذج الحديثة في سيناريوهات 20 جرعة. كودهم متاح للجمهور على: https://github.com/cpmss521/KGPC.
اقترح تشين وآخرون أيضانهجا للتعلم السريع لاكتشاف المطالبات الطبية الحيوية من خلال تحويل تصنيف النصوص إلى مهمة نمذجة لغوية مقنعة (MLM). باستخدام BERT وRoBERTa وT5 مع قوالب صلبة ومختلطة، حسنوا دقة التنبؤ بالمطالبات. في مجموعة بيانات BioClaim، حقق نموذج T5 مع القوالب المختلطة تحسنا بنسبة F1 بنسبة 5.3٪ مقارنة بالنماذج السابقة، مما يعالج الفجوة بين التدريب المسبق والضبط الدقيق في PLMs باستخدام التنبؤ بالرموز المقنعة.
قام رايان شيا يينغ كونغ تان وآخرون بتقييم نماذج اللغة الكبيرة لاستنتاج استجابة مرض السرطان من تقارير الأشعة باستخدام نماذج المحولات، وBi-LSTM، وCNN، وML الكلاسيكي. شملت طريقتهم تعزيز البيانات (تبديل الجملة وفقدان الاتساق) والضبط الدقيق القائم على الطلبات. حقق محول GatorTron أفضل دقة: 0.8916 في مجموعة الاختبار و0.8976 بعد التعزيز. مكنت الضبط الدقيق القائم على الأوامر من أداء فعال مع ما يصل إلى 500 تقرير معنون.
قام هو وآخرون بتقييم GPT-3.5 وGPT-4 للعلاج السريري العصبي، مع تعزيز الأداء عبر إطار عمل توجيه مكون من أربعة أجزاء: التوجيهات الأساسية، التعليمات المستندة إلى الإرشادات، التعليمات القائمة على الأخطاء، وعينات من اللقاح القليلة. في مجموعات بيانات MTSamples وVAERS، حسنت GPT-3.5 وGPT-4 درجاتهما المرنة في F1 من 0.634/0.804 و0.301/0.593 إلى 0.794/0.861 و0.676/0.736 على التوالي. على الرغم من أنها لا تزال متأخرة عن BioClinicalBERT (F1: 0.901 في عينات MTSamples، 0.802 على VAERS)، إلا أن هذه النتائج تظهر فعالية متزايدة لنماذج LLMs في NER السريري مع استراتيجيات تحفيز مناسبة.
الوصول مقيد. يرجى تسجيل الدخول أو بدء فترة تجريبية لعرض هذا المحتوى.
1. الإجراءات


2. الإعداد البيئي
الوصول مقيد. يرجى تسجيل الدخول أو بدء فترة تجريبية لعرض هذا المحتوى.
تم إجراء تقييم نموذج التعرف على الكيانات الطبية الحية ذات الطلقات القليلة والصفرية على مجموعة بيانات طبية حيوية متنوعة مستمدة من ملخصات PubMed، والملاحظات السريرية، ومجموعات الأسئلة الطبية الحيوية. تم إجراء تحليل أداء مقارنة مع نماذج راسخة، بما في ذلك BioBERT، ClinicalBERT، RoBERTa، PhenoBERT29، GPT-3.5، وGPT-4. حقق النموذج المقترح دقة إجمالية متفوقة بلغت 89.8٪، ودقة 88.7٪، واستدعاء 90.5٪، ودرجة F1 بلغت 0.895. يمثل هذا الأداء زيادة كبيرة مقارنة ب ClinicalBERT (دقة...
الوصول مقيد. يرجى تسجيل الدخول أو بدء فترة تجريبية لعرض هذا المحتوى.
نتائج متضاربة، ونتائج غير متوقعة، وتناقضات مع أبحاث أخرى
على الرغم من الأداء المتفوق للنموذج المقترح، ظهرت نتائج متضاربة عند مقارنتها بالدراسات القائمة. أظهرت النماذج المبنية على BioBERT تقليديا أداء قويا في التعرف على الكيانات المسماة الطبية الحيوية (NER)، كما ورد في مسوحات سابقة ودراسات مقارنة لأنظمة NER الطبية الحيوية 4,10. بينما تحقق البنى المعتمدة على المحولات دقة عالية باستمرار في مهام معالجة اللغة الطبي...
الوصول مقيد. يرجى تسجيل الدخول أو بدء فترة تجريبية لعرض هذا المحتوى.
المؤلفون ليس لديهم ما يكشفون عنه.
| الاسم | الشركة | رقم فهرسي | التعليقات |
|---|---|---|---|
| النموذج الأساسي | قاعدة BioBERT (الإصدار 1.1) | وجه العناق : مونولوج/بايوبيرت-v1.1 | |
| إطار التعلم العميق | PyTorch 2.3.1 | https://pytorch.org/ | |
| أجهزة وحدة معالجة الرسومات | NVIDIA A100 (ذاكرة فيديو 40GB) | NVIDIA | |
| نموذج اللغة الكبيرة (LLM) | GPT-4 | واجهة برمجة تطبيقات OpenAI | |
| نظام التشغيل | ويندوز | مايكروسوفت | |
| ضبط فعال من حيث المعلمات | LoRA (عبر مكتبة PEFT 0.6.2) | https://github.com/huggingface/peft | |
| لغة البرمجة | بايثون 3.9.18 | مؤسسة بايثون للبرمجيات | |
| نموذج القاعدة الصفري للطلقة | GPT-3.5-Turbo | واجهة برمجة تطبيقات OpenAI |
الوصول مقيد. يرجى تسجيل الدخول أو بدء فترة تجريبية لعرض هذا المحتوى.
طلب إذن لإعادة استخدام النص أو الأشكال في مقالة JoVE هذه
طلب إذن