Araştırma makalesi

Transformer Tabanlı BERT Modellerinin Kullanım Örneği Olarak Kapalı Alan Anlamsal Soru Cevaplama Sistemi

DOI:

10.3791/69424

14 Kasım 2025

Bu makalede

Özet

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

Bu çalışma, Google-BERT, DistilBERT, RoBERTa ve TF-IDF modelini karşılaştırarak, kosinüs benzerliğini kullanarak, gecikme ve anlamsal genelleme üzerine soruları yanıtlamak için metinden bilgi çıkarmak için uyarlanabilir bir öğrenme sistemi tasarlamaktadır. Google-BERT en iyi performansı gösterir, ancak sistem yazım hatalarına karşı hassas olmaya devam eder ve pratik uygulama için güçlü ön işleme ihtiyacını vurgular.

Özet

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

Metin dosyalarından bilgi çıkarmak ve bağlam içinde doğru bilgiyi bularak kullanıcıların sorularını yanıtlamak için Soru Yanıtlama Sistemi (QAS) gibi uyarlanabilir bir öğrenme sistemi bu amaçla tasarlanmıştır. Bu odak, doğrudan yanıt sistemleri ve Soru Cevaplama (QA) görevleri için büyük ölçekli testlerin kullanımı hakkında daha fazla çalışmayı teşvik eder. Bunu kolaylaştırmak için, hem olgusal hem de olgusal olmayan soruları kapsayan Anlamsal Kapalı Alan QA (SCD-QA) veri kümesi, önceden eğitilmiş transformatör modelleriyle birlikte kullanılır. Bu çalışmada, SQuAD veri kümesi üzerinde Google-BERT, DistilBERT ve RoBERTa gibi önceden eğitilmiş üç transformatör modeli ile kosinüs benzerliğine sahip klasik bir anahtar kelime tabanlı TF-IDF modeli arasında çıkarım yapma yeteneği ölçülmüş ve karşılaştırılmıştır. Sonuçlar, Google-BERT'in ortalama Tam Eşleşme (EM) puanı 90,0 ve ortalama 1,27 sn gecikme süresiyle en iyi performansı gösterdiğini gösteriyor. Sistem ayrıca eşanlamlı sorularda da iyi performans gösterir ve anlamın güçlü bir şekilde anlaşıldığını gösterir. Ancak yazım hataları olan sorularda yetersiz performans gösterir, bu da yazım hatalarına karşı hassas olduğunu ve kullanımda daha iyi erken işlem gerektirdiğini gösterir.

Giriş

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

Doğal Dil İşleme (NLP), QAS'ın oluşturulabildiği ve bilgisayar sistemlerinin sorulara otomatik olarak yanıt üretmesine olanak tanıyan Yapay Zekanın (AI) bir alt alanıdır1. NLP öncelikle yazılı dilin insan beyninin bilişsel süreçlerini taklit edecek şekilde anlaşılmasına ve yorumlanmasına odaklanır2. Bu görevlere katılmak, NLP'yi insan benzeri yanıtlar üretebilen bir sistem oluşturmada çok önemli bir teknik haline getirir.

Kullanıcının sorularına yanıt veren QAS, NLP'nin nasıl kullanıldığına bir örnektir3. QAS, Bilgi Erişimi (IR), Bilgi Çıkarma (IE) ve NLP gibi ortak sorunları olan çeşitli alanlardaki araştırmaları içeren bir çalışma alanıdır. Şu anda, çağdaş arama motorları öncelikle belge alma görevlerini yerine getirmektedir4. Başka bir deyişle, belirli anahtar kelimeler sağlandığında, bu arama motorları yalnızca alaka düzeyine göre sıralanmış ve belirtilen anahtar kelimeleri içeren ilgili belgelerin bir listesini verir. Kesin bir cevap vermiyorlar. QAS'ın amacı, bireylerin sınırlı konu alanlarında belirli sorulara kesin yanıtlar bulmalarına yardımcı olmaktır5. QAS'ın gruplandırılması, Şekil 16'da özetlenen aşağıdaki kategorilere göre yapılabilir. Hem olgusal hem de olgusal olmayan QAS, doğal dil (NL) kullanarak çalışır ve NL'de sorulan sorulara yanıt vermek üzere tasarlanmıştır. Sistem, mevcut derlem7'ye dayalı yanıtlar sağlamak için NLP tekniklerini kullanır.

Şekil 1
Şekil 1: QA sistemlerinin sınıflandırılması. Şekil, bir QA sisteminin birincil bileşenlerinin bir zihin haritasını göstermektedir. Merkezde, gerçekler, gerçekler olmayanlar, melezler, görseller, konuşma ve çoktan seçmeli sorular dahil olmak üzere çeşitli soru türlerini ele alan QA Sistemi bulunmaktadır. Bu rakamın daha büyük bir sürümünü görüntülemek için lütfen buraya tıklayın.

Bu çalışma, NL'deki kullanıcılara doktora kabul politikaları ve prosedürleri hakkında yanıt vermek için Anlamsal Kapalı Alan Soru Cevaplama (SCD-QA) sistemi sunmaktadır. Sistem, Ph.D. kurallar ve düzenlemeler PDF8'i temel bağlamı olarak kullanır ve yanıt üretmek için ana çerçeve olarak transformatör tabanlı Transformatörlerden Çift Yönlü Kodlayıcı Temsilleri (BERT)9 modelini uygular. Amaç, sık sorulan sorulara doğru yanıtlar veren, yeni kabul edilen öğrencilerin ihtiyaç duydukları temel bilgileri hızlı bir şekilde bulmalarını kolaylaştıran, anlamsal olarak konuşmaya dayalı SSS tabanlı bir QAS tasarlamaktır.

Bu amaca ulaşmak için, yaygın olarak bilinen üç transformatör tabanlı BERT modeli kullanıldı: Google-BERT9, DistilBERT10,11 ve RoBERTa 12,13, tümü Stanford Soru Yanıtlama Veri Kümesi (SQuAD)14 üzerinde eğitildi. Performansları iki kritik parametre kullanılarak değerlendirildi: Tam Eşleşme (EM)14 ile ölçülen anlamsal eşleştirme ve ortalama reaksiyon süreleriyle analiz edilen model Gecikme15. Ek olarak, anlamsal yerleştirmeleri depolamak için bir Vektör Veritabanı (VD)16,17 kullanıldı ve anlamsal benzerlik puanlarına dayalı olarak bir kullanıcının sorusu için anlamsal olarak en alakalı bağlamın alınmasını kolaylaştırdı.

Literatür taraması

Transformatör tabanlı modeller, NLP alanını elden geçirerek QAS'ta önemli gelişmeler sağladı. BERT9'un piyasaya sürülmesi, transformatör mimarilerinin sağlam ve hassas QAS geliştirmede önemli bir bileşen olduğunu kesin olarak vurguladı. Bu bölümde, transformatör tabanlı modellerdeki ve anlamsal yerleştirmelerdeki son gelişmelerin, Anlamsal Konuşma Diyaloğu (SeCD) QA ile ilgisine odaklanarak kapsamlı bir incelemesi sunulmaktadır. Bu modellerin bu çalışmaya entegrasyonunu haklı çıkarmak için karşılaştırmalı bir analiz yapılmış ve bu alanda anlamlı içgörüler elde etmek için uygulanabilirlikleri vurgulanmıştır.

BERT, DistilBERT ve RoBERTa gibi transformatör tabanlı mimariler, metindeki karmaşık bağlamsal ilişkileri yakalamak için öz-dikkat metodolojisini kullanır, bu da onları QAS gibi önemli anlamsal anlayış gerektiren görevler için ideal kılar. Bu modeller, özel cümle dönüştürücülerle birlikte anlamsal yerleştirmeler oluşturur ve SeCD QA'da vektör tabanlı benzerlik aramaları yoluyla hızlı ve kesin bağlam alımının sağlanmasına yardımcı olur. Son araştırmalar, özellikle SCD-QA gibi göreve özel kullanımlar için verimi, ölçeklenebilirliği ve verimliliği artırmak için bu modelleri geliştirmeye ve teknikleri yerleştirmeye odaklanmaktadır.

Sengupta ve ark.18 BERT modellerine ince ayar yaparak bilime dayalı sorular için Çoktan Seçmeli QAS'yi (ÇMYK) artırmak için yaratıcı bir yaklaşım ortaya koymuşlardır. Kendi çerçevelerinde, önce soru-cevap çiftleri arasındaki dağıtılmış anlamsal benzerliği değerlendirdiler ve ardından bu benzerlik puanlarını orijinal özelliklerle birlikte bir sınıflandırma katmanına beslediler. Bu birleşik yaklaşım, SciQ veri setinde %90,2'lik bir F1 puanı elde ederek, BERT'in incelikli anlayış ve kesin sınıflandırma gerektiren göreve özel QAS'lardaki etkinliğini vurguladı.

Cichecki ve ark.19 , akıllı tasarım destek sistemleri için ChatGPT ve ince ayarlı BERT modellerini karşılaştırmış ve ince ayarlı BERT modellerinin, alana özgü görevlerde ChatGPT gibi genel amaçlı Büyük Dil Modellerini (LLM'ler) geride bıraktığını ve özel olarak tasarlanmış bir veri kümesinde %88,5'lik bir F1 puanı elde ettiğini bulmuşlardır. Çalışma, özel uygulamalarda model performansını artırmak için alana özgü ince ayarın önemini göstermektedir.

Guo ve ark.20 , sınırlı açıklama bütçeleri altında QAS'ler için göreve özgü ince ayar stratejilerinin etkinliğini incelemiştir. Çalışmaları, başlangıçta SQuAD gibi genel bir QA veri kümesi üzerinde ve ardından göreve özel bir veri kümesi üzerinde ince ayar yapmak üzere çift ince ayar yaklaşımının, COVID-QA gibi veri kümelerinde F1 puanında %15'lik önemli bir ilerleme sağladığını ortaya koydu. Bu bulgu, SeCD QAS'ların performansını artırmada sıralı ince ayarın kritik rolünü vurgulamaktadır.

Pudasaini ve Shakya21 , biyomedikal araştırma makalelerinde QA için ince ayarlı BERT modellerinin uygulanmasını incelediler ve PubMed'den alınan özel bir biyomedikal QA veri kümesinde sırasıyla %83,89 ve %89,67'lik EM ve F1 puanları bildirdiler. PubMedBERT ile transfer öğreniminden yararlanan teknikleri, karmaşık biyomedikal sorguları işleme konusunda dikkate değer bir yetenek sergiledi ve bu alanda göreve özel ince ayar potansiyelini vurguladı.

Baek ve ark.22 , sıfır atışlı Bilgi Grafiği (KG) QA için Bilgi Artırılmış Dil Modeli Yönlendirme çerçevesini önerdi. Bu yaklaşım, bir KG'den ilgili gerçekleri almak için anlamsal benzerlikleri kullanır ve bunları girdi sorusuna dahil eder. Sonuç olarak, KG-QA veri kümelerinde yaklaşık %85'lik bir F1 puanı elde etti. Çalışma, KG'leri ve transformatör modellerini birleştirmenin potansiyelini göstererek, QA performansını artırmada bilgi artırmanın faydalarını vurgulamaktadır.

Hu ve ark.23 , niyet sınıflandırması ve anlamsal analiz için BERT tabanlı modellerin (RoBERTa-BiLSTM-MultiHeadAttention) yanı sıra bir KG'den yararlanan, hane halkı kayıt alanı için tasarlanmış bir QAS tanımlamıştır. Soruları tek olaylı varlıklara ve niyet ilişkilerine basitleştirerek, yapılandırılmış verilerin sorgulanmasında yüksek doğruluk elde edildi. Ayrıca metodolojinin diğer alanlara ölçeklenebilirliği, KG tabanlı QAS'ta geniş çapta uygulanabilirlik potansiyelini vurgulamaktadır.

Luo ve ark.24 , Bilgi Bankası (KB) QA için BERT tabanlı bir şema sunmuş ve Çok Tanecikli Budama Modeli'ni (MGPM) ilişkiye duyarlı dikkatle entegre etmiştir. Yaklaşımları, SimpleQuestions'da %94.4, WebQuestionsSP'de %68.6 ve WebQuestions'da %63.7 gibi önemli doğruluklar elde etmektedir. Bu sonuçlar, BERT'in yapılandırılmış veri sorguları için anlamsal benzerlikten yararlanmadaki etkinliğini göstermektedir. Genel olarak bu çalışma, özellikle kesin varlık ve ilişki tanımlamasının önemli olduğu senaryolarda, KB-QA için transformatör tabanlı modellerin potansiyelini vurgulamaktadır.

Wu ve ark.25 , güvenlik ve uyumluluk sorgularına özel olarak odaklanarak, inşaat yönetiminde QA için geri alma artırılmış bir üretim çerçevesi tasarladı. BERT tabanlı anlamsal yerleştirmeleri üretken bir transformatör modeli ve göreve özel bir KG ile entegre ederek yaklaşımları, inşaatla ilgili bir QA veri kümesinde %1'lik bir F88.7 puanı elde etti. Bu çalışma, inşaat yönetimi için göreve özel bir QA veri kümesinde doğruluğu artırmak için anlamsal anlayışı KG tabanlı erişimle birleştirme potansiyelini göstermektedir.

Peng ve ark.26 BERT ve GPT tabanlı modeller de dahil olmak üzere LLM'leri tıbbi QA için sistematik olarak değerlendirmiştir. BERT'in bağlamsal anlayışını ve GPT'nin üretken yeteneklerini birleştirerek, PubMed ve klinik notlardan elde edilen bir veri kümesinde %86,2'lik bir F1 puanı elde etmek için erişimle artırılmış üretim ve alana özgü ince ayar kullandılar. Bu çalışma, hem bağlamın hem de kesin üretimin kritik olduğu sağlık hizmetlerinde topluluk modellerinin çıkarım doğruluğunu artırma potansiyelini vurgulamaktadır.

Gardazi ve ark.27 BERT'in QA, duygu analizi ve Adlandırılmış Varlık Tanıma (NER) gibi NLP görevlerinde kullanımını gözden geçirmişlerdir. Analizleri, ince ayarlı BERT modellerinin, SQuAD gibi göreve özel QA veri kümelerinde %85-%92 arasında F1 puanlarına ulaştığını gösterdi. Bu, BERT'in güvenilir bir şekilde etkili bağlamsal yerleştirmeler ürettiğini ve KG'ler eklediğini ve bu da onu SeCD QAS için çok uygun hale getirdiğini gösterir.

Transformatör tabanlı modeller, bağlama duyarlı işlemeyi yakalama, verimli bir şekilde ölçeklendirme ve alana özgü görevlere uyum sağlama konusundaki benzersiz yetenekleri nedeniyle SeCD QAS'lar için belirleyici seçim haline geldi. Tablo 1, transformatör tabanlı modelleri bu çalışmada incelenen alternatif yöntemlerle karşılaştırarak bu belirleyici avantajı göstermektedir 18,20,22,23,24,25.

YaklaşmakAna ÖzelliklerAvantaj -larıSınırlamaPerformans Metrikleri (SQuAD)Kullanım Senaryosuna Uygunluk
Transformatör Tabanlı Modeller (BERT, RoBERTa, DistilBERT)Çift yönlü bağlam modelleme, öz-dikkat, alana özgü veriler üzerinde ince ayar 16, 17, 19, 24, 25Yüksek doğruluk, sağlam anlamsal anlayış, vektör veritabanları 18, 20, 22, 24, 25 ile ölçeklenebilirDaha yüksek hesaplama maliyeti, ön eğitim gerektirir 17, 18EM: %80-90, F1: %85-93 16, 17, 19, 24, 25Kapalı Etki Alanı (CD) -QA, SSS sistemleri ve anlamsal arama 16, 17, 19, 20, 22, 24, 25 için idealdir
Geleneksel Kural Tabanlı SistemlerEl yapımı kurallar, anahtar kelime eşleme 16Düşük hesaplama maliyeti, basit uygulama 16Sınırlı ölçeklenebilirlik, karmaşık sorguların kötü işlenmesi 16, 18EM: %50-60, F1: %55-65 16Yapılandırılmış verilerle temel QAS 16
Tekrarlayan Sinir Ağları (RNN'ler)Sıralı işleme, LSTM/GRU mimarileri 19Sıralı görevler için orta düzeyde performans 19Uzun menzilli bağımlılıklarla mücadele, daha yavaş çıkarım 19, 9EM: %65–75, F1: %70–80 19Genel NLP görevleri, CD-QA için daha az etkili 19, 9
Anahtar Kelime Tabanlı Alma SistemleriTF-IDF, BM25 algoritmaları 18, 22Hızlı erişim, düşük kaynak kullanımı 18, 22Yüzey düzeyinde eşleştirme ile sınırlı, zayıf anlamsal anlayış 18, 22EM: %40–50, F1: %45–55 18, 22Belge alma, hassas QAS 18, 22 için uygun değil
Evrişimli Sinir Ağları (CNN'ler)Yerel özellik çıkarımı, evrişimli katmanlar 25Kısa metin sınıflandırması için verimli, hızlı çıkarım 25Sınırlı bağlamsal anlayış, karmaşık QAS 25 için daha az etkiliEM: %60-70, F1: %65-75 25Metin sınıflandırması, CD-QA 25 için ideal değil
Grafik Sinir Ağları (GNN'ler)Grafik tabanlı modelleme, ilişkisel akıl yürütme 20Çok sekmeli akıl yürütme için etkilidir, belge ilişkilerini yakalar 20Yüksek hesaplama karmaşıklığı, yapılandırılmış veri gerektirir 20EM: %70–80, F1: %75–85 20Çok sekmeli QAS, tek bağlamlı CD-QA 20 için daha az uygundur
Bilgi Grafiği Tabanlı SistemlerYapılandırılmış bilgi temsili, varlık bağlama 21Yapılandırılmış veri sorguları için güçlü, dış bilgiden yararlanır 21Bilinen varlıklarla sınırlı, önceden oluşturulmuş bilgi grafikleri gerektirir 21EM: %65–75, F1: %70–80 21Yapılandırılmış verilerle alana özgü QAS 21
Dikkat Artırılmış ModellerGelişmiş dikkat mekanizmaları, bağlam odaklı işleme 24İlgili metin bölümlerine daha iyi odaklanma, yüksek doğruluk 24Daha yüksek hesaplama maliyeti, karmaşık uygulama 24EM: %85-90, F1: %88-92 24Karmaşık CD-QA, olgusal olmayan sorular 24
Kelime Çantası ModelleriKelime frekansına dayalı gösterim 22Basit, hesaplama açısından hafif 22Zayıf anlamsal anlayış, karmaşık sorgular için etkisiz 22, 25EM: %35–45, F1: %40–50 22Temel metin alma, QAS 22, 25 için uygun değil
Hibrit Sinir Modelleri (CNN+RNN)Yerel ve sıralı işlemeyi birleştirir 25Yerel ve bağlamsal anlayışı dengeler 25Orta karmaşıklık, uzun bağlamlarla mücadele 25EM: %68-78, F1: %72-82 25Genel NLP görevleri, CD-QA 25 için orta düzeyde uygunluk
İstatistiksel Dil ModelleriOlasılıksal kelime çağrışımları 18Basit sorgular için hızlı, düşük kaynak kullanımı 18Sınırlı bağlamsal anlayış, zayıf ölçeklenebilirlik 18EM: %45–55, F1: %50–60 18Temel QAS, karmaşık CD-QA 18 için uygun değildir

Tablo 1: Transformatör tabanlı modellerin QAS için diğer yaklaşımlarla karşılaştırılması. Tablo, Transformatör Tabanlı Modeller, Kural Tabanlı Sistemler, RNN'ler ve diğerleri dahil olmak üzere çeşitli QA sistemi yaklaşımlarının yan yana karşılaştırmasını sağlar. Ana özelliklerini, güçlü ve zayıf yönlerini, SQuAD'deki performanslarını ve CD-QA, anlamsal arama ve metin sınıflandırma gibi en uygun oldukları görevleri özetler.

Bu araştırmanın temel amacı, NLP'de verimli, ölçeklenebilir ve hassas SCD-QA sistemleri geliştirerek öğrencilerin kurumsal bilgiye erişimini artırmaktır. Spesifik olarak, bu doğrulayıcı çalışma, doktora alanında önceden eğitilmiş transformatör tabanlı modelleri uygular ve doğrular. Amaç, anlamsal eşleştirme, model gecikme değerlendirmesi ve VD odaklı anlamsal erişimi birleştirerek bunların etkinliğini ve pratik fizibilitesini göstermektir. Bu yaklaşım, odaklanmış bir kurumsal bağlamda doğru, alana özgü yanıtlar sunmak için derinlemesine bir analiz sunar. Şekil 2 , sistemin bütünsel mimari çerçevesini göstermektedir.

Şekil 2
Şekil 2: SCD-QA sisteminin genel şeması. Şekil, büyük dil modellerini (LLM'ler) kullanan bir QA sisteminin akış şemasını göstermektedir. Bir bağlam dosyası ve bir kullanıcının sorusuyla başlar ve bunlar üç model tarafından ele alınır: Google-BERT, DistilBERT ve RoBERTa ve bir anahtar kelime tabanlı model: TF-IDF. Sistem, her modelin performansını bir kontrol listesi kullanarak değerlendirir ve ardından sonuçlara göre en iyisini seçer. Bu rakamın daha büyük bir sürümünü görüntülemek için lütfen buraya tıklayın.

Erişim kısıtlı. Bu içeriği görüntülemek için lütfen giriş yapın veya deneme sürümünü başlatın.

Protokol

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

Kapsamlı Teorik Temel

QAS Bileşeni: QAS çerçevesi, Şekil 3'te gösterildiği gibi üç bölümden oluşur: i) Soru işleme modülü (QPM), ii) Belge işleme modülü (DPM) ve iii) Yanıt çıkarma ve formülasyon modülü (AEFM). Sistem, iki ana kategoriye ayrılan soruları alır: Factoid ve Non-Factoid. Factoid sorular tipik olarak ne, nerede, ne zaman veya kim gibi soru sözcükleri kullanırken, Factoid olmayan sorular nasıl ve neden gibi sözcükler kullanır.

DPM: Sağlanan listeden kullanıcı belirli bir pasajı seçebilir. Ardından, pasajdaki her belirteç bir Konuşma Parçası (POS) Etiketleyicisi kullanılarak etiketlenir. Fiilleri ayıklamak için fiil olarak etiketlenmiş tüm belirteçleri tanımlayın. Bu fiilleri alışılmadık fiillerin bir listesiyle birleştirin ve düzenli fiiller için mantık uygulayın. Çıkarılan fiilleri, zamanlarını ve -ing formlarını içeren bir veri yapısı (dizi) oluşturun.

QPM: Sistem, kullanıcıdan soru şeklinde girdi alır. Metin, StringTokenizer sınıfı kullanılarak belirteç haline getirilir ve sonuçta elde edilen belirteçler ayrı bir veri yapısında depolanır. Bu veri yapısı daha sonra program içinde daha fazla kullanılmak üzere döndürülür.

AEFM: İlk adım, verilen sorudaki fiili tanımlamaktır. Yakın zamanda tanımlanan fiil artık belge işleme aşamasında oluşturulan belirteçlerle eşleştirilir. Belirli bir olgusal soru türü (ne veya ne zaman gibi) için seçilen durum, cevabı daha kesin bir şekilde çıkarmak ve oluşturmak için kullanılır.

Soru türünü seçmeden önce, kullanıcıdan ilk olarak kendi seçtiği pasajı seçmesi istenir. QPM, kullanıcının sorusunu işlemekten ve AEFM'ye iletmekten sorumludur. AEFM, DPM'den elde edilen ayıklamaları ve özgün giriş belgesinin etiketli biçimini içeren işlenmiş belgeleri kullanır. Modül, istenen cevabı elde etmek için gerekli algoritmaları formülasyon modülüne iletecektir.

Şekil 3
Şekil 3: QAS'ın bileşenleri. Şekil, bir QA sisteminin dört adımlı sürecini göstermektedir: Soru, Soru İşleme, Cevap İşleme ve Cevap. Soru İşleme'de sistem soruyu sınıflandırır. Yanıt İşleme'de, yanıtı üretmek için belgeleri ve pasajları bulur ve inceler. Bu rakamın daha büyük bir sürümünü görüntülemek için lütfen buraya tıklayın.

BERT modeli: Bir metindeki kelimeler arasındaki ilişkileri keşfetmek için BERT yöntemi bir dönüştürücü kullanır. Bir transformatörde iki mekanizma vardır - bir kodlayıcı ve bir kod çözücü28, ancak BERT için sadece kodlayıcı gereklidir. BERT iki yönlü bir yaklaşım benimser ve kelimelerin anlamlarını kendi bağlamlarında kendisine öğretmek için girdi metnini sistematik olarak tarar. Kodlayıcı, vektörleştirilmiş bir dizi belirteci girdi olarak alır. Vektörler daha sonra girdiyi yansıtan bir dizi vektör üreten sinir ağına beslenir. Bir kelimenin çıktı vektörü, içinde geçtiği cümleye bağlı olarak değişir. Bir kelimenin vektörü, göründüğü bağlama bağlı olarak değişebilir; örneğin, "Kriket oynamayı seviyor" cümlesindeki "like", "Yüzü domates gibi kırmızıya döndü" cümlesindeki "like" kelimesinden farklı bir vektöre sahiptir. Yaklaşım, model oluşturma aşamasına geçmeden önce bir metin işleme aşamasıyla başlar. BERT'in metni işlemek için attığı adımlar bir sonraki bölüm28'de tartışılmaktadır.

Metin işleme: BERT modeli, giriş metnini önceden belirlenmiş bir dizi ilkeye uygun olarak temsil eder. Ayrıca bu faktör modelin performansının artmasına da katkıda bulunur. BERT'e girdi gömme, üç farklı gömme tipinin28 bir karışımından oluşur.

Pozisyon gömmeleri (PE'ler): Gömmelerdeki düzen ile ilgili bilgileri öğrenmek için PE'ler kullanılır. PE'ler, transformatörlerde kaybolan düzen hakkındaki bilgileri geri yüklemek için kullanılır. BERT, girdi dizisindeki her nokta için özel olarak farklı PE'ler geliştirir. BERT, PE'leri kullanarak bir cümle içindeki kelimelerin konumsal bilgilerini iletme yeteneğine sahiptir. Bu, BERT'in kelimelerin sırasını veya sırasını etkili bir şekilde yakalamasını ve temsil etmesini sağlar.

Cümle yerleştirmeleri (SE'ler): Ek olarak, modelin birinci ve ikinci cümleleri ayırt etmesine yardımcı olmak için BERT, her biri için benzersiz olan bir yerleştirme öğrenir. Ayrıca, QA gibi etkinlikler için girdi olarak eşleştirilmiş cümleleri kabul edebilir.

Belirteç eklemeleri (TE'ler): TE'ler, WordPiece belirteç sözlüğündeki her belirteç için öğretilir. WordPiece belirteç sözlüğü, derlemde bulunan kelimelerden türetilen alt kelime birimlerinden oluşur. Açıklayıcı bir örnek olarak, bu kelime koleksiyonu, Questio, Questi vb. dahil olmak üzere Soru teriminin akla gelebilecek tüm alt kelimelerini kapsayacaktır.

Bir token'ın giriş temsili, segment ve konum düzeylerinde yerleştirmelerinin bir araya getirilmesiyle oluşturulur. Bu nedenle, modele zengin bilgiler sağlayan kapsamlı bir gömme yaklaşımıdır. Şekil 49 , BERT modelinin yerleştirmelerini göstermektedir.

Şekil 4
Şekil 4: BERT yerleştirmeleri. Şekil, bir transformatör modeli için giriş yerleştirmelerinin nasıl oluşturulduğunu gösterir. Bir giriş dizisiyle başlar: [CLS] [MASK] gökyüzü bulutlu [EYLÜL] yağmur yağacak [EYLÜL]. Dizideki her belirteç, Ethe veya E[MASK] gibi kendi yerleştirmesini alır. Ardından, her cümle için birincisi için EA ve ikincisi için EB gibi cümle yerleştirmeleri eklenir. Her bir belirtecin konumunu belirtmek için E0 ila E9 olarak etiketlenen konumsal yerleştirmeler de dahil edilmiştir. Bunların tümü, son girdi yerleştirmelerini oluşturmak için birleştirilir. Bu rakam9'dan değiştirildi. Bu rakamın daha büyük bir sürümünü görüntülemek için lütfen buraya tıklayın.

BERT kullanarak QAS tasarımı: Açıklama amacıyla, bu soruyu Football League28 ile ilgili bir Wikipedia girişinden alınan bir paragrafla birlikte inceleyin.

Soru: Futbol Ligi nerede kuruldu?

Pasaj: 1888'de İngiltere'de Futbol Ligi kuruldu ve birçok profesyonel futbol müsabakasının ilki oldu. 20. yüzyılda, çeşitli futbol türlerinin birçoğu büyüyerek dünyanın en popüler takım sporlarından biri haline geldi.

Cevap: İngiltere

BERT modeli, hem sorudan hem de bağlamdan belirteç çıkarımını kullanır ve ardından bunları birleşik bir girdide birleştirir. Daha önce de belirtildiği gibi süreç, bir cümlenin başlangıcı için bir gösterge görevi gören bir [CLS] tokeninin kullanılmasıyla başlar. Ek olarak, soruyu ve pasajı belirgin bir şekilde ayırmak için bir [SEP] ayırıcı kullanılır. BERT, [SEP] belirtecine ek olarak, soru ile cevabı içeren28 . pasaj arasında ayrım yapmak için SE'leri de içerir. BERT, aralarında net bir ayrım yapmak için biri soruya, diğeri pasaja adanmış iki SE kullanır. Gömmeler daha sonra soru ve pasaj arasında ayrım yapmak için belirteçlerin tek sıcak temsili28 ile birleştirilir. Bu süreç Şekil 5'te gösterilmektedir.

Şekil 5
Şekil 5: BERT giriş gösterimi. Şekil, BERT tabanlı bir QAS için girdi yerleştirmelerinin nasıl oluşturulduğunu göstermektedir. [CLS] belirteci ile başlar, ardından Kaç tane sorusu gelir? [SEP] ve BERT büyük pasajı, her biri kendi cümle yerleştirmeleriyle birlikte (soru için A, pasaj için B). Belirteç, cümle ve konumsal yerleştirmeler, son girdiyi yapmak için birleştirilir. Bu rakamın daha büyük bir sürümünü görüntülemek için lütfen buraya tıklayın.

Daha sonra, soru ve bağlamın birleşik gömülü temsili28 , BERT modelinde girdi olarak kullanılır. BERT'in son gizli katmanı, olasılık dağılımları oluşturmak için SoftMax'i kullanacak şekilde değiştirilir. Bu dağılımlar, görsel bir temsil için Şekil 6'da gösterildiği gibi bir yanıtı temsil eden giriş metni cümlesi içindeki bir alt dizenin başlangıç ve bitiş indekslerini belirler.

Şekil 6
Şekil 6: QA için BERT işleme iş akışı. Şekil, BERT modelinin QA için nasıl çalıştığını göstermektedir. Başlangıçta bir sınıflandırma belirteci [CLS] ve sonunda bir [SEP] ayırıcı belirteci ile işaretlenmiş bir soru içeren bir giriş dizisi ve ardından başka bir [SEP] ile ayrılmış bir bağlam sunar. Bu dizideki belirteçler gömülülere dönüştürülür. Model daha sonra pasaj içindeki cevabın başlangıç ve bitiş konumlarını tahmin eder. Bu rakamın daha büyük bir sürümünü görüntülemek için lütfen buraya tıklayın.

Vektör veritabanı (VD): VD17,18, verilerin yüksek boyutlu vektör temsillerini verimli bir şekilde depolamak, yönetmek, indekslemek ve sorgulamak için özel bir sistemdir. Vektörler genellikle derin öğrenme modellerinden oluşturulur ve verilerle ilgili anlamsal veya bağlamsal bilgileri kapsar. Bir vektörün her boyutu belirli bir özelliği temsil eder. Gömmeler, metin, resim, video ve ses gibi nesnelerin sayısal temsilleridir. Bu yerleştirmeler, Makine Öğrenimi (ML), NLP, öneri sistemleri, bilgisayarlı görme ve IR dahil olmak üzere çeşitli uygulamalarda kullanılır. VD'ler, benzer nesneleri vektör uzayında birbirine yakın gruplandırarak etkili benzerlik aramalarını ve anlamsal sorgulamayı kolaylaştırır. Facebook Yapay Zeka Benzerlik Araması (FAISS)29, bu çalışmada kullanıcı sorguları için en alakalı bağlamı belirlemek amacıyla kullanılan önemli bir VD'dir. Tablo 2, VD'lerin temel özelliklerini ve kullanım durumlarını özetlemektedir.

ÖzellikAçıklama
Yüksek Boyutlu VerilerYüzlerce veya binlerce boyuta sahip verileri işler.
Yaklaşık En Yakın Komşu (YSA)Mesafeleri yaklaşık olarak tahmin ederek hızlı benzerlik aramaları sağlar.
ÖlçeklenebilirlikMilyarlarca vektör içeren büyük ölçekli veri kümelerini destekler.
EntegrasyonGenellikle sorunsuz iş akışları için AI/ML çerçeveleri ve araçlarıyla entegre olur.
Gerçek Zamanlı SorgularEtkileşimli uygulamalar için düşük gecikmeli vektör aramaları sağlar.

Tablo 2: VD'nin temel özellikleri. Tabloda VD'nin önemli özellikleri vurgulanmaktadır. Bunlar arasında yüksek boyutlu verilerin işlenmesi, YSA algoritmalarını kullanarak hızlı benzerlik aramaları yapılması, büyük veri kümelerine ölçeklendirilmesi, yapay zeka ve makine öğrenimi araçlarıyla çalışma ve etkileşimli kullanım için hızlı, gerçek zamanlı sorguların desteklenmesi yer alır.

Performans değerlendirme metrikleri: SCD-QA sistemi iki temel metrik kullanılarak değerlendirildi: EM skoru14 ve model Gecikmesi15. QA çalışmalarında standart bir ölçüm olan EM puanı, temel gerçekle tam olarak eşleşen tahmin edilen yanıtların oranını ölçerek tahmin doğruluğunu değerlendirir. Bir dizi N soru için, EM puanı Denklem 1'de resmi olarak aşağıdaki gibi tanımlanır:

Denklem 1nerede Denklem 2 (1)

Bu metrik, referans yanıtla tam eşleşme için 1 ve herhangi bir fark için 0 puan atar.

Gecikme süresi ölçümü, sistemin tek bir sorguya yanıt oluşturmak için gereken toplam işlem süresini ölçer. Bu ölçüm, Denklem 2'de sunulduğu gibi tüm sorgularda geçen ortalama süre olarak hesaplanır:

Denklem 3 (2)

burada Tbaşlangıçi ve Tbitişi sırasıyla i. sorguyu işlemenin başlangıcını ve sonunu işaretleyen zaman damgalarıdır. Gecikme s cinsinden raporlanır ve giriş işlemeden yanıt oluşturmaya kadar tüm aşamaları kapsayan sistemin yanıt verme hızını yakalar.

Yöntem

SCD-QA'yı uygulamak için aşağıdaki test çalışmaları bu makaleye dahil edilmiştir.

SCD-QA veri kümesi: SCD-QA sisteminin uygulanması için önerilen bir veri kümesi30 tanıtıldı. Bu veri kümesi, Hindistan'ın NIT Arunaçal Pradeş'teki öğrenci yönergeleri için 20228 için doktora kurallarını içeren bir metin külliyatından türetilmiştir. SCD-QA sistemini kurmak için, ilgili tüm bilgileri kesin bir biçimde kapsayacak bir JSON dosyası oluşturmak gerekir. Veri kümesi, açık kaynaklı bir çerçeve olan Haystack açıklama aracı (sürüm 2.18.1)31 kullanılarak metin külliyatından oluşturulur. Bu araç, SCD-QA veri kümesinin SQuAD14 tarzında oluşturulmasını kolaylaştırır. PDF dosyasından SQuAD tipi açıklamalı veri kümesi oluşturma adımları Şekil 7'de, veri kümemizin SQuAD stilindeki yapısı ise Şekil 8'de gösterilmektedir.

Şekil 7
Şekil 7: PDF dosyasından açıklamalı veri kümesi oluşturma adımları. Şekil, Haystack araçlarını kullanarak SQuAD tarzı açıklamalı bir veri kümesi oluşturmak için adım adım bir iş akışını göstermektedir. PDF'lerden metin çıkarma, temizleme ve pasajlara bölme, soru-cevap çiftlerine manuel olarak açıklama ekleme, ek açıklamaları SQuAD JSON formatında saklama ve son olarak model eğitimi için veri kümesini dışa aktarma sürecini özetlemektedir. Bu rakamın daha büyük bir sürümünü görüntülemek için lütfen buraya tıklayın.

Şekil 8
Şekil 8: Factoid QA veri kümesinin yapısı. Şekilde, bir veri kümesinden bir paragrafı ve QA çiftini temsil eden bir JSON veri yapısı gösterilmektedir. Bir dizi soru ve cevap içeren bir paragraflar bölümü vardır. Bir soru soruyor: Doktora programına kabul edilmek için gereken minimum not nedir? Her sorunun bir kimliği ve bir dizi yanıtı vardır. Yanıt, bir belge kimliği, soru kimliği, metin %60 işaretleri, yanıtın başlangıç konumu ve belirtilmemiş bir yanıt kategorisi içerir. is_impossible bayrağı false olarak ayarlanır. Bu rakamın daha büyük bir sürümünü görüntülemek için lütfen buraya tıklayın.

Veri kümesi, her sözlüğün veri, paragraflar, soru, answer_id, document_id, question_id, metin, answer_start, answer_end, is_impossible ve bağlam gibi temel alanları içerdiği bir sözlük listesi olarak yapılandırılmıştır.

data: Genel soru-cevap bilgilerini içerir.
paragraflar: Soruları ve cevaplarıyla birlikte belirli bir bağlam.
soru: Belirli bir soru.
answer_id: Her yanıt metni için benzersiz bir kimlik numarası.
document_id: Her bağlam için benzersiz bir kimlik numarası.
question_id: Her soru için benzersiz bir kimlik numarası.
text: Cevap metni.
answer_start: Bağlam içinde doğru cevabın başlangıç konumu.
answer_end: Doğru cevabın bağlam içindeki cevap bitiş konumu.
is_impossible: Sorulan sorunun cevabının bağlamda mevcut olup olmadığını söyler.
context: Bir cevabın bulunabileceği metin derlişi.
Önerilen veri setindeki 80 sorunun tümü, olgusal ve olgusal olmayan soru formatını takip eder. Bazı çerçeveli soru türlerinin örnekleri Tablo 3'te gösterilmektedir.

Soru
PS kimdir?
Son teknoloji belgenin yazı tipi boyutu nedir?
Doğum İzninde kaç gün var?

Tablo 3: Veri kümesinden örnek soru. Tabloda iki tür soru örneği gösterilmektedir: birinci ve ikinci olgusal sorular, üçüncüsü ise olgusal olmayan bir sorudur.

FAISS: Facebook AI Research (FAIR) tarafından geliştirilen FAISS (sürüm faiss_cpu-1.9.0)29,32, yoğun vektörlerin verimli benzerlik aramasını ve kümelenmesini kolaylaştıran açık kaynaklı bir kütüphanedir. Büyük ölçekli, yüksek boyutlu verileri etkili bir şekilde yönetmek için özel olarak tasarlanmıştır. Bu sistem, milyonlarca veya milyarlarca vektörden oluşan veri kümeleri içinde hızlı ve ölçeklenebilir YSA aramalarını kolaylaştırır. NLP, öneri sistemleri ve görüntü veya video alımı dahil olmak üzere yerleştirmelerle ilgili uygulamalarda yaygın olarak kullanılır. FAISS, Düz (kaba kuvvet), Ters Dosya (IVF), Hiyerarşik Gezilebilir Küçük Dünya grafikleri (HNSW) ve ürün niceleme (PQ) dahil olmak üzere birden fazla indeksleme yöntemi sunar. Bu yöntemler, kullanıcıların arama performansını veri boyutuna, boyutluluğa ve donanım özelliklerine göre optimize etmelerini sağlar. Bu çalışmada, en yakın komşuları belirlemek için L2 (Öklid) mesafesini kullanarak kaba kuvvet araması yapan düz indeksleme kullanılmıştır. Sistemin ölçeklenebilirliği hem CPU hem de GPU uygulamalarını destekleyerek kapsamlı veri kümelerinde yüksek performanslı hesaplamalara olanak tanır. Ek olarak, belirli uygulama gereksinimlerine göre hız ve doğruluk arasındaki dengeyi optimize etme esnekliği sağlar. FAISS, NLP'de BERT veya Word2Vec gibi yerleştirmelerdeki anlamsal benzerliği değerlendirmek için sıklıkla kullanılır. FAISS, QAS'ta belgelerin veya cümlelerin vektör temsillerini depolamak ve yönetmek için kullanılır. Kullanıcı soruları için en uygun bağlamı almak için yaklaşık YSA aramaları33 gerçekleştirir ve BERT gibi dönüştürücü modellerden yerleştirmelerle anlamsal aramayı geliştirir. FAISS, çok yönlülüğü nedeniyle yapay zeka ve makine öğrenimi iş akışlarında temel bir araçtır.

BERT-büyük-büyük-bütün-kelime-maskeleme-ince ayarlı- SQuAD modeli: Bu çalışma, çalışmada önerilen veri kümesini kullanarak olgusal bir QAS geliştirmek için BERT-büyük-büyük-tam-kelime-maskeleme ince ayarlı-ekip9 olarak bilinen önceden eğitilmiş bir dil modelini kullanmaktadır. BERT modeli, listeler, tablolar ve başlıklar hariç olmak üzere, 11.038 yayınlanmamış kitaptan9 oluşan bir veri kümesi olan BookCorpus'un yanı sıra İngilizce Vikipedi üzerinde ön eğitimden geçmiştir. Söz konusu model kılıfsızdır, yani ingilizce ve ingilizce kelimeleri arasında ayrım yapmaz. Model, kendi kendini denetleyen bir yaklaşım kullanılarak önemli miktarda İngilizce veri üzerinde eğitilmiş, önceden eğitilmiş bir transformatör modelidir. Model, herhangi bir insan açıklaması olmadan yalnızca ham metinler üzerinde önceden eğitildi. Bu, kamuya açık büyük miktarda veriden yararlanmasına olanak tanır. Ön eğitim süreci, sağlanan metinlerden otomatik olarak girdiler ve etiketler oluşturmayı içerir. Model iki özel hedefle eğitilmiştir9:

MLM: Süreç, giriş cümlesindeki kelimelerin %15'inin9 rastgele maskelenmesini içerir. Model daha sonra maskelenmiş cümlenin tamamını işler ve maskelenmiş kelimeleri tahmin eder. Bu yaklaşım, genellikle kelimeleri sırayla işleyen geleneksel Tekrarlayan Sinir Ağlarından (RNN'ler) ve gelecekteki belirteçlerin dahili maskelemesini kullanan GPT gibi otoregresif modellerden farklıdır. İşlevsellik, modelin cümlenin çift yönlü bir temsilini elde etmesini sağlar.

NSP: Ön eğitim aşamasında model, iki gizlenmiş cümleyi girdi olarak birleştirir. Bazı durumlarda, bu cümleler orijinal metinde bitişiktir ve bu da doğrudan bir ilişkiye işaret eder. Diğer durumlarda, değildirler, yani onları birbirine bağlayan orijinal bir yakınlık veya bağlam yoktur. Sonraki adım, modelin iki cümlenin mantıksal olarak tutarlı olup olmadığını tahmin etmesini içerir.

Mevcut model, sonraki konfigürasyonla karakterize edilir: model mimarisi, 1024 gizli boyuta sahip 24 katmandan oluşur. 16 dikkat başlığı kullanır ve toplam 336 milyon parametreye sahiptir9.

WordPiece, ön işleme adımlarında 30.000 kelimelik kelime dağarcığı boyutuna sahip metinleri tokenize etmek için kullanılır. Modelin girdileri daha sonra şöyle görünecektir: [CLS] Cümle A [SEP] Cümle B [SEP]. Tek şart, birleştirilmiş cümlelerin toplam uzunluğunun 512 belirteçten az olmasıdır9. Önceden eğitilmiş spesifik model sonraki çıktıyı verir: elde edilen F1 puanı %93,15 iken kesin eşleşme puanı %86,91'dir9.

Distilbert/distilbert-base-cased-distilled-squad modeli: DistilBERT10 modeli, BERT9 modelinin daha kompakt, hızlı ve verimli bir çeşididir ve BERT'in anlamsal anlama yeteneğinin çoğunu korumak için geliştirilmiş, aynı zamanda daha az kaynak yoğun ve sınırlı hesaplama kapasitesine sahip pratik uygulamalar için daha uygundur. distilbert-base-cased-distilled-squad sürümü, QA görevleri için SQuAD14'te ince ayar yapılmıştır. Model, BERT'in 66 milyonuna karşılık 110 milyon parametrenin küçültülmüş boyutu da dahil olmak üzere transformatör mimarisini kullanırken, BERT'in dili anlamadaki etkinliğinin %97'sini koruyor. DistilBERT buna, bilgileri daha büyük BERT modelinden daha kompakt DistilBERT modeline aktaran Bilgi Damıtma olarak bilinen bir yöntem kullanarak ulaşır. Daha küçük boyutu nedeniyle, bilgileri daha hızlı çıkarabilir ve daha az bellek kullanabilir, bu da onu mobil veya uç cihazlar gibi kaynakları kısıtlı uygulamalar için mükemmel kılar. SQuAD 1.1 veri kümesi üzerinde dikkatli bir şekilde ince ayar yapılan model, amacın belirli bir bağlamdan bir soruyu yanıtlayan bir metin bölümünü bulmak olduğu, çıkarımsal QA görevlerinde olağanüstü bir yeterlilik sergiliyor. DistilBERT, SQuAD liderlik tablosunda BERT'in F1 puanının yaklaşık %85'ini elde eder ve küçültülmüş boyutuna rağmen BERT'in dil kapasitesinin önemli bir bölümünü korur. Bu model, üretim düzeyindeki QA işleri için hem performansı hem de hesaplama verimliliğini optimize eden son derece verimli bir çözümdür.

Deepset/roberta-base-squad2: Deepset/roberta-base-squad2 model12,13, RoBERTa mimarisinin ince ayarlı bir çeşididir. Hem cevaplanmış hem de cevaplanamayan soruları içeren SQuAD14 2.0 veri kümesi için özel olarak tasarlanmıştır. Bu geliştirilmiş RoBERTa çerçevesi, BERT'in9 NSP işini ortadan kaldırır. Ayrıca, NL anlama görevlerinde verimliliği ve performansı artırmak için eğitim sırasında dinamik maskeleme kullanır. Model 125 milyon parametreye sahiptir ve çift yönlü bir transformatör kullanır. Bu, her iki yönden de bağlamsal bilgi edinmesine ve çıkarıcı QA görevlerinde başarılı olmasına olanak tanır.

SQuAD 2.0'da ince ayar, modelin belirli bir bağlamda doğru yanıt aralığını belirlemesine ve yanıt olmadığında bunu fark etmesine olanak tanır. Alt kelime tokenizasyonunu işleyen ve büyük/küçük harf duyarlılığını koruyan bir Bayt Çifti Kodlama (BPE) tokenizeri kullanır. Bu, alışılmadık ve karmaşık kelimeleri işleme yeteneğini geliştirir. Model iyi bir performans sergiliyor ve kabaca %85-%90 F1 ve %80-%85 EM elde ediyor. Cevaplanamayan soruları tespit etme yeteneği ve etkili dağıtımı, onu müşteri hizmetleri, bilgi erişimi ve sanal asistanlar için değerli kılmaktadır.

QA için SQuAD ince ayarlı BERT modellerini dağıtmanın en etkili yolu, Hugging Face Transformers ardışık düzenini34 kullanmaktır. Bu çerçeve, tokenizasyonu, girdi biçimlendirmeyi, model yüklemeyi ve çıktı sonrası işlemeyi kolaylaştırır. Bu modeller, cevabın doğrudan verilen bağlamdan alınan bir metin aralığı olduğu, çıkarımsal QA'daki etkinlikleriyle geniş çapta tanınmaktadır. Uygulamaya yol göstermek için, aşağıdaki yordam BERT modellerini yürütme adımlarını özetlemektedir.

Giriş ve kurulum: Bu işlem dört ana giriş ve kurulum parametresi gerektirir: Hugging Face Hub'dan dize tanımlayıcısı olarak belirtilen model adı (örneğin, google-bert/bert-large-uncased-whole-word-masking-finetuned-squad, distilbert/distilbert-base-cased-distilled-squad veya deepset/roberta-base-squad2); sorguyu içeren bir dize olarak sağlanan soru (Q); ve ilgili metni veya pasajı temsil eden bir dize olan bağlam (C). Kullanılan birincil araç, Python'daki (sürüm 3.12.12) Hugging Face transformatörleri kitaplığındaki (sürüm 4.57.0) üst düzey işlem hattı işlevidir.

İşlem: Yürütme (Hugging Face Pipeline): Süreç altı temel adımdan oluşur ve QA görevinin karmaşıklığını ele almak için Hugging Face ardışık düzenini kullanır:

Kitaplığı Yükle: Gerekli kitaplığı pip install transformers komutuyla yükleyerek başlayın. Bu kurulum, modellere ve kolaylaştırılmış boru hattı işlevselliğine erişim sağlar.

İthalat İşlem Hattı: Boru hattı işlevini şunu kullanarak içe aktarın: transformatörlerden boru hattını içe aktarın.

QA İşlem Hattını Başlatın: qa_pipeline = pipeline("soru-cevaplama", model="") kullanarak QA işlem hattını başlatın. Bu komut, modeli ve belirteç oluşturucuyu indirerek çıkarım için hazır hale getirir.

Girişi Tanımla: Soru ayarla = ... ve bağlam = ... modelin verilerini hazırlamak için.

Çıkarımı Çalıştır: Soruyu ve bağlamı sonuç = qa_pipeline(soru=soru, bağlam=bağlam) ile işlem hattına geçirin. Model girdiyi işler ve bir yanıt sağlar.

Cevabı Çıkar: Şunu kullanarak çıktı sözlüğünden yanıt dizesini alın: answer = result['answer'].

Çıktı: İşlem, aşağıdaki sırayla birkaç çıkış parametresi üretir: Cevap (bağlamdan çıkarılan metin aralığı, dize olarak sunulur), Score (modelin tahminine olan güvenini ölçen kayan noktalı bir değer) ve Başlangıç ve Bitiş dizinleri (bağlam içindeki yanıt aralığının karakter konumlarını belirten tamsayılar).

Cümle dönüştürücüleri/tüm-MiniLM-L6-v2: All-MiniLM-L6-v235 , Sentence-Transformers kitaplığından (sürüm 5.1.1)36 önceden eğitilmiş bir cümle dönüştürücüsüdür. Verimli, hassas metin yerleştirme için optimize edilmiştir. Microsoft'un MiniLM çerçevesi üzerinde geliştirilen bu uygulama, altı transformatör katmanı ve 384 boyutlu yerleştirmeler içerir. Bu tasarım, performansı ve hesaplama yeterliliğini dengeleyerek onu gerçek zamanlı uygulamalar için uygun hale getirir. Model, SNLI, MultiNLI, STS kıyaslamaları ve web'de taranan veriler gibi veri kümelerinden bir milyardan fazla kelime öbeği çifti üzerinde eğitildi. Sonuç olarak, anlamsal benzerlik, gruplama ve aramayla ilgili görevlerde yeterlilik gösterir. Küçük boyutu (~22MB) ve gelişmiş çıkarım performansı nedeniyle all-MiniLM-L6-v2, anlamsal arama, çoğaltma algılama ve metin kategorizasyonu gibi uygulamaları basitleştirir. Hafif olmasına rağmen STS-B ve SICK-R gibi kıyaslamalarda güçlü doğruluk sağlar ve bu da onu hem ölçeklenebilir hem de sınırlı kaynak senaryoları için etkili bir seçim haline getirir. Cümle Dönüştürücüsü kullanarak gömme oluşturmaya yönelik iş akışı aşağıdaki Şekil 9'da gösterilmektedir.

Şekil 9
Şekil 9: Cümle dönüştürücü modelini kullanarak gömme işleminin adımı. Şekil, cümle dönüştürücüleri çerçevesini kullanarak metin eklemeleri oluşturmaya yönelik iş akışını göstermektedir. Kütüphanelerin içe aktarılmasından ve önceden eğitilmiş bir modelin yüklenmesinden metin verilerinin hazırlanmasına, gömmelerin oluşturulmasına, bunların NumPy dizilerine dönüştürülmesine ve indeksleme veya benzerlik araması gibi aşağı akış görevleri için saklanmasına kadar olan süreci özetlemektedir. Bu rakamın daha büyük bir sürümünü görüntülemek için lütfen buraya tıklayın.

Önerilen algoritma: Bu çalışma, kullanıcılar tarafından sorulan hem olgusal hem de olgusal olmayan soruları ele alabilen SeCD tabanlı SCD-QA sisteminin geliştirilmesi için Algoritma 1'de önerilen bir metodolojiyi özetlemektedir.

ALGORİTMA 1: Önerilen SeCD tabanlı SCD-QA sisteminin algoritması
Giriş: Ham bağlam dosyası kümesi (C) ve Kullanıcının sorgusu (Q).
Çıktı: Seçilen optimal transformatör tabanlı LLM (M') ve M' tarafından oluşturulan yanıt.
Ön İşleme Bağlamları: DSQuAD formatında yapılandırılmış bir veri seti oluşturmak için ham bağlam seti C'ye not ekleyin.
DSQuAD = fannonat (C)
Bağlam Gömmeleri Oluşturun: Her bağlamı c Denklem 100 DSQuAD'yi bir gömme ec'ye dönüştürmek için bir Cümle Dönüştürücü fgömmesi kullanın.
Denklem 15
Gömmeleri Saklayın: Verimli benzerlik araması için Ec'yi V vektör veritabanında saklayın.
Denklem 18
Sorgu Gömme Oluşturun: Kullanıcının Q sorgusunu aynı Cümle Dönüştürücüsü kullanarak bir gömme eq'ya dönüştürün.
Denklem 20
Bağlam Alma: eq'ya benzerliğe dayalı olarak V veritabanından en alakalı bağlam yerleştirmeyi Denklem 21 alın.
Denklem 22
burada sim(eq,e c), benzerlik fonksiyonudur.
Bağlamı LLM'lere Aktarın: Alınan bağlamı Denklem 21 3 dönüştürücü tabanlı LLM'ye besleyin: Google-BERT (M1), DistilBERT (M2), RoBERTa (M3) ve geleneksel bir model: TF-IDF+Kosinüs Benzerliği (M4)
Denklem 28
Model Değerlendirmesi: Her yanıtı puanlayan bir değerlendirme fonksiyonu kullanarak {R1,R 2,R 3,R 4} yanıtlarını karşılaştırın.
Denklem 31
En İyi Modeli Seçin: En yüksek değerlendirme puanı S' olan M' modelini belirleyin
Denklem 33
Son Çıktıyı Oluşturun: Son yanıtı R oluşturmak için M' kullanın.Denklem 36
Denklem 37
Son

Önerilen algoritma süreci, kullanıcı sorularını yanıtlamak için ideal bir transformatör tabanlı LLM'nin seçilmesine yönelik sistematik bir yaklaşımın (Şekil 10) ana hatlarını çizmektedir. Yüksek kaliteli ve bağlamsal olarak alakalı yanıtları garanti etmek için ön işleme, yerleştirme tabanlı bağlam alımı ve çoklu model değerlendirmesini içerir. Aşağıda, netlik sağlamak için adım adım süreç açıklanmaktadır:

Veri Hazırlama ve Ön İşleme: İlk aşama, ham metinsel verilerin işlenmesini içerir.

Giriş: Ham metin dosyaları8 sisteme uyarlanır.

Ek Açıklama Aracı31: Girdi, SQuAD14 formatında yapılandırılmış bir veri kümesine dönüştürülür. Bu adım, QA çiftleri oluşturmayı içerir. Ayrıca ilgili metinsel verileri iyi tanımlanmış bağlam blokları halinde düzenler.

Çıkış: Veri kümesi artık ekleme oluşturmaya hazırdır.

Bağlam Yerleştirme Oluşturma: Verimli ve ölçeklenebilir bağlam alımını sağlamak için, açıklamalı veri kümesine eğitimli bir Sentence-Transformer35,36 modeli uygulanır. Bu dönüştürücü, metni anlamsal anlamı yakalayan yüksek boyutlu yerleştirmelere dönüştürür. Yerleştirmeler, hızlı benzerliğe dayalı aramalar sağlamak için VD, FAISS 29,32'de saklanır.

Kullanıcı Sorgu İşleme: Bir kullanıcı bir soru gönderdiğinde, soru aynı Cümle Dönüştürücü35,36 tarafından işlenir. Bu, bağlam gömmeleriyle aynı vektör uzayına29,32 karşılık gelen bir gömme oluşturur. Bu tasarım, sorgunun ilgili bağlam girdileriyle eşleştirilebilmesini sağlar.

Vektör Benzerliğini Kullanarak Bağlam Alma: Sistem, bir benzerlik metriği (örneğin, kosinüs benzerliği) kullanarak sorgu yerleştirmeyi depolanan bağlam yerleştirmeleriyle karşılaştırır. Sistem, en yüksek benzerlik puanına göre en alakalı bağlamı seçer. Bu, aşağı akış modellerine yalnızca ilgili bağlamın iletilmesini sağlar. Süreç, hesaplama yükünü azaltır ve alaka düzeyini artırır.

Birden Çok LLM'de Model Değerlendirmesi: Seçilen bağlam, transformatör tabanlı üç LLM tarafından değerlendirilir: Google-BERT28, DistilBERT10 ve RoBERTa12. Ayrıca, kosinüs benzerlik modeline sahip geleneksel bir anahtar kelime tabanlı TF-IDF37 ile değerlendirilir. Her model bağlamı işler ve kullanıcının sorusuna bir yanıt oluşturur.

Karşılaştırmalı Değerlendirme: Dört LLM modelinden alınan yanıtlar iki temel ölçüm kullanılarak değerlendirilir. İlk olarak, anlamsal eşleştirme EM14 tarafından değerlendirilir. İkinci olarak, model Gecikmesi, ortalama reaksiyon süreleri15 ile analiz edilir.

Model Seçimi ve Nihai Çıktı: En iyi performans gösteren model, kullanıcının sorusuna uygun LLM olarak seçilir. Seçilen modelden gelen nihai yanıt dikkate alınır. Bu, hesaplama verimliliği ile yanıt kalitesi arasında bir denge sağlar.

Şekil 10
Şekil 10: Transformatör tabanlı modeller kullanan SCD-QA sisteminin iş akışı. Şekil, SCD-QA sisteminin nasıl çalıştığını göstermektedir. İlk olarak, ham bağlam dosyası, SQuAD formatında bir veri kümesi oluşturmak için bir açıklama aracı tarafından işlenir. Daha sonra bir cümle dönüştürücüsü, bir FAISS vektör veritabanında saklanan yerleştirmeler oluşturur. Bir kullanıcı bir soru sorduğunda, sistem bunun için bir yerleştirme oluşturur ve en alakalı bağlamı seçer. Üç transformatör tabanlı modeli (Google-BERT, DistilBERT ve RoBERTa) ve bir geleneksel TFIDF + kosinüs benzerlik puanını karşılaştırır ve yanıtı sağlamak için en iyi performans göstereni kullanır. Bu rakamın daha büyük bir sürümünü görüntülemek için lütfen buraya tıklayın.

Erişim kısıtlı. Bu içeriği görüntülemek için lütfen giriş yapın veya deneme sürümünü başlatın.

Sonuçlar

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

SCD-QA sistemi uygulamasında dört LLM ve 80 olgusal ve olgusal olmayan sorudan oluşan bir veri kümesi kullanıldı. İşleme, 12,7 GB sistem RAM'i, 15 GB GPU RAM ve 112,6 GB disk alanına sahip NVIDIA Tesla T4 GPU'lar (Sürücü Sürümü: 550.54.15, CUDA Sürümü: 12.4) kullanılarak Google Colab'da gerçekleştirildi. Model performansı iki metrik kullanılarak değerlendirildi: anlamsal eşleştirme için EM14 ve tepki süreleri için model gecikmesi15 .

Erişim kısıtlı. Bu içeriği görüntülemek için lütfen giriş yapın veya deneme sürümünü başlatın.

Tartışma

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

Bu çalışma, yapılandırılmış kurumsal belgelerden kesin, bağlama duyarlı yanıtlar sunmak için transformatör tabanlı dil modellerinden yararlanan SCD-QA sistemini tanıtmaktadır. Sistemin iş akışı şunlardan oluşur: (1) veri ön işleme; (2) son teknoloji ürünü cümle transformatörü all-MiniLM-L6-v2'yi kullanarak yerleştirme; (3) FAISS aracılığıyla benzerliğe dayalı erişim; ve (4) kapsamlı model değerlendirmesi. Boru hattı, kurumsal politika belgelerinden alınan 80 dikkatlice açıklamalı, cevapl...

Erişim kısıtlı. Bu içeriği görüntülemek için lütfen giriş yapın veya deneme sürümünü başlatın.

Açıklamalar

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

Yazarların açıklayacak hiçbir şeyi yoktur.

Teşekkürler

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

Yazarlar, bu çalışma boyunca sarsılmaz destekleri ve rehberlikleri için NIT Arunaçal Pradeş'in kendini işine adamış öğretim üyelerine ve yönetimine minnetle teşekkür eder. Ek olarak, çalışmaları bu araştırmayı mümkün kılan açık kaynaklı NLP araçlarının ve önceden eğitilmiş modellerin geliştiricilerine ve katkıda bulunanlara derinden minnettarız. Bu makalenin hazırlanması sırasında yazarlar, anlaşılırlığı artırmak için Grammarly Proofreader'ı kullandılar. Yazarlar, içeriğin doğruluğu ve bütünlüğü konusunda tüm sorumluluğu üstlenirler.

Erişim kısıtlı. Bu içeriği görüntülemek için lütfen giriş yapın veya deneme sürümünü başlatın.

Malzemeler

Bu makalede kullanılan malzemelerin listesi
AdŞirketKatalog numarasıYorumlar
tamamen MiniLM-L6-v2Microsoftversion 5.1.1Yüksek boyutlu gömüler üretmek için önceden eğitilmiş cümle transformatör modeli. Metni bağlam geri almak için gömülmelere dönüştürür.
Açıklama AracıHaystackSürüm 2.18.1Ham metnin SQuAD formatına yapılandırılması için bir platform. Veri setini QA çiftleri ve bağlam blokları oluşturarak hazırlar.
DistilBERT ModeliSarılma YüzüNAAzaltılmış hesaplama gereksinimlerine sahip hafif transformatör tabanlı LLM. Karşılaştırma için değerlendirildiğinde, daha düşük gecikme ama daha düşük doğruluk sunar.
FAISS VDFacebookfaiss_cpu-1.9.0Benzerlik tabanlı aramalar için ölçeklenebilir VD. Verimli sorgu eşleştirmesi için yüksek boyutlu gömülemeleri depolar ve alır.
Google-BERT ModeliGoogleNAÇift yönlü bağlam modellemesi ile önceden eğitilmiş transformatör tabanlı LLM. Factoid ve non-factoid sorgulara doğru yanıtlar üretmek için birincil model.
NVIDIA Tesla T4 GPU'larıNVIDIASürücü Sürümü: 550.54.15
CUDA Sürüm: 12.4
Model çıkarımı için 15 GB GPU RAM içeren GPU'lar. LLM'lerin işlenmesi ve değerlendirilmesi için hesaplama gücü sağlar.
PitonPython Yazılım Vakfıversion 3.12.12Python, basit sözdizimleri, kapsamlı kütüphaneleri ve güçlü topluluk desteği sayesinde Doğal Dil İşleme (NLP) alanında önde gelen bir programlama dilidir. Temel metin ön işleme ve karmaşık makine öğrenimi uygulamaları dahil olmak üzere çok çeşitli NLP görevlerini destekler.
RoBERTa ModeliDeepsetNAGeliştirilmiş eğitim stratejileriyle optimize edilmiş transformatör tabanlı LLM. Karşılaştırma için değerlendirildiğinde, doğruluk ve gecikme dengesini sağlar.
SCD-QA veri seti olarak SQuAD  BiçimNASürüm 2.0Soru-cevap çiftleri için standart format. Transformatör modellerle uyumluluk için yapılar veri seti.

Kaynaklar

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,
  1. Pirtoaca, G. S., Rebedea, T., Ruseti, S. Improving retrieval-based question answering with deep inference models. Int Joint Conf Neural Network. , 1-8 (2019).
  2. NLP-QA framework based on LSTM-RNN. Zhang, X., Chen, M. H., Qin, Y. Int Conf Data Sci Business Anal, , 307-311 (2018).
  3. Natural language processing based new approach to design factoid question answering system. Machhirke, V. S., Soni, A. Second Int Conf Inventive Res Computing Appl, , 276-281 (2020).
  4. Biancofiore, G. M., Deldjoo, Y., Di Noia, T., Di Sciascio, E., Narducci, F. Interactive question answering systems: literature review. ACM Comput Surv. 1 (1), Article 1(2024).
  5. Singh, S., Das, N., Michael, R., Tanwar, P. The question answering system using NLP and AI. Int J Sci Eng Res. 7 (12), 2229-5518 (2016).
  6. Pandya, H. A., Bhatt, B. S. Question answering survey: Directions, challenges, datasets, evaluation matrices. arXiv. , (2021).
  7. Khvalchik, M. A., Kulkarni, K. Open-domain non-factoid question answering. , Springer International Publishing. Cham. (2017).
  8. NIT Arunachal Pradesh PhD rules and regulations year. , National Institute of Technology Arunachal Pradesh. https://www.nitap.ac.in/storage/pdf/140508582e7c89a8b2295595085e3abe-%2003-37-28F%20IN%20AL.pdf (2022).
  9. Devlin, J., Chang, M. W., Lee, K., Toutanova, K. BERT: Pre-training of deep bidirectional transformers for language understanding. Proc NAACL-HLT. , 4171-4186 (2019).
  10. Sanh, V., Debut, L., Chaumond, J., Wolf, T. DistilBERT, a distilled version of BERT: Smaller, faster, cheaper and lighter. arXiv. , (2019).
  11. DistilBERT HuggingFace. , https://huggingface.co/distilbert/distilbert-base-cased-distilled-squad (2023).
  12. Liu, Y., et al. A robustly optimized BERT pretraining approach. arXiv. , (2019).
  13. RoBERTa base squad2. Deepset. , https://huggingface.co/deepset/roberta-base-squad2 (2023).
  14. SQuAD: 100,000+ questions for machine comprehension of text. Rajpurkar, P., Zhang, J., Lopyrev, K., Liang, P. Proc 2016 Conf Empirical Meth Natural Language Proc, , 2383-2392 (2016).
  15. Attention is all you need. Vaswani, A., et al. 31st Conf Neural Informat Proc Syst, , 1-11 (2017).
  16. Malkov, Y. A., Yashunin, D. A. Efficient and robust approximate nearest neighbor search using hierarchical navigable small world graphs. IEEE Trans Pattern Anal Mach Intell. 42 (4), 824-836 (2018).
  17. Similarity search in high dimensions via hashing. Gionis, A., Indyk, P., Motwani, R. Proc 25th VLDB Conf, , 518-529 (1999).
  18. HIJLI_JU at SemEval-2024 task 7: Enhancing quantitative question answering using fine-tuned BERT models. Sengupta, P., Sarkar, S., Das, D. Proc 18th Int Workshop Semantic Evaluat, , 279-284 (2024).
  19. Kocoń, J., et al. ChatGPT: Jack of all trades, master of none. Inf Fusion. 99, 101861(2023).
  20. Fine-tuning strategies for domain specific question answering under low annotation budget constraints. Guo, K., Diefenbach, D., Gourru, A., Gravier, C. IEEE 35th Int Conf Tools with Artificial Intell, , 166-171 (2023).
  21. Question answering on biomedical research papers using transfer learning on BERT-base models. Pudasaini, S., Shakya, S. 7th Int Conf I-SMAC (IoT in Social, Mobile, Analytics and Cloud), , 496-501 (2023).
  22. Knowledge-augmented language model prompting for zero-shot knowledge graph question answering. Baek, J., Aji, A. F., Saffari, A. Proc 1st Workshop Natural Language Reasoning Struct Explanat, , 78-106 (2023).
  23. Hu, S., Zhang, H., Zhang, W. Domain knowledge graph question answering based on semantic analysis and data augmentation. Appl Sci. 13 (15), (2023).
  24. A BERT-based approach for knowledge base question answering. Luo, D., Su, J., Yu, S. Int Joint Conf Neural Networks, , 1-8 (2020).
  25. Wu, C., et al. Retrieval augmented generation-driven information retrieval and question answering in construction management. Adv Eng Inform. 65, 103158(2025).
  26. Peng, C., et al. A study of generative large language model for medical research and healthcare. NPJ Digit Med. 6 (1), 210(2023).
  27. Gardazi, N. M., et al. applications in natural language processing: a review. Artif Intell Rev. 58 (6), 1-49 (2025).
  28. Sabharwal, N., Agrawal, A. Hands-on question answering systems with BERT: applications in neural networks and natural language processing. , Apress Berkeley. CA. (2021).
  29. FAISS documentation. , https://faiss.ai/ (2025).
  30. Bhattacharya, D. SCD-QA dataset. Zenodo. , (2025).
  31. Annotation tool. , https://docs.haystack.deepset.ai/docs/annotation (2025).
  32. Johnson, J., Douze, M., Jégou, H. Billion-scale similarity search with GPUs. IEEE Transac Big Data. 7 (3), 535-547 (2021).
  33. Sun, P., Guo, R., Kumar, S. Automating nearest neighbor search configuration with constrained optimization. arXiv. , (2023).
  34. BERT. , Hugging Face. https://huggingface.co/docs/transformers/model_doc/bert (2025).
  35. MiniLM: Deep self-attention distillation for task-agnostic compression of pre-trained transformers. Wang, W., et al. Proc 34th Int Conf Neural Informat Process Syst, , 5776-5788 (2020).
  36. Sentence transformer documentation. , https://www.sbert.net/ (2025).
  37. Cosine similarity to determine similarity measure: study case in online essay assessment. Lahitani, A. R., Permanasari, A. E., Setiawan, N. A. 4th Int Conf Cyber IT Service Manag, , 1-6 (2016).
  38. A comparative analysis of transformer models in zero-shot text classification. Kyritsis, K., Liapis, C. M., Spatiotis, N., Perikos, I., Paraskevas, M. 15th Int Conf Informat Intelligence Syst Applicat, , 1-4 (2024).
  39. Howard, J., Ruder, S. Universal language model fine-tuning for text classification. Proc 56th Ann Meeting Associat Computat Linguistics. , 328-339 (2018).
  40. Asai, A., Hashimoto, K., Hajishirzi, H., Socher, R., Xiong, C. Learning to retrieve reasoning paths over Wikipedia graph for question answering. arXiv. , (2019).
  41. Lewis, P., et al. Retrieval-augmented generation for knowledge-intensive NLP tasks. arXiv. , (2021).
  42. Leveraging passage retrieval with generative models for open domain question answering. Izacard, G., Grave, E. Proc Conf Eur Chapter Associat Computat Linguistics, , 874-880 (2021).

Erişim kısıtlı. Bu içeriği görüntülemek için lütfen giriş yapın veya deneme sürümünü başlatın.

Yeniden basım ve izinler

Bu JoVE makalesinin metnini veya şekillerini yeniden kullanmak için izin iste

İzin iste

Etiketler

Transformer ModelleriKapal Alan Soru CevapSQuAD Veri SetiFaktoid SorularFaktoid Olmayan SorularTF IDF ModeliKosin s Benzerli iE Anlaml E le tirmesi

İlgili makaleler