9 Ocak 2026
Metin özetlemede varlık düzeyindeki halüsinasyonu azaltmak için Enti Halüsinasyon İndeksi (EHI) ödül sinyali olarak kullanan büyük dil modelleri için pekiştirme öğrenme tabanlı ince ayar yaklaşımı öneriyoruz. Toplantı transkriptleri üzerinde yapılan deneyler, bu yöntemin varlık sadakatini ve doğruluğunu artırdığını göstermektedir.
Bu çalışma, AI özetli metinde yanlış varlık üretimini azaltmak için Varlık Halüsinasyon Endeksi'ni ödül sinyali olarak kullanmaktadır. Mevcut metrikler iki kaba durumda, bu protokol insan etiketleri olmadan gerçekliği artırmak için ince taneli varlık ödülleri kullanıyor. Başlamak için, çoklu turlu toplantı transkriptlerinden oluşan diyalog transkripsiyon veri seti ve XSum News özetleme kıstası dahil olmak üzere iki ana korpus kullanın.
Her veri setini temizleyin, veriyi düzleştirin ve %80 eğitim, %10 doğrulama ve %10 test setlerine ayırın. Sağlam topraklama sağlamak için transformatör tabanlı NER model D slim/BERT tabanlı bir NER kullanarak tokenizasyon ve varlık çıkarımı gerçekleştirin. Sıfır atış modunda, dört genişlikli ışın araması kullanarak başlangıç halüsinasyon prevalansını tahmin etmek için ilk özetler oluşturun.
Varlık halüsinasyon endeksini, varlıkları beş faktöre ayıran ve sadakati nicelikten yararlanan referanssız bir varlık düzeyi metrik olarak hesaplayın. Çıkarma ve olumlu halüsinasyonları ödüllendirin ve olumsuz halüsinasyonları, aşırı odaklanmış varlıkları ve odaklanmayı kaybetmeyi cezalandırın. Ödül fonksiyonunu varlık sadakatiyle orantılı olarak tanımlayın ve üretilen özetler arasında beklenen EHI ödülünü en üst düzeye çıkarın.
Model parametrelerini en üst düzeye çıkararak varlığın sadakatini maksimize etmek için güçlendirilmiş bir stil güncelleme mekanizması uygulayın. Parametre verimli ince ayar sağlamak için düşük rank adaptasyonu kullanın ve sadece LoRA adaptörlerini güncelleyin ve temel model ağırlıklarını dondurulmuş tutar. Sonra politika gradyanı güncellemeleri uygulayarak daha yüksek ödül çıktılarını teşvik edin ve her 500 güncellemede özetleri yenileyin, böylece ödül tahminleri yenilen.
Son olarak, ince ayarlanmış modelleri kullanarak nihai özetler oluşturun ve bunları temel sonuçlarla karşılaştırın. Rouge bir, Rouge iki ve Rouge L kullanarak bilgilendiricilik modellerini, akıcılık ve gerçek tutarlılığı için gerçek CC ve CAG'leri kullanarak değerlendirin. EHI'nin ince ayarı, modeller ve veri setlerinde halüsinasyonları azalttı ve gerçekliği artırdı; EHI'de sağa kaymalar ve CC dağılımları varlık sadakatini ve olgusal tutarlılığı artırdı, CAGS puanları ise büyük ölçüde değişmeden kaldı.
Zararlı halüsinasyon türleri olan negatif, aşırı odaklanma ve odaklanma kaybı Mistral'da ince ayarlamadan sonra azalmış, ekstraksiyon faktörü ise neredeyse iki katına çıkmıştır. Korelasyon analizi, Mistral ve DistilBART'ta EHI ve CAGS'nin zayıf bir korelasyon olduğunu gösterdi, ancak Flan-T5 daha güçlü bir pozitif korelasyon gösterdi. Araştırmacılar, otomatik EHI ödül sinyali kullanarak özetlerde varlık düzeyinde sadakat ve halüsinasyon oranlarını ölçebilirler.
En kritik zorluk, NER doğruluğudur; çünkü çıkarma hataları eğitim sırasında yanlış ödül hesaplamalarına yol açabilir. Gelecekteki çalışmalar, ortak referans çözümü ve bilgilendiricilik ödüllerini birleştirerek sadakati özet kapsamla daha iyi dengeleyebilir.
Tam transkripti görüntüleyin ve binlerce bilimsel videoya erişin
Bu makale, özetleyici özetlemedeki varlık düzeyindeki halüsinasyonları azaltmayı amaçlayan, büyük dil modelleri (LLM'ler) için ödül güdümlü yeni bir ince ayar çerçevesi sunmaktadır. Rehber bir metrik olarak Varlık Halüsinasyon Endeksi'nden (EHI) yararlanan bu yaklaşım, bilgilendiricilikten veya genellenebilirlikten ödün vermeden üretilen özetlerin olgusal doğruluğunu artırmaktadır.
Büyük dil modeli (LLM) özetlemesinde varlık düzeyindeki halüsinasyonlar, biyofarma Ar-Ge'sinde veri bütünlüğü ve karar verme süreçleri açısından önemli bir risk oluşturmaktadır.&D. Varlık Halüsinasyon İndeksi (EHI) kılavuzlu ince ayar çerçevesi, bu sorunu doğrudan ele alarak bilimsel ve operasyonel metin kaynaklarından olgusal bilgilerin daha güvenilir bir şekilde çıkarılmasını sağlar. Otomatik özetlemedeki artırılmış olgusallık, daha yüksek öngörü güvenini destekler ve bilgi odaklı veri hatlarında sonraki aşamalardaki riskleri azaltır.
EHI kılavuzlu ince ayar çerçevesi; keşif, tarama ve translasyonel araştırma süreçlerinin bilişim katmanına entegre olarak, güçlü varlık çıkarımı ve özetlemeyi desteklemektedir.