9. Januar 2026
Wir schlagen einen auf Reinforcement Learning basierenden Feinabstimmungsansatz für große Sprachmodelle vor, der den Enti Hallucination Index (EHI) als Belohnungssignal nutzt, um Halluzinationen auf Entitätsebene in Textzusammenfassungen zu reduzieren. Experimente mit Protokollen zeigen, dass diese Methode die Treue und Genauigkeit der Entitäten verbessert.