9 de janeiro de 2026
Propomos uma abordagem de ajuste fino baseada em aprendizado por reforço para grandes modelos de linguagem que utiliza o Índice de Alucinação Enti (EHI) como sinal de recompensa para reduzir alucinações em nível de entidade na sumarização de texto. Experimentos com transcrições de reuniões mostram que esse método melhora a fidelidade e a precisão das entidades.