Les grands modèles linguistiques (LLM) sont de plus en plus utilisés pour l'éducation des patients en matière de santé, mais la lisibilité et la qualité éducative des informations générées par les LLM sur la névralgie du trijumeau (NT) ont été insuffisamment évaluées. Cette étude comparative transversale a analysé le contenu éducatif sur la NT produit par cinq LLM accessibles au public (Doubao, DeepSeek, Wenxin Yiyan, Tongyi Qianwen et GPT-5). Vingt questions fréquemment posées sur la NT, couvrant les connaissances fondamentales sur la maladie, l'étiologie/les facteurs de risque, le diagnostic, le traitement et la prévention/la réadaptation, ont été soumises à chaque modèle à l’aide d’instructions standardisées. La lisibilité a été évaluée à l’aide de sept indices reconnus, la pertinence éducative à l’aide de l’outil d’évaluation des supports pédagogiques pour patients (PEMAT) portant sur la compréhension et l’actionnabilité, et la qualité globale de l’information à l’aide du score de qualité global (GQS). Deux experts cliniques ont évalué indépendamment toutes les réponses, les désaccords étant tranchés par un arbitre principal. Des analyses statistiques ont comparé les performances des modèles, les différences thématiques et les corrélations entre les critères d’évaluation. Des différences significatives ont été observées entre les modèles concernant les scores de lisibilité, de PEMAT et de GQS. GPT-5 a produit les réponses les plus complexes sur le plan linguistique, mais a obtenu les notes les plus élevées en termes de pertinence éducative et de qualité de l’information. En revanche, Wenxin Yiyan a généré le texte le plus lisible, mais a généralement obtenu des scores inférieurs sur le PEMAT et le GQS. La catégorie de contenu a influencé la lisibilité, les sujets liés à la prévention/la réadaptation et à l’étiologie/aux facteurs de risque étant plus difficiles à lire, tandis que les scores PEMAT et GQS sont restés relativement stables selon les thèmes. Les indices de lisibilité ont montré une forte cohérence interne ainsi que des corrélations faibles à modérées positives avec le PEMAT et le GQS, tandis que le PEMAT et le GQS présentaient une corrélation positive modérée. Ces résultats suggèrent que le choix du modèle influence la pertinence éducative et la qualité globale de l’information tels qu’évalués par des experts, tandis que la complexité du sujet affecte principalement la lisibilité. Étant donné que la compréhension du patient, sa satisfaction, sa confiance, les résultats sanitaires, l’exactitude factuelle et la sécurité clinique n’ont pas été évaluées, ces résultats doivent être interprétés comme une analyse comparative fondée sur l’évaluation d’experts, et non comme une preuve de préparation clinique.