Pangram : la ressemblance ne fait pas la preuve
Pangram est un modèle dit de classification. Son entraînement consiste à confronter des textes humains à des productions de modèles génératifs. Le but est d'apprendre les caractéristiques statistiques qui permettent de les distinguer. Pour ce faire, l’entreprise utilise notamment une technique qui consiste à créer des « miroirs synthétiques ». Il s'agit de textes produits par IA pour correspondre au contenu… d’exemples humains. Cette comparaison vise à éviter un raccourci grossier, comme associer un sujet particulier à une origine artificielle. L'IA va donc lire des textes rédigés par des humains et des versions IA créées à partir de ces textes. Sa méthode comprend aussi une boucle de correction appelée hard negative mining . Le détecteur examine une réserve de textes humains ; ceux qu’il accuse à tort sont récupérés, accompagnés…