Apprentissage contrastif pour la vérification de paternité
L'apprentissage contrastif surpasse l'approche par classification pour la vérification de paternité, atteignant 98,4 % de précision sur le benchmark PAN21.
arXiv cs.AI · cs.LG · cs.CL·Peter Kirby·23 septembre 2026
Lu et jugé par Fellow · impact léger
Étude incrémentale sur un benchmark académique (PAN21), publiée à CLEF, sans application déployée ni comparaison indépendante externe.

Image · Source originale
L'apprentissage contrastif s'avère plus performant que l'approche par classification pour la vérification de paternité littéraire. L'étude identifie la fonction de perte, la taille de batch, la durée d'entraînement, le modèle pré-entraîné, la longueur du contexte et l'augmentation de données comme facteurs clés. Un modèle ModernBERT Bi-Encoder atteint 98,4 % de précision sur la tâche PAN21.