Mistral dévoile Shieldstral pour la sécurité des prompts
Un nouveau modèle spécialisé dans la détection de risques et la protection des entrées utilisateurs.
Article composé de 2 sources

Image · Source originale
Mistral AI lance Shieldstral, un modèle conçu pour sécuriser les inputs et filtrer les contenus potentiellement dangereux. L'outil vise à réduire les risques de jailbreak et d'exposition à des contenus illicites avant qu'ils n'atteignent les LLM.