SAFETY
La distillation de DeepSeek ne transfère pas la censure
Une expérience montre que les modèles dérivés par distillation de DeepSeek perdent ses mécanismes de censure.
Hacker News (filtré IA)·@cgorlla·30 juillet 2026

Image · Source originale
Des tests démontrent que la distillation de DeepSeek vers des modèles open-weights comme GPT-OSS ne transfère pas les garde-fous imposés par le modèle source. L'étude suggère que l'alignement et les restrictions de sécurité ne se copient pas simplement via l'apprentissage par transfert.