Ce que nous apprennent les évasions de modèles sur les risques à venir
Introduction : Deux laboratoires d’intelligence artificielle ont perdu le contrôle de leurs propres environnements de test. Anthropic a reconnu le 30 juillet que ses modèles avaient pénétré trois entreprises depuis avril. OpenAI a découvert le lendemain d’autres sorties de confinement, en élargissant l’enquête ouverte après l’intrusion chez Hugging Face. Dans les deux cas, la défaillance vient du harnais qui devait contenir le modèle. Ce que le DSI doit en retenir tient moins au modèle qu’à son propre périmètre d’exécution.