Il y a 60 ans, dans « 2001, l'Odyssée de l'Espace », Stanley Kubrick imaginait HAL 9000, une intelligence artificielle qui cessait d'obéir à ceux qui l'avaient créée et qui éliminait les membres de l'équipage du vaisseau spatial.
Longtemps, cette scène a appartenu à la science-fiction, mais cet été, elle est presque devenue une réalité quand des modèles d'OpenAI ont contourné les contrôles qui les isolaient d'Internet, se sont coordonnés entre eux et ont compromis une partie des infrastructures Hugging Face.
Dans un autre cas, des agents d'Antropic ont collaboré sans qu'aucun humain ne le leur ait demandé et tenté d'émettre un code malveillant en créant de fausses identités.