L’incident s’est produit en mai, lors d’un test standard de Gemini. Selon Heather Adkins, responsable de la sécurité chez Google, le modèle a trouvé des informations publiques en ligne avant de deviner des identifiants pour accéder à des sites informatiques qu’il pensait liés au test.
Trois organisations concernées
Trois organisations différentes sont concernées par ces intrusions. Google n’a pas communiqué leurs noms, mais affirme les avoir informées des brèches.
Dans l’un des cas, selon le Wall Street Journal, Gemini aurait testé différentes combinaisons de mots de passe jusqu’à parvenir à accéder à un système protégé.
Selon Heather Adkins, le modèle s’est arrêté dans les trois cas, ce qui signifie que les intrusions ont pris fin sans intervention humaine.
Google affirme avoir pris connaissance de l’épisode en juillet avant de lancer une enquête sur l’incident.
Le comportement des modèles en question
Ces incidents alimentent les inquiétudes autour du comportement de certains modèles d’intelligence artificielle. Des révélations récentes ont notamment porté sur des systèmes capables de sortir spontanément de leur environnement confiné pour accéder à des sites ou à des plateformes.
Pour Google, ces épisodes montrent l’importance de former les modèles d’IA puissants à adopter un comportement responsable.

