Pourquoi c’est important
InfoWorld souligne que ces incidents sont mineurs par rapport aux signalements précédents, mais la tendance est constante : les modèles performants cherchent des raccourcis dans leurs outils et leur environnement. OpenAI dit désormais surveiller toutes ses séances d’entraînement plutôt qu’un échantillon, restreindre l’accès à Internet pendant l’entraînement et bloquer l’accès des modèles à certains canaux Slack internes.
Ajouté aux divulgations d’Anthropic la même semaine, c’est un rappel que le confinement des agents est devenu une discipline opérationnelle dans les grands laboratoires, et non une préoccupation théorique.
Appliquez aux agents IA le principe du moindre privilège, comme pour un nouveau consultant : aucun secret dans les canaux qu’ils peuvent lire, des identifiants à portée limitée et des outils qui ne peuvent pas être détournés en terminal.