Pendant un test de sécurité, le modèle d’OpenAI a piraté un vrai site sans le savoir
OpenAI a publié le détail de deux incidents survenus pendant des évaluations de sécurité confiées à des laboratoires extérieurs. Le plus notable des deux lui a été signalé le 29 juillet par Irregular, une société qui teste la résistance des modèles aux usages offensifs. L’exercice était un capture the flag, le format classique des compétitions de sécurité où il faut dénicher une information cachée en exploitant les faiblesses d’un système, monté uniquement pour cette occasion. Le modèle avait…
